Към основното съдържание
AILoft
Обратно към интеграциите
Cloud

Groq

Groq е облачен доставчик на извод, който пуска популярни отворени модели (Llama, Mixtral, Gemma, Whisper и други) върху собствен хардуер LPU (модул за обработка на език). Скоростта на извода често е 10-100 пъти по-висока, отколкото при доставчиците, използващи GPU, което подхожда на приложения, чувствителни към забавяне.

Функции и възможности

Крайна скорост на извод
Хардуер LPU
Поддръжка на Llama 3 / Mixtral / Gemma
Ниско забавяне
Съвместим с OpenAI API
Транскрипция на звук (Whisper)

🎯 Най-подходящ за агенти с ниско забавяне, чатботове в реално време и приложения, при които скоростта на отговора е решаваща.

Предимства

  • Най-бързият наличен извод
  • Има безплатно ниво
  • Съвместим с OpenAI
  • Няколко модела
  • Отличен за разговор в реално време

Недостатъци

  • Няма собствени модели
  • Ограничен контекстен прозорец
  • Ограничения в безплатното ниво
  • Зависи от достъпността на Groq

💰 Цени

Щедро безплатно ниво. Платените планове започват от около 0,05 $ на милион токена в зависимост от модела. Вижте groq.com.

Опитайте нашите агенти

Разгледайте агентите