Ugrás a fő tartalomra
Vissza az integrációkhoz
Cloud

Groq

A Groq felhőalapú következtetési szolgáltató, amely a népszerű nyílt modelleket (Llama, Mixtral, Gemma, Whisper és mások) saját fejlesztésű LPU (nyelvi feldolgozóegység) hardverén futtatja. A következtetés sebessége gyakran 10-100-szorosa a GPU-alapú szolgáltatókénak, ami illik a késleltetésre érzékeny alkalmazásokhoz.

Funkciók és képességek

Végletes következtetési sebesség
LPU-hardver
Llama 3 / Mixtral / Gemma támogatás
Alacsony késleltetés
OpenAI-kompatibilis API
Hangátirat (Whisper)

🎯 Leginkább alacsony késleltetésű ügynökökhöz, valós idejű csevegőrobotokhoz és olyan alkalmazásokhoz való, ahol a válasz sebessége dönt.

Előnyök

  • A leggyorsabb elérhető következtetés
  • Van ingyenes csomag
  • OpenAI-kompatibilis
  • Több modell
  • Kiváló valós idejű csevegéshez

Hátrányok

  • Nincsenek saját modelljei
  • Korlátozott kontextusablak
  • Korlátok az ingyenes csomagban
  • Függ a Groq elérhetőségétől

💰 Árazás

Nagyvonalú ingyenes csomag. A fizetős csomagok modelltől függően nagyjából 0,05 $-tól indulnak millió tokenenként. Lásd: groq.com.

Próbálja ki ügynökeinket

Ügynökök böngészése