Siirry pääsisältöön
Takaisin integraatioihin
Cloud

Groq

Groq on pilvipohjainen päättelypalvelu, joka ajaa yleisiä avoimia malleja (Llama, Mixtral, Gemma, Whisper ja muita) omalla LPU-laitteistollaan (Language Processing Unit). Tuloksena päättelynopeudet ovat usein 10-100 kertaa suuremmat kuin GPU-pohjaisilla palveluilla, mikä sopii viiveelle herkkiin sovelluksiin.

Ominaisuudet ja kyvyt

Äärimmäinen päättelynopeus
LPU-laitteisto
Tuki Llama 3:lle / Mixtralille / Gemmalle
Matala viive
OpenAI-yhteensopiva API
Äänen litterointi (Whisper)

🎯 Parhaimmillaan matalan viiveen agenteissa, reaaliaikaisissa chatboteissa ja sovelluksissa, joissa vastausnopeus ratkaisee.

Edut

  • Nopein saatavilla oleva päättely
  • Maksuton taso
  • OpenAI-yhteensopiva
  • Useita malleja
  • Erinomainen reaaliaikaiseen keskusteluun

Haitat

  • Ei omia malleja
  • Rajallinen kontekstin koko
  • Käyttörajat maksuttomalla tasolla
  • Riippuu Groqin saatavuudesta

💰 Hinnoittelu

Antelias maksuton taso. Maksulliset paketit alkaen noin 0,05 $ miljoonalta tokenilta mallista riippuen. Katso groq.com.

Kokeile agenttejamme

Selaa agentteja