Takaisin integraatioihin
⚡
Cloud
Groq
Groq on pilvipohjainen päättelypalvelu, joka ajaa yleisiä avoimia malleja (Llama, Mixtral, Gemma, Whisper ja muita) omalla LPU-laitteistollaan (Language Processing Unit). Tuloksena päättelynopeudet ovat usein 10-100 kertaa suuremmat kuin GPU-pohjaisilla palveluilla, mikä sopii viiveelle herkkiin sovelluksiin.
Kokeile agenttejamme → groq.com
Ominaisuudet ja kyvyt
Äärimmäinen päättelynopeus
LPU-laitteisto
Tuki Llama 3:lle / Mixtralille / Gemmalle
Matala viive
OpenAI-yhteensopiva API
Äänen litterointi (Whisper)
🎯 Parhaimmillaan matalan viiveen agenteissa, reaaliaikaisissa chatboteissa ja sovelluksissa, joissa vastausnopeus ratkaisee.
✓ Edut
- Nopein saatavilla oleva päättely
- Maksuton taso
- OpenAI-yhteensopiva
- Useita malleja
- Erinomainen reaaliaikaiseen keskusteluun
✗ Haitat
- –Ei omia malleja
- –Rajallinen kontekstin koko
- –Käyttörajat maksuttomalla tasolla
- –Riippuu Groqin saatavuudesta
💰 Hinnoittelu
Antelias maksuton taso. Maksulliset paketit alkaen noin 0,05 $ miljoonalta tokenilta mallista riippuen. Katso groq.com.