Zum Hauptinhalt springen
Zurück zu Integrationen
Cloud

Groq

Groq ist ein Cloud-Inferenzanbieter, der verbreitete Open-Source-Modelle (Llama, Mixtral, Gemma, Whisper und weitere) auf eigener LPU-Hardware (Language Processing Unit) ausführt. Das Ergebnis sind Inferenzgeschwindigkeiten, die oft 10- bis 100-mal höher liegen als bei GPU-basierten Anbietern — ideal für latenzkritische Anwendungen.

Funktionen & Fähigkeiten

Extreme Inferenzgeschwindigkeit
LPU-Hardware
Unterstützung für Llama 3 / Mixtral / Gemma
Geringe Latenz
OpenAI-kompatible API
Audiotranskription (Whisper)

🎯 Am besten für latenzarme Agenten, Chatbots in Echtzeit und Anwendungen, bei denen die Antwortgeschwindigkeit entscheidend ist.

Vorteile

  • Schnellste verfügbare Inferenz
  • Kostenloses Kontingent
  • OpenAI-kompatibel
  • Mehrere Modelle
  • Gut für Chat in Echtzeit

Nachteile

  • Keine proprietären Modelle
  • Begrenztes Kontextfenster
  • Ratenbegrenzung im kostenlosen Kontingent
  • Abhängig von der Groq-Verfügbarkeit

💰 Preise

Großzügiges kostenloses Kontingent. Bezahlte Tarife ab etwa 0,05 $ pro 1 Mio. Tokens, je nach Modell. Siehe groq.com.

Unsere Agenten testen

Agenten durchsuchen