Ir para o conteúdo principal
Voltar às integrações
Cloud

Groq

A Groq é um fornecedor de inferência na nuvem que executa modelos de código aberto muito usados (Llama, Mixtral, Gemma, Whisper e outros) no seu próprio hardware LPU (Language Processing Unit). O resultado são velocidades de inferência muitas vezes 10 a 100 vezes superiores às dos fornecedores baseados em GPU, o que a torna ideal para aplicações sensíveis à latência.

Funcionalidades e capacidades

Velocidade de inferência extrema
Hardware LPU
Suporte a Llama 3 / Mixtral / Gemma
Baixa latência
API compatível com OpenAI
Transcrição de áudio (Whisper)

🎯 Ideal para agentes de baixa latência, chatbots em tempo real e aplicações em que a rapidez da resposta é decisiva.

Vantagens

  • A inferência mais rápida disponível
  • Nível gratuito
  • Compatível com OpenAI
  • Vários modelos
  • Ótimo para conversa em tempo real

Desvantagens

  • Sem modelos proprietários
  • Janela de contexto limitada
  • Limites de utilização no nível gratuito
  • Depende da disponibilidade da Groq

💰 Preços

Nível gratuito generoso. Planos pagos a partir de cerca de 0,05 $ por milhão de tokens, consoante o modelo. Ver groq.com.

Experimente os nossos agentes

Explorar agentes