Saltar al contenido principal
Volver a integraciones
Cloud

Groq

Groq es un proveedor de inferencia en la nube que ejecuta modelos de código abierto muy usados (Llama, Mixtral, Gemma, Whisper y otros) sobre su propio hardware LPU (Language Processing Unit). El resultado son velocidades de inferencia a menudo entre 10 y 100 veces superiores a las de los proveedores basados en GPU, lo que lo hace ideal para aplicaciones sensibles a la latencia.

Funciones y capacidades

Velocidad de inferencia extrema
Hardware LPU
Compatible con Llama 3 / Mixtral / Gemma
Baja latencia
API compatible con OpenAI
Transcripción de audio (Whisper)

🎯 Ideal para agentes de baja latencia, chatbots en tiempo real y aplicaciones donde la velocidad de respuesta es decisiva.

Ventajas

  • La inferencia más rápida disponible
  • Nivel gratuito
  • Compatible con OpenAI
  • Varios modelos
  • Muy bueno para chat en tiempo real

Desventajas

  • Sin modelos propietarios
  • Ventana de contexto limitada
  • Límites de uso en el nivel gratuito
  • Depende de la disponibilidad de Groq

💰 Precios

Nivel gratuito generoso. Planes de pago desde unos 0,05 $ por millón de tokens según el modelo. Consulte groq.com.

Probar nuestros agentes

Explorar agentes