Volver a integraciones
⚡
Cloud
Groq
Groq es un proveedor de inferencia en la nube que ejecuta modelos de código abierto muy usados (Llama, Mixtral, Gemma, Whisper y otros) sobre su propio hardware LPU (Language Processing Unit). El resultado son velocidades de inferencia a menudo entre 10 y 100 veces superiores a las de los proveedores basados en GPU, lo que lo hace ideal para aplicaciones sensibles a la latencia.
Probar nuestros agentes → groq.com
Funciones y capacidades
Velocidad de inferencia extrema
Hardware LPU
Compatible con Llama 3 / Mixtral / Gemma
Baja latencia
API compatible con OpenAI
Transcripción de audio (Whisper)
🎯 Ideal para agentes de baja latencia, chatbots en tiempo real y aplicaciones donde la velocidad de respuesta es decisiva.
✓ Ventajas
- La inferencia más rápida disponible
- Nivel gratuito
- Compatible con OpenAI
- Varios modelos
- Muy bueno para chat en tiempo real
✗ Desventajas
- –Sin modelos propietarios
- –Ventana de contexto limitada
- –Límites de uso en el nivel gratuito
- –Depende de la disponibilidad de Groq
💰 Precios
Nivel gratuito generoso. Planes de pago desde unos 0,05 $ por millón de tokens según el modelo. Consulte groq.com.