返回集成
⚡
Cloud
Groq
Groq 是一家云推理提供商,在自研的 LPU(语言处理单元)硬件上运行常见的开源模型(Llama、Mixtral、Gemma、Whisper 等)。其推理速度往往比 GPU 提供商快 10 到 100 倍,非常适合对延迟敏感的应用。
试用我们的智能体 → groq.com
功能与能力
极致推理速度
LPU 硬件
支持 Llama 3 / Mixtral / Gemma
低延迟
兼容 OpenAI 的 API
音频转写(Whisper)
🎯 最适合低延迟代理、实时聊天机器人,以及响应速度至关重要的应用。
✓ 优势
- 现有最快的推理
- 提供免费额度
- 兼容 OpenAI
- 多种模型可选
- 非常适合实时聊天
✗ 不足
- –没有自研模型
- –上下文窗口有限
- –免费额度有限制
- –依赖 Groq 的可用性
💰 定价
免费额度慷慨。付费方案视模型约从每百万 token 0.05 美元起。详见 groq.com。