跳转到主要内容
返回集成
Cloud

Groq

Groq 是一家云推理提供商,在自研的 LPU(语言处理单元)硬件上运行常见的开源模型(Llama、Mixtral、Gemma、Whisper 等)。其推理速度往往比 GPU 提供商快 10 到 100 倍,非常适合对延迟敏感的应用。

功能与能力

极致推理速度
LPU 硬件
支持 Llama 3 / Mixtral / Gemma
低延迟
兼容 OpenAI 的 API
音频转写(Whisper)

🎯 最适合低延迟代理、实时聊天机器人,以及响应速度至关重要的应用。

优势

  • 现有最快的推理
  • 提供免费额度
  • 兼容 OpenAI
  • 多种模型可选
  • 非常适合实时聊天

不足

  • 没有自研模型
  • 上下文窗口有限
  • 免费额度有限制
  • 依赖 Groq 的可用性

💰 定价

免费额度慷慨。付费方案视模型约从每百万 token 0.05 美元起。详见 groq.com。

试用我们的智能体

浏览智能体