インテグレーションに戻る
⚡
Cloud
Groq
Groq は、一般的なオープンモデル(Llama、Mixtral、Gemma、Whisper など)を自社の LPU(言語処理ユニット)ハードウェア上で動かすクラウド推論プロバイダーです。推論速度は GPU 系プロバイダーの 10〜100 倍に達することも多く、レイテンシーに敏感なアプリケーションに向いています。
エージェントを試す → groq.com
機能と性能
極限の推論速度
LPU ハードウェア
Llama 3 / Mixtral / Gemma に対応
低レイテンシー
OpenAI 互換 API
音声の文字起こし(Whisper)
🎯 低レイテンシーのエージェント、リアルタイムチャットボット、応答速度が決め手となるアプリに最適です。
✓ メリット
- 現時点で最速の推論
- 無料枠あり
- OpenAI 互換
- 複数のモデル
- リアルタイムチャットに最適
✗ デメリット
- –独自モデルはなし
- –コンテキストウィンドウが限られる
- –無料枠には上限あり
- –Groq の可用性に依存
💰 料金
手厚い無料枠。有料プランはモデルにより 100 万トークンあたり約 0.05 ドルから。詳細は groq.com。