メインコンテンツへスキップ
インテグレーションに戻る
Cloud

Groq

Groq は、一般的なオープンモデル(Llama、Mixtral、Gemma、Whisper など)を自社の LPU(言語処理ユニット)ハードウェア上で動かすクラウド推論プロバイダーです。推論速度は GPU 系プロバイダーの 10〜100 倍に達することも多く、レイテンシーに敏感なアプリケーションに向いています。

機能と性能

極限の推論速度
LPU ハードウェア
Llama 3 / Mixtral / Gemma に対応
低レイテンシー
OpenAI 互換 API
音声の文字起こし(Whisper)

🎯 低レイテンシーのエージェント、リアルタイムチャットボット、応答速度が決め手となるアプリに最適です。

メリット

  • 現時点で最速の推論
  • 無料枠あり
  • OpenAI 互換
  • 複数のモデル
  • リアルタイムチャットに最適

デメリット

  • 独自モデルはなし
  • コンテキストウィンドウが限られる
  • 無料枠には上限あり
  • Groq の可用性に依存

💰 料金

手厚い無料枠。有料プランはモデルにより 100 万トークンあたり約 0.05 ドルから。詳細は groq.com。

エージェントを試す

エージェントを見る