ข้ามไปยังเนื้อหาหลัก
กลับไปที่การเชื่อมต่อ
Cloud

Groq

Groq เป็นผู้ให้บริการการอนุมานบนคลาวด์ที่รันโมเดลเปิดยอดนิยม (Llama, Mixtral, Gemma, Whisper และอื่น ๆ) บนฮาร์ดแวร์ LPU (หน่วยประมวลผลภาษา) ที่พัฒนาเอง ความเร็วในการอนุมานมักสูงกว่าผู้ให้บริการที่ใช้ GPU ถึง 10-100 เท่า จึงเหมาะกับแอปพลิเคชันที่อ่อนไหวต่อความหน่วง

คุณสมบัติและความสามารถ

ความเร็วการอนุมานสูงสุด
ฮาร์ดแวร์ LPU
รองรับ Llama 3 / Mixtral / Gemma
ความหน่วงต่ำ
API ที่เข้ากันได้กับ OpenAI
การถอดเสียง (Whisper)

🎯 เหมาะที่สุดสำหรับเอเจนต์ที่ต้องการความหน่วงต่ำ แชตบอตแบบเรียลไทม์ และแอปพลิเคชันที่ความเร็วในการตอบเป็นตัวชี้ขาด

ข้อดี

  • การอนุมานที่เร็วที่สุดเท่าที่มี
  • มีระดับใช้งานฟรี
  • เข้ากันได้กับ OpenAI
  • มีหลายโมเดล
  • ยอดเยี่ยมสำหรับแชตแบบเรียลไทม์

ข้อเสีย

  • ไม่มีโมเดลของตัวเอง
  • หน้าต่างบริบทจำกัด
  • ระดับใช้งานฟรีมีขีดจำกัด
  • ขึ้นอยู่กับความพร้อมใช้งานของ Groq

💰 ราคา

ระดับใช้งานฟรีที่ใจกว้าง แผนแบบเสียเงินเริ่มต้นราว 0.05 ดอลลาร์ต่อหนึ่งล้านโทเคน ขึ้นกับโมเดล ดูที่ groq.com

Agent ที่เข้ากันได้

ลองใช้ Agent ของเรา

ดู Agent ทั้งหมด