Zum Hauptinhalt springen

KI-Modelle

Übersicht der KI-Modelle und lokale Laufzeitumgebungen für KI-Agenten.

KI-Modelle(398)

Aktuelle Übersicht der KI-Modelle — Preis, Kontext und Schwerpunkt.

Anthropic: Claude Fable 5.1

Anthropic

$10/M1.0M ctx9/2026
MultimodalSchlussfolgernAgenten

Anthropic: Claude Fable 5.1 (batch)

Anthropic

$5/M1.0M ctx9/2026
MultimodalSchlussfolgernAgenten

Google: Gemini 3.8 Flash

Google

$0.75/M1.0M ctx9/2026
MultimodalAudioSchlussfolgernAgenten

Google: Gemini 3.8 Flash (batch)

Google

$0.375/M1.0M ctx9/2026
MultimodalAudioSchlussfolgernAgenten

Meta: Muse Spark 1.3

Meta

$1.25/M1.0M ctx9/2026
MultimodalAudioSchlussfolgernAgenten

Meta: Muse Spark 1.3 Contributor

Meta

$0.1/M1.0M ctx9/2026
MultimodalAudioSchlussfolgernAgenten

OpenAI: GPT-6 Astra

OpenAI

$10/M1.1M ctx9/2026
MultimodalSchlussfolgernAgenten

OpenAI: GPT-6 Astra (batch)

OpenAI

$5/M1.1M ctx9/2026
MultimodalSchlussfolgernAgenten

OpenAI: GPT-6 Astra Pro

OpenAI

$10/M1.1M ctx9/2026
MultimodalSchlussfolgernAgenten

OpenAI: GPT-6 Astra Pro (batch)

OpenAI

$5/M1.1M ctx9/2026
MultimodalSchlussfolgernAgenten

DeepSeek V4 Flash Latest

deepseek

$0.05/M1.3M ctx8/2026
SchlussfolgernAgenten

DeepSeek: DeepSeek V4 Flash Vision Exp

DeepSeek

$0.44/M1.0M ctx8/2026
MultimodalSchlussfolgernAgenten

DeepSeek: DeepSeek V4 Pro 0813 (batch)

DeepSeek

$1.32/M1.0M ctx8/2026
SchlussfolgernAgenten

Google: Gemini 3.7 Flash

Google

$0.75/M1.0M ctx8/2026
MultimodalAudioSchlussfolgernAgenten

Google: Gemini 3.7 Flash (batch)

Google

$0.375/M1.0M ctx8/2026
MultimodalAudioSchlussfolgernAgenten

Meta: Muse Glimmer 30B

Meta

$0.35/M131k ctx8/2026
MultimodalSchlussfolgernAgenten

Meta: Muse Glimmer 30B (batch)

Meta

$0.35/M131k ctx8/2026
MultimodalSchlussfolgernAgenten

Meta: Muse Spark 1.2

Meta

$1.25/M1.0M ctx8/2026
MultimodalAudioSchlussfolgernAgenten

Meta: Muse Spark 1.2 Contributor

Meta

$0.1/M1.0M ctx8/2026
MultimodalAudioSchlussfolgernAgenten

NVIDIA: Nemotron 3.5 Lightning

NVIDIA

$0.08/M262k ctx8/2026
SchlussfolgernAgenten

Qwen: Qwen3.8 2.4T A95B

Qwen

$2/M1.0M ctx8/2026
SchlussfolgernAgenten

Qwen: Qwen3.8 2.4T A95B (batch)

Qwen

$2/M1.0M ctx8/2026
SchlussfolgernAgenten

Qwen: Qwen3.8 27B

Qwen

$0.42/M1.0M ctx8/2026
MultimodalSchlussfolgernAgenten

Qwen: Qwen3.8 Flash

Qwen

$0.15/M1.0M ctx8/2026
MultimodalSchlussfolgernAgenten

Qwen: Qwen3.8 Max

Qwen

$2/M992k ctx8/2026
MultimodalSchlussfolgernAgenten

Z.ai: GLM 5.3

Z.ai

$1.4/M1.0M ctx8/2026
SchlussfolgernAgenten

Z.ai: GLM 5.3 Flash

Z.ai

$0.15/M1.0M ctx8/2026
MultimodalSchlussfolgernAgenten

Z.ai: GLM 5.3 Flash (batch)

Z.ai

$0.15/M1.0M ctx8/2026
MultimodalSchlussfolgernAgenten

Z.ai: GLM Flash Latest

Z.ai

$0.075/M1.3M ctx8/2026
MultimodalSchlussfolgernAgenten

Z.ai: GLM Latest

Z.ai

$1.17/M1.3M ctx8/2026
SchlussfolgernAgenten
1 / 14

Daten aktualisiert: 7.9.2026 · Preise sind Richtwerte pro 1M Eingabe-Tokens laut öffentlichen Preislisten. Maßgeblich ist die offizielle Preisliste des Anbieters.

Lokale AI-Laufzeiten

Installieren Sie zuerst eine Laufzeit, dann laden Sie Modelle herunter, um AILoft-Agenten lokal auszuführen.

Sie suchen GPU-Leistung, um Modelle lokal auszuführen oder Inferenz selbst zu hosten?

GPU-Server