KI-Modelle
Übersicht der KI-Modelle und lokale Laufzeitumgebungen für KI-Agenten.
KI-Modelle(398)
Aktuelle Übersicht der KI-Modelle — Preis, Kontext und Schwerpunkt.
Anthropic: Claude Fable 5.1
Anthropic
Anthropic: Claude Fable 5.1 (batch)
Anthropic
Google: Gemini 3.8 Flash
Google: Gemini 3.8 Flash (batch)
Meta: Muse Spark 1.3
Meta
Meta: Muse Spark 1.3 Contributor
Meta
OpenAI: GPT-6 Astra
OpenAI
OpenAI: GPT-6 Astra (batch)
OpenAI
OpenAI: GPT-6 Astra Pro
OpenAI
OpenAI: GPT-6 Astra Pro (batch)
OpenAI
DeepSeek V4 Flash Latest
deepseek
DeepSeek: DeepSeek V4 Flash Vision Exp
DeepSeek
DeepSeek: DeepSeek V4 Pro 0813 (batch)
DeepSeek
Google: Gemini 3.7 Flash
Google: Gemini 3.7 Flash (batch)
Meta: Muse Glimmer 30B
Meta
Meta: Muse Glimmer 30B (batch)
Meta
Meta: Muse Spark 1.2
Meta
Meta: Muse Spark 1.2 Contributor
Meta
NVIDIA: Nemotron 3.5 Lightning
NVIDIA
Qwen: Qwen3.8 2.4T A95B
Qwen
Qwen: Qwen3.8 2.4T A95B (batch)
Qwen
Qwen: Qwen3.8 27B
Qwen
Qwen: Qwen3.8 Flash
Qwen
Qwen: Qwen3.8 Max
Qwen
Z.ai: GLM 5.3
Z.ai
Z.ai: GLM 5.3 Flash
Z.ai
Z.ai: GLM 5.3 Flash (batch)
Z.ai
Z.ai: GLM Flash Latest
Z.ai
Z.ai: GLM Latest
Z.ai
Daten aktualisiert: 7.9.2026 · Preise sind Richtwerte pro 1M Eingabe-Tokens laut öffentlichen Preislisten. Maßgeblich ist die offizielle Preisliste des Anbieters.
Lokale AI-Laufzeiten
Installieren Sie zuerst eine Laufzeit, dann laden Sie Modelle herunter, um AILoft-Agenten lokal auszuführen.
Ollama
Run LLMs locally. Supports Llama, Gemma, Phi, Mistral and more.
LM Studio
Desktop app for running local LLMs with GUI. GGUF model support.
Jan.ai
Open-source ChatGPT alternative that runs offline on your computer.
GPT4All
Free, local, privacy-aware chatbot. No GPU required.
AnythingLLM
All-in-one AI app with RAG, agents, and multi-model support.
text-generation-webui
Gradio web UI for running large language models locally.
Sie suchen GPU-Leistung, um Modelle lokal auszuführen oder Inferenz selbst zu hosten?
GPU-Server →