Modèles d’IA
Aperçu des modèles d’IA et environnements locaux pour les agents IA.
Modèles d’IA(398)
Aperçu actuel des modèles d’IA — prix, contexte et spécialisation.
Anthropic: Claude Fable 5.1
Anthropic
Anthropic: Claude Fable 5.1 (batch)
Anthropic
Google: Gemini 3.8 Flash
Google: Gemini 3.8 Flash (batch)
Meta: Muse Spark 1.3
Meta
Meta: Muse Spark 1.3 Contributor
Meta
OpenAI: GPT-6 Astra
OpenAI
OpenAI: GPT-6 Astra (batch)
OpenAI
OpenAI: GPT-6 Astra Pro
OpenAI
OpenAI: GPT-6 Astra Pro (batch)
OpenAI
DeepSeek V4 Flash Latest
deepseek
DeepSeek: DeepSeek V4 Flash Vision Exp
DeepSeek
DeepSeek: DeepSeek V4 Pro 0813 (batch)
DeepSeek
Google: Gemini 3.7 Flash
Google: Gemini 3.7 Flash (batch)
Meta: Muse Glimmer 30B
Meta
Meta: Muse Glimmer 30B (batch)
Meta
Meta: Muse Spark 1.2
Meta
Meta: Muse Spark 1.2 Contributor
Meta
NVIDIA: Nemotron 3.5 Lightning
NVIDIA
Qwen: Qwen3.8 2.4T A95B
Qwen
Qwen: Qwen3.8 2.4T A95B (batch)
Qwen
Qwen: Qwen3.8 27B
Qwen
Qwen: Qwen3.8 Flash
Qwen
Qwen: Qwen3.8 Max
Qwen
Z.ai: GLM 5.3
Z.ai
Z.ai: GLM 5.3 Flash
Z.ai
Z.ai: GLM 5.3 Flash (batch)
Z.ai
Z.ai: GLM Flash Latest
Z.ai
Z.ai: GLM Latest
Z.ai
Données mises à jour : 07/09/2026 · Prix indicatifs, par million de tokens d'entrée, d'après les tarifs publics. Le tarif officiel du fournisseur fait foi.
Runtimes IA locaux
Installez d’abord un runtime, puis téléchargez des modèles pour exécuter localement les agents AILoft.
Ollama
Run LLMs locally. Supports Llama, Gemma, Phi, Mistral and more.
LM Studio
Desktop app for running local LLMs with GUI. GGUF model support.
Jan.ai
Open-source ChatGPT alternative that runs offline on your computer.
GPT4All
Free, local, privacy-aware chatbot. No GPU required.
AnythingLLM
All-in-one AI app with RAG, agents, and multi-model support.
text-generation-webui
Gradio web UI for running large language models locally.
Besoin de puissance GPU pour exécuter des modèles en local ou héberger votre inférence ?
Serveurs GPU →