Classement des meilleurs LLM en 2026 : comparatif mis à jour quotidiennement
Benchmark et comparatif des meilleurs LLM, mis à jour automatiquement chaque jour. Données consolidées, couvrant précision, multimodalité, coût et performance. Faites défiler pour explorer les classements par catégorie.
Face à l’explosion des modèles d’IA, choisir le bon LLM devient un casse-tête : GPT-5, Claude 4.5 Sonnet, Gemini 2.5 Pro, Grok 4… Ce classement compare le top 100 des modèles sur des critères objectifs (qualité, vitesse, coût, capacités multimodales) grâce aux benchmarks indépendants d’Artificial Analysis. Les données sont synchronisées automatiquement chaque jour pour garantir un comparatif toujours à jour. Utilisez les filtres ci-dessous pour trouver le modèle adapté à votre usage et budget.
Classements des modèles IA
Top 100 des meilleurs LLM
| Modèle | Créateur | Quality Index | Speed (tok/s) | Prix ($/1M) |
|---|---|---|---|---|
| Claude Opus 5 (Adaptive Reasoning, Max Effort) | 63.1 | 55.9 | $10.00 Premium | |
| Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) | 62.5 | 54.9 | $10.00 Premium | |
| Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) | 62.1 | 68.4 | $20.00 Premium | |
| Claude Opus 5 (Adaptive Reasoning, High Effort) | 61.5 | 53.4 | $10.00 Premium | |
| GPT-5.6 Sol (max) | 60.9 | 74.9 | $11.25 Premium | |
| Grok 4.6 (high) | 60.9 | 62.2 | $3.00 Standard | |
| Kimi K3 (max) | 59.7 | 39.0 | $6.00 Standard | |
| GLM-5.3 (max) | 59.5 | 78.8 | $2.15 Standard | |
| GPT-5.6 Sol (xhigh) | 59.0 | 73.3 | $11.25 Premium | |
| Claude Opus 5 (Adaptive Reasoning, Medium Effort) | 58.6 | 52.9 | $10.00 Premium | |
| Qwen3.8 Max | 58.1 | 45.0 | $3.00 Standard | |
| Qwen3.8 2.4T A95B | 57.7 | 45.0 | $3.00 Standard | |
| GPT-5.6 Sol (high) | 57.3 | 64.5 | $11.25 Premium | |
| Claude Opus 4.8 (Adaptive Reasoning, Max Effort) | 57.3 | 0.0 | $10.00 Premium | |
| Muse Spark 1.2 (xhigh) | 56.8 | 0.0 | $2.00 Standard | |
| GPT-5.6 Terra (max) | 56.6 | 113.9 | $4.50 Standard | |
| GPT-5.5 (xhigh) | 56.3 | 0.0 | $11.25 Premium | |
| Gemini 3.7 Flash (high) | 56.0 | 357.8 | $1.50 Budget | |
| Grok 4.5 (high) | 55.8 | 56.8 | $3.00 Standard | |
| GPT-5.6 Sol (medium) | 55.6 | 62.6 | $11.25 Premium | |
| Claude Sonnet 5 (Adaptive Reasoning, Max Effort) | 55.3 | 86.6 | $4.00 Standard | |
| Claude Opus 4.7 (Adaptive Reasoning, Max Effort) | 55.0 | 0.0 | $10.00 Premium | |
| GPT-5.5 (high) | 54.7 | 0.0 | $11.25 Premium | |
| Gemini 3.7 Flash (medium) | 53.4 | 375.0 | $1.50 Budget | |
| DeepSeek V4 Pro 0813 (Reasoning, Max Effort) | 53.2 | 68.5 | $1.98 Budget | |
| Muse Spark 1.1 (xhigh) | 53.2 | 0.0 | $2.00 Standard | |
| GPT-5.4 (xhigh) | 53.1 | 0.0 | $5.63 Standard | |
| GPT-5.6 Terra (xhigh) | 52.8 | 100.0 | $4.50 Standard | |
| GLM-5.2 (max) | 52.6 | 86.5 | $2.15 Standard | |
| Claude Opus 5 (Adaptive Reasoning, Low Effort) | 52.5 | 51.5 | $10.00 Premium | |
| GPT-5.6 Luna (max) | 52.3 | 138.1 | $0.45 Budget | |
| Qwen3.8 27B | 52.0 | 0.0 | $1.09 Budget | |
| Gemini 3.5 Flash (high) | 52.0 | 0.0 | $3.38 Standard | |
| DeepSeek V4 Flash 0731 (Reasoning, Max Effort) | 51.8 | 121.9 | $0.66 Budget | |
| Gemini 3.6 Flash (high) | 51.6 | 201.4 | $1.50 Budget | |
| GPT-5.5 (medium) | 51.4 | 0.0 | $11.25 Premium | |
| Gemini 3.7 Flash (low) | 50.9 | 321.3 | $1.50 Budget | |
| GPT-5.6 Sol (low) | 50.7 | 68.9 | $11.25 Premium | |
| GPT-5.6 Luna (xhigh) | 50.1 | 137.7 | $0.45 Budget | |
| GPT-5.6 Terra (high) | 50.1 | 100.1 | $4.50 Standard | |
| Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort) | 48.4 | 0.0 | $6.00 Standard | |
| Kimi K3 (low) | 48.3 | 38.8 | $6.00 Standard | |
| Gemini 3.1 Pro Preview | 47.7 | 124.3 | $4.50 Standard | |
| Motif 3 | 47.4 | 0.0 | $0.00 Budget | |
| GPT-5.6 Luna (high) | 47.0 | 139.0 | $0.45 Budget | |
| GPT-5.6 Terra (medium) | 46.8 | 99.5 | $4.50 Standard | |
| Gemini 3.5 Flash (medium) | 46.7 | 256.0 | $3.38 Standard | |
| Qwen3.7 Max | 46.7 | 0.0 | $3.75 Standard | |
| GPT-5.3 Codex (xhigh) | 45.5 | 125.2 | $4.81 Standard | |
| MiniMax-M3 | 45.4 | 107.9 | $0.53 Budget | |
| DeepSeek V4 Pro (Reasoning, Max Effort) | 45.3 | 66.0 | $0.54 Budget | |
| Motif 3 (Beta) | 45.3 | 0.0 | $0.00 Budget | |
| Kimi K2.6 | 45.1 | 0.0 | $1.71 Budget | |
| Claude Opus 4.6 (Adaptive Reasoning, Max Effort) | 44.9 | 0.0 | $10.00 Premium | |
| GPT-5.5 (low) | 44.5 | 0.0 | $11.25 Premium | |
| Muse Spark | 44.3 | 0.0 | $0.00 Budget | |
| Claude Opus 4.7 (Non-reasoning, High Effort) | 43.9 | 0.0 | $10.00 Premium | |
| DeepSeek V4 Pro (Reasoning, High Effort) | 43.7 | 71.1 | $0.54 Budget | |
| GPT-5.2 (xhigh) | 43.3 | 0.0 | $4.81 Standard | |
| Kimi K2.7 Code | 43.0 | 38.2 | $1.71 Budget | |
| MiMo-V2.5-Pro | 42.9 | 58.1 | $0.54 Budget | |
| Claude Sonnet 5 (Non-reasoning, High Effort) | 42.6 | 62.6 | $4.00 Standard | |
| Inkling (xhigh) | 42.3 | 70.5 | $1.76 Budget | |
| Hy3 | 42.2 | 75.8 | $0.24 Budget | |
| DeepSeek V4 Flash (Reasoning, Max Effort) | 42.1 | 0.0 | $0.17 Budget | |
| GPT-5.6 Sol (Non-reasoning) | 41.9 | 68.7 | $11.25 Premium | |
| Claude Opus 4.5 (Reasoning) | 41.9 | 0.0 | $10.00 Premium | |
| Nex-N2-Pro | 41.7 | 135.3 | $1.00 Budget | |
| Solar Pro 4 | 41.6 | 39.3 | $0.53 Budget | |
| MiMo-V2-Pro | 41.4 | 0.0 | $0.00 Budget | |
| GPT-5.6 Terra (low) | 41.3 | 92.8 | $4.50 Standard | |
| Inkling Small | 41.2 | 68.9 | $0.53 Budget | |
| GPT-5.2 Codex (xhigh) | 41.2 | 0.0 | $4.81 Standard | |
| Qwen3.6 Max Preview | 41.1 | 0.0 | $2.93 Standard | |
| GLM-5.1 (Reasoning) | 41.0 | 28.2 | $2.14 Standard | |
| GPT-5.4 mini (xhigh) | 40.9 | 0.0 | $1.69 Budget | |
| Grok Build 0.1 0616 | 40.7 | 0.0 | $1.25 Budget | |
| Gemini 3 Pro Preview (high) | 40.6 | 0.0 | $4.50 Standard | |
| GLM-5 (Reasoning) | 40.6 | 0.0 | $1.55 Budget | |
| Qwen3.6 Plus | 40.5 | 0.0 | $1.13 Budget | |
| GPT-5.4 (low) | 40.2 | 0.0 | $5.63 Standard | |
| JT-4.1 Flash 236B A21B | 39.9 | 0.0 | $0.00 Budget | |
| Agnes 2.5 Pro Alpha | 39.7 | 131.2 | $0.56 Budget | |
| GPT-5.4 nano (xhigh) | 39.7 | 0.0 | $0.46 Budget | |
| Qwen3.7 Plus | 39.4 | 55.6 | $0.70 Budget | |
| GLM-5-Turbo | 39.1 | 0.0 | $0.00 Budget | |
| DeepSeek V4 Flash (Reasoning, High Effort) | 39.0 | 0.0 | $0.17 Budget | |
| GPT-5.6 Luna (medium) | 38.9 | 132.8 | $0.45 Budget | |
| GPT-5.2 (medium) | 38.9 | 0.0 | $4.81 Standard | |
| MiniMax-M2.7 | 38.9 | 0.0 | $0.53 Budget | |
| Claude Opus 4.6 (Non-reasoning, High Effort) | 38.8 | 0.0 | $10.00 Premium | |
| Gemini 3 Flash Preview (Reasoning) | 38.7 | 0.0 | $1.13 Budget | |
| Nemotron 3 Ultra 550B A55B (Reasoning) | 38.3 | 120.3 | $1.14 Budget | |
| MiMo-V2.5 | 38.0 | 51.7 | $0.18 Budget | |
| Grok 4.20 0309 v2 (Reasoning) | 38.0 | 0.0 | $1.56 Budget | |
| Grok 4.3 (high) | 37.9 | 0.0 | $1.56 Budget | |
| Ling 3.0 Flash | 37.8 | 428.6 | $0.11 Budget | |
| Qwen3.6 27B (Reasoning) | 37.7 | 59.4 | $1.35 Budget | |
| GPT-5.1 (high) | 37.5 | 0.0 | $3.44 Standard | |
| Gemini 3.5 Flash-Lite | 37.4 | 368.1 | $0.85 Budget |
Meilleurs modèles Text-to-Video
| Rang | Modèle | Créateur | ELO Rating |
|---|---|---|---|
| #1 | Gemini Omni Flash | 1,322 | |
| #2 | MiniMax H3 | 1,305 | |
| #3 | HappyHorse-1.0 | 1,284 | |
| #4 | Dreamina Seedance 2.0 720p | 1,265 | |
| #5 | HappyHorse-1.1 | 1,262 | |
| #6 | Wan2.7-260612 | 1,242 | |
| #7 | Kling 3.0 1080p (Pro) | 1,239 | |
| #8 | Kling 3.0 Omni 1080p (Pro) | 1,227 | |
| #9 | grok-imagine-video | 1,222 | |
| #10 | Bach-1.0 Preview | 1,215 | |
| #11 | Wan 2.7 | 1,215 | |
| #12 | Vidu Q3 Pro | 1,214 | |
| #13 | Runway Gen-4.5 | 1,214 | |
| #14 | Kling 3.0 Omni 720p (Standard) | 1,214 | |
| #15 | Veo 3 | 1,212 | |
| #16 | PixVerse V5.6 | 1,211 | |
| #17 | SkyReels V4 | 1,210 | |
| #18 | Kling 3.0 720p (Standard) | 1,210 | |
| #19 | PixVerse V6 | 1,209 | |
| #20 | Veo 3.1 Lite | 1,207 | |
| #21 | Veo 3.1 | 1,199 | |
| #22 | Veo 3.1 Fast | 1,198 | |
| #23 | Kling 2.5 Turbo 1080p | 1,198 | |
| #24 | Kling 2.6 Pro (January) | 1,196 | |
| #25 | Kling O1 Pro (January) | 1,195 | |
| #26 | PixVerse V5.5 | 1,194 | |
| #27 | Kling O1 Standard (January) | 1,186 | |
| #28 | Wan 2.6 | 1,185 | |
| #29 | Ray 3 | 1,184 | |
| #30 | Kling 2.6 Standard (January) | 1,182 | |
| #31 | Veo 3 Fast Preview | 1,173 | |
| #32 | Seedance 1.5 pro | 1,171 | |
| #33 | Hailuo 2.3 | 1,171 | |
| #34 | Hailuo 02 Standard | 1,169 | |
| #35 | PixVerse V5 | 1,168 | |
| #36 | Vidu Q2 | 1,164 | |
| #37 | Wan 2.5 Preview | 1,157 | |
| #38 | Hailuo 02 Pro | 1,148 | |
| #39 | Seedance 1.0 | 1,136 | |
| #40 | Kling 2.1 Master | 1,129 | |
| #41 | LTX-2 Pro | 1,121 | |
| #42 | LTX-2 Fast | 1,120 | |
| #43 | LTX-2.3 Fast | 1,120 | |
| #44 | Veo 2 | 1,111 | |
| #45 | Wan 2.2 A14B | 1,107 | |
| #46 | Vidu Q3 Turbo | 1,106 | |
| #47 | LTX-2.3 Pro | 1,105 | |
| #48 | Kling 2.0 | 1,082 | |
| #49 | Seedance 1.0 Mini | 1,079 | |
| #50 | Pika 2.5 | 1,076 |
Meilleurs modèles Image-to-Video
| Rang | Modèle | Créateur | ELO Rating |
|---|---|---|---|
| #1 | Gemini Omni Flash | 1,366 | |
| #2 | MiniMax H3 | 1,352 | |
| #3 | Dreamina Seedance 2.0 720p | 1,337 | |
| #4 | grok-imagine-video-1.5 | 1,328 | |
| #5 | PixVerse V6 | 1,326 | |
| #6 | grok-imagine-video | 1,326 | |
| #7 | HappyHorse-1.1 | 1,310 | |
| #8 | HappyHorse-1.0 | 1,289 | |
| #9 | Kling 2.5 Turbo 1080p | 1,287 | |
| #10 | SkyReels V4 | 1,285 | |
| #11 | Kling 3.0 1080p (Pro) | 1,284 | |
| #12 | Vidu Q3 Pro | 1,280 | |
| #13 | Kling 3.0 Omni 1080p (Pro) | 1,278 | |
| #14 | PixVerse V5.6 | 1,277 | |
| #15 | Wan 2.7 | 1,270 | |
| #16 | Kling 2.6 Standard (January) | 1,267 | |
| #17 | Kling 3.0 Omni 720p (Standard) | 1,264 | |
| #18 | Kling 3.0 720p (Standard) | 1,263 | |
| #19 | Cosmos3-Super-Image2Video-4Step | 1,263 | |
| #20 | PixVerse V5.5 | 1,262 | |
| #21 | PixVerse V5 | 1,261 | |
| #22 | Runway Gen-4.5 | 1,259 | |
| #23 | Veo 3.1 Fast | 1,257 | |
| #24 | Kling 2.6 Pro (January) | 1,257 | |
| #25 | Veo 3.1 | 1,250 | |
| #26 | Seedance 1.5 pro | 1,247 | |
| #27 | Veo 3.1 Lite | 1,247 | |
| #28 | Cosmos3-Super-Image2Video | 1,245 | |
| #29 | Hailuo 2.3 | 1,242 | |
| #30 | Hailuo 2.3 Fast | 1,241 | |
| #31 | Hailuo 02 Pro | 1,240 | |
| #32 | Wan 2.5 Preview | 1,235 | |
| #33 | Hailuo 02 Standard | 1,234 | |
| #34 | Seedance 1.0 | 1,230 | |
| #35 | Vidu Q2 Turbo | 1,228 | |
| #36 | Vidu Q3 Turbo | 1,225 | |
| #37 | Vidu Q2 Pro | 1,224 | |
| #38 | Veo 3 | 1,222 | |
| #39 | Ray 3 | 1,217 | |
| #40 | Wan 2.6 | 1,206 | |
| #41 | Kling 2.1 Master | 1,201 | |
| #42 | Pika 2.5 | 1,195 | |
| #43 | Hailuo 02 Fast | 1,194 | |
| #44 | LTX-2 Pro | 1,187 | |
| #45 | Kling 2.1 Pro | 1,182 | |
| #46 | LTX-2 Fast | 1,181 | |
| #47 | Kling 2.0 | 1,172 | |
| #48 | Kling 2.1 Standard | 1,168 | |
| #49 | LTX-2.3 Fast | 1,158 | |
| #50 | Vivago 2.0 | 1,158 |
Meilleurs modèles Text-to-Speech
| Rang | Modèle | Créateur | ELO Rating |
|---|---|---|---|
| #1 | Sonic 3.6 | 1,285 | |
| #2 | Qwen-Audio-3.0-TTS-Plus | 1,240 | |
| #3 | Simba 3.2 | 1,240 | |
| #4 | Luna TTS | 1,221 | |
| #5 | Gemini 3.1 Flash TTS | 1,212 | |
| #6 | StepAudio 2.5 TTS | 1,208 | |
| #7 | Sonic 3.5 | 1,203 | |
| #8 | Realtime TTS 1.5 Max | 1,196 | |
| #9 | Lightning V3.1 Pro (Jul 2026) | 1,195 | |
| #10 | Realtime TTS-2 - Research Preview | 1,187 | |
| #11 | Soniox TTS Real-Time v2 | 1,183 | |
| #12 | Eleven v3 | 1,179 | |
| #13 | Speech 2.8 HD | 1,173 | |
| #14 | Falcon 2 | 1,154 | |
| #15 | Gradium TTS Beta | 1,153 | |
| #16 | Speech 2.8 Turbo | 1,152 | |
| #17 | Async Flash v1.5 | 1,149 | |
| #18 | Fish Audio S2.1 Pro | 1,144 | |
| #19 | Step TTS 2 (Mar 2026) | 1,141 | |
| #20 | Speech 2.6 HD | 1,136 | |
| #21 | Lightning V3.1 Pro TTS (Jun 2026) | 1,135 | |
| #22 | Realtime TTS 1.5 Mini | 1,133 | |
| #23 | Azure HD 2.5 | 1,132 | |
| #24 | Async Pro v1.0 | 1,128 | |
| #25 | Speech 2.6 Turbo | 1,127 | |
| #26 | Fish Audio S2 Pro | 1,125 | |
| #27 | Simba 3.0 | 1,124 | |
| #28 | SpaceXAI TTS | 1,122 | |
| #29 | Speech-02-HD | 1,112 | |
| #30 | TTS-1 HD | 1,108 | |
| #31 | Step Audio EditX (Mar 2026) | 1,105 | |
| #32 | Turbo v2.5 | 1,104 | |
| #33 | Multilingual v2 | 1,104 | |
| #34 | TTS-1 | 1,094 | |
| #35 | Gradium TTS | 1,094 | |
| #36 | Chatterbox HD | 1,093 | |
| #37 | Gemini 2.5 Flash Lite TTS | 1,090 | |
| #38 | Speech-02-Turbo | 1,084 | |
| #39 | Flash v2.5 | 1,084 | |
| #40 | Studio | 1,081 | |
| #41 | Voxtral TTS | 1,081 | |
| #42 | OpenAudio S1 | 1,079 | |
| #43 | Speech 2.6 | 1,078 | |
| #44 | GPT-Realtime-2 | 1,073 | |
| #45 | Sonic 3 | 1,072 | |
| #46 | Bland Speech v3 | 1,071 | |
| #47 | Maya 2 Flash | 1,071 | |
| #48 | Journey | 1,069 | |
| #49 | T2A-01-HD | 1,066 | |
| #50 | SIMBA 1.6 | 1,065 |
Meilleurs modèles Image Editing
| Rang | Modèle | Créateur | ELO Rating |
|---|---|---|---|
| #1 | Reve 2.1 | 1,262 | |
| #2 | MAI-Image-2.5 | 1,256 | |
| #3 | GPT Image 2 (high) | 1,256 | |
| #4 | GPT Image 1.5 (high) | 1,250 | |
| #5 | Qwen-Image-3.0-Pro | 1,249 | |
| #6 | Nano Banana 2 (Gemini 3.1 Flash Image Preview) | 1,249 | |
| #7 | Seedream 5.0 Pro | 1,247 | |
| #8 | Nano Banana Pro (Gemini 3 Pro Image) | 1,244 | |
| #9 | MAI-Image-2.5-Flash | 1,234 | |
| #10 | grok-imagine-image-quality | 1,226 | |
| #11 | HunyuanImage 3.0 Instruct (Fal) | 1,223 | |
| #12 | DreamImage 2.0 | 1,221 | |
| #13 | Luma UNI 1 Max | 1,219 | |
| #14 | Qwen-Image-3.0 | 1,218 | |
| #15 | grok-imagine-image | 1,213 | |
| #16 | Kling Image 3.0 Omni | 1,209 | |
| #17 | Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) | 1,201 | |
| #18 | Wan 2.7 Pro | 1,200 | |
| #19 | FLUX.2 [max] | 1,199 | |
| #20 | Kling Image 3.0 | 1,199 | |
| #21 | Kling Image O1 | 1,198 | |
| #22 | Wan 2.6 Image | 1,194 | |
| #23 | HiDream-O1-Image | 1,192 | |
| #24 | Wan 2.7 | 1,188 | |
| #25 | Seedream 4.5 | 1,186 | |
| #26 | Agnes Image 2.0 Flash | 1,186 | |
| #27 | Seedream 4.0 | 1,184 | |
| #28 | Nano Banana (Gemini 2.5 Flash Image) | 1,179 | |
| #29 | Reve V1 (December) | 1,175 | |
| #30 | FLUX.2 [pro] | 1,170 | |
| #31 | Seedream 5.0 Lite | 1,170 | |
| #32 | FLUX.2 [klein] 9B | 1,166 | |
| #33 | Qwen Image Edit Plus 2511 | 1,166 | |
| #34 | Qwen Image 2.0 Pro (2026-04-22) | 1,166 | |
| #35 | FLUX.2 [flex] | 1,162 | |
| #36 | Eigen Image | 1,161 | |
| #37 | Qwen Image Edit Max 2601 | 1,159 | |
| #38 | Luma UNI 1 | 1,159 | |
| #39 | P-Image-Edit | 1,156 | |
| #40 | ImagineArt 2.0 | 1,156 | |
| #41 | FLUX.2 [dev] Turbo | 1,152 | |
| #42 | Qwen Image Edit Plus 2509 | 1,141 | |
| #43 | Step Image Edit 2 | 1,140 | |
| #44 | FLUX.2 [dev] Flash | 1,139 | |
| #45 | FLUX.2 [klein] Base 9B | 1,138 | |
| #46 | Wan 2.5 Preview | 1,138 | |
| #47 | FLUX.2 [dev] | 1,138 | |
| #48 | Vidu Q2 | 1,133 | |
| #49 | HiDream-O1-Image-Dev | 1,131 | |
| #50 | GPT Image 1 (high) | 1,129 |
Pourquoi ce classement ?
Face à l’explosion du nombre de modèles d’IA (GPT, Claude, Gemini, Llama, Mistral…), il devient difficile de s’y retrouver.
Ce classement compare plus de 500 modèles des principaux acteurs du marché sur plusieurs dimensions objectives.
Qualité
Performance sur des benchmarks académiques reconnus (MMLU Pro, GPQA, Math-500)
Vitesse
Rapidité de génération mesurée en tokens par seconde
Prix
Coût par million de tokens pour optimiser votre budget
Coding
Capacités de programmation et d’assistance au développement
Méthodologie
Source des données
Les données proviennent d’Artificial Analysis, une plateforme indépendante qui réalise des tests automatisés sur tous les modèles accessibles publiquement via API.
Critères d’évaluation
Intelligence Index (0-100)
Score composite qui agrège plusieurs benchmarks académiques de référence :
- MMLU Pro : questions à choix multiples couvrant 57 domaines de connaissances
- GPQA : questions de niveau doctorat en sciences
- Math-500 : problèmes mathématiques avancés
Vitesse (tokens/seconde)
Vitesse de génération mesurée en conditions réelles via les API officielles. Plus le score est élevé, plus le modèle génère rapidement du texte (crucial pour les applications interactives).
Prix ($/1M tokens)
Tarification blended calculée avec un ratio 3:1 (3 tokens en entrée pour 1 token en sortie), représentant un usage typique. Les prix évoluent régulièrement avec la concurrence.
Comment lire ce tableau ?
Intelligence Index
Score global de performance intellectuelle. Un score de 50+ indique un modèle frontier capable de raisonnement avancé.
Speed (tokens/s)
Vitesse de génération. Important pour les applications nécessitant des réponses rapides (chatbots, assistance).
Prix ($/1M tokens)
Coût par million de tokens. Les prix ont fortement baissé grâce à la compétition.
Badges de prix
Des badges colorés indiquent rapidement la catégorie de prix :
Quel modèle choisir selon votre besoin ?
Consultez notre comparatif détaillé ChatGPT vs Claude vs Gemini vs Mistral pour une analyse approfondie. Voir aussi notre sélection des 15 meilleures IA gratuites en 2026.
Développement / Code
Visez un Quality Index élevé, puis comparez : la plupart des éditeurs publient une variante spécialisée code (suffixe Codex, Coder).
Triez la colonne Quality Index, puis vérifiez le prix : l’écart entre deux variantes d’une même famille est souvent plus grand que l’écart de qualité.
Rédaction / Contenu
Pour produire du contenu au kilomètre, le rapport qualité/prix prime sur la performance brute. Filtrez sur les badges Budget ou Standard.
Les variantes légères (mini, Flash, Haiku) suffisent largement pour articles, emails et descriptions produits.
Analyse / Recherche
Pour du raisonnement complexe, restez sur les modèles dits frontier, au-dessus de 50 de Quality Index.
Privilégiez les modèles de raisonnement, qui décomposent le problème étape par étape avant de répondre.
Usage intensif / Budget
Pour un gros volume à budget contraint, filtrez sur le badge Budget et regardez les modèles open-source.
Certains modèles à moins de $1/1M dépassent aujourd’hui 49 de Quality Index : triez par prix croissant pour les repérer.
Tendances actuelles du marché LLM
Guerre des prix
Les tarifs ont été divisés par 10 en 3 ans grâce à la compétition entre OpenAI, Anthropic, Google et Meta.
Explosion des performances
Les modèles récents (2025-2026) dépassent désormais les humains sur de nombreux benchmarks académiques.
Spécialisation
Émergence de modèles optimisés pour des tâches spécifiques (code, maths, langues) plutôt que généralistes.
Open-source en hausse
Meta (Llama), Alibaba (Qwen3.5), DeepSeek et Xiaomi (MiMo) proposent des modèles gratuits de niveau quasi-professionnel.
Modèles de raisonnement
Nouvelle génération capable de « réfléchir » étape par étape (GPT-5 reasoning, Claude Adaptive Reasoning, DeepSeek V3.2).
Questions fréquentes
À quelle fréquence ce classement est-il mis à jour ?
Les données sont synchronisées automatiquement chaque jour avec l’API d’Artificial Analysis. Vous consultez toujours les derniers résultats disponibles, incluant les nouveaux modèles et mises à jour de prix.
Pourquoi certains modèles connus ne sont pas dans le classement ?
Seuls les modèles accessibles publiquement via API sont testés et comparés. Les modèles privés, en bêta fermée ou sans API publique ne peuvent pas être inclus dans ce classement indépendant.
Le prix affiché est-il le prix réel que je paierai ?
Le prix blended est une estimation basée sur un ratio 3:1 input/output qui représente un usage typique. Votre coût réel peut varier selon votre cas d’usage. Consultez toujours la tarification officielle de chaque fournisseur pour des chiffres précis.
Un modèle plus cher est-il forcément meilleur ?
Non. Le rapport qualité/prix varie énormément d’un modèle à l’autre : certains modèles classés « Budget », à moins de $1 par million de tokens, dépassent aujourd’hui 49 de Quality Index, là où des modèles « Premium » à plus de $10 plafonnent à peine plus haut. Triez le tableau par prix croissant pour repérer ces écarts. Le choix dépend surtout de votre cas d’usage : pour du contenu simple, un modèle budget suffit amplement.
Comment sont calculés les scores de qualité ?
Artificial Analysis utilise des benchmarks académiques standardisés (MMLU Pro, GPQA, Math-500, etc.) et teste tous les modèles dans les mêmes conditions pour garantir une comparaison objective. Les tests sont automatisés et régulièrement mis à jour.
Puis-je utiliser ces données pour mon projet ?
Les données sont fournies par Artificial Analysis via leur API. Pour toute utilisation commerciale ou redistribution, veuillez consulter leurs conditions d’utilisation sur artificialanalysis.ai. Ce classement est fourni à titre informatif.
Puis-je réutiliser ces données ?
Oui, pour un usage informatif en citant la source. Vérifiez néanmoins les licences et mentions légales des fournisseurs d’origine.
Que signifient les mentions entre parenthèses après le nom d’un modèle ?
Un même modèle est souvent testé sous plusieurs configurations, indiquées entre parenthèses. Les mentions max, xhigh, high, medium et low correspondent au niveau d’effort de raisonnement accordé au modèle : plus il est élevé, meilleure est généralement la qualité, mais plus la réponse est lente et coûteuse. Les suffixes de type mini, nano ou Flash désignent au contraire des versions allégées, pensées pour la vitesse et le faible coût.
Quel est le meilleur modèle pour du code ?
Il n’existe pas de réponse unique, et ce classement ne propose pas de score dédié au code suffisamment fiable pour trancher. En pratique, partez des modèles à fort Quality Index, puis regardez si l’éditeur publie une variante spécialisée (suffixe Codex, Coder). Testez ensuite sur votre propre base de code : la qualité perçue dépend beaucoup du langage, de la taille du contexte et de votre façon de formuler les demandes.
