Mise à jour quotidienne automatique

Classement des meilleurs LLM en 2026 : comparatif mis à jour quotidiennement

Benchmark et comparatif des meilleurs LLM, mis à jour automatiquement chaque jour. Données consolidées, couvrant précision, multimodalité, coût et performance. Faites défiler pour explorer les classements par catégorie.

500+modèles suivis
100modèles classés
24 hfréquence de sync
AAsource : Artificial Analysis

Face à l’explosion des modèles d’IA, choisir le bon LLM devient un casse-tête : GPT-5, Claude 4.5 Sonnet, Gemini 2.5 Pro, Grok 4… Ce classement compare le top 100 des modèles sur des critères objectifs (qualité, vitesse, coût, capacités multimodales) grâce aux benchmarks indépendants d’Artificial Analysis. Les données sont synchronisées automatiquement chaque jour pour garantir un comparatif toujours à jour. Utilisez les filtres ci-dessous pour trouver le modèle adapté à votre usage et budget.

Classements des modèles IA

Top 100 des meilleurs LLM

Dernière mise à jour : il y a 13 heures
Données : Artificial Analysis
ModèleCréateurQuality IndexSpeed (tok/s)Prix ($/1M)
Claude Opus 5 (Adaptive Reasoning, Max Effort)
Anthropic
63.1
55.9 $10.00 Premium
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
Anthropic
62.5
54.9 $10.00 Premium
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
Anthropic
62.1
68.4 $20.00 Premium
Claude Opus 5 (Adaptive Reasoning, High Effort)
Anthropic
61.5
53.4 $10.00 Premium
GPT-5.6 Sol (max)
OpenAI
60.9
74.9 $11.25 Premium
Grok 4.6 (high)
SpaceXAI
60.9
62.2 $3.00 Standard
Kimi K3 (max)
Kimi
59.7
39.0 $6.00 Standard
GLM-5.3 (max)
Z AI
59.5
78.8 $2.15 Standard
GPT-5.6 Sol (xhigh)
OpenAI
59.0
73.3 $11.25 Premium
Claude Opus 5 (Adaptive Reasoning, Medium Effort)
Anthropic
58.6
52.9 $10.00 Premium
Qwen3.8 Max
Alibaba
58.1
45.0 $3.00 Standard
Qwen3.8 2.4T A95B
Alibaba
57.7
45.0 $3.00 Standard
GPT-5.6 Sol (high)
OpenAI
57.3
64.5 $11.25 Premium
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
Anthropic
57.3
0.0 $10.00 Premium
Muse Spark 1.2 (xhigh)
Meta
56.8
0.0 $2.00 Standard
GPT-5.6 Terra (max)
OpenAI
56.6
113.9 $4.50 Standard
GPT-5.5 (xhigh)
OpenAI
56.3
0.0 $11.25 Premium
Gemini 3.7 Flash (high)
Google
56.0
357.8 $1.50 Budget
Grok 4.5 (high)
SpaceXAI
55.8
56.8 $3.00 Standard
GPT-5.6 Sol (medium)
OpenAI
55.6
62.6 $11.25 Premium
Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
Anthropic
55.3
86.6 $4.00 Standard
Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
Anthropic
55.0
0.0 $10.00 Premium
GPT-5.5 (high)
OpenAI
54.7
0.0 $11.25 Premium
Gemini 3.7 Flash (medium)
Google
53.4
375.0 $1.50 Budget
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
DeepSeek
53.2
68.5 $1.98 Budget
Muse Spark 1.1 (xhigh)
Meta
53.2
0.0 $2.00 Standard
GPT-5.4 (xhigh)
OpenAI
53.1
0.0 $5.63 Standard
GPT-5.6 Terra (xhigh)
OpenAI
52.8
100.0 $4.50 Standard
GLM-5.2 (max)
Z AI
52.6
86.5 $2.15 Standard
Claude Opus 5 (Adaptive Reasoning, Low Effort)
Anthropic
52.5
51.5 $10.00 Premium
GPT-5.6 Luna (max)
OpenAI
52.3
138.1 $0.45 Budget
Qwen3.8 27B
Alibaba
52.0
0.0 $1.09 Budget
Gemini 3.5 Flash (high)
Google
52.0
0.0 $3.38 Standard
DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
DeepSeek
51.8
121.9 $0.66 Budget
Gemini 3.6 Flash (high)
Google
51.6
201.4 $1.50 Budget
GPT-5.5 (medium)
OpenAI
51.4
0.0 $11.25 Premium
Gemini 3.7 Flash (low)
Google
50.9
321.3 $1.50 Budget
GPT-5.6 Sol (low)
OpenAI
50.7
68.9 $11.25 Premium
GPT-5.6 Luna (xhigh)
OpenAI
50.1
137.7 $0.45 Budget
GPT-5.6 Terra (high)
OpenAI
50.1
100.1 $4.50 Standard
Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)
Anthropic
48.4
0.0 $6.00 Standard
Kimi K3 (low)
Kimi
48.3
38.8 $6.00 Standard
Gemini 3.1 Pro Preview
Google
47.7
124.3 $4.50 Standard
Motif 3
Motif Technologies
47.4
0.0 $0.00 Budget
GPT-5.6 Luna (high)
OpenAI
47.0
139.0 $0.45 Budget
GPT-5.6 Terra (medium)
OpenAI
46.8
99.5 $4.50 Standard
Gemini 3.5 Flash (medium)
Google
46.7
256.0 $3.38 Standard
Qwen3.7 Max
Alibaba
46.7
0.0 $3.75 Standard
GPT-5.3 Codex (xhigh)
OpenAI
45.5
125.2 $4.81 Standard
MiniMax-M3
MiniMax
45.4
107.9 $0.53 Budget
DeepSeek V4 Pro (Reasoning, Max Effort)
DeepSeek
45.3
66.0 $0.54 Budget
Motif 3 (Beta)
Motif Technologies
45.3
0.0 $0.00 Budget
Kimi K2.6
Kimi
45.1
0.0 $1.71 Budget
Claude Opus 4.6 (Adaptive Reasoning, Max Effort)
Anthropic
44.9
0.0 $10.00 Premium
GPT-5.5 (low)
OpenAI
44.5
0.0 $11.25 Premium
Muse Spark
Meta
44.3
0.0 $0.00 Budget
Claude Opus 4.7 (Non-reasoning, High Effort)
Anthropic
43.9
0.0 $10.00 Premium
DeepSeek V4 Pro (Reasoning, High Effort)
DeepSeek
43.7
71.1 $0.54 Budget
GPT-5.2 (xhigh)
OpenAI
43.3
0.0 $4.81 Standard
Kimi K2.7 Code
Kimi
43.0
38.2 $1.71 Budget
MiMo-V2.5-Pro
Xiaomi
42.9
58.1 $0.54 Budget
Claude Sonnet 5 (Non-reasoning, High Effort)
Anthropic
42.6
62.6 $4.00 Standard
Inkling (xhigh)
Thinking Machines
42.3
70.5 $1.76 Budget
Hy3
Tencent
42.2
75.8 $0.24 Budget
DeepSeek V4 Flash (Reasoning, Max Effort)
DeepSeek
42.1
0.0 $0.17 Budget
GPT-5.6 Sol (Non-reasoning)
OpenAI
41.9
68.7 $11.25 Premium
Claude Opus 4.5 (Reasoning)
Anthropic
41.9
0.0 $10.00 Premium
Nex-N2-Pro
Nex AGI
41.7
135.3 $1.00 Budget
Solar Pro 4
Upstage
41.6
39.3 $0.53 Budget
MiMo-V2-Pro
Xiaomi
41.4
0.0 $0.00 Budget
GPT-5.6 Terra (low)
OpenAI
41.3
92.8 $4.50 Standard
Inkling Small
Thinking Machines
41.2
68.9 $0.53 Budget
GPT-5.2 Codex (xhigh)
OpenAI
41.2
0.0 $4.81 Standard
Qwen3.6 Max Preview
Alibaba
41.1
0.0 $2.93 Standard
GLM-5.1 (Reasoning)
Z AI
41.0
28.2 $2.14 Standard
GPT-5.4 mini (xhigh)
OpenAI
40.9
0.0 $1.69 Budget
Grok Build 0.1 0616
SpaceXAI
40.7
0.0 $1.25 Budget
Gemini 3 Pro Preview (high)
Google
40.6
0.0 $4.50 Standard
GLM-5 (Reasoning)
Z AI
40.6
0.0 $1.55 Budget
Qwen3.6 Plus
Alibaba
40.5
0.0 $1.13 Budget
GPT-5.4 (low)
OpenAI
40.2
0.0 $5.63 Standard
JT-4.1 Flash 236B A21B
China Mobile
39.9
0.0 $0.00 Budget
Agnes 2.5 Pro Alpha
Sapiens AI
39.7
131.2 $0.56 Budget
GPT-5.4 nano (xhigh)
OpenAI
39.7
0.0 $0.46 Budget
Qwen3.7 Plus
Alibaba
39.4
55.6 $0.70 Budget
GLM-5-Turbo
Z AI
39.1
0.0 $0.00 Budget
DeepSeek V4 Flash (Reasoning, High Effort)
DeepSeek
39.0
0.0 $0.17 Budget
GPT-5.6 Luna (medium)
OpenAI
38.9
132.8 $0.45 Budget
GPT-5.2 (medium)
OpenAI
38.9
0.0 $4.81 Standard
MiniMax-M2.7
MiniMax
38.9
0.0 $0.53 Budget
Claude Opus 4.6 (Non-reasoning, High Effort)
Anthropic
38.8
0.0 $10.00 Premium
Gemini 3 Flash Preview (Reasoning)
Google
38.7
0.0 $1.13 Budget
Nemotron 3 Ultra 550B A55B (Reasoning)
NVIDIA
38.3
120.3 $1.14 Budget
MiMo-V2.5
Xiaomi
38.0
51.7 $0.18 Budget
Grok 4.20 0309 v2 (Reasoning)
SpaceXAI
38.0
0.0 $1.56 Budget
Grok 4.3 (high)
SpaceXAI
37.9
0.0 $1.56 Budget
Ling 3.0 Flash
InclusionAI
37.8
428.6 $0.11 Budget
Qwen3.6 27B (Reasoning)
Alibaba
37.7
59.4 $1.35 Budget
GPT-5.1 (high)
OpenAI
37.5
0.0 $3.44 Standard
Gemini 3.5 Flash-Lite
Google
37.4
368.1 $0.85 Budget

Meilleurs modèles Text-to-Video

Dernière mise à jour : il y a 13 heures
Données : Artificial Analysis
RangModèleCréateurELO Rating
#1Gemini Omni Flash
Google
1,322
#2MiniMax H3
MiniMax
1,305
#3HappyHorse-1.0
Alibaba-ATH
1,284
#4Dreamina Seedance 2.0 720p
ByteDance Seed
1,265
#5HappyHorse-1.1
Alibaba-ATH
1,262
#6Wan2.7-260612
Alibaba
1,242
#7Kling 3.0 1080p (Pro)
KlingAI
1,239
#8Kling 3.0 Omni 1080p (Pro)
KlingAI
1,227
#9grok-imagine-video
SpaceXAI
1,222
#10Bach-1.0 Preview
Video Rebirth
1,215
#11Wan 2.7
Alibaba
1,215
#12Vidu Q3 Pro
Vidu
1,214
#13Runway Gen-4.5
Runway
1,214
#14Kling 3.0 Omni 720p (Standard)
KlingAI
1,214
#15Veo 3
Google
1,212
#16PixVerse V5.6
PixVerse
1,211
#17SkyReels V4
Skywork AI
1,210
#18Kling 3.0 720p (Standard)
KlingAI
1,210
#19PixVerse V6
PixVerse
1,209
#20Veo 3.1 Lite
Google
1,207
#21Veo 3.1
Google
1,199
#22Veo 3.1 Fast
Google
1,198
#23Kling 2.5 Turbo 1080p
KlingAI
1,198
#24Kling 2.6 Pro (January)
KlingAI
1,196
#25Kling O1 Pro (January)
KlingAI
1,195
#26PixVerse V5.5
PixVerse
1,194
#27Kling O1 Standard (January)
KlingAI
1,186
#28Wan 2.6
Alibaba
1,185
#29Ray 3
Luma Labs
1,184
#30Kling 2.6 Standard (January)
KlingAI
1,182
#31Veo 3 Fast Preview
Google
1,173
#32Seedance 1.5 pro
ByteDance Seed
1,171
#33Hailuo 2.3
MiniMax
1,171
#34Hailuo 02 Standard
MiniMax
1,169
#35PixVerse V5
PixVerse
1,168
#36Vidu Q2
Vidu
1,164
#37Wan 2.5 Preview
Alibaba
1,157
#38Hailuo 02 Pro
MiniMax
1,148
#39Seedance 1.0
ByteDance Seed
1,136
#40Kling 2.1 Master
KlingAI
1,129
#41LTX-2 Pro
Lightricks
1,121
#42LTX-2 Fast
Lightricks
1,120
#43LTX-2.3 Fast
Lightricks
1,120
#44Veo 2
Google
1,111
#45Wan 2.2 A14B
Alibaba
1,107
#46Vidu Q3 Turbo
Vidu
1,106
#47LTX-2.3 Pro
Lightricks
1,105
#48Kling 2.0
KlingAI
1,082
#49Seedance 1.0 Mini
ByteDance Seed
1,079
#50Pika 2.5
Pika Art
1,076

Meilleurs modèles Image-to-Video

Dernière mise à jour : il y a 13 heures
Données : Artificial Analysis
RangModèleCréateurELO Rating
#1Gemini Omni Flash
Google
1,366
#2MiniMax H3
MiniMax
1,352
#3Dreamina Seedance 2.0 720p
ByteDance Seed
1,337
#4grok-imagine-video-1.5
SpaceXAI
1,328
#5PixVerse V6
PixVerse
1,326
#6grok-imagine-video
SpaceXAI
1,326
#7HappyHorse-1.1
Alibaba-ATH
1,310
#8HappyHorse-1.0
Alibaba-ATH
1,289
#9Kling 2.5 Turbo 1080p
KlingAI
1,287
#10SkyReels V4
Skywork AI
1,285
#11Kling 3.0 1080p (Pro)
KlingAI
1,284
#12Vidu Q3 Pro
Vidu
1,280
#13Kling 3.0 Omni 1080p (Pro)
KlingAI
1,278
#14PixVerse V5.6
PixVerse
1,277
#15Wan 2.7
Alibaba
1,270
#16Kling 2.6 Standard (January)
KlingAI
1,267
#17Kling 3.0 Omni 720p (Standard)
KlingAI
1,264
#18Kling 3.0 720p (Standard)
KlingAI
1,263
#19Cosmos3-Super-Image2Video-4Step
NVIDIA
1,263
#20PixVerse V5.5
PixVerse
1,262
#21PixVerse V5
PixVerse
1,261
#22Runway Gen-4.5
Runway
1,259
#23Veo 3.1 Fast
Google
1,257
#24Kling 2.6 Pro (January)
KlingAI
1,257
#25Veo 3.1
Google
1,250
#26Seedance 1.5 pro
ByteDance Seed
1,247
#27Veo 3.1 Lite
Google
1,247
#28Cosmos3-Super-Image2Video
NVIDIA
1,245
#29Hailuo 2.3
MiniMax
1,242
#30Hailuo 2.3 Fast
MiniMax
1,241
#31Hailuo 02 Pro
MiniMax
1,240
#32Wan 2.5 Preview
Alibaba
1,235
#33Hailuo 02 Standard
MiniMax
1,234
#34Seedance 1.0
ByteDance Seed
1,230
#35Vidu Q2 Turbo
Vidu
1,228
#36Vidu Q3 Turbo
Vidu
1,225
#37Vidu Q2 Pro
Vidu
1,224
#38Veo 3
Google
1,222
#39Ray 3
Luma Labs
1,217
#40Wan 2.6
Alibaba
1,206
#41Kling 2.1 Master
KlingAI
1,201
#42Pika 2.5
Pika Art
1,195
#43Hailuo 02 Fast
MiniMax
1,194
#44LTX-2 Pro
Lightricks
1,187
#45Kling 2.1 Pro
KlingAI
1,182
#46LTX-2 Fast
Lightricks
1,181
#47Kling 2.0
KlingAI
1,172
#48Kling 2.1 Standard
KlingAI
1,168
#49LTX-2.3 Fast
Lightricks
1,158
#50Vivago 2.0
HiDream
1,158

Meilleurs modèles Text-to-Speech

Dernière mise à jour : il y a 13 heures
Données : Artificial Analysis
RangModèleCréateurELO Rating
#1Sonic 3.6
Cartesia
1,285
#2Qwen-Audio-3.0-TTS-Plus
Alibaba
1,240
#3Simba 3.2
SpeechifyAI
1,240
#4Luna TTS
VUI Labs
1,221
#5Gemini 3.1 Flash TTS
Google
1,212
#6StepAudio 2.5 TTS
StepFun
1,208
#7Sonic 3.5
Cartesia
1,203
#8Realtime TTS 1.5 Max
Inworld
1,196
#9Lightning V3.1 Pro (Jul 2026)
Smallest.ai
1,195
#10Realtime TTS-2 - Research Preview
Inworld
1,187
#11Soniox TTS Real-Time v2
Soniox
1,183
#12Eleven v3
ElevenLabs
1,179
#13Speech 2.8 HD
MiniMax
1,173
#14Falcon 2
Murf AI
1,154
#15Gradium TTS Beta
Gradium
1,153
#16Speech 2.8 Turbo
MiniMax
1,152
#17Async Flash v1.5
async
1,149
#18Fish Audio S2.1 Pro
Fish Audio
1,144
#19Step TTS 2 (Mar 2026)
StepFun
1,141
#20Speech 2.6 HD
MiniMax
1,136
#21Lightning V3.1 Pro TTS (Jun 2026)
Smallest.ai
1,135
#22Realtime TTS 1.5 Mini
Inworld
1,133
#23Azure HD 2.5
Microsoft
1,132
#24Async Pro v1.0
async
1,128
#25Speech 2.6 Turbo
MiniMax
1,127
#26Fish Audio S2 Pro
Fish Audio
1,125
#27Simba 3.0
SpeechifyAI
1,124
#28SpaceXAI TTS
SpaceXAI
1,122
#29Speech-02-HD
MiniMax
1,112
#30TTS-1 HD
OpenAI
1,108
#31Step Audio EditX (Mar 2026)
StepFun
1,105
#32Turbo v2.5
ElevenLabs
1,104
#33Multilingual v2
ElevenLabs
1,104
#34TTS-1
OpenAI
1,094
#35Gradium TTS
Gradium
1,094
#36Chatterbox HD
Resemble AI
1,093
#37Gemini 2.5 Flash Lite TTS
Google
1,090
#38Speech-02-Turbo
MiniMax
1,084
#39Flash v2.5
ElevenLabs
1,084
#40Studio
Google
1,081
#41Voxtral TTS
Mistral
1,081
#42OpenAudio S1
Fish Audio
1,079
#43Speech 2.6
Hithink
1,078
#44GPT-Realtime-2
OpenAI
1,073
#45Sonic 3
Cartesia
1,072
#46Bland Speech v3
Bland AI
1,071
#47Maya 2 Flash
Maya Research
1,071
#48Journey
Google
1,069
#49T2A-01-HD
MiniMax
1,066
#50SIMBA 1.6
SpeechifyAI
1,065

Meilleurs modèles Image Editing

Dernière mise à jour : il y a 13 heures
Données : Artificial Analysis
RangModèleCréateurELO Rating
#1Reve 2.1
Reve
1,262
#2MAI-Image-2.5
Microsoft AI
1,256
#3GPT Image 2 (high)
OpenAI
1,256
#4GPT Image 1.5 (high)
OpenAI
1,250
#5Qwen-Image-3.0-Pro
Alibaba
1,249
#6Nano Banana 2 (Gemini 3.1 Flash Image Preview)
Google
1,249
#7Seedream 5.0 Pro
Bytedance
1,247
#8Nano Banana Pro (Gemini 3 Pro Image)
Google
1,244
#9MAI-Image-2.5-Flash
Microsoft AI
1,234
#10grok-imagine-image-quality
SpaceXAI
1,226
#11HunyuanImage 3.0 Instruct (Fal)
Tencent
1,223
#12DreamImage 2.0
Newport AI
1,221
#13Luma UNI 1 Max
Luma Labs
1,219
#14Qwen-Image-3.0
Alibaba
1,218
#15grok-imagine-image
SpaceXAI
1,213
#16Kling Image 3.0 Omni
KlingAI
1,209
#17Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)
Google
1,201
#18Wan 2.7 Pro
Alibaba
1,200
#19FLUX.2 [max]
Black Forest Labs
1,199
#20Kling Image 3.0
KlingAI
1,199
#21Kling Image O1
KlingAI
1,198
#22Wan 2.6 Image
Alibaba
1,194
#23HiDream-O1-Image
HiDream
1,192
#24Wan 2.7
Alibaba
1,188
#25Seedream 4.5
ByteDance Seed
1,186
#26Agnes Image 2.0 Flash
Sapiens AI
1,186
#27Seedream 4.0
ByteDance Seed
1,184
#28Nano Banana (Gemini 2.5 Flash Image)
Google
1,179
#29Reve V1 (December)
Reve
1,175
#30FLUX.2 [pro]
Black Forest Labs
1,170
#31Seedream 5.0 Lite
Bytedance
1,170
#32FLUX.2 [klein] 9B
Black Forest Labs
1,166
#33Qwen Image Edit Plus 2511
Alibaba
1,166
#34Qwen Image 2.0 Pro (2026-04-22)
Alibaba
1,166
#35FLUX.2 [flex]
Black Forest Labs
1,162
#36Eigen Image
Eigen AI
1,161
#37Qwen Image Edit Max 2601
Alibaba
1,159
#38Luma UNI 1
Luma Labs
1,159
#39P-Image-Edit
Pruna AI
1,156
#40ImagineArt 2.0
ImagineArt
1,156
#41FLUX.2 [dev] Turbo
Fal
1,152
#42Qwen Image Edit Plus 2509
Alibaba
1,141
#43Step Image Edit 2
StepFun
1,140
#44FLUX.2 [dev] Flash
Fal
1,139
#45FLUX.2 [klein] Base 9B
Black Forest Labs
1,138
#46Wan 2.5 Preview
Alibaba
1,138
#47FLUX.2 [dev]
Black Forest Labs
1,138
#48Vidu Q2
Vidu
1,133
#49HiDream-O1-Image-Dev
HiDream
1,131
#50GPT Image 1 (high)
OpenAI
1,129

Pourquoi ce classement ?

Face à l’explosion du nombre de modèles d’IA (GPT, Claude, Gemini, Llama, Mistral…), il devient difficile de s’y retrouver.

Ce classement compare plus de 500 modèles des principaux acteurs du marché sur plusieurs dimensions objectives.

Qualité

Performance sur des benchmarks académiques reconnus (MMLU Pro, GPQA, Math-500)

Vitesse

Rapidité de génération mesurée en tokens par seconde

Prix

Coût par million de tokens pour optimiser votre budget

Coding

Capacités de programmation et d’assistance au développement

Méthodologie

Source des données

Les données proviennent d’Artificial Analysis, une plateforme indépendante qui réalise des tests automatisés sur tous les modèles accessibles publiquement via API.

Critères d’évaluation

Intelligence Index (0-100)

Score composite qui agrège plusieurs benchmarks académiques de référence :

  • MMLU Pro : questions à choix multiples couvrant 57 domaines de connaissances
  • GPQA : questions de niveau doctorat en sciences
  • Math-500 : problèmes mathématiques avancés

Vitesse (tokens/seconde)

Vitesse de génération mesurée en conditions réelles via les API officielles. Plus le score est élevé, plus le modèle génère rapidement du texte (crucial pour les applications interactives).

Prix ($/1M tokens)

Tarification blended calculée avec un ratio 3:1 (3 tokens en entrée pour 1 token en sortie), représentant un usage typique. Les prix évoluent régulièrement avec la concurrence.

Guide de lecture

Comment lire ce tableau ?

Intelligence Index

Score global de performance intellectuelle. Un score de 50+ indique un modèle frontier capable de raisonnement avancé.

55+Excellence
50-55Très performant
40-50Performant
< 40Basique

Speed (tokens/s)

Vitesse de génération. Important pour les applications nécessitant des réponses rapides (chatbots, assistance).

> 100Très rapide
50-100Rapide
20-50Moyen
< 20Lent

Prix ($/1M tokens)

Coût par million de tokens. Les prix ont fortement baissé grâce à la compétition.

Gratuit$0 (modèles open-source)
Budget< $2 / 1M
Standard$2-10 / 1M
Premium> $10 / 1M

Badges de prix

Des badges colorés indiquent rapidement la catégorie de prix :

BudgetExcellent rapport qualité/prix
StandardÉquilibre performance/coût
PremiumQualité maximale
Cas d’usage

Quel modèle choisir selon votre besoin ?

Consultez notre comparatif détaillé ChatGPT vs Claude vs Gemini vs Mistral pour une analyse approfondie. Voir aussi notre sélection des 15 meilleures IA gratuites en 2026.

Développement / Code

Visez un Quality Index élevé, puis comparez : la plupart des éditeurs publient une variante spécialisée code (suffixe Codex, Coder).

Triez la colonne Quality Index, puis vérifiez le prix : l’écart entre deux variantes d’une même famille est souvent plus grand que l’écart de qualité.

Rédaction / Contenu

Pour produire du contenu au kilomètre, le rapport qualité/prix prime sur la performance brute. Filtrez sur les badges Budget ou Standard.

Les variantes légères (mini, Flash, Haiku) suffisent largement pour articles, emails et descriptions produits.

Analyse / Recherche

Pour du raisonnement complexe, restez sur les modèles dits frontier, au-dessus de 50 de Quality Index.

Privilégiez les modèles de raisonnement, qui décomposent le problème étape par étape avant de répondre.

Usage intensif / Budget

Pour un gros volume à budget contraint, filtrez sur le badge Budget et regardez les modèles open-source.

Certains modèles à moins de $1/1M dépassent aujourd’hui 49 de Quality Index : triez par prix croissant pour les repérer.

Tendances

Tendances actuelles du marché LLM

Restez informé des évolutions de l’IA

Chaque semaine, les nouveaux modèles, les évolutions de prix et les analyses qui comptent.

FAQ

Questions fréquentes

À quelle fréquence ce classement est-il mis à jour ?

Les données sont synchronisées automatiquement chaque jour avec l’API d’Artificial Analysis. Vous consultez toujours les derniers résultats disponibles, incluant les nouveaux modèles et mises à jour de prix.

Pourquoi certains modèles connus ne sont pas dans le classement ?

Seuls les modèles accessibles publiquement via API sont testés et comparés. Les modèles privés, en bêta fermée ou sans API publique ne peuvent pas être inclus dans ce classement indépendant.

Le prix affiché est-il le prix réel que je paierai ?

Le prix blended est une estimation basée sur un ratio 3:1 input/output qui représente un usage typique. Votre coût réel peut varier selon votre cas d’usage. Consultez toujours la tarification officielle de chaque fournisseur pour des chiffres précis.

Un modèle plus cher est-il forcément meilleur ?

Non. Le rapport qualité/prix varie énormément d’un modèle à l’autre : certains modèles classés « Budget », à moins de $1 par million de tokens, dépassent aujourd’hui 49 de Quality Index, là où des modèles « Premium » à plus de $10 plafonnent à peine plus haut. Triez le tableau par prix croissant pour repérer ces écarts. Le choix dépend surtout de votre cas d’usage : pour du contenu simple, un modèle budget suffit amplement.

Comment sont calculés les scores de qualité ?

Artificial Analysis utilise des benchmarks académiques standardisés (MMLU Pro, GPQA, Math-500, etc.) et teste tous les modèles dans les mêmes conditions pour garantir une comparaison objective. Les tests sont automatisés et régulièrement mis à jour.

Puis-je utiliser ces données pour mon projet ?

Les données sont fournies par Artificial Analysis via leur API. Pour toute utilisation commerciale ou redistribution, veuillez consulter leurs conditions d’utilisation sur artificialanalysis.ai. Ce classement est fourni à titre informatif.

Puis-je réutiliser ces données ?

Oui, pour un usage informatif en citant la source. Vérifiez néanmoins les licences et mentions légales des fournisseurs d’origine.

Que signifient les mentions entre parenthèses après le nom d’un modèle ?

Un même modèle est souvent testé sous plusieurs configurations, indiquées entre parenthèses. Les mentions max, xhigh, high, medium et low correspondent au niveau d’effort de raisonnement accordé au modèle : plus il est élevé, meilleure est généralement la qualité, mais plus la réponse est lente et coûteuse. Les suffixes de type mini, nano ou Flash désignent au contraire des versions allégées, pensées pour la vitesse et le faible coût.

Quel est le meilleur modèle pour du code ?

Il n’existe pas de réponse unique, et ce classement ne propose pas de score dédié au code suffisamment fiable pour trancher. En pratique, partez des modèles à fort Quality Index, puis regardez si l’éditeur publie une variante spécialisée (suffixe Codex, Coder). Testez ensuite sur votre propre base de code : la qualité perçue dépend beaucoup du langage, de la taille du contexte et de votre façon de formuler les demandes.