Mise à jour quotidienne automatique

Classement des meilleurs LLM en 2026 : comparatif mis à jour quotidiennement

Benchmark et comparatif des meilleurs LLM, mis à jour automatiquement chaque jour. Données consolidées, couvrant précision, multimodalité, coût et performance. Faites défiler pour explorer les classements par catégorie.

500+modèles suivis
100modèles classés
24 hfréquence de sync
AAsource : Artificial Analysis

Face à l’explosion des modèles d’IA, choisir le bon LLM devient un casse-tête : GPT-5, Claude 4.5 Sonnet, Gemini 2.5 Pro, Grok 4… Ce classement compare le top 100 des modèles sur des critères objectifs (qualité, vitesse, coût, capacités multimodales) grâce aux benchmarks indépendants d’Artificial Analysis. Les données sont synchronisées automatiquement chaque jour pour garantir un comparatif toujours à jour. Utilisez les filtres ci-dessous pour trouver le modèle adapté à votre usage et budget.

Classements des modèles IA

Top 100 des meilleurs LLM

Dernière mise à jour : il y a 19 heures
Données : Artificial Analysis
ModèleCréateurQuality IndexSpeed (tok/s)Prix ($/1M)
Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)
Anthropic
53.4
71.0 $20.00 Premium
Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)
Anthropic
53.2
61.3 $20.00 Premium
GPT-6 Astra (max)
OpenAI
52.7
61.8 $20.00 Premium
GPT-6 Astra (xhigh)
OpenAI
52.4
57.9 $20.00 Premium
Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)
Anthropic
51.2
54.5 $20.00 Premium
GPT-6 Astra (high)
OpenAI
50.9
52.4 $20.00 Premium
Claude Opus 5 (Adaptive Reasoning, Max Effort)
Anthropic
50.8
57.0 $10.00 Premium
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
Anthropic
49.7
57.3 $10.00 Premium
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
Anthropic
49.6
0.0 $20.00 Premium
GPT-6 Astra (medium)
OpenAI
49.6
52.0 $20.00 Premium
Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback)
Anthropic
48.9
51.8 $20.00 Premium
Claude Opus 5 (Adaptive Reasoning, High Effort)
Anthropic
48.1
57.2 $10.00 Premium
Muse Spark 1.3 (max)
Meta
48.1
281.4 $2.00 Standard
GPT-5.6 Sol (max)
OpenAI
47.0
72.6 $8.00 Standard
Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)
Anthropic
46.8
50.5 $20.00 Premium
Grok 4.7 (xhigh)
SpaceXAI
46.4
44.4 $3.00 Standard
Grok 4.7 (high)
SpaceXAI
46.3
38.1 $3.00 Standard
MiMo-V2.6-Pro
Xiaomi
46.3
115.9 $0.54 Budget
GPT-6 Astra (low)
OpenAI
45.8
50.1 $20.00 Premium
Qwen3.8 Max (0902)
Alibaba
45.4
42.4 $3.00 Standard
Muse Spark 1.3 (xhigh)
Meta
45.1
432.5 $2.00 Standard
Claude Opus 5 (Adaptive Reasoning, Medium Effort)
Anthropic
44.8
52.6 $10.00 Premium
GLM-5.3 (max)
Z AI
44.8
64.7 $2.15 Standard
Grok 4.6 (high)
SpaceXAI
44.3
70.3 $3.00 Standard
Grok 4.6 (xhigh)
SpaceXAI
44.2
68.1 $3.00 Standard
GPT-5.6 Sol (xhigh)
OpenAI
44.0
74.7 $8.00 Standard
Step 5 Preview
StepFun
43.7
93.3 $1.43 Budget
Kimi K3 (max)
Kimi
43.6
37.7 $6.00 Standard
Grok 4.6 (medium)
SpaceXAI
42.8
65.4 $3.00 Standard
GPT-5.6 Sol (high)
OpenAI
42.3
65.7 $8.00 Standard
GPT-5.6 Terra (max)
OpenAI
42.1
109.3 $4.50 Standard
GLM 5.3 Flash
Z AI
41.8
79.5 $0.24 Budget
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
Anthropic
41.8
0.0 $10.00 Premium
Gemini 3.8 Flash (high)
Google
40.9
365.0 $1.50 Budget
Claude Opus 4.7 (Adaptive Reasoning, Max Effort)
Anthropic
40.7
0.0 $10.00 Premium
Qwen3.8 Max
Alibaba
40.2
0.0 $3.00 Standard
Qwen3.8 2.4T A95B
Alibaba
39.9
40.9 $3.00 Standard
Qwen3.8-Flash-Next
Alibaba
39.8
54.4 $0.23 Budget
Gemini 3.8 Flash (medium)
Google
39.8
0.0 $1.50 Budget
Gemini 3.7 Flash (medium)
Google
39.6
0.0 $1.50 Budget
Muse Spark 1.2 (xhigh)
Meta
39.6
0.0 $2.00 Standard
DeepSeek V4.1 Flash (Reasoning, Max Effort)
DeepSeek
39.5
230.6 $0.53 Budget
Claude Opus 5 (Adaptive Reasoning, Low Effort)
Anthropic
39.4
55.6 $10.00 Premium
GPT-5.6 Sol (medium)
OpenAI
39.2
63.2 $8.00 Standard
Gemini 3.7 Flash (high)
Google
39.1
0.0 $1.50 Budget
GPT-5.4 (xhigh)
OpenAI
39.0
0.0 $5.63 Standard
Grok 4.5 (high)
SpaceXAI
38.8
0.0 $3.00 Standard
GPT-5.5 (xhigh)
OpenAI
38.4
0.0 $11.25 Premium
Claude Sonnet 5 (Adaptive Reasoning, Max Effort)
Anthropic
38.2
85.5 $4.00 Standard
GPT-5.6 Terra (xhigh)
OpenAI
38.0
97.2 $4.50 Standard
GPT-5.6 Luna (max)
OpenAI
37.3
155.8 $0.45 Budget
GPT-5.5 (high)
OpenAI
37.0
0.0 $11.25 Premium
Gemini 3.7 Flash (low)
Google
36.9
0.0 $1.50 Budget
DeepSeek V4 Pro 0813 (Reasoning, Max Effort)
DeepSeek
36.0
86.7 $1.98 Budget
Agnes 3.0 Flash
Sapiens AI
35.5
0.0 $0.08 Budget
Agnes 2.5 Pro Beta
Sapiens AI
35.2
0.0 $0.15 Budget
Grok 4.6 (low)
SpaceXAI
35.1
56.8 $3.00 Standard
DeepSeek V4 Flash Vision (Reasoning, Max Effort)
DeepSeek
34.8
237.5 $0.66 Budget
GPT-5.6 Luna (xhigh)
OpenAI
34.6
154.5 $0.45 Budget
Kimi K3 (low)
Kimi
34.5
37.0 $6.00 Standard
Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)
Anthropic
34.4
73.0 $4.00 Standard
DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
DeepSeek
34.3
0.0 $0.66 Budget
GPT-5.6 Terra (high)
OpenAI
34.2
88.0 $4.50 Standard
Gemini 3.6 Flash (high)
Google
34.0
0.0 $1.50 Budget
GPT-5.5 (medium)
OpenAI
33.8
0.0 $11.25 Premium
Muse Spark 1.1 (xhigh)
Meta
33.7
0.0 $2.00 Standard
GLM-5.2 (max)
Z AI
33.7
0.0 $2.15 Standard
Qwen3.8 27B (xhigh)
Alibaba
33.7
48.3 $1.13 Budget
Gemini 3.5 Flash (medium)
Google
33.6
0.0 $3.38 Standard
Motif 3
Motif Technologies
33.6
0.0 $0.00 Budget
GPT-5.6 Sol (low)
OpenAI
33.5
67.7 $8.00 Standard
Gemini 3.8 Flash (low)
Google
33.5
0.0 $1.50 Budget
Gemini 3.5 Flash (high)
Google
32.6
0.0 $3.38 Standard
GPT-5.3 Codex (xhigh)
OpenAI
32.5
161.7 $4.81 Standard
Motif 3 (Beta)
Motif Technologies
32.3
0.0 $0.00 Budget
GPT-5.6 Luna (high)
OpenAI
32.1
148.4 $0.45 Budget
Claude Opus 4.6 (Adaptive Reasoning, Max Effort)
Anthropic
31.9
0.0 $10.00 Premium
Claude Sonnet 5 (Adaptive Reasoning, High Effort)
Anthropic
31.7
64.9 $4.00 Standard
Muse Spark
Meta
31.3
0.0 $0.00 Budget
Claude Opus 4.7 (Non-reasoning, High Effort)
Anthropic
30.9
0.0 $10.00 Premium
GPT-5.5 (low)
OpenAI
30.7
0.0 $11.25 Premium
K2 Horizon 375B A23B
Institute of Foundation Models
30.5
0.0 $0.00 Budget
DeepSeek V4 Pro 0424 (Reasoning, Max Effort)
DeepSeek
30.4
0.0 $0.54 Budget
GPT-5.2 (xhigh)
OpenAI
30.4
0.0 $4.81 Standard
Apodex 1.1
Apodex
30.4
0.0 $0.98 Budget
DeepSeek V4 Pro 0424 (Reasoning, High Effort)
DeepSeek
30.1
0.0 $0.54 Budget
GPT-5.6 Terra (medium)
OpenAI
30.1
89.4 $4.50 Standard
Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)
Anthropic
30.1
0.0 $6.00 Standard
Gemini 3.1 Pro Preview
Google
29.7
142.6 $4.50 Standard
Qwen3.7 Max
Alibaba
29.5
0.0 $3.75 Standard
MiniMax-M3
MiniMax
29.2
138.9 $0.53 Budget
Claude Opus 4.5 (Reasoning)
Anthropic
29.1
0.0 $10.00 Premium
MiMo-V2-Pro
Xiaomi
28.6
0.0 $0.00 Budget
GPT-5.2 Codex (xhigh)
OpenAI
28.5
0.0 $4.81 Standard
Qwen3.6 Max Preview
Alibaba
28.4
0.0 $2.93 Standard
GPT-5.6 Sol (Non-reasoning)
OpenAI
28.3
64.6 $8.00 Standard
Nex-N2-Pro (based on Qwen3.5-397B-A17B)
Nex AGI
28.2
0.0 $0.00 Budget
Solar Pro 4
Upstage
28.2
50.0 $0.53 Budget
Claude Sonnet 5 (Adaptive Reasoning, Medium Effort)
Anthropic
28.1
72.0 $4.00 Standard
Gemini 3 Pro Preview (high)
Google
28.0
0.0 $4.50 Standard

Meilleurs modèles Text-to-Video

Dernière mise à jour : il y a 19 heures
Données : Artificial Analysis
RangModèleCréateurELO Rating
#1Wan 3.0
Alibaba
1,336
#2Gemini Omni Flash
Google
1,330
#3MiniMax H3
MiniMax
1,302
#4HappyHorse-1.0
Alibaba-ATH
1,287
#5HappyHorse-1.1
Alibaba-ATH
1,272
#6Dreamina Seedance 2.0 720p
ByteDance Seed
1,259
#7Wan2.7-260612
Alibaba
1,243
#8grok-imagine-video
SpaceXAI
1,235
#9Kling 3.0 Omni 1080p (Pro)
KlingAI
1,230
#10PixVerse V5.6
PixVerse
1,230
#11PixVerse V6
PixVerse
1,230
#12Kling 3.0 1080p (Pro)
KlingAI
1,230
#13Vidu Q3 Pro
Vidu
1,226
#14Bach-1.0 Preview
Video Rebirth
1,223
#15PixVerse V5.5
PixVerse
1,219
#16LTX-2.5 Fast
Lightricks
1,217
#17Veo 3.1 Lite
Google
1,216
#18Kling 3.0 Omni 720p (Standard)
KlingAI
1,214
#19Runway Gen-4.5
Runway
1,214
#20Veo 3.1
Google
1,213
#21SkyReels V4
Skywork AI
1,212
#22Veo 3
Google
1,211
#23Kling 3.0 720p (Standard)
KlingAI
1,210
#24Wan 2.7
Alibaba
1,209
#25LTX-2.5 Pro
Lightricks
1,209
#26Veo 3.1 Fast
Google
1,207
#27Kling 2.5 Turbo 1080p
KlingAI
1,203
#28Wan 2.6
Alibaba
1,197
#29Kling 2.6 Pro (January)
KlingAI
1,196
#30Kling O1 Pro (January)
KlingAI
1,193
#31Kling O1 Standard (January)
KlingAI
1,185
#32Ray 3
Luma Labs
1,185
#33Kling 2.6 Standard (January)
KlingAI
1,184
#34Sora 2 Pro
OpenAI
1,179
#35Seedance 1.5 pro
ByteDance Seed
1,176
#36PixVerse V5
PixVerse
1,176
#37Hailuo 2.3
MiniMax
1,176
#38Veo 3 Fast Preview
Google
1,173
#39Vidu Q2
Vidu
1,171
#40Hailuo 02 Standard
MiniMax
1,170
#41Sora 2 (December)
OpenAI
1,168
#42Wan 2.5 Preview
Alibaba
1,160
#43Hailuo 02 Pro
MiniMax
1,154
#44Seedance 1.0
ByteDance Seed
1,136
#45LTX-2 Pro
Lightricks
1,127
#46Kling 2.1 Master
KlingAI
1,127
#47LTX-2 Fast
Lightricks
1,125
#48LTX-2.3 Pro
Lightricks
1,125
#49LTX-2.3 Fast
Lightricks
1,121
#50Wan 2.2 A14B
Alibaba
1,116

Meilleurs modèles Image-to-Video

Dernière mise à jour : il y a 19 heures
Données : Artificial Analysis
RangModèleCréateurELO Rating
#1Gemini Omni Flash
Google
1,369
#2Wan 3.0
Alibaba
1,361
#3Bach 1.0 Pro
Video Rebirth
1,359
#4MiniMax H3
MiniMax
1,354
#5PixVerse V6
PixVerse
1,337
#6Dreamina Seedance 2.0 720p
ByteDance Seed
1,336
#7grok-imagine-video-1.5
SpaceXAI
1,329
#8grok-imagine-video
SpaceXAI
1,326
#9HappyHorse-1.1
Alibaba-ATH
1,312
#10Kling 2.5 Turbo 1080p
KlingAI
1,296
#11HappyHorse-1.0
Alibaba-ATH
1,293
#12Vidu Q3 Pro
Vidu
1,290
#13PixVerse V5.6
PixVerse
1,286
#14SkyReels V4
Skywork AI
1,281
#15Kling 3.0 Omni 1080p (Pro)
KlingAI
1,279
#16PixVerse V5
PixVerse
1,276
#17Kling 3.0 1080p (Pro)
KlingAI
1,276
#18Cosmos3-Super-Image2Video-4Step
NVIDIA
1,274
#19PixVerse V5.5
PixVerse
1,274
#20Kling 3.0 720p (Standard)
KlingAI
1,269
#21Kling 3.0 Omni 720p (Standard)
KlingAI
1,268
#22Wan 2.7
Alibaba
1,268
#23Kling 2.6 Pro (January)
KlingAI
1,265
#24Kling 2.6 Standard (January)
KlingAI
1,263
#25Runway Gen-4.5
Runway
1,263
#26Veo 3.1 Fast
Google
1,259
#27Seedance 1.5 pro
ByteDance Seed
1,256
#28Hailuo 2.3
MiniMax
1,255
#29Hailuo 2.3 Fast
MiniMax
1,254
#30Cosmos3-Super-Image2Video
NVIDIA
1,253
#31Veo 3.1
Google
1,251
#32Hailuo 02 Pro
MiniMax
1,248
#33Hailuo 02 Standard
MiniMax
1,245
#34Wan 2.5 Preview
Alibaba
1,243
#35Veo 3.1 Lite
Google
1,241
#36Vidu Q2 Turbo
Vidu
1,236
#37Seedance 1.0
ByteDance Seed
1,233
#38Vidu Q2 Pro
Vidu
1,232
#39Vidu Q3 Turbo
Vidu
1,229
#40Veo 3
Google
1,225
#41Wan 2.6
Alibaba
1,219
#42Ray 3
Luma Labs
1,215
#43LTX-2.5 Fast
Lightricks
1,214
#44Kling 2.1 Master
KlingAI
1,206
#45Hailuo 02 Fast
MiniMax
1,206
#46LTX-2 Pro
Lightricks
1,201
#47Pika 2.5
Pika Art
1,199
#48LTX-2.5 Pro
Lightricks
1,191
#49LTX-2 Fast
Lightricks
1,189
#50Kling 2.1 Pro
KlingAI
1,184

Meilleurs modèles Text-to-Speech

Dernière mise à jour : il y a 19 heures
Données : Artificial Analysis
RangModèleCréateurELO Rating
#1Sonic 3.6
Cartesia
1,272
#2Qwen-Audio-3.0-TTS-Plus
Alibaba
1,260
#3Realtime TTS-2
Inworld
1,245
#4Simba 3.2
SpeechifyAI
1,237
#5Luna TTS
VUI Labs
1,230
#6Realtime TTS-2 Flash
Inworld
1,210
#7Breeze TTS 2
BreezeBlue
1,204
#8StepAudio 2.5 TTS (Aug 2026)
StepFun
1,199
#9Gemini 3.1 Flash TTS
Google
1,199
#10v3 Conversational
ElevenLabs
1,197
#11Sonic 3.5
Cartesia
1,186
#12Lightning V3.1 Pro (Jul 2026)
Smallest.ai
1,175
#13Soniox TTS Real-Time v2
Soniox
1,175
#14Eleven v3
ElevenLabs
1,167
#15Speech 2.8 HD
MiniMax
1,166
#16Falcon 2
Murf AI
1,155
#17Gradium TTS (Aug 2026)
Gradium
1,150
#18Speech 2.8 Turbo
MiniMax
1,149
#19Fish Audio S2.1 Pro
Fish Audio
1,138
#20Step TTS 2 (Mar 2026)
StepFun
1,133
#21Async Flash v1.5
async
1,130
#22Azure HD 2.5
Microsoft
1,129
#23Speech 2.6 HD
MiniMax
1,127
#24SpaceXAI TTS
SpaceXAI
1,126
#25Fish Audio S2 Pro
Fish Audio
1,121
#26Simba 3.0
SpeechifyAI
1,118
#27Speech 2.6 Turbo
MiniMax
1,114
#28Async Pro v1.0
async
1,113
#29Speech-02-HD
MiniMax
1,112
#30TTS-1 HD
OpenAI
1,100
#31Chatterbox HD
Resemble AI
1,096
#32Speech 2.6
Hithink
1,096
#33Step Audio EditX (Mar 2026)
StepFun
1,094
#34Turbo v2.5
ElevenLabs
1,094
#35Multilingual v2
ElevenLabs
1,092
#36Speech-02-Turbo
MiniMax
1,086
#37TTS-1
OpenAI
1,085
#38Gemini 2.5 Flash Lite TTS
Google
1,080
#39OpenAudio S1
Fish Audio
1,077
#40Voxtral TTS
Mistral
1,075
#41Studio
Google
1,075
#42Flash v2.5
ElevenLabs
1,074
#43Journey
Google
1,072
#44GPT-Realtime-2
OpenAI
1,072
#45Maya 2 Flash
Maya Research
1,068
#46Magpie-Multilingual 357M (Feb 2026)
NVIDIA
1,063
#47Polly Generative
Amazon
1,062
#48T2A-01-HD
MiniMax
1,062
#49Kokoro 82M v1.0
Kokoro
1,061
#50Sonic 3
Cartesia
1,057

Meilleurs modèles Image Editing

Dernière mise à jour : il y a 19 heures
Données : Artificial Analysis
RangModèleCréateurELO Rating
#1GPT Image 2.5 Sunburst (max)
OpenAI
1,180
#2GPT Image 2.5 Flare (max)
OpenAI
1,161
#3MAI-Image-2.6
Microsoft AI
1,133
#4MAI-Image-2.6-Flash
Microsoft AI
1,124
#5GPT Image 2 (high)
OpenAI
1,122
#6Muse Image
Meta
1,116
#7MAI-Image-2.5
Microsoft AI
1,113
#8Seedream 5.0 Pro
ByteDance Seed
1,107
#9Nano Banana 2 (Gemini 3.1 Flash Image)
Google
1,106
#10MAI-Image-2.5-Pro
Microsoft AI
1,106
#11Grok Imagine Image 2.0
SpaceXAI
1,105
#12GPT Image 1.5 (high)
OpenAI
1,103
#13Nano Banana Pro (Gemini 3 Pro Image)
Google
1,096
#14MAI-Image-2.5-Flash
Microsoft AI
1,087
#15grok-imagine-image-quality
SpaceXAI
1,081
#16Qwen-Image-3.0-Pro
Alibaba
1,076
#17grok-imagine-image
SpaceXAI
1,069
#18Luma UNI 1 Max
Luma Labs
1,068
#19HiDream-O1-Edit-1.5
HiDream
1,065
#20Seedream 5.0 Lite
ByteDance Seed
1,055
#21Qwen-Image-3.0
Alibaba
1,048
#22DreamImage 2.0
Newport AI
1,044
#23Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)
Google
1,042
#24Wan 2.7 Pro
Alibaba
1,041
#25Luma UNI 1
Luma Labs
1,039
#26Wan 2.6 Image
Alibaba
1,038
#27Wan 2.7
Alibaba
1,037
#28Seedream 4.5
ByteDance Seed
1,036
#29HunyuanImage 3.0 Instruct (Fal)
Tencent
1,027
#30Qwen Image Edit Plus 2511
Alibaba
1,023
#31Qwen Image 2.0 Pro (2026-04-22)
Alibaba
1,016
#32FLUX.2 [klein] 9B
Black Forest Labs
1,014
#33Seedream 4.0
ByteDance Seed
1,014
#34Eigen Image
Eigen AI
1,013
#35Agnes Image 2.0 Flash
Sapiens AI
1,011
#36Reve V1 (December)
Reve
1,009
#37FLUX.2 [pro]
Black Forest Labs
1,008
#38FLUX.2 [flex]
Black Forest Labs
1,006
#39Step Image Edit 2
StepFun
1,006
#40Kling Image 3.0
KlingAI
1,003
#41Qwen Image Edit Max 2601
Alibaba
1,000
#42FLUX.2 [dev]
Black Forest Labs
1,000
#43FLUX.2 [dev] Turbo
Fal
999
#44FLUX.2 [dev] Flash
Fal
998
#45FLUX.2 [max]
Black Forest Labs
997
#46Nano Banana (Gemini 2.5 Flash Image)
Google
988
#47Wan 2.5 Preview
Alibaba
984
#48P-Image-Edit
Pruna AI
981
#49GPT Image 1 (high)
OpenAI
980
#50Qwen Image Edit Plus 2509
Alibaba
980

Pourquoi ce classement ?

Face à l’explosion du nombre de modèles d’IA (GPT, Claude, Gemini, Llama, Mistral…), il devient difficile de s’y retrouver.

Ce classement compare plus de 500 modèles des principaux acteurs du marché sur plusieurs dimensions objectives.

Qualité

Performance sur des benchmarks académiques reconnus (MMLU Pro, GPQA, Math-500)

Vitesse

Rapidité de génération mesurée en tokens par seconde

Prix

Coût par million de tokens pour optimiser votre budget

Coding

Capacités de programmation et d’assistance au développement

Méthodologie

Source des données

Les données proviennent d’Artificial Analysis, une plateforme indépendante qui réalise des tests automatisés sur tous les modèles accessibles publiquement via API.

Critères d’évaluation

Intelligence Index (0-100)

Score composite qui agrège plusieurs benchmarks académiques de référence :

  • MMLU Pro : questions à choix multiples couvrant 57 domaines de connaissances
  • GPQA : questions de niveau doctorat en sciences
  • Math-500 : problèmes mathématiques avancés

Vitesse (tokens/seconde)

Vitesse de génération mesurée en conditions réelles via les API officielles. Plus le score est élevé, plus le modèle génère rapidement du texte (crucial pour les applications interactives).

Prix ($/1M tokens)

Tarification blended calculée avec un ratio 3:1 (3 tokens en entrée pour 1 token en sortie), représentant un usage typique. Les prix évoluent régulièrement avec la concurrence.

Guide de lecture

Comment lire ce tableau ?

Intelligence Index

Score global de performance intellectuelle. Un score de 50+ indique un modèle frontier capable de raisonnement avancé.

55+Excellence
50-55Très performant
40-50Performant
< 40Basique

Speed (tokens/s)

Vitesse de génération. Important pour les applications nécessitant des réponses rapides (chatbots, assistance).

> 100Très rapide
50-100Rapide
20-50Moyen
< 20Lent

Prix ($/1M tokens)

Coût par million de tokens. Les prix ont fortement baissé grâce à la compétition.

Gratuit$0 (modèles open-source)
Budget< $2 / 1M
Standard$2-10 / 1M
Premium> $10 / 1M

Badges de prix

Des badges colorés indiquent rapidement la catégorie de prix :

BudgetExcellent rapport qualité/prix
StandardÉquilibre performance/coût
PremiumQualité maximale
Cas d’usage

Quel modèle choisir selon votre besoin ?

Consultez notre comparatif détaillé ChatGPT vs Claude vs Gemini vs Mistral pour une analyse approfondie. Voir aussi notre sélection des 15 meilleures IA gratuites en 2026.

Développement / Code

Visez un Quality Index élevé, puis comparez : la plupart des éditeurs publient une variante spécialisée code (suffixe Codex, Coder).

Triez la colonne Quality Index, puis vérifiez le prix : l’écart entre deux variantes d’une même famille est souvent plus grand que l’écart de qualité.

Rédaction / Contenu

Pour produire du contenu au kilomètre, le rapport qualité/prix prime sur la performance brute. Filtrez sur les badges Budget ou Standard.

Les variantes légères (mini, Flash, Haiku) suffisent largement pour articles, emails et descriptions produits.

Analyse / Recherche

Pour du raisonnement complexe, restez sur les modèles dits frontier, au-dessus de 50 de Quality Index.

Privilégiez les modèles de raisonnement, qui décomposent le problème étape par étape avant de répondre.

Usage intensif / Budget

Pour un gros volume à budget contraint, filtrez sur le badge Budget et regardez les modèles open-source.

Certains modèles à moins de $1/1M dépassent aujourd’hui 49 de Quality Index : triez par prix croissant pour les repérer.

Tendances

Tendances actuelles du marché LLM

Restez informé des évolutions de l’IA

Chaque semaine, les nouveaux modèles, les évolutions de prix et les analyses qui comptent.

FAQ

Questions fréquentes

À quelle fréquence ce classement est-il mis à jour ?

Les données sont synchronisées automatiquement chaque jour avec l’API d’Artificial Analysis. Vous consultez toujours les derniers résultats disponibles, incluant les nouveaux modèles et mises à jour de prix.

Pourquoi certains modèles connus ne sont pas dans le classement ?

Seuls les modèles accessibles publiquement via API sont testés et comparés. Les modèles privés, en bêta fermée ou sans API publique ne peuvent pas être inclus dans ce classement indépendant.

Le prix affiché est-il le prix réel que je paierai ?

Le prix blended est une estimation basée sur un ratio 3:1 input/output qui représente un usage typique. Votre coût réel peut varier selon votre cas d’usage. Consultez toujours la tarification officielle de chaque fournisseur pour des chiffres précis.

Un modèle plus cher est-il forcément meilleur ?

Non. Le rapport qualité/prix varie énormément d’un modèle à l’autre : certains modèles classés « Budget », à moins de $1 par million de tokens, dépassent aujourd’hui 49 de Quality Index, là où des modèles « Premium » à plus de $10 plafonnent à peine plus haut. Triez le tableau par prix croissant pour repérer ces écarts. Le choix dépend surtout de votre cas d’usage : pour du contenu simple, un modèle budget suffit amplement.

Comment sont calculés les scores de qualité ?

Artificial Analysis utilise des benchmarks académiques standardisés (MMLU Pro, GPQA, Math-500, etc.) et teste tous les modèles dans les mêmes conditions pour garantir une comparaison objective. Les tests sont automatisés et régulièrement mis à jour.

Puis-je utiliser ces données pour mon projet ?

Les données sont fournies par Artificial Analysis via leur API. Pour toute utilisation commerciale ou redistribution, veuillez consulter leurs conditions d’utilisation sur artificialanalysis.ai. Ce classement est fourni à titre informatif.

Puis-je réutiliser ces données ?

Oui, pour un usage informatif en citant la source. Vérifiez néanmoins les licences et mentions légales des fournisseurs d’origine.

Que signifient les mentions entre parenthèses après le nom d’un modèle ?

Un même modèle est souvent testé sous plusieurs configurations, indiquées entre parenthèses. Les mentions max, xhigh, high, medium et low correspondent au niveau d’effort de raisonnement accordé au modèle : plus il est élevé, meilleure est généralement la qualité, mais plus la réponse est lente et coûteuse. Les suffixes de type mini, nano ou Flash désignent au contraire des versions allégées, pensées pour la vitesse et le faible coût.

Quel est le meilleur modèle pour du code ?

Il n’existe pas de réponse unique, et ce classement ne propose pas de score dédié au code suffisamment fiable pour trancher. En pratique, partez des modèles à fort Quality Index, puis regardez si l’éditeur publie une variante spécialisée (suffixe Codex, Coder). Testez ensuite sur votre propre base de code : la qualité perçue dépend beaucoup du langage, de la taille du contexte et de votre façon de formuler les demandes.