Résultats des juges IA

Chaque juge reçoit deux réponses anonymes à la même consigne rédigée nativement en français. Il choisit le meilleur texte ou déclare une égalité, sans connaître le nom des modèles.

Un juge peut aussi évaluer une paire contenant une réponse de son propre modèle ; l’identité des réponses reste masquée pendant sa décision.

Les tableaux additionnent tous les duels validés et publiés, juge par juge : victoires, défaites, égalités et nombre de confrontations. Les noms sont masqués pendant le vote, afin que le verdict porte sur le texte plutôt que sur la marque qui l’a produit.

Les rangs suivent d’abord le nombre total de victoires, et non le taux de victoire ou la force des adversaires ; lorsque la couverture varie, lisez victoires, défaites et égalités avec le nombre de confrontations.

Pour les catégories d’écriture sélectionnées, les rangs sont attribués avant que les filtres d’éditeur, de taille, de statut du modèle, de mode de génération et d’accès ne masquent des modèles ; la numérotation visible peut donc conserver des écarts.

Les juges IA permettent de comparer beaucoup de paires avec un protocole constant. Ils ne remplacent pas les lecteurs : les votes du public alimentent un classement humain séparé, qui révèle les points d’accord et de désaccord entre humains et machines.

Dernier verdict inclus :

Claude Fable 5

1027 verdicts de duels validés

Résultats de Claude Fable 5
Rang Modèle Victoires Défaites Égalités Confrontations
1 Claude Fable 5 High 💡 754 58 42 854
2 MiniMax M3 💡 36 48 6 90
3 Claude Opus 5 💡 28 9 8 45
4 DeepSeek V4 Pro 💡 22 47 3 72
6 MiMo V2.5 Pro 💡 14 60 3 77
9 Qwen3.7 Plus 💡 11 60 3 74
11 Gemma 4 31B Q8_0 💡 🏠 9 37 0 46
12 Gemma 4 12B Q8_0 (sans raisonnement) 🏠 7 13 0 20
13 GPT-5.6 Terra 💡 6 39 0 45
14 DeepSeek V4 Flash 💡 6 62 3 71
15 Gemma 4 12B Q8_0 💡 🏠 5 29 2 36
16 MiMo V2.5 💡 5 71 1 77
17 Qwen3.6 35B A3B Q8_0 💡 🏠 3 27 0 30
18 Gemma 4 26B A4B Q8_0 💡 🏠 3 39 1 43
19 Qwen3.6 35B A3B Q8_0 (sans raisonnement) 🏠 2 17 1 20
21 Kimi K3 💡 2 30 13 45
22 GPT-5.6 Sol 💡 2 36 6 44
23 GPT-5.6 Luna 💡 2 43 0 45
24 Gemma 4 31B QAT-Q4_0 (sans raisonnement) 🏠 0 6 0 6
25 Gemma 4 12B QAT-Q4_0 💡 🏠 0 9 0 9
26 Gemma 4 26B A4B QAT-Q4_0 💡 🏠 0 9 0 9
27 Qwen3.6 35B A3B Q4_K_M 💡 🏠 0 9 0 9
28 Gemma 4 31B QAT-Q4_0 💡 🏠 0 11 0 11
29 Mistral Medium 3.5 128B Q4_K_M (sans raisonnement) 🏠 0 11 0 11

Claude Opus 4.8

420 verdicts de duels validés

Résultats de Claude Opus 4.8
Rang Modèle Victoires Défaites Égalités Confrontations
1 Qwen3.6 35B A3B Q4_K_M 💡 🏠 47 62 1 110
2 MiniMax M3 💡 42 12 0 54
4 Claude Fable 5 High 💡 33 0 0 33
5 Gemma 4 26B A4B QAT-Q4_0 💡 🏠 33 24 0 57
6 Gemma 4 31B Q8_0 💡 🏠 30 79 0 109
7 Gemma 4 12B QAT-Q4_0 💡 🏠 28 30 1 59
8 Gemma 4 12B Q8_0 💡 🏠 27 32 0 59
9 Qwen3.6 35B A3B Q8_0 💡 🏠 20 39 1 60
10 MiMo V2.5 Pro 💡 18 3 0 21
11 DeepSeek V4 Pro 💡 16 6 0 22
12 DeepSeek V4 Flash 💡 13 9 0 22
14 MiMo V2.5 💡 12 9 0 21
15 Qwen3.7 Plus 💡 11 10 0 21
17 Gemma 4 26B A4B Q8_0 💡 🏠 9 23 0 32
18 Qwen3.6 35B A3B Q8_0 (sans raisonnement) 🏠 6 8 0 14
19 Gemma 4 31B QAT-Q4_0 💡 🏠 4 2 0 6
21 Gemma 4 12B Q8_0 (sans raisonnement) 🏠 4 10 0 14
23 Mistral Medium 3.5 128B Q4_K_M (sans raisonnement) 🏠 1 3 0 4
24 GPT-5.6 Sol 💡 0 1 0 1
25 Gemma 4 31B QAT-Q4_0 (sans raisonnement) 🏠 0 3 0 3

Claude Opus 5

16412 verdicts de duels validés

Résultats de Claude Opus 5
Rang Modèle Victoires Défaites Égalités Confrontations
1 Claude Fable 5 High 💡 677 11 8 696
2 Claude Opus 5 💡 532 1 1 534
3 Kimi K3 💡 488 39 6 533
4 Claude Sonnet 5 💡 463 63 8 534
5 MiniMax M3 💡 430 98 6 534
7 GPT-5.6 Sol 💡 410 102 19 531
8 DeepSeek V4 Pro 💡 386 136 14 536
9 Muse Glimmer 30B K-Quant 17GB 💡 🏠 380 177 12 569
10 Muse Glimmer 30B K-Quant Dynamic 💡 🏠 376 183 11 570
11 GPT-5.6 Terra 💡 369 146 18 533
12 GPT-5.6 Luna 💡 358 154 21 533
13 Qwen3.7 Plus 💡 355 161 18 534
14 MiMo V2.5 Pro 💡 338 191 5 534
18 DeepSeek V4 Flash 💡 298 236 4 538
19 Gemma 4 26B A4B Q8_0 💡 🏠 281 247 23 551
20 Mistral Medium 3.5 128B Q4_K_M (sans raisonnement) 🏠 276 242 14 532
21 Gemma 4 26B A4B QAT-Q4_0 💡 🏠 254 251 28 533
22 Gemma 4 31B QAT-Q4_0 💡 🏠 252 261 22 535
23 MiMo V2.5 💡 242 279 13 534
25 Gemma 4 31B Q8_0 💡 🏠 230 293 14 537
26 Gemma 4 12B Q8_0 💡 🏠 228 310 17 555
27 Gemma 4 12B QAT-Q4_0 💡 🏠 225 293 18 536
28 Qwen3.6 35B A3B Q8_0 💡 🏠 220 344 9 573
29 GLM 5.3 💡 217 16 1 234
31 Gemma 4 12B Q8_0 (sans raisonnement) 🏠 207 325 9 541
32 Qwen3.8 27B Q4_K_M 💡 🏠 206 51 8 265
33 Gemma 4 31B QAT-Q4_0 (sans raisonnement) 🏠 200 370 17 587
34 Qwen3.8 27B Q8_0 💡 🏠 188 52 19 259
35 GLM 5.3 Flash 💡 187 35 11 233
36 Inkling 💡 186 46 2 234
37 Muse Spark 1.2 💡 185 40 11 236
38 Nemotron 3 Super 120B A12B Q4_K_M 💡 🏠 185 338 13 536
39 Seed 2.1 Turbo (sans raisonnement) 183 47 6 236
40 Qwen3.6 35B A3B Q4_K_M 💡 🏠 175 356 7 538
41 Qwen3.8 Flash 💡 173 48 12 233
42 Qwen3.8 Max 💡 173 60 3 236
43 Hy4 Preview 💡 167 49 17 233
44 Qwen3.8 27B Q6_K 💡 🏠 154 97 17 268
45 Gemma 4 26B A4B Q8_0 (sans raisonnement) 🏠 148 80 26 254
46 Aion 3.0 💡 144 68 24 236
47 Gemma 4 31B Q6_K 💡 🏠 135 105 19 259
48 Gemma 4 26B A4B Q6_K (sans raisonnement) 🏠 133 109 16 258
49 Qwen3.8 27B Q6_K (sans raisonnement) 🏠 131 106 13 250
50 Qwen3.6 35B A3B Q8_0 (sans raisonnement) 🏠 131 413 2 546
51 Hy3 💡 127 106 5 238
52 Grok 4.6 💡 127 108 0 235
53 Gemma 4 26B A4B QAT-Q4_0 (sans raisonnement) 🏠 127 120 15 262
54 Gemma 4 E4B Q8_0 (sans raisonnement) 🏠 127 408 5 540
55 Gemma 4 26B A4B Q6_K 💡 🏠 126 114 14 254
57 Gemma 4 12B QAT-Q4_0 (sans raisonnement) 🏠 117 130 9 256
58 Mistral Medium 3.5 💡 113 119 4 236
59 Qwen3.8 27B Q8_0 (sans raisonnement) 🏠 111 148 2 261
60 Gemma 4 31B Q6_K (sans raisonnement) 🏠 105 147 6 258
61 Gemma 4 12B Q6_K (sans raisonnement) 🏠 104 139 11 254
62 Qwen3.8 27B Q4_K_M (sans raisonnement) 🏠 103 138 13 254
63 Gemma 4 E4B Q8_0 💡 🏠 100 429 4 533
64 Gemma 4 31B Q8_0 (sans raisonnement) 🏠 85 162 4 251
65 Gemma 4 E4B Q6_K (sans raisonnement) 🏠 81 170 6 257
66 Gemma 4 12B Q6_K 💡 🏠 79 179 6 264
67 Gemma 4 E4B Q6_K 💡 🏠 70 187 4 261
68 Gemma 4 E4B Q4_K_M (sans raisonnement) 🏠 66 188 2 256
69 Nemotron 3 Nano Omni 30B A3B Q4_K_M 💡 🏠 59 469 8 536
70 Gemma 4 E2B Q4_K_M 💡 🏠 56 481 3 540
71 Gemma 4 E2B Q6_K 💡 🏠 55 183 11 249
72 Gemma 4 E2B Q8_0 💡 🏠 55 484 1 540
74 Gemma 4 E2B Q8_0 (sans raisonnement) 🏠 45 200 6 251
75 Qwen3.6 35B A3B Q4_K_M (sans raisonnement) 🏠 44 212 1 257
76 Gemma 4 E2B Q6_K (sans raisonnement) 🏠 43 208 2 253
77 Granite 4.2 30B Q6_K 💡 🏠 42 184 8 234
78 Gemma 4 E4B Q4_K_M 💡 🏠 40 214 4 258
79 Gemma 4 E2B Q4_K_M (sans raisonnement) 🏠 31 217 1 249
80 Granite 4.2 30B Q8_0 💡 🏠 30 198 6 234
81 Granite 4.2 30B Q4_K_M 💡 🏠 22 211 1 234
82 Nemotron 3 Nano Omni 30B A3B Q8_0 💡 🏠 12 238 1 251
83 Granite 4.2 8B Q8_0 💡 🏠 8 225 1 234
84 Granite 4.2 8B Q4_K_M 💡 🏠 6 225 3 234
85 Granite 4.2 8B Q6_K 💡 🏠 3 224 1 228

GPT-5.6 Sol

20820 verdicts de duels validés

Résultats de GPT-5.6 Sol
Rang Modèle Victoires Défaites Égalités Confrontations
1 Claude Fable 5 High 💡 1909 92 1 2002
2 GPT-5.6 Sol 💡 842 87 2 931
3 Claude Opus 5 💡 540 5 0 545
4 Kimi K3 💡 508 35 1 544
5 Gemma 4 26B A4B QAT-Q4_0 💡 🏠 499 586 0 1085
6 Gemma 4 12B QAT-Q4_0 💡 🏠 491 614 0 1105
7 DeepSeek V4 Flash 💡 476 478 0 954
8 DeepSeek V4 Pro 💡 471 297 0 768
9 Claude Sonnet 5 💡 439 109 0 548
10 GPT-5.6 Luna 💡 429 114 1 544
11 Mistral Medium 3.5 128B Q4_K_M (sans raisonnement) 🏠 419 603 1 1023
12 Qwen3.7 Plus 💡 398 235 0 633
13 GPT-5.6 Terra 💡 392 152 0 544
15 Qwen3.8 Flash 💡 354 170 0 524
16 Hy4 Preview 💡 344 163 0 507
18 Muse Glimmer 30B K-Quant 17GB 💡 🏠 338 195 0 533
19 Gemma 4 31B QAT-Q4_0 💡 🏠 337 314 0 651
20 MiMo V2.5 Pro 💡 335 296 2 633
21 MiniMax M3 💡 329 257 0 586
22 GLM 5.3 Flash 💡 308 208 0 516
23 Gemma 4 26B A4B Q8_0 💡 🏠 308 311 0 619
24 Muse Glimmer 30B K-Quant Dynamic 💡 🏠 306 227 0 533
26 Gemma 4 31B Q8_0 💡 🏠 298 419 2 719
27 Gemma 4 12B Q8_0 💡 🏠 292 313 1 606
28 Qwen3.6 35B A3B Q4_K_M 💡 🏠 279 624 0 903
29 Muse Spark 1.2 💡 278 51 1 330
30 MiMo V2.5 💡 270 359 1 630
31 GLM 5.3 💡 260 58 0 318
32 Gemma 4 12B Q8_0 (sans raisonnement) 🏠 249 381 1 631
34 Qwen3.6 35B A3B Q8_0 💡 🏠 240 330 0 570
35 Qwen3.8 Max 💡 229 88 0 317
36 Aion 3.0 💡 214 114 0 328
37 Nemotron 3 Super 120B A12B Q4_K_M 💡 🏠 214 332 0 546
39 Gemma 4 31B QAT-Q4_0 (sans raisonnement) 🏠 208 339 1 548
40 Gemma 4 31B Q6_K 💡 🏠 206 84 0 290
41 Qwen3.8 27B Q4_K_M 💡 🏠 201 94 0 295
42 Qwen3.8 27B Q8_0 💡 🏠 200 92 1 293
43 Seed 2.1 Turbo (sans raisonnement) 200 130 0 330
45 Gemma 4 26B A4B Q6_K 💡 🏠 188 110 1 299
46 Inkling 💡 188 138 1 327
47 Qwen3.8 27B Q6_K 💡 🏠 182 108 1 291
48 Qwen3.8 27B Q6_K (sans raisonnement) 🏠 177 121 1 299
49 Hy3 💡 176 153 0 329
50 Gemma 4 26B A4B Q8_0 (sans raisonnement) 🏠 174 102 0 276
51 Gemma 4 12B QAT-Q4_0 (sans raisonnement) 🏠 163 113 1 277
52 Gemma 4 31B Q8_0 (sans raisonnement) 🏠 162 131 0 293
53 Gemma 4 26B A4B Q6_K (sans raisonnement) 🏠 161 134 1 296
54 Gemma 4 12B Q6_K (sans raisonnement) 🏠 159 141 2 302
55 Gemma 4 E4B Q8_0 (sans raisonnement) 🏠 156 362 0 518
56 Gemma 4 26B A4B QAT-Q4_0 (sans raisonnement) 🏠 153 121 3 277
57 Gemma 4 31B Q6_K (sans raisonnement) 🏠 144 149 0 293
58 Mistral Medium 3.5 💡 141 179 0 320
59 Qwen3.6 35B A3B Q8_0 (sans raisonnement) 🏠 133 471 0 604
60 Gemma 4 E4B Q8_0 💡 🏠 129 391 0 520
61 Gemma 4 E4B Q6_K (sans raisonnement) 🏠 123 171 0 294
62 Qwen3.8 27B Q4_K_M (sans raisonnement) 🏠 120 178 0 298
63 Gemma 4 12B Q6_K 💡 🏠 115 180 1 296
64 Gemma 4 E2B Q8_0 💡 🏠 111 417 0 528
65 Granite 4.2 30B Q8_0 💡 🏠 100 383 0 483
66 Grok 4.6 💡 99 219 0 318
67 Gemma 4 E2B Q6_K 💡 🏠 96 202 1 299
68 Gemma 4 E4B Q4_K_M (sans raisonnement) 🏠 96 203 0 299
69 Gemma 4 E2B Q4_K_M 💡 🏠 96 432 0 528
70 Granite 4.2 30B Q6_K 💡 🏠 87 225 0 312
71 Nemotron 3 Nano Omni 30B A3B Q4_K_M 💡 🏠 84 462 0 546
72 Gemma 4 E2B Q6_K (sans raisonnement) 🏠 82 215 0 297
74 Gemma 4 E2B Q8_0 (sans raisonnement) 🏠 80 213 0 293
75 Qwen3.8 27B Q8_0 (sans raisonnement) 🏠 78 217 0 295
76 Gemma 4 E4B Q6_K 💡 🏠 75 220 0 295
77 Gemma 4 E2B Q4_K_M (sans raisonnement) 🏠 68 225 0 293
79 Qwen3.6 35B A3B Q4_K_M (sans raisonnement) 🏠 63 215 0 278
80 Nemotron 3 Nano Omni 30B A3B Q8_0 💡 🏠 58 281 0 339
81 Granite 4.2 30B Q4_K_M 💡 🏠 56 420 0 476
82 Gemma 4 E4B Q4_K_M 💡 🏠 53 245 0 298
83 Granite 4.2 8B Q8_0 💡 🏠 20 292 0 312
84 Granite 4.2 8B Q4_K_M 💡 🏠 17 449 0 466
85 Granite 4.2 8B Q6_K 💡 🏠 9 448 0 457

Les IA ont voté. À vous de jouer.

Un juge IA peut lire des milliers de duels sans café ni pause déjeuner. Mais il ne sait pas ce qui vous fait rire, vous touche ou vous donne envie de continuer à lire. Votre vote à l’aveugle nourrit un classement humain séparé et nous aide à repérer les désaccords les plus intéressants entre humains et machines.

Comparer deux textes à l’aveugle