Analyses

Des enquêtes fondées sur les données du Baromètre pour mesurer comment les modèles, les réglages de génération et les protocoles d’évaluation influent sur la qualité des textes.

IA locale

Un classement dynamique des modèles à poids ouverts pour écrire en français, avec filtres de quantification et repères mémoire.

Muse Glimmer 30B à l'écrit : comparatif avec les IA locales

Les deux quantifications de Muse Glimmer ne racontent pas tout à fait la même histoire en français. Nos duels, désormais complétés par quatre comparaisons locales provisoires, aident à choisir sans transformer un premier signal en verdict.

L’IA écrit-elle mieux en français avec ou sans raisonnement ?

Dans l’échantillon direct actuel du Baromètre, le mode avec raisonnement obtient 72,1 % des points sur les duels français. Mais l’échantillon est petit, l’écart change de sens selon le modèle, et aucun vote humain ne compare encore directement les deux réglages.