Les évolutions du Baromètre

Le relevé horodaté des améliorations publiques, de leurs contrôles et du consensus entre deux modèles exigé avant publication.

Des résultats IA plus rapides, avec le bon nom de modèle

Les classements détaillés des juges IA s’affichent plus vite lors des visites suivantes et Claude Opus 4.8 retrouve partout son nom exact.

  • Moyen: Le cache public existant, limité à cinq minutes, couvre désormais les catégories et les classements agrégés des juges IA. Chaque langue et sélection de catégories dispose de sa propre entrée, tandis que les filtres travaillent sur des copies indépendantes.
  • Petit: Le sommaire, le titre du juge et l’intitulé du tableau affichent maintenant « Claude Opus 4.8 » au lieu de « Claude Opus 4 8 ».

Contrôles: Tests ciblés du cache et du nom, suite Django complète, contrôle public des quatre éditions et validation indépendante par Opus 5.

Un audit toutes les huit heures, avec garde-fous

Le Baromètre peut désormais progresser à intervalles réguliers sans confier sa maintenance à une automatisation sans contrôle.

  • Moyen: Mise en place d’un audit systemd borné toutes les huit heures. GPT-5.6 Sol ne peut appliquer que les changements approuvés indépendamment par Claude Opus 5.
  • Petit: Ajout de garde-fous qui imposent le retour à la version précédente si les tests, les contrôles publics ou la relecture après publication échouent.
  • Petit: Publication de ce journal horodaté dans quatre éditions rédigées séparément.

Contrôles: Suite Django complète, contrôles publics des quatre sites et validation indépendante par Opus 5 obligatoires.