Ce site est un site officiel de l’ODERSA. Voici comment le savoir

Le domaine officiel

L’adresse de ce site se termine par odersa.org. Chaque service de l’association vit sur un sous-domaine de odersa.org et nulle part ailleurs. Si l’adresse dans la barre de votre navigateur ne finit pas par odersa.org, ce site n’est pas le nôtre.

Gratuit, et sans compte

Tout est ouvert tout de suite. Aucune inscription, aucun compte, aucun mot de passe, aucun abonnement, aucune publicité. Rien n’est réservé à qui paie, puisque rien ne se paie.

Aucune donnée collectée

Ce site ne vous suit pas : ni mouchard, ni cookie de traçage, aucun outil de mesure embarqué dans ces pages, et rien de mesuré sur votre appareil. Notre hébergeur compte les passages de façon agrégée, comme tout serveur qui répond : un total, jamais un profil. Vous n’avez pas à nous croire : ouvrez les outils de développement de votre navigateur, onglet Réseau, et rechargez la page. Vous verrez la liste complète de ce que le site demande. Tout vient de odersa.org, rien ne part ailleurs.

Contenus libres

Les contenus sont publiés sous licence CC BY 4.0. Vous pouvez les copier, les traduire, les imprimer et les redistribuer, pour vos cours comme pour vos proches, à la seule condition de citer l’ODERSA.

Relevés et limites

Résultats et mesures

Cette page appartient au dossier du projet Génération de langage naturel vérifiable. Elle expose les relevés du 28 août 2026 sur l’état courant du système étudié : parc de faits, couverture linguistique, équivalence factuelle et déterminisme. Chaque figure est accompagnée de la table des mêmes données, et la dernière section nomme ce que ces chiffres ne disent pas.

Mesures du – régénérables.

Date de mesure : 28 août 2026 Relevés régénérables sur l’état courant

1. Méthode de mesure

Les chiffres de cette page ne sont pas des estimations, et ne sont pas non plus des records conservés. Ils sont produits par des relevés qui se refont en une commande sur l’état courant du système, et qui écrasent les précédents. La date affichée en tête de page est celle du relevé, pas celle de la rédaction : quand le système évolue, la mesure est refaite et la page change.

Le principe éditorial qui en découle tient en une phrase : la division ne publie que ce qu’elle peut re-mesurer. Un résultat qu’un relevé ne saurait pas reproduire n’a pas sa place ici, même s’il est vrai. C’est aussi la raison pour laquelle aucune comparaison chiffrée avec d’autres systèmes n’apparaît sur ce site : la division mesure ce qu’elle contrôle, et rien d’autre.

Trois familles de relevés se partagent la page. La première décrit ce dont dispose le système, c’est-à-dire son parc de faits structurés. La deuxième mesure ce qu’il produit effectivement, langue par langue et sujet par sujet. La troisième soumet les sorties à des contrôles extérieurs, dont un contrôle négatif destiné à établir que ces contrôles savent échouer.

Casse typographique en bois inclinée, garnie de caractères d’imprimerie en plomb rangés par compartiments, avec un composteur posé au centre.
Casse typographique, Gutenberg-Museum Mainz, photo dronepicr, CC BY 2.0.

Trois définitions opérationnelles fixent le vocabulaire des relevés.

Définition 1 (document complet). Pour un sujet et une langue donnés, une sortie rendue en entier, sans section vide ni erreur de production. Le balayage compte une langue comme couvrante si et seulement si ce document existe.

Définition 2 (omission honnête). L’absence comptée de document, ou d’un fait dans un document, lorsque la matière disponible ne permet pas de l’énoncer correctement. Chaque omission est publiée avec la mesure qu’elle accompagne : couverture et omissions se complètent à 1 000 par construction.

Définition 3 (équivalence factuelle). Deux versions d’un même sujet sont équivalentes si toute valeur de données extraite de l’une, au seuil publié, se retrouve sans conflit dans le référentiel du sujet. Dire moins est permis, dire autre chose ne l’est pas.

2. Le parc de faits

Le système travaille sur 3 444 fiches de faits structurés, réparties en 8 domaines. La répartition est très inégale, et cette inégalité explique une part importante des écarts de couverture observés plus loin : un domaine peu doté en fiches, ou doté de fiches peu denses, produit mécaniquement moins de documents complets.

Fiches de faits structurés par domaine : figures historiques 1 070, villes et lieux 1 003, espèces vivantes 504, événements 445, pays 197, substances 156, inventions 65, objets célestes 4. figures historiques 1 070 villes et lieux 1 003 espèces vivantes 504 événements 445 pays 197 substances 156 inventions 65 objets célestes 4
Figure 1. Fiches de faits structurés par domaine, relevé du 28 août 2026. Les mêmes données figurent au tableau 1.
Tableau 1. Fiches de faits structurés par domaine, 28 août 2026
Domaine Fiches
Figures historiques1 070
Villes et lieux1 003
Espèces vivantes504
Événements445
Pays197
Substances156
Inventions65
Objets célestes4
Total3 444

3. Couverture linguistique, sujet par sujet

Le balayage du 28 août 2026 compte, pour un sujet d’essai donné, combien de langues produisent un document complet sur les 1 000 langues traitées. Les langues restantes ne produisent pas un document dégradé : elles se taisent, et ce silence est compté comme une omission honnête.

Langues produisant un document complet, sur 1 000 langues traitées, balayage du 28 août 2026 : pays (Kenya) 935 ; espèce (lion) 932 ; substance 924 ; figure historique 132. pays (Kenya) 935 / 1 000 espèce (lion) 932 / 1 000 substance 924 / 1 000 figure historique 132 / 1 000
Figure 2. Langues produisant un document complet par sujet d’essai, balayage du 28 août 2026. Les mêmes données figurent au tableau 2, avec la colonne des omissions honnêtes.
Tableau 2. Balayage du 28 août 2026 : langues produisant un document complet et omissions honnêtes, sur 1 000 langues
Sujet d’essai Document produit Omissions honnêtes
Pays (Kenya)93565
Espèce vivante (lion)93268
Substance92476
Figure historique132868

Les deux colonnes de chiffres se complètent à 1 000 : chaque langue qui ne produit pas un document est comptée comme une omission honnête, et aucune n’est perdue en route. La longueur des documents varie fortement selon le sujet : la médiane s’établit à 77 mots pour le sujet pays, à 8 mots pour l’espèce et à 7 mots pour la substance. Un exemple français de fiche pays compte 274 mots, pour un niveau de lecture mesuré à grade 12.

Publier la colonne des omissions n’est pas une précaution rhétorique, c’est une condition de lecture des autres colonnes. Un taux de couverture élevé n’a de sens que si l’on sait ce qu’est devenu le reste : sans cette colonne, rien ne distingue un système qui se tait d’un système qui approxime. Compter les silences est ce qui rend les affirmations lisibles, et c’est pourquoi le domaine le moins couvert figure sur la même figure et dans le même tableau que les mieux dotés.

4. Robustesse multi-sujets

Un relevé sur un sujet unique par domaine se prête au choix arrangeant. Le relevé multi-sujets écarte ce risque par construction : cinq sujets sont retenus par domaine, choisis par ordre lexicographique, donc sans intervention discrétionnaire. La valeur portée pour chaque domaine est la moyenne des langues produisant un document sur ces cinq sujets.

Langues produisant un document, moyenne sur 5 sujets par domaine choisis par ordre lexicographique, sur 1 000 langues, 28 août 2026 : substances 924 ; espèces vivantes 908 ; pays 907 ; événements 900 ; villes et lieux 897 ; figures historiques 273. substances 924 / 1 000 espèces vivantes 908 / 1 000 pays 907 / 1 000 événements 900 / 1 000 villes et lieux 897 / 1 000 figures historiques 273 / 1 000
Figure 3. Langues produisant un document, moyenne sur 5 sujets par domaine choisis par ordre lexicographique, 28 août 2026. Les mêmes données figurent au tableau 3.
Tableau 3. Robustesse multi-sujets, 28 août 2026 : moyenne des langues produisant un document sur 5 sujets par domaine, sur 1 000 langues
Domaine Moyenne sur 5 sujets
Substances924
Espèces vivantes908
Pays907
Événements900
Villes et lieux897
Figures historiques273

Cinq domaines sur six se tiennent dans une bande étroite, ce qui indique que la couverture ne dépend pas du sujet choisi mais de la matière disponible. Le domaine des figures historiques confirme au contraire sa dispersion : selon la densité de la fiche, le nombre de langues produisant un document va de 109 à 902. La limite est donc la donnée disponible, et non le procédé de production, ce que la division dit plutôt que d’écarter le domaine du relevé.

Le même relevé multi-sujets mesure la longueur des documents produits. La figure 4 porte les trente médianes, une par sujet : la position d’une grappe dit la richesse du domaine, son étalement dit la variance à l’intérieur du domaine.

Longueur médiane des documents en mots, cinq sujets par domaine, campagne du 28 août 2026 : pays de 19 à 68 ; événements de 18 à 30 ; villes et lieux de 8 à 16 ; espèces vivantes de 11 à 14 ; figures historiques de 11 à 13 ; substances 7 sur chacun des cinq sujets. pays 19–68 événements 18–30 villes et lieux 8–16 espèces vivantes 11–14 figures historiques 11–13 substances 7
Figure 4. Longueur médiane des documents, en mots, pour chacun des trente sujets de la campagne (cinq par domaine, ordre lexicographique), 28 août 2026. Chaque point est un sujet ; l’axe court de 0 à 70 mots.

La grappe des substances est un point répété : 7 mots de médiane sur chacun des cinq sujets, la signature d’un domaine dont la matière disponible est uniforme d’un sujet à l’autre. À l’opposé, le domaine des pays s’étale de 19 à 68 mots de médiane selon le sujet. Les figures historiques combinent les deux lectures : la couverture y varie de 109 à 902 langues selon la fiche, mais la longueur médiane y reste resserrée, de 11 à 13 mots – ce qui se dit varie peu, c’est le nombre de langues capables de le dire qui varie.

5. Équivalence factuelle et déterminisme

Les deux relevés qui suivent portent sur les sorties elles-mêmes. Le premier vérifie l’équivalence factuelle entre les langues, au sens de la définition 3 : dire moins est permis, dire autre chose ne l’est pas. Les textes produits ont été relus par un vérificateur indépendant du système, qui extrait les valeurs numériques de données et vérifie que chacune se retrouve, sans conflit, dans le référentiel du sujet, sur un seuil publié : les valeurs supérieures ou égales à 10 000, ce qui exclut les années portées par des noms propres. Sur 935 langues relues, 415 valeurs ont été comparées, et aucun conflit n’a été relevé.

Un contrôle qui ne trouve rien n’a de valeur que s’il est capable de trouver quelque chose. Un contrôle négatif accompagne donc le relevé : une valeur corrompue artificiellement injectée dans une sortie a bien été détectée par le vérificateur. C’est cette capacité à échouer qui rend le résultat précédent lisible comme un résultat, et non comme un silence d’instrument.

Le second relevé porte sur le déterminisme. 147 générations ont été répétées dans deux processus séparés, et les 147 empreintes SHA-256 obtenues sont identiques : aucun écart. La reproductibilité annoncée n’est donc pas une propriété interne postulée, mais une égalité constatée de l’extérieur, sur des empreintes que n’importe quel tiers sait calculer.

Processus A Processus B Empreintes SHA-256 147 générations les mêmes 147 générations calculables par un tiers 147 / 147 identiques 0 écart

Schéma 1. Déterminisme inter-processus, relevé du 28 août 2026 : les mêmes 147 générations, rejouées dans deux processus séparés, rendent des empreintes identiques.

Tableau 4. Équivalence factuelle et déterminisme, 28 août 2026
Relevé Valeur
Langues relues par le vérificateur indépendant935
Valeurs numériques comparées415
Conflits relevés0
Générations répétées dans deux processus séparés147
Empreintes SHA-256 identiques147
Écarts relevés0

Propriété P4

Équivalence factuelle entre langues

Les versions d’un même sujet dans des langues différentes portent exactement les mêmes faits : dire moins est permis, dire autre chose ne l’est pas.

Statut : vérifiée de l’extérieur sur le relevé du 28 août 2026, contrôle négatif inclus.

6. La campagne élargie

Les relevés précédents portaient sur un sujet d’essai. La même vérification a ensuite été rejouée à l’échelle : 30 sujets, choisis par ordre lexicographique à raison des 5 premiers de chacun des 6 domaines mesurés, relus dans les 1 000 langues. 1 646 valeurs numériques ont été comparées de l’extérieur, et aucun conflit n’a été relevé. Les contrôles négatifs ont été rejoués sujet par sujet : sur les 8 sujets dont le référentiel porte des valeurs au-dessus du seuil, 8 corruptions injectées, 8 détections.

30 sujets Sorties produites Valeurs extraites Comparaison 8 corruptions ordre lexicographique 30 sujets, 1 000 langues seuil publié, 10 000 et plus entre langues injectées à dessein 1 646 valeurs · 0 conflit 8 / 8 rejetées

Schéma 2. Le circuit de la campagne élargie, 28 août 2026. Le juge est externe : il ne lit que les sorties finies. La branche basse est le contrôle négatif, qui établit que la comparaison sait échouer.

La calibration du vérificateur a été mesurée séparément, dans les deux sens. 105 corruptions artificielles ont été injectées dans des sorties réelles, à raison d’une valeur altérée par texte, sur 15 langues et 8 sujets : 105 détections sur 105. À l’inverse, 113 textes sains ont été relus sans qu’aucune fausse alerte ne soit levée. La sensibilité et la spécificité de l’instrument sont donc mesurées, pas supposées.

Verdict du vérificateur alerte levée silence Réalité texte corrompu (105) texte sain (113) 105 / 105 détections 0 corruption manquée 0 fausse alerte 113 / 113 relus sans alerte Une valeur altérée par texte, 15 langues, 8 sujets.

Schéma 3. Calibration du vérificateur, campagne du 28 août 2026. Les deux cases d’erreur sont vides, et elles sont publiées : un instrument se juge à ses deux colonnes.

Deux relevés de couverture complètent la campagne : les 197 sujets du domaine des pays produisent un document dans chacune des 4 langues témoins (français, anglais, swahili, arabe), et 25 systèmes d’écriture distincts ont été détectés dans les sorties elles-mêmes.

Tableau 5. Campagne élargie du 28 août 2026
Relevé Valeur
Sujets relus (5 par domaine, ordre lexicographique)30
Valeurs numériques comparées entre langues1 646
Conflits relevés0
Corruptions artificielles détectées105 / 105
Fausses alertes sur textes sains0 / 113
Sujets du domaine pays servis dans les 4 langues témoins197 / 197
Systèmes d’écriture détectés dans les sorties25

7. Le détail des systèmes d’écriture

L’écriture dominante de chaque document produit lors de la campagne a été détectée de l’extérieur, par plages Unicode, sans regarder le procédé qui l’a produite. 25 systèmes d’écriture distincts en ressortent. L’alphabet latin domine, et 21 des 25 systèmes ne sont portés que par une ou deux langues chacun : c’est la longue traîne typographique que le traitement égal des langues doit servir correctement, jusqu’au tibétain ou à l’oriya.

Tableau 6. Systèmes d’écriture détectés dans les sorties de la campagne, par nombre de langues, 28 août 2026
Système d’écriture Langues
Latin895
Cyrillique9
Arabe6
Devanagari3
Éthiopien2
Bengali2
Hébreu2
Sinogrammes2
Grec1
Arménien1
Géorgien1
Hiragana et katakana1
Hangeul1
Thaï1
Lao1
Birman1
Tibétain1
Tamoul1
Télougou1
Kannada1
Malayalam1
Oriya1
Gurmukhi1
Gujarati1
Cinghalais1

8. Limites

Le domaine des figures historiques est le moins couvert de tous, et l’écart n’est pas marginal : 132 langues sur 1 000 pour le sujet d’essai, 273 en moyenne sur cinq sujets, avec une dispersion de 109 à 902 selon la densité de la fiche. Ce domaine est aussi celui qui compte le plus de fiches, ce qui écarte l’explication par la rareté des sujets et renvoie à la densité de la matière disponible dans chaque langue.

La longueur des documents est faible hors du domaine des pays. Les médianes de 8 et 7 mots relevées pour l’espèce et la substance décrivent des documents brefs, utilisables comme fiches de faits mais pas encore comme contenus pédagogiques complets. La division préfère publier ces médianes que les taire : elles disent où le travail reste à faire.

Enfin, tous les chiffres de cette page sont mesurés sur l’état courant du système et régénérés à chaque évolution. Ils ne décrivent pas un système figé, et un relevé ultérieur pourra les déplacer dans un sens comme dans l’autre. La date en tête de page est donc une donnée du résultat, pas une mention d’archive.

9. Menaces à la validité

La portée de ces relevés appelle cinq réserves, que la division énonce elle-même plutôt que de les laisser découvrir.

Le vérificateur d’équivalence ne compare que les valeurs numériques supérieures ou égales à 10 000, seuil publié qui exclut les années portées par des noms propres. 22 des 30 sujets de la campagne élargie ne portent aucune valeur au-dessus de ce seuil : pour ces sujets, l’équivalence relève des contrôles mécaniques internes, pas de ce juge externe.

L’équivalence porte sur les valeurs de données au seuil publié, non sur la précision d’affichage. Une version peut arrondir une valeur en l’annonçant – écrire « environ 1 208 000 » là où une autre version écrit 1 208 333 –, et cela se voit dans les démonstrations : le vérificateur compare chaque valeur extraite au référentiel du sujet, qui porte les deux formes, et l’arrondi annoncé relève du dire moins, jamais du dire autre chose.

Les sujets d’essai restent peu nombreux : un par domaine pour le balayage, cinq pour la robustesse. L’ordre lexicographique écarte le choix arrangeant ; il n’établit pas, à lui seul, la représentativité des sujets retenus.

Le déterminisme est constaté entre deux processus séparés d’une même machine ; la reproductibilité entre machines distinctes n’a pas encore fait l’objet d’un relevé publié.

Enfin, la couverture compte des documents produits, jamais leur richesse : les longueurs médianes publiées avec le balayage bornent cette lecture, et des médianes de 7 et 8 mots hors du domaine des pays décrivent des fiches de faits, non des leçons.

Citer cette page

Les mesures de cette page sont datées et régénérables : une citation porte donc la date de mesure, jamais une date de consultation seule.

ODERSA Research (division de recherche de l’ODERSA). « Résultats et mesures », mesures du 28 août 2026. https://research.odersa.org/resultats

Au format BibTeX :

@misc{odersa_research_mesures_2026,
  author       = {{ODERSA Research}},
  title        = {R\'esultats et mesures},
  organization = {ODERSA},
  year         = {2026},
  howpublished = {\url{https://research.odersa.org/resultats}},
  note         = {Mesures du 28 ao\^ut 2026, r\'eg\'en\'erables}
}

À lire ensuite

Raccourcis clavier

TabNaviguer de lien en lien
EntréeOuvrir le lien ou plier/déplier une question
?Ouvrir cette aide
ÉchapFermer le panneau ou cette aide