Ce site est un site officiel de l’ODERSA. Voici comment le savoir

Le domaine officiel

L’adresse de ce site se termine par odersa.org. Chaque service de l’association vit sur un sous-domaine de odersa.org et nulle part ailleurs. Si l’adresse dans la barre de votre navigateur ne finit pas par odersa.org, ce site n’est pas le nôtre.

Gratuit, et sans compte

Tout est ouvert tout de suite. Aucune inscription, aucun compte, aucun mot de passe, aucun abonnement, aucune publicité. Rien n’est réservé à qui paie, puisque rien ne se paie.

Aucune donnée collectée

Ce site ne vous suit pas : ni mouchard, ni mesure d’audience, ni cookie de traçage. Vous n’avez pas à nous croire : ouvrez les outils de développement de votre navigateur, onglet Réseau, et rechargez la page. Vous verrez la liste complète de ce que le site demande. Tout vient de odersa.org, rien ne part ailleurs.

Contenus libres

Les contenus sont publiés sous licence CC BY 4.0. Vous pouvez les copier, les traduire, les imprimer et les redistribuer, pour vos cours comme pour vos proches, à la seule condition de citer l’ODERSA.

Ce sur quoi ce cours s’appuie

Chaque cadre officiel, chaque source scientifique, chaque police et chaque corpus embarqué dans The AI Manual est répertorié ici, avec une adresse qui s’ouvre et se vérifie.

Une attribution fausse serait pire qu’une attribution absente. Chaque source de cette page a été ouverte à son adresse avant d’être citée ici : rien n’y est recopié de mémoire.

Les cadres officiels

The AI Manual met en forme quatre cadres internationaux de littératie en intelligence artificielle, et les pièces qui les précisent ou les rattachent au droit européen. Vérifiés en ligne le 13 août 2026.

Les travaux scientifiques et techniques, par thème

Chaque affirmation technique de ce cours porte une publication vérifiée en ligne le 13 août 2026, réunie ici par thème plutôt qu’alignée en une seule liste illisible.

Tokenisation

Ces travaux établissent comment un texte se découpe en unités plus petites qu’un mot, et pourquoi ce découpage coûte plus cher dans certaines langues que dans d’autres.

Prédiction et échantillonnage

Ces travaux montrent comment un modèle choisit un mot dans une distribution de probabilité, et comment la température et les coupes top-k ou top-p changent ce choix.

Hallucination

Ces travaux expliquent pourquoi un modèle invente avec aplomb : une conséquence de la façon dont il est entraîné et évalué, pas une panne isolée.

Biais

Ces travaux mesurent que les biais humains présents dans les corpus d’entraînement se retrouvent, mesurables, dans les modèles qui en sont issus.

Mémorisation des données

Ces travaux démontrent qu’un modèle peut restituer mot pour mot des fragments de ses données d’entraînement, y compris des informations personnelles, par simple interrogation.

Image fabriquée

Ces travaux identifient les artefacts techniques qui trahissent une image générée, et notent que l’œil humain ne les voit plus dans les visages de synthèse récents.

Voix fabriquée

Ces travaux situent la détection de voix synthétique et ses limites, et une autorité publique documente un usage frauduleux réel d’une voix clonée.

Filigranes et provenance

Ces travaux décrivent les deux familles de preuve d’origine, un manifeste attaché au fichier et un filigrane statistique inséré dans le texte généré, et leurs limites respectives.

Détecteurs

Ces travaux montrent que les détecteurs de texte généré par IA se trompent, avec un biais documenté contre les locuteurs non natifs d’une langue, au point qu’un éditeur a retiré le sien.

Coût matériel

Ces travaux chiffrent une consommation d’énergie en forte croissance, disproportionnée face à une tâche équivalente confiée à un système spécialisé.

Les polices

Les deux polices du système sont embarquées en woff2, dans site/assets/css/fonts/ : aucune requête vers un service de polices, aucun CDN. Leur licence a été relue en ligne le 14 août 2026, à l’adresse du fichier qui la porte.

La licence SIL Open Font License autorise l’usage, la modification et la redistribution des deux polices, à la seule condition de ne pas les revendre séparément et de conserver la licence avec elles.

Les corpus des démonstrations

Une seule œuvre tierce est embarquée dans les démonstrations, et elle est du domaine public. Un second texte, entièrement d’origine ODERSA, sert à comparer un même contenu selon la langue.

Un texte du domaine public

Le Tour du monde en quatre-vingts jours, Jules Verne, 1873. Domaine public : Jules Verne est mort le 24 mars 1905, et son œuvre en français est libre de droits partout depuis longtemps. Les 623 premiers paragraphes du roman, soit environ 25 288 mots, forment le corpus sur lequel s’entraîne le modèle jouet de ce cours. Les seules retouches, toutes réversibles et déclarées dans le fichier du corpus, sont typographiques : apostrophes rendues typographiques, tirets et guillemets de la transcription retirés, marques d’italique retirées, titres de chapitre et table des matières écartés. Un modèle qui n’a lu que ce texte de 1873 ne peut rien savoir de ce qui s’est passé depuis : c’est exactement ce que la démonstration met en évidence.

Un texte maison

La même phrase, dans les 7 langues que la flotte de l’ODERSA prévoit de servir, sert à comparer combien d’unités un même sens demande selon la langue. Ce texte est celui de la bannière de confiance de l’ODERSA elle-même, déjà publié sous licence CC BY 4.0 : ce n’est pas un corpus tiers, et il ne pose donc aucune question de droits.

Le moteur qui fait tourner ces démonstrations, tire dans ces corpus et calcule des probabilités, est un code écrit par l’ODERSA : ce n’est pas une bibliothèque tierce, et ce site n’en embarque aucune.

Les schémas

Chaque schéma de ce site est un SVG dessiné à la main par l’ODERSA, sans photographie ni image appelée à un domaine tiers. Chacun est réutilisable sous licence CC BY 4.0, comme le reste du site, et sa légende porte cette mention.

C’est ce qui permet à la bannière de confiance de promettre qu’aucune requête ne sort de l’appareil qui ouvre ce site : aucune image, comme aucune police et aucun script, n’est appelée à distance.

Les photographies

Chaque photographie de The AI Manual illustre une page précise, et sa légende, sous l’image, porte déjà l’auteur. Ce tableau réunit chacune avec sa licence complète, l’adresse qui la prouve sur Wikimedia Commons, et la page qui la sert.

Les photographies embarquées dans The AI Manual : ce qu’elles montrent, leur auteur, leur licence et la page qui les sert
Ce qu’elle montre Auteur Licence Preuve sur Wikimedia Commons Servie sur
Un clavier d’ordinateur portable rétroéclairé, la plupart des doigts posés sur la rangée de repos, la touche U enfoncée Colin CC BY-SA 4.0 Page du fichier Accueil
La salle de lecture de la bibliothèque Sainte-Geneviève à Paris, ses longues tables et ses rayonnages sous une voûte JOHN TOWNER heytowner CC0 Page du fichier D’où viennent les biais
Un local technique où convergent des dizaines de câbles réseau branchés sur des panneaux de brassage Brian Hankins (Bhankins) Public domain Page du fichier Ce qu’on lui donne
Un photographe accroupi au bord d’un terrain de football, un long téléobjectif à la main Ximeg CC BY-SA 3.0 Page du fichier Une image fabriquée
Plusieurs microphones montés sur pieds autour d’une batterie, dans un studio d’enregistrement dan paluska CC BY 2.0 Page du fichier Une voix fabriquée
Un amphithéâtre vide, ses rangées de sièges et de tablettes vues depuis le fond de la salle Yinan Chen Public Domain Page du fichier Pour enseigner

Deux de ces photographies, le clavier de l’accueil et le photographe de la page Une image fabriquée, sont sous une licence de partage à l’identique, CC BY-SA. Le texte de The AI Manual est sous CC BY 4.0, comme l’annonce la licence ; ces deux photographies gardent leur propre licence, elles n’y basculent pas. Reprendre la page qui les porte oblige à rediffuser la photographie sous cette même licence de partage à l’identique, avec son attribution, pas sous les termes du reste du site.

Toutes les photographies de cette page sont embarquées dans ce dépôt et servies depuis le domaine du site, jamais appelées à une adresse tierce, comme les polices et les schémas. C’est ce qui permet à la bannière de confiance de promettre qu’aucune requête ne sort de l’appareil qui ouvre ce site.

Ce que ce site ne doit à personne d’autre

Cela se vérifie en quelques secondes, à l’onglet Réseau du navigateur, pendant que la page se charge : aucune requête n’en sort.

Comment ces crédits se maintiennent

Une source périmée, une adresse qui a changé, une attribution mal posée : cela se signale, sans compte ni formulaire. Les conditions de réutilisation de ce site sont décrites dans la licence.