Dans une publication sur X, Andrej Karpathy décrit plusieurs formats qu’il utilise pour obtenir des explications plus faciles à lire et à examiner. Sa réflexion porte sur la manière dont un modèle structure ses réponses.
Chercheur et enseignant en intelligence artificielle, Karpathy a fait partie des membres fondateurs d’OpenAI et a dirigé les travaux sur l’IA chez Tesla. Il a rejoint en mai l’équipe chargée du préentraînement des modèles chez Anthropic.
Une écriture conçue pour éviter les ambiguïtés
Karpathy recommande d’abord de demander aux modèles de répondre selon le standard ASD-STE100, aussi appelé Simplified Technical English. En français, l’expression peut être traduite par un anglais technique simplifié.
Cette méthode a été créée pour les manuels de maintenance aéronautique. Son objectif est de rendre des instructions techniques compréhensibles par des lecteurs dont l’anglais et les connaissances peuvent varier. Elle encadre le vocabulaire et la construction des phrases afin de réduire les ambiguïtés de lecture.
Le standard ASD-STE100 comprend 53 règles de rédaction consacrées au choix des mots, à la grammaire, aux phrases et au style. Son dictionnaire contient environ 900 mots approuvés. Chaque mot possède généralement un seul sens et une seule fonction grammaticale.
Karpathy estime que les modèles connaissent bien ce standard et que ses contraintes produisent des textes plus lisibles. Comme son application complète reste stricte, il adapte parfois la consigne donnée au modèle en demandant une réponse qui respecte environ 80 % de ses principes.
Pour une réponse rédigée en français, le dictionnaire anglais du standard ne peut pas être appliqué mot pour mot. Sa logique reste compréhensible. Elle consiste à utiliser des phrases courtes, à traiter une seule idée par phrase, à privilégier la voix active et à employer les mêmes termes pour désigner les mêmes notions.
Des diagrammes et des pages HTML
Pour remplacer une explication écrite, Karpathy conseille aussi de demander directement un diagramme. Il juge ce format plus facile à comprendre, à parcourir et à analyser qu’un bloc de texte.
L’étape suivante consiste à réclamer une page HTML interactive. Le modèle peut alors répartir l’explication dans plusieurs zones, afficher des éléments visuels et proposer des interactions au lieu de livrer uniquement une succession de paragraphes.
Cette proposition rejoint les usages qui distinguent HTML et Markdown pour les agents IA. Karpathy avait déjà relayé en mai un retour de l’équipe Claude Code sur son recours à des pages HTML plutôt qu’à des documents Markdown.
Des vidéos explicatives produites à la demande
Le format dans lequel Karpathy dit placer le plus d’espoir reste celui des vidéos explicatives personnalisées. Son exemple de consigne demande au modèle de produire une présentation dans un style proche de 3Blue1Brown, une chaîne connue pour ses vidéos pédagogiques consacrées aux mathématiques.
La narration repose dans son exemple sur une clé d’API ElevenLabs. Karpathy indique que les personnes qui ne disposent pas de cet accès peuvent demander au modèle de rechercher une solution locale gratuite compatible avec leur ordinateur.
Il estime que cette méthode commence à fonctionner. Sa publication ne fournit toutefois aucun résultat chiffré et ne compare pas l’efficacité pédagogique des vidéos avec celle des textes, des diagrammes ou des pages HTML.
Le contrôle des réponses prend plus de place
Karpathy relie ces formats à une évolution du travail avec les modèles. À mesure que l’IA prend en charge une part plus importante de la production, il prévoit davantage de contrôle humain et de temps consacré à la compréhension des résultats.
Cette surveillance rejoint le travail de relecture d’une production assistée par IA. Le changement de format ne vérifie pas l’exactitude des informations produites par le modèle.
Karpathy invite également à demander des productions logicielles temporaires, conçues pour un besoin précis puis abandonnées après usage. Cette proposition prolonge ses prises de position sur les logiciels créés avec l’aide de l’IA. Il présente ces formats comme des usages personnels, sans protocole destiné à mesurer leurs résultats.




