Pouvons-nous encore marquer les machines ?

Une conversation fleuve avec le mathématicien qui a inventé le watermarking des LLM. L’article Pouvons-nous encore marquer les machines ? est apparu en premier sur Le Grand Continent.
Résumé
Watermarking des IA
Le watermarking (ou marquage invisible) est une technique qui permet d’identifier les textes générés par une intelligence artificielle (IA) sans altérer leur qualité apparente.
Développée par Scott Aaronson en 2022 chez OpenAI, cette méthode repose sur l’ajout d’un signal statistique discret dans le processus de génération de texte des modèles de langage (LLM).
Concrètement, les LLM fonctionnent en choisissant chaque mot ou token (unité de texte) selon une distribution de probabilité.
Aaronson a modifié cette distribution en intégrant une fonction pseudo-aléatoire cryptographique, favorisant ou défavorisant certaines séquences de mots de manière imperceptible pour un lecteur humain.
Ainsi, un texte marqué reste identique en apparence, mais contient une signature unique permettant de prouver son origine artificielle.
Cette approche a été adoptée par des laboratoires comme Anthropic, qui l’a intégrée dans son modèle Claude en 2026, sous l’impulsion de l’AI Act européen imposant la détection des contenus générés par IA.
Lire l'analyse complète en 6 points →
Commentaires (0)
Connecte-toi pour commenter
Se connecterAucun commentaire pour le moment.
Voir aussi
Plus de contenus dans cette catégorie →Découvre plus de contenu sur Napseflow


