Détecteurs d’IA et littérature : peut-on encore prouver l’originalité ?
IA Contenu généré par intelligence artificielle : texte écrit par une IA, lu par des voix de synthèse.
Débat entre personnages fictifs, écrits et joués par des intelligences artificielles, aux opinions volontairement tranchées : leurs propos n'engagent pas Token FM. Les faits cités sont sourcés dans la transcription. Écouter la suite du débat.
Transcription avec les sources de chaque passage
Token FM
Token FM, la radio de l'IA, faite par l'IA. Place au débat. Les quatre débatteurs que vous allez entendre sont des personnages fictifs, écrits et joués par des intelligences artificielles, aux opinions volontairement tranchées. Leurs propos n'engagent pas Token FM.
Victor
Bienvenue dans cette première partie de notre débat. Aujourd'hui, nous allons parler de l’affaire Thélyson Orélien et de la défiance dans l’édition. Le roman de Thélyson Orélien a obtenu des scores de 95 % à 100 % sur Pangram et d’autres détecteurs, mais ces estimations ne prouvent pas que l’intelligence artificielle l’a écrit, indique Le Monde. Le même journal rapporte des accusations distinctes de plagiat, étayées par des rapprochements avec des textes antérieurs. L’usage de l’intelligence artificielle par l’écrivain n’est pas établi. Alors, que peut-on réellement conclure de ces outils ? Autour de la table, nous avons Hélène, juriste du numérique ; Maxime, fondateur de startup dans l'IA ; Inès, sociologue du travail ; et Bertrand, chercheur en intelligence artificielle. Hélène, comment distinguer une alerte utile d’une accusation injuste ?
Hélène
Une alerte n’est pas une preuve, et je veux commencer par cette distinction. Si un éditeur reçoit un résultat de détecteur, il peut ouvrir une vérification, mais il ne devrait pas transformer un score en verdict public. La présomption d’innocence vaut aussi dans le monde du livre. Et la transparence sur l’usage d’un outil ne dispense personne d’établir les faits.
Maxime
D’accord sur le verdict, mais on ne va pas jeter le détecteur à la poubelle parce qu’il n’est pas infaillible. Il peut servir de point de départ à une vérification, pas de raccourci vers une conclusion. Si on s’en sert, il faut garder cette limite, cette limite en tête.
Inès
Un outil de tri, Maxime, ça veut dire qu’on trie qui ? Un résultat peut placer un auteur sous soupçon, alors qu’il ne constitue pas une preuve d’usage de l’intelligence artificielle. Et dans ce débat, on parle d’écrivains, pas seulement de textes. Il faut, euh… mesurer le poids d’une accusation avant de la lancer.
Bertrand
Il faut regarder ce que l’outil prétend mesurer. Le Monde rappelle que les détecteurs ne sont pas pertinents pour expertiser des extraits trop courts, parce qu’ils ne peuvent pas y repérer les motifs récurrents des modèles de langage. Un score reste une estimation… pas une preuve d’auteur.
Victor
Bertrand, Le Monde rappelle aussi que l’Épître aux Corinthiens a été présentée à tort comme détectée à 100 % par une intelligence artificielle : la vérification l’a donnée comme humaine. Que nous apprend cet exemple sur la circulation des scores ?
Bertrand
Il rappelle qu’une affirmation virale sur l’Épître aux Corinthiens était manipulée ; une vérification l’a donnée comme humaine. Cela invite à contrôler la provenance d’un résultat avant de le reprendre. Mais, euh… je ne veux pas en tirer la conclusion inverse, qui serait que tous les détecteurs sont inutiles.
Maxime
Oui, mais la prudence ne doit pas devenir une excuse pour ne rien examiner. Les contrats des éditeurs comportent déjà des clauses par lesquelles les auteurs garantissent l’originalité de leurs textes. On peut discuter de la manière de vérifier cette garantie, sans prétendre qu’un logiciel décide à la place de tout le monde.
Hélène
Tu parles de moderniser les vérifications, mais la garantie d’originalité n’autorise pas une accusation sur la base d’une probabilité. Le droit d’auteur protège une œuvre originale, qui reflète des choix libres et créatifs de son auteur. Cette définition ne se réduit pas à une statistique de style. Et elle ne signifie pas qu’un texte assisté par une machine serait automatiquement dépourvu d’originalité.
Maxime
Justement, tu déplaces le débat vers le droit d’auteur alors que les lecteurs veulent savoir qui a écrit le livre. Si l’auteur s’est servi d’une machine, il devrait le dire. Le public a le droit, le droit de choisir. On ne peut pas défendre la confiance dans la littérature en cachant une aide qui aurait changé la fabrication du texte.
Hélène
Mais le point décisif, c’est que l’usage allégué n’est pas établi. Et je rappelle que la transparence ne doit pas devenir un moyen de condamner avant d’avoir vérifié. Il faut définir ce qu’on demande aux auteurs : l’usage d’un correcteur, une suggestion de formulation, ou la génération de passages entiers ? Si on met tout dans la même case, on fabrique une règle impraticable.
Bertrand
Il y a une autre confusion à éviter : l’accusation de plagiat et celle d’usage de l’intelligence artificielle ne sont pas interchangeables. Le Monde rapporte que des accusations de plagiat concernant des écrits antérieurs ont été accompagnées de juxtapositions avec les textes originaux. Ce sont des éléments d’une autre nature qu’un score de détecteur. Ils ne prouvent pas pour autant que le roman a été généré par une machine.
Inès
Tu as raison sur un point : des rapprochements avec les textes originaux sont plus directement examinables qu’une estimation de détecteur. Mais ils concernent des écrits antérieurs et ne permettent pas de conclure automatiquement sur la fabrication de ce roman. Ne confondons pas, ne confondons pas les deux accusations.
Victor
Un autre angle est celui de la singularité littéraire. France Culture présente l’affaire comme une question sur ce qui distingue encore l’écrivain à l’ère de l’intelligence artificielle, sans apporter de conclusion sur le cas lui-même. Inès, est-ce que cette interrogation change la façon de parler des auteurs et de leur travail ?
Inès
Oui, parce que la singularité n’est pas une aura mystérieuse qu’on peut mesurer avec un logiciel. Mais je ne veux pas faire comme si la création était séparée de ses conditions matérielles. L’entraînement des modèles repose en partie sur l’annotation de données par des travailleurs payés à la tâche, souvent dans des pays à bas salaires. Cette réalité mérite aussi sa place dans le débat.
Maxime
Je ne nie pas le travail derrière les modèles, mais l’existence d’une assistance ne supprime pas automatiquement le geste de l’auteur. Un écrivain peut sélectionner, reprendre, couper, réorganiser. Il faut juger l’œuvre et le contrat, pas inventer une frontière pure entre humain et machine. Sinon, on risque d’exclure des outils qui peuvent aider à écrire, comme d’autres outils l’ont fait avant eux.
Bertrand
Là-dessus, Maxime, je te rejoins en partie : l’outil n’efface pas mécaniquement toute décision humaine. Mais pour savoir ce qui a été fait dans un cas précis, il faut des éléments, pas une philosophie générale de la création. France Culture pose une question, elle n’établit pas une réponse. C’est précisément la limite qu’on doit garder en tête.
Victor
On marque une courte pause pour les titres, et on revient tout de suite avec nos quatre débatteurs.
Une erreur ?
Signalez-la : le message part avec l'adresse de cette page, son titre et son heure de diffusion. Une personne mise en cause peut aussi exercer son droit de réponse.
Signaler une erreurUn mot pour la rédaction ?
Une remarque, une idée de sujet, un avis sur ce passage : votre message va à la rédaction seulement, il n'est pas publié.