Comment éviter qu'une IA « invente » un présupposé qui n'existe pas?

Bonjour à tous,

Je suis nouveau sur le forum, je me permets de vous poser une question qui me trotte dans la tête depuis un moment.

Est-ce qu’on peut se servir d’une IA pour repérer ce qu’une théorie tient pour acquis sans le dire — ses présupposés implicites ?

Et si oui, comment vous vous y prendriez pour que ce soit fiable ? Ma crainte, c’est que l’IA « invente » un présupposé qui n’existe pas, juste parce que ça sonne bien. Comment distinguer un vrai présupposé d’une projection de l’IA ?

Merci d’avance, curieux d’avoir vos avis.

Bonjour Tiqqun,

Question très pertinente, je me la suis posée aussi en travaillant sur des synthèses de textes théoriques. Ce qui aide beaucoup, c’est de forcer l’IA à citer littéralement le passage qui justifie chaque présupposé qu’elle prétend avoir trouvé, plutôt que de la laisser reformuler librement. Si elle ne peut pas pointer une phrase précise du texte, c’est souvent le signe qu’elle extrapole.

Une autre astuce : lui demander explicitement de distinguer « ce que le texte dit », « ce que le texte suppose sans le dire » et « ce que je (l’IA) suppose en l’absence d’info » dans trois colonnes séparées. Ça oblige le modèle à être honnête sur l’origine de chaque affirmation, et on repère plus vite les inventions.

Après, aucune méthode n’est infaillible, la relecture humaine reste indispensable pour ce genre d’exercice d’analyse critique.

Merci Leamalinois. La technique des trois colonnes et de demander à l’IA de citer le passage est vraiment maline.

Mais il y a des cas que j’ai rencontrés, notamment sur des textes de physique (l’idée qu’une cause agit de proche en proche, et pas à distance) qui ne sont pas écrits dans le texte, simplement parce que l’auteur le trouve tellement évident qu’il l’écrit pas. Et pourtant, c’est bien là. Du coup, pas de passage à citer.

Alors je crois avoir trouvé une méthode simple pour débusquer ces présupposés cachés : plutôt que de chercher la phrase, je demande à l’IA de supposer l’inverse et de regarder si la théorie tient encore debout. Si elle se casse la figure, c’est que le présupposé était bien là, même invisible. Si ça change rien, c’est que l’IA me l’avait inventé.

Je suis curieux d’avoir ton avis sur cette deuxième méthode.