Posté par BAud (site web personnel) .
Évalué à 6 (+4/-0).
Dernière modification le 07 août 2026 à 08:57.
le mien me dit 100% en regardant la date de création du compte et aucune info concrète (références) sur les essais effectués pour être en mesure de les corroborer.
J'ai commencé à utiliser mon agent favori pour ça, avec un Qwen3.6 et un simple prompt du style "est-ce que ça a été généré par IA ?".
Les résultats sont assez variables, mais disons que ça ne détecte de manière fiable que les trucs les plus évidents en fait (photo d'un chat qui joue au tennis, ou texte insupportable rempli de phrases creuses avec des emojis partout).
En théorie, la théorie et la pratique c'est pareil. En pratique c'est pas vrai.
Oui on est dans le correct, 24Go de VRAM. Après j'ai pas poussé plus que ça, mais en quelques essais je l'ai vu se tromper dans les deux sens (faux positifs et faux négatifs).
En théorie, la théorie et la pratique c'est pareil. En pratique c'est pas vrai.
Tout ce que j'ai essayé n'avait aucune fiabilité. En particulier, les LLM grand public répondent de manière assez aléatoire, et ne sont pas d'accord entre eux.
Pour être un peu plus précis, la détection peut fonctionner dans les situations caricaturales: texte naïf ou plein de fautes de frappe par exemple, ou copier-coller direct d'une réponse de chatGPT à une question technique. Par contre, il n'y a aucune puissance pour détecter une tentative de fraude par exemple; il suffit d'ajouter au prompt "fais en sorte que la réponse ne soit pas facilement attribuable à une IA" et les modèles s'en sortent très bien.
J'ai peur que le problème soit simplement insoluble. Il semble très facile d'entrainer deux modèles simultanément; un qui cherche à détecter l'IA et l'autre qui cherche à ne pas se faire détecter. La tâche est asymétrique, et je pense que le modèle qui cherche à ne pas se faire repérer va gagner à tous les coups.
En tout cas, je viens de faire un essai: j'ai demandé à Mistral de rédiger 10 lignes sur la question "est-il facile de détecter un texte réalisé par une IA", puis la même chose mais de manière à ce que ça soit plus difficile à détecter. J'ai ensuite demandé à chatGPT si ça venait d'une IA ou non, réponse: pour le premier, "Je dirais que le texte présente plusieurs indices compatibles avec une rédaction par IA, avec une probabilité que je qualifierais de plutôt élevée", pour le deuxième: "Cela peut justement être le résultat d'une IA à qui l'on aurait demandé d'écrire de façon naturelle et personnelle. Mais cela peut tout aussi bien être un texte humain."
Donc CQFD: même un petit modèle s'en tire bien pour se rendre difficilement détectable.
C'est peut-être plus dur pour les images, pour les longs textes, etc, mais je pense que l'asymétrie de la tâche rend la détection très complexe.
# Un me dit 90% IA, le suivant me dit 20%
Posté par BAud (site web personnel) . Évalué à 6 (+4/-0). Dernière modification le 07 août 2026 à 08:57.
le mien me dit 100% en regardant la date de création du compte et aucune info concrète (références) sur les essais effectués pour être en mesure de les corroborer.
# Quelques essais en local
Posté par gUI (Mastodon) . Évalué à 6 (+3/-0).
J'ai commencé à utiliser mon agent favori pour ça, avec un Qwen3.6 et un simple prompt du style "est-ce que ça a été généré par IA ?".
Les résultats sont assez variables, mais disons que ça ne détecte de manière fiable que les trucs les plus évidents en fait (photo d'un chat qui joue au tennis, ou texte insupportable rempli de phrases creuses avec des emojis partout).
En théorie, la théorie et la pratique c'est pareil. En pratique c'est pas vrai.
[^] # Re: Quelques essais en local
Posté par Luc-Skywalker . Évalué à 4 (+2/-0).
Eh ben. C'est plutôt décevant.
C'est avec ta config qui est quand même assez musclée il me semble ?
"Si tous les cons volaient, il ferait nuit" F. Dard
[^] # Re: Quelques essais en local
Posté par gUI (Mastodon) . Évalué à 5 (+2/-0).
Oui on est dans le correct, 24Go de VRAM. Après j'ai pas poussé plus que ça, mais en quelques essais je l'ai vu se tromper dans les deux sens (faux positifs et faux négatifs).
En théorie, la théorie et la pratique c'est pareil. En pratique c'est pas vrai.
[^] # Re: Quelques essais en local
Posté par Luc-Skywalker . Évalué à 3 (+1/-0).
Ok. C'est sans doute des niveaux d'introspection trop profonds pour espérer une réponse rationnelle de l'IA ;)
"Si tous les cons volaient, il ferait nuit" F. Dard
# Problème insoluble?
Posté par arnaudus . Évalué à 4 (+1/-0).
Tout ce que j'ai essayé n'avait aucune fiabilité. En particulier, les LLM grand public répondent de manière assez aléatoire, et ne sont pas d'accord entre eux.
Pour être un peu plus précis, la détection peut fonctionner dans les situations caricaturales: texte naïf ou plein de fautes de frappe par exemple, ou copier-coller direct d'une réponse de chatGPT à une question technique. Par contre, il n'y a aucune puissance pour détecter une tentative de fraude par exemple; il suffit d'ajouter au prompt "fais en sorte que la réponse ne soit pas facilement attribuable à une IA" et les modèles s'en sortent très bien.
J'ai peur que le problème soit simplement insoluble. Il semble très facile d'entrainer deux modèles simultanément; un qui cherche à détecter l'IA et l'autre qui cherche à ne pas se faire détecter. La tâche est asymétrique, et je pense que le modèle qui cherche à ne pas se faire repérer va gagner à tous les coups.
En tout cas, je viens de faire un essai: j'ai demandé à Mistral de rédiger 10 lignes sur la question "est-il facile de détecter un texte réalisé par une IA", puis la même chose mais de manière à ce que ça soit plus difficile à détecter. J'ai ensuite demandé à chatGPT si ça venait d'une IA ou non, réponse: pour le premier, "Je dirais que le texte présente plusieurs indices compatibles avec une rédaction par IA, avec une probabilité que je qualifierais de plutôt élevée", pour le deuxième: "Cela peut justement être le résultat d'une IA à qui l'on aurait demandé d'écrire de façon naturelle et personnelle. Mais cela peut tout aussi bien être un texte humain."
Donc CQFD: même un petit modèle s'en tire bien pour se rendre difficilement détectable.
C'est peut-être plus dur pour les images, pour les longs textes, etc, mais je pense que l'asymétrie de la tâche rend la détection très complexe.
Envoyer un commentaire
Suivre le flux des commentaires
Note : les commentaires appartiennent à celles et ceux qui les ont postés. Nous n’en sommes pas responsables.