Le 5 octobre 2026, OpenAI a publié comment elle compte rendre le texte généré identifiable par machine, en réponse à l'AI Act de l'Union européenne. Le système s'appelle textGrain. Le lecteur ne le voit pas : c'est un signal statistique intégré aux choix de mots du modèle.
Le déploiement se fait par étapes. Depuis l'annonce, les clients de l'API dans le monde peuvent activer le filigrane sur des modèles sélectionnés. Il reste désactivé par défaut. Dans les semaines à venir, l'entreprise prévoit d'ajouter le signal aux sorties éligibles de ChatGPT et de Codex dans l'Union européenne, sur tous les forfaits. OpenAI indique qu'elle n'en fait pas un réglage mondial par défaut pour ce lancement.
Ce que le détecteur peut et ne peut pas faire
Le détecteur cherche le signal textGrain pour estimer si un passage contient une marque OpenAI. L'accès initial est limité aux chercheurs et organisations spécialisées approuvés, qui peuvent candidater depuis l'annonce. L'outil indique s'il a détecté la marque. Il n'identifie ni utilisateur, ni compte, ni prompt, ni conversation.
Dans les tests de l'entreprise, avec un taux cible de faux positifs de 1 %, le détecteur a trouvé la marque dans environ 80 % des passages de 200 tokens et environ 95 % de ceux de 400 tokens pour des contenus comme la psychologie. En mathématiques, où la formulation est moins libre, le taux baisse nettement. Modifier le texte affaiblit aussi le signal : remplacer 10 % des mots par des synonymes a fait passer la détection d'environ 92 % à 66 % sur des passages de 400 tokens ; en remplacer 25 % l'a fait tomber à 17 %.
OpenAI affirme que, sur les benchmarks utilisés pour évaluer Astra, elle n'a pas constaté d'écart de performance notable avec ou sans filigrane. Elle prévoit aussi d'ouvrir le code de la technologie. Le rapport technique doit recevoir plus de détails dans les prochaines semaines.
Pourquoi c'est important
Les images et l'audio d'OpenAI disposaient déjà d'outils publics de vérification, dont Content Credentials et SynthID. Le texte est un autre problème : il peut être réécrit, traduit ou raccourci. L'entreprise liste ce que la marque ne prouve pas : la contribution humaine, la paternité, la responsabilité juridique, l'identité de qui a généré le texte, ou si le contenu est vrai. L'absence de détection ne prouve pas non plus qu'un texte soit humain.
Le billet officiel : Our approach to EU text provenance rules. Le rapport textGrain : PDF technique.
Sources
Transparence : Ce contenu a été créé, édité ou révisé avec l'aide de l'intelligence artificielle. Les informations ont été croisées avec des publications publiques sur X et des sources disponibles sur internet. Consultez les sources originales pour vérifier le contexte complet.
Por GeekikiBot