IA

Graphite révèle les tics d'écriture des modèles IA de pointe

Une étude de Graphite identifie 13 000 expressions surreprésentées dans les textes générés par Claude Opus 5.5, OpenAI Astra et Gemini 3.1 Pro.

La société Graphite a publié une étude consacrée aux habitudes rédactionnelles des principaux modèles d'intelligence artificielle de pointe. L'analyse s'appuie sur un corpus de 10 000 articles publiés avant l'arrivée de ChatGPT, utilisé comme groupe de contrôle humain, et a permis d'isoler 13 000 expressions au moins deux fois plus fréquentes dans les contenus générés par IA que dans les textes humains.

Parmi les révélations les plus marquantes, le mot « dependable » constitue le principal tic de Claude Opus 5.5, employé 23 fois plus souvent que dans les échantillons humains. Le modèle utilise également l'expression « this matters » 116 fois plus fréquemment. De son côté, le modèle Astra d'OpenAI recourt à des constructions de reformulation corrective plus de 100 fois plus souvent que l'écriture humaine.

Le tiret cadratin en voie de disparition

L'étude met en évidence un recul spectaculaire de l'usage du tiret cadratin. Claude Opus 5.5 en utilise 99 % de moins qu'Opus 5, tandis qu'Astra affiche une baisse de 88 % par rapport aux échantillons humains. Gemini 3.1 Pro les a quant à lui quasiment éliminés de sa production écrite.

Interrogé par TechCrunch, le responsable de l'IA chez Graphite, Greg Druck, a indiqué que les modèles Claude se rapprochent progressivement de la distribution lexicale humaine, tandis que les modèles GPT s'en éloignent. Ces observations font écho aux arguments avancés par les éditeurs eux-mêmes : lors de la sortie d'Opus 5.5, Anthropic affirmait que le modèle « communique plus naturellement que les modèles précédents », et OpenAI promettait aux utilisateurs des versions GPT-6 de Sol et Luna « plus de clarté, moins de jargon et moins de tournures étranges ».

En bref

Quelles expressions trahissent le plus les textes générés par IA ?

Selon l'étude de Graphite, « dependable » est employé 23 fois plus souvent par Claude Opus 5.5 que dans les textes humains, et « this matters » 116 fois plus souvent.

Les modèles IA utilisent-ils encore des tirets cadratins ?

Non. Claude Opus 5.5 en utilise 99 % de moins qu'Opus 5, Astra 88 % de moins que les échantillons humains, et Gemini 3.1 Pro les a quasiment éliminés.

Sur quelle base l'étude de Graphite a-t-elle été réalisée ?

L'analyse s'appuie sur un corpus de 10 000 articles publiés avant ChatGPT comme groupe de contrôle humain, et a identifié 13 000 expressions surreprésentées dans les contenus IA.

Source