Études de cas

Pangram peut-il détecter GPT-6 Astra ?

4 septembre 2026

Voici un bref résumé


Sur 986 requêtes, Pangram 4 atteint une précision de 99,59 % sur les sorties GPT-6 Astra.

Sur 986 requêtes provenant de Chatbot Arena, Pangram 4 a classé trois sorties de GPT-6 Astra comme mixtes, une comme entièrement humaine et 982 comme entièrement générées par l'IA, atteignant une précision de 99,59 % sur GPT-6 Astra.

Nous abordons ci-dessous les faux négatifs par catégorie.

Le banc d'essai a été généré à partir d'un sous-ensemble filtré des premières requêtes de Chatbot Arena issues du jeu de données LMSYS (Zheng et al., 2023). J'ai éliminé les requêtes demandant du code, des mathématiques, des réponses très courtes ou très longues, ou des textes créatifs inappropriés. J'ai ensuite soumis ces requêtes à GPT-6 Astra et analysé leurs résultats avec Pangram 4 .

Résultats par catégorie

CatégorieExemplesIAMixteHumain
Arguments161600
E-mails / lettres575610
Essais / articles343400
Explications54754610
Poèmes et autres écrits créatifs18318111
Avis7700
Récits14214200
Total98698231

Les trois résultats, mitigés, étaient un poème, une brève explication et un courriel.

Astra a tendance à répondre très brièvement aux questions courtes. Au total, j'ai envoyé 1 032 questions pour cet ensemble de tests, mais 46 des réponses d'Astra 6 étaient inférieures au minimum de 50 mots requis par Pangram et n'ont donc pas été prises en compte dans le calcul.

Conclusion

Pangram est robuste face à GPT-6 Astra lors de la saisie de requêtes en langage naturel et le détecte avec une précision de 99,59 %. Pangram est capable de généraliser aux nouveaux modèles car les nouvelles versions de ces derniers ont tendance à hériter d'une grande partie du style et de la voix de leurs prédécesseurs ; il n'est donc pas nécessaire de réentraîner Pangram pour chaque nouvelle version.

Voici comment GPT-6 Astra se compare à nos modèles de référence d'autres modèles de pointe récents :

ModèleDétectée comme IAPrécision
Claude Sonnet 5.51 019/1 02299.71%
Gemini 3.8 Flash998/1 00099.80%
Gemini 3.1 Pro997/1 00099.70%
Claude Opus 5.5997/1 00099.70%
Fable 5.11 093/1 09799.64%
Claude, opus 51 105/1 10799.82%
GPT-5.63 408/3 42399.56%
Claude Sonnet 51 145/1 14799.83%
Gémeaux 328/28100%

Si vous souhaitez vérifier un document en particulier, vous pouvez essayer Pangram ici.


Annamieka Aerts

Annamieka est rédactrice technique chez Pangram.

Plus d'articles d'Annamieka Aerts

Lectures complémentaires

Pangram peut-il détecter Gemini 3.8 Flash et Gemini 3.1 Pro ?
Études de cas

Pangram peut-il détecter Gemini 3.8 Flash et Gemini 3.1 Pro ?

30 septembre 2026
Selon Pangram, 21 % des articles publiés dans ICLR seraient générés par l'IA
Études de cas

Selon Pangram, 21 % des articles publiés dans ICLR seraient générés par l'IA

18 novembre 2025
Les articles présentés lors des conférences sur l'IA sont de plus en plus souvent rédigés par l'IA : une hausse de 370 % depuis 2023
Études de cas

Les articles présentés lors des conférences sur l'IA sont de plus en plus souvent rédigés par l'IA : une hausse de 370 % depuis 2023

30 septembre 2024
Quel détecteur d'IA est le plus précis ? 30 outils testés (2026)
Études de cas

Quel détecteur d'IA est le plus précis ? 30 outils testés (2026)

7 janvier 2026
Comment repérer les avis générés par l'IA
Études de cas

Comment repérer les avis générés par l'IA

5 décembre 2023
Pangram peut-il détecter Claude Opus 5.5 ?
Études de cas

Pangram peut-il détecter Claude Opus 5.5 ?

23 septembre 2026