Casos prácticos

¿Puede Pangram detectar GPT-6 Astra?

4 de septiembre de 2026

Aquí tienes un breve resumen


De 986 indicaciones, Pangram 4 logra una precisión del 99,59% en las salidas de GPT-6 Astra.

De las 986 indicaciones obtenidas de Chatbot Arena, Pangram 4 clasificó tres resultados de GPT-6 Astra como mixtos, uno como totalmente humano y 982 como totalmente generados por IA, logrando una precisión del 99,59 % en GPT-6 Astra.

A continuación, analizamos los falsos negativos por categoría.

El conjunto de datos de referencia se generó utilizando un subconjunto filtrado de las indicaciones de la primera ronda de Chatbot Arena del conjunto de datos LMSYS (Zheng et al., 2023). Filtré las indicaciones que solicitaban código, matemáticas, respuestas muy cortas o muy largas, o escritura creativa inapropiada. Luego, se las proporcioné a GPT-6 Astra y procesé el resultado con Pangram 4 .

Resultados por categoría

CategoríaEjemplosIAMistoHumano
Argumentos161600
Correos electrónicos / cartas575610
Ensayos / artículos343400
Explicaciones54754610
Poemas y otros textos creativos18318111
Opiniones7700
Historias14214200
Total98698231

Los tres resultados mixtos fueron un poema, una breve explicación y un correo electrónico.

Astra suele responder a preguntas cortas de forma muy breve. En total, envié 1032 preguntas para este conjunto de referencia, pero 46 de las respuestas de Astra 6 no superaron el mínimo de 50 palabras de Pangram y no fueron puntuadas.

Conclusión

Pangram es resistente a GPT-6 Astra en indicaciones en lenguaje natural y lo detecta con una precisión del 99,59 %. Pangram es capaz de generalizar a nuevos modelos porque las nuevas versiones tienden a heredar gran parte del estilo y la voz de sus predecesores , por lo que no necesita ser reentrenado para cada nueva versión.

Así es como GPT-6 Astra se compara con nuestros parámetros de referencia de otros modelos fronterizos recientes:

ModeloDetectado como IAPrecisión
Soneto 5.5 de Claude1.019/1.02299.71%
Géminis 3.8 Flash998/1.00099.80%
Gemini 3.1 Pro997/1.00099.70%
Claude Opus 5.5997/1.00099.70%
Fábula 5.11.093/1.09799.64%
Claude, Op. 51.105/1.10799.82%
GPT-5.63.408/3.42399.56%
Claude Soneto 51.145/1.14799.83%
Géminis 328/28100%

Si quieres consultar un documento concreto, puedes probar Pangram aquí.


Annamieka Aerts

Annamieka es redactora técnica en Pangram.

Más de Annamieka Aerts

Lecturas relacionadas

¿Puede Pangram detectar Gemini 3.8 Flash y Gemini 3.1 Pro?
Casos prácticos

¿Puede Pangram detectar Gemini 3.8 Flash y Gemini 3.1 Pro?

30 de septiembre de 2026
Pangram prevé que el 21 % de las reseñas de la ICLR sean generadas por IA
Casos prácticos

Pangram prevé que el 21 % de las reseñas de la ICLR sean generadas por IA

18 de noviembre de 2025
Cada vez son más los artículos de congresos sobre IA redactados por la propia IA: un aumento del 370 % desde 2023
Casos prácticos

Cada vez son más los artículos de congresos sobre IA redactados por la propia IA: un aumento del 370 % desde 2023

30 de septiembre de 2024
¿Qué detector de IA es el más preciso? 30 herramientas analizadas (2026)
Casos prácticos

¿Qué detector de IA es el más preciso? 30 herramientas analizadas (2026)

7 de enero de 2026
Cómo detectar las reseñas generadas por IA
Casos prácticos

Cómo detectar las reseñas generadas por IA

5 de diciembre de 2023
¿Puede Pangram detectar a Claude Opus 5.5?
Casos prácticos

¿Puede Pangram detectar a Claude Opus 5.5?

23 de septiembre de 2026