Un modelo detecta contenido web generado por IA solo por su estructura, con un 98% de precisión

Training a model to identify AI-generated web content from structure alone

Un nuevo estudio muestra que el texto generado por IA puede identificarse por sus firmas estructurales —cómo se presenta la información, en qué orden y con qué evidencia— en lugar de por palabras concretas. Analizando 2.250 entradas de blog humanas anteriores a ChatGPT frente a 11.250 réplicas de IA de cinco modelos, un instrumento de 214 características alcanza un macro-F1 de 98,0 en empresas no vistas, incluso tras reescribir cada texto. Las publicaciones de IA comparten una forma ordenada y autoanunciada, y el 79,3% se atribuye al modelo correcto.

Las publicaciones de IA comparten una forma ordenada y autoanunciada, el 79,3% se atribuye a la fuente correcta frente a una tasa de acierto del 16,7%, y las publicaciones humanas ocupan configuraciones estructurales raras.

Más de este día

2026-09-22