Detectar textos generados por LLM con machine learning clásico: un 85% de precisión por frase

Detecting LLM-Generated Texts with "Classical" Machine Learning

Detectar textos generados por LLM con machine learning clásico: un 85% de precisión por frase

Un desarrollador crea un detector de textos generados por IA usando métodos tradicionales de machine learning, como TF-IDF y SVM de scikit-learn, y logra una precisión del 85% por frase. El proyecto, inspirado en la abundancia de fanfics de baja calidad en Lofter, entrena siete clasificadores binarios con datos humanos y generados por distintos modelos (Gemini, Qwen, etc.), y los combina por votación. El resultado es un detector que funciona en el navegador, con una demo online y código abierto en GitHub.

El machine learning clásico todavía funciona: mucho mejor que esas herramientas online que solo le preguntan a un LLM 'oye, ¿este texto es generado por IA?'

Más de este día

2026-07-16