Los modelos de lenguaje desarrollan sesgos sociales novedosos mediante exploración adaptativa
Large Language Models Develop Novel Social Biases Through Adaptive Exploration
Un estudio reciente revela que los grandes modelos de lenguaje (LLM) pueden desarrollar sesgos sociales novedosos a través de un proceso de exploración adaptativa, similar al aprendizaje por refuerzo. Los investigadores observaron que, al interactuar con su entorno, estos modelos aprenden a asociar ciertos grupos con atributos positivos o negativos, incluso cuando no hay datos previos que respalden tales asociaciones. Este hallazgo subraya la importancia de monitorear y mitigar los sesgos emergentes en sistemas de IA.
Los modelos de lenguaje grandes pueden desarrollar sesgos sociales novedosos mediante exploración adaptativa, incluso sin datos de entrenamiento sesgados.