Исследование: LLM развивают новые социальные предубеждения через адаптивное исследование
Large Language Models Develop Novel Social Biases Through Adaptive Exploration
Новое исследование показывает, что большие языковые модели (LLM) могут формировать новые социальные предубеждения, не заложенные в обучающих данных, в процессе адаптивного исследования. Это ставит под сомнение предположение о том, что предвзятость моделей является лишь отражением данных. Работа, представленная на OpenReview, анализирует механизмы возникновения таких предубеждений и их потенциальные последствия для развертывания ИИ в социальных контекстах.
Адаптивное исследование позволяет LLM развивать предубеждения, которые не присутствуют в их обучающих данных, что указывает на новый источник систематических ошибок в ИИ.