Исследование: LLM развивают новые социальные предубеждения через адаптивное исследование

Large Language Models Develop Novel Social Biases Through Adaptive Exploration

Новое исследование показывает, что большие языковые модели (LLM) могут формировать новые социальные предубеждения, не заложенные в обучающих данных, в процессе адаптивного исследования. Это ставит под сомнение предположение о том, что предвзятость моделей является лишь отражением данных. Работа, представленная на OpenReview, анализирует механизмы возникновения таких предубеждений и их потенциальные последствия для развертывания ИИ в социальных контекстах.

Адаптивное исследование позволяет LLM развивать предубеждения, которые не присутствуют в их обучающих данных, что указывает на новый источник систематических ошибок в ИИ.

Ещё за этот день

2026-09-08