Математики требуют от OpenAI доказательств, что их работы не использовались
Mathematicians want proof OpenAI didn't use their work

Математик Andreas Thom обвинил OpenAI в неэтичном и «нечестном» поведении, заявив, что его взаимодействие с ChatGPT могло повлиять на результаты по non-sofic группам. Он обратился к исследователям Sébastien Bubeck и Mark Sellke, но ответ не развеял сомнений: компания не подтвердила, попали ли его идеи в обучающие данные. Thom настаивает, что только OpenAI может это доказать, раскрыв датасеты.
«Деидентификация может удалить имя; она не удаляет интеллектуальное содержание математической идеи».
- arutar
Вот немного (смежного, но релевантного) контекста, который публиковался в других местах, но, я думаю, стоит упомянуть снова здесь:
https://mathstodon.xyz/@tao/117237320796901560
Особенно в последние годы математическое сообщество работает в значительной степени добросовестно, и много усилий тратится на то, чтобы должным образом отдать должное за идеи. Даже когда идеи открываются параллельно, если выясняется, что предыдущая работа содержала ту же самую суть, то это в подавляющем большинстве случаев рассматривается как лучшая практика — отдавать приоритет в таком случае. Смысл, с точки зрения хорошей академической практики, в том, чтобы поддерживать здоровье практики в целом.
Как объясняет Теренс Тао в том посте, цель математики не только в решении больших проблем. И даже если бы кто-то был очень одержим решением больших проблем, всё равно (в долгосрочной перспективе) лучше поддерживать здоровье сообщества в целом, чтобы проблемы, которые сейчас недостижимы, могли снова стать достижимыми в будущем. Хорошая академическая практика — одна из частей этой культуры.
- shmoil
Эндрю Уайлс прочитал 3 лекции, и только в конце последней он объявил, что решил FLT. Представьте, что кто-то из аудитории объявил между второй и третьей лекцией, что они доказали FLT (используя его идеи, очевидно).
Почему это нормально, если так делает openAI?
- asimpletune
Это немного похоже на то, как мы вернулись к проблеме, когда клиент становится продуктом.
Если бы я был математиком, я бы не хотел, чтобы моя неопубликованная работа попала в руки конкурента.
Если бы я был юристом, я бы не хотел, чтобы личные детали моей защиты стали доступны обвинению. Анонимно или нет.
Я бы не хотел, чтобы сюжет невыпущенной книги был предложен другому автору.
- throwaway713
Я что-то упускаю очевидное? Разве это не просто запрос к БД, чтобы посмотреть историю состояний переключателя «Data Controls» → «Improve model for everyone» в настройках? Просто сообщите, был ли он когда-либо включён и за какой период.
- aennassiri
Если бы OpenAI оставалась полностью некоммерческой организацией, стремящейся создать «ОТКРЫТЫЙ» ИИ на благо всего человечества (не только США или нескольких акционеров), я был бы рад поделиться своим кодом, своей работой и даже разметить их данные... При этом я не виню их. Трудно оставаться некоммерческой организацией и одновременно иметь необходимые капитальные инвестиции для создания AGI.
Я не критикую их, но надеюсь, что эта гонка за первым лучшим результатом или AGI не ослепит их и не помешает принимать правильные решения, например, не использовать данные своих пользователей без согласия.