Математики требуют от OpenAI доказательств, что их работы не использовались

Mathematicians want proof OpenAI didn't use their work

Математики требуют от OpenAI доказательств, что их работы не использовались

Математик Andreas Thom обвинил OpenAI в неэтичном и «нечестном» поведении, заявив, что его взаимодействие с ChatGPT могло повлиять на результаты по non-sofic группам. Он обратился к исследователям Sébastien Bubeck и Mark Sellke, но ответ не развеял сомнений: компания не подтвердила, попали ли его идеи в обучающие данные. Thom настаивает, что только OpenAI может это доказать, раскрыв датасеты.

«Деидентификация может удалить имя; она не удаляет интеллектуальное содержание математической идеи».
  1. arutar

    Вот немного (смежного, но релевантного) контекста, который публиковался в других местах, но, я думаю, стоит упомянуть снова здесь:

    https://mathstodon.xyz/@tao/117237320796901560

    Особенно в последние годы математическое сообщество работает в значительной степени добросовестно, и много усилий тратится на то, чтобы должным образом отдать должное за идеи. Даже когда идеи открываются параллельно, если выясняется, что предыдущая работа содержала ту же самую суть, то это в подавляющем большинстве случаев рассматривается как лучшая практика — отдавать приоритет в таком случае. Смысл, с точки зрения хорошей академической практики, в том, чтобы поддерживать здоровье практики в целом.

    Как объясняет Теренс Тао в том посте, цель математики не только в решении больших проблем. И даже если бы кто-то был очень одержим решением больших проблем, всё равно (в долгосрочной перспективе) лучше поддерживать здоровье сообщества в целом, чтобы проблемы, которые сейчас недостижимы, могли снова стать достижимыми в будущем. Хорошая академическая практика — одна из частей этой культуры.

  2. shmoil

    Эндрю Уайлс прочитал 3 лекции, и только в конце последней он объявил, что решил FLT. Представьте, что кто-то из аудитории объявил между второй и третьей лекцией, что они доказали FLT (используя его идеи, очевидно).

    Почему это нормально, если так делает openAI?

  3. asimpletune

    Это немного похоже на то, как мы вернулись к проблеме, когда клиент становится продуктом.

    Если бы я был математиком, я бы не хотел, чтобы моя неопубликованная работа попала в руки конкурента.

    Если бы я был юристом, я бы не хотел, чтобы личные детали моей защиты стали доступны обвинению. Анонимно или нет.

    Я бы не хотел, чтобы сюжет невыпущенной книги был предложен другому автору.

  4. throwaway713

    Я что-то упускаю очевидное? Разве это не просто запрос к БД, чтобы посмотреть историю состояний переключателя «Data Controls» → «Improve model for everyone» в настройках? Просто сообщите, был ли он когда-либо включён и за какой период.

  5. aennassiri

    Если бы OpenAI оставалась полностью некоммерческой организацией, стремящейся создать «ОТКРЫТЫЙ» ИИ на благо всего человечества (не только США или нескольких акционеров), я был бы рад поделиться своим кодом, своей работой и даже разметить их данные... При этом я не виню их. Трудно оставаться некоммерческой организацией и одновременно иметь необходимые капитальные инвестиции для создания AGI.

    Я не критикую их, но надеюсь, что эта гонка за первым лучшим результатом или AGI не ослепит их и не помешает принимать правильные решения, например, не использовать данные своих пользователей без согласия.

Ещё за этот день

2026-09-10