Un matemático acusa a OpenAI de "deshonestidad" por sus datos de entrenamiento
Mathematicians want proof OpenAI didn't use their work

Andreas Thom, matemático, sospecha que sus conversaciones con ChatGPT pudieron alimentar el resultado de OpenAI sobre grupos no sofianos, anunciado con gran despliegue. Tras preguntar a los investigadores Sébastien Bubeck y Mark Sellke si sus interacciones formaron parte del entrenamiento, la respuesta solo negó el acceso directo, no su posible influencia. Thom exige que OpenAI divulgue sus datasets y califica la distinción sobre datos anonimizados como engañosa.
La desidentificación puede eliminar un nombre; no elimina el contenido intelectual de una idea matemática.
- arutar
Aquí hay algo de contexto (adyacente, pero relevante), que se ha publicado en otros lugares pero que creo que vale la pena mencionar de nuevo aquí:
https://mathstodon.xyz/@tao/117237320796901560
Especialmente en los últimos años, la comunidad matemática ha trabajado en gran medida de buena fe, y se dedica mucho esfuerzo a intentar dar el crédito adecuado por las ideas. Incluso cuando las ideas se descubren en paralelo, si resulta que un trabajo previo contenía la misma idea esencial, se considera con creces la mejor práctica dar prioridad en este caso. El punto, en la buena práctica académica, es mantener la salud de la práctica en general.
Como explica Terence Tao en esa publicación, el objetivo de las matemáticas no es solo resolver grandes problemas. Y, incluso si uno estuviera muy enfocado de manera obstinada en resolver grandes problemas, sigue siendo (a largo plazo) mejor mantener la salud de la comunidad en general para que los problemas que están fuera de alcance en este momento puedan volver a estarlo en el futuro. La buena práctica académica es una parte de esta cultura.
- shmoil
Andrew Wiles dio 3 conferencias, y solo al final de la última anunció que había resuelto el FLT. Imagina que alguien del público anunciara entre la segunda y la tercera conferencia que había demostrado el FLT (usando sus ideas, obviamente).
¿Por qué está bien si lo hace OpenAI?
- asimpletune
Es un poco como si hubiéramos vuelto al problema de que el cliente se convierte en el producto.
Si yo fuera matemático, no querría que mi trabajo no publicado cayera en manos de un competidor.
Si yo fuera abogado, no querría que los detalles privados de mi defensa estuvieran disponibles para la acusación. De forma anónima o no.
No querría que la trama de un libro inédito se le sugiriera a otro autor.
- throwaway713
¿Me estoy perdiendo algo obvio? ¿No es esto simplemente una consulta simple a la base de datos para ver el historial de estado del interruptor "Controles de datos" → "Mejorar el modelo para todos" en la configuración? Solo informa si alguna vez estuvo activado y durante qué período de tiempo.
- aennassiri
Si OpenAI hubiera seguido siendo una organización totalmente sin ánimo de lucro que buscara construir una IA "ABIERTA" para el beneficio de toda la humanidad (no solo de EE. UU. o de unos pocos accionistas), habría estado encantado de compartir mi código, mi trabajo e incluso etiquetar sus datos... Dicho esto, no los culpo. Es una misión difícil seguir siendo una organización sin ánimo de lucro y, al mismo tiempo, tener la inversión de capital necesaria para construir AGI.
No los estoy criticando, pero espero que esta carrera hacia el mejor resultado o la AGI no los ciegue para tomar buenas decisiones como no usar los datos de sus usuarios sin consentimiento.