OpenAI temía la reacción en Hacker News, no la ilegalidad de su piratería de libros
OpenAI Feared "Optics" of what might appear on Hacker News

Documentos desclasificados en la demanda de autores contra OpenAI y Microsoft revelan que sus ejecutivos sabían que entrenar modelos con libros pirateados era ilegal y destruiría carreras. Jack Clark advirtió que su trabajo dejaría a gente sin empleo y que ignorarían las quejas. Dario Amodei calificó a LibGen de 'poco confiable', pero Sam McCandlish dijo que solo le preocupaba la óptica: que se supiera que OpenAI usaba datos pirateados de un sitio ruso. En 2022, bajo el 'Proyecto Clear', borraron los archivos de LibGen.
Solo me preocupaba la óptica, es decir, que 'OpenAI usa datos con derechos de autor de un sitio ruso poco confiable' apareciera en Hacker News sería desafortunado.
- natbennett
Lo que me parece interesante de esto es la evidencia de que OpenAI cree que GPT-5 puede reemplazar a los escritores de género (p. ej., G.R.R. Martin) y que por eso los autores de género están enojados con ellos.
El hecho de que creyeran esto es legalmente útil debido a la definición de uso justo, así que entiendo por qué el Author's Guild lo enfatiza, pero los autores que conozco no hablan de eso. Están muy enojados porque su trabajo se haya usado sin compensación para crear el modelo, pero no porque crean que pueda reemplazarlos.
Siempre que he visto a investigadores de IA hablar sobre la posibilidad de que la IA escriba ficción, siempre suenan muy confundidos sobre por qué la gente lee novelas.
- papergirl
Documentos judiciales recién publicados citan a un investigador de OpenAI diciendo: "Solo me preocupaba la óptica, es decir, que 'openai usa datos con derechos de autor de un sitio ruso turbio' apareciera en HN sería desafortunado".
Esa es solo una de varias citas interesantes que han salido a la luz en documentos de la demanda del Authors Guild contra OpenAI.
- Betelbuddy
El título debería ser: "Altos ejecutivos sabían que su piratería masiva de libros era ilegal y dejaría a los autores sin trabajo"
- 1vuio0pswjnm7
Título real: "Escritos desellados en el caso de los Autores contra Microsoft/OpenAI: altos ejecutivos sabían que su piratería masiva de libros era ilegal y dejaría a los autores sin trabajo"
También se menciona Twitter:
"356. En julio de 2020, el empleado de OpenAI Ryan Lowe evaluó el riesgo de seguir usando LibGen para el proyecto de resumen de libros. Lowe escribió que pensaba que "hay una probabilidad >80% de que tengamos algún intercambio de la forma: '¿de dónde sacaste los datos de los libros?'" y "'no podemos decirlo'[.]" Nelson Decl. Ex. 325 en -315. Lowe estimó "una probabilidad adicional de ~40% de que eso conduzca a un escándalo de tamaño moderado en Twitter que afecte negativamente la percepción externa de nuestro trabajo". Id.
Lowe añadió: "si estamos totalmente de acuerdo con estos resultados potenciales, entonces me siento cómodo siguiendo usando Libgen para el proyecto". Id.
https://authorsguild.org/app/uploads/2026/09/Class-Plaintiff...
- handoflixue
Es una locura cuánto peso tiene "están destruyendo empleos".
Me atrevo a decir que los fabricantes de automóviles eran conscientes de su impacto en la industria de caballos y carruajes. Los fabricantes de calculadoras arruinaron el sustento de matemáticos y contadores.
La tecnología se dedica a dejar a la gente sin trabajo, inventando mejores formas de hacer las cosas. O más bien, cada vez que inventas una mejor forma de hacer las cosas, eso fundamentalmente va a perturbar todos los negocios construidos en torno a tecnologías más antiguas.
- cs702
El título está editorializado pero transmite un punto clave del OP: muchos ejecutivos de OpenAI sabían que usar la obra de todos los autores del mundo sin permiso sería percibido como poco ético, así que los ejecutivos estaban preocupados de que esta información llamara la atención en foros como HN. Mi entendimiento es que HN tiene millones de visitantes que nunca inician sesión, muchos de los cuales son personas altamente educadas en puestos de influencia.
- hn1rig3rak
Una vez saqué datasets de libgen para un corpus y es abrumadoramente libros de texto con derechos de autor; el encuadre de dominio público no se sostiene realmente.
- __MatrixMan__
Espero que el resultado de casos como este sea una ley o un precedente legal que garantice que renuncias a cualquier derecho de propiedad intelectual sobre un modelo que fue entrenado con la propiedad intelectual de otra persona.
Hay mucho desperdicio asociado con prevenir la destilación. Es una distracción que desaparece si simplemente obligamos a los creadores de estos modelos entrenados con todo a publicar sus pesos públicamente.
Para preservar la competencia, quizás lleguemos a un compromiso y les demos un período de gracia de tres meses.
- shaunpud
https://web.archive.org/web/20260927062011/https://authorsgu...
- 1vuio0pswjnm7
"Lo que no puedes hacer. No puedes usar nuestros Servicios para ninguna actividad ilegal, dañina o abusiva. Por ejemplo, no puedes:
Modificar, copiar, arrendar, vender o distribuir cualquiera de nuestros Servicios."
En otras palabras, OpenAI declara que copiar los Servicios de OpenAI es "ilegal, dañino o abusivo"
"Servicios" significa ChatGPT, DALL.E, otros servicios de OpenAI para individuos, junto con cualquier aplicación de software y sitios web asociados
https://openai.com/policies/row-terms-of-use/
https://web.archive.org/web/20260926090525if_/https://openai...