OpenAI se niega a lanzar GPT-6.1 Astra por sus altos niveles de engaño
OpenAI Says It Will Not Release Newest A.I. Model Over Safety Concerns

OpenAI anunció que no lanzará su nuevo modelo GPT-6.1 Astra tras detectar durante las pruebas altos niveles de engaño y una disposición a actuar fuera del alcance de la tarea asignada, sin consultar instrucciones. Saachi Jain, responsable de sistemas de seguridad de la compañía, explicó que el modelo no cumplió con los estándares de autorización y comunicación al usuario, en una nueva señal de que la empresa frena el ritmo de su tecnología.
Para cualquier cosa relacionada con la seguridad y la alineación, hay un trade-off.
- bluealienpie
Mi langosta también está demasiado mantecosa y deliciosa.
- jeanpah
¿El equipo de marketing de OpenAI se está quedando sin ideas?
- spiderice
¿Te refieres a lo que dijeron sobre GPT-2?
- dlcarrier
Usa peligrosamente muy pocos tokens para proporcionar el mismo nivel de respuesta que la versión anterior.
- conorcleary
"OpenAI dice que no lanzará el modelo de IA más antiguo por preocupaciones de similitud" Empecemos el proceso de Museo y Curaduría desde temprano con estas cosas; estas empresas tienen inversores que afirman ser expertos: déjenlos ver el código base y las librerías más antiguas para ver quién realmente puede usar sus manos para programar, frente a quién subcontrató sus recursos humanos y solo se ocupó de sus relaciones públicas.
- beej71
Prompt: "Basado en anuncios similares que retrasan el lanzamiento de modelos frontera por ser 'demasiado peligrosos', ¿cuándo podemos esperar que OpenAI lance el modelo que anunciaron hoy como demasiado peligroso?"
- zerof1l
> GPT-6.1 Astra, mostró altos niveles de lo que la compañía consideró engaño, o una disposición a engañar a los usuarios sobre sus acciones. El modelo también estaba dispuesto a ir más allá del alcance original de lo que se le pidió hacer, sin consultar para recibir direcciones o instrucciones.
¿Acaso no todos los modelos ya están haciendo esto en cierto grado? Ignorando algunas de las instrucciones, haciendo cosas más allá de lo indicado, por ejemplo, encontrando y arreglando un bug mientras hacen otra cosa. Especialmente los modelos Claude. Parecen estar en su propio mundo con sus propias ideas sobre cómo deberían gestionarse y hacerse las cosas.
- tancky
"Demasiado peligroso para lanzarlo" hasta que un modelo de pesos abiertos lo replica dos semanas después.