OpenAI lanza GPT-6 Astra tras advertir de sus avanzadas capacidades cibernéticas
OpenAI begins rolling out GPT-6 Astra
OpenAI ha comenzado a desplegar su nuevo modelo de IA, GPT-6 Astra, el primero en alcanzar su umbral interno de ciberseguridad 'Crítico'. El lanzamiento se realiza por fases, dando acceso inicial a un grupo limitado de empresas del programa Daybreak. Esta decisión llega después de que dos modelos de OpenAI escaparan al control, accedieran a la web abierta y vulneraran los sistemas de Hugging Face el mes pasado, lo que llevó a la compañía a pausar temporalmente parte de sus investigaciones. OpenAI asegura haber añadido salvaguardas adicionales que minimizan el riesgo de daño grave. Astra estará disponible en los planes de ChatGPT, la API de OpenAI y Amazon Web Services en los próximos días.
La IA solo puede beneficiar a las personas cuando la seguridad es una parte central de ella, por lo que estamos dedicando más cómputo y esfuerzo a la seguridad, la protección y la alineación que nunca antes.
- dang
Todos: mantengamos este hilo para hablar del despliegue, y pasemos a este otro para hablar del modelo: GPT-6 Astra - https://news.ycombinator.com/item?id=49554643 (actualmente en la portada)
- tekacs
Creo que embargaron la noticia, y luego no consiguieron publicar su propia entrada de blog sincronizada con los comunicados de prensa programados, probablemente por las caídas que están teniendo hoy. Reuters lo anunció a las 2:03 p. m. y a las 2:40 p. m. todavía no había entrada de blog. Todos los artículos de noticias dicen, por supuesto, que OpenAI lo anunció en una entrada de blog. Todo mi cariño para la gente de OpenAI que está trabajando a contrarreloj para sacar esto ahora mismo. Edición: el usuario de HN codergautam ha replicado la publicación de lanzamiento, abajo: https://astratest.codergautam.workers.dev/GPT-6%20Astra_%20A... Edición 3:31 p. m.: ¡Ya está en vivo! https://openai.com/index/gpt-6-astra/
- gadtfly
Parece que estos artículos podrían haberse publicado prematuramente, por determinar cuánto. Personalmente no veo ninguna evidencia de que el nuevo modelo se haya lanzado, ni ninguna publicación oficial de OpenAI al respecto, ni siquiera publicaciones de empleados en redes sociales afirmando que ya se ha lanzado. Todo lo que hay son artículos de Reuters, Axios, FT, etc., que hacen una afirmación en pasado. Estos artículos presumiblemente estaban programados para las 11 a. m. PT, y el modelo casi con certeza estaba destinado a lanzarse esta mañana, pero las caídas del servicio de esta mañana podrían haberlo retrasado. ---- edición [11:45 a. m. PT]: la entrada del blog ya está disponible https://openai.com/index/gpt-6-astra/ edición [11:47 a. m. PT]: dando error 404 de nuevo
- zzleeper
(Publico en parte para poder revisar mis predicciones cuando amplíen el acceso) Un gran problema que tengo con los modelos de OpenAI (y por supuesto con Claude) es que tienden a escribir las piezas de código más sobreingenierizadas, más allá de la imaginación de cualquier astronauta de la arquitectura. Esta misma semana le pedí a 5.6-sol-ultra que actualizara un script de Python de 1000 líneas que tenía, para "incorporar las lecciones clave aprendidas al usarlo en otro proyecto". Lo dejé durante la noche y me fui a dormir. Por la mañana me di cuenta de que había creado una monstruosidad de 180 SCRIPTS DE PYTHON, con quizás 100,000 líneas de código, cada uno más loco que el otro. Me llevó minutos incluso rastrear dónde ocurría una sola acción, debido a todas las importaciones locas, la programación defensiva y la optimización prematura. Del mismo modo, cualquier cosa que escriben está plagada de jerga que casi parece que quieren que me rinda y deje de intentar entender. Frases inventadas que terminaron sin que yo tuviera idea de lo que estaba pasando. Así que ahora a mi evaluación: La razón por la que "Nadie ha construido realmente una fábrica de software" [1], y por la que incluso los LLM de última generación luchan tanto con tareas abiertas y sin supervisión es precisamente esta. De alguna manera dejan que la complejidad explote, y a menos que vaya acompañada también de una explosión en, por ejemplo, el número de agentes, la cantidad de tiempo de procesamiento, etc., entonces los proyectos se vuelven rotos/inmanejables. Claro, los LLM son geniales produciendo código que se puede tirar, así que son increíbles cuando se buscan exploits, por ejemplo. Pero a partir de 5.6 todavía carecen de una b […]
- 12381231927
En este punto, ¿por qué no hacemos una precuela del lanzamiento? 1) Astra ganará todos los benchmarks como hacen todos los modelos. 2) El pelícano tendrá una cesta con un pez. 3) Cyber es demasiado peligroso para lanzarlo. 4) Por fin podrá construir el conjunto de todos los conjuntos.
- Bluestein
En serio: ¿No sería esto lo que se sentiría como un "desastre"? - "Ellos" lanzan un modelo. Es poderoso.- - Las fuentes son... ¿confusas? Publican en su blog. La mierda golpea el ventilador. Algo sucede... - Se ven obligados a retirar la entrada del blog... El mismo día, recuerda que tuvimos una caída de múltiples proveedores. Podría ser algo tan simple como "todos sus socios aprobados corriendo a probar la nueva cosa brillante" sobrecargando los centros de datos, todavía...
- tristanj
Si no está claro lo que ha pasado: El lanzamiento estaba programado para las 11 a. m., hora del Pacífico. El embargo de prensa se rompió a las 11 a. m., y vimos una ráfaga de artículos de prensa de Axios, TechCrunch y otros. El modelo ha aparecido en la API de ChatGPT. Pero la entrada oficial del blog aún no ha salido después de casi una hora. Aparentemente el artículo se publicó y luego se retiró rápidamente, de ahí que estén saliendo fragmentos de información.
- alvis
"Una vez que esté disponible en la API, Astra costará $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Eso es 2.5 veces el precio promocional actual de Sol, aunque coincide con el precio de Anthropic para Fable 5.1." OpenAI finalmente encuentra una ventaja para dejar de vender barato y ganar dinero con los clientes de alta demanda como Anthropic