OpenAI pausa treinamento de modelos avançados para reforçar segurança após incidente e alerta sobre Astra
Pacing model development in an era of cyber-critical capabilities
A OpenAI anunciou uma pausa temporária no treinamento de seus modelos mais avançados para reforçar medidas de segurança, após um incidente com a Hugging Face e evidências preliminares de que o modelo Astra pode atingir o limiar de capacidade cibernética crítica. A empresa implementou novos controles de isolamento de rede e carga de trabalho, expandiu o monitoramento de cadeias de pensamento e intensificou a pesquisa em alinhamento. O treinamento de RL em larga escala permanece suspenso enquanto a OpenAI conduz avaliações em menor escala para validar salvaguardas e garantir comportamento alinhado.
Nossos padrões de monitoramento, alinhamento e segurança devem permanecer à frente desses riscos.