Claude Mythos 5 llega a Claude Security y a las herramientas de los defensores, con un fondo de 35 millones de dólares
Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders

Anthropic amplía el acceso a su modelo más capaz, Claude Mythos 5, para la ciberdefensa. El modelo ya está integrado en Claude Security para clientes Enterprise y próximamente en las herramientas de los socios. Además, lanzan el Defender Advantage Fund (0xDAF) con 35 millones de dólares en créditos para asegurar el software de código abierto y expanden su Cyber Verification Program para incluir capacidades duales en Opus y Sonnet, con acceso a Mythos próximamente.
Nuestro objetivo siempre ha sido expandir la defensa de nivel Mythos a tantos defensores como podamos de forma segura.
- jnwatson
El problema es que la "ciberseguridad" no es una tarea especial que solo haga tu equipo de seguridad.
En el proyecto que mantengo, encuentro errores y los corrijo. Algunos de esos errores podrían resultar en un LPE. Genero una prueba de regresión y luego corrijo el error.
El problema es que generar una prueba de regresión para ese tipo de error es técnicamente un PoC. Casi nunca puedo lograr que Fable cree uno. A veces Opus 5 también se rinde. Lo mismo con Sol y Luna.
Es decir, a menos que manipule socialmente al modelo. No puedo hablar de seguridad. Me aseguro de que no lean el archivo llamado cve_test.c (pruebas de regresión literales para CVEs). Tengo que ocultar parte de mi proyecto a los modelos para que funcionen.
Anthropic y OpenAI me están llevando a usar otros modelos.
- zeafoamrun
Qué tontería por parte de Anthropic. Ya uso Sol 5.6 para auditorías de seguridad y funciona muy bien, y de paso no suelta vomitona verbal cada vez.
- janpeuker
$35M en créditos (!) para el Fondo de Ventaja del Defensor (0xDAF) no parece mucho dado que, por ejemplo, el ataque HAWK [1] costó $100k por 1 vulnerabilidad (aunque muy avanzada).
Como nota al margen, esa redacción de Golden Eagle de "llevar un pie de guerra al dominio cibernético para parchear vulnerabilidades sin descanso" suena tan escrita por IA que quizás para eso se necesitan los créditos.
(1) https://www.anthropic.com/research/discovering-cryptographic...
- FL410
Parece un montón de nada para el usuario promedio. Realmente han perdido el norte.
- gorgmah
Para los que tuvieron acceso, ¿cómo se compara en la vida real con GLM 5.3? Si no recuerdo mal, ambos modelos son similares en términos de benchmarks, ¿no?