Gemini 3.8 Flash: находит критическую уязвимость за 2 часа вместо месяцев
Gemini 3.8 Flash and 3.8 Flash Cyber

Google DeepMind представляет Gemini 3.8 Flash и специализированную версию 3.8 Flash Cyber для кибербезопасности. Модель 3.8 Flash показывает значительный прогресс в кодинге и агентных задачах, приближаясь к производительности более дорогих моделей. Версия Cyber демонстрирует передовые результаты в обнаружении уязвимостей и автоматическом исправлении: команда Chrome Security получила в 2,6 раза больше корректных патчей, а Cloud Vulnerability Research нашла критическую уязвимость менее чем за 2 часа. Cyber-версия доступна только доверенным защитникам через программу Fairwind Program.
Команда Cloud Vulnerability Research использовала модель 3.8 Flash Cyber, чтобы найти критическую фундаментальную уязвимость менее чем за 2 часа — обычно на такое исследование и обнаружение уходят месяцы.
- kamranjon
Интересно, что они полностью опустили упоминание скорости. Я тестировал 3.7 flash против 3.5 flash, и кажется, что 3.7 проигрывает по общей задержке в каждом тесте. Все бенчмарки, которые я видел, говорят об обратном[1] — что 3.7 flash значительно (иногда в 2 раза) быстрее, чем 3.5 flash, — но мне ни разу не удалось подтвердить это на реальных сценариях. Кто-нибудь находил, что их показатели задержки на самом деле точны? Может, поэтому они смягчили формулировки в этом релизе? Для контекста: я тестирую более крупные генеративные задачи, которые занимают 8–10 секунд на 3.5 flash и 15–25 секунд на 3.7 flash. В обоих случаях — минимальные настройки рассуждений.
1: https://artificialanalysis.ai/?speed=intelligence-vs-speed&m...
- TechRemarker
Надеюсь, до выхода 4.0 Flash мы наконец получим Gemini 3.5 Pro.
- atemerev
Сейчас все цензурируют модели за что-либо отдаленно напоминающее кибер или био. У меня уже проблемы с моими исследованиями в математической эпидемиологии из-за этого — и Sol, и Fable просто отказываются. Они продолжают подталкивать людей к китайским моделям, которые можно децензурировать.