Дешёвая Gemini 3.8 Flash почти догнала Claude Opus 5 на починке багов

Google выпустила Gemini 3.8 Flash — третье обновление линейки Flash за шесть недель — и отдельную модель Gemini 3.8 Flash Cyber для поиска уязвимостей. На бенчмарке DeepSWE 1.1, где агент чинит реальные баги в репозиториях, новая Flash набрала 73,7% против 74% у Claude Opus 5 — при цене и скорости уровня Flash.
Цена за токен осталась как у 3.7 Flash, но модель тратит больше токенов на рассуждение, так что счёт за задачу вырастет. Версию Cyber в открытый доступ не отдали: она раздаётся только проверенным командам защиты — по той же логике, что закрытые кибермодели Anthropic и OpenAI. По замерам Google, Cyber берёт 86,2% на отраслевом тесте CyberGym и держится на границе лучших результатов по автоматическому исправлению уязвимостей.
Sundar Pichai@sundarpichai
We’re also introducing Gemini 3.8 Flash Cyber, our most capable cybersecurity model. It shows frontier-level performance in discovering vulnerabilities and patching them at scale, with Flash-level speed & pricing. That includes achieving 86.2% on the important CyberGym industry https://t.co/iZBfqOdyMh
3 5592 сентября 2026
Что говорят
mattlondonHacker News
Прошло всего три-четыре недели после 3.7 Flash, которая вышла через три-четыре недели после 3.6 Flash. Похоже, DeepMind без Демиса у руля спустили с цепи и они несутся на полной. А где, кстати, 3.5 Pro? :)
andaiHacker News
Погодите, я не осознавал, что 3.7 Flash уже обходит Sol на ряде бенчмарков. Это же куда меньшая модель, разве нет?
xnxHacker News
Похоже на апгрейд без компромиссов к 3.7, которая и так дешевая, быстрая и без этого искалеченного стиля письма, как у Claude.