
На 2 септември 2026 г. Google обяви Gemini 3.8 Flash — поредния бърз модел от семейството Gemini — и заедно с него специализиран вариант, наречен Gemini 3.8 Flash Cyber. Вторият не се продава на никого: достъп до него получават само организации, одобрени по новата програма Fairwind. Работата му е една — да търси уязвимости в код и да пише поправките за тях.
Ars Technica отбелязва, че това е третият Flash модел за шест седмици. Темпото на Google в тази серия вече е по-скоро месечно, отколкото годишно.
Какво може обикновеният 3.8 Flash
Google описва 3.8 Flash като „най-интелигентния си работен кон“ — модел, който при трудни задачи сам прави допълнителни стъпки на разсъждение и вика инструменти в цикъл, вместо да отговори с първото хрумнало.
Числата: на бенчмарка за автономно програмиране DeepSWE v1.1 моделът стига 73,7% — практически наравно с далеч по-големия Claude Opus 5 (74%). На HLE-Verified, който проверява многостъпково разсъждение в науки, хуманитаристика и професионални области, резултатът е 54,9%. Google посочва и водещи резултати на Vals Finance Agent V2 и на правния бенчмарк на Harvey.
Контекстният прозорец е 1 милион токена на вход и 64 хиляди на изход.
Цените са американски и с промоционален период до 31 декември 2026 г.: 0,75 щ.д. за милион входни токена и 3,75 щ.д. за милион изходни (около 0,65 € и 3,25 €). След тази дата тарифата се удвоява — 1,50 и 7,50 щ.д. за милион.
Моделът вече е достъпен през Google AI Studio, Antigravity, Android Studio и Gemini API, в Gemini Enterprise, а за абонатите на Google AI Pro и Ultra — в приложението Gemini, в AI Mode на търсачката и в Google Таблици.
Cyber вариантът: 86,2% на CyberGym
Тук е интересната част. Gemini 3.8 Flash Cyber е обучен за две конкретни неща: откриване на уязвимости и автоматично закърпване.
На CyberGym — стандартния бенчмарк за намиране на уязвимости в C/C++ — моделът постига 86,2% pass@1 и изпреварва както предшественика си 3.5 Flash Cyber, така и значително по-големи модели.
Снимка: Google DeepMind
По-показателен е вътрешният тест на Google с реални уязвимости в кодови бази на 20 езика за програмиране. Там 3.8 Flash Cyber успява в 71,0% от случаите, срещу 58,9% за 3.7 Flash и 46,6% за 3.5 Flash Cyber. Ръст от близо 25 процентни пункта за две поколения.
При писането на поправки картината е по-нюансирана. На CWE-Bench на Collinear моделът дава 47,2% pass@1 при около 3,60 щ.д. на изпълнение — тоест минимално под водещия конкурент с неговите 47,8%, но при чувствително по-ниска цена. Екипът по сигурността на Chrome обаче съобщава друго: при техните задачи 3.8 Flash Cyber е дал 2,6 пъти повече верни поправки от най-добрите комерсиални модели, които са многократно по-големи.
VentureBeat цитира и тест на Wiz (компанията, която Google придоби за 32 милиарда долара): 7,5–9,7% по-висок recall при 2,3–5,2 пъти по-ниска цена от челните модели.
Отделно Google измерва и устойчивостта срещу prompt injection по методиката на Gray Swan — успешните атаки падат до 6,0%. За модел, който по дефиниция чете чужд, потенциално враждебен код, това не е второстепенен параметър.
Двата конкретни случая
Google дава два примера, които звучат по-убедително от таблиците. Екипът Cloud Vulnerability Research е използвал модела, за да открие критична уязвимост в основен компонент за под два часа — работа, която обикновено отнема месеци.
Вторият случай е бъг, който е седял в Chromium и Chrome тринайсет години. Google го описва като много фин проблем, покрай който са минали десетки, ако не и стотици инженери, без никой да го маркира.
Fairwind: кой получава достъп
За разлика от 3.8 Flash, Cyber вариантът не е публичен. Достъпът минава през програмата Fairwind, а Google приема заявки с приоритет от три групи: държавни органи и национални киберагенции, оператори на критична инфраструктура (здравеопазване, телекоми, енергетика, финанси) и поддръжници на основни софтуерни платформи.
Условията не са символични. Организациите трябва да въведат удостоверяване на ниво потребител и MFA, устойчиво на фишинг, да ограничат достъпа само до вътрешните екипи по сигурност, реакция при инциденти и penetration testing, да следят кой и колко го ползва и да не преотстъпват или препродават достъпа. Google изрично проверява всеки кандидат за „доказана история на етична дейност“. Партньорите може да включат и CodeMender, а през Gemini Enterprise Agent Platform има опция за нулево задържане на данни.
Контекстът
Ограниченият достъп не е случаен. Само преди дни OpenAI обяви, че моделът ѝ Astra достига прага Critical за киберспособности — същият тип модел, който еднакво добре намира и използва дупки. А Forescout вече показа как Claude пренася готов RCE експлойт от един PLC контролер на друг за осем часа и 535 долара.
Логиката на Fairwind е точно тази: ако технологията така или иначе съществува, защитниците да я получат първи и при ясни правила. Дали шестседмичният цикъл на нови Flash модели ще остави време тези правила да работят — е друг въпрос.
Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.
Предпочитан източник в Google