Сигурност

Редакция Overclock.bg ·

OpenAI Astra: моделът, който сам пробива системи

OpenAI Astra: моделът, който сам пробива системи

На 1 септември 2026 г. OpenAI публикува документа „Path to Astra: critical capabilities and frontier safeguards“ и с него потвърди нещо, което лабораторията избягваше да каже месеци наред: предстоящият модел Astra е първият в портфолиото ѝ, който достига прага Critical за киберспособности по вътрешната Preparedness Framework. С подходящите инструменти и достъп Astra открива неизвестни досега пропуски и сам разработва работещи експлойти срещу добре защитени системи — без човек да го води стъпка по стъпка. Моделът ще излезе „скоро“, но най-силните му офанзивни функции ще стигнат до шепа партньори.

Какво точно може Astra

Astra покрива публичния тест ExploitBench със 100% и изпреварва GPT-5.6 Sol, който досега беше най-силният публичен модел на компанията за такива задачи. Заради риска от замърсяване с публични данни OpenAI изгради и собствена вътрешна версия на теста — 20 наскоро оповестени уязвимости с висока степен на сериозност в V8. В нея моделът е открил и вплел два zero-day пропуска в една верига от експлойти, пише TechCrunch.

Дефиницията за Critical в рамката на OpenAI е нарочно висока: модел с инструменти, който може да намира и разработва функционални zero-day експлойти от всякаква сериозност в множество втвърдени реални критични системи без човешка намеса, или да измисля и изпълнява изцяло нови атаки от край до край, ако му дадете само обща цел. Досегашният таван за публично достъпните модели беше нивото High.

Кой ще получи достъп

Пълните киберспособности на Astra отиват при малка група „алфа тестери“ — хора и организации, отговорни за защитата на критична цифрова инфраструктура. Сред тях са американското правителство и компаниите от програмата на OpenAI за доверен достъп. Останалите ще чакат: разширяването ще мине през нивото Daybreak Blue, в което днес влиза GPT-5.6 Sol, и ще се случи едва когато лабораторията реши, че калибрирането е правилно и ползата за защитниците надвишава риска от злоупотреба.

Логиката е позната от други области: същият инструмент, който намира дупка преди атакуващия, върши чудесна работа и в обратната посока. Достатъчно е да си припомните с какъв обем уязвимости се борят големите проекти — в ядрото на Linux вече се стига до близо 2000 CVE на издание, а човешките ръце за преглед не се увеличават.

Спирачките през август

Публикацията от 1 септември идва след месец на видими спирачки. На 7 август OpenAI съобщи, че вече не може да изключи Critical ниво при Astra, и постави на пауза вътрешни дейности, които не покриват новите изисквания за сигурност. На 18 август лабораторията временно спря обучението с подсилване на най-новите си модели за две седмици, а най-голямото планирано frontier RL пускане остана замразено.

Мерките, които компанията изброява, са от типа, който обикновено се прилага към оръжеен код:

  • изолирани тестови среди и sandbox изпълнение;
  • ограничен мрежов достъп и достъп до инструменти;
  • по-силна защита и криптиране на теглата на модела;
  • допълнително наблюдение и системи за откриване на рискови действия;
  • прекъсване на дейност с висок риск.

Към тях за самия релийз се добавят по-строг harness, който разпознава злоупотреба и опити за jailbreak, ограничения на ниво акаунт за „по-рискови“ потребители и наблюдение на веригата от разсъждения. Отделно OpenAI е тествала дали моделът се опитва да излезе от средата си — тема, която не е хипотетична, след като по-рано неин модел сам пробива инфраструктурата на Hugging Face при контролирано тестване.

Скептицизъм и контекст

Не всички приемат резултатите на доверие. Бивш изследовател на OpenAI отбелязва пред TechCrunch, че покорното поведение по време на тестове за безопасност не доказва безопасност — може да означава и че моделът разпознава, че го изпитват. Анализаторката Апекша Каушик от Gartner пък нарича момента „съществена повратна точка“ за индустрията, цитирана от CSO Online.

Струва си да се отбележи и какво липсва: OpenAI не публикува дата за излизане, нито цена или конкретен списък с партньори. Компанията, която междувременно отчита 1 милиард долара годишен приход от рекламите в ChatGPT, този път избра предпазливия сценарий — обявява способността, но задържа достъпа.

Заключение

Astra е първият случай, в който голяма лаборатория казва открито, че моделът ѝ пресича собствената ѝ червена линия за кибербезопасност — и въпреки това го пуска, макар и дозирано. Ако калибрирането е правилно, защитниците получават инструмент, който намира дупките преди атакуващите. Ако не е, същият инструмент рано или късно ще се озове от другата страна. Следващите месеци и разширяването през Daybreak Blue ще покажат кое от двете.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още