AI

Редакция Overclock.bg ·

GPT-6 Astra: OpenAI обяви „ерата на AGI“

GPT-6 Astra: OpenAI обяви „ерата на AGI“

На 3 септември 2026 г. OpenAI пусна GPT-6 Astra и го нарече „най-интелигентният и най-подравненият модел в света“. По-интересно от маркетинга обаче е какво каза президентът на компанията Грег Брокман по време на представянето: „Добре дошли в ерата на AGI.“ Това е първият път, в който OpenAI официално заявява, че прагът е прекрачен — макар и с достатъчно уговорки, че никой да не може да я хване за думата.

Кой го получава и кога

Достъпът тръгва отзад напред. Първи го взимат ограничен брой организации от Daybreak — програмата на OpenAI за киберсигурност, в която се влиза с кандидатстване. В следващите дни моделът стига до абонатите на ChatGPT Plus, Pro, Business и Enterprise, както и до OpenAI API и Amazon Web Services. Според the-decoder абонатите на Pro, Business и Enterprise получават и отделен вариант GPT-6 Astra Pro.

В API моделът се води gpt-6-astra и струва 10 долара за милион входни токена и 50 долара за милион изходни (приблизително €8,60 и €43). Това е 2,5 пъти повече от GPT-5.6 Sol и точно колкото Claude Fable 5.1 на Anthropic. Има и „бърз“ режим — 2,5 пъти по-висока скорост срещу двойна цена.

Брокман защити сметката с аргумент, който ще чувате все по-често: „Това, което всъщност искате, е цената на задача. Можете ли да свършите работата на приемлива цена и с приемлива скорост?“

Числата

Астра е трениран на над 100 000 GPU в центъра Stargate в Тексас и резултатите му покриват необичайно широк набор от тестове:

  • ARC-AGI-3: 99,9% — но само с персонализиран harness, който пази скритото състояние на разсъжденията между заявките и позволява на модела да преизползва вече свършена работа. Със стандартния harness резултатът пада до 62,7%, отбелязва Саймън Уилисън.
  • FrontierMath Tier 4 v2: 97,6%
  • DeepSWE v1.1 (софтуерно инженерство): 74,1%
  • OSWorld 2.0 (работа с компютър): 72,6%
  • Terminal Bench 4.0: 57,7%; Agents’ Final Exam: 59,3%
  • Дълъг контекст: 100% на теста с осем „игли“ при 256K–512K токена и 96,3% при 512K–1M

Разликата от 37 пункта в ARC-AGI-3 между двата harness-а е добра илюстрация защо е разумно да гледате бенчмарковете скептично. Обобщаващият Artificial Analysis Intelligence Index дава на Astra 61 точки — наравно с GPT-5.6 Sol и под 66-те на Claude Fable 5.1. По индекса за кодиращи агенти обаче Astra изпреварва Sol с 2 точки при сходна цена и струва под половината от Fable 5.

Киберспособностите

Най-тежката част остава сигурността. Astra покрива ExploitBench със 100%, а на SRE-Bench постига 88,0% от първи опит и 99,2% в рамките на четири опита. По време на оценките моделът е открил две неизвестни дотогава zero-day уязвимости. На по-трудния ExploitGym резултатът е далеч по-скромен — 42,4%.

Това прави Astra първия модел, който OpenAI класифицира като Critical по вътрешната си Preparedness Framework. Компанията предупреди за това още преди пускането — писахме подробно как Astra сама пробива компютърни системи и какви ограничения въведе лабораторията около обучението му.

Официална визуализация на OpenAI за GPT-6 Astra Снимка: OpenAI / the-decoder

Какво всъщност значи „ерата на AGI“

Тук си струва да сте внимателни с формулировките. OpenAI не казва, че GPT-6 Astra е AGI. Брокман го нарича „поколенчески скок“, който „в крайна сметка може да бъде видян“ като момента на пристигането на AGI — конструкция, която оставя изхода отворен и в двете посоки.

Практическата разлика с предишните поколения е в автономността. Astra работи с компютър и браузър като човек: щрака, попълва форми, преминава през многостъпкови задачи в различни области, без да губи от поглед първоначалната инструкция. Engadget описва демонстрационното видео, в което моделът прави 3D модели и презентации и върши няколко задачи едновременно — поръчва храна, докато пише игра. 9to5Google добавя демонстрация, в която Astra търси педиатър в Google Maps и попълва формуляри за контакт, и отбелязва, че моделът изпреварва Claude Opus 5 и Fable 5 при работа с компютър при по-ниска цена.

Заключение

GPT-6 Astra е силен модел с реални предимства при агентните задачи, дългия контекст и сигурността — и с цена, която го прави сериозна алтернатива на Claude за кодиращи агенти. Обявяването на „ерата на AGI“ е по-скоро позициониране, отколкото измерим факт: същият модел, който взима 99,9% на един тест с подходящ harness, пада до 62,7% без него и остава под Fable 5.1 по обобщаващия индекс.

По-важното следствие е друго. За първи път най-способният публичен модел на OpenAI излиза с етикет Critical за киберспособности, а достъпът до него тръгва от програма за киберсигурност, а не от масовия абонамент. Как ще се разшири този достъп през следващите месеци ще каже повече от която и да е презентация.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още