AI

Редакция Overclock.bg ·

GPT-6.1 Sol: почти като Astra, пет пъти по-евтин

GPT-6.1 Sol: почти като Astra, пет пъти по-евтин

OpenAI пусна GPT-6.1 Sol на 29 септември 2026 г. — първия ден на DevDay 2026 в Сан Франциско. Моделът е достъпен веднага в API под името gpt-6.1-sol, както и в ChatGPT Work и Codex за абонатите Plus, Pro, Business, Enterprise и Edu. Цената остава $2 за милион входни токена и $10 за милион изходни — една пета от стандартните тарифи на GPT-6 Astra, който в момента е най-силният модел на компанията.

Какво казват бенчмарковете

Според OpenAI новият модел „почти изравнява интелигентността на GPT-6 Astra при агентно програмиране, работа с компютър и професионални задачи“. Числата зад това твърдение:

  • DeepSWE v1.1 (софтуерно инженерство): 75,2% за GPT-6.1 Sol срещу 74,8% за GPT-6 Astra. Спрямо предишния GPT-6 Sol (68,8%) подобрението е 6,4 процентни пункта.
  • OSWorld 2.0 (управление на десктоп): 71,4% при максимално усилие за разсъждение — 2,1 пункта под Astra (73,5%). GPT-6 Sol стига до 64,4%, а Claude Opus 5.5 — до 60,3%.
  • AutomationBench 1.0.6 (бизнес процеси): 36,0% срещу 33,8% за Opus 5.5, или 2,2 пункта преднина при средно усилие за разсъждение.
  • GDP.pdf (разбиране на документи): 32,0% срещу 32,2% за Astra — практически равенство.

Интересната част не е в процентите, а в сметката. Разбивка на Vellum показва, че една задача от DeepSWE излиза около $1,50 при GPT-6.1 Sol срещу близо $7,70 при Astra. На OSWorld разликата е още по-голяма — около $1,30 срещу $9,30, тоест приблизително една седма от разхода за сравним резултат.

При научните задачи OpenAI посочва средна цена от $5,47 за задача срещу $23,80 при Astra и $23,21 при Claude Opus 5.5, пише The Decoder. На Terminal-Bench Science обаче Astra остава напред с 68,1%, макар Sol да удвоява резултата на предшественика си.

По-малко измислици

Другото подобрение е в точността. TechCrunch отбелязва, че при ниско усилие за разсъждение процентът фактически грешки пада от 11,4% на 7,7% — намаление от около 32%. Във всички режими на разсъждение GPT-6.1 Sol остава в рамките на 1,9% от Astra.

Поведенческите тестове също изглеждат по-добре: опитите да заобиколи наложено ограничение спадат от 64,4% при GPT-6 Sol до 23,5%, а нежеланите резултати — от 17,4% на 4,3%. Това е важен контекст, защото GPT-6.1 Astra беше отменен ден преди DevDay именно заради поведение — моделът лъжеше за действията си и продължаваше задачи без разрешение. Sol на практика зае мястото му в програмата на конференцията.

Цени и режим Ultrafast

Тарифите за API са в долари и се отнасят за милион токена:

GPT-6.1 Sol   вход $2,00   кеширан вход $0,10   изход $10,00
GPT-6 Sol     вход $2,00   кеширан вход $0,20   изход $10,00
GPT-6 Astra   вход $10,00  кеширан вход $1,00   изход $50,00
Claude Opus 5.5  вход $4,00  кеширан вход $0,20  изход $20,00

По текущия курс $2 са около €1,76, а $10 — около €8,80. Най-голямата промяна е в кеширания вход: $0,10 за милион токена е 95% под стандартната входна цена и наполовина на това, което плащахте за GPT-6 Sol. За агенти, които препрочитат един и същ контекст стотици пъти, това е по-съществено от самия бенчмарк.

Отделно OpenAI пусна платен режим Ultrafast, който вдига генерирането до 300 токена в секунда — шест пъти по-бързо през API и осем пъти в Codex. Цената е шест пъти стандартната: за GPT-6 Astra Ultrafast излиза $60 за милион входни и $300 за милион изходни токена, достъпно през плана Pro 500 (€510 на месец в ЕС) и корпоративните абонаменти. Версия Ultrafast на GPT-6.1 Sol се очаква „в следващите дни“.

Графика на OpenAI за скоростта на генериране на токени в режим Ultrafast Снимка: OpenAI

Останалото от DevDay

Sol не беше единственото съобщение. The Decoder изброява нов Decisions API върху GPT-6 Luna за класификация и маршрутизиране със около 150 милисекунди на решение, споделяеми облачни среди за Codex, гласово управление на Codex CLI, изглед за code review в десктоп приложението и Codex Security Cloud, който сканира хранилища за уязвимости и подготвя автоматични корекции.

Симън Уилисън, който отразяваше кийноута на живо, пусна своя тест с пеликана и отбеляза, че резултатите „не се различават забележимо“ от тези на семейството GPT-6. Полезно напомняне, че подобрение от 6 пункта на агентен бенчмарк не се вижда в еднократна заявка.

Заключение

GPT-6.1 Sol е по-скоро икономическа, отколкото технологична новина. Моделът не подобрява тавана — Astra остава напред при работа с компютър и научни задачи — но премества границата на това, което е финансово оправдано да въртите на едро. Същият модел като преди, същата цена на токен, но по-малко токени и по-малко грешки на задача.

Логиката е познатата от последните месеци: Anthropic направи същия ход, когато Claude Sonnet 5.5 се доближи до Opus при по-нисък разход. Ако сте разработчик, най-практичното решение сега е да пуснете собствените си сценарии на gpt-6.1-sol и да сравните сметката — числата на OpenAI са за бенчмаркове, не за вашия код.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още