
OpenAI обяви на 30 юли 2026 г. най-агресивното си поевтиняване досега: GPT-5.6 Luna пада с 80%, а GPT-5.6 Terra — с 20%. Новите цени важат веднага в API-то, в Codex и в ChatGPT Work, а флагманът Sol запазва тарифата си, но получава нов платен режим Fast. Ходът е директен отговор на натиска от китайските модели и от евтините алтернативи, които компанията вече не може да пренебрегва.
Какво точно поевтинява
Luna, най-бързият и най-достъпен модел от семейството GPT-5.6, вече струва $0,20 за милион входни токена и $1,20 за милион изходни (около €0,17 и €1,05). Досега цената беше $1,00 вход и $6,00 изход — тоест разходът пада петорно.
Terra слиза от $2,50/$15,00 на $2 вход и $12 изход за милион токена (приблизително €1,74 и €10,45).
Sol остава на $5 вход и $30 изход, но в API-то се появява Fast режим, който заменя досегашния Priority Processing: до 2,5 пъти по-бърза обработка срещу двойна цена — $10 вход и $60 изход за милион токена (около €8,70 и €52). Интелигентността на модела не се променя, плащате единствено за скорост.
Важен детайл за абонатите: по-ниските цени се отразяват и в начина, по който се брои потреблението в Codex и ChatGPT Work, така че лимитите ви на практика стигат по-далеч. Terra е достъпна и за безплатните планове и Go, докато Luna изисква Plus, Pro, Business или Enterprise.
Sol пренаписа собствената си инфраструктура
Най-интересната част от съобщението не е ценоразписът, а откъде идват парите за него. OpenAI обяснява, че поевтиняването е финансирано от оптимизации в сървърния слой, извършени до голяма степен от самия GPT-5.6 Sol — моделът е търсил работа, която може да бъде предварително изчислена, избегната или паралелизирана.
Резултатите, които компанията изброява:
- около 20% по-нисък разход за обслужване на заявка благодарение на подобрени GPU кернели в продукция;
- над 15% по-добра ефективност при генерирането на токени чрез усъвършенствано спекулативно декодиране.
Според OpenAI Luna покрива нивото на водещите модели отпреди година, а задача, която тогава е струвала $1, днес излиза около 6 цента и се изпълнява приблизително 9 пъти по-бързо.
Разработчикът Саймън Уилисън, който проследи промяната в блога си, веднага прехвърли демото си agent.datasette.io от Gemini 3.1 Flash-Lite към Luna заради разликата в цената.
Къде застава Luna спрямо конкуренцията
Сравнението е красноречиво. Gemini 3.1 Flash-Lite на Google струва $0,25 вход и $1,50 изход за милион токена, а Claude Haiku 4.5 на Anthropic — $1 вход и $5 изход. Luna е под тях и по двата показателя.
| Модел | Вход / милион токена | Изход / милион токена |
|---|---|---|
| GPT-5.6 Luna | $0,20 | $1,20 |
| Gemini 3.1 Flash-Lite | $0,25 | $1,50 |
| Claude Haiku 4.5 | $1,00 | $5,00 |
| GPT-5.6 Terra | $2,00 | $12,00 |
| GPT-5.6 Sol | $5,00 | $30,00 |
Това не е абсолютният под на пазара — модели на DeepSeek, MiniMax и Xiaomi остават по-евтини на чист токен. Но за първи път модел от челната серия на OpenAI влиза в същата ценова лига.
Реакциите от партньорите са очаквано ентусиазирани. „GPT-5.6 Luna е най-близкото до интелигентност, твърде евтина, за да се мери. Не съм виждал толкова достъпен модел да е толкова мощен”, коментира Микеле Катаста, президент и ръководител на AI в Replit.
Защо се случва точно сега
Контекстът е конкурентен, а не благотворителен. Китайските модели вече държат съществен дял от корпоративното потребление на токени в САЩ през платформи като OpenRouter, а Microsoft активно бута собствените си по-евтини MAI модели като заместител на OpenAI — тема, която засегнахме и в статията за превръщането на Copilot в „супер приложение”.
Едновременно с това корпоративните клиенти станаха чувствителни към сметката. Когато разликата в качеството между челните модели се свива, решаващият аргумент се измества към цената за токен и към скоростта.
Има и обратна страна, която анализаторите отбелязват: The Decoder цитира опасения, че агресивното поевтиняване може да задуши растежа на приходите точно в момента, в който лабораториите наливат десетки милиарди в инфраструктура. Същият спор върви и около темпото на развитие изобщо — в началото на месеца над 1200 служители на водещи лаборатории поискаха спирачка.
Заключение
За разработчиците новината е еднозначно добра: ако сте градили около евтин модел от друг доставчик, сметката ви току-що има основателна причина да бъде преизчислена. По-широкият сигнал е друг — състезанието между челните AI модели вече не се води само на бенчмаркове, а на ценоразписа. И когато един модел оптимизира собствената си инфраструктура достатъчно, за да финансира 80% отстъпка, следващият ход е на конкуренцията.
Новините на Overclock — директно в Telegram, без алгоритми.
Следвайте ни в Telegram