AI

OpenAI сряза цената на GPT-5.6 Luna с 80%

OpenAI сряза цената на GPT-5.6 Luna с 80%

OpenAI обяви на 30 юли 2026 г. най-агресивното си поевтиняване досега: GPT-5.6 Luna пада с 80%, а GPT-5.6 Terra — с 20%. Новите цени важат веднага в API-то, в Codex и в ChatGPT Work, а флагманът Sol запазва тарифата си, но получава нов платен режим Fast. Ходът е директен отговор на натиска от китайските модели и от евтините алтернативи, които компанията вече не може да пренебрегва.

Какво точно поевтинява

Luna, най-бързият и най-достъпен модел от семейството GPT-5.6, вече струва $0,20 за милион входни токена и $1,20 за милион изходни (около €0,17 и €1,05). Досега цената беше $1,00 вход и $6,00 изход — тоест разходът пада петорно.

Terra слиза от $2,50/$15,00 на $2 вход и $12 изход за милион токена (приблизително €1,74 и €10,45).

Sol остава на $5 вход и $30 изход, но в API-то се появява Fast режим, който заменя досегашния Priority Processing: до 2,5 пъти по-бърза обработка срещу двойна цена — $10 вход и $60 изход за милион токена (около €8,70 и €52). Интелигентността на модела не се променя, плащате единствено за скорост.

Важен детайл за абонатите: по-ниските цени се отразяват и в начина, по който се брои потреблението в Codex и ChatGPT Work, така че лимитите ви на практика стигат по-далеч. Terra е достъпна и за безплатните планове и Go, докато Luna изисква Plus, Pro, Business или Enterprise.

Sol пренаписа собствената си инфраструктура

Най-интересната част от съобщението не е ценоразписът, а откъде идват парите за него. OpenAI обяснява, че поевтиняването е финансирано от оптимизации в сървърния слой, извършени до голяма степен от самия GPT-5.6 Sol — моделът е търсил работа, която може да бъде предварително изчислена, избегната или паралелизирана.

Резултатите, които компанията изброява:

  • около 20% по-нисък разход за обслужване на заявка благодарение на подобрени GPU кернели в продукция;
  • над 15% по-добра ефективност при генерирането на токени чрез усъвършенствано спекулативно декодиране.

Според OpenAI Luna покрива нивото на водещите модели отпреди година, а задача, която тогава е струвала $1, днес излиза около 6 цента и се изпълнява приблизително 9 пъти по-бързо.

Разработчикът Саймън Уилисън, който проследи промяната в блога си, веднага прехвърли демото си agent.datasette.io от Gemini 3.1 Flash-Lite към Luna заради разликата в цената.

Къде застава Luna спрямо конкуренцията

Сравнението е красноречиво. Gemini 3.1 Flash-Lite на Google струва $0,25 вход и $1,50 изход за милион токена, а Claude Haiku 4.5 на Anthropic — $1 вход и $5 изход. Luna е под тях и по двата показателя.

МоделВход / милион токенаИзход / милион токена
GPT-5.6 Luna$0,20$1,20
Gemini 3.1 Flash-Lite$0,25$1,50
Claude Haiku 4.5$1,00$5,00
GPT-5.6 Terra$2,00$12,00
GPT-5.6 Sol$5,00$30,00

Това не е абсолютният под на пазара — модели на DeepSeek, MiniMax и Xiaomi остават по-евтини на чист токен. Но за първи път модел от челната серия на OpenAI влиза в същата ценова лига.

Реакциите от партньорите са очаквано ентусиазирани. „GPT-5.6 Luna е най-близкото до интелигентност, твърде евтина, за да се мери. Не съм виждал толкова достъпен модел да е толкова мощен”, коментира Микеле Катаста, президент и ръководител на AI в Replit.

Защо се случва точно сега

Контекстът е конкурентен, а не благотворителен. Китайските модели вече държат съществен дял от корпоративното потребление на токени в САЩ през платформи като OpenRouter, а Microsoft активно бута собствените си по-евтини MAI модели като заместител на OpenAI — тема, която засегнахме и в статията за превръщането на Copilot в „супер приложение”.

Едновременно с това корпоративните клиенти станаха чувствителни към сметката. Когато разликата в качеството между челните модели се свива, решаващият аргумент се измества към цената за токен и към скоростта.

Има и обратна страна, която анализаторите отбелязват: The Decoder цитира опасения, че агресивното поевтиняване може да задуши растежа на приходите точно в момента, в който лабораториите наливат десетки милиарди в инфраструктура. Същият спор върви и около темпото на развитие изобщо — в началото на месеца над 1200 служители на водещи лаборатории поискаха спирачка.

Заключение

За разработчиците новината е еднозначно добра: ако сте градили около евтин модел от друг доставчик, сметката ви току-що има основателна причина да бъде преизчислена. По-широкият сигнал е друг — състезанието между челните AI модели вече не се води само на бенчмаркове, а на ценоразписа. И когато един модел оптимизира собствената си инфраструктура достатъчно, за да финансира 80% отстъпка, следващият ход е на конкуренцията.

Новините на Overclock — директно в Telegram, без алгоритми.

Следвайте ни в Telegram

Прочетете още