AI

Редакция Overclock.bg ·

Claude Opus 5: по-мощен и по-евтин AI за код и агенти

Claude Opus 5: по-мощен и по-евтин AI за код и агенти

Anthropic представи Claude Opus 5 на 24 юли 2026 г. — ново поколение AI модел, който според компанията предлага почти цялата интелигентност на топ модела ѝ Claude Fable 5, но на половин цена. Моделът е достъпен веднага във всички платформи на Anthropic и е позициониран като ефективен „ежедневен работен кон” за писане на код, автономни агенти и корпоративни работни процеси.

Цената е ключовата новина

Opus 5 струва $5 за милион входни токена и $25 за милион изходни (около €4,4 и €22) — точно колкото предшественика Opus 4.8 и без поскъпване. За сравнение флагманът Fable 5 остава на $10 вход и $50 изход за милион токена. С други думи, компанията предлага производителност, доближаваща се до върха на гамата ѝ, на приблизително половината от разхода.

Наред с това Anthropic добавя няколко практични лоста за бизнеса. Появява се „effort dial” — механизъм, който позволява на екипите да управляват и прогнозират по-точно сметките си, като балансират между дълбочина на разсъжденията и цена. Има и Fast mode — на двойна цена, но с около 2,5 пъти по-бърз изход. По думите на Anthropic Opus 5 намалява осезаемо изразходваните токени при партньори като Harvey и Zapier.

Как се представя на бенчмарковете

Най-впечатляващият резултат идва от ARC-AGI-3 — бенчмаркът, създаден да измерва нещо близко до „реална интелигентност” чрез непознати среди, в които моделът трябва сам да изследва, планира и действа. Opus 5 постига 30,2%, докато предишният рекорд беше едва 7,8% (държан от GPT-5.6 Sol Max), както съобщава The Decoder. Моделите от класа Fable се задържаха около 20%. На по-старите версии Opus 5 бележи 90,4% на ARC-AGI-2 и 97,5% на ARC-AGI-1.

Екипът на ARC Prize приписва скока на „по-силно логическо разсъждение”, което позволява автономно изследване. При решаването моделът дори демонстрирал нетипично поведение — превел задачи в алгебрична нотация и сам изведел уравнения за отражение.

Картината обаче не е еднопосочна. На независимия бенчмарк Witness Opus 5 постига 43,4 точки — статистически изравнен с Kimi K3 и Fable 5, което показва, че напредъкът е по-тесен, отколкото ARC-AGI-3 подсказва. А на класацията на Artificial Analysis моделът води пред Fable 5, но с малка разлика.

Код, агенти и корпоративни задачи

Тук са и най-осезаемите ползи. По данни на Anthropic:

  • на CursorBench 3.2 Opus 5 е в рамките на 0,5% от пиковия резултат на Fable 5 — на половин цена;
  • на OSWorld 2.0 (реални компютърни задачи) надминава Fable 5 на една трета от цената;
  • на Zapier AutomationBench постига около 1,5 пъти по-висок процент успех спрямо следващия най-добър модел.

Scott Wu, изпълнителен директор на Cognition (компанията зад агента Devin), заяви, че на FrontierCode 1.1 „Claude Opus 5 се доближава до нивото на Fable на половин цена”, със силни страни в дебъгването и анализа на първопричини. Като илюстрация за агентните умения Anthropic посочва случай, в който моделът, без пряк достъп до чертеж на машинна част, сам написал компютърно-зрителен pipeline, за да извлече геометрията и да реконструира 3D модел във FreeCAD.

По линия на сигурността Opus 5 достига ниво в откриването на уязвимости, сравнимо с Mythos 5, но Anthropic умишлено не го е обучавала на техники за експлоатация, за да запази изоставане в тази област. Темата за автономните агенти, които действат сами, тепърва ще става по-остра — както показа и случаят с агента на OpenAI, който проби Hugging Face.

Какво означава това за разработчиците и надпреварата

За разработчиците посланието е директно: почти флагманско качество при кодиране и агентни задачи, без флагманска цена. Комбинацията от непроменена цена спрямо Opus 4.8 и по-ниска консумация на токени прави модела привлекателен за продукти, които въртят милиони заявки — точно сегментът, за който Anthropic се бори с OpenAI и с китайски играчи като Moonshot.

За индустрията Opus 5 е поредният сигнал, че конкуренцията вече не се води само по чиста мощ, а по цена на единица интелигентност. Когато „почти толкова добро” струва наполовина, изборът на модел за реални приложения се измества. Разработчикът Simon Willison също отбелязва в прегледа си, че моделът предлага „frontier интелигентността на Fable 5 на половин цена” — формулировка, която обобщава цялата стратегия зад пускането.

Остава да видим дали независимите тестове ще потвърдят рекордите от ARC-AGI-3 в ежедневната работа, или напредъкът ще се окаже по-скромен, както подсказва Witness. Но за момента Anthropic ясно заяви приоритета си — не най-скъпият възможен модел, а най-изгодният за реална употреба.

Източници: The Decoder, VentureBeat, Simon Willison.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още