AI

Редакция Overclock.bg ·

Claude Fable 5.1 на практика: пет нива на усилие

Claude Fable 5.1 на практика: пет нива на усилие

Anthropic пусна Claude Fable 5.1 на 1 септември 2026 г. и моделът е достъпен веднага през API-то като claude-fable-5-1, както и през AWS, Google Cloud и Microsoft Azure. Пет дни по-късно вече има достатъчно независими тестове, за да се каже кое от обещаното се усеща в работа и кое зависи изцяло от това как настроите модела.

Какво точно е новото

Fable 5.1 не е ново поколение, а надграждане на Fable 5 от юни. Контекстът остава един милион токена, а официалното съобщение описва три групи промени.

Първата е агентната работа. На Terminal-Bench 4.0 моделът стига 55,8% срещу 42,0% за Fable 5, а на Terminal-Bench-Science 0.1 — 52,6% срещу 24,7%. На CursorBench 3.2.0 разликата е по-скромна: 73,4% срещу 70,5%.

Втората са предпазните механизми. Fable 5.1 вече може да открива уязвимости в код, като защитите се задействат около 60% по-рядко в сесия, а при безобидни биологични въпроси — 85% по-рядко. Писането на експлойти и penetration testing остават блокирани.

Третата е цената: базовата тарифа не мърда, но четенето от кеша поевтинява със 75%. Подробностите за сметката разгледахме отделно в статията за това как Fable 5.1 и Mythos 5.1 стават до 45% по-евтини.

Пет нива на усилие, а не превключвател

Най-практичната новост са петте степени на разсъждение — low, medium, high, xhigh и max. По подразбиране Claude Code стартира на high, а Claude Cowork и claude.ai — на medium.

Разликата не е козметична. В тестовете на Саймън Уилисън една и съща задача — SVG рисунка на пеликан на велосипед — минава почти без разсъждение на low и medium (около 2000 изходни токена), докато на xhigh моделът изразходва 36 767 токена за 7 минути и 51 секунди, а на max — 65 927 токена за 13 минути и 54 секунди. Резултатът на max наистина е най-добър, но ви струва 3,30 щ.д. (около 2,80 €) срещу 0,10 щ.д. (около 0,09 €) на low.

Изводът е скучен, но важен: усилието е основната ръчка за настройка. Според ръководството за промптване medium горе-долу изравнява Fable 5 при по-ниска цена, а low често излиза по-евтино на задача от Opus 5 и Sonnet 5, без да губи точки.

Промените в поведението, които ще забележите

Ако мигрирате от Fable 5, очаквайте различен стил на работа. Прегледът на ръководството за Fable 5.1 изброява няколко ясни разлики:

  • по-малко паралелни извиквания на инструменти — често по едно на ход, което значи повече токени и повече чакане;
  • по-малко междинни съобщения за прогрес, особено на високо усилие; понякога изглежда, че моделът е замръзнал, а всъщност мисли;
  • по-плътна проза, по-малко удебелявания, заглавия и списъци;
  • склонност да пренапише целия файл вместо да направи точкова редакция;
  • разширяване на обхвата — освен поисканото получавате и „поправки“, за които не сте молили.

Последните две се лекуват с изрична инструкция в системното съобщение — например да редактира хирургически и да докладва чужди бъгове, вместо да ги поправя.

Карта на релефа на вулкан на Венера с резолюция 300 метра Снимка: Anthropic

Как се справя в реални задачи

Anthropic показва примери от клиенти: прототип на MongoDB, изграждан три дни, и една непрекъсната 38-часова машинно-обучаема сесия в Ramp, в която моделът сам е открил артефакт в етикетите и го е коригирал.

Независимите тестове са по-приземени. Един разработчик даде на Fable 5.1 два случая: кодек за изображения на Go, който да бие WebP, и сайт на дизайн студио. И двата излязоха от един промпт без корекции, а кодекът компресира с между 1 и 9% по-добре от WebP в зависимост от снимката. Самият автор обаче уточнява, че тестовият набор е под 50 изображения — твърде малко за производствени изводи.

Tom’s Guide предлага един промпт, който показва силата на модела най-бързо: описвате реален проект, върху който работите, поставяте текущия си код или план и искате да ви кажат какво не е наред в мисленето ви, какво пропускате, след което да го преработят, обяснявайки решението на всяка стъпка. Логиката е проста — Fable 5.1 се справя най-добре, когато му дадете проект, а не въпрос.

Къде не си струва

Fable 5.1 остава по-бавен от Opus 5 и двойно по-скъп на некеширани токени. За класификация, кратки въпроси по код или високообемен чат е излишен — там по-евтините модели вършат същото. Големият контекст също не е безплатен: един милион токена не означава един милион токена полезно внимание.

Заключение

Fable 5.1 е модел за дълги, автономни задачи, при които провалът струва скъпо. Ако го включите така — с подходящо ниво на усилие и ясни инструкции срещу пренаписването на файлове — печалбата е реална. Ако го оставите на max за всичко, ще платите многократно повече за разлика, която често няма да забележите. За контекст колко бързо се движи класацията, вижте и как Artificial Analysis преработи своя Intelligence Index.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още