Anthropic прави свои чипове, AMD купува Taalas

В рамките на едно денонощие две компании обявиха, че искат да контролират силиция, върху който работят езиковите модели. На 5 август Anthropic потвърди, че сглобява вътрешен екип за проектиране на собствени чипове за Claude. Ден по-късно, на 6 август, AMD обяви, че придобива Taalas — стартъп от Торонто, който не зарежда теглата на модела от паметта, а ги “изпича” директно в транзисторите.
Двете новини нямат обща пресконференция, но имат обща причина: inference-ът вече е по-голямото перо от обучението, а сметката за него се плаща на всеки токен.
Anthropic наема хора, които са “пускали силиций”
Anthropic не обяви продукт, дата или партньор за производство — обяви позиции за работа. Компанията търси полупроводникови инженери, които са “shipped silicon”, тоест реално са докарвали чип до производство, с възнаграждения между 320 000 и 485 000 долара (около 277 000 – 420 000 евро) годишно.
Официалната формулировка на Anthropic е, че ще проектира хардуера и моделите заедно, за да може Claude “да работи по-бързо и по-ефективно в мащаба, от който клиентите ни имат нужда”. На практика това означава чип, съобразен конкретно с механизмите на внимание и KV кеша на моделите на Anthropic, а не универсален ускорител. Според индустриални оценки, цитирани при отразяването, целта е около 50% сваляне на цената за токен.
Важното уточнение: това не е разрив с досегашните доставчици. Anthropic изрично остава при “multi-chip” подхода — AWS Trainium, Google TPU, Nvidia и AMD. Компанията вече е обвързана с до един милион TPU и над гигават капацитет по договора с Google от 23 октомври 2025 г., а през 2026 г. добави ново споразумение с Google и Broadcom за още няколко гигавата, които тръгват от 2027 г.
Срокове няма. Няма и яснота дали Anthropic ще произвежда чипа само с външен партньор — макар да се съобщава за ранни разговори със Samsung за 2nm процес. За сравнение, разработката на един челен AI чип се оценява на около 500 млн. долара.
AMD и чиповете, в които моделът е вграден завинаги
Taalas е основана през 2023 г. от Любиша Байич — човекът, който преди това създаде Tenstorrent — заедно с Драго Игнятович и Лейла Байич. Стартъпът е събрал около 219 млн. долара в три рунда, последният от които 169 млн. в началото на 2026 г.
Идеята е крайно проста и крайно радикална: вместо теглата на модела да седят в HBM памет и да се стриймват към процесора при всяка операция, те се записват физически в маска-ROM структура върху чипа. Taalas нарича резултата model-specific integrated circuit (MSIC).
Снимка: AMD
Първият чип HC1 е произведен по 6nm процес на TSMC, има около 53 млрд. транзистора върху 815 mm² и консумира около 200 W на карта. През февруари 2026 г. Taalas показа HC1 да обслужва Llama 3.1 8B с близо 17 000 токена в секунда — по данни на The Register 48 пъти повече от GPU на Nvidia и 8,5 пъти повече от ускорителите на Cerebras. Следващият HC2 се цели в 20 млрд. параметъра, а 50 такива ускорителя биха поели модел с трилион параметъра.
Уловката
Чипът е заключен за конкретен модел. Смяна отвъд LoRA адаптер означава нов re-spin — макар Taalas да твърди, че се променят само два метални слоя, а не целият дизайн. Тоест печелите порядък производителност, но губите гъвкавостта, заради която изобщо съществуват GPU-тата.
Затова AMD не заменя нищо. Планът е Taalas да влезе в rack системите Helios редом с Instinct GPU и EPYC CPU — GPU-тата обработват промпта, изпечените чипове генерират токените. “AMD изгражда пълна AI платформа, която дава на клиентите гъвкавост да разгърнат правилното изчислително решение за всяко натоварване”, коментира Вамси Бопана, старши вицепрезидент на AI групата в AMD.
Финансовите условия не са разкрити. Сделката се очаква да приключи през четвъртото тримесечие на 2026 г., след регулаторно одобрение.
Защо и двете новини сочат в една посока
Контекстът е сделката на Nvidia за технологията на Groq за около 20 млрд. долара от декември 2025 г. Три от най-големите играчи на пазара правят едно и също движение: купуват или строят хардуер, оптимизиран само за генериране на токени.
Причината е икономическа. Цените на inference-а падат агресивно — вижте ценовата война около кодиращите агенти — докато цената на паметта върви нагоре и вече бута нагоре сметките в целия хардуерен сектор. Чип, който изобщо не се нуждае от HBM за теглата, атакува точно това перо.
Заключение
Anthropic е в самото начало: обяви за работа, никакви срокове и открит въпрос кой ще произвежда. AMD е с няколко стъпки напред — купува готов екип с работещ тестов чип, но и с технология, чиято главна слабост е, че моделите остаряват за месеци, а маските не се пренаписват. Следващите 12 месеца ще покажат кое тежи повече: порядъкът производителност или свободата да смените модела утре.
Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.
Предпочитан източник в Google