Anthropic слага воден знак на всеки отговор на Claude

Anthropic започна да маркира всичко, което Claude произвежда. Компанията обяви на 10 август, че вплита невидим воден знак директно в генерирания текст и прикача цифрово подписани метаданни за произход към файловете. Мярката идва от Кодекса за поведение към член 50 от европейския AI Act, но Anthropic я прилага глобално — не само за потребителите в ЕС.
Според собствената документация на компанията знакът „не променя смисъла, качеството или четимостта” на текста и остава невидим при нормално четене. По-интересното е второто уточнение: маркировката е проектирана така, че да преживее част от редакциите — тоест леко пренаписване или изчистване на абзац не я премахва задължително.
Какво точно се маркира
Разделението е на две.
За текста Anthropic използва невидим воден знак, вграден на ниво модел. Това означава, че той се появява навсякъде, където моделът работи: Claude Platform API, приложението Claude, Claude Code, Claude Cowork и Claude Tag. Важи и когато достъпвате моделите през AWS, Google Cloud или Microsoft Foundry.
За файловете — засега .svg, .png и .jpg — Claude добавя подписани метаданни за произход по отворения стандарт C2PA (Coalition for Content Provenance and Authenticity). Подписът показва, че файлът е минал през Claude, и прави последващото пипане на метаданните откриваемо.
Графикът е ясен: всеки нов модел, пуснат на или след 2 август 2026 г., идва с маркировка от първия ден. За вече съществуващите модели тече преходен период и Anthropic работи по добавянето ѝ със задна дата.
Откъде идва изискването
Член 50 от AI Act влезе в сила на 2 август 2026 г. Той изисква доставчиците на генеративен AI да маркират съдържанието си машинночетимо, за да могат платформи, регулатори и хора надолу по веригата да го различат от човешкото.
Европейската комисия публикува съответния Кодекс за поведение на 31 юли 2026 г. — буквално два дни преди задълженията да станат приложими. Според Комисията го подписаха около 190 организации: 82 по Раздел 1 (доставчици на модели) и 152 по Раздел 2 (внедрители). В първия списък освен Anthropic са Google, Meta, Microsoft, OpenAI, Mistral, Cohere, Aleph Alpha и Synthesia. Във втория има имена извън тех сектора — Getty Images, Lenovo, Lufthansa, Iberdrola.
Кодексът е доброволен, но Комисията и AI Board го признаха за адекватен инструмент за доказване на съответствие — засега единствения общоевропейски.
Какво не оцелява
Anthropic не продава маркировката като детектор на AI и си прави труда да изброи ограниченията.
Знакът изчезва при тежко редактиране, при превод на друг език, при конвертиране между формати и — най-прозаично — при скрийншот. Твърде кратък текст може изобщо да не носи откриваем сигнал. И обратното: наличието на знак не доказва, че Claude е написал съдържанието. Хората използват модела и за редакция, превод или преформулиране на собствен текст, така че маркер може да се появи и върху нещо, писано от човек.
Anthropic обеща техническа документация и инструменти за проверка, но без конкретен срок.
Скептицизмът
The Register отбелязва, че изследователи вече показаха как се махат водни знаци от изображения, а инструменти за изтриване на C2PA метаданни се намират свободно онлайн. За текста най-очевидната заобиколка е OCR — прекарайте отговора през скрийншот и разпознаване на текст и статистическият сигнал си отива.
Изданието посочва и втори ефект: част от клиентите, които не искат произходът на съдържанието им да е видим, може да мигрират към модели с отворени тегла, където никой не вгражда нищо.
Технически подходът на Anthropic не е обявен в детайли. The Decoder го сравнява със SynthID на Google DeepMind, който изкривява леко вероятностите при предсказването на следващия token, но компанията не е потвърдила, че използва същия механизъм.
Какво означава на практика
За обикновения потребител нищо не се променя видимо — текстът изглежда и се чете по същия начин. Промяната е за всички, които трябва да отсяват: университети, редакции, платформи и работодатели. Те получават сигнал, но слаб — сигурен само в едната посока и лесен за заличаване от този, който наистина иска.
Дебатът за произхода на AI кода и текста тече и в друга посока: Торвалдс наскоро се оплака от наплива от AI ревюта в Linux ядрото. Воден знак, който не преживява копи-пейст през скрийншот, едва ли ще реши този проблем — но поне превръща произхода в нещо, което може да се провери, вместо да се гадае.
Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.
Предпочитан източник в Google