AI

Редакция Overclock.bg ·

Anthropic слага воден знак на всеки отговор на Claude

Anthropic слага воден знак на всеки отговор на Claude

Anthropic започна да маркира всичко, което Claude произвежда. Компанията обяви на 10 август, че вплита невидим воден знак директно в генерирания текст и прикача цифрово подписани метаданни за произход към файловете. Мярката идва от Кодекса за поведение към член 50 от европейския AI Act, но Anthropic я прилага глобално — не само за потребителите в ЕС.

Според собствената документация на компанията знакът „не променя смисъла, качеството или четимостта” на текста и остава невидим при нормално четене. По-интересното е второто уточнение: маркировката е проектирана така, че да преживее част от редакциите — тоест леко пренаписване или изчистване на абзац не я премахва задължително.

Какво точно се маркира

Разделението е на две.

За текста Anthropic използва невидим воден знак, вграден на ниво модел. Това означава, че той се появява навсякъде, където моделът работи: Claude Platform API, приложението Claude, Claude Code, Claude Cowork и Claude Tag. Важи и когато достъпвате моделите през AWS, Google Cloud или Microsoft Foundry.

За файловете — засега .svg, .png и .jpg — Claude добавя подписани метаданни за произход по отворения стандарт C2PA (Coalition for Content Provenance and Authenticity). Подписът показва, че файлът е минал през Claude, и прави последващото пипане на метаданните откриваемо.

Графикът е ясен: всеки нов модел, пуснат на или след 2 август 2026 г., идва с маркировка от първия ден. За вече съществуващите модели тече преходен период и Anthropic работи по добавянето ѝ със задна дата.

Откъде идва изискването

Член 50 от AI Act влезе в сила на 2 август 2026 г. Той изисква доставчиците на генеративен AI да маркират съдържанието си машинночетимо, за да могат платформи, регулатори и хора надолу по веригата да го различат от човешкото.

Европейската комисия публикува съответния Кодекс за поведение на 31 юли 2026 г. — буквално два дни преди задълженията да станат приложими. Според Комисията го подписаха около 190 организации: 82 по Раздел 1 (доставчици на модели) и 152 по Раздел 2 (внедрители). В първия списък освен Anthropic са Google, Meta, Microsoft, OpenAI, Mistral, Cohere, Aleph Alpha и Synthesia. Във втория има имена извън тех сектора — Getty Images, Lenovo, Lufthansa, Iberdrola.

Кодексът е доброволен, но Комисията и AI Board го признаха за адекватен инструмент за доказване на съответствие — засега единствения общоевропейски.

Какво не оцелява

Anthropic не продава маркировката като детектор на AI и си прави труда да изброи ограниченията.

Знакът изчезва при тежко редактиране, при превод на друг език, при конвертиране между формати и — най-прозаично — при скрийншот. Твърде кратък текст може изобщо да не носи откриваем сигнал. И обратното: наличието на знак не доказва, че Claude е написал съдържанието. Хората използват модела и за редакция, превод или преформулиране на собствен текст, така че маркер може да се появи и върху нещо, писано от човек.

Anthropic обеща техническа документация и инструменти за проверка, но без конкретен срок.

Скептицизмът

The Register отбелязва, че изследователи вече показаха как се махат водни знаци от изображения, а инструменти за изтриване на C2PA метаданни се намират свободно онлайн. За текста най-очевидната заобиколка е OCR — прекарайте отговора през скрийншот и разпознаване на текст и статистическият сигнал си отива.

Изданието посочва и втори ефект: част от клиентите, които не искат произходът на съдържанието им да е видим, може да мигрират към модели с отворени тегла, където никой не вгражда нищо.

Технически подходът на Anthropic не е обявен в детайли. The Decoder го сравнява със SynthID на Google DeepMind, който изкривява леко вероятностите при предсказването на следващия token, но компанията не е потвърдила, че използва същия механизъм.

Какво означава на практика

За обикновения потребител нищо не се променя видимо — текстът изглежда и се чете по същия начин. Промяната е за всички, които трябва да отсяват: университети, редакции, платформи и работодатели. Те получават сигнал, но слаб — сигурен само в едната посока и лесен за заличаване от този, който наистина иска.

Дебатът за произхода на AI кода и текста тече и в друга посока: Торвалдс наскоро се оплака от наплива от AI ревюта в Linux ядрото. Воден знак, който не преживява копи-пейст през скрийншот, едва ли ще реши този проблем — но поне превръща произхода в нещо, което може да се провери, вместо да се гадае.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още