AI

Редакция Overclock.bg ·

Claude с воден знак и API за проверка, но има съмнения

Claude с воден знак и API за проверка, но има съмнения

Anthropic обяви на 14 август, че всички текстове на Claude вече носят невидим воден знак, и потвърди, че скоро ще пусне API, с който трети страни ще могат да го проверяват. В официалното описание компанията признава ограниченията сама, а изследователи, цитирани от Nature, вече казват, че знакът се маха твърде лесно, за да спре хората, които наистина искат да го заобиколят.

Как работи знакът

Схемата е вариант на SynthID-Text — методът на Google DeepMind, публикуван в Nature през 2024 г. Идеята е проста: когато моделът избира следващата дума и няколко варианта са еднакво добри, вместо обикновен генератор на случайни числа се използва таен ключ плюс няколко от предходните думи. Резултатът си остава случаен на вид, но следва статистическа схема, която може да се провери с ключа.

Anthropic го формулира така: думите, които Claude избира, все още са случайни, но вече може да се провери дали последователността съвпада с изборите, които Claude би направил.

Ключовото тук е, че нищо не се добавя към текста. Няма скрити символи, няма невидими интервали, няма промяна във форматирането. Затова водният знак пътува с текста при копиране и поставяне — той е текстът.

Какво покрива и колко струва

Маркирането е на ниво модел, тоест важи навсякъде, където се появява Claude: Claude Platform (API), Claude, Claude Code, Claude Cowork и Claude Tag. Помощната страница уточнява, че моделите, пуснати на или след 2 август 2026 г., го поддържат още от старта, а по-старите ще го получат през следващите месеци.

За файлове подходът е различен: при поддържаните формати (.svg, .png, .jpg) Anthropic закача подписани метаданни по отворения стандарт C2PA, без да пипа самия файл.

Цената е нула. Според The Register схемата не генерира допълнителни токени, не поскъпва обслужването и има пренебрежимо влияние върху скоростта. Anthropic твърди още, че водният знак не носи никаква идентифицираща информация — не може да бъде проследен до конкретен човек, организация или разговор.

Как Claude маркира генерираното съдържание Снимка: Anthropic

API-то още го няма

Тук е и най-голямата дупка. Anthropic пише дословно, че „скоро” ще предложи API за откриване на водния знак и че още уточнява детайлите по реализацията. Дата няма. The Decoder отбелязва, че това ще позволи на разработчиците да вградят проверката в собствените си приложения — но засега маркирането работи, а начин да го проверите публично няма.

Дори когато API-то излезе, то ще връща вероятност, не присъда. Компанията изрично казва, че водният знак не може да различи „Claude написа това” от „Claude силно редактира това”, нито да разпознае текст от друг модел с друга схема.

Къде знакът се къса

Anthropic изброява случаите честно, както обобщава и BleepingComputer:

  • Кратки текстове — малко думи означава малко избори, а значи и слаб сигнал.
  • Фактологични пасажи — при „2+2=” няма алтернативна формулировка, която да носи знак.
  • Код — точният код не се маркира почти никак; коментарите могат да носят знак.
  • Редакция на чужд текст — ако Claude само коригира ваши изречения, повечето думи са ваши и знак почти не се закача.
  • Пълно пренаписване — замяна на всяка дума премахва знака напълно. Леката редакция вероятно не.

Какво казват изследователите

Метаученият Рийз Ричардсън от Northwestern University е директен пред Nature: водните знаци едва ли ще спрат мотивираните хора да произвеждат фалшиви или нискокачествени статии, защото сигналът се маха лесно — например като прекараш текста през друг модел. А моделите с отворени тегла са точно такъв изход, при който никой не налага маркиране.

Нихар Шах от Carnegie Mellon University е по-умерен. Ако процентът фалшиви положителни е достатъчно нисък, част от нелегитимните употреби ще излизат наяве. Като пример той сочи ICML 2026, където организаторите са хванали 506 рецензенти, нарушили забраната за AI. Изводът му: някои ще заобикалят проверката внимателно, но много други просто копират и поставят.

Защо точно сега

Причината е регулаторна. През юли Anthropic подписа Кодекса за поведение на ЕС за прозрачност при генерирано от AI съдържание — заедно с около 190 други организации. Съответните изисквания на AI Act влязоха в сила на 2 август 2026 г. Регионално ограничаване технически не е възможно, затова маркирането тръгва глобално, включително за потребители извън ЕС.

Заключение

Водният знак на Claude е реален и вече работи, но не е това, за което мнозина ще го вземат. Той е вероятностен сигнал за обработка, не доказателство за авторство, и се къса при пренаписване. Ако очаквате инструмент, който ще разчисти интернет от машинно генерирани текстове — това не е той. По-скоро е слой прозрачност, който хваща небрежните, докато старателните минават покрай него. А самата екосистема около Claude в момента произвежда и далеч по-странни проблеми от неразпознат текст.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още