Anthropic ще поставя воден знак върху текста, генериран от AI моделите ѝ, включително Claude, за да спази европейските разпоредби. Компанията потвърди въвеждането на водните знаци в актуализирана страница за поддръжка.
Кодексът за прозрачност към Закона за изкуствения интелект на ЕС, който влезе в сила на 2 август, изисква компаниите, работещи в областта на изкуствения интелект, да маркират съдържанието, генерирано или редактирано от изкуствен интелект, по начин, по който други системи да могат да го идентифицират.
Anthropic заяви, че всички модели, пуснати след 2 август, автоматично ще разполагат с технология за поставяне на воден знак както върху генерирания от компютър текст, така и върху файловете. За файловете компанията използва отворения стандарт C2PA.
И заяви, че ще разшири поддръжката и за по-старите модели, като добави, че водният знак ще се пренася, когато потребителите копират и поставят текста.
Тъй като водният знак е част от текста, той ще се пренася заедно с текста, когато той бъде копиран и поставен на друго място, и може да остане дори след някои редакции. Поставянето на воден знак ще се прилага на ниво модел, което означава, че той ще присъства, независимо от кой продукт на Claude или от коя платформа произхожда текстът“, се посочва на страницата за поддръжка.
Не е ясно колко редакции трябва да направят потребителите, за да премахнат водния знак.
Компанията отбеляза, че водният знак ще се прилага към различни продукти, като API на платформата Claude, Claude, Claude Code, Claude Cowork и Claude Tag.
Платформите сега бързат да поставят воден знак върху съдържанието, генерирано от AI, след негативната реакция от страна на потребителите и за да избегнат регулаторния контрол. Миналата седмица платформата за музика, създадена с AI, Suno, обяви, че ще маркира генерираните на платформата песни след поредица от правни предизвикателства. Миналия месец стана ясно, че услугата за бюлетини Substack си сътрудничи с Pangram, за да маркира съдържанието, генерирано от AI.
Освен Anthropic, други компании, като Black Forest Labs, Google, Meta, Microsoft, OpenAI и Synthesia, са поели ангажимент да спазват кодекса на ЕС.
Google, Anthropic и невидимият подпис на AI текста
В надпреварата за разпознаване на текст, генериран от изкуствен интелект, Google вече има технология, която работи по сходен принцип с обявения от Anthropic подход. SynthID Text променя вероятностите при избора на токени по време на генерирането, така че в текста да се появява статистически модел, невидим за човешкото око, но разпознаваем от специализиран детектор.
Google използва технологията за текст, генериран в Gemini app и web. Важната особеност е, че watermark-ът не представлява отделен metadata слой, който може лесно да бъде изгубен при копиране и поставяне. Вместо това сигналът е заложен в самата последователност от думи и токени. Така обикновеното copy/paste не го премахва.
Технологията обаче има ограничения. Самият Google посочва, че тя работи по-надеждно при по-дълги и разнообразни текстове, което означава, че кратките отговори остават по-трудни за надеждно идентифициране.
На този фон Anthropic изглежда прави още една крачка по отношение на продуктовото обещание. Според обявения подход, watermarking-ът ще бъде приложен на ниво модел, така че сигналът да присъства независимо от начина, по който е генериран текстът – чрез Claude, API или Claude Code. При Google публичната информация е по-конкретно свързана с Gemini app и web, а не с абсолютно всеки генериран от моделите текст.
Какво прави OpenAI?
Особено интересен е подходът на OpenAI. През 2026 г. компанията възприе двуслоен модел за изображения, който комбинира C2PA Content Credentials с Google SynthID. Причината е, че двете технологии решават различни проблеми.
C2PA създава криптографски подписана информация за произхода на дадено съдържание – например кой инструмент го е създал и дали при създаването му е използван AI. Тази информация обаче може да бъде загубена при определени операции с файла, включително преобразуване или screenshot.
SynthID, от друга страна, вгражда невидим сигнал директно в самото съдържание. При изображенията това означава промени на ниво пиксели, а при текста – статистическа характеристика на генерираната последователност. Именно затова подобен watermark може да оцелее при част от трансформациите, при които metadata се губят.
При текста в ChatGPT ситуацията не е толкова ясна. Засега няма публично официално съобщение, че OpenAI ще поставя воден знак на всички текстови отговори на ChatGPT. Компанията подкрепя европейския Transparency Code, който включва изисквания и към генерирано от AI съдържание, но публично не е посочила конкретна технология или дата за въвеждане на watermark за LLM текст.
Това оставя OpenAI в по-различна позиция от Anthropic и Google, поне що се отнася до публично заявените планове за текст.
Watermark не означава „AI generated“ надпис
Разликата между watermark и provenance технологията е важна и за това как трябва да се разбират новите правила в Европа.
C2PA/Content Credentials представляват информация за произхода и историята на дадено съдържание, докато невидимите водни знаци като SynthID се опитват да вградят разпознаваем сигнал директно в самото съдържание.
Следователно европейските изисквания не означават, че всеки текст, генериран от AI, ще бъде придружен от видим надпис „AI-generated“. За доставчиците на генеративни AI системи ключовото изискване е съдържанието да бъде маркирано по начин, който позволява машинно разпознаване. Видимото обозначаване има отделни изисквания при определени категории съдържание, включително deepfake материали и някои AI-генерирани текстове по въпроси от обществен интерес.
На този етап Google и Anthropic изглеждат сред най-напредналите компании по отношение на поставянето на водни знаци на LLM текст. OpenAI има значително развита инфраструктура за установяване на произхода на съдържание, но публично тя е най-конкретна при изображенията. Meta и Microsoft също развиват инструменти за проследяване и обозначаване на AI съдържание, но по-ясните им решения засега са концентрирани основно върху мултимедията. При аудиото пък един от най-видимите примери е ElevenLabs.
Така битката за „невидимия подпис“ на AI текста тепърва започва. Ако технологиите се наложат, генерираният от езиков модел текст може да носи своеобразен цифров отпечатък, който да остава разпознаваем дори след копиране и редактиране. Големият въпрос ще бъде доколко тези системи ще са устойчиви на по-сериозна преработка на текста и дали различните компании ще използват съвместими стандарти – нещо, от което ще зависи дали AI watermarking-ът ще се превърне в реален индустриален стандарт или ще остане набор от отделни, несъвместими технологии.
Източник: Economic.bg

