Пазарът за премахване на водни знаци от изкуствен интелект (ИИ) се появи броени дни след като Anthropic разкри, че включва невидими маркировки във всичко, което Claude пише. Това обхваща проект в GitHub с над 4500 звезди, група от наскоро регистрирани уеб инструменти и поне една утвърдена услуга за избягване на детекция на ИИ.

Въпреки това, нито едно от твърденията за преодоляване на текстовия воден знак в момента не може да бъде проверено, тъй като Anthropic все още не е публикувала как работи технологията, нито е пуснала детектора, който би показал дали изчистеният документ все още носи маркировката.

Сред най-големите е „watermarks-remover“ – инструмент с лиценз MIT от разработчика на софтуер Гийом Мейер, основател на Memo.

Той започна като умение за агент само за Claude, а сега рекламира поддръжка за Claude, Gemini и SynthID-Text, източници на произход на OpenAI, както и модели с отворени тегла, използващи маркировки в стил Кирхенбауер.

Публикацията на Мейер в социалните мрежи бързо набра популярност, надхвърляйки 2 милиона гледания: „watermarks-remover вече поддържа водни знаци от OpenAI и Gemini в допълнение към Claude“.

Наред с него съществуват хранилища, включително „claude-watermark-cleaner“, „remove-ai-watermarks“ и „noai-watermark“, плюс група уеб инструменти, които се появиха оттогава: claudewatermark.com, claudewatermark.rip, gptcleanup.com и claudewatermarkremover.app.

StealthGPT, която продава услуги за избягване на детекция на ИИ, добави инструмент за премахване на водни знаци на Claude към страниците си с примери за употреба. Друга услуга, Human Writes, рекламира заобикаляне на Turnitin и GPTZero при есета и писмени работи, твърди, че премахва водния знак на Claude, и съдържа долна колонтитул, указваща на потребителите, че трябва да се използва само в съответствие с политиките за академична честност.

Собствената таблица за сравнение на StealthGPT прави уговорката, че „никой инструмент не гарантира 100% заобикаляне, моделите на детекторите се обновяват редовно“, на същата страница, където обявява, че вече премахва водни знаци на Claude.

Какво всъщност правят „инструментите за премахване на водни знаци“

Инструментите правят три различни неща и само някои от тях могат да бъдат проверени.

Премахването на скрити знаци от текста работи и може да бъде отчетено: символи с нулево разстояние, контроли за двупосочност, Unicode тагове и визуално сходни интервали.

Премахването на метаданни C2PA, EXIF и XMP от файлове също работи при PNG, JPEG, SVG, PDF, DOCX, ODT, HTML и Markdown. Това е частта, която директно засяга подписаните данни за произход на Anthropic, и също така не е голямо постижение. Метаданните на файловете така или иначе не оцеляват при повторно запазване, конвертиране на формат или екранна снимка.

Трудната част е самият воден знак. Той не се намира в скритите символи.

Водният знак се крие в това кои думи е избрал моделът, което означава, че единственият известен начин за премахването му е текстът да бъде сериозно пренаписан с помощта на втори модел.

Мейер е необичайно открит за това, като публикува в сряда, че неговият инструмент засега премахва само метаданни, а премахването на самите маркировки може да се появи по-късно, но не е достъпно днес. Неговото описание README отива по-далеч, твърдейки, че пренаписването заменя избора на думи на оригиналния модел с този на по-евтиния модел, и пита защо някой, който плаща за премиум модел, би прекарал резултата му през по-лош.

Търговските сайтове са по-малко внимателни. Няколко от тях обещават чист, неоткриваем резултат, а резултатите, които някои от тях връщат, се измерват спрямо обикновени детектори на ИИ, а не спрямо водния знак на Anthropic, за който не съществува публичен детектор.

Независимите тестове вече откриха пропуски.

Паскуале Пилитери клонира основните проекти и прочете кода вместо описанията README, откривайки, че един популярен инструмент за почистване на текст оставя най-често срещаната техника със скрит зловреден код непокътната. Скритият зловреден код се декодира обратно непокътнат, след като инструментът уж е почистил текста.

Защо Claude изобщо маркира текст

Anthropic публикува помощна страница тази седмица, в която излага своя подход.

Текстът от модели, пуснати на или след 2 август 2026 г., носи незабележим воден знак, вплетен в изказа.

Поддържаните типове файлове получават подписани метаданни C2PA. Маркирането се прилага на ниво модел, така че се появява в API, claude.ai, Claude Code, Claude Cowork и Claude Tag, както и чрез AWS, Google Cloud и Microsoft Foundry.

Стимулът за това е член 50 от Законодателния акт на ЕС за изкуствения интелект, който е в сила от 2 август, с глоби, достигащи 15 милиона евро или 3% от глобалния оборот.

Откритата маркировка също означава по-малко, отколкото изглежда. Anthropic признава, че тя показва, че съдържанието е било обработено от Claude, но не е задължително да е написано от него.

Ако прекарате собствената си проза през модела за проверка на граматиката, превод или резюме, изходният резултат се връща маркиран.

Страницата на Anthropic също така изброява начините, по които маркировката изчезва, включително сериозна редакция, парафразиране и превод.

Компанията заявява, че ще поддържа детекция от трети страни, както изискват правилата на ЕС за прозрачност, и ще публикува техническа документация по-късно.

Реакцията онлайн е по-малко снизходителна.

В отговор на публикацията на Мейер, един потребител, Емад Горбаниня, нарече водното маркиране „кутийка за отмятане на съответствието, а не истинска защита“. Мейер се съгласи с първата част, отговаряйки, че това е „чисто съответствие, за да се остане на пазара на ЕС“.