
За кілька днів після того, як компанія Anthropic повідомила про впровадження невидимих водяних знаків у весь текст, згенерований її моделлю Claude, з’явився ринок інструментів для їх видалення. Він охоплює проєкт на GitHub із понад 4 500 зірками, кілька нових веб-інструментів та щонайменше одну відому службу для обходу виявлення ШІ.
Наразі жодні заяви про можливість обходу текстових водяних знаків неможливо перевірити, оскільки Anthropic ще не опублікувала, як саме вони працюють, або не випустила детектор, який би показав, чи залишається водяний знак у “очищеному” документі.
Хто що пропонує
Серед найбільших інструментів — watermarks-remover, розроблений Гійомом Мейєром, засновником Memo, за ліцензією MIT.

Спочатку він був навичкою для Claude, а тепер підтримує видалення водяних знаків від Claude, Gemini та SynthID-Text, а також поверхневі дані OpenAI щодо походження контенту та моделі з відкритими вагами, що використовують мітки стилю Kirchenbauer.
Публікація Мейєра в соціальних мережах швидко набрала обертів, зібравши понад 2 мільйони переглядів:
watermarks-remover now supports watermarks from OpenAI and Gemini in addition to Claude.https://t.co/OxSdnAjEGe
— Guillaume Meyer (@guillaumemeyer) August 11, 2026
Поряд із цим проєктом існують репозиторії, такі як claude-watermark-cleaner, remove-ai-watermarks та noai-watermark, а також кілька веб-інструментів, що з’явилися відтоді: claudewatermark.com, claudewatermark.rip, gptcleanup.com та claudewatermarkremover.app.
StealthGPT, компанія, що продає послуги обходу виявлення ШІ, додала функцію видалення водяних знаків Claude до своїх сторінок із описом використання. Інший сервіс, Human Writes, рекламує можливість обходити Turnitin та GPTZero для есе та завдань, стверджує, що видаляє водяний знак Claude, і має нижній колонтитул, який нагадує користувачам, що послуга повинна використовуватися відповідно до політик академічної доброчесності.
На сторінці порівняння StealthGPT зазначає, що “жоден інструмент не гарантує 100% обходу, моделі виявлення регулярно оновлюються”, на тій самій сторінці, де оголошується про видалення водяних знаків Claude.
Що роблять “видалячі водяних знаків”
Ці інструменти виконують три різні дії, і лише деякі з них можна перевірити.
Видалення прихованих символів із тексту працює і може бути пораховане: символи з нульовою шириною, керуючі символи двонаправленого тексту, символи тегів Unicode та схожі на пробіл символи.
Видалення метаданих C2PA, EXIF та XMP з файлів також працює для форматів PNG, JPEG, SVG, PDF, DOCX, ODT, HTML та Markdown. Це частина, яка безпосередньо стосується підписаних даних походження Anthropic, і це також не є значним досягненням. Метадані файлів у будь-якому разі не зберігаються після повторного збереження, конвертації формату або скріншота.
Складна частина — це сам водяний знак. Він не міститься у прихованих символах.
Водяний знак полягає у виборі слів моделлю, що означає, що єдиний відомий спосіб його видалити — це суттєво переписати текст, використовуючи другу модель.
Мейєр досить відверто це пояснює, зауваживши в середу, що його інструмент наразі видаляє лише метадані, а видалення самих міток може з’явитися пізніше, але ще не доступне. Його README йде далі, стверджуючи, що перезапис замінює вибір слів оригінальної моделі на вибір дешевшої моделі, і запитуючи, чому хтось, хто платить за преміум-модель, буде потім обробляти її вивід через гіршу.
Комерційні сайти менш обережні. Кілька з них обіцяють чистий, непомітний вивід, а результати, які деякі з них повертають, вимірюються за допомогою звичайних детекторів ШІ, а не водяного знака Anthropic, для якого немає загальнодоступного детектора.
Незалежне тестування вже виявило прогалини.
Паскуале Піліттері клонував основні проєкти та прочитав код, а не README, виявивши, що один популярний очищувач тексту пропускає найпоширенішу техніку прихованого навантаження без змін. Приховане навантаження було розшифровано неушкодженим після того, як інструмент нібито очистив текст.
Чому Claude ставить мітки на тексті
Anthropic опублікувала сторінку підтримки цього тижня, де виклала свій підхід.
Текст, згенерований моделями, випущеними 2 серпня 2026 року або пізніше, містить непомітний водяний знак, вплетений у формулювання.
Підтримувані типи файлів отримують підписані метадані C2PA. Маркування застосовується на рівні моделі, тому воно з’являється через API, claude.ai, Claude Code, Claude Cowork і Claude Tag, а також через AWS, Google Cloud і Microsoft Foundry.
Причиною є Стаття 50 Закону ЄС про ШІ, яка набула чинності 2 серпня, зі штрафами, що сягають 15 мільйонів євро або 3% світового обороту.
Виявлена мітка також означає менше, ніж здається. Anthropic визнає, що вона вказує на обробку контенту моделлю Claude, а не обов’язково на його написання.
Якщо ви пропустите власний текст через модель для перевірки граматики, перекладу або резюме, вихідні дані будуть позначені.
Сторінка Anthropic також перелічує способи, якими мітка зникає, включно з редагуванням, перефразуванням та перекладом.
Компанія заявляє, що підтримуватиме стороннє виявлення, як того вимагають правила прозорості ЄС, і пізніше опублікує технічну документацію.
Реакція в Інтернеті була менш прихильною.
У відповідь на публікацію Мейєра один користувач, Емад Горбанінія, назвав водяні знаки “галочкою відповідності, а не реальним захистом”. Мейєр погодився щодо першої частини, відповівши, що це “чиста відповідність для збереження присутності на ринку ЄС”.
Більш смілива заява Горбанінії, що один інструмент видаляє мітки походження від трьох постачальників за один прохід, не витримує перевірки з репозиторієм, який стверджує протилежне.
Частина, яка має турбувати захисників
watermarks-remover постачається як навичка агента, яка встановлюється шляхом створення символічного посилання на каталог у локальній папці навичок і викликається за допомогою команди зі слешем. Його опціональна система оцінювання клонує сторонній дослідницький репозиторій та завантажує артефакт розміром приблизно 220 МБ.
Примітка: BleepingComputer не проводив аудит і тестування будь-яких інструментів, згаданих у цій статті. Читачі повинні ставитися до них з тією ж обережністю, що й до будь-якого іншого неперевіреного коду з Інтернету.
Це модель, на яку варто звернути увагу.
Незалежно від переваг основного аргументу про походження та конфіденційність, швидкозростаюча категорія інструментів, які люди інтегрують безпосередньо в конвеєри агентів, а потім пропускають через них свої документи, стає поверхнею атаки ланцюга постачання.
Проєкти, що наразі існують у цій сфері, принаймні відкриті та читабельні, навіть якщо вони не мають жодної ліцензії.
Наступна хвиля, яка з’явиться на ринку з попитом, підтвердженим понад чотирма тисячами зірок, і без можливості для покупців перевірити будь-які заяви, може бути іншою.
Після отримання дійсних облікових даних, лише 37% дій зловмисників блокується
Загальні показники запобігання можуть приховувати те, що відбувається після початкового доступу. Коли зловмисники використовують дійсні облікові дані, запобігання різко знижується.
The Blue Report 2026 вимірює методи захисту по техніках на основі 338 мільйонів симуляцій, проведених у робочих середовищах клієнтів.
Отримати звіт
Пов’язані статті:
Claude Fable 5 залишається безкоштовним для платних користувачів до 19 липня, поки Anthropic купує більше часу
Anthropic заявляє, що Claude Fable 5 не буде назавжди вилучено з підписок
Перезапуск Claude Fable розчаровує користувачів зниженою продуктивністю
Anthropic випускає Sonnet 5 з продуктивністю, близькою до Opus 4.8, за нижчою ціною
Anthropic тестує Claude Cowork, схожий на настільний комп’ютер, для мобільних пристроїв
За даними порталу: www.bleepingcomputer.com
