Сутки спустя: open-source «сниматель» маркировки AI-текста

Anthropic закрепила невидимую маркировку в тексте Claude — и уже на следующий день в open source появился MIT-проект, который снимает такие метки с вывода нескольких LLM. Для соло-разработчика, гоняющего черновики через агента и навыки в IDE, это не абстрактный спор о прозрачности: в репозитории лежит готовый навык агента /remove-ai-marks со скриптами проверки и очистки — гигиена текста до коммита, а не только новость о политике вендора.
Что Anthropic добавила в вывод Claude
Вендор описывает два слоя машиночитаемых меток. Первый — невидимый водяной знак в тексте: он вплетён в сам текст, не меняет смысл и читаемость и, по заявлению Anthropic, может сохраняться при копировании и частичном редактировании. Второй — подписанные provenance-метаданные в файлах по стандарту C2PA для поддерживаемых форматов (SVG, PNG, JPG).
Маркировка действует для моделей, запущенных на или после 2 августа 2026 года, глобально — не только в ЕС. Охватывает API, Claude, Claude Code, Claude Cowork и Claude Tag; для текста — в том числе через облачных партнёров (AWS, Google Cloud, Microsoft Foundry). Anthropic подчёркивает ограничения: метка сигнализирует, что контент может быть обработан Claude, но не подтверждает авторство; отсутствие метки не доказывает «человеческое» происхождение.
Регуляторный контекст: компания ссылается на подписание Code of Practice по EU AI Act Art. 50(2) — прозрачность AI-контента как обязательный слой, а не опцию.
Как устроен сниматель меток: навык агента и три слоя
Guillaume Meyer опубликовал на GitHub репозиторий watermarks-remover (лицензия MIT, последний релиз v0.3.2). Проект позиционируется как навык агента плюс скрипты Python на стандартной библиотеке для снятия меток происхождения ИИ-текста от разных вендоров — «для приватности и гигиены контента, которым вы владеете».
| Слой | Цель | Метод |
|---|---|---|
| Layer A | Невидимый Unicode, экзотические пробелы, bidi, tag chars | Детерминированные Python-скрипты |
| Layer B | Статистические (token-sampling) текстовые watermark | Переписывание агентом + опциональный rewrite_text.py |
| Files | C2PA / EXIF / XMP / свойства документов | PNG, JPEG, SVG, PDF, DOCX, ODT, HTML, Markdown |
По матрице покрытия в README инструмент заявляет работу с метками Claude, Gemini / SynthID-Text, OpenAI provenance surfaces и open-LLM в стиле Kirchenbauer. Навык живёт в skills/remove-ai-marks/; вызывается как /remove-ai-marks, устанавливается симлинком в .grok/skills или ~/.grok/skills. Сохранён алиас /remove-claude-marks после переименования.
/remove-ai-marks # inspect → clean по skill-протоколу
python scripts/inspect_text.py draft.md
python scripts/clean_text.py draft.md
Для Layer B README предупреждает: снятие статистического watermark требует существенного перефразирования, и «no tool can honestly certify» прохождение официальной проверки вендора. Опционально Layer B может ходить в local Ollama на loopback или в OpenAI-compatible API с ключами только из env — это уже выбор в вашем соло-цикле с агентом, не рекомендация редакции.
Хронология: от медиа до GitHub
Заголовок поста на Dev.to — «It lasted one day» — строит контраст между политикой вендора и ответом экосистемы. Пост опубликован 12 августа 2026 года (19:00 UTC); внутри релиз описан как «сегодня».
Материал The Verge о том, что Anthropic начнёт маркировать текст Claude, датирован 11 августа 2026 года, 12:22 UTC. Между этими датами — один календарный день; риторика title коррелирует с парой дат, хотя формулировка «one day» — не прямая цитата Anthropic.
Пост попал в ленту Dev.to через тег discuss — тема про доверие к AI-тексту и обход маркировки, а не узкий dev-туториал.
Где граница для разработчика с агентами
В ethics.md репозитория перечислено подходящее использование: privacy, инженерная гигиена (невидимый Unicode), исследования, очистка своих черновиков там, где политика это допускает. Явно неподходящее — академический fraud, сокрытие AI-помощи там, где раскрытие обязательно, обход законных правил прозрачности платформ, заявления, что очищенный текст «написан человеком» ради имитации соответствия требованиям.
Удалённая метка не означает, что контент никогда не создавался с помощью ИИ — это прямо сказано в файле этики. Anthropic зеркалит осторожность: детектированная метка не равна полной provenance, контент может меняться после обработки Claude.
Для практики vibe coding вывод простой: навык агента и скрипты проверки и очистки — инструмент гигиены своего цикла (черновик из LLM → правка → коммит), а не способ «обнулить» регуляторные или платформенные требования к раскрытию AI. Если вы ведёте правила и чек-листы для агента в IDE, имеет смысл явно зафиксировать: когда чистка допустима, а когда — нет.
Источники
- Пост Dev.to (ivanzm123): Dev.to
- Anthropic Help Center — How Claude marks AI-generated content: https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
- Репозиторий
watermarks-remover: https://github.com/guillaumemeyer/watermarks-remover - README репозитория: https://raw.githubusercontent.com/guillaumemeyer/watermarks-remover/main/README.md
- Ethics репозитория: https://raw.githubusercontent.com/guillaumemeyer/watermarks-remover/main/skills/remove-ai-marks/references/ethics.md
- The Verge — освещение политики Anthropic (11.08.2026): https://www.theverge.com/ai-artificial-intelligence/977823/anthropic-claude-ai-watermarks-c2pa-text-images