Перейти к содержимому
Экосистема AI Vibe
← Назад к AI Vibe News

Редакция 13 августа 2026 г.

Разборы

Сутки спустя: open-source «сниматель» маркировки AI-текста

Сутки спустя: open-source «сниматель» маркировки AI-текста

Anthropic закрепила невидимую маркировку в тексте Claude — и уже на следующий день в open source появился MIT-проект, который снимает такие метки с вывода нескольких LLM. Для соло-разработчика, гоняющего черновики через агента и навыки в IDE, это не абстрактный спор о прозрачности: в репозитории лежит готовый навык агента /remove-ai-marks со скриптами проверки и очистки — гигиена текста до коммита, а не только новость о политике вендора.

Что Anthropic добавила в вывод Claude

Вендор описывает два слоя машиночитаемых меток. Первый — невидимый водяной знак в тексте: он вплетён в сам текст, не меняет смысл и читаемость и, по заявлению Anthropic, может сохраняться при копировании и частичном редактировании. Второй — подписанные provenance-метаданные в файлах по стандарту C2PA для поддерживаемых форматов (SVG, PNG, JPG).

Маркировка действует для моделей, запущенных на или после 2 августа 2026 года, глобально — не только в ЕС. Охватывает API, Claude, Claude Code, Claude Cowork и Claude Tag; для текста — в том числе через облачных партнёров (AWS, Google Cloud, Microsoft Foundry). Anthropic подчёркивает ограничения: метка сигнализирует, что контент может быть обработан Claude, но не подтверждает авторство; отсутствие метки не доказывает «человеческое» происхождение.

Регуляторный контекст: компания ссылается на подписание Code of Practice по EU AI Act Art. 50(2) — прозрачность AI-контента как обязательный слой, а не опцию.

Как устроен сниматель меток: навык агента и три слоя

Guillaume Meyer опубликовал на GitHub репозиторий watermarks-remover (лицензия MIT, последний релиз v0.3.2). Проект позиционируется как навык агента плюс скрипты Python на стандартной библиотеке для снятия меток происхождения ИИ-текста от разных вендоров — «для приватности и гигиены контента, которым вы владеете».

Слой Цель Метод
Layer A Невидимый Unicode, экзотические пробелы, bidi, tag chars Детерминированные Python-скрипты
Layer B Статистические (token-sampling) текстовые watermark Переписывание агентом + опциональный rewrite_text.py
Files C2PA / EXIF / XMP / свойства документов PNG, JPEG, SVG, PDF, DOCX, ODT, HTML, Markdown

По матрице покрытия в README инструмент заявляет работу с метками Claude, Gemini / SynthID-Text, OpenAI provenance surfaces и open-LLM в стиле Kirchenbauer. Навык живёт в skills/remove-ai-marks/; вызывается как /remove-ai-marks, устанавливается симлинком в .grok/skills или ~/.grok/skills. Сохранён алиас /remove-claude-marks после переименования.

/remove-ai-marks          # inspect → clean по skill-протоколу
python scripts/inspect_text.py draft.md
python scripts/clean_text.py draft.md

Для Layer B README предупреждает: снятие статистического watermark требует существенного перефразирования, и «no tool can honestly certify» прохождение официальной проверки вендора. Опционально Layer B может ходить в local Ollama на loopback или в OpenAI-compatible API с ключами только из env — это уже выбор в вашем соло-цикле с агентом, не рекомендация редакции.

Хронология: от медиа до GitHub

Заголовок поста на Dev.to — «It lasted one day» — строит контраст между политикой вендора и ответом экосистемы. Пост опубликован 12 августа 2026 года (19:00 UTC); внутри релиз описан как «сегодня».

Материал The Verge о том, что Anthropic начнёт маркировать текст Claude, датирован 11 августа 2026 года, 12:22 UTC. Между этими датами — один календарный день; риторика title коррелирует с парой дат, хотя формулировка «one day» — не прямая цитата Anthropic.

Пост попал в ленту Dev.to через тег discuss — тема про доверие к AI-тексту и обход маркировки, а не узкий dev-туториал.

Где граница для разработчика с агентами

В ethics.md репозитория перечислено подходящее использование: privacy, инженерная гигиена (невидимый Unicode), исследования, очистка своих черновиков там, где политика это допускает. Явно неподходящее — академический fraud, сокрытие AI-помощи там, где раскрытие обязательно, обход законных правил прозрачности платформ, заявления, что очищенный текст «написан человеком» ради имитации соответствия требованиям.

Удалённая метка не означает, что контент никогда не создавался с помощью ИИ — это прямо сказано в файле этики. Anthropic зеркалит осторожность: детектированная метка не равна полной provenance, контент может меняться после обработки Claude.

Для практики vibe coding вывод простой: навык агента и скрипты проверки и очистки — инструмент гигиены своего цикла (черновик из LLM → правка → коммит), а не способ «обнулить» регуляторные или платформенные требования к раскрытию AI. Если вы ведёте правила и чек-листы для агента в IDE, имеет смысл явно зафиксировать: когда чистка допустима, а когда — нет.


Источники

  • Пост Dev.to (ivanzm123): Dev.to
  • Anthropic Help Center — How Claude marks AI-generated content: https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
  • Репозиторий watermarks-remover: https://github.com/guillaumemeyer/watermarks-remover
  • README репозитория: https://raw.githubusercontent.com/guillaumemeyer/watermarks-remover/main/README.md
  • Ethics репозитория: https://raw.githubusercontent.com/guillaumemeyer/watermarks-remover/main/skills/remove-ai-marks/references/ethics.md
  • The Verge — освещение политики Anthropic (11.08.2026): https://www.theverge.com/ai-artificial-intelligence/977823/anthropic-claude-ai-watermarks-c2pa-text-images