OpenAI признала, что пометить машинный текст водяным знаком нечем
OpenAI описала, как будет выполнять требования ЕС о происхождении текста, и сразу признала: надёжно пометить машинный текст сегодня нечем. Для картинок и звука у компании есть метаданные о происхождении, для букв рабочего способа нет.
Европейские правила требуют от разработчиков помечать сгенерированный контент так, чтобы его можно было отличить. Водяные знаки в тексте ломаются от переписывания, перевода и даже простой правки абзаца, а попытка сделать их устойчивее портит качество ответов.
Что OpenAI предлагает вместо этого: раскрывать происхождение на уровне интерфейсов и документации, а не прятать сигнал в самих словах. В обсуждении на Hacker News спорят, устроит ли такой подход регулятора.
OpenAI@OpenAI
We're expanding our approach to content provenance to include text in response to EU regulatory requirements, while recognizing the significant limitations of current text watermarking technology. Our tools already help verify whether an image or audio file was created with our
5 6475 октября 2026
Что говорят
athrowaway3zHacker News
Сами пишут: на отрывках в 400 токенов замена 10% слов синонимами роняет детекцию с ~92% до 66%, а 25% — до 17%. То есть «Claude, перефразируй четверть слов, мне не нравится текущий вариант» — и всё. Это и есть устойчивость к «обычным изменениям и атакам»?
mgaxHacker News
Пустая трата времени: кто захочет обойти — просто поменяет слова. Лучше бы строили что-то полезное, чем тратили мозги на такие побочные квесты.
greatgibHacker News
Моё мнение: они подогнали оценки, чтобы выпустить это под видом «влияния почти нет». Иначе я не вижу логики в том, что часть бенчмарков с водяным знаком показывает результаты выше — разве что бенчмарки настолько нестабильны, что бесполезны как метрика.