OpenAI начинает добавлять невидимые водяные знаки в тексты, созданные ChatGPT и Codex для пользователей Евросоюза. Компания объясняет шаг требованиями закона ЕС об искусственном интеллекте, который предполагает возможность машинного распознавания контента, созданного генеративными моделями.
Технология получила название textGrain. Она не добавляет в текст скрытых символов или лишних пробелов, а меняет статистический выбор слов и токенов во время генерации — специальный детектор затем ищет этот сигнал.
Внутренние тесты OpenAI показали: детектор распознаёт около 80% маркированных фрагментов объёмом 200 токенов и до 95% — на 400 токенов. Если заменить четверть слов в тексте, точность обнаружения падает примерно до 17%. Редактирование, перевод или переработка текста ослабляют сигнал.
OpenAI подчёркивает, что наличие водяного знака не доказывает полное копирование текста из ChatGPT — система не показывает, какая часть материала создана ИИ, а какая изменена человеком. Для разработчиков через API функция уже доступна для ряда моделей и отключена по умолчанию. Аналогичную технологию для соблюдения требований ЕС с августа использует Anthropic в моделях Claude.
