OpenAI введёт водяные знаки для текста ChatGPT и Codex в ЕС
В API водяные знаки можно включить для отдельных моделей по всему миру, а в ЕС скрытый сигнал появится в подходящих ответах ChatGPT и Codex.
OpenAI заявила, что добавит невидимый водяной знак в подходящий текст, который ChatGPT и Codex генерируют в Европейском союзе. Так компания отвечает на требование EU AI Act: сгенерированный текст должен быть распознаваемым машинами.
Что меняется #
Для клиентов API watermarking запускается как опциональная функция по всему миру для отдельных моделей. OpenAI подчёркивает, что в API она выключена по умолчанию и на старте не становится глобальным стандартом для ChatGPT или Codex.
Метод компании называется textGrain. Он добавляет статистический сигнал через небольшие сдвиги в выборе слов моделью, а детектор затем ищет этот сигнал в тексте. OpenAI также открывает заявки на доступ к детектору, но сначала только для одобренных исследователей и экспертных организаций, а не для широкой публики.
Почему это важно #
Текстовое происхождение перестаёт быть абстрактной темой для AI-комплаенса: европейские пользователи скоро могут получать текст со скрытым платформенным сигналом, а разработчики смогут сами решать, нужен ли watermarking для их обязательств по прозрачности.
OpenAI одновременно ограничивает ожидания. Водяной знак не идентифицирует пользователя, не доказывает авторство, не устанавливает ответственность и не проверяет правдивость текста. По тестам компании, сигнал быстро слабеет после редактирования: замена 10% слов синонимами снизила обнаружение примерно с 92% до 66%, а замена 25% — до 17%.
Именно в этом главное ограничение. Watermarking становится частью AI-регулирования, но пока это вероятностная подсказка, а не железное доказательство.
Источники
- OpenAIopenai.com
- TechCrunchtechcrunch.com