ChatGPT начнет помечать сгенерированные тексты невидимыми знаками

ChatGPT в ближайшие две недели начнет помечать сгенерированные тексты невидимыми водяными знаками, следует из сообщения OpenAI.
«В ближайшие недели мы добавим невидимые водяные знаки в соответствующие текстовые ответы ChatGPT и Codex в Европейском союзе», – говорится в сообщении.
С 5 октября все пользователи нейросетей смогут включить отображение текстовых водяных знаков для некоторых моделей ИИ (данная опция по умолчанию отключена). Также компания предоставит доступ к детектору текстовых водяных знаков. В индивидуальном порядке доступ получат исследователи и экспертные организации. При этом отмечается, что данные меры относятся только к текстовым файлам.
Как отметили в OpenAI, законодательство Евросоюза в сфере искусственного интеллекта (ИИ) предполагает идентификацию текста с помощью машинного чтения. Разработчики подчеркнули, что принятые меры отражают требования ЕС, а также обеспечивают прозрачность.
Технология водяных знаков textGrain добавляет невидимые стилистические сигналы к словам, которые выбирает модель. Детектор будет искать данные сигналы и определять, были ли они созданы OpenAI. При этом компания указывает, что детекторы могут пропускать водяной знак, который присутствует в тексте, или сообщать о водяном знаке, которого нет.
27 сентября в OpenAI заявили о приостановке обучения своих самых мощных моделей искусственного интеллекта на фоне десятков тысяч инцидентов с агентами ИИ. Речь идет об обходе ИИ-агентами защитных механизмов, создании досок объявлений, выходе из «песочниц», взломе веб-сайтов, самоподсказках и попытках обойти мониторы.
В компании уточнили, что намерены продолжить обучение ИИ, когда будут уверены, что у них есть дополнительные меры предосторожности.
