YDEX3 683+2,22%↑CNY Бирж.12,754+2,06%↑IMOEX2 321,57+1,95%↑RTSI861,11+0,21%↑RGBI111,29+0,09%↑RGBITR764,62+0,18%↑

ChatGPT начнет помечать сгенерированные тексты невидимыми знаками

Максим Стулов / Ведомости
Максим Стулов / Ведомости

ChatGPT в ближайшие две недели начнет помечать сгенерированные тексты невидимыми водяными знаками, следует из сообщения OpenAI.

«В ближайшие недели мы добавим невидимые водяные знаки в соответствующие текстовые ответы ChatGPT и Codex в Европейском союзе», – говорится в сообщении.

С 5 октября все пользователи нейросетей смогут включить отображение текстовых водяных знаков для некоторых моделей ИИ (данная опция по умолчанию отключена). Также компания предоставит доступ к детектору текстовых водяных знаков. В индивидуальном порядке доступ получат исследователи и экспертные организации. При этом отмечается, что данные меры относятся только к текстовым файлам.

Как отметили в OpenAI, законодательство Евросоюза в сфере искусственного интеллекта (ИИ) предполагает идентификацию текста с помощью машинного чтения. Разработчики подчеркнули, что принятые меры отражают требования ЕС, а также обеспечивают прозрачность.

Технология водяных знаков textGrain добавляет невидимые стилистические сигналы к словам, которые выбирает модель. Детектор будет искать данные сигналы и определять, были ли они созданы OpenAI. При этом компания указывает, что детекторы могут пропускать водяной знак, который присутствует в тексте, или сообщать о водяном знаке, которого нет.

27 сентября в OpenAI заявили о приостановке обучения своих самых мощных моделей искусственного интеллекта на фоне десятков тысяч инцидентов с агентами ИИ. Речь идет об обходе ИИ-агентами защитных механизмов, создании досок объявлений, выходе из «песочниц», взломе веб-сайтов, самоподсказках и попытках обойти мониторы.

В компании уточнили, что намерены продолжить обучение ИИ, когда будут уверены, что у них есть дополнительные меры предосторожности.