OpenAI объявила о запуске Lockdown Mode — нового режима защиты от атак через prompt injection. Речь идет о скрытых вредоносных инструкциях для чат-бота, которые могут быть встроены в веб-страницы и другие источники контента.
В этом режиме ChatGPT отключает несколько функций, чтобы снизить риск утечки данных. В частности, будет недоступен просмотр веб-страниц в реальном времени: сервис сможет работать только с кэшированным контентом.
- отключается загрузка и показ изображений из интернета;
- сохраняется возможность генерировать изображения;
- отключаются Deep Research;
- отключается Agent Mode.
OpenAI уточняет, что даже при включенном Lockdown Mode ChatGPT все равно может оставаться уязвимым для prompt injection. По словам компании, такие инструкции могут присутствовать в кэшированном веб-контенте или в загруженном файле и влиять на поведение модели или точность ответа.
Цель нового режима — снизить вероятность передачи чувствительных данных в ходе таких атак.
«Lockdown Mode предназначен не для всех, — заявили в OpenAI. — Он создан для людей и организаций, которые работают с чувствительными данными и хотят получить более строгую защиту от рисков утечки данных, связанных с prompt injection».
Компания также сообщила, что сейчас постепенно открывает Lockdown Mode для самостоятельных аккаунтов ChatGPT Business, а также для подходящих личных аккаунтов.
Источник: OpenAI.