OpenAI внедряет приватную проверку безопасности для корпоративных клиентов
Компания представила технологию Private Safety Processing. Она позволяет выявлять сложные угрозы в работе ИИ-агентов, не передавая содержимое запросов разработчикам.
Компания представила технологию Private Safety Processing. Она позволяет выявлять сложные угрозы в работе ИИ-агентов, не передавая содержимое запросов разработчикам.
3 мин

Компания OpenAI подтвердила приверженность политике нулевого хранения данных (Zero Data Retention, ZDR) для корпоративных пользователей API и анонсировала новую технологию — Private Safety Processing. Это решение позволяет автоматизированным системам безопасности анализировать серии взаимодействий с ИИ, при этом сотрудники OpenAI не получают доступа к исходным текстам запросов и ответов. Это важный шаг для бизнеса, которому необходим баланс между строгим контролем безопасности и защитой конфиденциальной информации.
Политика ZDR гарантирует, что OpenAI не сохраняет промпты и ответы после обработки запроса, а данные клиентов не используются для обучения моделей без явного согласия. До сих пор системы безопасности, совместимые с ZDR, оценивали каждое взаимодействие изолированно.
Однако по мере развития технологий большие языковые модели (LLM) переходят от простых ответов на вопросы к выполнению длительных и сложных задач — так называемых агентных процессов (agentic workflows). В таких сценариях серьезные риски могут быть незаметны в рамках одного запроса. Злонамеренные намерения, попытки обойти ограничения или сбои в работе автономного агента часто проявляются только при анализе цепочки действий.

Content Access Controls diagram showing an API request entering Private Safety Processing, with customer-controlled encrypted storage and automated safety review. Customers receive full alerts and may share content with OpenAI; OpenAI otherwise sees only alert category and severity, with no customer content.
Private Safety Processing решает проблему анализа контекста без компрометации данных. Технология работает следующим образом:
Во-первых, анализ паттернов происходит автоматически поверх связанных взаимодействий. Система ищет аномалии, не раскрывая текст.
Во-вторых, данные остаются под контролем клиента. Если используется инфраструктура клиента, контент не покидает ее пределов. Если данные хранятся на серверах OpenAI, они шифруются ключами, которыми управляет исключительно заказчик. У OpenAI нет копии этих ключей.
В-третьих, при обнаружении угрозы OpenAI получает лишь узконаправленный сигнал о типе подозрительной активности. Сами тексты остаются скрытыми. Расследование инцидентов ложится на плечи клиента, который работает с данными внутри собственной системы.
Исключение составляют только законодательные требования, такие как обязательная отчетность о материалах, связанных с насилием над детьми (CSAM). В этих случаях изображения по-прежнему сохраняются для ручной проверки.

Pacing model development in an era of cyber-critical capabilities — Card image
Этот анонс отражает фундаментальный сдвиг в индустрии искусственного интеллекта. По мере того как ИИ становится более автономным, старые методы модерации перестают работать. Невозможно понять, вышел ли ИИ-агент из-под контроля, оценивая только его последний шаг.
В то же время корпоративный сектор — банки, медицинские учреждения, исследовательские центры — не может позволить себе передавать провайдеру ИИ контекст своих бизнес-процессов для мониторинга. Требование некоторых разработчиков сохранять данные для проверки безопасности становится непреодолимым барьером для внедрения технологий на уровне предприятий.
OpenAI решает этот парадокс чисто техническим путем, создавая архитектуру нулевого доверия (zero-trust) для систем безопасности. Это позволяет компании удерживать корпоративных клиентов, для которых конфиденциальность является не просто предпочтением, а юридическим обязательством.
Тестирование Private Safety Processing уже началось с ранними клиентами, а полноценное развертывание и публикация технической документации запланированы на сентябрь.
Вероятно, подобный подход станет золотым стандартом для всей B2B-индустрии искусственного интеллекта. Конкурентам придется внедрять аналогичные криптографические и архитектурные решения, чтобы доказать бизнесу, что безопасность ИИ не требует отказа от коммерческой тайны.
OpenAI нашла способ проверять безопасность сложных ИИ-агентов на серии запросов, не нарушая политику нулевого хранения данных и не раскрывая текст разработчикам.
Переход от разовых запросов к автономным ИИ-агентам делает классическую модерацию бесполезной — для оценки безопасности теперь требуется анализировать поведение модели во времени, что требует принципиально новых подходов к шифрованию.