
OpenAI готовит новую систему мониторинга безопасности для подходящих API-клиентов, использующих Zero Data Retention (ZDR), реагируя на растущее противоречие в корпоративном ИИ: продвинутым моделям нужен больший контекст для выявления злоупотреблений, тогда как клиенты всё чаще требуют, чтобы чувствительные промпты и ответы оставались конфиденциальными.
Компания сообщила в публикации OpenAI News, что Private Safety Processing проходит тестирование с первыми клиентами. Предлагаемая система будет анализировать закономерности между связанными взаимодействиями, не предоставляя сотрудникам OpenAI доступ к исходному содержимому. OpenAI планирует начать поэтапный запуск и опубликовать технический white paper в сентябре, хотя точную дату релиза и детальный график развёртывания не раскрыла.
В рамках Zero Data Retention OpenAI заявляет, что не сохраняет промпты и ответы моделей для подходящих клиентов после обработки запроса. Содержимое клиента недоступно сотрудникам OpenAI для просмотра, а корпоративные данные не используются для обучения моделей, если клиент явно не выбрал это.
Такая модель контроля исторически затрудняла проведение анализа безопасности по нескольким обменам. OpenAI говорит, что существующие системы, совместимые с ZDR, оценивают взаимодействия по отдельности. Private Safety Processing предназначен для расширения этих проверок на связанные взаимодействия, позволяя автоматическим системам искать закономерности, которые могут быть не видны в одном запросе.
Компания привела несколько примеров рисков, которые могут возникать со временем: повторные попытки обойти защитные механизмы, скоординированная активность между аккаунтами, угрозы, замаскированные под обычное исследование, или ИИ-агент, продолжающий действовать после того, как пользователь попросил его остановиться. В объявлении предложение напрямую связывается с растущей сложностью frontier-моделей и более длительно работающих ИИ-агентов.
OpenAI описала два возможных варианта хранения. В одном содержимое остаётся на инфраструктуре, контролируемой клиентом. В другом содержимое может храниться на инфраструктуре OpenAI, но быть зашифровано ключами, контролируемыми клиентом. OpenAI утверждает, что её сотрудники не будут иметь копий этих ключей и, следовательно, не смогут получить доступ к исходным промптам или ответам.
Если автоматические системы выявят потенциальный риск, OpenAI говорит, что они отправят компании узко определённый сигнал, описывающий тип связанной активности, а не содержимое клиента. OpenAI сможет использовать этот сигнал, чтобы решить, требуется ли принудительное действие, в то время как клиент сохранит исходную информацию в своих собственных системах.
Клиенты смогут расследовать уведомления и решения о принудительном применении, используя информацию, доступную в их среде. Они также смогут по своему выбору поделиться с OpenAI релевантными материалами, если захотят оспорить решение, объяснить законную деятельность или помочь в расследовании подтверждённого злоупотребления.
Такой дизайн пытается отделить обеспечение безопасности от обычного человеческого доступа к данным клиента. Это не означает, что данные никогда не могут сохраняться. OpenAI прямо отметила, что изображения, помеченные как возможный материал сексуального насилия над детьми, по-прежнему будут сохраняться для ручной проверки и сообщения, в том числе в развёртываниях ZDR, из-за правовых требований.
В объявлении также остаются открыты важные технические вопросы. OpenAI пока не опубликовала архитектуру, механику хранения риск-сигналов, показатели ошибок или точные инструменты управления, которые получат клиенты. Эти детали будут ключевыми для определения того, удовлетворит ли система организации с жёсткими требованиями к приватности, аудиту и регулированию.
Основное подтверждение продуктового плана — это само объявление OpenAI. Второй источник содержит тот же заголовок через запрос Google News, но полный текст статьи был недоступен, поэтому он не подтверждает технические заявления независимо и не даёт дополнительных рыночных сведений.
Поэтому заявления OpenAI о Zero Data Retention, шифровании, доступе сотрудников и Private Safety Processing следует рассматривать как заявленные поставщиком продуктовые обязательства и планы. Компания говорит, что новая система сейчас тестируется с первыми клиентами, но не назвала этих клиентов и не привела цифры внедрения.
Публикация включает положительный комментарий от Glean, который заявил, что обязательство OpenAI не использовать данные для обучения и политика ZDR поддерживают их решение строить на OpenAI. Это индивидуальное одобрение клиента или партнёра, а не независимое доказательство широкого корпоративного внедрения. OpenAI также сказала, что получила обратную связь от организаций из разных отраслей, регионов и размеров компаний, но не предоставила разбивку по этим организациям.
Наиболее сильные утверждения о безопасности с сохранением приватности остаются предварительными, пока OpenAI не опубликует обещанный технический документ и клиенты не смогут оценить элементы управления в реальной эксплуатации. В частности, покупателям нужно будет понимать, какие метаданные создаются, как долго сохраняются сигналы безопасности, кто может к ним получить доступ и как можно оспаривать автоматические решения о принудительном применении.
Для продуктовых команд, создающих приложения вокруг frontier-моделей, объявление решает практическую проблему внедрения. Многие рабочие процессы включают конфиденциальные записи, проприетарные исследования, медицинскую информацию, финансовые данные или бизнес-планы. Требование к провайдеру сохранять содержимое для проверки безопасности может заблокировать такие приложения, даже если сама модель способна их поддерживать.
Private Safety Processing может сделать ZDR более пригодным для приложений, работающих в нескольких ходах диалога или многократно вызывающих ИИ-агентов. Ассистент для программирования, исследовательский процесс или система обслуживания клиентов могут генерировать последовательность по отдельности обычных запросов, которые становятся проблематичными только в совокупности. Напротив, многошаговый мониторинг может создать новые риски, если законная активность будет ошибочно классифицирована или если клиенты не смогут восстановить, почему было выдано предупреждение.
Предложение также переносит часть операционной ответственности на клиентов. Если OpenAI не видит исходное содержимое, клиентам понадобятся сильное внутреннее логирование, контроль доступа, реагирование на инциденты и инструменты расследования. Это может быть привлекательно для регулируемых организаций, поскольку чувствительные материалы остаются в их среде, но это также означает, что защита приватности будет частично зависеть от собственной инфраструктуры и управления клиента.
Для разработчиков ИИ ключевой коммерческий вопрос заключается в том, могут ли более сильные гарантии конфиденциальности сосуществовать с надёжным выявлением злоупотреблений. Провайдеры, сохраняющие больше данных, могут предлагать более простое централизованное наблюдение, тогда как развёртывания в стиле ZDR дают более жёсткий контроль клиенту, но требуют более сложных технических решений. OpenAI позиционирует свою новую систему как способ сузить этот разрыв без отказа от ZDR.
Первым сигналом станет запланированный на сентябрь запуск OpenAI и технический white paper. Покупателям стоит обратить внимание на точные определения «связанных взаимодействий», масштаб автоматического анализа, сроки хранения риск-сигналов и границы доступа сотрудников.
Ранние развёртывания у клиентов также покажут, сможет ли система выявлять скоординированное злоупотребление без неприемлемого числа ложных срабатываний. Данные о задержке, согласованности принудительных мер, обработке апелляций и поддержке инфраструктуры, контролируемой клиентом, будут важнее, чем само объявление.
Ещё один вопрос — будет ли Private Safety Processing охватывать все frontier-модели и сценарии использования API или только отдельные продукты и клиентов. OpenAI описала его как совместимый с ZDR, но не уточнила критерии допуска, цены, региональную доступность или обязательства по уровню обслуживания.
Предварительная версия OpenAI нацелена на один из самых трудных компромиссов в корпоративном ИИ: системы безопасности часто выигрывают от широкого поведенческого контекста, тогда как клиенты хотят, чтобы провайдер видел как можно меньше их данных. Архитектура на основе зашифрованного содержимого, ключей у клиента и ограниченных риск-сигналов выглядит правдоподобно, но её ценность будет зависеть от технической прозрачности и операционной эффективности.
Пока это продуктовое обязательство в стадии тестирования, а не завершённая возможность. Разработчикам и корпоративным покупателям следует рассматривать ZDR как важную границу конфиденциальности, ожидая технический документ и результаты в продакшене, чтобы проверить, как Private Safety Processing справляется с выявлением злоупотреблений, аудитами, апелляциями и исключительными юридическими случаями.
OpenAI тестирует Private Safety Processing для клиентов Zero Data Retention, стремясь выявлять злоупотребления в нескольких сессиях без раскрытия промптов сотрудникам.