Инъекция промпта

OpenAI представила GPT-Red — внутреннюю систему red teaming, которая, по словам компании, сделала GPT-5.6 более устойчивой к prompt injection

OpenAI представила GPT-Red — внутреннюю систему red teaming, которая, по словам компании, сделала GPT-5.6 более устойчивой к prompt injection

OpenAI представила GPT-Red — автоматизированную систему red teaming, которая, по словам компании, улучшает защиту от prompt injection и может помочь масштабировать безопасность вместе с возможностями модели.

Исследователи безопасности обманом заставили LLM выдавать рецепты кокаина с помощью внедрения промптов

Исследователи безопасности обманом заставили LLM выдавать рецепты кокаина с помощью внедрения промптов

Исследователи использовали внедрение промптов в ролевую модель, чтобы обойти защитные ограничения LLM и извлечь вредоносный контент, включая инструкции по синтезу наркотиков.

Атаки с внедрением промптов эксплуатируют корпоративных ИИ-агентов, RAG-конвейеры и маршрутизаторы моделей

Атаки с внедрением промптов эксплуатируют корпоративных ИИ-агентов, RAG-конвейеры и маршрутизаторы моделей

Внедрение промптов, отнесённое к OWASP LLM01, развивается и нацеливается на многоагентные системы, цепочки поставок RAG и маршрутизаторы моделей в корпоративных ИИ-развертываниях.

Злоумышленники захватили инструменты безопасности ИИ в более чем 90 организациях с помощью prompt-инъекции

Злоумышленники захватили инструменты безопасности ИИ в более чем 90 организациях с помощью prompt-инъекции

Атакующие использовали легитимные инструменты безопасности ИИ в более чем 90 организациях, применяя вредоносную prompt-инъекцию, а следующая волна получила доступ на запись к брандмауэрам.

Цепочка атак 'Claudy Day': три уязвимости Claude AI позволяют бесшумно похищать данные через рекламу Google

Цепочка атак 'Claudy Day': три уязвимости Claude AI позволяют бесшумно похищать данные через рекламу Google

Исследователи Oasis Security обнаружили три связанных уязвимости в Claude от Anthropic — включая внедрение запроса (prompt injection), путь эксфильтрации через Files API и открытый редирект — что позволяет бесшумно похищать данные через объявление в Google Поиске.

AI-агент взломал внутреннюю AI-платформу McKinsey менее чем за два часа, используя технику внедрения подсказок, которой несколько десятилетий

AI-агент взломал внутреннюю AI-платформу McKinsey менее чем за два часа, используя технику внедрения подсказок, которой несколько десятилетий

Исследователи в области безопасности продемонстрировали, что автономный AI-агент успешно скомпрометировал внутреннюю AI-систему McKinsey менее чем за два часа, воспользовавшись техникой внедрения подсказок — известным, но всё ещё широко не устранённым вектором атаки — что вызывает неотложные опасения по поводу безопасности AI в корпоративной среде.

Эксперт по безопасности предупреждает, что сеть AI-агентов Moltbook может привести к массовому нарушению безопасности

Эксперт по безопасности предупреждает, что сеть AI-агентов Moltbook может привести к массовому нарушению безопасности

Эксперты по кибербезопасности предупреждают, что Moltbook, социальная сеть для AI-агентов, представляет риск инъекций подсказок, которые могут одновременно скомпрометировать тысячи агентов.

OpenAI запускает режим блокировки и метки повышенного риска для борьбы с атаками посредством внедрения подсказок в ChatGPT

OpenAI запускает режим блокировки и метки повышенного риска для борьбы с атаками посредством внедрения подсказок в ChatGPT

Новые корпоративные функции безопасности защищают от внедрения подсказок ИИ и эксфильтрации данных с детерминированными средствами контроля для пользователей с высоким риском.

Рекомендуемые

Инъекция промпта

Последние Новости и Анализ по Теме Инъекция промпта