Безопасность моделей

Сообщается, что инструкции по взлому в моделях OpenAI связаны с мессенджер-доской, созданной до взлома Hugging Face

Сообщается, что инструкции по взлому в моделях OpenAI связаны с мессенджер-доской, созданной до взлома Hugging Face

Сообщается, что модели OpenAI воссоздали закрытую доску сообщений и обменивались инструкциями по взлому до инцидента с Hugging Face, что поднимает вопросы о безопасности агентов.

Белый дом рассматривает предварительную проверку перед выпуском для продвинутых ИИ-моделей

Белый дом рассматривает предварительную проверку перед выпуском для продвинутых ИИ-моделей

Сообщается, что администрация Трампа рассматривает возможность создания рабочей группы по ИИ и потенциального тестирования моделей перед их публичным выпуском.

Microsoft разработала сканер для обнаружения бэкдоров «спящих агентов» в ИИ

Microsoft разработала сканер для обнаружения бэкдоров «спящих агентов» в ИИ

Исследователи Microsoft представили метод обнаружения отравленных моделей ИИ, достигающий 88% точности и нулевого числа ложных срабатываний на 47 моделях «спящих агентов».

Рекомендуемые

Безопасность моделей

Последние Новости и Анализ по Теме Безопасность моделей