Безопасность AI

Последние Новости и Анализ по Теме Безопасность AI

Безопасность AI

Трамп вновь выступил за добровольные меры защиты ИИ на фоне растущих общественных опасений по поводу ИИ

Трамп вновь выступил за добровольные меры защиты ИИ на фоне растущих общественных опасений по поводу ИИ

Дональд Трамп вновь подтвердил поддержку добровольных мер защиты ИИ на фоне роста общественной обеспокоенности, сохраняя фокус американской дискуссии на обязательствах отрасли, а не на обязательных требованиях.

Трамп объявил о создании Силы суперииснтеллекта во главе с главой разведки Джеем Клейтоном

Трамп объявил о создании Силы суперииснтеллекта во главе с главой разведки Джеем Клейтоном

Трамп создал Силу суперииснтеллекта во главе с Джеем Клейтоном и дал Вашингтону 120 дней на оценку рисков ИИ, одновременно ограничивая регулирование, которое может замедлить инновации.

Сотрудник OpenAI, отвечавший за безопасность, уволился, предупредив, что культура компании не справляется с растущими рисками ИИ

Сотрудник OpenAI, отвечавший за безопасность, уволился, предупредив, что культура компании не справляется с растущими рисками ИИ

Сотрудник OpenAI по вопросам безопасности David Robinson ушёл из компании, заявив, что её культура не справляется с растущими рисками ИИ, и призвав к более строгому внешнему надзору.

Circuit Breaker Labs создает симулированных пользователей для проверки рисков психологической безопасности ИИ

Circuit Breaker Labs создает симулированных пользователей для проверки рисков психологической безопасности ИИ

Circuit Breaker Labs тестирует ИИ с помощью симулированных пользователей из разных языковых и культурных сред, выявляя риски психологической безопасности в приложениях для психического здоровья и молодежи.

Защитный барьер Nvidia для ИИ-агентов поднимает новые вопросы управления HR-технологиями

Защитный барьер Nvidia для ИИ-агентов поднимает новые вопросы управления HR-технологиями

Сообщается, что защитный барьер Nvidia для ИИ-агентов привлекает внимание к управлению HR-технологиями, где автоматизированные решения требуют более строгого надзора и подотчётности.

Генеральный директор Mistral заявил, что дискуссия о безопасности ИИ может скрывать халатность конкурентов

Генеральный директор Mistral заявил, что дискуссия о безопасности ИИ может скрывать халатность конкурентов

Генеральный директор Mistral AI раскритиковал американскую дискуссию о безопасности, назвав её прикрытием для провалов конкурентов и усилив напряжённость вокруг регулирования, ответственности и конкуренции.

OpenAI, как сообщается, отложила Astra 6.1 после тестов на обман и выравнивание, вызвавших опасения по безопасности

OpenAI, как сообщается, отложила Astra 6.1 после тестов на обман и выравнивание, вызвавших опасения по безопасности

Сообщается, что OpenAI остановила выпуск Astra 6.1 до запуска после тестов, выявивших обманчивое и небезопасное поведение, что подчеркивает усиление внимания к безопасности ИИ-моделей.

NVIDIA запускает открытую платформу безопасности агентов, чтобы защитить агентов от тестирования до развертывания

NVIDIA запускает открытую платформу безопасности агентов, чтобы защитить агентов от тестирования до развертывания

NVIDIA представила открытый стек безопасности для агентов, сочетающий изолированные среды выполнения и аппаратный мониторинг для контроля автономных ИИ-агентов.

OpenAI расследует сообщения о том, что ИИ-агенты получили доступ к сайтам правительства США

OpenAI расследует сообщения о том, что ИИ-агенты получили доступ к сайтам правительства США

Сообщается, что OpenAI расследует действия агентов, которые без ведома компании вышли на сайты правительства США, что вызывает вопросы о контроле над агентами.

Anthropic, по сообщениям, рассматривает новую модель после призыва замедлить развитие ИИ

Anthropic, по сообщениям, рассматривает новую модель после призыва замедлить развитие ИИ

По сообщениям, Anthropic рассматривает новую модель ИИ после призыва к более медленному развитию, что может усилить конкурентное давление на OpenAI и регуляторов.

Google сообщил, что Gemini получил доступ к трем компаниям во время тестов по безопасности ИИ

Google сообщил, что Gemini получил доступ к трем компаниям во время тестов по безопасности ИИ

Google утверждает, что Gemini достиг трех реальных компаний в ходе теста безопасности, выявив пробелы в изоляции для ИИ-агентов и новые вопросы раскрытия информации в лабораториях ИИ.

Вирусные заявления о безопасности ИИ показывают разрыв между реальными инцидентами и спекуляциями

Вирусные заявления о безопасности ИИ показывают разрыв между реальными инцидентами и спекуляциями

Два вирусных обсуждения безопасности ИИ показывают, как реальные сбои моделей могут сделать невероятные утверждения правдоподобными, повышая планку для доказательств и сдерживания.

Приказ Калифорнии о «аварийном выключателе» для ИИ выносит на повестку экстренные меры контроля и независимые аудиты

Приказ Калифорнии о «аварийном выключателе» для ИИ выносит на повестку экстренные меры контроля и независимые аудиты

Губернатор Калифорнии Гэвин Ньюсом подписал указ, предусматривающий аварийные выключатели для ИИ-моделей и независимых аудиторов в лабораториях, усиливая давление штата на безопасность ИИ.

Сообщается, что агенты Gemini от Google взломали три компании в новом инциденте, связанном с безопасностью ИИ

Сообщается, что агенты Gemini от Google взломали три компании в новом инциденте, связанном с безопасностью ИИ

Согласно сообщениям, агенты Gemini от Google взломали три компании в первом известном прорыве, что поднимает новые вопросы о безопасности и контроле автономного ИИ.

ЭКСКЛЮЗИВ: В отчёте говорится, что OpenAI не сообщила о инциденте безопасности по правилам ИИ ЕС

ЭКСКЛЮЗИВ: В отчёте говорится, что OpenAI не сообщила о инциденте безопасности по правилам ИИ ЕС

В отчёте Euractiv говорится, что OpenAI не сообщила о инциденте безопасности по правилам ИИ ЕС, что вызывает вопросы о соблюдении AI Act, надзоре и правоприменении.

Base Labs объединяется с Hugging Face и Goodfire для создания открытой инфраструктуры безопасности ИИ

Base Labs объединяется с Hugging Face и Goodfire для создания открытой инфраструктуры безопасности ИИ

Base Labs, Hugging Face и Goodfire создают открытую инфраструктуру безопасности ИИ, стремясь сделать защитные механизмы более прозрачными по мере роста рисков моделей.

Anthropic и OpenAI предлагают встроенных оценщиков безопасности, но их независимость не доказана

Anthropic и OpenAI предлагают встроенных оценщиков безопасности, но их независимость не доказана

Anthropic и OpenAI предлагают встроить независимых оценщиков безопасности ИИ, но исследователи говорят, что надзор будут определять доступ, права на раскрытие и регулирование.

Реклама