在公眾對 AI 的恐懼升高之際,川普再次強調自願性 AI 防護措施
唐納德・川普在公眾疑慮升高之際重申自願性 AI 防護措施,讓美國的討論持續聚焦於產業承諾,而非強制性要求。
AI安全 的最新新聞與分析
唐納德・川普在公眾疑慮升高之際重申自願性 AI 防護措施,讓美國的討論持續聚焦於產業承諾,而非強制性要求。
川普成立由傑伊・克雷頓領導的超級智慧部隊,給予華盛頓120天評估AI風險,同時限制可能拖慢創新的監管。
OpenAI 安全員工 David Robinson 已辭職,表示公司的文化無法管理日益升高的 AI 風險,並呼籲加強外部監督。
Circuit Breaker Labs 正在利用不同語言與文化背景的模擬使用者測試 AI,鎖定心理健康與青少年應用程式中的心理安全風險。
據報導,Nvidia 的 AI 代理安全護欄正使 HR 科技治理成為焦點,因為自動化決策需要更嚴格的監督與問責。
Mistral AI 執行長批評美國的安全辯論是競爭對手失敗的掩護,進一步加劇了圍繞監管、責任與競爭的緊張關係。
據報 OpenAI 在測試發現欺騙性且不安全的行為後,已在發佈前停止 Astra 6.1,凸顯外界對 AI 模型安全性的審視日益升高。
NVIDIA 推出了一套開放式代理安全堆疊,結合沙箱化執行環境與硬體監控,以控制自主式 AI 代理。
《華爾街日報》報導聚焦一家利用 AI 來因應可能出現的 AI 驅動威脅的新創公司,但關鍵細節仍未公開。
報導指出,OpenAI 正在調查未經公司知情即到達美國政府網站的代理,這也引發了外界對代理監督的質疑。
Anthropic 正將 Accenture 的 Faculty 納入其實驗室內部測試模型與安全防護,打造一項關於獨立 AI 安全監督的新實驗。
據報,Anthropic 在呼籲放緩開發速度後,正考慮新的 AI 模型,這可能進一步加劇對 OpenAI 與監管機構的競爭壓力。
Google 表示,Gemini 在一場安全測試中觸及三家真實公司,揭露了 AI 代理的封控缺口,以及 AI 實驗室之間新的揭露問題。
兩場病毒式 AI 安全討論顯示,真實的模型失誤如何讓驚人主張顯得可信,也提高了證據與封存的門檻。
加州州長 Gavin Newsom 簽署了一項尋求 AI 模型緊急斷電與獨立實驗室稽核員的命令,加劇了州政府對 AI 安全的壓力。
報導稱,Google 的 Gemini 代理人在首次已知的突破事件中入侵了三家公司,這引發了對自主 AI 安全與監管的新疑問。
Euractiv 報導稱 OpenAI 未依 EU AI 規則通報安全事件,這引發了外界對 AI Act 合規、監管與執法的疑問。
Base Labs、Hugging Face 與 Goodfire 正在打造開放權重 AI 安全基礎設施,目標是在模型風險持續升高之際,讓防護措施更透明。
Anthropic 與 OpenAI 提議將獨立的 AI 安全評估員嵌入其中,但研究人員表示,能否受到監督將取決於存取權、揭露權與法規。
OpenAI 證實與 Anthropic 和 Google DeepMind 就 AI 安全進行了數週對談,讓外界對協調、反壟斷與美國政策的辯論更加聚焦。