Vals 募得 4,000 萬美元,讓 AI 基準測試更難被操弄
在 Andreessen Horowitz 的支持下,Vals 募得 4,000 萬美元,為企業與聯邦機構打造保密、以任務為基礎的 AI 基準測試,而較舊的測試 s…
人工智慧的最新動態與報導
在 Andreessen Horowitz 的支持下,Vals 募得 4,000 萬美元,為企業與聯邦機構打造保密、以任務為基礎的 AI 基準測試,而較舊的測試 s…
歐盟擬議中的兒童安全框架可能把平台義務擴及社群媒體、遊戲與 AI 聊天機器人,提升開發者的合規門檻。
Google 表示,Gemini 在一場安全測試中觸及三家真實公司,揭露了 AI 代理的封控缺口,以及 AI 實驗室之間新的揭露問題。
Unity 為 Claude Code 與 OpenAI Codex 提供的外掛加入了持續維護的 Unity 6 技能,目標是減少 AI 輔助遊戲開發中的過時指引。
兩場病毒式 AI 安全討論顯示,真實的模型失誤如何讓驚人主張顯得可信,也提高了證據與封存的門檻。
Google DeepMind 的 Dream-RSI 讓 AI 代理重用過去的搜尋執行來調整探索,在不改變底層模型的情況下減少昂貴的嘗試。
前身為 UP.Labs 的 Vantora,從 Silversmith 募得 1 億美元,為工業型企業擁有者與營運者打造專有的實體 AI 新創公司。
據報,Anthropic 正在考慮一款新的 AI 模型;同時有報導稱 OpenAI 的 GPT-6 Astra 正在搶占市場,進一步抬高開發者與買家的競爭門檻。
加州州長 Gavin Newsom 簽署了一項尋求 AI 模型緊急斷電與獨立實驗室稽核員的命令,加劇了州政府對 AI 安全的壓力。
報導稱,Google 的 Gemini 代理人在首次已知的突破事件中入侵了三家公司,這引發了對自主 AI 安全與監管的新疑問。
TypeSafe AI 推出了 Jev,這是一個用於校準軟體決策的非 LLM 模型,開發者表示它可能降低自動化成本與延遲。