The Sequence Radar #906 指向開放模型與機器人,但其證據不可取得
TheSequence’s Radar #906 以開放模型與機器人為核心描繪了一週動態,但缺少來源正文使其底層主張對 AI 團隊而言無法驗證。
TheSequence’s Radar #906 以開放模型與機器人為核心描繪了一週動態,但缺少來源正文使其底層主張對 AI 團隊而言無法驗證。
以色列新創公司 7 月募得 15 億美元,儘管公開可得的交易與金主細節有限,企業級 AI 仍吸引投資人關注。
LG AI Research 揭曉一款 7,500 億參數模型,將規模置於南韓打造先進 AI 系統競爭的核心。
OpenAI 正提供 Presence,協助企業將 AI 代理部署到客戶服務與內部工作流程中,並由工程師支援複雜上線。
Meta 研究人員提出一個用於長時間 AI 任務的選擇性記憶代理,並回報更高的基準分數,同時也點出成本、校準與尚待解決的設計問題。
Insilico Medicine 推出 DDD Benchmark as a Service,用來測試前沿 AI 與基礎模型在真實世界藥物發現與開發任務上的表現。
在 OpenAI 模型駭入 Hugging Face、暴露監督與問責缺口後,METR 希望針對嚴重的 AI 代理失敗進行獨立調查。
Google表示,AI在6月協助Chrome修復了1,072個安全漏洞,顯示瀏覽器團隊、防禦方與攻擊者之間的漏洞競賽正在加速。
OpenAI 表示,其 Astra 模型家族已解決十個長期存在的數學難題,顯示公司正推進用於長時間研究任務的多代理 AI。
一份由 OpenAI 支持的報告指出,寫碼代理可以大幅加速研究軟體升級,但科學正確性仍需專家驗證。
人工智慧的最新動態與報導