Anthropic 論文提供 AI 系統改善對齊研究的早期觀察
Anthropic 研究人員報告,一個自動化系統改善了 10 項對齊基準,為 AI 研究自動化及其實務限制提供早期測試。
AI研究工具 的最新新聞與分析
Anthropic 研究人員報告,一個自動化系統改善了 10 項對齊基準,為 AI 研究自動化及其實務限制提供早期測試。
Google Research 的 WikiSkill 讓 AI 代理保留失敗與成功的紀錄,無需重新訓練底層模型即可提升重複任務表現。
OpenAI 表示,Model ML 使用 GPT-5.6 Sol 將金融研究轉為可追蹤的 PowerPoint 與 Excel 交付成果,凸顯以工作流程為中心的 AI。
中國科學院軟件研究所推出 Reasoning Lens,旨在讓 AI 模型的推理過程更透明,便於除錯、建立信任與評估。
出版巨頭愛思唯爾正式推出LeapSpace,一款AI研究工具,可掃描五大出版社的1800萬篇付費期刊文章,引發對費用、可及性公平及市場壟斷的質疑。