Anthropicの論文が、AIシステムによるアライメント研究の改善を早期に示す
Anthropicの研究者は、自動化システムが10個のアライメントベンチマークを改善したと報告し、AI研究自動化の初期テストと、その実践上の限界を示した。
AI研究ツールに関する最新ニュースと分析
Anthropicの研究者は、自動化システムが10個のアライメントベンチマークを改善したと報告し、AI研究自動化の初期テストと、その実践上の限界を示した。
Google Research の WikiSkill は、AI エージェントが失敗と成功の記録を保持できるようにし、基盤モデルを再学習せずに反復タスクの性能を向上させます。
OpenAIは、Model MLがGPT-5.6 Solを使って金融調査を追跡可能なPowerPointとExcelの成果物に変換すると説明し、ワークフロー重視のAIを示していると述べている。
CASソフトウェア研究所は、デバッグ、信頼、評価のためにAIモデルの推論をより可視化することを目的としたツール Reasoning Lens を公開した。
出版大手エルゼビアは公式に『LeapSpace』を立ち上げた。これはAI研究ツールで、5社の大手出版社が提供する1800万件の有料ジャーナル記事をスキャンし、費用、アクセスの公平性、市場支配に関する問題を提起している。