「But marinade」と漏えいしたパスワードが、AI推論APIの内部にあるリスクを浮き彫りにした
研究者らは、APIの欠陥により公開セッションから隠れたAI推論と秘密情報が露出し、AI開発者と企業に安全性・プライバシー上のリスクが生じたと述べている。
研究者らは、APIの欠陥により公開セッションから隠れたAI推論と秘密情報が露出し、AI開発者と企業に安全性・プライバシー上のリスクが生じたと述べている。
AnthropicのClaude Opus 5がARC-AGI-3で新たな最高スコアを記録し、真の推論力向上なのかベンチマーク対策なのかという新たな疑問を呼んでいる。
NVIDIAは、5,000人超が参加したKaggleチャレンジで、AIの推論はより大きなモデルよりも、検証済みトレースとワークフロー設計によって改善することが示されたと述べている。
Anthropicは、Claudeの新しい解釈可能性研究によりモデルの推論の一部を追跡できると述べており、AI安全性、デバッグ、企業の信頼にとって注目すべき一歩だとしています。
AgenticSTS の研究者は、構造化メモリによってAIエージェントが Slay the Spire 2 を倒しつつトークン使用量を削減できたと述べ、コンテキストの劣化を乗り越える実践的な道筋を示した。
Anthropic は、Claude に分離可能な内部推論ワークスペースを見いだしたという新研究を発表したとし、AI の解釈可能性と安全性の取り組みを変える可能性があるとしている。
CASソフトウェア研究所は、デバッグ、信頼、評価のためにAIモデルの推論をより可視化することを目的としたツール Reasoning Lens を公開した。
Google は Gemini 3 Deep Think の大規模なアップグレードを公開し、『人類の最後の試験』で48.4%を達成し、国際オリンピックの課題で金メダル相当の成績を収めました。
AI推論に関する最新ニュースと分析