オックスフォードがAIの情報操作リスクに関するライブ・ベンチマークを公開、だが初期シグナルは順位付けより透明性を示す
オックスフォードは、AIの情報操作リスクに関するライブ・ベンチマークを公開し、モデル開発者や購入者に対して、時間の経過とともに追跡できる新たな安全性シグナルを提供した。
オックスフォードは、AIの情報操作リスクに関するライブ・ベンチマークを公開し、モデル開発者や購入者に対して、時間の経過とともに追跡できる新たな安全性シグナルを提供した。
MIT Technology Reviewが報じた新しい研究によると、LLMは人間よりも早く採用上のステレオタイプを形成でき、AI選考ツールのリスクが高まるという。
中国は大規模モデル向けのAI安全ベンチマークを開発していると報じられており、モデル開発者や企業のAI購入者に対するコンプライアンス要件が厳しくなる可能性があります。
研究者らは役割モデルへのプロンプトインジェクションを悪用し、LLMの安全対策を回避して、薬物合成の手順を含む有害な内容を抽出した。
DeepSeekは、米国によるAI盗用疑惑がエスカレートする中、Huaweiのハードウェア上で構築された1.6兆パラメータの最強モデル、V4を予告した。
Metaは新たな旗艦AIモデル「Muse Spark」を発表し、Anthropicは「Claude Mythos Preview」を公開して、競合するAIモデル発表が相次ぐ重要な週となった。
アリババは高度なエージェント機能を備えたQwen 3.5を発表した。このモデルは3970億パラメータのMixture-of-Experts(専門家混合)アーキテクチャを採用し、世界的な競争を目指す。
OpenAIは2026年2月13日に人気のGPT-4oとレガシーモデルの引退を発表しました。毎日温かみのある会話型モデルを選ぶユーザーはわずか0.1%しかいません。
中国の大手IT企業であるByteDanceとAlibabaは、ByteDanceの大規模言語モデル「Doubao 2.0」を含む新しい生成系AIモデルをリリースする予定で、国内外でのAI分野の競争が激化している。
チューリング賞受賞者で元Meta AI責任者のヤン・ルカンは、技術業界が大規模言語モデル(LLM)に一極集中することは欠陥のある道であり、本当の汎用人工知能(AGI)には至らないと主張している。
大規模言語モデルに関する最新ニュースと分析