NVIDIA、Nemotron 3 Super と NeMo RL の指針でエンタープライズ向けのプレイブックにエージェント強化学習を押し上げる
NVIDIA は、RLVR と GRPO がエンタープライズ AI エージェントに実用段階に入ったとし、Nemotron 3 Super と NeMo RL をドメイン特化の信頼性向上と結び付けている。
NVIDIA は、RLVR と GRPO がエンタープライズ AI エージェントに実用段階に入ったとし、Nemotron 3 Super と NeMo RL をドメイン特化の信頼性向上と結び付けている。
General Intuitionは、数百万時間に及ぶゲームプレイで学習したAIを拡張するために3億2,000万ドルを調達し、アクションデータがAIの現実世界における推論能力の向上に役立つと見込んでいる。
元Google DeepMind研究者のデイビッド・シルバーは、ロンドン拠点のスタートアップIneffable Intelligenceのために、Sequoia Capital主導の記録的な10億ドルのシードラウンドを調達しており、この会社は大規模言語モデルではなく強化学習を用いて超知能を構築することを目指している。
強化学習に関する最新ニュースと分析