NVIDIA 宣稱 Vera Rubin NVL72 每瓦可帶來高達 30 倍的 agentic 工作量
NVIDIA 表示,Vera Rubin NVL72 相較於 GB300,每百萬瓦可提供高達 30 倍的 agentic 推論吞吐量,但仍待獨立基準審查。
AI 電源效率 的最新新聞與分析
NVIDIA 表示,Vera Rubin NVL72 相較於 GB300,每百萬瓦可提供高達 30 倍的 agentic 推論吞吐量,但仍待獨立基準審查。
NVIDIA 表示,Vera Rubin NVL72 每兆瓦可提供高達 GB300 30 倍的代理式 AI 吞吐量,目標是長上下文推論成本。
NVIDIA 表示,Vera Rubin NVL72 每兆瓦可提供的代理式 AI 吞吐量最高可達 GB300 的 30 倍,正在重塑推理經濟。
OpenAI 表示,Jalapeño 晶片可提升多種模型的 AI 推論速度與能效,但目前結果仍屬於供應商自述,且尚未正式部署。
NVIDIA 表示,Vera Rubin NVL72 每兆瓦可提供高達比 GB300 多 30 倍的代理式吞吐量,正在重塑 AI 建構者的推論經濟。
KAIST 報告指出 AI 代理中存在一項新近辨識出的隱藏能源成本,為企業 AI 部署與代理設計帶來新的疑問。
新的報導顯示,進階 AI 系統的耗電量可能遠高於基本聊天機器人,為 AI 採購方帶來新的成本與基礎設施疑問。
曾任 Databricks AI 負責人的 Naveen Rao 創立了 Unconventional AI,該公司承諾利用新型硬體大幅提升推理處理的能源效率。