OpenAI 將 GPT-6 Astra Ultrafast 帶到 NVIDIA Blackwell GPU
OpenAI 的 GPT-6 Astra Ultrafast 現已在 NVIDIA Blackwell GPU 上提供,承諾加快代理工作流程,但關鍵效能說法仍來自供應商報告。
AI GPU 的最新新聞與分析
OpenAI 的 GPT-6 Astra Ultrafast 現已在 NVIDIA Blackwell GPU 上提供,承諾加快代理工作流程,但關鍵效能說法仍來自供應商報告。
AWS 在 SageMaker AI 上針對 G5、G6、G6e 與 G7 進行 30B MoE 模型基準測試,顯示 Blackwell 可能如何改善推論成本與延遲。
NVIDIA 的新推論指南把 GPU 容量與 TCO 連結到工作負載行為、模型最佳化與彈性部署,而不只是峰值需求。
NVIDIA 表示,Groq 3 LPX 已隨 Vera Rubin 進入全面量產,目標是為 AI 代理與多輪工作負載提供更快的長上下文推論。
NVIDIA 的 ALCHEMI Toolkit 將 AI 程式碼代理連接到 GPU 加速的材料模擬,而基準測試顯示驗證仍然至關重要。
Reflection AI 與 Nebius 簽署 10 億美元算力協議,凸顯開放模型新創正加速搶占稀缺的 AI 基礎設施。
NVIDIA 正敦促 LLM 開發者共同設計適合 GPU 的推論模型,押注具備硬體意識的架構能在規模化時降低成本與延遲。
NVIDIA 已將 BioNeMo Agent Toolkit 連接到 Anthropic 的 Claude Science,目標是讓研究人員能以自然語言執行 GPU 加速的生物學工作流程。
NVIDIA 已將 BioNeMo Agent Toolkit 與 Anthropic 的 Claude Science 整合,目標是讓 AI 驅動的研究更容易使用加速型生物學工作流程。
中國的 Nvidia 雲端合作夥伴取得了 300 台搭載違禁 H100/H200 AI GPU 的伺服器,價值 9,200 萬美元;在 Super Micro 走私逮捕事件後,Sharetronic 股價暴跌。