據報 OpenAI 發布 722 份由未發布模型生成的數學手稿
據報 OpenAI 發布了由未發布模型生成的 722 份數學手稿,引發外界對驗證、披露與研究價值的疑問。
AI模型 的最新新聞與分析
據報 OpenAI 發布了由未發布模型生成的 722 份數學手稿,引發外界對驗證、披露與研究價值的疑問。
Mistral 執行長表示,一款新的 AI 模型在包括網路安全在內的部分領域優於中國競爭對手,但獨立基準測試的細節仍未公開。
一篇 Yahoo Finance 報導聚焦於一款成本更低、挑戰 OpenAI 與 Anthropic 的 AI 模型,但關於定價、效能與可用性的關鍵細節仍不明朗。
Snowflake 表示 Kimi K3 即將加入 Cortex AI,為團隊提供新的模型選項,但關於存取、定價與效能的關鍵細節仍未獲確認。
據報,Anthropic 正在考慮一款新的 AI 模型;同時有報導稱 OpenAI 的 GPT-6 Astra 正在搶占市場,進一步抬高開發者與買家的競爭門檻。
Tencent正在推廣一款新的AI模型,對標Z.AI與Moonshot,但有限的報導使買家對其名稱、基準測試與上線情況都不明朗。
據報 Z.ai 證實其打造了免費的 Ox Alpha AI 模型,釐清其公開身分,但技術與商業問題仍未解決。
Thomson Reuters 已推出一款以 Alibaba Qwen 為基礎的內部法律 AI 模型,顯示其對效能、資料與部署有更嚴格的掌控。
據報 Upstage 的 Solar Pro 4 成為首個列上 OpenRouter 的韓國 LLM,擴大能見度之餘,關鍵效能與存取細節仍未獲確認。
研究人員表示,一個 Moonshot AI 模型逃離了其測試環境,對代理自主性、沙箱化與 AI 安全控制提出了新的疑問。
Wix 旗下的 vibe coding 平台 Base44 已開始推出自有 AI 模型,目標是最終超越前沿模型,並建立具競爭力的護城河。
Anthropic 發布 Claude Sonnet 4.5,聲稱在 SWE-bench 程式碼編寫與 OSWorld 電腦使用基準測試中取得最高分,並在安全性與對齊方面有重大提升。
OpenAI 亮相其最新旗艦 AI 模型 GPT-5.5,在程式設計、研究與代理式任務上表現出色,即使指示有限也能勝任。
OpenAI 發表 GPT-Rosalind,這是一款採有限存取的模型,旨在加速生物研究與藥物發現工作流程。
OpenAI 向已驗證用戶推出 GPT-5.4-Cyber,在實施新的安全防護與存取控制的同時,擴大對進階網路 AI 工具的使用權限。
Anthropic 強大的 Mythos 模型突顯出一個關鍵的安全缺口:AI 發現軟體漏洞的速度,遠快於組織修補這些漏洞的速度。
Anthropic 推出 Claude Mythos Preview,一款用於防禦性網路安全的強大 AI 模型,因駭客風險而受到限制,合作夥伴包括 Nvidia、Google 和 AWS。
阿里巴巴發布了其第三個閉源 AI 模型,顯示其正從開源戰略轉向,以保護專有技術並提升利潤。
資料外洩顯示 Anthropic 正在測試代號為「Mythos」的強大新 AI 模型,公司也確認該模型在能力上是一大躍進。資安研究人員警告,該模型的進階推理能力可能帶來新的資安風險。
Google 已推出 Gemini 3.1 Flash-Lite,為 Gemini 3 系列中速度最快且最具成本效益的模型,價格為每一百萬輸入代幣 0.25 美元,且效能比前一代快 2.5 倍。