Liquid AI 將 speculative decoding 加入 LFM2.5-VL-3B,以加速視覺語言推論
Liquid AI 發布了 LFM2.5-VL-DSpark,一款 2.8 億參數的 drafter,可在邊緣裝置與 H100 GPU 上加速 LFM2.5-VL-3B 的解碼。
裝置端 AI 的最新新聞與分析
Liquid AI 發布了 LFM2.5-VL-DSpark,一款 2.8 億參數的 drafter,可在邊緣裝置與 H100 GPU 上加速 LFM2.5-VL-3B 的解碼。
PrismML 發布了 Bonsai 2 27B,一款為電腦與手機設計的壓縮推理模型,進一步強化了私有、端側 AI 的可行性。
Google 表示,Gemma 4 已突破 1.5 億次下載,並展示了使用這些開放模型開發裝置端 AI 應用程式的開發者。
Google 介紹了 Gemma 4 12B,這是一款無編碼器的多模態開放模型,可在配備 16GB 記憶體的筆記型電腦上本地執行。
有報導指出,Chrome 一直在安裝一個本地的 Gemini Nano 模型以支援 AI 功能,引發了對儲存空間、同意與能源消耗的擔憂。
Google 推出了一款由其 Gemma AI 模型驅動的 iOS 離線優先 AI 語音轉錄應用,劍指 Wispr Flow 等競爭對手。
隨著蘋果慶祝成立50週年,前內部人士表示,該公司浪費了早期的AI優勢,但如今正押注於裝置端AI與Google Gemini,以重啟Siri。