相關推薦
微信 WeMM-Embedding 已被大規模使用:朋友圈搜索、視頻號推薦都在跑,日調用 10 億次
微信AI於9月4日開源多模態嵌入模型WeMM-Embedding,含2B、4B、9B三個版本,支持文本、圖像、視頻、視覺文檔等交錯輸入,可在統一語義空間比較檢索,已在朋友圈搜索、視頻號推薦等場景落地。
Sep 8, 2026
221.9k
DeepSeek首個視覺實驗模型正式開源,3050億參數對標頂尖水平
DeepSeek開源V4系列首個實驗性多模態模型V4-Flash-Vision-Exp。該模型基於V4-Flash架構融合視覺模塊,在原有文本能力上新增深度圖像理解與分析能力,總參數量達3050億,視覺與文本架構有機結合,可精準解讀圖像並實現多模態融合。
Sep 1, 2026
213.6k
價格砍至四十分之一!智譜開源原生多模態大模型GLM-5.3-Flash
智譜開源原生多模態模型GLM-5.3-Flash(320B-A18B),以領先性能和極致定價推動AI普惠。該模型測評獲57分,與Claude Opus4.8持平,編程能力相當,綜合性能超越GLM-5.2。發佈前以匿名“Ox-Alpha”公開測試,登頂OpenCode、OpenRouter平臺調用。
Aug 27, 2026
265.2k
扎克伯格押注本地智能:Meta 重磅開源 30B 稠密模型 Muse Glimmer
Meta發佈300億參數開源多模態模型Muse Glimmer,採用寬鬆Apache 2.0許可,專爲本地智能體工作流優化,強化多步推理與工具調用能力,支持文本和視覺處理。這是Llama 4後首次開放模型權重,旨在推動開源AI生態發展。
Aug 11, 2026
222.1k
8B 參數塞進 4K 生成與編輯,商湯開源輕量統一多模態模型 U1.5-Lite 預覽版
商湯科技面向社區開源輕量統一多模態模型SenseNova U1.5-Lite-Preview。該模型基於U1系統性迭代,在單一架構中融合視覺理解、推理、生成與編輯四大能力,僅以8B-MoE參數即支持4K分辨率、更真實質感與複雜視覺控制。商湯稱U1驗證了統一架構可行性,U1.5則實現了輕量高性能的突破。
Aug 4, 2026
293.2k
VIP會員