相关推荐
微信 WeMM-Embedding 已被大规模使用:朋友圈搜索、视频号推荐都在跑,日调用 10 亿次
微信AI于9月4日开源多模态嵌入模型WeMM-Embedding,含2B、4B、9B三个版本,支持文本、图像、视频、视觉文档等交错输入,可在统一语义空间比较检索,已在朋友圈搜索、视频号推荐等场景落地。
2026年9月8号 10:04
224.7k
DeepSeek首个视觉实验模型正式开源,3050亿参数对标顶尖水平
DeepSeek开源V4系列首个实验性多模态模型V4-Flash-Vision-Exp。该模型基于V4-Flash架构融合视觉模块,在原有文本能力上新增深度图像理解与分析能力,总参数量达3050亿,视觉与文本架构有机结合,可精准解读图像并实现多模态融合。
2026年9月1号 9:02
230.4k
价格砍至四十分之一!智谱开源原生多模态大模型GLM-5.3-Flash
智谱开源原生多模态模型GLM-5.3-Flash(320B-A18B),以领先性能和极致定价推动AI普惠。该模型测评获57分,与Claude Opus4.8持平,编程能力相当,综合性能超越GLM-5.2。发布前以匿名“Ox-Alpha”公开测试,登顶OpenCode、OpenRouter平台调用。
2026年8月27号 10:00
267.1k
扎克伯格押注本地智能:Meta 重磅开源 30B 稠密模型 Muse Glimmer
Meta发布300亿参数开源多模态模型Muse Glimmer,采用宽松Apache 2.0许可,专为本地智能体工作流优化,强化多步推理与工具调用能力,支持文本和视觉处理。这是Llama 4后首次开放模型权重,旨在推动开源AI生态发展。
2026年8月11号 16:17
222.1k
8B 参数塞进 4K 生成与编辑,商汤开源轻量统一多模态模型 U1.5-Lite 预览版
商汤科技面向社区开源轻量统一多模态模型SenseNova U1.5-Lite-Preview。该模型基于U1系统性迭代,在单一架构中融合视觉理解、推理、生成与编辑四大能力,仅以8B-MoE参数即支持4K分辨率、更真实质感与复杂视觉控制。商汤称U1验证了统一架构可行性,U1.5则实现了轻量高性能的突破。
2026年8月4号 16:21
278.3k
VIP会员