商湯科技正式宣佈開源全新的輕量級、原生統一多模態大模型 SenseNova U1.5Lite。作爲一款參數量爲8B 的輕量化模型,它在多項核心視覺任務中展現出了超越同量級模型的實力,甚至在部分複雜排版與文字渲染上達到了媲美超大規模商業模型的交付水平。

SenseNova U1.5Lite 原生支持3至4K 的上下文長度,能夠同時處理主體、數量、空間關係、文字、佈局以及風格等多重約束,從而顯著提升複雜視覺任務執行時的穩定性。
在具體功能特性方面,該模型帶來了多項核心升級。首先是更高質量的視覺生成,顯著改善了整體構圖、色彩、材質、光影、真實感和局部細節,有效避免了傳統模型常見的局部正確但整體完成度不足的問題。其次是更可靠的原生圖像編輯能力,增強了對主體身份、空間結構、版式關係以及非編輯區域的保持度,同時全面提升了局部修改、元素替換、文字精修和多參考圖編輯的綜合表現。

此外,該模型在文字與複雜佈局的處理上同樣表現亮眼,加強了中英文文字、海報、信息圖、品牌視覺及多文本排版能力,推動生成內容向完整的視覺表達邁進。在視覺控制上,它支持 Bounding Box、Visual Marker 以及單圖、多圖參考等多種方式,能夠對指定區域和對象進行更精確的編輯。更值得一提的是,它實現了原生4K 高分辨率輸出,在高分辨率生成中能夠兼顧整體宏觀構圖與極精細的肌理、微小文字以及光影折射效果。
項目地址:https://github.com/OpenSenseNova/SenseNova-U1
VIP會員