商汤科技宣布开源SenseNova U1.5-Lite-Preview,这是一款将视觉理解、图像生成和编辑放在同一模型中的多模态模型,采用8B-MoT规模,支持原生4K图像生成。
该模型相比SenseNova U1提升了局部纹理、细节和真实质感表现,也能更准确地生成中英文文字和复杂版式。商汤还称,模型在图像编辑时能够更好地保持主体身份和空间结构。
用户可以通过边界框、视觉标记和多张参考图控制生成与编辑结果。SenseNova U1.5-Lite-Preview目前已在GitHub、Hugging Face和ModelScope开放,仍属于预览版本。
近期文章
- 六年1000店,一家大马咖啡品牌如何把星巴克“拉下马”2026/08/21 18:04
- 谁来审判 OpenAI?2026/08/21 16:57
- 中国已建成超70个具身智能训练场2026/08/21 14:08
- 方程豹方程S系列开启预订,23万元起2026/08/21 14:06
- 阿里资本开支增75%,二季度净利润降76%2026/08/21 14:04
寻求报道
如果你的产品足够锐意创新,欢迎联系我们!
你可能会喜欢

六年1000店,一家大马咖啡品牌如何把星巴克“拉下马”
2026/08/21 18:04

谁来审判 OpenAI?
2026/08/21 16:57

中国已建成超70个具身智能训练场
2026/08/21 14:08

方程豹方程S系列开启预订,23万元起
2026/08/21 14:06
成为付费用户可以阅读 商汤 所有资料
了解更多 →阅读原文 ↗动点科技