以前让 AI 生成一张图,最头疼的是两件事:要么图片够惊艳但文字总是写歪,要么想改某个局部细节,AI 把整张图都给你重画了。商汤科技这次开源的生图模型,就是冲着这两个老大难去的。 据了解,商汤科技正式开源了 8B 大小的生图模型 SenseNova U1.5 Lite,支持原生 4K 高清直出。三周前它刚出过一个 Preview 预览版,这次的正式版用官方话说就是三个词:更完整、更准确、更稳定。 它最突出的能力有几点:能一次听懂 3 到 4 千字的长指令,让你把主体、数量、位置、文字、排版风格一股脑全写进去也不容易漏细节;在复杂排版、海报、信息图这类任务上,比肩闭源的 GPT-Image-2;还支持「框选+标注」的精准局部编辑——比如让你只改图上左下角的一行字,其他区域基本不动。 能做到这些,靠的是「先拆开练,再合回来」的训练思路:先把文字渲染、美感、图像编辑这些本事分别训练成几个专项模型,最后再用蒸馏技术把能力融合回同一个轻量模型里。所以你拿到的始终只有一个 8B 模型,调用更省、部署更轻,不需要在不同子模型之间来回切换。 目前模型已开源,代码在 GitHub(OpenSenseNova/SenseNova-U1),模型权重在 HuggingFace 上可以找到,普通创作者也能直接用上。国产开源生图模型补上「稳定干活」这一课,值得一试。 来源:量子位《开源国产8B模型,比肩闭源Image 2了!》 https://www.qbitai.com/2026/08/479192.html |