以后用 AI 做图改图,再也不用「抽卡」赌概率了。
2026 年 8 月 21 日,商汤科技正式开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite(U1.5 Lite)。就雷科技的体验来说,SenseNova U1.5 Lite 在上下文长度、画面风格和文字理解方面都有着相当显著的提升,就连画布大小也支持到了原生 4K。
大家都知道,提示词生图时,提示词越准确、完善,生成出来的图片就越符合我们的预期。但在创作大型图片时,不少模型都「吃不下」太长的提示词。中途让 AI 对图片进行二次编辑时,模型也容易因上下文超限而崩溃。
那么 SenseNova U1.5 Lite 又是怎么解决这个问题的呢?首先在上下文长度上,U1.5 Lite 原生支持 3-4K 超长上下文,即使面对超长提示词和多次修改,同样能控制画面元素的一致性。
举个例子:过几天雷科技要去德国参加 IFA 报道,我先让 SenseNova U1.5 Lite 输出一张手绘风格的柏林观光指南。

图片来源:雷科技
在同一个对话中把带文字的图片交还给 U1.5 Lite,并要求它将图中的文字翻译成中文。将结果并排对比,除了少数本身分辨率就不够高的文字外,原始图片的风格、插图甚至是字体风格都得到了保留。

图片来源:雷科技
另外 SenseNova U1.5 Lite 还有一个我非常喜欢的特性:区域修改。之前雷科技曾让 AI 按照同一个图片模板输出不同企业 IPO 信息的卡片,但没做几张后 AI 就开始不听使唤了,时常把局部修改意见应用到整张图片上。
至于 SenseNova U1.5 Lite,我们甚至可以直接在图片上标记要修改的地方,而模型也会按照「约定」只修改指定区域。

原始图片
图片来源:商汤

修改后图片
图片来源:雷科技
当然了,这种大上下文窗口和保留原始信息的能力,也为 SenseNova U1.5 Lite 带来了很多新的用法,比如在保留原始图片信息的情况下利用多张图片进行合成。而就雷科技的体验来说,U1.5 Lite 在长指令和精准编辑上的表现相当能打。
也正因如此,在雷科技看来,商汤决定开源 SenseNova U1.5 Lite,也从另一个角度印证了AI 已经走出了曾经的「小打小闹」,开始投身真正工作场景的观点。过去我们「抗拒」在真实工作中使用 AI,担心的无非还是 AI 的不可控性。如果你玩过早期 Stable Diffusion,对文生图的「蛮荒时代」一定不会陌生:即使用上 ComfyUI,最终的成果也有一定的不确定性。
而 U1.5 Lite 这类模型的出现,意味着 AI 生图已经不是过去那种「抽卡」的玩法。一个拥有可靠、稳定生图、改图能力的开源模型,将显著降低 AI 制图的门槛,这对创作者和小团队可谓意义非凡。在开源模型的赛道,商汤已经领跑行业,接下来,就看同行怎么接招了。
机器人产业最重要风向标,世界机器人大会(WRC)2026 重磅来袭,还有世界人形机器人运动会紧随其后。
宇树、智元、启元、魔法原子、银河通用、云深处、灵心巧手等 300 余家 TOP 展商联袂呈现,定义全球机器人产业未来!
所有关于机器人的核心问题,WRC 都将给出答案。
雷科技 WRC 2026 报道团已抵达 WRC 现场。




登录后才可以发布评论哦
打开小程序可以发布评论哦