开源模型又多了一个新选择。

以后用AI做图改图,再也不用「抽卡」赌概率了。


2026年8月21日,商汤科技正式开源轻量级、原生统一多模态大模型 SenseNova U1.5 Lite(U1.5 Lite)。就雷科技的体验来说,SenseNova U1.5 Lite 在上下文长度、画面风格和文字理解方面都有着相当显著的提升,就连画布大小也支持到了原生 4K。


大家都知道,提示词生图时,提示词越准确、完善,生成出来的图片就越符合我们的预期。但在创作大型图片时,不少模型都「吃不下」太长的提示词。中途让AI对图片进行二次编辑时,模型也容易因上下文超限而崩溃。


那么 SenseNova U1.5 Lite 又是怎么解决这个问题的呢?首先在上下文长度上,U1.5 Lite 原生支持 3-4K 超长上下文,即使面对超长提示词和多次修改,同样能控制画面元素的一致性。


举个例子:过几天雷科技要去德国参加 IFA 报道,我先让 SenseNova U1.5 Lite 输出一张手绘风格的柏林观光指南。


u15-98e81271-358d-4edd-a926-82be99d6dea5.png

图片来源:雷科技


在同一个对话中把带文字的图片交还给 U1.5 Lite,并要求它将图中的文字翻译成中文。将结果并排对比,除了少数本身分辨率就不够高的文字外,原始图片的风格、插图甚至是字体风格都得到了保留。


u15-fb9a0b95-64e9-4754-9fd5-3650f38867cc.png

图片来源:雷科技


另外 SenseNova U1.5 Lite 还有一个我非常喜欢的特性:区域修改。之前雷科技曾让AI按照同一个图片模板输出不同企业 IPO 信息的卡片,但没做几张后AI就开始不听使唤了,时常把局部修改意见应用到整张图片上。


至于 SenseNova U1.5 Lite,我们甚至可以直接在图片上标记要修改的地方,而模型也会按照「约定」只修改指定区域。


截屏2026-08-21 15.59.35.png

原始图片

图片来源:商汤


u15-2f436cfd-3a26-47ba-97d7-7053cf511222.png

修改后图片

图片来源:雷科技


当然了,这种大上下文窗口和保留原始信息的能力,也为 SenseNova U1.5 Lite 带来了很多新的用法,比如在保留原始图片信息的情况下利用多张图片进行合成。而就雷科技的体验来说,U1.5 Lite 在长指令和精准编辑上的表现相当能打。


也正因如此,在雷科技看来,商汤决定开源 SenseNova U1.5 Lite,也从另一个角度印证了AI已经走出了曾经的「小打小闹」,开始投身真正工作场景的观点。过去我们「抗拒」在真实工作中使用AI,担心的无非还是AI的不可控性。如果你玩过早期 Stable Diffusion,对文生图的「蛮荒时代」一定不会陌生:即使用上 ComfyUI,最终的成果也有一定的不确定性。


而 U1.5 Lite 这类模型的出现,意味着AI生图已经不是过去那种「抽卡」的玩法。一个拥有可靠、稳定生图、改图能力的开源模型,将显著降低AI制图的门槛,这对创作者和小团队可谓意义非凡。在开源模型的赛道,商汤已经领跑行业,接下来,就看同行怎么接招了。


机器人产业最重要风向标,世界机器人大会(WRC)2026重磅来袭,还有世界人形机器人运动会紧随其后。


宇树、智元、启元、魔法原子、银河通用、云深处、灵心巧手等300余家TOP展商联袂呈现,定义全球机器人产业未来!


所有关于机器人的核心问题,WRC都将给出答案。


雷科技WRC 2026报道团已抵达WRC现场。

导流版本.png

稿定设计-13.png