昨天帮朋友改一张活动海报,就改左下角几行字,我折腾了半小时——不是不会P图,是AI改图太不靠谱,要么把整张图重画一遍,要么把不该动的背景也顺手抹了。所以今天看到商汤把自家生图模型的正式版开源了,我第一反应是:这玩意儿能不能治"AI改图手残"?
这个模型叫SenseNova U1.5 Lite,只有8B大小,比很多手机App还轻,但官方敢说它在排版和精准编辑上能跟OpenAI的付费闭源模型GPT-Image-2掰手腕。怎么个厉害法?给你九张角度、光线各不相同的食物照片,它能拼成一张整整齐齐的食谱卡片,每道菜还认得出来;让它"只改左下角的字、其他别动",它真就只动那一块,旁边的图形、颜色、字体层级原封不动;给它三张参考图,它还能分清哪张管版式、哪张管人物、哪张管文字,最后合成一张新海报。
说白了,以前AI生图是"画个大概",现在是"指哪打哪"。这背后是个挺朴素的技术思路:先把文字、审美、编辑这些能力分开练,练好了再融回同一个模型里。所以用户拿到手的还是一个小模型,不用在好几个模型之间来回切换,跑起来快、部署轻,还免费开源,GitHub和Hugging Face上都能下,在线也能直接体验。
为啥普通人该关心这事?很简单,以前这种"让AI帮你改图、排版、做封面"的能力,要么藏在付费API里,要么需要顶配显卡,普通人也就看个热闹。现在8B的开源模型就能干这活,意味着做海报、剪贴画、改错字这类活儿,门槛被彻底拉下来了——小工作室、自媒体、甚至学生党,都能用上以前只有专业团队才用得起的工具。
国产模型这条路走得挺聪明。不跟人家拼参数大小、拼谁的演示视频更炫,而是把"稳定干活"四个字做到位,再大大方方开源,让所有人都能用上。AI生图的评判标准也在悄悄变:以前比谁画得惊艳,现在比谁能老老实实把活干完。照着这个趋势,设计师的"改图"生意,怕是真要不好做了。
生图模型 商汤

