先说最直观的——中文文字。以前用海外模型做海报,中文字体经常缺胳膊少腿,排版也歪七扭八。但U1.5 Lite出来的字,清晰规整,不管是标题还是小字说明,基本不用后期再修。这对做设计、做宣传图的人来说,省了不少事。
再说改图。有时候只想把画面里的一个杯子换成花瓶,别的什么都不动,听起来简单,但很多模型要么改完光影全乱,要么连背景都给你变了。这个模型因为自己能看懂原图的结构,知道哪里该动、哪里该留着,所以改得特别有分寸。我试了局部替换,边缘过渡自然,几乎看不出修图痕迹。
还有高清输出。它支持原生4K,不是那种先画小图再放大的假高清。放大看细节,纹理、光影都连得上,没有糊成一团的现象。
更让我觉得聪明的是,它把「看图、画图、改图」三件事塞进了同一个模型里。以前你可能需要分别用不同的工具,或者折腾复杂的插件流程。但用这个,你直接跟它说一句“把这张海报的标题改成红色,背景不变”,它就能一次性搞定,不用来回切换。因为它自己理解画面里有什么、空间怎么排布,所以处理复杂指令时不会丢三落四。
听说他们的训练方式也挺巧妙——先针对不同方向(比如文字、美感、编辑)分别训练了几个顶尖专家,再把所有专家的本事揉进一个轻量模型里。这样用户不用操心该调用哪个,一个模型就能干多个专家的活。而且他们特别用强化学习来让模型「更听话」,指令理解得更准,画面也更好看。
最实在的是,这个模型开源,允许商用。海外社区讨论的不再是谁参数大,而是它能不能真正替代工作流里的某一步。过去大家比的是最好能多好,现在比的是能不能稳定不出错。这个8B的轻量模型,不拼参数量,拼的是稳定、可控、真能用。
说真的,AI生图模型太多,但能让人放心放到生产里的不多。这个模型确实值得试一下。




