动漫风格的AI绘画工具,正在从"生成一张好看的图"转向"把一个角色用到底"。东京团队Metanomaly运营的PixAI在经历约一个月的早期体验后,于9月18日正式发布新一代动漫图像模型Tsubaki.3,同时推出Tsubaki Video与Tsubaki Video Flash两款视频模型。官方把这一代的核心概括为"参考、编辑、发展"三步:先参考已有形象,再局部修改,最后扩展到新场景、新分镜与新格式。发布同期还启动了面向全球的创作比赛,持续到10月20日。
最直观的升级在分辨率。Tsubaki.3原生支持最高2048×2048像素的输出,约四百万像素,是上一代Tsubaki.2在1024×1024下总像素量的四倍。PixAI称这带来的不只是数字变化,角色服饰、材质、背景的细节密度更高,提示词遵循度、复杂构图能力、光照控制范围与风格跨度同步提升,头发、蕾丝这类细小元素的表现也更好。
光照控制是这一代被单独强调的能力。光的角度、强度与色温都能通过提示词指定,丁达尔光、逆光剪影、水下透光这类以往难以稳定复现的效果,官方称可以可靠生成,并且每一处高光、阴影与投影都来自同一个光源,画面在物理上站得住。摄影感方面,模型补充了胶片颗粒、镜头眩光、浅景深与白平衡这类"只有相机才有"的质感,玻璃、水洼与湿路面的反射在放大后依然成立。风格跨度从写实到动漫由同一个模型覆盖,连两种风格之间的过渡区间也能精确落点,不必为了换风格切换模型。对批量出图的工作室来说,分辨率与风格稳定性的提升直接减少了后期修图的工作量,同一套提示词在不同批次之间的一致性也更容易维持。
Tsubaki.3最重要的改动,是把注意力放在了首张图生成之后的工作流上。用户可以通过智能参考系统一次上传最多三张参考图,不需要重新训练专属模型或整理数据集。基于一张已有的角色图,就能批量产出表情集、服装变体、姿势合集、三视图与年龄变化,角色的主要视觉特征在整个系列中保持稳定。官方强调一致性来自模型本身,而不是反复抽卡碰运气。
编辑环节则取消了"重画一张"的默认做法。上传图片后,用户可以用自然语言说明要改哪里、替换什么、保留什么,比如调整发色或服装,同时维持姿势、背景与光照不变;也能修正手势、增删物体,甚至修改画面内的文字。这套能力背后是一条更长的链路:生成完的角色可以继续变成新服装、新表情、新设定与新场景,再进一步进入漫画与视频。PixAI把这种结构定义为以角色为中心的创作方式,用户不再每换一个需求就从头开始,而是把已经做好的角色当成下一阶段的素材。这套流程对连载类创作的适配度最高,因为连载最怕的正是角色在不同画面里长得不一样,一旦形象出现漂移,读者的代入感就会断掉。
漫画方向的能力是这一代扩展最明显的部分。Tsubaki.3支持在一次生成中完成整页多格漫画,包含分格布局、取景、特写与远景的切换、多机位角度,以及网点纸与速度线这类漫画技法。用户可以先用文字描述一个剧情节点,再挂上自己已有的角色参考图,模型据此搭建出带有该角色的页面。官方把定位说得很克制:它支持角色设定、故事板、分格布局与漫画页这些环节,而不是全自动生产长篇条漫。
平面设计与排版也被纳入范围。海报、主视觉、横幅、封面这类需要图文同框的场景,标题、日期与角标能在一次生成中落到合适位置,模型可以渲染中文、英文、日文与韩文四种文字,省去回到编辑器里重新排版的步骤。此外还新增了"配方"机制,创作者可以把自己调好的风格或提示词模板打包分享,其他人直接套用或在其基础上二次创作,目前流行的配方覆盖粉彩、半写实、全息与复古拼贴等方向。配方的意义不止省事,它把原本只存在于个人经验里的风格参数变成了可流通的资产:创作者可以用一套自己调好的视觉语言建立辨识度,也能直接复用他人验证过的组合快速试错。
配套发布的Tsubaki Video与Tsubaki Video Flash,把同一套参考驱动的思路延伸到运动上:相机运动、场景深度与角色一致的动画都在范围内,两个视频模型对所有用户开放,不区分会员等级,生成成本在10月20日前打七折。PixAI的意图很清楚,让同一个角色与创意在图像、漫画、视频三种格式之间流动,而不是把每种格式当成互不相干的独立体验。
这家平台的体量也值得记一笔。PixAI自2022年10月上线以来累计注册用户超过1600万,在韩国、北美与中国台湾地区拥有活跃社区,除Tsubaki系列外还有AI创作智能体Mio.2、自然语言图像编辑模型PixAI Edit Pro与节点式创作工作台PixAI Studio。把这几件事放在一起看,动漫类绘画工具的竞争点正在迁移:单张图的质量早已不是门槛,谁能把角色一致性与跨格式复用做扎实,谁才真正进入了创作者的生产流程。对做内容的工作室来说,这意味着评估工具的标准要改一改,不能只看样图好不好看,要看一个角色能不能被改得动、用得久。