蚂蚁集团旗下InclusionAI团队近日开源了6B参数文生图模型LLaDA-Image。该模型采用全扩散架构,在预训练和中期训练阶段,通过超过90%的纯图片样本建立视觉先验,后续SFT阶段再引入图文对完成语言对齐。LLaDA-Image在Qwen-Image-Bench中英文榜单中均获开源模型第一,总分位于GPT Image 1与Imagen 4.0 Ultra之间。该模型支持文生图与指令图像编辑,通过TwinFlow蒸馏技术将推理步骤从50步压缩至2-4步,同时保持较高生成质量。目前,模型权重、训练代码和完整配方已全栈开放。
