该模型基于单流 Diffusion Transformer(DiT)架构,参数规模为 8B,仅需 24 GB 显存的消费级显卡即可实现高精度图像生成。在 GenEval、LongText-Bench 等国际基准测试中,其指令遵循与文字渲染能力均达到开源模型领先水平(SOTA),尤其在处理中英日韩多语言排版、复杂多主体关系和结构化布局方面表现突出。
百度文心开源 8B 文生图模型 ERNIE-Image
Previous: Anthropic 宣布在 Claude 平台推行身份验证机制
Next: 谷歌发布 macOS 版 Gemini 应用