百度文心开源 8B 文生图模型 ERNIE-Image

该模型基于单流 Diffusion Transformer(DiT)架构,参数规模为 8B,仅需 24 GB 显存的消费级显卡即可实现高精度图像生成。在 GenEval、LongText-Bench 等国际基准测试中,其指令遵循与文字渲染能力均达到开源模型领先水平(SOTA),尤其在处理中英日韩多语言排版、复杂多主体关系和结构化布局方面表现突出。

Previous:

Next:

发表回复

Please Login to Comment
SHARE
TOP
🍉
🔈Hi,朋友。欢迎来到木木的博客小站!