百度开源文生图模型 ERNIE-Image。该模型基于单流 Diffusion Transformer(DiT)架构,参数规模为 8B,仅需 24 GB 显存的消费级显卡即可实现高精度图像生成。在 GenEval、LongText-Bench 等国际基准测试中,其指令遵循与文字渲染能力均达到开源模型领先水平(SOTA),尤其在处理中英日韩多语言排版、复杂多主体关系和结构化布局方面表现突出。
百度文心
🌸 在花频道|茶馆讨论|投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel