蚂蚁百灵开源UI设计图像模型
蚂蚁百灵大模型开源Ming-Image-0.1-Design系列两个六B参数模型,覆盖UI、信息图、海报、透明图层及前端与演示文稿技能,并在UI/UX设计专项评测中位列开源模型第一。
驱动中国9月23日消息,蚂蚁百灵大模型正式开源Ming-Image-0.1-Design系列模型,推出两个参数量均为6B的图像生成模型,并同步开放Design Skill和PPT Skill,把模型能力延伸至前端页面与可编辑演示文稿场景。
该系列包含Ming-Image-0.1-Design和Ming-Image-0.1-Design-Layer。前者可根据文字需求生成UI、信息图、海报和完整视觉设计;后者可将创意图或设计图拆解为可独立编辑的透明图层。
官方称,Ming-Image-0.1-Design重点增强四项能力:支持8K长结构化提示词增强,把自然语言需求整理成文案、模块、布局与视觉风格;改善标题、按钮、卡片及多区域信息的文字渲染和版式稳定表现;借助端到端生成一次完成整体设计,并统一配色、构图与素材风格;引入原生RGBA VAE,可直接生成人物、商品、图标、装饰等透明背景素材。
与通过代码多次调用通用生图模型、分别生成背景、插画和装饰的方式相比,端到端生成方式在全局控制上更完整,可降低素材之间的色系冲突与画风差异。
在Artificial Analysis于2026年9月18日更新的UI / UX Design专项评测中,Ming-Image-0.1-Design位列开源模型第一,Elo得分为1082。该模型在UI / UX场景中的版式胜率达到67.4%,复杂构图达到67.0%,文字渲染达到66.7%。
官方同时说明该系列存在能力边界。Design当前在排版和文字方面表现相对稳定,但面对复杂人手动作、连续操作步骤,或需要精细阴影、反光效果时,输出稳定性仍不足。Layer模型的分层不存在唯一答案,不同用户可能只需要背景、主体、文字三层,也可能希望将每段文字和每个图标分别拆开;在大量叠加光效、特殊透明材质和复杂遮挡情况下,可能出现边缘残留或图层缺失。
为便于开发者体验,Ming-Image-0.1-Design已在OpenRouter开放为期两周的免费API调用。