蚂蚁百灵开源UI设计图像模型

AI 驱动中国 顾川 661次阅读
分享 Q
AI摘要
由 AI 生成 · 仅供参考

蚂蚁百灵大模型开源Ming-Image-0.1-Design系列两个六B参数模型,覆盖UI、信息图、海报、透明图层及前端与演示文稿技能,并在UI/UX设计专项评测中位列开源模型第一。

驱动中国9月23日消息,蚂蚁百灵大模型正式开源Ming-Image-0.1-Design系列模型,推出两个参数量均为6B的图像生成模型,并同步开放Design Skill和PPT Skill,把模型能力延伸至前端页面与可编辑演示文稿场景。

该系列包含Ming-Image-0.1-Design和Ming-Image-0.1-Design-Layer。前者可根据文字需求生成UI、信息图、海报和完整视觉设计;后者可将创意图或设计图拆解为可独立编辑的透明图层。

官方称,Ming-Image-0.1-Design重点增强四项能力:支持8K长结构化提示词增强,把自然语言需求整理成文案、模块、布局与视觉风格;改善标题、按钮、卡片及多区域信息的文字渲染和版式稳定表现;借助端到端生成一次完成整体设计,并统一配色、构图与素材风格;引入原生RGBA VAE,可直接生成人物、商品、图标、装饰等透明背景素材。

与通过代码多次调用通用生图模型、分别生成背景、插画和装饰的方式相比,端到端生成方式在全局控制上更完整,可降低素材之间的色系冲突与画风差异。

在Artificial Analysis于2026年9月18日更新的UI / UX Design专项评测中,Ming-Image-0.1-Design位列开源模型第一,Elo得分为1082。该模型在UI / UX场景中的版式胜率达到67.4%,复杂构图达到67.0%,文字渲染达到66.7%。

官方同时说明该系列存在能力边界。Design当前在排版和文字方面表现相对稳定,但面对复杂人手动作、连续操作步骤,或需要精细阴影、反光效果时,输出稳定性仍不足。Layer模型的分层不存在唯一答案,不同用户可能只需要背景、主体、文字三层,也可能希望将每段文字和每个图标分别拆开;在大量叠加光效、特殊透明材质和复杂遮挡情况下,可能出现边缘残留或图层缺失。

为便于开发者体验,Ming-Image-0.1-Design已在OpenRouter开放为期两周的免费API调用。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com
本文价值 4 1 人已评
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友