6B开源模型让AI设计可预览可编辑可交付
过去,在灵光闪应用中,用户需等应用生成完成才能看到完整页面设计;在画眉的专业设计场景中,设计师拿到成图后还需拆层处理,通常要5分钟以上才能继续编辑。两个场景指向同一问题:AI设计需从“能够生成”走向“可预览、可编辑、可交付”。
我们正式开源Ming-Image-0.1-Design系列,包含两个参数量均为6B的模型:Ming-Image-0.1-Design(Design)从文字需求生成UI、信息图、海报和完整视觉设计;Ming-Image-0.1-Design-Layer(Layer)将创意图或设计图拆成可独立编辑的透明图层。同时开源Design Skill和PPT Skill,将模型能力连接到前端页面与可编辑演示文稿。

Design重点增强四项能力:支持8K长结构化提示词增强;优化文字渲染与版式稳定性;端到端生成一次性完成整体设计;创建原生RGBA VAE,直接生成透明背景素材。相比多次调用通用生图模型,端到端生成拥有更完整的全局控制,减少色系冲突和画风不一致。
Layer做的不是普通抠图,而是恢复设计图背后的结构,可将设计图拆成2—9个语义独立的RGBA图层,侧重广告海报、PPT、UI/UX、信息图、电商主视觉和模板再创作等场景。模型按文字、卡片、主体和背景等设计角色组织图层,保留透明边缘,补全被遮挡区域,并保障图层重新组合后的一致性。其通过Type Token、Alpha-Aware Layer Optimization和Composite-Layer Stack Consistency实现更准拆分。

在Artificial Analysis于2026年9月18日更新的UI/UX Design专项评测中,Ming-Image-0.1-Design位列开源模型第1,Elo得分1082。UI/UX场景版式胜率67.4%,复杂构图67.0%,文字渲染66.7%。具体案例中,果园Dashboard对照Nano Banana 2 Lite、FLUX.2 [max]和Krea 2 Medium获得12/12胜出;食谱App对照Nano Banana 2、Nano Banana Pro和MAI-Image-2.5-Flash获得10/10胜出。6B参数通过专项训练同样可进入大模型竞争区间。
Layer在Crello-Test图层解耦评测中,RGB L1、Alpha soft IoU两项指标及MLM-0至MLM-5六档设置下共12项结果全部排名第一,即使与未开源、使用Crello训练集微调的Qwen-Image-Layered-I2L相比仍全面领先。相同软硬件条件下,6B的Layer质量优于20B Qwen官方开源版本,单次推理时间从795秒降至183秒,速度提升约4.3倍;经工程优化,1024分辨率端到端服务通常约20秒返回完整结果。

灵光闪应用接入后,设计预览被前置到应用生成初始阶段,Design端到端生成布局完整、风格统一的应用预览,Agent再调用Layer拆解素材并结合设计文档完成代码生成,使最终应用与预览高度一致。该功能正在内测,将于近期上线。
画眉接入Layer后,可直接将图片转换为语义独立的可编辑图层,文字、主体、背景和装饰可分别修改、移动、隐藏或替换,通常约40秒获得分层结果。内部测试口径下,首次获得图层从5分钟以上降至约40秒,提速约7.5倍;过去用GPT-image2完成改字操作,成本高出Ming-Image模型的7倍。画眉支持AI生图、文案调整、图像分层、图层编辑和PSD导出等能力。
本次同步开源Design Skill和PPT Skill。Design Skill支持Text-to-Page和Image-to-Page(Visual Coding),将Design、Layer和Coding串成完整链路,直接生成可运行、可继续修改的前端页面。Text-to-Page让用户输入一句需求,约15秒先看到完整页面方案,确认后再提取素材交给Coding构建页面,首次看到结果从约5分钟降至15秒。Visual Coding则从参考图直接还原页面。
更多推荐阅读

Bengio高徒Bonnie Li从DeepMind转会OpenAI
9月16日,谷歌DeepMind核心研究员Bonnie Li宣布离职,转会OpenAI。她曾深度参与Gemini 2.5/3、世界模型Genie 2/3及具身智能体Sima 2研发,并提到OpenAI在Ilya Sutskever主政时期的“Feel the AGI”口号。对曾以12:1人才净流入比傲视硅谷的DeepMind而言,这仅是冰山一角——其对主要竞对的人才留存比已骤降至2:1。 201...
2026-09-23
19个AI血战星际争霸:GPT-6全胜仍不敌人类新手
想太多,就连最聪明的AI也会被拖死。43分钟、11138个推理token、6批指令——0个作战单位。这是Grok 4.6在《星际争霸:母巢之战》中交出的成绩单。把推理拉到最高档位xhigh的Grok,从开局苦思冥想到游戏结束,连一个能上场打仗的兵也没造出来。同一榜单另一头,GPT-6 Astra同样火力全开,18战18胜,胜率100%。这份名为Brood War Bench的星际大模型榜单,在Ha...
2026-09-23
OpenAI神秘Aeon曝光,正面迎战Meta Muse
今天,OpenAI 正式发布 GPT-6 Sol 和 GPT-6 Luna,但外界更关心其个人 AI 智能体 Aeon(Codex Bot)何时推出。近两个月,个人 AI 智能体从边缘话题变成普通用户手机上的新图标。Meta 9 月 8 日推出 Muse,据 Business Insider 报道,其从美国应用商店排名第二跃升至第一,风头盖过长期霸榜的 ChatGPT。此前,xAI(现更愿被称作 ...
2026-09-23
阿里谷歌同时重做电脑,AI原生PC真要来了
在刚结束的高通骁龙峰会上,阿里千问展示了面向AI打造的PC产品Qwen Book。同时,首批Googlebook将于下月初发售,两者不约而同地使用相似定位:“AI原生电脑”。 过去两年的AI PC通常意味着增加一颗NPU并预装聊天助手。这一轮尝试有所不同,Google和千问都把改造深入到操作系统,AI不再等待用户打开单独窗口,而是主动读取屏幕内容、调用其他应用,并在后台持续完成任务。 首批Go...
2026-09-23
Meta的AI让真人代打电话,被骂到紧急撤回
路透社9月22日爆料,Meta正在为员工测试一项名为“human concierge”(真人礼宾)的新功能,让真人代替AI帮Muse用户打电话办事。用户将任务交给Muse后,Muse可将部分电话请求转交外部承包商,由真人拨打电话完成。该服务尚处内部测试阶段,未向普通用户公开,但消息传出后引发争议,Meta已紧急撤回该计划。 Muse是Meta新推出的AI应用,上线十天即登顶美国App Store...
2026-09-23
千问办公发布企业上下文,让Agent真正读懂公司
在大模型忙于刷 Benchmark 时,不能说话的 Jev 意外成为 AI 圈新顶流,反映出大模型应用价值正从“生成什么”延伸到“能否理解复杂信息并做出可靠判断”。在企业办公场景中,员工一句“帮我整理报价”背后可能牵涉客户历史、库存、折扣、审批权限和部门协作。AI 若只会生成文档而不了解业务背景,很难真正进入工作流。企业需要的是能理解业务上下文、知道与谁协作、清楚权限边界的 AI。 千问办公在杭...
2026-09-23