DeepSeek V4.1 Flash上线:552B MoE模型全面超越V4 Pro

DeepSeek V4.1 Flash上线:552B MoE模型全面超越V4 Pro

AI 资讯 来源:新闻/公众号 发布时间:2026-09-10 更新于 2026-09-10 预计阅读 4 分钟

周四上午,DeepSeek V4.1 Flash 正式在网页、App 和 API 端全面上线。官方称其在性能、响应速度、效率等核心指标上全面超越 V4 Pro,采用新架构并原生支持多模态。

刚刚,DeepSeek V4.1 Flash正式上线!已适配Harness

V4.1 Flash 是一款总参数 552B 的 MoE 模型,采用全新 Causal-Encoder-Decoder 架构,输入与输出采用非对称计算设计:输入侧仅激活 8B 参数,输出侧激活 16B 参数,在保持大模型容量的同时大幅降低推理成本。模型还引入新的预训练方法,并进行更大规模强化学习后训练,在多项基准测试中实现性能提升,整体智能水平超过大批当前旗舰模型。

刚刚,DeepSeek V4.1 Flash正式上线!已适配Harness

开源链接已公布。官方基准结果显示,V4.1 Flash 在软件工程、网络安全环境和自动化任务等测试中表现较强,在 DeepSWE v1.1、CyberGym 和 Automation-Bench 上均取得最高分,其中 DeepSWE 仅以 0.2 分领先 Opus 5;但在 Terminal-Bench 3.0 上,其 30.0 分明显低于 Opus 5 的 43.3 分和 GPT-5.6 Sol 的 34.4 分。整体看,它在部分 Coding 和 Agent 类任务上具备较强竞争力,但并非所有基准都占优。在 GPQA Diamond、Terminal-Bench 3.0/4.0、ProgramBench 等项目上,仍与顶级闭源模型存在差距。

刚刚,DeepSeek V4.1 Flash正式上线!已适配Harness

DeepSeek 对 V4.1 Flash 信心十足,已公告将砍掉 V4 Pro。此次更新另一主线是进一步压低推理成本。Agent 类负载 token 结构极度倾斜,常是几万 token 上下文、工具返回、代码仓库前缀,换几十到几百 token 输出,V4.1 的输入/输出比面向此类任务改进,大幅优化总成本。V4.1 Flash 还对缓存进一步压缩,官方数据显示新一代模型 KV Cache 大幅缩小,相比上一代对 HBM 需求降至 1/4,对 SSD 需求降至 1/8。缓存分层中本就把 SSD 当一级存储用,是 DeepSeek 服务栈的一贯路线。每步要读的 KV 已小到不再主导显存带宽,权重读取才是瓶颈,这也是社区测出 400 token/s、速度不随上下文长度衰减的原因。

9 月 14 日中午 12 时后,V4 Pro 的 API 将下线,所有请求自动路由至 V4.1 Flash,并按 Flash 系列降价后单价计费:空闲时段输入缓存命中 0.02 元、未命中 1 元,输出 4 元;高峰时段为空闲时段 2 倍。C 端网页和 App 原有的快速、专家、识图三个模式已全部合并,接入 V4.1 Flash,可用最先进大模型开深度思考加搜索。部分第三方 Agent 工具、AI 平台也同步上线新模型,如 Workbuddy。此前 OpenDesign 已对 V4.1 Flash 进行基准测试,在 OpenDesign Arena 上达到世界第二,超过 Fable 5.1,仅次于 Astra。

与新模型同步的还有 DeepSeek Harness v0.1.5,Web 界面支持上传图片、PDF 等文件。新版本与 V4.1 Flash 训练深度结合,模型在 DSH 不同配置中均进行专项训练和优化。新版为插件作者提供更多标准化 UI 扩展入口,新增文件上传、侧边栏文件预览等功能,优化 UI 性能与交互,并增加与模型研究前沿深度结合的实验功能。

标签: AI 资讯 AI

更多推荐阅读

DeepSeek新模型全面超越,开发者为何不买账?

DeepSeek新模型全面超越,开发者为何不买账?

崔添翼9月9日在X发推称,V4.1 Flash在性能、费用、速度和总用时上全面超过V4 Pro,因此V4.1 Flash上线后、V4.1 Pro上线前,所有发往V4 Pro的请求将路由到V4.1 Flash,按Flash价格计费。DeepSeek当天在开放平台发布公告,部分客户收到邮件,但距切换仅一天左右,没有新旧模型并行迁移期。不少开发者是在刷到浏览量超70万的推文后,才意识到调用的V4 Pro...

2026-09-10
GPT-6与实时视频爆发,AI游戏互动内容迎新赛季

GPT-6与实时视频爆发,AI游戏互动内容迎新赛季

一周之内,大语言、图片、视频模型都迎来新赛季。OpenAI发布GPT-6 Astra,重点提升编码、数学、电脑与浏览器操作、多步骤工作流完成度,演示中包含游戏场景创建。社区随后涌现大量游戏创作和Blender 3D绘制,有人用HTML和Godot复刻《英雄联盟》《索尼克》,有人用Blender绘制3D版颐和园。9月8日,OpenAI发布GPT-image-2.5,生成延迟最多降低50%,参考图一致...

2026-09-10
GPT-6 Astra限时免费开放,今晚11点截止

GPT-6 Astra限时免费开放,今晚11点截止

速速体验,还有9个小时。 智东西9月10日报道,昨夜,AI大模型评测平台Arena宣布,用户可以在Arena直接模式中免费使用 GPT-6 Astra,时间截止到今晚11点。 值得注意的是,官方声明了仅可以使用GPT-6 Astra的medium级别,而且必须在直接模式中体验,使用额度方面没有明确限制。 消息一出,大量网友涌入Arena,有网友使用GPT-6 Astra开发了一款沙滩滑板游戏...

2026-09-10
WorkBuddy丝滑接入飞书,AI办公新玩法来了

WorkBuddy丝滑接入飞书,AI办公新玩法来了

有一说一,现在的AI办公产品真的非常卷,卷到大家都不清楚产品到底有哪些功能了。比如我之前在团队里说WorkBuddy也可以配飞书时,有小伙伴的反应是:“WorkBuddy,飞书?你确定?!” 那今天就讲解下如何用WorkBuddy搭配飞书,以及用上飞书后还有哪些特别玩法。 配置流程非常丝滑。打开WorkBuddy连接器,搜索飞书,点击+号,出现首次使用弹窗提示,等一会儿会出现飞书创建应用界面,...

2026-09-10
刘慈欣坐镇AI科幻大赛,百万大奖寻找完整故事

刘慈欣坐镇AI科幻大赛,百万大奖寻找完整故事

初中时看《科幻世界》很痴迷,从《三体》到《逃出母宇宙》,想象力第一次被插上跨越星河的翅膀。这几年我试着用AI把脑海中的场景画出来、做成视频,也收获了不少关注。看到RunningHub与第十七届华语科幻星云奖联合发起全球AIGC长片创作大赛,内心某个角落被激活了。大赛9月8日启动报名,10月9日先导片提交截止,11月3日正式作品截止,约两个月创作时间。这是我一定要参与,也强力推荐给朋友的比赛。 奖...

2026-09-10
中国首部AI长剧导演:三年后99%影视内容都将用上AIGC

中国首部AI长剧导演:三年后99%影视内容都将用上AIGC

9月6日晚,导演李东珅在北京朝阳一文创园接受采访。他是国内首部AI长剧《后西游记》的导演。该剧共30集、每集约40分钟,画面和人物演绎均由AIGC完成,2026年8月31日在芒果TV上线并登陆湖南卫视黄金档。芒果超媒连续两个交易日“20CM”涨停,9月1日报收20.38元,两日市值增加约116.5亿元。 李东珅曾拍过《河西走廊》《中国》等纪录片,自称“国内拍历史类纪录片已是天花板”,但去年他感到...

2026-09-10
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部