DeepSeek新模型全面超越,开发者为何不买账?

DeepSeek新模型全面超越,开发者为何不买账?

AI 资讯 来源:新闻/公众号 发布时间:2026-09-10 更新于 2026-09-10 预计阅读 6 分钟

崔添翼9月9日在X发推称,V4.1 Flash在性能、费用、速度和总用时上全面超过V4 Pro,因此V4.1 Flash上线后、V4.1 Pro上线前,所有发往V4 Pro的请求将路由到V4.1 Flash,按Flash价格计费。DeepSeek当天在开放平台发布公告,部分客户收到邮件,但距切换仅一天左右,没有新旧模型并行迁移期。不少开发者是在刷到浏览量超70万的推文后,才意识到调用的V4 Pro即将被替换。

内部和外部测试显示,V4.1 Flash已全面超过V4 Pro,新模型采用新结构,原生支持多模态,能力更强、速度更快、成本更低。从DeepSeek角度看,维持V4 Pro不划算:占用更多算力、推理更慢、价格更高、效果可能还不如Flash。将Pro流量转到Flash可释放算力、降低成本,用户也能少花钱。但这笔账用户并不买账。

V4.1 Flash全面超越,开发者为何还在喷 DeepSeek:缺的不是能力,是软件工程思维

评论区最先反对的是已将V4 Pro接入业务的开发者。有人直接回复“请不要这样做”。用户可接受旧模型退役并愿意按计划迁移,但平台不能在几乎没有缓冲时间下替用户切换。有网友建议新旧模型使用不同model ID,旧模型停服前至少预留两周缓冲期,让下游完成Prompt、QC和参数适配后再迁移。不同模型表现习惯和参数设置差异大,直接替换容易让稳定任务出问题。生产环境中的Prompt经过反复调试,摸清了模型脾气,换成V4.1 Flash后可能改变指令理解、回答长度、输出结构、拒答范围或工具调用顺序,少一个字段、多一段解释都可能让程序报错。

科研团队也表示,正在使用DeepSeek-V4-Pro-0813开展研究,一些论文尚未完成。旧模型撤掉后,后续实验无法沿用原条件,已有结果也难以复现。他们希望至少保留独立端点一段时间。有海外开发者讽刺:“你们真的需要接受一些正规的软件工程培训。”模型进入Agent和生产流程后,版本变化会影响整条任务链,明确版本号、提前通知并保留回退能力是软件工程基本要求。

V4.1 Flash全面超越,开发者为何还在喷 DeepSeek:缺的不是能力,是软件工程思维

争论前两天,崔添翼还发布消息称DeepSeek开放约150个资深后端和服务端工程师岗位,几乎都不参与模型训练,方向包括操作系统、虚拟化、网络、存储、调度、容器、控制平面和Agent弹性计算。对于以小团队和高人才密度著称的DeepSeek,一次放出约150个工程岗位规模不小,重点不是新模型,而是模型下面的系统工程。

用人重点是DSec,即DeepSeek Elastic Compute,为后训练和评估阶段执行Agent任务搭建的沙箱基础设施,单集群已能并发运行数十万个Agent环境。DSec通过同一套Python SDK提供四种选择:简单函数调用进入预热容器,持久环境用兼容Docker的容器,高隔离要求用Firecracker微型虚拟机,需要完整操作系统则用QEMU虚拟机。为避免每台主机复制完整镜像,DSec接入分布式文件系统3FS,按需加载数据,减少存储、网络和启动开销,并优化页缓存、内存回收和容器运行时,让单主机承载更多沙箱。

V4.1 Flash全面超越,开发者为何还在喷 DeepSeek:缺的不是能力,是软件工程思维

DSec还要处理任务中断后的恢复。强化学习等后训练中大量Agent rollout同时运行,算力重新分配时部分任务可能中断。恢复不能简单重跑命令,因为有些命令已修改文件或环境。DSec使用全局有序轨迹日志,同时记录命令和执行结果,恢复后直接使用已保存结果,跳过完成步骤。随着数十万沙箱并发,调度、隔离和恢复都在给后台系统带来更大压力。

这些工程说明DeepSeek在基础设施层面有能力,也愿为规模化Agent负载投入资源。但工程能力被限定在“模型之下”,一旦涉及“模型之上”的用户契约,就退回研究团队思维:觉得新的更好就换。争议核心并非V4.1 Flash性能或价格,而是模型切换的决策权。开发者可接受退役和迁移,但难接受只提前一天通知、没有并行过渡、没有继续调用旧模型的入口。对To B业务而言,稳定性、可预期性和行为一致性往往比性能提升和价格下降更重要。

DeepSeek愿招150个后端工程师,说明清楚规模化Agent负载需要多少工程投入。同样值得投入的,是一套让用户安全迁移的工程流程:版本隔离、退役公告、过渡窗口、通知机制。这些不需要150个人,但需要同一种工程思维——把模型当成别人系统里的依赖项,而不是可随时替换的组件。若希望在模型迭代上保持激进节奏,DeepSeek至少需在沟通机制上补齐短板,否则每次仓促切换都会消耗用户信任,而信任流失远比一次模型下架更难挽回。

标签: AI 资讯 AI

更多推荐阅读

DeepSeek V4.1 Flash上线:552B MoE模型全面超越V4 Pro

DeepSeek V4.1 Flash上线:552B MoE模型全面超越V4 Pro

周四上午,DeepSeek V4.1 Flash 正式在网页、App 和 API 端全面上线。官方称其在性能、响应速度、效率等核心指标上全面超越 V4 Pro,采用新架构并原生支持多模态。 V4.1 Flash 是一款总参数 552B 的 MoE 模型,采用全新 Causal-Encoder-Decoder 架构,输入与输出采用非对称计算设计:输入侧仅激活 8B 参数,输出侧激活 16B 参数,...

2026-09-10
GPT-6与实时视频爆发,AI游戏互动内容迎新赛季

GPT-6与实时视频爆发,AI游戏互动内容迎新赛季

一周之内,大语言、图片、视频模型都迎来新赛季。OpenAI发布GPT-6 Astra,重点提升编码、数学、电脑与浏览器操作、多步骤工作流完成度,演示中包含游戏场景创建。社区随后涌现大量游戏创作和Blender 3D绘制,有人用HTML和Godot复刻《英雄联盟》《索尼克》,有人用Blender绘制3D版颐和园。9月8日,OpenAI发布GPT-image-2.5,生成延迟最多降低50%,参考图一致...

2026-09-10
GPT-6 Astra限时免费开放,今晚11点截止

GPT-6 Astra限时免费开放,今晚11点截止

速速体验,还有9个小时。 智东西9月10日报道,昨夜,AI大模型评测平台Arena宣布,用户可以在Arena直接模式中免费使用 GPT-6 Astra,时间截止到今晚11点。 值得注意的是,官方声明了仅可以使用GPT-6 Astra的medium级别,而且必须在直接模式中体验,使用额度方面没有明确限制。 消息一出,大量网友涌入Arena,有网友使用GPT-6 Astra开发了一款沙滩滑板游戏...

2026-09-10
WorkBuddy丝滑接入飞书,AI办公新玩法来了

WorkBuddy丝滑接入飞书,AI办公新玩法来了

有一说一,现在的AI办公产品真的非常卷,卷到大家都不清楚产品到底有哪些功能了。比如我之前在团队里说WorkBuddy也可以配飞书时,有小伙伴的反应是:“WorkBuddy,飞书?你确定?!” 那今天就讲解下如何用WorkBuddy搭配飞书,以及用上飞书后还有哪些特别玩法。 配置流程非常丝滑。打开WorkBuddy连接器,搜索飞书,点击+号,出现首次使用弹窗提示,等一会儿会出现飞书创建应用界面,...

2026-09-10
刘慈欣坐镇AI科幻大赛,百万大奖寻找完整故事

刘慈欣坐镇AI科幻大赛,百万大奖寻找完整故事

初中时看《科幻世界》很痴迷,从《三体》到《逃出母宇宙》,想象力第一次被插上跨越星河的翅膀。这几年我试着用AI把脑海中的场景画出来、做成视频,也收获了不少关注。看到RunningHub与第十七届华语科幻星云奖联合发起全球AIGC长片创作大赛,内心某个角落被激活了。大赛9月8日启动报名,10月9日先导片提交截止,11月3日正式作品截止,约两个月创作时间。这是我一定要参与,也强力推荐给朋友的比赛。 奖...

2026-09-10
中国首部AI长剧导演:三年后99%影视内容都将用上AIGC

中国首部AI长剧导演:三年后99%影视内容都将用上AIGC

9月6日晚,导演李东珅在北京朝阳一文创园接受采访。他是国内首部AI长剧《后西游记》的导演。该剧共30集、每集约40分钟,画面和人物演绎均由AIGC完成,2026年8月31日在芒果TV上线并登陆湖南卫视黄金档。芒果超媒连续两个交易日“20CM”涨停,9月1日报收20.38元,两日市值增加约116.5亿元。 李东珅曾拍过《河西走廊》《中国》等纪录片,自称“国内拍历史类纪录片已是天花板”,但去年他感到...

2026-09-10
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部