千问3.8 Flash实测:低价高性能,4090显卡可流畅运行

千问3.8 Flash实测:低价高性能,4090显卡可流畅运行

AI 测评 来源:新闻/公众号 发布时间:2026-08-31 更新于 2026-08-31 预计阅读 4 分钟

阿里近日发布并开源了Qwen 3.8 Flash-Next模型,凭借极具竞争力的价格和出色的性能,发布即登顶Huggingface榜单。这款模型采用125B MoE架构,每个Token仅激活约6B参数,原生支持262144 token上下文,并可通过YaRN扩展至1M token,被视为Qwen 4新架构的预演。相比Qwen 3.7 Plus,激活参数降至1/3,训练成本降至1/9,通用、数学推理、编程能力均有提升。价格方面,每百万Tokens输入0.8元,输出2.7元,缓存命中0.1元,最低仅为DeepSeek-V4-Flash的1/3。

实测表现:高效完成多场景任务

在实测中,Qwen 3.8 Flash-Next展现了惊人的效率。它能在不到2分钟内完成四种平台(小红书、微博、抖音、朋友圈)的相机产品文案改写,且风格与话题标签准确。另一项测试中,它于4分钟内将万字会议实录整理为总结、表格及通知邮件,结论与分工准确,并主动梳理未决事项。这种高效处理能力,让它在办公场景中极具实用性。目前,模型已在“千问办公”平台首发,API同步开放。

价格战升级:国产模型集体降价

同期,智谱也开源了GLM-5系列首个原生多模态模型GLM-5.3-Flash,性能比肩Claude Opus 4.8,价格仅为GLM-5.3的1/10,并推出两周半价活动,活动期内价格仅为GLM-5.3的1/20、Opus 4.8的1/40。两款模型均以低价冲击DeepSeek-V4-Flash,国产大模型价格战进一步加剧。

技术亮点与市场意义

Qwen 3.8 Flash-Next的MoE架构是其核心竞争力。125B总参数中仅激活6B,大幅降低了推理成本,使得在4090显卡上即可流畅运行,这为中小企业和个人开发者提供了低成本部署的可能。原生262K上下文支持,加上YaRN扩展至1M的能力,使其在处理长文档、复杂对话时游刃有余。训练成本降至1/9,意味着阿里在模型迭代上拥有更高的效率,为Qwen 4的推出铺平了道路。

从市场角度看,阿里和智谱的接连动作,标志着国产大模型正从“拼参数”转向“拼性价比”。低价策略不仅吸引了更多用户,也倒逼行业优化架构和训练效率。对于开发者而言,这意味着更低的试错成本和更快的应用落地。

结语

千问3.8 Flash-Next的发布,不仅是技术的一次跃升,更是市场策略的精准落子。它以低价和高性能重新定义了入门级大模型的标准,而GLM-5.3-Flash的跟进,则让这场价格战更加白热化。未来,随着更多国产模型的加入,大模型的应用门槛将进一步降低,惠及更广泛的用户群体。

标签: AI 测评 AI

更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速

世界模型专家刘宇加盟理想,机器人基座模型研发提速

理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。

2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启

AI办公赛道巨头混战,Agent创业窗口反而开启

2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。

2026-09-05
AI报告读着累?新指标用隐喻率量化可读性

AI报告读着累?新指标用隐喻率量化可读性

Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。

2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%

AI科学家K Pro上岗,全球最大药企研发提速70%

Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。

2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。

2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明

AI攻克费马大定理:Claude 11天写出1300万行证明

Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。

2026-09-05
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部