阶跃Flash模型实测:110亿激活参数撑起高效智能体

阶跃Flash模型实测:110亿激活参数撑起高效智能体

AI 测评 来源:新闻/公众号 发布时间:2026-08-28 更新于 2026-08-29 预计阅读 3 分钟

阶跃Flash模型实测:110亿激活参数撑起高效智能体

近日,阶跃星辰发布Step 3.7 Flash模型。这是一款198B参数的稀疏MoE多模态模型,每token仅激活约11B参数,支持256K上下文,最高吞吐400 tokens/s,并可调低、中、高三档推理强度。实测中,它响应飞快,多模态感知与纠错能力结合良好,且在多轮交互中保持稳定输出,把Token消耗控制在很经济的水平。 这种经济性至关重要。企业使用AI的成本已可能超过雇佣员工成本:有客户未给Claude许可证设上限,一个月花掉5亿美元;米哈游测试AI Agent时,几十个Agent未及时关闭,一晚消耗约200万元Token。高效率Flash模型因此成为主流。这场成本压力正在重塑AI应用的选择逻辑。 Step 3.7 Flash正是这一趋势的代表。稀疏MoE架构意味着总参数达198B,但每次只激活约11B参数,相当于一个庞大的专家团队每次轮换少数专家上场,既保有知识广度,又大幅压缩单次计算开销。它还支持256K上下文,能处理长文档和复杂多轮任务;最高400 tokens/s的吞吐让Agent响应迅捷;开发者可调低、中、高三档推理强度,按需平衡速度与质量,三档设置让复杂任务用高强度、简单任务用低强度,灵活调配资源。 在多模态实测中,草图转电商看板任务里,模型准确识别手写文字和布局,生成高度还原的响应式页面,但开始遗漏“全部”选项;指示后能准确定位并修改,展现出视觉理解与按指令纠错的闭环能力。这种修正能力对Agent至关重要,因为真实工作流往往需要多轮反馈。 数据任务方面,模型结合联网分析,正确提取比亚迪产销快报关键数据,指出5月新能源汽车销量383453辆、产量380549辆,1-5月累计同比下降20.32%,当月产销回暖,出口占比41.9%。这意味着它能胜任信息抽取与初步分析,可直接用于情报整理和报表解读。 面对调音台照片,Step 3.7 Flash识别出NFM M系列,并按“查MUTE、调GAIN、推FADER、查AUX和主输出”的逻辑给出排查建议,显出专业迁移能力。不过,图片转互动地图时,它识别出7个地点,但地标对应不严谨、方位有偏差,空间推理仍有短板。这说明模型在视觉-空间对齐上还有改进余地,但在识别和逻辑推演上已具备实用价值。 总体而言,模型整体表现符合“更稳、更快、更省”的定位。本次实测消耗Token仅占套餐周额度15%左右,对Agent高频调用非常友好。它既能处理长上下文,又能在高频调用下控制成本,正是Agent规模化部署所需要的。高效益Flash模型让Agent能更稳、更快、更省地跑通工作流,推动AI从高成本玩具转变为工业级生产力工具。 Agent常态化作业的关口,正是成本与效率。Step 3.7 Flash用“少激活、高吞吐”的架构给出一个务实答案。随着模型持续迭代,曾被账单失控困住的Agent场景,有望迎来规模复用的拐点。

标签: AI 测评 AI

更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速

世界模型专家刘宇加盟理想,机器人基座模型研发提速

理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。

2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启

AI办公赛道巨头混战,Agent创业窗口反而开启

2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。

2026-09-05
AI报告读着累?新指标用隐喻率量化可读性

AI报告读着累?新指标用隐喻率量化可读性

Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。

2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%

AI科学家K Pro上岗,全球最大药企研发提速70%

Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。

2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。

2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明

AI攻克费马大定理:Claude 11天写出1300万行证明

Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。

2026-09-05
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部