纯血国产!4B模型越级打怪,杀入万亿赛道

纯血国产!4B模型越级打怪,杀入万亿赛道

AI 资讯 来源:新闻/公众号 发布时间:2026-09-03 更新于 2026-09-03 预计阅读 2 分钟

科大讯飞旗下词元星火于9月1日在Hugging Face发布两款开源端侧模型星火X2.5-4B和1.7B。4B模型在多项评测中表现突出:τ³

-bench多轮工具调用得分30.4,MCP-Atlas协议测试54.6,BrowseComp自主搜索40.9,IFBench指令理解75.

纯血国产!4B模型越级打怪,杀入万亿赛道

0,在智能体与工具调用指标上实现越级表现。1.7B版本在MCP-Atlas同尺寸中得分最高(23.4)。两模型均基于全国产算力训练,兼容英伟

达、华为、海光等硬件平台。

端侧模型此前受限于“只会动嘴不会动手”,而星火X2.5通过压缩体积解决部署难题:4B模型BF16精度权重约8G

B,1.7B约3GB,4bit量化后可再减半。4B版本适用于笔记本及老旧业务系统,1.7B面向汽车座舱、智能家居等场景。

实测中,模型在断

网环境下完成两份八千字合同的比对,精准识别出“应当”改为“可以”的义务弱化、知识产权条款整段缺失、违约金比例不对等三处隐蔽改动,并输出风险分

级报告。数据处理方面,模型自主编写Python代码完成表格分析,揪出超审批上限4条、字段缺失3条、拆单嫌疑11条,以及周末报销、负数金额等异

常,全程无需人工干预。

技术层面,星火X2.5采用混合注意力机制,原生支持100万Token上下文,显存占用仅为传统全局注意力模型的四分之

一。后训练阶段使用多教师在线策略蒸馏(MOPD),通过大模型导师实时纠偏小模型操作路径,传授工具调用与问题解决能力,而非简单灌输知识。

模型瞄准信创替代市场。按国资委要求,2027年底前央企国企需完成信息化系统100%信创替换,党政PC替换需求达千万台量级。今年8月施行的《网

络数据安全风险评估办法》亦将AI大模型纳入动态安全评估,使本地化处理成为合规刚需。星火X2.5权重采用Apache-2.0协议,支持免费商用

与微调,兼容vLLM、Ollama等主流框架,已在Hugging Face、ModelScope、GitHub全面开源,MaaS平台同步上线

并限时免费。

标签: AI 资讯 AI

更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速

世界模型专家刘宇加盟理想,机器人基座模型研发提速

理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。

2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启

AI办公赛道巨头混战,Agent创业窗口反而开启

2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。

2026-09-05
AI报告读着累?新指标用隐喻率量化可读性

AI报告读着累?新指标用隐喻率量化可读性

Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。

2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%

AI科学家K Pro上岗,全球最大药企研发提速70%

Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。

2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。

2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明

AI攻克费马大定理:Claude 11天写出1300万行证明

Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。

2026-09-05
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部