纯血国产!4B模型越级打怪,杀入万亿赛道
科大讯飞旗下词元星火于9月1日在Hugging Face发布两款开源端侧模型星火X2.5-4B和1.7B。4B模型在多项评测中表现突出:τ³
-bench多轮工具调用得分30.4,MCP-Atlas协议测试54.6,BrowseComp自主搜索40.9,IFBench指令理解75.

0,在智能体与工具调用指标上实现越级表现。1.7B版本在MCP-Atlas同尺寸中得分最高(23.4)。两模型均基于全国产算力训练,兼容英伟
达、华为、海光等硬件平台。
端侧模型此前受限于“只会动嘴不会动手”,而星火X2.5通过压缩体积解决部署难题:4B模型BF16精度权重约8G
B,1.7B约3GB,4bit量化后可再减半。4B版本适用于笔记本及老旧业务系统,1.7B面向汽车座舱、智能家居等场景。
实测中,模型在断
网环境下完成两份八千字合同的比对,精准识别出“应当”改为“可以”的义务弱化、知识产权条款整段缺失、违约金比例不对等三处隐蔽改动,并输出风险分
级报告。数据处理方面,模型自主编写Python代码完成表格分析,揪出超审批上限4条、字段缺失3条、拆单嫌疑11条,以及周末报销、负数金额等异
常,全程无需人工干预。
技术层面,星火X2.5采用混合注意力机制,原生支持100万Token上下文,显存占用仅为传统全局注意力模型的四分之
一。后训练阶段使用多教师在线策略蒸馏(MOPD),通过大模型导师实时纠偏小模型操作路径,传授工具调用与问题解决能力,而非简单灌输知识。
该
模型瞄准信创替代市场。按国资委要求,2027年底前央企国企需完成信息化系统100%信创替换,党政PC替换需求达千万台量级。今年8月施行的《网
络数据安全风险评估办法》亦将AI大模型纳入动态安全评估,使本地化处理成为合规刚需。星火X2.5权重采用Apache-2.0协议,支持免费商用
与微调,兼容vLLM、Ollama等主流框架,已在Hugging Face、ModelScope、GitHub全面开源,MaaS平台同步上线
并限时免费。
更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速
理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。
2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启
2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。
2026-09-05
AI报告读着累?新指标用隐喻率量化可读性
Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。
2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%
Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。
2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿
Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。
2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明
Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。
2026-09-05