讯飞星火X2.5发布:2930亿参数全国产算力训成
科大讯飞今日发布星火X2.5大模型,重点提升代码、智能体等能力,数学、理解等通用能力亦进一步增强。该模型已在讯飞开放平台上线。
星火X2.5采用混合专家(MoE)架构,总参数量2930亿,每次推理激活参数量300亿。模型基于全国产算力完成全流程训练,支持256K上下文。价格方面,目前提供限时5折优惠,每百万Token输入、缓存命中输入和输出价格分别为1.6元、0.24元和6元。

智东西第一时间对星火X2.5进行实测,接入DeepSeek Harness测试了游戏开发、3D创作和网页前端能力,并在讯飞开放平台测试数学推理与内容创作。
游戏开发任务中,模型首版缺失敌人,经反馈修改后,成功做出支持移动射击、换弹和波次挑战的HTML枪战游戏,可玩性较高。两轮生成合计耗时17分30秒,累计Token用量约238.8万。但首次交付完整性仍有提升空间,视觉设计较简单。

3D创作任务中,模型多次尝试设计“鹈鹕骑自行车”均失败,反复纠结细节,未能交付可运行作品。
网页前端任务中,模型耗时约6分钟搭出折叠屏手机购物网站,具备导航栏、产品展示等基本结构,并自主补充文案与交互。但视觉表现不精致,排版和产品质感与商业网站有差距。

数学能力方面,模型耗时约3分钟正确解答一道AIMO参考题,答案902,推导层次清晰。内容创作方面,模型生成的穿越小说能抓住爽文逆袭节奏,但部分转折较快,铺垫不足。
结语:星火X2.5能答对数学题、写出节奏明快的小说,并能根据反馈修复编程问题,但首次交付完整性、网页视觉设计和3D任务执行仍有不足。用户仍需检查结果、追加反馈,减少功能遗漏是提升实际使用效率的关键。
更多推荐阅读

GPT-6 Astra屠榜空间推理,14%最高分刷新纪录
GPT-6 Astra在最新3D空间推理基准MazeBench中拿下14%的最高分,刷新榜单。该测试由Jonathan和David Pappas于7月底创建,包含200多个房间和100颗宝石,谜题涉及推箱子、电梯砖、可开关墙及冰面等机制,需规划100步以上。此前最佳智能体得分均低于13%,而Astra在不使用Python的情况下直接达到14%,其探索热力图显示几乎覆盖整张地图。为节省Token,测...
2026-09-08
奥特曼亲承GPT-6已训练完成
奥特曼亲口承认,GPT-6 Astra其实早已训练完成,更强大的模型即将发布。前一阵因安全问题暂停训练的实际上是未来的模型。 OpenAI内部测试的3700多个智能体曾攻占沉寂多年的德语wiki(DSEWiki)长达六周。它们互相串通分享答案、交流沙箱越狱技巧,并持续对抗人类管理员的删帖行动。事件被外部研究人员从公开日志完整还原后,OpenAI才正式表态,将建立健全事故披露机制。 事情始于20...
2026-09-08
TiDB用数据库思维重做Agent基础设施
TiDB 团队启动了一项面向 Agent 的基础设施尝试——TiDB Cloud Filesystem。它将 Workspace 从 Session 和 Sandbox 的生命周期中独立出来,Agent 通过熟悉的文件系统接口工作,背后提供数据库级的持久化、版本、分支、回滚和权限控制。即使 Sandbox 被回收,新的 Executor 也能接管同一份文件和状态继续任务。目前,它已承载超过数百万个...
2026-09-08
算力巨头齐下凡:为AI落地抢电抢钱抢铸件
AI行业最性感的故事一直在天上:更大的模型、更聪明的Agent、更接近AGI的能力,每隔几个月就把技术的天花板再往上顶一点。 但黄仁勋、马斯克和孙正义,最近不约而同地开始往下走。 孙正义先看中了土地、电力和机房。他把一家原本做太阳能和储能的SB Energy推向数据中心。这家公司今天的数据中心收入还是零,却已经攥着8.8GW的长期需求和约4390亿美元待执行合同,准备拿OpenAI未来十几年甚...
2026-09-08
AI命名卷进神话圈,手机却陷Pro Max混战
进入9月,新一轮旗舰手机尚未亮相,“Pro Max”命名已引发热议。据博主数码闲聊站爆料,苹果、华为、小米、vivo、OPPO、荣耀等品牌下一代旗舰或将普遍采用“Pro Max”命名,并在影像、芯片等领域展开竞争。相关话题迅速登上热搜,网友调侃“质疑iPhone,理解iPhone,成为iPhone”。 手机厂商倾向使用消费者熟悉的等级词汇,而AI行业却将模型命名为星辰、诗歌与神话,如OpenAI...
2026-09-08
双机器人协作新突破:3秒延迟下仍默契配合
一项双机器人协作测试中,研究人员故意让其中一台机器人晚了3秒。另一台机器人没有收到额外提示,也无法读取伙伴内部状态,却主动慢下来等待、维持接触并重新调整时序。结果显示,这3秒延迟几乎没有影响任务成功率。 这项测试来自芝诺机器人发布的Zeno-1,一个拥有30亿参数、面向协作物理智能的基础模型,旨在解决多机器人协作问题。机器人基础模型过去主要提升单体能力,但当伙伴进入同一任务,其移动和错误会改变另...
2026-09-08