中国电信通用Agent杀入IDC实测前三

中国电信通用Agent杀入IDC实测前三

AI 资讯 来源:新闻/公众号 发布时间:2026-09-18 更新于 2026-09-18 预计阅读 4 分钟

IDC发布国内首份《中国企业级通用Agent产品技术评估》,中国电信TeleAgent进入前三。此次评估未采用大模型Benchmark,而是用近百道非公开任务考察Agent在真实办公环境中的端到端执行能力。TeleAgent常规任务得分3.49分、复杂任务3.36分,九项能力中任务表现获满分,成本效率为评测最高分。该产品今年4月内部试用,7月推出V1.0,一个多月用户规模已接近120万。

央企做了个通用Agent,直接杀进IDC实测前三!

IDC定义企业级通用Agent需理解目标、调用工具与Skill、连接企业知识和业务系统并持续执行任务。测试任务涵盖邮件、日程、文档处理,以及长上下文、多步骤循环、复杂PPT、表格处理和浏览器操作等,部分任务接近真实工作,如处理3755行脏数据、从约3万字材料提炼生成11页PPT。IDC还会核验系统状态和最终文件。结果显示,多数Agent能跑复杂任务,但任务变长后交付质量和资源消耗差距放大。TeleAgent任务表现满分且成本效率最高,说明底层模型已难解释全部差距,关键越来越取决于模型外围的工程系统。

央企做了个通用Agent,直接杀进IDC实测前三!

IDC报告提到Agent Harness,即围绕大模型搭建的执行系统,负责上下文安排、工具调度、任务状态保存、执行环境控制、异常处理与结果检查。TeleAgent高分项可沿此拆解:上下文方面,系统对旧工具输出轻量剪枝,过长时由压缩模型处理,并实时监测窗口,接近上限先压缩再继续,上下文窗口已突破400K;同时加入autoDream长期记忆,定期整理对话并合并信息,保留项目背景、用户习惯和偏好,实现跨会话延续。

央企做了个通用Agent,直接杀进IDC实测前三!

底层上,TeleAgent未直接套用现成Coding Agent框架,核心内核含约3万行自研Go代码,并处理Windows PowerShell、麒麟、统信等兼容性问题,产品侧针对办公任务重新适配。成本方面,ModelRouter根据模态、长度、关键词判断任务复杂度,分配轻量、均衡、旗舰三档模型,翻译、总结等用轻量模型,PPT、文档生成等用均衡档,深度研究、代码调试等调用旗舰模型。智能路由可降低推理成本约40%,简单任务响应3-5秒,路由延迟低于10ms,并加入PD分离、KV Cache和负载感知调度等优化。

安全方面,Skill进入系统前检查来源、病毒和漏洞,短期与长期记忆分别管理,文件读写限制在指定目录,高危命令被监控,代码和文件操作尽量隔离。TeleAgent因此成为首批通过中国信通院相关安全评测的智能体产品之一,在中国电信研究院内部安全评测通过率98.2%,与外部安全厂商联合的28个场景、336个测试用例通过率99.7%。今年4月桌面端内部试用后,又花两个月做安全测试和能力优化,7月正式推出。

中国电信对智能体投入已久。2024年底开始建设星辰智能体平台,2025年4月确定为集团智能体基础设施,同年8月推出星辰超级智能体网页版,此后接入Coding增强、Skill和桌面环境。2026年4月TeleAgent桌面端内部试用时,已积累一年多平台、技术和产品经验。中电信人工智能公司有1200多人,九成以上来自社会化招聘,平均年龄30岁出头,核心骨干有较大自主招聘和技术探索空间,早期产品不急于算收入,先求用户口碑。组织上集中资源决策,让熟悉电信业务和有互联网产品经验的人一线配合。中国电信内部大规模使用提供了真实试验环境,Skill广场已上架5.6万个技能,被添加近200万次,参与开发员工达2万人。

标签: AI 资讯 AI

更多推荐阅读

谷歌DeepMind成立AGI研究所,诺奖得主挂帅

谷歌DeepMind成立AGI研究所,诺奖得主挂帅

几周前,GPT-6 Astra横空出世,OpenAI首次官宣AGI实现。今天,谷歌DeepMind火速成立全新机构——DeepMind研究院(DMI),由Demis Hassabis、Shane Legg与James Manyika联手挂帅。以前的DeepMind只想搞出AGI,现在问题升级为:AGI真的来了以后,全人类到底拿什么接招? DMI专门研究“超级智能”对经济和社会的颠覆性影响,目标是...

2026-09-18
OpenAI前核心成员造出只会做选择题的大模型

OpenAI前核心成员造出只会做选择题的大模型

TypeSafe AI创始人Diogo Almeida曾是OpenAI核心成员,参与创造RLHF和InstructGPT,2024年初离职创业,两年后推出全新模型Jev。该模型只做一件事:高频决策。它无法聊天、写代码或生成文字,是纯粹的通用分类器。 开发者Marcel Pociot用Jev做了浏览器插件,过滤X上不想看的内容,如引战、加密货币、政治争论等。每条帖子Jev在后台判断是否命中分类,平...

2026-09-18
1300张卡击败GPT-6!前OpenAI副总裁造出材料大模型

1300张卡击败GPT-6!前OpenAI副总裁造出材料大模型

前OpenAI研究副总裁Liam Fedus在X上发布Periodic Labs首个模型Periodic Neon:仅用1300张H200,加上数月实验数据,在自研XRD分析基准上超过GPT-6 Astra。Neon约1T参数,在134道高难度X射线衍射分析题组成的FrontierXRD上成功率达55.3%,领先GPT-6 Astra和Claude Fable 5.1。Astra据传总参数数万亿、...

2026-09-18
国产AI存储刷新全球纪录,焱融全栈布局曝光

国产AI存储刷新全球纪录,焱融全栈布局曝光

智东西9月17日报道,9月1日,MLCommons发布MLPerf Storage v3.0基准测试榜单。焱融全闪AI存储F9000X在多项测试中拿下第一,验证其在极限AI训练负载下对高速网络带宽的高效利用能力。 随着AI从模型训练走向规模化推理,存储需处理的数据和任务持续增加。训练阶段要持续向GPU供给海量数据,并快速保存和恢复模型Checkpoint;推理阶段需管理不断膨胀的KV Cache...

2026-09-18
AI短片斩获威尼斯双奖,千万级创作大赛开启

AI短片斩获威尼斯双奖,千万级创作大赛开启

十天前,AI超创DiDi_OK的《网站》在2026年威尼斯Reply AI Film Festival上斩获评审大奖与观众选择奖双料大奖。该片从76个国家3100多部作品中脱颖而出,评委包括奥斯卡得主和《狮子王》联合导演。影片用十来分钟探讨“观看能否改变现实”,凭借画面与叙事功力成为本届唯一同时获得两项大奖的作品。这类会讲故事的AI创作者,正是当下AI行业最稀缺的人才。 今天,虎鲸文娱集团正式启...

2026-09-18
奥特曼曝后Astra模型已超越全球顶尖数学家

奥特曼曝后Astra模型已超越全球顶尖数学家

在和Salesforce CEO Marc Benioff的对谈中,奥特曼剧透了OpenAI内部模型的最新进展。他判断:“GPT-5.5的水平大概相当于一个普通的数学教授。GPT-5.6,大概能比肩全球排名前1%到2%的顶尖数学教授。”随后他曝出重磅消息:“在这个代号为Astra的模型之后,我们还有一个内部模型(Post-Astra)。它已经能够解决世界上最顶尖数学家都束手无策的难题。”OpenA...

2026-09-18
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部