端侧AI成新战场,斑马智能要让汽车变身token工厂

端侧AI成新战场,斑马智能要让汽车变身token工厂

AI 资讯 来源:新闻/公众号 发布时间:2026-09-25 更新于 2026-09-25 预计阅读 6 分钟

2026云栖大会上,Agent Native成为AI新主流叙事,产业焦点从云侧AI基础设施转向端侧。千问发布Qwen Intelligence进入AI手机,AI眼镜、耳夹式耳机、录音硬件、原生桌面终端同期亮相。斑马智能首席产品官蔡明表示,车对AI尤其是Agent的诉求更迫切,将成为AI体验最好的具身智能终端。

杭州国际博览中心举办“原生智能·端上生长——Agentic AI重构下一代终端”论坛,场外停放八辆来自腾势、神行者、红旗、智己、MG等品牌的车辆,其中一辆为首款搭载高通骁龙8397平台与斑马智能AutoOmni的量产车,其智能座舱模型跑在车规芯片上而非云端。AutoOmni是面向智能终端的全模态端侧大模型系列,本次大会推出新一代主力型号AutoOmni 2.0-23B-A3B。

智能终端变成token工厂,这家公司要让AI真正被深度使用

工信部发布的《“人工智能+软件”专项行动实施方案》指出,支持软件企业与智能手机、智能家居、智能网联汽车等终端厂商联合创新,加速轻量化模型与终端软件融合部署。AI竞争胜负手正从云端模型能力转向端侧,即模型能否在有限内存、算力和网络条件下稳定安全完成任务。

中汽信息科技技术总监康凯发布《中国具身智能产业发展报告2026》,提出三个判断:具身智能已走过技术验证阶段,处于价值验证阶段;汽车产业与具身智能在感知、决策、执行底层逻辑上高度相似,汽车工业是具身智能落地工业场景的关键试金石;降本与商业化闭环将决定大规模应用。康凯强调,具身智能若不能在汽车行业大范围应用,就难以在工业领域真正铺开。斑马智能首席技术官司罗认为,智能汽车是具身智能最大的中试场和规模化压测平台。

智能终端变成token工厂,这家公司要让AI真正被深度使用

大模型上车第一阶段是模型题,关注模型与车的连接;第二阶段是系统工程题,要回答装进去后能否扛住内存、时延、越狱注入及欧洲认证审核。如今第一阶段成绩与第二阶段困境同时发生。

工信部数据显示,2026年上半年具备L2级组合驾驶辅助功能的乘用车新车渗透率达70.5%,具备NOA能力的车型装车率超三成。但多家行业调研显示,国内高阶智驾付费订阅与买断整体渗透率不足10%,多数自主品牌自研智驾付费激活率不足30%,20万元级以下走量家用车型付费率甚至低于2%。麦肯锡《2026中国汽车消费者洞察》显示,约八成受访者将城市NOA视为购车重要选项;罗兰贝格等调研显示,多数用户认为核心智驾与座舱基础功能应免费标配。斑马智能首席战略官邢悦认为,核心原因是行业尚未形成真正的超级智能体交互范式。

智能终端变成token工厂,这家公司要让AI真正被深度使用

座舱侧同样存在落差。斑马智能自2024年中启动全面AI转型至今,对主流车企服务覆盖率达68%,端侧智能与端模型应用市场份额为63%。但装机不等于使用。蔡明判断,AI上车不是终点,而是用户深度使用的起点。深度使用核心在于基于意图驱动、AI真正懂“我的世界”,需要端侧交互范式变革,以用户为中心的跨端上下文和记忆连通。AI上车大潮后第二阶段竞争发生在模型与硬件交界处,即端侧。

端侧约束不是尺寸,而是三堵墙:内存墙,车规级芯片运行内存远低于服务器且需共享,模型能否跑起来取决于权重能否驻留;时延墙,座舱交互容忍度以百毫秒计,云端往返网络抖动可能吃掉全部预算;并发墙,真实座舱多任务同时在线,模型需在多路任务下保持稳定。此外还有隐私与成本两项产业约束。司罗判断,车是重要半封闭场景,需保护隐私;Agent时代token消耗是持续性支出,全部由云端承担意味着车企要为每辆在用车支付长期账单。端模型价值在于释放车端芯片已付出的硬件价值,变成端上token工厂,降低传上云流量与云端token消耗。

司罗给出三个趋势判断:端AI随端侧算力与资源提升进入快速发展期,端上做的是差异化能力而非云端能力简单迁移;云侧AI从级联式小模型链路全面转向大模型驱动,端云一体架构从2026年开始出现并成为主流;舱驾融合加快落地,2026年以两个系统互相调用形态出现,之后走向模型层面融合。端侧价值在于做云端做不了的事:长聆听、长睁眼、善记忆,形成主动服务。当端侧承担感知、理解与执行完整闭环,就更接近一层基础设施。斑马智能谋求建设产业级甚至国家级端侧AI基础设施,把操作系统、端侧模型、执行框架、芯片推理与云上生态做成可量产整体。

内存墙使稀疏架构在端侧意义更大。云端MoE解决训练与推理经济性,端侧则决定模型能否放进芯片。总参数决定能力上限,激活参数决定单次推理内存与算力开销,二者解耦后端侧才有机会在有限物理资源上获得接近中大型模型能力。AutoOmni走此路线。司罗概括端模型竞争要素:基模是支柱,量化与部署是壁垒,系统是围栏,差异化场景是特色。工程指标上,斑马智能端侧方案可概括为多、快、好、省:8路以上多任务稳定并发,大模型推理提速5至6倍,99%以上量化保真度,运行内存占用减少50%。此前斑马端侧主力是4B稠密模型,AutoOmni-4B在

标签: AI 资讯 AI

更多推荐阅读

AI替你干活后,谁还为你成长买单?

AI替你干活后,谁还为你成长买单?

一个人还在学习的现场,工作却已经可以绕过他完成。 在机器人手术室里,主刀医生坐在控制台前操纵机械臂,年轻住院医师却可能只负责清除烟雾和积液,或坐在另一台控制台前观看。研究技术与工作的学者马特·贝恩用两年多时间观察发现:传统手术往往需要两个人、四只手,年轻医生参与其中也就有了练习机会;机器人让专家可以独自操作,学徒成了可选项。 这里的“可选”比“被替代”更值得深思。年轻医生没有被赶出手术室,仍能...

2026-09-25
实时世界模型PixVerse R2走红 用户可实时操控剧情走向

实时世界模型PixVerse R2走红 用户可实时操控剧情走向

从“看视频”到“操控世界”,一款实时世界模型近日在海外走红。9月22日上线当天,爱诗科技(AIsphere)最新发布的实时世界模型PixVerse R2登上X(Twitter)趋势榜第二。有海外网友认为,这标志着AI生成从“创作视频”转向“与AI世界互动”,不像是看视频,更像是身临其境。 在PixVerse R2创造的世界中,用户可以移动、说话、做出选择。每一个提示词、每一个动作,都会实时改变眼...

2026-09-25
高通骁龙新芯片为AI Agent重新设计

高通骁龙新芯片为AI Agent重新设计

北京时间9月23日,在2026骁龙峰会上,高通CEO安蒙正式介绍面向Agent时代的战略转型,并发布两款新一代旗舰手机SoC:第六代骁龙8超级至尊版与第六代骁龙8至尊版。两款芯片均采用台积电2nm制程,搭载自研Oryon CPU,8核配置,包括两颗最高5GHz的Prime核心和6颗最高4GHz的Performance核心,为业界首次将手机CPU主频提升至5GHz。高通首次在同一代骁龙8 Elite...

2026-09-25
DeepSeek梁文锋署名论文:沙盒如何开启RSI闭环

DeepSeek梁文锋署名论文:沙盒如何开启RSI闭环

DeepSeek联合清华大学发表论文《DeepSeek Elastic Compute(DSec): A Sandbox Infrastructure for Effective Agentic Training at Scale》,9月19日提交arXiv,编号2609.22978,作者超130人,梁文锋署名最后一位。 论文核心是公开DeepSeek训练Agent所用的沙盒平台DSec。训练A...

2026-09-25
昇腾超节点破三堵墙,十万亿大模型训推最优解

昇腾超节点破三堵墙,十万亿大模型训推最优解

2026年AI圈的关键词是“智能体”。AI从能聊到能干,推理需求指数级爆发,预计2030年全球每月Token消耗超120千万亿,暴涨24倍。顶级MoE模型参数量达十万亿级,训练压力同步增长。传统服务器难以应对,超节点成为行业公认的更优路径,可解决“存储墙”和“通信墙”,但真正商业化落地者很少。 昇腾950超节点在华为全联接大会2026期间正式上市,成为业界最大规模商用超节点,包括Atlas 95...

2026-09-25
代码生成提速后,软件交付瓶颈转向何处?

代码生成提速后,软件交付瓶颈转向何处?

2026年9月22日,阿里巴巴集团CEO吴泳铭在杭州云栖大会演讲中提出,机器正成为思考的主力,智能正成为规模化商品,未来机器思考总量将达人类1000倍以上。与技术底座演进同步,阿里研发方式加速向AI Native转变,Agent不再只用于生成代码,而是进入需求、开发、测试、发布和运维各环节。 9月23日,“智启原生 研见未来”阿里巴巴集团AI Native研发实践论坛在云栖大会举办。机器之心主编...

2026-09-25
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部