成立九年,中科类脑把积累装进Token工厂

成立九年,中科类脑把积累装进Token工厂

AI 资讯 来源:新闻/公众号 发布时间:2026-09-24 更新于 2026-09-24 预计阅读 6 分钟

过去评价数据中心习惯看卡数、算力规模和PUE,大模型进入规模化推理阶段后,标准开始转向产出端:同样一批芯片、同样一度电,最终能生成多少满足质量、时延和稳定性要求的Token。芯片通电只代表生产开始,计算、存储、网络、模型部署和任务调度任一环节卡住,昂贵芯片仍可能低效空转。中科类脑瞄准的正是从资源到智能产出的转化过程,其体系称为“算电协同型Token工厂”,把异构芯片、模型、用户任务和电力放进同一套系统调度。对外落在BitaHub彼塔云平台,对内由决策大脑统筹电力、算力、Token三个子系统。

成立九年,中科类脑把积累装进Token工厂

中科类脑合伙人、副总经理常峰算了一笔账:一度工业用电采购价通常几毛钱,转化成算力后价值可达几十元,进一步形成Token后,部分模型每百万Token价格可超过百元。算力是生产设备,电力是原料,用户提示词和任务进入Token生产线,模型完成智能转换,调度系统决定任务何时、何地、用哪类芯片和模型运行,客户最终购买的是能完成任务、符合指标的Token服务。传统IDC交付机柜、电力、网络和空间,云厂商提供算力实例与模型接口,中科类脑再向上走一层,即Token生产运营层,对Token生产效率、成本和任务结果负责。常峰将其商业逻辑概括为效能和场景化,目前已在AI4S及能源领域形成可规模化的商业闭环。

成立九年,中科类脑把积累装进Token工厂

BitaHub统一纳管英伟达、昇腾等不同架构算力,聚合模型API和Token服务,连接企业私有算力池与公共资源池。以平均30张、峰值100张芯片的需求为例,企业按日常负载自建,高峰缺口由平台补齐70张,相当于获得弹性扩缩的Token生产线。截至目前,平台已接入逾3000个算力节点,总规模超过5000P,累计服务超8万企业及科研用户。后台是公司与中国科大团队联合研发的决策大脑,负责电算Token一体化系统从监控、预测到调度、运营的闭环。中科类脑的核心产品并非某一座机房、芯片或模型,而是跨域生产组织能力:在满足安全、时延和稳定性前提下,把分散算力与模型资源组合成可持续高质量交付的Token。

成立九年,中科类脑把积累装进Token工厂

其最核心技术落在AI系统软件层,将算力资源、芯片、模型、电价和任务纳入同一套决策系统,基于电力条件对算力、模型和任务柔性调度,概括为“1+3”架构:一个决策大脑连接算力、Token和电力三个子系统,先匹配算力、模型与任务,再把电力信号加入全局优化。CTO丁海松将节奏拆成三步:监控Token需求、集群负载、新能源发电功率、电价及每份算力Token产出效率;预测未来15分钟、1小时甚至更长时间内绿电出力、电价和任务需求变化;决策调整三个子系统运行方式,以用户体验、结果质量和系统稳定性为边界。调度核心是从算力任务中找出“柔性负荷”:对首Token时延敏感的实时任务留在原地,可排队、可断续的批处理任务转移到电价低谷时段异地运行。

异构芯片调度被常峰比作管理说不同语言的员工。中科类脑为每种芯片配置“包工头”式插件,调度层只分发任务,插件指挥同类芯片,并给每张芯片建立能力画像。系统还拆解推理流水线,把Prefill和Decode拆开,通过KV Cache迁移连接:Prefill计算密集交给算力更强芯片,Decode依赖显存和带宽交给大显存、高吞吐芯片。高端芯片不必包办整条推理链,新旧芯片、国产和海外芯片都能各司其职。长上下文任务中,KV Cache相当于模型已读内容的“工作记忆”,跨节点迁移可减少重算。训练作业跨集群调度还需同步检查点、优化器状态和数据进度,并控制任务中断时间。

这套系统在一次跨上海、芜湖和乌鲁木齐的调度测试中接受检验:控制响应保持在200秒以内,跨域迁移成功率100%,能耗预测精度98%。测试把异构适配、跨域迁移、长上下文KV跨节点协同、绿电预测和SLA约束放进同一条生产链联动,电力信号让任务按电网压力和绿电供给调整运行地点,还带来电力成本下降。这是全国首个跨三地算电协同智能调度测试。9月17日,皖疆人工智能科技产业园在乌鲁木齐开园,按“三中心一平台”布局,首个突破千P的融合算力中心已建成投运。

丁海松认为,核心壁垒是对算电Token一体化的运营能力和理解。算力、电力单看可能都在第一梯队,但真正壁垒是叠加后的系统级能力。异构调度、推理优化等算侧能力可追赶,绿电出力预测等电侧能力可补上,真正困难的是把两套技术语言、两批工程经验和两类运行数据装进同一系统,并长期稳定运行。中科类脑在世界制造大会上正式推出算电词元一体化平台,延续“1+3”架构,以博弈智能决策大脑为中枢,打通算力、Token、电力三大子系统,构建“电-算-Token”全链路闭环。常峰将Token工厂终局比作“黑灯工厂”:算力智能体负责芯片适配、任务切分和KV Cache协同搬运,电力智能体负责电价预测、绿电出力预测和储能充放电,控制中枢统筹整座工厂。更远则是算电芯模一体化,按模型

标签: AI 资讯 AI

更多推荐阅读

高中辍学生创AI独角兽,估值2370亿要IPO

高中辍学生创AI独角兽,估值2370亿要IPO

对Nscale来说,真正的考验可能才刚刚开始。近日,这家成立仅两年多的AI基础设施公司递交了上市申请,计划登陆纽约证券交易所,股票代码“NSCL”,总部位于伦敦。据《金融时报》,本次IPO目标估值最高约350亿美元。今年3月,Nscale刚完成20亿美元C轮融资,当时估值为146亿美元。 2026年上半年,Nscale实现营收1.406亿美元,同比增长1252%;但同期净亏损10.2亿美元。到8...

2026-09-24
商汤前骨干AI创业再获2亿融资,宁德时代曾押注

商汤前骨干AI创业再获2亿融资,宁德时代曾押注

据知情人士透露,上海AI能源科技公司达卯科技已完成约2亿元新一轮融资,具体投资方及估值暂未披露。这是其近一年内第二笔亿元级融资。此前,达卯科技在2022年A轮融资中获商汤科技、涌铧投资等支持;2025年9月完成近亿元A+轮融资,由宁德时代旗下溥泉资本领投;2026年7月,固德威进入其股东阵容。目前股东还包括宁德时代、商汤科技、寒武纪等产业链企业,其中寒武纪并非直接股东。 达卯科技成立于2021年...

2026-09-24
千问办公首款桌面机器人Eva实测曝光

千问办公首款桌面机器人Eva实测曝光

今年云栖大会首次将主会场从云栖小镇迁至杭州国际博览中心,展览面积超5万平方米,联合超1000家企业参展,去年为500多家。主会场算力提升3倍,真武V900芯片将于2027年Q1上线,下一代Qwen4已投入训练,参数规模将扩展至5到10万亿。 下午参加千问办公分论坛,发现其推出两款硬件产品:QwenNote A2和QwenNote A2 Eva。A2是轻薄随身助理智能设备,Eva是桌面AI Age...

2026-09-24
GPT-6缓存升级省78.5%,你的账单为何没打折?

GPT-6缓存升级省78.5%,你的账单为何没打折?

把一堆资料交给AI写报告、核对出处、做成PPT时,每追加一次要求,应用都可能再次把原始材料、任务说明和聊天历史交给模型。若旧内容未命中缓存,就需重新处理,反复消耗计算费用与等待时间。这正是OpenAI近期升级瞄准的问题。 9月22日,OpenAI公布GPT-6提示缓存升级,提高默认缓存命中率,并提供更细的监测、诊断和控制手段。按官方费率,同一段材料连续使用10次,若首次写入后后续9次全部命中缓存...

2026-09-24
前Scale AI产品负责人创立AI医保经纪Corridor,获2500万美元融资

前Scale AI产品负责人创立AI医保经纪Corridor,获2500万美元融资

Jackson Wagner于2022年7月离开Scale AI产品负责人一职后,如今正在AI健康福利领域创业。他创办的Corridor是一家AI健康福利经纪公司,专注服务中小企业。传统经纪公司往往忽视这类小型客户,因为小额账户佣金较低,但耗费时间与大客户相同。 Corridor押注AI解决方案能解决这一问题。在其平台上,客户与人工顾问合作,AI Agent在后台处理行政事务,如核实医生是否在保...

2026-09-24
AI视频告别炫技,虎鲸文娱押注下一代基础设施

AI视频告别炫技,虎鲸文娱押注下一代基础设施

AI生成逼真视频已不再新鲜,这种新鲜感的消退源于AI视频供给和消费的快速规模化。DataEye报告显示,2026年国内AI剧/漫剧市场规模同比增长138%,前5个月即达220亿元。 更深层的变化是,观众不再关心视频是否由AI生成,而更关心内容本身是否优质。虎鲸文娱分析发现,2025年第四季度用户讨论集中在“提示词”“技术”“真假”,到2026年第二季度则转向“剧情”“故事”“男主”“女主”。“一...

2026-09-24
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部