九年沉淀,中科类脑把积累做成 Token 工厂
中科类脑推出算电词元一体化平台,以异构调度与电力协同为核心,目标是把每度电转化为更多高质量 Token。
中科类脑成立于 2016 年,2024 年正式把过去九年积累的算力调度能力与七年多的电力智能化业务合并到同一套系统中,并在 9 月的世界制造大会上推出「算电词元一体化平台」,对外定位为「算电协同型 Token 工厂」。公司合伙人、副总经理常峰将这套商业逻辑拆成两件事:效能决定每颗芯片、每度电能生产多少 Token,场景化决定这些 Token 能换来多大价值。
算力之上,交付 Token
中科类脑不打算做传统 IDC,也不只做云厂商那一层,而是把自己放在「Token 生产运营层」,对 Token 的生产效率、成本和任务结果负责。前台载体是 BitaHub 彼塔云平台,统一纳管英伟达、昇腾等不同架构的算力,聚合模型 API 和 Token 服务,并连通企业私有算力池与公共资源池。截至目前,平台已接入逾 3000 个算力节点,总规模超过 5000P,累计服务超 8 万企业及科研用户。
以平均 30 张、峰值 100 张芯片的需求为例,企业按日常负载自建,高峰缺口由平台补齐 70 张芯片,相当于获得一条可弹性扩缩的 Token 生产线。后台则是公司与中国科大团队联合研发的决策大脑,负责「电-算-Token」一体化系统从监控、预测到调度、运营的闭环运转。
1+3 架构:算力、Token 与电力同框调度
中科类脑 CTO 兼研究院院长丁海松将这套系统概括为「1+3」架构:一个博弈智能决策大脑,连接算力、Token 和电力三个子系统。其运行节奏分三步:先实时监控 Token 需求、集群负载、新能源出力、电价和每份算力的 Token 产出效率;再对未来 15 分钟到 1 小时以上的绿电出力、电价和任务需求做预测;最后由决策层调整三个子系统的运行方式,所有决策都以用户体验、结果质量和系统稳定性为边界。
异构芯片调度是这套系统的硬骨头。中科类脑为每类芯片配置一个「包工头式」插件,由调度层分发任务,插件负责指挥同类芯片,并给每张芯片建立能力画像,记录它擅长什么任务、和谁组合效率更高。在大模型推理环节,系统会把 Prefill 和 Decode 拆开:Prefill 计算密集,交给算力更强的芯片;Decode 依赖显存和带宽,交给大显存、高吞吐芯片;两阶段之间通过 KV Cache 迁移衔接,避免长上下文重算。
这套调度能力在一次跨上海、芜湖、乌鲁木齐的测试中接受检验:控制响应保持在 200 秒以内,跨域迁移成功率 100%,能耗预测精度 98%,也是全国首个跨三地算电协同智能调度测试。9 月 17 日,皖疆人工智能科技产业园在乌鲁木齐开园,首个突破千 P 的融合算力中心已建成投运。
Token 越便宜,系统级能力越值钱
国家数据局披露的数据是这一方向的背景板:我国日均 Token 调用量从 2024 年初的 1000 亿增至 2026 年 3 月的 140 万亿,两年增长超过千倍;与此同时,部分主流模型 API 累计降价超过 90%。通用 Token 的利润被迅速压薄,中科类脑给出的统一优化指标是「度电智能」,即每度电产出的有效 Token 数量,解法分三层:
- 第一层,算力与 Token 优化:通过异构调度与推理加速技术提升每度电产出的有效 Token 数量。
- 第二层,算电协同增益:在算力优化之上叠加电力协同,进一步压低单位 Token 成本。
- 第三层,场景结果计价:把通用 Token 组织成场景结果,按价值定价。
常峰判断,同样数量的 Token,用于普通对话和用于科研、能源等专业任务,客户愿意支付的价格可能完全不同。公司已在 AI4S 和能源两个领域形成可规模化的商业闭环,前者把读论文、实验设计、验证和论文生成串成完整工作流,后者依托多年央国企市场积累的行业数据和业务理解形成供给壁垒。
资本端,公司在 2025 年获中移基金独家 B 轮投资,2026 年由中车资本领投数亿元 B+ 轮,银杏谷、水木、启迪等跟投。常峰把 Token 工厂的终局比作「黑灯工厂」:算力智能体负责芯片适配、任务切分和 KV Cache 协同搬运,电力智能体负责电价预测、绿电出力预测和储能充放电,再由一个控制中枢统筹整座工厂。更远一步则是「算-电-芯-模」一体化,让芯片在设计阶段就服务于 Token 生产。
