AI 服务器终于也想装“电表”了:九章云极在 WAIC 发布 AI 工厂
九章云极在 WAIC 2026 展示由训练工厂、Token 工厂和九章智算云 3.0 组成的 AI 工厂,尝试用 DCU 统一计算不同芯片的有效算力,再把模型服务按 Token 产出计量。产品已有官网入口,但“千倍降本”等宣传仍缺统一条件下的独立验证,用户更应关注实际单价、稳定性和任务总成本。
云服务器账单通常写着用了多少张卡、跑了多少小时,但真正做 AI 产品的人更关心另一件事:这些钱最后生成了多少可用 Token,完成了多少任务。不同型号的 GPU 和 NPU 混在一起后,单看“卡时”更难比较。
九章云极在 WAIC 2026 发布由训练工厂、Token 工厂和九章智算云 3.0 组成的“AI 工厂”。它想给算力增加一套类似电表的计量方式:先用 DCU 折算有效计算量,再把推理服务对应到 Token 产出,让开发和财务团队能从“买了多少卡”转向“这笔预算生产了多少智能调用”。
它先解决的不是模型能力,而是算力账单看不懂
大模型训练可以连续占用大量算力,推理业务却会随着访问高峰起伏。只按 GPU 型号和使用时长收费,不能直接说明不同芯片真正完成了多少有效计算,也很难让业务团队把成本对应到每次模型调用。
九章云极提出的 DCU 是一套自定义算力计量单位,官方定义为 312 TFLOPS 的有效计算持续一小时。平台尝试把不同芯片折算到同一尺度,再把推理侧与 Token 产量相连,用于队列调度、资源配额和账单管理。
这套单位不是行业统一货币。同一模型在不同精度、上下文长度、并发量和推理引擎下,Token 成本可能差很多。DCU 能否让不同供应商真正横向比较,还要看测量方法、折算规则和账单明细是否公开透明。
训练工厂管“怎么把模型练出来”,Token 工厂管“上线后怎么供得起”
九章云极把平台分成训练工厂和 Token 工厂。前者处理多机多卡训练、故障恢复和异构资源调度;后者面向模型部署、流量弹性和按量计费。训练低谷的资源可以转向推理,推理需求回落后再释放或重新分配。
WAIC 期间,界面新闻报道九章云极同时展示了九章智算云 3.0,并称平台已接入十余个智算中心,覆盖大模型训练与推理、具身智能和自动驾驶等业务。这个数字来自公司在发布期的披露,文章没有把接入数量等同于稳定客户数量或收入。
官网已经提供 AI 工厂产品页、体验入口和商务申请,但主要面向企业、科研机构和技术团队,不是普通用户注册后就能免费跑模型的消费级工具。最终价格、可选芯片、数据迁移和私有化条件,需要在具体合同或控制台里确认。
别先看“千倍降本”,先拿真实任务跑一遍账单
官网把高算力利用率、缓存复用、零拷贝、弹性调度和绿电协同组合成“千倍降本路径”。这是产品目标和厂商测算,不是所有客户都能直接获得的固定折扣。模型、硬件、任务长度和原有利用率不同,结果可能相差很大。
更实用的验证方式是选一个持续一周的真实任务,记录完成率、平均延迟、峰值扩容、故障恢复、Token 数量和含存储网络在内的总账单,再与现有云平台按相同条件比较。只有单位任务成本下降,才说明“电表”真的帮用户省了钱。
WAIC 这次发布的价值,是把 AI 基础设施竞争从“谁有更多卡”继续推向“谁能把每张卡的产出算清楚”。DCU 能否成为跨芯片、跨平台都认的计量方式,还要等更多公开规则、真实账单和第三方复测。
想继续了解
• 九章云极:WAIC 2026 AI 工厂预告
• 九章云极:AI 工厂产品页与体验入口
• 九章云极:九章智算云算力治理更新
• 界面新闻:WAIC 发布 AI 工厂与九章智算云 3.0
• WAIC 2026:官方企业目录
一起维护这篇内容
我要更新 发现链接失效、信息过时或内容有误,可以提交更新建议。


交流讨论
最新评论