算力像水电一样卖?智微智能Token工厂要把AI当商品批发

在WAIC 2026上,智微智能联合腾云智算、元川微发布Token工厂,号称将算力生产工厂化,按Token消耗量计费,首批已试运营。这相当于把AI推理能力当作水电一样按需供应,企业无需自建硬件,直接买“智能输出”。


图片来自 tech.china.com 的相关公开报道,展示产品、原型、使用场景或事件背景;具体信息以原始来源为准。 摄影/版权标识:tech.china.com。 来源:tech.china.com


AI算力太贵、太难用?智微智能在WAIC 2026上扔出一个新玩法:Token工厂。它不卖服务器,不租机柜,而是直接卖“智能”——按Token消耗量计费,像水电一样即开即用。首批已试运营,适配GLM5.2、DeepSeek V4 Pro等大模型,面向企业级用户开放。这可能是AI基础设施从“卖铲子”转向“卖水”的一个信号。

目前能确认到哪一步
announced:智微智能在WAIC 2026上联合腾云智算、元川微发布Token工厂,并宣布已正式开启试运营,首批面向企业级用户。该服务深度适配GLM5.2、DeepSeek V4 Pro等主流旗舰大模型。目前处于试运营阶段,尚未公布全面商用时间表及具体定价。


Token工厂是什么?把算力变成“自来水”
智微智能在WAIC 2026上联合腾云智算、元川微发布了Token工厂,号称要“让算力像水电一样触手可及”。它不是一个硬件产品,而是一套服务:企业不用再买昂贵的GPU服务器,也不用操心机房运维,直接按Token消耗量付费,就能获得AI推理能力。首批已适配GLM5.2、DeepSeek V4 Pro等主流大模型,主要面向企业Agent开发和批量推理场景。

这套模式彻底颠覆了传统硬件售卖和机柜带宽计费。智微智能的说法是,Token工厂从算力硬件和数据投入开始,经过模型训练、部署,再到实时Token生产,最后通过监控反馈优化,形成闭环。客户拿到的不是机器,而是“智能输出”——包括API调用、代码生成、多模态AIGC等,用量透明,按需计费。


图片来自 tech.china.com 的相关公开报道,展示产品、原型、使用场景或事件背景;具体信息以原始来源为准。 摄影/版权标识:tech.china.com。 来源:tech.china.com


现场还秀了哪些硬核装备?
除了Token工厂,智微智能在WAIC现场还摆出了六大全栈算力矩阵,覆盖从边缘到超大规模训练的场景。其中一款7U 8卡GPU服务器SYS-80715E-G8,支持8个PCIe 5.0 x16插槽和32个DDR5内存插槽,专为大模型训练和科学计算设计。另一款T5双卡液冷工作站则采用全液冷散热,主打静音稳定,适合专业渲染和AI开发。

这些硬件是Token工厂的“原料”基础,但智微智能显然不想只当硬件商。他们强调“硬件+智能”双轮驱动,Token工厂才是这次的主角。不过,这些服务器和工作站目前仍是传统销售模式,与Token工厂的按需计费服务并行存在。


图片来自 k.sina.com.cn 的相关公开报道,展示产品、原型、使用场景或事件背景;具体信息以原始来源为准。 摄影/版权标识:k.sina.com.cn。 来源:k.sina.com.cn



图片来自 k.sina.com.cn 的相关公开报道,展示产品、原型、使用场景或事件背景;具体信息以原始来源为准。 摄影/版权标识:k.sina.com.cn。 来源:k.sina.com.cn


算力批发,真的能成吗?
Token工厂的野心很大:把算力变成像水电一样的公共事业。但现实是,AI推理的延迟、吞吐量、模型兼容性等问题,远比水电复杂。智微智能声称通过全栈软硬件协同优化,能提供“极致吞吐量、超低时延”,但首批仅面向企业级用户,且未公布具体性能数据和定价。媒体观察认为,这更像是一次商业模式试验。

值得注意的是,在WAIC同期,润建股份也发布了五象云谷Token工厂润蟾平台,并启动了Token工厂产业标准建设。智微智能的Token工厂能否成为行业标准,还需看实际落地效果。目前它仍处于试运营阶段,普通用户暂时还无法体验。

资料线索
tech.china.com
finance.eastmoney.com
k.sina.com.cn

本文是基于公开页面整理的 AI 硬件情报,不是本站实测或购买建议。图片发布副本增加 waoo.ai 水印,原摄影者和来源标识保留。
0
一起维护这篇内容

发现链接失效、信息过时或内容有误,可以提交更新建议。

我要更新

交流讨论

最新评论

返回顶部