是石科技在 WAIC 发布“拓元”:国产算力开始比谁能产出更多有效 Token
是石科技在 WAIC 2026 发布国产 Token 优化工厂“拓元(Vectron)”,把异构算力调度、推理优化和模型适配放进一套系统。它面向的不是普通聊天用户,而是需要在国产芯片和多种模型上稳定跑推理的企业团队。
买到算力不等于把算力用好。同一批硬件上,模型能否稳定响应、长上下文会不会拖慢、不同芯片能不能统一调度,都会直接影响每个 Token 的实际成本。
是石科技在 WAIC 2026 发布“拓元(Vectron)”,把这组问题包装成一座“国产 Token 优化工厂”。它做的不是训练一个新模型,而是尝试把硬件、推理框架、模型和集群调度连成一条可优化的生产线。
一套系统同时处理调度、算子、框架和模型适配
人民网与新华财经报道显示,拓元在本届 WAIC 正式发布,目标是在同等算力投入下产出更多有效 Token,并改善推理响应和长上下文运行。公开介绍把它拆成任务自适应、硬件专属算子、模型与推理框架优化、异构集群调度等层次。
这意味着它面向的不是只调用一个公网 API 的个人用户,而是已经拥有或租用多种算力、需要部署多个模型的企业。对这些团队来说,最麻烦的往往不是单卡跑通演示,而是把不同芯片、不同地域的资源持续纳管,并让业务在负载变化时仍保持稳定。
是石科技官网将公司定位在 HPC 与 AI 融合基础设施方向。拓元把原来分散在项目交付中的能力收束成产品,是这次 WAIC 发布最值得关注的变化。
“Token 工厂”正在把算力竞争从数量推向效率
本届 WAIC 上,多家厂商都用 Token 工厂、模型工厂或推理平台描述自己的方案。共同信号是:行业不再只展示有多少卡,而开始强调每份硬件能持续提供多少有效推理服务。
不过,公开报道中的兼容数量、吞吐规模和客户范围主要来自企业发布。它们能说明产品已经进入市场,但不能替代在具体模型、硬件、并发和延迟目标下的独立基准。采购团队仍需要用自己的任务和数据做对照测试。
尤其是异构集群,统一纳管只是第一步。故障恢复、版本升级、模型精度变化、数据隔离和成本归因,都会决定它最后是生产系统,还是一块好看的运营大屏。
用户真正需要比较的是每个任务的总成本
如果团队正在评估拓元,建议不要只看峰值 Token 数,而要记录完成同一业务任务的总时间、失败率、人工维护量和硬件占用。只有任务口径一致,优化前后的数字才有可比性。
后续值得继续追踪的是正式产品文档、支持矩阵、部署方式、计费模型以及可复现的第三方测试。这些信息补齐后,才能判断“Token 优化工厂”究竟能在哪些规模和场景下形成明确收益。
想继续了解
• 人民网:国产 Token 优化工厂在 WAIC 正式发布
• 新华财经:是石科技全球首发国产 Token 优化工厂
• 是石科技官方网站
• 量子位:拓元的产品与技术路径
• WAIC 2026 官方企业目录
一起维护这篇内容
我要更新 发现链接失效、信息过时或内容有误,可以提交更新建议。


交流讨论
最新评论