智能体一干活就要查几百次数据:星环把整套数据库搬上 GPU
星环科技在 WAIC 2026 发布 GPU 原生认知数据库预览版,尝试把 SQL 分析、知识检索、文档解析、上下文和长期记忆放进一套以 GPU 为中心的数据底座。产品已开放客户测试申请,正式版计划于今年年底前推出;现有性能数字主要来自厂商测试,价格、迁移方式和独立基准仍待公开。
聊天机器人回答一次问题,通常只查一两轮资料;真正执行任务的智能体却可能不断分析、调用工具、检查结果、再重新查询。一个任务反复访问数据几百次后,模型还没算完,数据库先可能变成等待最久的环节。
7月17日,星环科技在 WAIC 2026 发布 GPU 原生认知数据库预览版。它不只是给传统数据库加一块显卡,而是尝试把 SQL、文档解析、向量检索、知识库和长期记忆整体搬到 GPU 一侧,让数据处理和模型推理少在 CPU 与 GPU 之间来回倒腾。产品已经开放客户测试申请,但仍处于预览阶段。
智能体的问题不只在模型,还在它每一步都要等数据
企业里的智能体很少只回答一句话。它可能先查客户资料,再读合同和邮件,接着调用业务系统,发现条件不满足后重新检索。每一次循环都要访问表格、文档、向量索引或知识图谱,查询延迟会被连续放大。
传统架构通常由 GPU 跑模型、CPU 侧数据库查数据。结果需要在主机内存和显存之间传递,面对大量并发智能体时,数据搬运和 CPU 侧计算容易拖慢整条任务链。星环的方案是以 GPU 为中心重写数据库计算和访问架构,让 SQL 分析、文档处理、向量索引和知识召回尽量在同一侧运行。
这并不意味着所有企业都应该把现有数据库直接换掉。GPU 成本、事务能力、数据规模、现有系统兼容性和运维方式都会影响实际收益。对于一天只跑少量查询的业务,迁移整套架构未必比继续使用成熟 CPU 数据库更划算。
“认知”不是数据库突然会思考,而是把智能体需要的几类数据放到一起
星环把产品拆成 SQL 数据库、知识库、记忆与上下文系统三部分,底层统一管理表格、文档、图片、音视频、向量和图等数据。智能体可以同时做结构化分析、RAG 检索和跨会话记忆,不必为每种数据单独连接一套系统。
对普通使用者来说,这类基础设施不会直接出现在聊天窗口里。它真正影响的是等待时间和回答连续性:智能体能否更快找到企业内部依据,是否记得任务做到哪一步,以及多轮操作后会不会因为上下文断裂重新开始。
星环公开了多组加速和记忆基准数字,也在 WAIC 展示了金融等场景。不过这些数字主要来自厂商测试和现场演示,硬件配置、数据集、比较对象与真实业务负载并不完全相同。文章没有把最高倍数写成通用效果;是否更快、更省,仍需在相同条件下由客户或第三方复测。
预览版已经能申请测试,距离放心迁移还有几张答卷
据钛媒体报道,星环已开放客户测试申请,公司创始人孙元浩表示正式版预计在今年年底前上线。这是当前公开的产品计划,不是已经完成的交付承诺。官网也尚未公开统一价格、详细测试申请流程或完整兼容迁移清单。
接下来最值得关注的不是再刷新一个最高加速数字,而是三件事:旧数据库和数据工具怎样迁移;混合负载下事务、查询和智能体记忆能否长期稳定;在 GPU 采购、电费和运维都计入后,单次任务的总成本是否真的下降。
如果这些问题能在正式版、公开文档和客户测试中逐步回答,数据库可能会从智能体背后的隐形等待环节,变成可以直接影响任务速度与成本的产品竞争点。现阶段更准确的说法仍是:星环把一条激进的 GPU 数据库路线做成了可申请测试的预览产品。
想继续了解
• 星环科技:GPU 原生认知数据库产品页
• 钛媒体:预览版、客户测试与正式版计划
• 新华财经:WAIC 现场发布与智能体数据负载
• 环球网:WAIC 现场演示与架构说明
• 智东西:产品架构、基准与云服务说明
• WAIC 2026:官方企业目录
一起维护这篇内容
我要更新 发现链接失效、信息过时或内容有误,可以提交更新建议。


交流讨论
最新评论