
星环科技 GPU 原生认知数据库(Transwarp Cognitive Database)以 GPU 为中心重构数据库计算架构,将 SQL 数据库、知识库与记忆系统融为一体,统一支撑数据分析、知识检索、可信上下文供给和持久化记忆;同时,星环科技将推出认知数据库云服务,通过 Data Factory 提供高性能数据与知识服务,通过 Token Factory 提升企业级 AI 推理效率,降低 AI 原生应用与 AI Agents 规模化落地的成本与门槛。
一、为什么数据库需要同时面向 GPU 与 AI Agents 重构?
为什么要用 GPU 重构数据库?
在传统 AI 架构中,GPU 主要承担模型推理,CPU 侧数据库和工具系统负责数据查询、复杂分析、文档处理与调用执行。
随着 AI Agents 进入高频、多轮、并发运行阶段,传统 CPU 通常仅具备数十至百级通用计算核心,内存带宽约为 100 — 400GB/s,有限的并行计算与数据吞吐能力,以及 CPU 内存与 GPU 显存之间频繁的数据搬运带来的时延,正在成为端到端响应链路中的关键瓶颈。

GPU 原生并非在传统数据库上叠加局部加速组件,而是以 GPU 为中心重构数据库的计算与数据访问架构,将 SQL 分析、文档解析、向量索引、知识召回等高并行计算交由 GPU 执行,使数据处理与模型推理在统一的 GPU 加速体系中协同运行。
同时,通过 GIDS(GPU-Initiated Direct Storage)等技术,由 GPU 直接发起存储访问,绕过 CPU 与主机内存,减少数据中转、内存拷贝和 I/O 等待,进一步缩短从数据读取、处理和检索到模型推理的端到端链路。
为什么要为 AI Agents 重构数据库?
传统数据库主要面向人工查询和业务系统,而 AI Agents 正在成为新的数据使用者。它们会在任务执行过程中持续访问数据、检索知识、调用工具,数据库也需要从一次性返回查询结果,转向持续支撑 Agent 分析、判断与行动。
首先,Agent 需要更快获得数据。数百个 Agent 并发运行,单个任务又可能连续发起数百次调用,任何一次查询或检索的等待,都会被放大为整体响应时延。
其次,Agent 需要的不只是一次查询结果,而是完整、可信的业务上下文。企业事实、文档知识、语义信息和关联关系分散在不同系统中,只有统一组织和协同检索,才能帮助 Agent 更准确地理解问题、形成判断。
最后,Agent 需要延续历史。用户偏好、任务进度、已有结论和交互记录需要被持续保存并准确召回,避免每次任务都从头开始,保障跨任务、跨会话的连续执行。
因此,面向 AI Agents,数据库不能只负责高性能存储和查询数据,还要进一步支撑知识组织、上下文供给与长期记忆,成为 Agent 持续分析、判断和执行的认知基础设施。
二、星环科技 GPU 原生认知数据库:围绕 AI Agents 设计的一体化认知底座
星环科技 GPU 原生认知数据库面向 AI Agents 工作负载设计,在统一底座上融合 SQL 分析、知识检索、记忆与上下文管理能力,为高性能在线分析、RAG 多模型混合检索、机器学习加速分析与会话上下文记忆提供统一支撑。

1、GPU 加速结构化数据 SQL 分析,不仅更快,而且更省
在 TPC-DS SF1000(1TB)测试中,星环科技 GPU 原生认知数据库完成完整 99 项查询任务,性能达到开源 CPU 数据库(DuckDB)的 70 倍;数据加载、Power 测试、吞吐测试与数据维护等环节均获得数十倍至百倍级提升。更高的计算性能意味着,面对数百个 AI Agents 并发调用和复杂任务中的连续数据访问,数据库可以更快完成分析与检索,减少 Agent 等待数据的时间,提升整体响应和任务执行效率。
与 Snowflake、Databricks 不同规格配置对比,性能最高提升 66 倍,性价比最高提升 14 倍。当同等任务能够以更短时间、更少计算资源完成,更高的计算效率最终转化为更低的单位任务成本,让企业能够以更优的资源投入支撑更大规模的 Agent 应用。
2、GPU 加速文档处理与知识召回,让 AI 更快获得可信上下文
基于星环科技 COSMIC 文档解析服务,在 OmniDocBench 所覆盖的复杂文档上(1651 页 PDF,10 种文档类型,5 种布局,5 种语言,10 万条精细注释),文档解析性能提升 10 倍。GPU 向量索引进一步加速知识入库和召回,索引构建性能最高提升近 50 倍,检索吞吐最高提升 238 倍,让 RAG 与 AI 推理能够更快获得所需上下文。
在国产算力适配方面,认知数据库已完成海光 DCU 单卡与多卡优化,向量索引构建由天级缩短至分钟级,检索性能相比 CPU 最高提升 58 倍,并实现线性的多卡扩展。
3、显存利用率提升 20 倍,充分释放每一张 GPU 的效能
通过数据卸载和索引搜索优化,星环 GPU 索引可将大部分数据索引卸载至内存或 SSD,显存消耗降低至约 5%,实现 20 倍索引容量放大;即使将 95% 的计算相关数据卸载到内存或 SSD,搜索吞吐仍可达到传统 CPU 索引的 12 倍。系统支持全显存、内存卸载和 SSD 卸载三种模式热切换。
支持全显存、内存卸载和 SSD 卸载三种搜索模式热切换,可根据数据规模、性能要求与成本预算灵活调整资源配置,在保障业务响应效率的同时,提高 GPU 资源利用率,降低大规模数据检索的基础设施成本。
4、记忆能力双冠军,让 AI Agents 越用越懂业务
星环科技认知数据库在 BEAM 500K 长程情景记忆与 LongMemEval-S 长对话记忆两项基准测试中整体准确率分别达到 79.6% 和 92.8%,均超过主流开源记忆系统。
在长程事件排序、知识更新和信息提取等关键能力上,为 AI Agents 持续学习业务上下文、更新认知并跨会话执行任务提供支撑。
5、自然语言驱动,贯通数据开发、治理、分析与报告生成
星环科技认知数据库将自然语言交互内生于数据底座,通过理解业务意图并自动编排数据任务,将用户需求直接转化为可执行的数据工作流,贯通数据开发、数据治理、查询分析与报告生成全过程。业务人员无需掌握复杂工具和专业语法,即可直接调用企业数据能力,显著缩短从需求提出到结果交付的周期。
三、真实场景验证,GPU 原生加速价值看得见
复杂企业知识问答:加速知识入库、检索与推理全链路,提升准确率
OfficeQA Pro 包含近百年美国财政部公报的近万页宏观经济文档、2600 万个数值、133 项复杂企业文档推理任务和 246 个复杂问题。
星环科技 GPU 原生认知数据库将包含 OCR 的文档解析与知识入库性能提升约 10 倍、数据检索性能提升约 20 倍、单题端到端 AI 推理性能提升约 6 倍,最终准确率达到 79.3%,超过业内领先大模型。
金融量化因子回测:更快验证策略与发现 Alpha 机会
智能投研涉及多源数据扫描、因子计算、历史回测、参数搜索和策略验证,往往需要反复执行大规模计算。在不同测试任务中,星环科技 GPU 原生认知数据库相较 CPU 方案最高实现 5881 倍性能提升。更短的因子计算、参数优化和历史回测周期,使研究人员能够在同一时间窗口内验证更多策略与假设,更快捕捉市场机会。
信贷全链路经营与风险分析:更快审批、更早识别风险变化
信贷业务分析需要贯通客户、授信、用信、还款及风险变化等全链路信息,并支持持续追问与多维钻取。星环科技 GPU 原生认知数据库加速资产质量分析、动态风险归因和信贷决策再分析,并支持持续追问与多维交互分析,在 4.8 亿条明细数据规模下,整体性能提升 449 倍,加速全链路数据分析,帮助客户更快看清业务全貌、定位风险变化并形成决策。
四、从 Data Factory 到 Token Factory,推出认知数据库云服务
此外,星环科技同步将推出认知数据库云服务,整体包括 Data Factory 与 Token Factory 两类服务,从数据与知识处理到模型推理,以低成本高性能提升企业 AI 运行效率。

Data Factory 面向企业数据与知识管理,以认知数据库即服务的方式,支撑 AI 数据与知识工程、数据治理、数据分析、知识检索和内容创作等场景。
可在同等成本下实现 10 倍以上性能提升,并支持 Snowflake、Databricks 等云数据库一键迁移,以及 S3 对象存储和本地文件接入,并通过统一接口支撑 BI 报表、AI Agents 与数据应用,帮助企业降低数据平台建设与迁移门槛。
Token Factory:以更高资源效率支撑企业级 AI 推理
Token Factory 提供计算资源调度、模型服务与 Token 服务,面向 AI 编程、AI 办公和智能开发工具等 AI 原生应用。可实现输入吞吐提升 10 倍、输出吞吐提升 20% — 80%,以更高推理效率和更低运行成本支撑企业级 AI 应用规模化落地。
结语:面向 AI Agents,数据库正在进入新的范式
随着企业 AI 从大模型问答走向 AI Agents,数据基础设施承载的已不再只是数据存储与查询,而是持续的数据分析、知识召回、上下文供给与记忆管理。
面对高频、多轮、并发运行带来的性能、时延与成本挑战,数据库必须从传统的数据管理系统,演进为支撑 AI Agents 持续认知、判断与行动的新一代基础设施。
星环科技 GPU 原生认知数据库,以 GPU 原生架构重构数据处理方式,以知识与记忆能力重构数据服务方式,让数据分析更快、知识召回更准、上下文供给更及时,为企业构建可落地、可扩展、可持续演进的 AI Agents 提供坚实底座。GPU 原生,认知驱动,面向 AI Agents 的新一代 AI 数据库,已经到来。
GPU 原生,认知驱动。面向 AI Agents 的新一代 AI 数据库,已经到来。
注:文中性能及评测数据来自星环科技内部测试结果与公开基准,具体表现受软硬件配置、数据规模及测试方法影响。


登录后才可以发布评论哦
打开小程序可以发布评论哦