7月17日,星环科技在上海世界人工智能大会(WAIC)上发布GPU原生认知数据库预览版,该产品将数据库完整功能迁移至GPU运行,试图重构数据库底层计算架构。
星环科技创始人孙元浩称,星环科技是目前全球唯一将完整数据库功能在GPU上运行的公司,领先国际竞争对手一代。据他介绍,在TPC-DS基准测试中,该产品使用多卡GPU可在数秒内完成1TB数据集的99个复杂查询,而传统CPU方案需要数十秒至数百秒。
孙元浩表示,该产品研发周期约一年半,预览版发布后已开放客户测试申请,正式版预计今年年底前上线。
此次产品发布的背景是,企业级AI应用正从大模型问答向AI Agent方向演进。孙元浩表示,AI Agent在执行任务过程中会持续调用数据、检索知识,单次任务可能发起数百次数据访问。传统CPU数据库在面对高并发Agent负载时,计算核心和内存带宽不足,且数据在CPU与GPU之间搬运带来的时延问题突出。
一位数据库行业人士表示,将完整数据库功能迁移至GPU在工程上难度极高,涉及存储引擎、查询优化器、事务管理等模块的全面重写。
GPU拥有万级并行计算单元和数TB/s级高带宽显存。星环科技的方案是将数据库整体迁移至GPU运行,使数据分析计算与模型推理在同一显存内完成,避免跨芯片数据搬运。孙元浩称,这一架构改变了对传统CPU-GPU 1:1配比的需求,GPU空闲算力也可被充分利用。
除计算架构变化外,新产品还将知识检索、上下文供给与长期记忆管理纳入同一数据库底座。孙元浩将其定义为“认知数据库”,称其不只记录结构化数据,还能理解文档内容、自动建立关联。据其介绍,该系统记忆准确率超过90%,在BEAM 500K和LongMemEval-S基准测试中超过主流开源记忆系统。
在GPU加速数据库领域,Snowflake和Databricks均在探索相关技术路径。孙元浩评价称,国际公司的尝试时间更长,但仅实现局部加速,加速比平均约1.5倍,GPU比CPU贵两三倍,1.5倍的加速没有经济性。
从客户侧看,孙元浩表示,对GPU原生数据库反馈最积极的行业包括金融、制造、零售和交通。在本次WAIC展会上,星环科技展示了浦发银行、天津能源投资集团等客户的案例。以信贷全链路分析为例,面对4.8亿条明细数据,GPU原生数据库实现了特定场景下449倍的性能提升;在智能投研场景中,性能提升覆盖30倍至5881倍。
不过,性能数据能否转化为商业收入仍存不确定性。星环科技近年财报显示公司尚未盈利,企业级基础软件的拓展受限于客户预算周期。GPU原生数据库的定价策略、与现有产品的兼容迁移方案、以及从试用到采购的转化率,将决定该产品能否成为新的增长点。
在产品矩阵方面,星环科技同时展示了大模型运营平台Sophon LLMOps、智能体开发平台AgentBox、智能数据平台XClaw和数据治理平台Astro,覆盖从语料治理到智能办公的链路。但孙元浩强调,公司核心仍是数据基础软件,数据库和大数据平台是主业。
谈及算力成本,孙元浩认为,尽管Token单价在下降,但企业实际使用中的总成本仍然高昂,他判断,未来两三年硬件将有革命性变化,软件层面也在重构,必须通过软硬件联合创新持续降低推理成本,企业才能大规模用得起AI。
相关文章
2026-07-210阅读
2026-07-210阅读
2026-07-210阅读
2026-07-210阅读
2026-07-210阅读
2026-07-210阅读
2026-07-210阅读
2026-07-210阅读
2026-07-210阅读
2026-07-210阅读