WAIC 2026圆满收官|华瑞指数云携手大普微亮相,聚焦知力基础设施技术革新

原创cby****2026-07-22 17:54

  /传播易/2026世界人工智能大会(WAIC 2026)于7月17日-20日在上海盛大举办,本届大会以“智能伙伴 共创未来”为主题,汇聚全球千余家AI企业、数万行业从业者,集中展示AI应用、算力、大模型、AI基础设施全链条前沿成果,是观测全球AI产业技术迭代、产业落地趋势的核心平台。

  当下AI行业迎来关键拐点:头部大模型性能差距持续收窄,GPU算力走向标准化、商品化,单纯依靠算力、模型构建产品壁垒的时代已然落幕。行业普遍面临推理算力空转、KV Cache显存瓶颈、企业业务数据无法高效供给大模型、多套存储系统割裂运维等痛点,AI底层数据基础设施、上下文调度能力成为产业竞争全新热点。

  作为全球AI知力基础设施开创者,华瑞指数云(ExponTech)携手硬件生态伙伴大普微登陆WAIC 2026展台,完整展出全自研WiDE分布式引擎支撑的全系列AI存储产品矩阵,联合展示双方共同打造的岳磐AI原生数据一体机,并由联合创始人兼CTO曹羽中现场深度解读“知力”核心战略,围绕上下文之战、AI推理底层革新、存算协同落地路径带来前沿技术分享,吸引大量行业用户、智算中心、AI厂商等专业观众驻足交流。

  软硬协同标杆:岳磐

  本次展会华瑞指数云与大普微联合展出的岳磐AI原生数据一体机,是面向AI训练、大规模推理、企业RAG知识库、核心交易业务的一体化软硬融合解决方案,融合大普微全栈自研高性能企业级SSD硬件优势与华瑞指数云WQS AI原生KV Cache AI存储核心能力,一站式解决当前AI集群显存不足、KV Cache重复计算、多场景存储割裂、推理成本居高不下等难题。

  (岳磐一体机)

  1.

  岳磐一体机可将高频KV Cache数据从昂贵GPU HBM显存卸载至分布式SSD存储池,构建全局共享KV缓存资源池,实测可节省60%以上推理GPU硬件成本;在H20推理集群多轮对话压测中,30并发场景下Token吞吐提升4.2倍,60并发场景吞吐提升5倍,TTFT首包响应速度最高缩短89%,缓存命中率稳定维持97%以上,30-100并发规模无性能衰减,完美适配多轮对话、Agent智能体等高并发业务场景。

  2.

  依托底层WiDE统一架构,一套存储同时承载企业OLTP核心交易数据、海量非结构化业务文档、AI训练数据集、RAG向量知识库、推理KV缓存,无需跨系统迁移拷贝数据,消除数据孤岛,大幅降低运维复杂度与整体建设成本。

  3.

  原生兼容vLLM、SGLang、TRT-LLM、昇腾MindIE、寒武纪推理框架等国内外主流推理引擎,深度适配英伟达CMX分层缓存架构;集群支持EB级线性横向扩展,新增节点同步扩容容量与IO性能,端到端访问时延稳定控制在200μs以内,单节点带宽可达200Gbps,充分支撑智算中心、金融、医疗、电网等大规模生产落地。

  完整产品矩阵:

  展会现场,华瑞指数云完整展出基于全自研WiDE下一代分布式引擎打造的四大核心产品,覆盖企业通算、AI智算全场景,形成完整知力基础设施拼图,实现从生产业务数据到AI上下文记忆的全链路统一管理:

  1. WDS极速分布式块存储:面向数据库、虚拟化、容器核心业务,2023年曾打破SPC-1全球存储性能世界纪录,承载企业结构化交易数据,提供超高IOPS、稳定低时延访问能力。

  2. WFS分布式文件存储:聚焦AI训练、海量影像、数字资产场景,提供TB级超高吞吐,MLPerf Storage v2.0评测拿下多项全球第一,GPU集群加载、模型Checkpoint写入速度相较传统Lustre提升5倍,有效提升GPU利用率2倍。

  3. WADP AI原生统一数据平台:业内唯一横跨通算、智算双赛道一体化纯软平台,打通结构化、非结构化、向量数据统一存储,一站式支撑AI数据采集、清洗、训练、推理全流程管道,为RAG检索、企业知识库提供高速数据供给底座。

  4. WQS AI原生KV Cache存储:本次展会核心明星产品,专为上下文KV Cache设计的分布式KV存储,也是整套知力体系的核心载体。

  四大产品依托同一套WiDE底层引擎,实现统一元数据、统一运维、统一权限管控,支持全本地化部署与信创全栈适配,200余家政企、互联网、头部AI企业已在生产环境稳定落地,兼顾性能、安全与国产化适配需求。

  KV Cache

  本届WAIC上,WQS AI原生KV Cache存储成为焦点,凭借颠覆传统文件系统的底层架构,重新定义下一代AI推理知力基础设施,华瑞指数云联合创始人兼CTO曹羽中在现场面向参展观众阐释了公司核心战略——知力与知力基础设施。

  1. WQS作为知力基础设施的核心,通过底层架构革新,从根源解决推理算力浪费

  当前行业普遍采用分布式文件系统承载KV Cache,存在7层以上IO跳转、内核多次切换、随机小IO性能断崖下跌等缺陷,大量算力消耗在重复Prefill计算,整体资源利用率不足三成。

  WQS摒弃文件系统改造的行业捷径,基于WiDE引擎构建原生分布式KV引擎,采用用户态RDMA零拷贝传输,仅2跳IO直达存储内核,消除6层协议转换开销,端到端时延控制在200μs以内,相比传统方案延迟降低50倍;针对KV Cache典型16KB-10MB随机小块IO深度优化,可稳定跑满200-400GE高速网络带宽,搭配CacheBlend分片缓存复用技术,实现文档、段落、对话片段独立命中,生产环境缓存命中率最高可达98%。

  技术层面,WQS早在2025年11月完成与英伟达Bluefield-3 DPU、Spectrum-x网络软硬融合测试,完美适配英伟达2026年初发布的CMX五层存储分层架构中关键G3.5全局共享KV池,行业内实现产品落地早于标准发布,印证技术路线前瞻性。落地层面,依托WQS构建全局共享KV缓存池,推理集群Prefill与Decode配比可从传统3:1优化至1:3.同等硬件规模Token整体吞吐提升4-5倍,无需新增GPU即可大幅扩展推理服务能力。

  2. 核心战略:算力趋同,知力决定AI智力上限

  在现场技术分享中,曹羽中提出核心判断:当下AI行业算力、模型全面趋同,AI产品的核心竞争力不再是计算能力,而是“知力”。

  他表示,算力是一次性消耗资源,计算完成即遗忘,大量算力浪费在重复上下文预填充;而知力是承载企业全部上下文资产的核心能力,涵盖企业数十年沉淀的业务知识、内部资产数据等静态业务数据,以及Agent交互对话、中间推理结果等动态记忆,具备可积累、可复用的时间复利。

  所谓知力基础设施,就是一套能够对全量上下文完成统一存储、全局共享、毫秒级精准检索、高效输送至GPU的底层系统,打通数据通往模型的高速IO通道。算力决定AI运算速度,而知力决定AI能掌握多少业务背景、理解深度、思考准确度,直接划定AI智能能力的上限。

  Agent产品的能力天花板从来不在模型,而在上下文:缺乏完整知力体系的AI,如同每日失忆的天才,沟通成本无法沉淀;而依托知力基础设施,企业业务数据、对话记忆全局留存共享,形成不可复制、无法迁移的专属数据护城河,也是未来AI产业竞争的核心壁垒。

  生态共建,持续深耕知力基础设施,构筑存算协同产业新生态

  本次WAIC携手大普微推出岳磐一体机,是华瑞指数云开放硬件生态、推进AI存算深度协同的重要一步。未来公司将持续深化与英伟达、国产昇腾、寒武纪等算力厂商,大普微等硬件厂商、头部AI框架企业的全链路生态合作,打通芯片、服务器、存储、推理软件全栈适配,完善软硬一体化解决方案交付能力。

  面向产业长期发展,华瑞指数云将持续坚守全自研底层技术路线,围绕“知力基础设施”长期深耕,持续迭代WiDE分布式引擎、WQS全局KV缓存、WADP统一AI数据平台核心产品。依托国内全球规模领先的AI推理落地场景优势,持续探索上下文存储、全局知识共享底层技术,推动中国企业在AI底层存储赛道掌握技术话语权,摆脱跟随式发展。

  曹羽中表示,未来三到五年,AI产业竞争将全面转向上下文资产的运营效率,知力基础设施将成为智算中心、企业智能化转型的标配底座。华瑞指数云将持续以底层技术创新为核心,联合全产业链伙伴,共建算力、知力协同发展的AI产业新生态,为千行百业智能化落地提供自主可控、高性能、低成本的新一代数据基础设施支撑。


免责申明:网站文章均由网站用户自行通过本网站系统平台投稿编辑整理发布,仅供学习与参考,不代表本网站赞同其观点和对其真实性负责。如有侵犯您的版权,请联系我们,我们将及时删除。
《挑战奥美》作家:李刚 买卖广告我推荐传播易
大家都在找
在线客服咨询

电话咨询

微信咨询

热门推荐
热门精品,等你来挑
查看更多