翼华科技亮相 WAIC 2026:AI DPU 让每一个 Token 更便宜

2026年07月21日

首发培风图南 AI-DPU 技术路线,构建大模型推理“上下文记忆层”

7 月 17 日至 20 日,2026 世界人工智能大会暨人工智能全球治理高级别会议(WAIC 2026)在上海举行。作为国内领先的高性能网络及算力芯片企业,翼华科技携全系列自研图南智能网卡与全新“培风图南”AI-DPU 解决方案亮相展会,并在 WAIC CONNECT 产业对接论坛发表《重构缓存边界:AI DPU 让每一个 Token 更便宜》主题演讲,首次公开培风图南 AI-DPU 产品路线,为大模型推理降本提供了一条全新的算力互联路径。

WAIC 是全球人工智能领域规格最高、规模最大、影响力最广的行业盛会之一。本届大会以“智能伙伴 共创未来”为主题,由十部委与上海市人民政府共同主办,展览总面积首次突破 10 万平方米,1100 余家海内外企业带来 3000 余项创新产品,140 余场高端论坛汇聚 1400 余位国际嘉宾。能够在这一舞台上发布核心技术路线、与全球 AI 产业同台交流,是行业对翼华科技技术积累与产业价值的又一次认可。

01 主题演讲

重构缓存边界,让每一个 Token 更便宜

在 WAIC CONNECT 产业对接论坛上,公司联合创始人兼高级副总裁贾淑芸发表主题演讲,首次对外系统阐述培风图南 AI-DPU 的技术逻辑。

贾淑芸在演讲中谈到,当下的算力竞争早已不只是单卡性能的比拼——当大模型步入长上下文、多轮对话与多智能体阶段,真正的约束正从“算得够不够快”转向“记忆够不够省”。上下文越长,需要承载的 KV Cache 越大,一旦超出 GPU 显存,就只能在更远的存储层级之间反复搬运、重复计算,既拉长了延迟,也持续推高推理开销,“算力充足、记忆昂贵”由此成为 AI 规模化落地必须跨越的一道断层。

面对这道断层,翼华科技在本届 WAIC 发布全新产品:在 GPU 与底层存储之间,增设一层由“培风图南”AI-DPU 驱动的 Context Memory(上下文记忆层),由 DPU 承担KV 的组织与调度,把原本分散在各张卡上、用完即弃的临时 KV,沉淀为可跨请求、跨节点共享复用的统一资源,从源头压减重复计算。

围绕这一架构,我们在三个方向同步发力:

  • 极致降本:依托前缀 KV 跨请求复用与会话持久化,尽可能压减重复计算,使典型场景下 Decode 阶段的硬件成本与首 Token 延迟同步下降;

  • 高效卸载:把 KV 索引、RDMA 零拷贝、压缩加密、智能预取等一系列数据面工作从 CPU/GPU 上剥离、交由 AI-DPU 承接,让主计算资源专注推理本身、不被分散;

  • 开放生态:不绑定特定 GPU 厂商,也不要求更换现有网络,全面适配异构 GPU 与标准以太网,兼容 vLLM、SGLang 等主流推理框架,已有存量集群即可平滑、渐进地完成接入。

"算力决定模型能想多快,记忆决定模型能想多远,而成本决定这一切能否真正普惠。"

—— 贾淑芸,翼华科技联合创始人兼高级副总裁

贾淑芸表示,翼华科技愿做那个把“记忆”做便宜、让智能真正实现普惠的企业。围绕这一目标,我们已同步开放 POC 合作,邀请推理框架、存储伙伴与云厂商共同参与,一起把开放的 Context Memory 接口标准建起来。

02 展台直击

产品、平台、解决方案,同台亮相

本届展会上,我们集中呈现了图南 ED201 芯片与 TUNAN-7 系列智能网卡等公司核心产品、绝云可视化运维管理平台以及智算网络解决方案等多款产品与方案:


  • 图南 ED201 芯片与 TUNAN-7 系列智能网卡:已实现大规模商用,适配 AI 训练、分布式推理、高性能存储等三大场景,凭借高吞吐、P4 可编程可定制、硬件可信根启动与低功耗特性,获得客户广泛好评;

  • 绝云可视化运维管理平台与智算网络解决方案:同步展出,为算力中心提供从设计、集成到运维的全栈服务,核心解决当前数据中心网卡运维工具分散、批量操作效率低、故障定位慢的行业痛点;

  • 端到端智算建设能力:翼华科技具备从方案规划、机房勘验、系统设计、设备到货验收、现场施工,到算力集群实施、管理平台部署和系统联调交付的完整服务能力。无论是算力系统、网络系统、存储系统,还是安全系统、业务系统与运维平台,翼华科技均可提供端到端的规划、建设和交付支持。


03 四年深耕

以技术底气站上产业前沿

此次亮相 WAIC,背后是翼华科技在高性能网络与算力芯片领域近四年的持续深耕。公司在北京、上海、深圳、杭州、西安设有五大研发中心,研发人员占比超 70%,坚持“双芯驱动、全栈服务”,在 RDMA、RISC-V、P4 可编程等核心技术领域实现全栈自研。



5

大研发中心

70%+

研发人员占比

4

深耕高性能网络与算力芯片

成立仅四年,我们便实现了首款芯片的规模化商用,并先后斩获第二十届“中国芯”优秀技术创新产品奖、算力强基行动卓越产品、AI Cloud 典型案例等行业荣誉,作为工信部机间互联标准工作组牵头单位深度参与多项国家及行业标准编制。

从 WAIC 到更广阔的产业现场,翼华科技将持续深耕网络算力与“记忆”层,以 AI DPU 为抓手,联合产业链伙伴共建开放的 AI 推理缓存标准,让每一个 Token 更便宜,让智能真正普惠千行百业。