发布日期:2026-07-24 07:18 点击次数:139

7月18日下昼,由不雅察者网、WAIC CONNECT主持,半导体行业不雅察协办的“「重构算力」——AI算力需求与供给的结构性重构产业贯穿会”在上海张江科学礼堂举办。动作WAIC 2026同期的一场攻击产业活动,这场积贮了政府、产业方与需求方的闭门研讨,把见识聚焦到AI算力供需两头的深层结构性变化。
在主旨演讲嘉宾中,翼华科技(北京)股份有限公司连合创举东说念主兼高档副总裁贾淑芸的共享非常引东说念主关注。相较于场上被反复盘问的GPU、大模子与推理芯片,她所代表的DPU(数据处理单位)与智能网卡,是产业链条中一个更为“隐性”却越发关键的挨次。

算力集群不是“堆卡”,是“组网”
“当代AIDC其实依然是一个巨型机系统。”贾淑芸在接收不雅察者网专访时谨防强调了这少量。她把大型AI数据中心的问题归纳成三件事——“算、存、运”。
算,即是外界最为老到的GPU与推理芯片;存,对应显存、内存和闪存;而运,也即是通讯,恰是DPU与智能网卡所承担的部分。
大模子测验与推理从来不是一张卡的独角戏,而是无独有偶、以至数十万张卡的集体功课。每完成一步计较,卡与卡之间就需要一次乃至屡次数据交换。交换尚未完成,下一步就无法开工。也即是说,腾贵的算力在集群里有十分一部分时分其实是“在等网罗”。
DPU与智能网卡果真作念的事,是把网罗合同处理、RDMA通讯这些正本占用CPU、GPU的活贯串过来,为计较中枢提供一个自如、可臆想、可靠的通讯接口;再把网罗里的列队、丢包、重传抹平,不让任何一次尾部延时把所有这个词集群拖入恭候;同期把存储、安全等基础设施卸载下来,让大模子的记念系统不错快速检索,不“失忆”。
一朝缺了这一层,后果对贾淑芸而言是不问可知的:GPU期骗率上不去,万卡集群跑出五六千卡的有用算力,简直等于把一半的采购成本打了水漂;集群界限越大越不自如,一次长尾延时、一次网罗抖动,就可能让所有这个词测验任务中断回滚;CPU还会被网罗和存储合同栈吃掉多数核数,整机成本进一步恶化。她给出的论断是,算力集群从来不是“堆卡”,而是“组网”——网罗算力这一层,决定了买来的GPU算力最终能终了若干。
为什么是RISC-V
国内作念DPU的公司不少,但大多数采纳了ARM内核决议,翼华科技走的是自研RISC-V内核的路子,其首款基于自研RISC-V核的智能网卡依然流片并商用落地。这么一个相对特有的工夫旅途,背后是若何的考量?
贾淑芸对不雅察者网讲述,成本、生态、供应链安全,王人在衡量范围之内,但最根柢的原因是DPU这个品类与RISC-V的工夫特点自然契合。她证据,DPU本色上是一颗界限专用处理器,中枢任务是报文处理与存储、计较卸载,追求的是高带宽、低时延与能效比,而不是通用计较意旨上的大而全。RISC-V最大的上风就在于领导集不错活泼扩张——针对网罗报文处理、KV治理加快去定制领导与微架构,尤其是矢量扩张(Vector Extension)相当得当数据面与检索类责任,这在尺度ARM核授权形式下很难作念到。
翼华自研的RISC-V核援救RVA23轨范,具备多放射、乱序实施、浮点与矢量计较才气;SoC层面则采用了活泼的集群架构,CPU核与自研的网罗、安全加快引擎通过高带宽总线紧耦合,概况按客户对性能、功耗、面积的不同条目活泼确立。关于外界关心的生态短板,她也作念了分析——比拟x86和ARM,RISC-V生态如实还有差距,但对DPU来说“够用了”:GCC、LLVM用具链、Linux操作系统、DPDK等网罗开源软件的援救王人依然比较教育,翼华自己也在通过开源样式反哺RISC-V在网罗和存储标的的生态。
这条旅途对翼华的竞争力意味着什么?意味着性能优化的天花板从此掌持在我方手里;家具界说开脱了领导集授权的贬抑,不错奴才客户需求快速迭代;从领导集到核到SoC的全链路自主可控,在现时的产业环境下,对客户而言更是实实在在的价值。首款RISC-V智能网卡的流片与商用,也考证了这条路子走得通。
从“省”到“快”:图南系列的AI适配
DPU最初是云厂商的故事,主要惩处虚构化卸载、多佃农禁绝这类问题。但当AI大模子测验成为主角,网罗费解与时延的条目较之传统云计较依然逾越好几个量级。这么的需求切换,如何反过来界说DPU的家具筹算与交易形式?
贾淑芸的判断是“根人性的”变化。她把云期间DPU的中枢命题详细为一个字——“省”,把虚构化、多佃农禁绝、存储合同这些支出从CPU上卸下来,帮云厂商省出不错对外售售的CPU核数;而AI期间DPU的中枢命题则换成了“快”,测验集群对RDMA费解、时延和抖动的条目逾越数个量级,网罗性能径直决定了GPU期骗率,也径直决定了每一次测验任务的成本与成败。
这种变化传导到家具与交易两个层面。家具筹算上,重点从限度面卸载转向数据面性能:RDMA引擎要自研,拥塞限度算法要深度优化,大界限组网下的低时延低抖动要有保险,还要和接济系统、聚拢通讯库密致协同。交易形式上,客户也重新部云厂商的定制名堂扩张到智算中心、劳动器整机厂和行业客户,家具的尺度化和兼容性条目随之提高,国产化替代成为一个明确的增量市集。
翼华科技的“图南”系列智能网卡,恰是按照这一逻辑打造的。它基于翼华领有自主知识产权的芯片架构实现高费解线速转发,勾通自研的RDMA工夫面向智算场景大界限组网作念优化,同期保留P4可编程才气,让网罗、存储、安全、运维等千般负载王人不错活泼卸载,既得意AI测验推理对高性能网罗的严苛条目,也能隐秘云数据中心与旯旮计较的传统场景。RISC-V的通用处理才气则被用来实现流量的治理和接济。
在此基础上,翼华还洽商推出“培风图南”系列AI-DPU。借助RISC-V的通用处理才气与RVV向量处理才气,这条家具线将进一步实现KV Cache治理的卸载与加快,构建大模子的"记念层",裁汰推理当用的部署成本,同期提高推理速率。
客户到底为什么买单
英伟达BlueField系列早已大界限部署,国内DPU赛说念这几年也显袒露不少创业公司。翼华的图南系列既然依然商用,主要落地在哪些客户手中?
贾淑芸先容,图南系列SuperNIC现在的客户不错分红几类:智算中心的成立方与运营方,用它作念GPU集群的高性能参数面与存储面网罗;劳动器整机厂商,把智能网卡动作整机决议的尺度部件;云和旯旮计较客户,用于虚构化卸载和5G旯旮业务加快;此外皮运营商与部分行业客户侧也有名堂在激动。而洽商推出的培风图南系列,则将主要面向大模子应用公司和Token工场运营方,通过构建大模子记念层裁汰推理部署成本、同期提高长程任务的推感性能。
至于客户在采纳国产DPU时最垂青什么,她的谜底与外界的直观不太相通:自如性和兼容性排在第一位,价钱反而排在临了。原因并不难领路——网卡是7×24小时在线的部件,客户不会为了追求部分性能特点而烽火可用性,能否平滑接入现存的劳动器、交换机与软件栈,是商用的前提;其次才是性能,尤其是RDMA场景下的真实证据。“客户算的是总账,一张卡要是能把GPU期骗率提上来几个点,卡自己的价差不错忽略不计。”贾淑芸暗意,翼华的战术一直是肃穆定性和兼容性作念塌实,再谈性能起程点。
行业洗牌中的糊口公法
2021年、2022年,DPU一度是本钱追捧的风口,多数创业公司涌入。而后两年,赛说念较着参加削弱与整合期。动作一家2022年景立的公司,翼华科技如何看待这一轮洗牌?
贾淑芸对那段激越作念了深远领悟。觉得其中如实有泡沫的身分——本钱看到了BlueField的故事,团队簇拥而入,但许多公司低估了两件事:一方面,芯片的产业周期是硬贬抑,从流片到商用再到界限上量,莫得三五年下不来,烧钱速率远超预期;另一方面,DPU并不是一颗芯片的生意,而是一整套软硬件生态的生意,入手、合同栈以及与客户环境的适配责任,工程量以至比芯片自己还要大。这两年本钱落潮、行业整合,本色上是纪念知识。
翼华成立于2022年,恰好赶上激越的尾巴与极冷的起原。这么的时点,反而倒逼团队从第一天起就保持克制——不追求大而全的家具界说,聚焦智算这个真实需求场景;限度团队界限与研发节律,把资金花在流片和客户落地上。她提到,2022年也偶合是面向GPU互联的SuperNIC元年,翼华科技从起步阶段就锁定了SuperNIC与AI-DPU这两大后劲市集。
而在她给出的DPU公司糊口清单里,有几点尤为关键:芯片要果真流片、果真商用,而不是停留在PPT和FPGA原型阶段;要有付费客户、有可复制的场景,酿成正向的收入轮回;还要在英伟达和头部云厂商自研除外,找到我方不行替代的互异化位置——比如翼华科技采纳的RISC-V自研路子,以及为大模子构建记念层的AI-DPU旅途。行业洗牌无意是赖事,泡沫出清之后,留住来的公司会拿到更聚拢的资源和更明晰的市集。
国产智算的网罗答卷
产业最蔼然的宏不雅议题之一是国产智算能否实现果真的全栈自主。今天的智算中心,机内互联主要依赖NVLink,机间互联依赖InfiniBand,本色上仍是英伟达的禁闭生态。
在贾淑芸看来,这是最关键也最难攻克的一层。国产GPU单卡性能还在追逐,但要是互联问题不惩处,卡越多、集群恶果赔本越大,“全栈自主”就只然而一句空论。她给出的标的是怒放的以太网路子——用增强以太网加RDMA去对标乃至高出InfiniBand。这亦然巨匠产业的共鸣标的,超以太网(Ultra Ethernet)等新尺度的演进,本色上王人是要用怒放生态抗击禁闭体系。
要走通这条路,必须有三个层面的复旧:高性能的国产网卡与DPU芯片,把RDMA、拥塞限度这些中枢才气果真作念到自主;国产交换机与国产GPU的端网协同,一张好网卡还不够,所有这个词链路要全部调优;怒放的尺度和软件生态,让智算中心不被任何单一厂商锁定。
翼华科技的家具与生态布局,亦然沿着这三条线在激动。家具上,图南系列将加快向更高带宽演进,不息强化面向智算场景的自研合同处理引擎和拥塞限度才气;生态上,翼华正与国产GPU厂商、劳动器厂商、交换机厂商激动深度的端网适配和连合决议;同期通过开源P4处理器和自研的虚构合同处理器,提供快速适配怒放合同的才气,反哺网罗尺度和合同组织——凭借可编程的挨次,翼华SuperNIC不错同期援救RoCE、UEC乃至各家的自界说合同。
“咱们的办法很明确:在国产智算的网罗算力这一层,作念出果真可界限商用的自主采纳。”贾淑芸这么总结。
回到WAIC「重构算力」的现场议程——测验推理转型、国产算力生态、HBM/CPO先进硬件、万卡集群接济、智算新基建全链路成本测算,简直每一个议题王人指向合并个命题:算力供需之间的结构性重构。而在这场重构里,DPU与智能网卡所代表的“网罗算力”挨次尊龙凯时(中国)官方网站,恰是决定国产AI基础设施上限的关键变量之一。翼华科技所代表的自研RISC-V DPU路子,能否在这一轮洗牌之后跑出属于中国的BlueField,将是产业界接下来数年最值得关注的看点之一。
Powered by 尊龙凯龙时官网进入「中国」网页版入口 @2013-2022 RSS地图 HTML地图