AI推理芯片的故事,正在出现一个耐人寻味的转折。
10月9日,据多位知情人士透露,英伟达计划投资AI推理芯片初创公司d-Matrix。这家成立七年的公司做的芯片,恰恰是英伟达的竞争对手。
赢家开始给对手注资,这比单纯的竞争更有看头。
一家专攻推理的芯片公司,凭什么被英伟达盯上
d-Matrix总部位于加州圣克拉拉,2019年成立,走的路线与GPU完全不同:数字内存计算(Digital In-Memory Compute)。
传统GPU做推理,数据要在显存和计算单元之间来回搬运。大部分时间和电,都耗在了搬运上。d-Matrix直接把计算单元嵌进内存里,数据原地运算,搬运环节被大幅压缩。
2025年11月,d-Matrix完成2.75亿美元C轮融资,估值20亿美元,投资方包括微软旗下风投M12。2026年6月9日,其首款推理加速器Corsair正式量产,由台积电6nm工艺代工,与世芯(Alchip)合作,当夏开始向优先级云厂商和AI实验室批量出货。
效果数据来自Gimlet Labs的研究:Corsair与英伟达Blackwell GPU搭配时,推理速度最快提升10倍,成本降低至三分之一,能效提升最多5倍。前提是它不单打独斗,而是作为GPU旁边的专用推理引擎。
下一代Raptor更激进:3D DRAM直接叠在计算逻辑下面
在今年的Hot Chips 2026上,d-Matrix亮出了下一代产品Raptor:把3D DRAM直接堆叠在计算逻辑下方,32GB内存带宽做到约100TB/s,专为大模型生成式推理设计。
作为对比,英伟达HBM3e显存的带宽大约在每秒几TB的量级。100TB/s意味着内存墙这个大模型推理的最大瓶颈,被从架构层面掀了顶盖。
Raptor将接替Corsair成为公司的主力产品,配套的JetStream 400G以太网卡也已亮相,瞄准数据中心规模的推理集群。
到今年9月,d-Matrix累计融资已超过5亿美元。《The Information》7月报道称,公司正在洽谈新一轮融资,目标估值50亿美元。
英伟达投资对手,图的是什么
黄仁勋的这笔潜在投资,至少有三层算计。
第一层是生态收编。英伟达去年12月与Groq达成200亿美元授权协议,那是它第一次投资推理芯片初创公司。半年后又看上d-Matrix,说明英伟达的策略很清晰:与其让这些专用推理芯片在外面单干,不如让它们进自己的机柜。Next Platform报道,d-Matrix的Raptor将与英伟达的Rackscale整机架方案配对,处理同一项推理任务的不同环节。
第二层是市场事实。AI行业正在从训练竞赛转向推理落地,推理算力的需求增速已经超过训练。市调机构普遍预计,2026年推理占AI算力支出的比例将超过60%。这块蛋糕太大,英伟达吃不完,与其硬堵,不如分着吃、钱照赚。
第三层是防守。Groq、Cerebras、d-Matrix这些专用推理芯片(ASIC)公司,报价普遍比GPU方案低。客户用脚投票的结果,英伟达看得清楚。投资是最便宜的情报,也是最稳固的联盟。
对开发者和企业用户意味着什么
推理成本正在快速下探。OpenRouter的数据显示,中国大模型8月末单周Token调用量已达55.16万亿,连续多周全球第一。调用量越大,每百万Token的成本差异就越值钱。
对企业用户来说,GPU加专用推理加速器的异构组合,可能是2027年数据中心的标配。模型服务商用Corsair跑长上下文的解码阶段,用GPU跑预填充和复杂Agent任务,账单能砍掉一大截。
对芯片行业来说,这则新闻宣告了一个现实:专用推理芯片不再是挑战者的玩具。当行业老大都开始下注,这条赛道就算正式转正了。
英伟达投资d-Matrix的金额和条款尚未最终敲定。可以确定的是,推理芯片战争已经从”谁能造出来”进入”谁能进谁的机柜”的新阶段。
黄仁勋的算盘,从来不打没把握的谱。
苏公网安备32010502011527号
发表回复