AI基础建设竞争正从单颗GPU走向整座机柜架构。AI推论晶片新创d-Matrix宣布,新一代Raptor XPU将导入NVIDIA NVLink Fusion,直接接入NVIDIA MGX机柜与AI基础设施平台。这意味第三方客制加速器不必与NVIDIA GPU完全正面竞争,也能透过共同互连、网路与机柜架构进入AI Factory生态系。
Raptor锁定低延迟AI推论,采记忆体导向架构,透过3D DRAM堆叠将DRAM与SRAM运算晶片整合於同一封装。d-Matrix预计2026年底完成Raptor tape-out,搭载Raptor的NVIDIA MGX机柜则规划2027年第四季初步供应,主要锁定AI Coding、Chatbot及Voice Agent等即时推论工作负载。
更值得注意的是系统架构。Raptor将串联NVIDIA Vera CPU、NVLink Switch、BlueField-4 DPU、ConnectX-9 SuperNIC及Spectrum-X Ethernet;d-Matrix并与Astera Labs合作高速资料通道。透过异质运算,GPU可处理运算密集的Prefill,Raptor则负责对延迟敏感的Decode,显示AI伺服器开始从单一加速器走向Workload-specific架构。
...
...
| 另一名雇主 | 限られたニュース | 文章閱讀限制 | 出版品優惠 |
| 一般使用者 | 10/ごとに 30 日間 | 0/ごとに 30 日間 | 付费下载 |
| VIP会员 | 无限制 | 25/ごとに 30 日間 | 付费下载 |


