科技 · 2025年12月29日

輝達的推理新佈局:Feynman + LPU,ASIC 道路被堵?

作者 WEIWEI · 來源

NVIDIA 正在通過下一代 Feynman 晶片主導 AI 推理堆疊,並計劃將 Groq LPU 單元整合其中。據 GPU 專家 AGF 稱,LPU 很可能採用台積電 混合鍵合(SoIC)技術堆疊在 Feynman GPU 上,就像 AMD 的 X3D CPU 堆疊 3D V-Cache 一樣。

這種架構的核心優勢是:LPU 配備大量 片上 SRAM,實現低延遲推理和高模型浮點利用率(MFU),同時保留 HBM 作為容量儲存。這讓 NVIDIA 在解碼和低延遲推理任務上獲得領先,而 ASIC 廠商的空間被大幅壓縮。

為規避反壟斷風險,NVIDIA 並未直接收購 Groq,而是簽署了 非獨家 IP 許可協議,獲得 LPU 技術使用權。這種“反向收購”策略類似微軟早前收購初創團隊的做法,確保 NVIDIA 能整合 LPU 到 AI Factory 架構中,同時避開監管調查。

總結來看,Feynman + LPU 的組合可能將 NVIDIA 在 AI 推理領域的競爭力提升到新高度,同時讓 ASIC 競爭者難以追趕。