英伟达Feynman GPU将采用堆叠SRAM加速AI推理

英伟达Feynman GPU将采用堆叠SRAM加速AI推理

快速阅读: 最新消息显示,英伟达计划于2028年推出“费曼”GPU架构,采用堆叠式SRAM内存以降低AI推理延迟。该设计通过将SRAM裸片与主芯片共封装提升带宽,并利用成熟制程控制成本,但面临多层堆叠带来的散热挑战。

据业内人士透露,英伟达计划于2028年左右推出下一代“费曼”(Feynman)GPU架构,或将采用堆叠式SRAM内存模块,以提升特定任务的处理效率。该设计旨在降低目标工作负载的延迟,而非单纯增强通用计算性能。

这一技术路线与业界现有的缓存堆叠方案相似,其背后动因在于英伟达正加大对人工智能推理领域的投入。近期,该公司对Groq等企业的投资表明,其战略正转向融合传统GPU计算与专用处理单元。由于此类专用模块需快速访问低延迟内存,仅依赖外部内存难以满足效率要求。

为实现这一目标,英伟达拟将独立的SRAM芯片与主GPU封装在同一基板上。通过单独制造SRAM裸片并堆叠至处理器上方,可在不扩大主计算芯片面积的前提下,显著提升内部带宽并缩短内存访问延迟。同时,采用成熟制程生产SRAM也有助于控制成本、提高良品率。

不过,该方案面临散热挑战。多层硅堆叠会增加热密度,使散热管理更为复杂。英伟达需优化冷却系统,以确保设备在持续高负载下稳定运行。目前,该公司尚未正式公布“费曼”架构的技术细节,相关消息仍属推测。更确切的信息预计将在产品临近发布时逐步披露。

(以上内容均由Ai生成)

引用自:Guru3D网站

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注