您的当前位置:首页 > 知识 > NVIDIA要用上X3D堆叠设计!下代GPU将引入LPU单元 正文
时间:2026-10-12 00:25:51 来源:网络整理 编辑:知识
虽然NVIDIA目前在AI训练领域无可匹敌,但面对日益增长的即时推理需求,其正筹划一项足以改变行业格局的“秘密武器”。据AGF透露,NVIDIA计划在2028年推出的Feynman(费曼)架构GPU中
虽然NVIDIA目前在AI训练领域无可匹敌,用上引入元但面对日益增长的堆叠U单即时推理需求,其正筹划一项足以改变行业格局的设计“秘密武器”。
据AGF透露,下代NVIDIA计划在2028年推出的用上引入元Feynman(费曼)架构GPU中,整合来自Groq公司的堆叠U单LPU(语言处理单元),以大幅提升AI推理性能。设计
Feynman架构将接替Rubin架构,下代采用台积电最先进的用上引入元A16(1.6nm)制程,为了突破半导体物理限制,堆叠U单NVIDIA计划利用台积电的设计SoIC混合键合技术,将专为推理加速设计的下代LPU单元直接堆叠在GPU之上。

这种设计类似于AMD的堆叠U单3D V-Cache技术,但NVIDIA堆叠的设计不是普通缓存,而是专为推理加速设计的LPU单元。
设计的核心逻辑在于解决SRAM的微缩困境,在1.6nm这种极致工艺下,直接在主芯片集成大量SRAM成本极高且占用空间。
通过堆叠技术,NVIDIA可以将运算核心留在主芯片,而将需要大量面积的SRAM独立成另一层芯片堆叠上去。
台积电的A16制程一大特色是支持背面供电技术,这项技术可以腾出芯片正面的空间,专供垂直信号连接,确保堆叠的LPU能以极低功耗进行高速数据交换。

结合LPU的“确定性”执行逻辑,未来的NVIDIA GPU在处理即时AI响应(如语音对话、实时翻译)时,速度将实现质的飞跃。
不过这也存在两大潜在挑战,分别是散热问题和CUDA兼容性难题,在运算密度极高的GPU 再加盖一层芯片,如何避免“热当机”是工程团队的头号难题。
同时LPU强调“确定性”执行顺序,需要精确的内存配置,而CUDA生态则是基于硬件抽象化设计的,要让这两者完美协同,需要顶级的软件优化。
福州:架起连心桥 打好新时代新“侨牌”2026-10-12 00:05
文創產業 為經濟找出口|天下雜誌2026-10-11 23:56
咱吃的不是糖,是幸福多巴胺!2026-10-11 23:13
春都王中王火腿肠重温经典,重磅来袭!2026-10-11 23:11
当割草机器人遇见世界杯:MOVA打造了一场庭院足球挑战赛2026-10-11 22:45
横尾太郎的起点!《龙背上的骑兵》或将迎来新动向2026-10-11 22:35
文旅部公布恢复出境团队游第三批名单:含英美日韩等国2026-10-11 21:52
现代简约风格室内设计案例分析2026-10-11 21:48
《迈克尔·杰克逊:巨星之路》IGN3分:无聊透顶 失去灵魂!2026-10-11 21:46
獨家專訪 毛治國:事情要一步一步來(Web Only 訪談Q&A全文)|天下雜誌2026-10-11 21:41
把课堂搬到床头 用爱心叩开心门_2026-10-12 00:04
省考报名第四天迎爆发性增长 省直单位招录比65∶12026-10-11 23:41
启动!舒城县杭埠河沃孜大桥2026-10-11 23:33
科沃尔加盟后将打替补 卢:他有项技能比肩水花2026-10-11 23:22
各保险公司短期重疾险,2022各保险公司短期重疾险2026-10-11 23:06
定期寿险和意外险有必要一起买吗?定期寿险和意外险可以重复赔付吗?2026-10-11 23:03
驻新安镇帮镇扶村工作队:教育帮扶奉献爱心,梦想护航传递希望2026-10-11 22:58
阳台隐形门装修效果图2026-10-11 22:24
SSD性能暴跌75%!升级Win11后别忘了这步2026-10-11 22:00
聰明理好債,別讓華爾街風暴在你家上演|天下雜誌2026-10-11 21:59