您的当前位置:首页 > 焦点 > NVIDIA要用上X3D堆叠设计!下代GPU将引入LPU单元 正文
时间:2026-10-03 05:07:19 来源:网络整理 编辑:焦点
虽然NVIDIA目前在AI训练领域无可匹敌,但面对日益增长的即时推理需求,其正筹划一项足以改变行业格局的“秘密武器”。据AGF透露,NVIDIA计划在2028年推出的Feynman(费曼)架构GPU中
虽然NVIDIA目前在AI训练领域无可匹敌,用上引入元但面对日益增长的堆叠U单即时推理需求,其正筹划一项足以改变行业格局的设计“秘密武器”。
据AGF透露,下代NVIDIA计划在2028年推出的用上引入元Feynman(费曼)架构GPU中,整合来自Groq公司的堆叠U单LPU(语言处理单元),以大幅提升AI推理性能。设计
Feynman架构将接替Rubin架构,下代采用台积电最先进的用上引入元A16(1.6nm)制程,为了突破半导体物理限制,堆叠U单NVIDIA计划利用台积电的设计SoIC混合键合技术,将专为推理加速设计的下代LPU单元直接堆叠在GPU之上。

这种设计类似于AMD的堆叠U单3D V-Cache技术,但NVIDIA堆叠的设计不是普通缓存,而是专为推理加速设计的LPU单元。
设计的核心逻辑在于解决SRAM的微缩困境,在1.6nm这种极致工艺下,直接在主芯片集成大量SRAM成本极高且占用空间。
通过堆叠技术,NVIDIA可以将运算核心留在主芯片,而将需要大量面积的SRAM独立成另一层芯片堆叠上去。
台积电的A16制程一大特色是支持背面供电技术,这项技术可以腾出芯片正面的空间,专供垂直信号连接,确保堆叠的LPU能以极低功耗进行高速数据交换。

结合LPU的“确定性”执行逻辑,未来的NVIDIA GPU在处理即时AI响应(如语音对话、实时翻译)时,速度将实现质的飞跃。
不过这也存在两大潜在挑战,分别是散热问题和CUDA兼容性难题,在运算密度极高的GPU 再加盖一层芯片,如何避免“热当机”是工程团队的头号难题。
同时LPU强调“确定性”执行顺序,需要精确的内存配置,而CUDA生态则是基于硬件抽象化设计的,要让这两者完美协同,需要顶级的软件优化。
45岁可以买的重疾险,2022年45岁可以买的重疾险2026-10-03 05:03
卡普空称《怪物猎人:荒野》销量遇冷是因为PS5太贵2026-10-03 05:01
汉阴:“真金白银”兑收益 产业签约谋新篇2026-10-03 04:29
张杰健身照是怎么回事 张杰健身照是什么样子为什么引人尖叫?2026-10-03 04:03
这都有漏捡! 《废土:复刻版》意外可在Xbox商店免费领取2026-10-03 03:19
新意满满!成都大运会火炬、场馆长啥样?一文速览亮点2026-10-03 03:10
失意男子海上漂流两小时 警民救回后还想往海里走2026-10-03 02:51
身体充电,激发能量!速8能量在饮料旺季带你赚大钱!2026-10-03 02:41
交通意外险保险,交通意外险保险公司可以先行垫付医疗费吗?2026-10-03 02:32
2026平安逸家·康瑞百万医疗险(慢病版)怎么样?多少钱一年在哪买?2026-10-03 02:24
夏天来了,你们都离不开它!爆果忍着汽水需求旺盛,代理不断!2026-10-03 05:02
视焦点讯!【盘中播报】130只个股突破半年线2026-10-03 04:50
新中式风格装修设计与选择2026-10-03 04:26
中国农民丰收节|晒出一年好“丰”景2026-10-03 04:23
世界冠军爆冷出局 国乒女双无缘欧洲大满贯半决赛2026-10-03 04:17
泉州残疾人康复中心设立辅具服务站:辅具免费修 还可免费借2026-10-03 04:16
“说事日”里话民生 “解题”路上见真情_2026-10-03 03:55
零刻ME Pro NAS型迷你主机今日开启预售,标配Intel N95处理器2026-10-03 03:38
热身赛中国男篮83比78力克乌拉圭队2026-10-03 03:06
生意社:9月24日神木市场兰炭价格持稳运行2026-10-03 02:47