您的当前位置:首页 > 探索 > NVIDIA要用上X3D堆叠设计!下代GPU将引入LPU单元 正文
时间:2026-10-07 21:30:03 来源:网络整理 编辑:探索
虽然NVIDIA目前在AI训练领域无可匹敌,但面对日益增长的即时推理需求,其正筹划一项足以改变行业格局的“秘密武器”。据AGF透露,NVIDIA计划在2028年推出的Feynman(费曼)架构GPU中
虽然NVIDIA目前在AI训练领域无可匹敌,用上引入元但面对日益增长的堆叠U单即时推理需求,其正筹划一项足以改变行业格局的设计“秘密武器”。
据AGF透露,下代NVIDIA计划在2028年推出的用上引入元Feynman(费曼)架构GPU中,整合来自Groq公司的堆叠U单LPU(语言处理单元),以大幅提升AI推理性能。设计
Feynman架构将接替Rubin架构,下代采用台积电最先进的用上引入元A16(1.6nm)制程,为了突破半导体物理限制,堆叠U单NVIDIA计划利用台积电的设计SoIC混合键合技术,将专为推理加速设计的下代LPU单元直接堆叠在GPU之上。

这种设计类似于AMD的堆叠U单3D V-Cache技术,但NVIDIA堆叠的设计不是普通缓存,而是专为推理加速设计的LPU单元。
设计的核心逻辑在于解决SRAM的微缩困境,在1.6nm这种极致工艺下,直接在主芯片集成大量SRAM成本极高且占用空间。
通过堆叠技术,NVIDIA可以将运算核心留在主芯片,而将需要大量面积的SRAM独立成另一层芯片堆叠上去。
台积电的A16制程一大特色是支持背面供电技术,这项技术可以腾出芯片正面的空间,专供垂直信号连接,确保堆叠的LPU能以极低功耗进行高速数据交换。

结合LPU的“确定性”执行逻辑,未来的NVIDIA GPU在处理即时AI响应(如语音对话、实时翻译)时,速度将实现质的飞跃。
不过这也存在两大潜在挑战,分别是散热问题和CUDA兼容性难题,在运算密度极高的GPU 再加盖一层芯片,如何避免“热当机”是工程团队的头号难题。
同时LPU强调“确定性”执行顺序,需要精确的内存配置,而CUDA生态则是基于硬件抽象化设计的,要让这两者完美协同,需要顶级的软件优化。
驾乘意外险多少钱?驾乘意外险买多少合适?2026-10-07 21:11
“双11”电商成交额再创新高 新零售呈现较快发展趋势2026-10-07 20:16
抖音温婉与杨清柠微博开撕是怎么回事?温婉和杨清柠什么关系揭秘2026-10-07 20:12
Q1中国学习平板市场规模下滑 线上仍是主流销售渠道2026-10-07 19:53
35岁女重疾险多少钱?35岁女重疾险要花多少钱?2026-10-07 19:50
威少27+10+5维特斯22分 雷霆力擒国王结束4连败2026-10-07 19:36
泉州发现60多处不文明施工 市城管办发函要求整改2026-10-07 19:32
哈德森:CBA打球得到回报 在快船能打出稳定防守2026-10-07 19:20
装修吊顶用什么材料 装修吊顶可以用玻璃材料吗,行业资讯2026-10-07 19:04
网友调查:您认为威少还有没有希望获常规赛MVP2026-10-07 18:54
速卖通618战报:品牌成交同比增长90%,多类目涌现百万美金冠军2026-10-07 21:25
果汁市场新宠,众多经销商!豫善堂果汁品质,抢占果汁市场!2026-10-07 21:12
青春铸匠心 奋进启新程——明宇重工致敬每一位逐梦前行的青年力量2026-10-07 20:57
河南多式联运“新兵” 郑州至天津铁海联运班列今日首发2026-10-07 20:30
百度智能云发布百度千帆Token Plan企业版,提供GLM2026-10-07 20:28
"119"消防宣传活动 VR火场逃生成大热门2026-10-07 20:26
iPhone 17标准版登顶 一季度全球畅销手机出炉2026-10-07 19:32
创维G27Q MAX QD2026-10-07 19:23
3000元左右的重疾险有用吗?3000元左右的重疾险怎么买2026-10-07 19:06
曾振農飛霸王機?|天下雜誌2026-10-07 19:03