NVIDIA要用上X3D堆叠设计!下代GPU将引入LPU单元
虽然NVIDIA目前在AI训练领域无可匹敌,用上引入元但面对日益增长的堆叠U单即时推理需求,其正筹划一项足以改变行业格局的设计“秘密武器”。 据AGF透露,下代NVIDIA计划在2028年推出的用上引入元Feynman(费曼)架构GPU中,整合来自Groq公司的堆叠U单LPU(语言处理单元),以大幅提升AI推理性能。设计 Feynman架构将接替Rubin架构,下代采用台积电最先进的用上引入元A16(1.6nm)制程,为了突破半导体物理限制,堆叠U单NVIDIA计划利用台积电的设计SoIC混合键合技术,将专为推理加速设计的下代LPU单元直接堆叠在GPU之上。 这种设计类似于AMD的堆叠U单3D V-Cache技术,但NVIDIA堆叠的设计不是普通缓存,而是专为推理加速设计的LPU单元。 设计的核心逻辑在于解决SRAM的微缩困境,在1.6nm这种极致工艺下,直接在主芯片集成大量SRAM成本极高且占用空间。 通过堆叠技术,NVIDIA可以将运算核心留在主芯片,而将需要大量面积的SRAM独立成另一层芯片堆叠上去。 台积电的A16制程一大特色是支持背面供电技术,这项技术可以腾出芯片正面的空间,专供垂直信号连接,确保堆叠的LPU能以极低功耗进行高速数据交换。 结合LPU的“确定性”执行逻辑,未来的NVIDIA GPU在处理即时AI响应(如语音对话、实时翻译)时,速度将实现质的飞跃。 不过这也存在两大潜在挑战,分别是散热问题和CUDA兼容性难题,在运算密度极高的GPU 再加盖一层芯片,如何避免“热当机”是工程团队的头号难题。 同时LPU强调“确定性”执行顺序,需要精确的内存配置,而CUDA生态则是基于硬件抽象化设计的,要让这两者完美协同,需要顶级的软件优化。

- 最近发表
- 随机阅读
-
- 当割草机器人遇见世界杯:MOVA打造了一场庭院足球挑战赛
- 美國房市交易跌至10年新低,竟成聯準會的神救援?|天下雜誌
- 成都“观鸟热”背后生态价值转化为幸福感
- 曝FIFA许可莫德斯特转会 仲裁结果未知或等补偿
- 支付宝发布AIS开发套件:让Agent自动发现、调用、计费
- 谷歌攻克苹果隔空投送 安卓苹果文件共享破壁
- 台湾栾树结果鹭岛披“秋衣” 街头秋景引市民赞叹
- 德罗赞34+6难敌对手5人上双 快船胜马刺取3连胜
- 交行滁州分行首笔“免申贷”落地赋能小微企业发展_
- 让温暖与关怀“一站到家”
- 曝骑士总决赛更想打勇士 卢:这取决于我们自己
- 烤漆玻璃门头该怎么安装 烤漆玻璃材料特点是什么,行业资讯
- 可以只买重疾险吗?哪些情况不可以买重疾险
- 安耐美EB Bronze铜牌电源上线:316元起,兼顾性能与性价比
- 勇士雷霆G6创收视率纪录 赛季最高!期待抢七战
- 本週重點回顧:台積電加碼亞利桑納、中國公布防疫新10條|天下雜誌
- 苹果macOS 27将彻底放弃Intel Mac 一个时代落幕
- 挡风玻璃的划痕怎么抛光 玻璃表面有划痕该怎么办,行业资讯
- 厦门“e政务”上线新功能 4项派出所证明实现立等可取
- 厦门“00后”小将傅梵涛 夺青奥会男子蹦床冠军
- 搜索
-
- 友情链接
-