第 3 章 · 芯(二):内存子系统与带宽


文档摘要

第 3 章 · 芯(二):内存子系统与带宽 本章要回答的核心问题:上一章我们看了算力,但算力要用满,靠的是喂数据的带宽——为什么说大模型训练里"带宽往往比算力更稀缺"?HBM 到底是怎么把带宽堆上去的? 章节摘要 如果说第 2 章讲的是"算多快",本章讲的就是"喂多快"。在大模型训练中,算力增长的速度长期快于内存带宽增长的速度,两者的剪刀差形成了著名的"内存墙"。 会员。《第 3 章 · 芯(二):内存子系统与带宽》收录于灏天文库文集《AI 超级计算集群 · NVL72 与昇腾950 SuperPoD》,提供技术教程、实践指南与问题解决方案,支持在线阅读、全文检索与知识沉淀,助力开发者系统化学习。文档编号69191。

该文档为会员专享,请先登录或注册后再查看


发布者: 作者: 转发
评论区 (0)
U