您现在的位置是:首页 > 技术资料 > Blackwell架构
推荐星级:
  • 1
  • 2
  • 3
  • 4
  • 5

Blackwell架构

更新时间:2026-06-30 08:18:57 大小:15K 上传用户:潇潇江南查看TA发布的资源 标签:blackwell 下载积分:2分 评价赚积分 (如何评价?) 打赏 收藏 评论(0) 举报

资料介绍

Blackwell架构是NVIDIA在2024年推出的新一代GPU架构,作为上一代Hopper架构的继任者,主要面向AI计算、高性能计算(HPC)以及专业图形处理领域,同时也覆盖消费级旗舰显卡市场。该架构分为面向数据中心的B100核心和面向消费级与专业工作站的B200核心,在AI性能、能效比、显存带宽等关键指标上实现了跨越式提升,进一步巩固了NVIDIA在加速计算领域的领先地位。

架构研发背景

AI大模型的爆发式增长对GPU算力提出了前所未有的要求,Hopper架构推出后,全球AI训练需求仍然以每年10倍的速度增长,现有架构的算力密度和能效比已经无法满足超大规模大模型训练的需求。同时,随着生成式AI应用落地加速,推理场景对低延迟、高吞吐量的需求也不断提升,NVIDIA需要推出新一代架构来匹配市场需求。

早在2022年,NVIDIA就启动了Blackwell架构的研发,命名延续了NVIDIA以著名科学家命名架构的传统,Blackwell源自18世纪英国著名数学家、统计学家托马斯·贝叶斯(Thomas Bayes),对应AI领域核心的贝叶斯推理算法,也直接呼应了该架构对AI推理的优化方向。

B100核心技术规格

B100是Blackwell架构面向数据中心AI训练与HPC场景的旗舰核心,基于台积电4N工艺(台积电定制4nm工艺)打造,整体规格相比上一代H100有大幅提升:

1. 核心配置:集成超过1040亿个晶体管,拥有144个流式多处理器(SM)单元,总计8960个CUDA核心,FP32算力达到37.4 TFLOPS,相比H100提升了约30%。

2. AI算力:第四代Tensor Core(张量核心)支持全新的FP4数据格式,FP4 AI算力达到1440 PetaFLOPS,FP8算力达到720 PetaFLOPS,相比H100的FP8算力提升了整整4倍,能效比提升超过2.5倍。



部分文件列表

文件名 大小
Blackwell架构.docx 15K

全部评论(0)

暂无评论

上传资源 上传优质资源有赏金

  • 打赏
  • 30日榜单
  • 21下载积分 打赏60.00元   3天前

    用户:他山之石可攻玉

  • 21下载积分 打赏310.00元   3天前

    用户:小猫做电路

  • 21下载积分 打赏210.00元   3天前

    用户:zhengdai

  • 21下载积分 打赏210.00元   3天前

    用户:w993263495

  • 21下载积分 打赏10.00元   3天前

    用户:烟雨

  • 21下载积分 打赏60.00元   3天前

    用户:gsy幸运

  • 21下载积分 打赏70.00元   3天前

    用户:铁蛋锅

  • 21下载积分 打赏65.00元   3天前

    用户:xzxbybd

  • 21下载积分 打赏60.00元   3天前

    用户:jh0355

  • 21下载积分 打赏60.00元   3天前

    用户:w178191520

  • 21下载积分 打赏20.00元   3天前

    用户:jh03551

  • 21下载积分 打赏20.00元   3天前

    用户:sun2152

  • 21下载积分 打赏20.00元   3天前

    用户:kk1957135547

  • 21下载积分 打赏25.00元   3天前

    用户:w1966891335

  • 21下载积分 打赏20.00元   3天前

    用户:xuzhen1

  • 21下载积分 打赏15.00元   3天前

    用户:x15580286248

  • 21下载积分 打赏25.00元   3天前

    用户:pcb

  • 21下载积分 打赏20.00元   3天前

    用户:bhacker

  • 21下载积分 打赏15.00元   3天前

    用户:liqiang9090

推荐下载