您现在的位置是:首页 > 技术资料 > 昇腾910B技术参数
推荐星级:
  • 1
  • 2
  • 3
  • 4
  • 5

昇腾910B技术参数

更新时间:2026-07-29 08:35:54 大小:13K 上传用户:潇潇江南查看TA发布的资源 标签:昇腾 下载积分:2分 评价赚积分 (如何评价?) 打赏 收藏 评论(0) 举报

资料介绍

架构与技术参数

核心架构

昇腾910B采用华为自研达芬奇架构v2.0,在初代达芬奇架构基础上对计算单元、调度单元、缓存体系做了全面升级,针对大模型训练的长序列计算、混合精度运算做了专项优化。核心计算单元采用3D Cube矩阵计算架构,单核心的矩阵计算吞吐率相比初代提升100%,同时支持动态shape计算,适配大模型训练过程中灵活的输入输出维度变化。

内存与互联技术

采用高带宽HBM2e堆叠显存,相比GDDR6显存,带宽提升超过3倍,能够满足大模型训练过程中对参数频繁读写的带宽需求。支持华为自研CCL互联加速技术Chip Connection Link),多芯片集群互联时可实现更低延迟的通信,解决大模型分布式训练的通信瓶颈,8卡集群下的通信效率可达90%以上。同时支持ECC纠错,提升长时间训练的稳定性,降低数据出错概率。

软件生态参数

昇腾910B兼容华为CANN架构Compute Architecture for Neural Networks),支持PyTorchTensorFlow等主流深度学习框架,提供一键式模型迁移工具,迁移效率可达90%以上。支持动态图转静态图优化,同时兼容原生动态图开发模式,适配大模型快速迭代开发需求,提供包含算子库、编译器、调试工具在内的全栈开发工具链。

场景适配参数

大模型训练适配参数

支持最大千亿参数大模型单卡加载,配合昇腾集群方案,可以支持十万亿参数级大模型的分布式训练,训练吞吐量相比前代昇腾910提升超过80%,支持从预训练、微调、RLHF全流程训练任务,适配MoE混合专家模型等当前主流大模型结构。

大模型推理适配参数

单卡可支持最大10B参数大模型INT4精度离线推理,在典型生成任务下,推理速度可达每秒上千token输出,支持动态批处理、连续批处理优化,推理吞吐量相比FP16精度提升超过3倍,适合线下批量推理、在线高并发对话场景部署。


部分文件列表

文件名 大小
1785284698昇腾910B技术参数.docx 13K

全部评论(0)

暂无评论

上传资源 上传优质资源有赏金

  • 打赏
  • 30日榜单

推荐下载