


定价:79元
印次:1-1
ISBN:9787302724995
出版日期:2026.08.01
印刷日期:2026.08.10
图书责编:崔彤
图书分类:零售
本书系统介绍了基于 AMD ROCm 平台的 HIP 加速计算技术,围绕 GPU 编程在异构计算中的核心作用,展开对 HIP 编程语言、GPU 硬件架构、性能优化方法、多 GPU 协同计算策略及 ROCm 生态组件的全面讲解。内容设计结合了当前实际需求,从语言基础出发,逐步引导读者掌握复杂程序结构与高效的并行计算模式。 书中配有大量可运行的代码示例,涵盖矩阵运算、图像处理、聚类分析、图遍历等典型任务,突出实践导向,强调理论与应用的结合。除了基础语法与程序结构,还深入讲解了 HIP 中的内存管理、线程调度、核函数优化、异步执行机制、调试工具链等关键主题,并结合 ROCm 提供的多种高性能库(如 rocBLAS、rocFFT、rocRAND)及性能分析工具,构建起完整的开发与优化路径。 针对当前多样化的计算平台需求,书中也探讨了多 GPU 系统下的点对点通信与集合通信方法,介绍了 ROCm 与机器学习框架(PyTorch、TensorFlow)的集成方式,以及在数据中心环境中结合容器与作业调度系统的实际部署方案。 本书适合高校计算机、软件工程、电子信息等专业本科生和研究生使用,也可供从事高性能计算、GPU 应用开发与平台迁移的科研人员和工程师参考。
过敏意,现任上海交通大学讲席教授,长期从事并行计算与编译器、云计算、高性能计算、高能效计算等方向的研究。曾主持国家自然科学基金杰青项目、973 计划项目、863 计划等项目。他是中组部国家级人才计划获得者,欧洲科学院外籍院士,国务院政府特殊津贴专家,IEEE Fellow,中国计算机学会会士、常务理事,担任教育部创新团队学术带头人,973 计划首席科学家。
序 一 数十年来,计算机体系结构的发展在很大程度上受益于摩尔定律与工艺演进所带来的性能红利。随着单核频率提升空间日益受限, Dennard缩放定律逐步失效,依赖传统通用处理器持续获得算力增长的道路越来越难以为继。与此同时,人工智能、深度学习与大数据应用的迅猛发展,又以前所未有的规模放大了社会对算力的需求。在这样的双重驱动下,异构计算已经不再是某种“可选方案”,而是变成了当代计算系统演进的关键方向。 从体系结构的角度看,过去十年如此,未来十年亦如此,我们都将持续处于一个由多种异构硬件共同构成的计算时代:通用 CPU负责控制、调度与复杂逻辑处理, GPU以及其他加速器则承担高吞吐、强并行的核心计算任务。在这一异构生态中, GPU无疑是最具代表性的加速器之一,它凭借面向吞吐量的架构设计、大规模线程并发能力以及对数据并行任务的天然适配,成为人工智能训练与推理、科学计算、高性能计算等领域的中坚力量。因此,理解 GPU、理解异构计算,已经成为理解现代算力体系的必要前提。 然而,硬件的异构化越深入,编程与优化的挑战也就越突出。面对复杂的异构硬件,如何让开发者更高效地编程、更可控地调优、更充分地逼近硬件性能上限,成为过去二十年并行计算领域最核心的问题之一。从 2007年 CUDA的诞生,到后续 OpenCL的探索,再到今天 HIP所代表的新一代跨平台异构编程实践,这些工作虽然路径不同,但都指向同一个目标:降低异构计算的使用门槛,同时尽可能释放底层硬件的潜力。 在这一脉络中, HIP是一个很有雄心,也非常值得期待的尝试。它在编程模型上与 CUDA高度相似,却又试图在性能与可移植性之间取得...
第 1章 介绍 ………………………………………………………………………
1.1 并行编程 ……………………………………………………………………………… 2
1.2 GPU …………………………………………………………………………………… 3
1.3 ROCm ………………………………………………………………………………… 5
1.4 HIP框架 ……………………………………………………………………………… 6
1.5 本书内容 ……………………………………………………………………………… 6
第 2章 开始使用 HIP编程 ………………………………………………………
2.1 在 HIP中实现“Hello World” ……………………………………………………… 8
2.2 使用 HIP进行数据处理——Vector Add 示例 ……………………………………… 9
2.2.1 并行执行的机会……………………………………………………………… 9
2.2.2 组织线程…………………………………………………………………… 10
2.2.3 使用 HIP API 进行数据传输 ……………………………………………… 12
2.2.4 错误和正确性检查………………………………………………………… 13
2.2.5 综合示例…………………………………………………………………… 14
2.3 总结 ………………………………………………………………………………… 16
第 3章 HIP内核编程…………………………………………... 查看详情
本书的主要特色在于聚焦 AMD ROCm 平台与 HIP 编程语言,系统性强、实用性高,兼顾教学和工程应用。内容设计充分考虑跨平台开发需求,同时深入讲解 ROCm 软件栈中的调试工具与性能优化方法,覆盖多 GPU 协同计算及主流 AI 框架的适配方式。与现有以 NVIDIA CUDA 为主的书籍相比,本书为读者提供了面向多元硬件环境的实践参考。
查看详情


