• 正版现货新书 通用图形处理器指令集架构和软硬件设计:乘影开源GPGPU设计透视 9787302705055 何虎,马鸣远,于芳菲著
  • 正版现货新书 通用图形处理器指令集架构和软硬件设计:乘影开源GPGPU设计透视 9787302705055 何虎,马鸣远,于芳菲著

正版现货新书 通用图形处理器指令集架构和软硬件设计:乘影开源GPGPU设计透视 9787302705055 何虎,马鸣远,于芳菲著

全新正版现货,以书名为准,放心购买,购书咨询18822403591朱老师

75.36 5.8折 129 全新

库存19件

北京丰台

作者何虎,马鸣远,于芳菲著

出版社清华大学出版社

ISBN9787302705055

出版时间2025-12

装帧平装

开本26cm

定价129元

货号200231769

上书时间2026-09-15

   商品详情   

品相描述:全新
商品描述
作者简介

何虎,博士,清华大学上海清华国际创新中心副主任,副教授。研究VLIW处理器架构并开发出面向特定应用的DSP,成果应用于音视频码流数据安全加密系统。曾获北京市科学技术奖一等奖等省部级奖励3项。在TCAD、TCAS、Frontiers等期刊发表多篇高水平学术论文,获批发明专利20余项。



目录

第1部分 背景与概览

第1章 行业背景和发展

1.1 GPGPU的历史与发展

1.1.1 早期计算机图形的发展

1.1.2 专用图形处理器的诞生

1.2 GPU的可编程化与GPGPU的萌芽

1.2.1 可编程着色器时代(2001-2006年)

1.2.2 通用计算需求的增长

1.3 GPGPU通用计算时代的兴起(2006年起)

1.3.1 统一渲染架构的引入

1.3.2 CUDA的推出与影响

1.3.3 OpenCL的出现与标准化

1.3.4 计算着色器的引入与GPGPU的成熟

1.4 光线追踪与AI时代

1.4.1 光线追踪的崛起:从离线到实时

1.4.2 AI驱动的GPU变革

1.5 GPU的未来:架构演化与技术创新

1.5.1 硬件架构的持续演化

1.5.2 网格着色器

1.5.3 封装和互连技术的演进

1.5.4 GPGPU技术的挑战

1.6 本章小结

第2章 开源项目与开发进展

2.1 主要开源GPGPU项目概览

2.1.1 OpenVGA

2.1.2 Nyuzi Processor(2012)

2.1.3 MIAOW(2015)

2.1.4 FGPU:An SIMT-Architecture for FPGAs(2016)

2.1.5 Vortex(2019)

2.1.6 乘影GPGPU

2.2 开源GPU模拟器项目概况

2.2.1 GPGPU-Sim

2.2.2 gem5-gpu

2.3 开源项目情况与分析

第2部分 GPU设计思想和指令集

第3章 从并行思想到GPGPU

3.1 指令级并行

3.1.1 流水线

3.1.2 乱序执行

3.1.3 超标量技术

3.2 线程级并行

3.2.1 粗粒度多线程

3.2.2 细粒度多线程

3.2.3 同时多线程

3.2.4 多核处理器

3.2.5 讨论

3.3 数据级并行

3.3.1 向量化与性能提升

3.3.2 Amdahl定律与向量加速的整体影响

3.3.3 内存带宽与数据获取

3.3.4 SIMD硬件的形态变换

3.3.5 NPU

3.4 GPGPU

3.5 比较、讨论和小结

3.5.1 横向对比

3.5.2 软硬件协同优化新趋势

第4章 NVIDIA GPU指令集

4.1 寄存器

4.1.1 通用寄存器

4.1.2 特殊寄存器

4.1.3 Predicate寄存器

4.1.4 Uniform寄存器

4.1.5 讨论

4.2 内存和缓存

4.3 运算

4.3.1 浮点数运算

4.3.2 整数运算

4.3.3 Warp级别运算

4.4 本章小结

第5章 AMD GPU指令集

5.1 架构简介

5.2 寄存器

5.2.1 控制寄存器

5.2.2 通用寄存器

5.3 指令格式

5.3.1 常用指令字段

5.3.2 缓存控制修饰符

5.4 程序控制指令

5.5 标量指令

5.6 向量指令

5.6.1 编码格式及特点

5.6.2 16b计算

5.6.3 VOPD:双发射计算

5.6.4 矩阵乘加指令

5.7 内存和缓存

5.7.1 Flat访存

5.7.2 Global访存

5.7.3 Scratch访存

5.8 本章小结

第6章 RISC-V及其向量扩展

6.1 RISC-V指令集概述

6.1.1 RISC-V起源

6.1.2 RISC-V架构特点

6.2 RISC-V指令集

6.2.1 基础指令集

6.2.2 扩展指令集

6.3 RISC-V向量扩展概述

6.3.1 向量扩展的引入

6.3.2 向量寄存器和状态映射

6.3.3 RISC-V向量扩展的关键特性

6.4 RISC-V向量扩展的指令集

6.4.1 向量扩展指令格式

6.4.2 向量masking

6.5 RISC-V向量扩展的应用

第7章 乘影GPGPU指令集

7.1 编程模型映射方案

7.2 指令设计说明

7.2.1 RISC-V标量指令

7.2.2 RISC-V向量指令

7.3 自定义指令

7.3.1 分支控制指令

7.3.2 寄存器扩展指令

7.3.3 同步和任务控制指令

7.3.4 自定义矩阵乘加指令

7.3.5 自定义计算指令

7.3.6 自定义访存指令

7.3.7 自定义64位地址空间立即数访存指令

7.3.8 自定义异步复制指令

7.3.9 自定义访存前缀指令

7.3.10 自定义计算前缀指令

7.4 寄存器

7.4.1 通用寄存器堆设计方案

7.4.2 CSR方案

7.4.3 应用程序二进制接口

7.5 内存模型和内存分配方案

7.6 本章小结

第3部分 乘影GPGPU硬件架构

第8章 流式多处理器单元核心微架构

8.1 线程束调度器

8.1.1 线程束调度器架构

8.1.2 线程束调度的讨论

8.2 流水线前端设计

8.2.1 取指单元

8.2.2 译码单元

8.2.3 指令缓冲

8.2.4 记分板

8.2.5 线程分支与SIMT-Stack

8.2.6 SIMT分支的讨论

8.3 流水线后端设计

8.3.1 操作数收集器和寄存器文件

8.3.2 标量单元

8.3.3 浮点数乘法器

8.3.4 向量执行单元

8.




内容摘要
"本书聚焦通用并行计算GPGPU 技术及其实践,系统回顾GPU 从图形渲染到通用计算的演化历程,深入解析GPU指令集、微架构、软件工具链设计。本书分为4 部分:第 1 部分回顾GPGPU的时代背景与发展历程,介绍主要开源项目;第2 部分探讨GPU设计思想与指令集,并引出乘影GPGPU自定义指令集;第3 部分剖析乘影GPGPU硬件微架构,包括流式多处理器单元、CTA调度器、缓存子系统、内存管理单元以及张量计算系统等关键模块;第4 部分介绍基于OpenCL的编程模型、LLVM 编译器及驱动工具链,构建完整的GPGPU软件生态。本书兼顾理论与实操,既涵盖GPU并行计算的核心原理与关键技术,又结合乘影开源项目的实践示例,帮助读者深入理解并掌握现代GPGPU的设计与实现路径。
本书适合对GPU 架构、并行计算与开源硬件生态感兴趣的工程师、学生和研究人员阅读。
"

主编推荐
"这是一部全景式解析开源GPGPU设计的力作,旨在打通从理论原理到项目实践的全链路。
贯穿全栈,视野宏大
从GPU发展史、指令集设计、微架构剖析,到OpenCL编程模型与LLVM编译器工具链,提供一站式GPGPU知识体系。
硬核剖析,深入细节
立足“乘影”开源项目,对流式多处理器(SM)、缓存子系统、内存管理单元(MMU)及Tensor Core等关键模块进行深度解读。
实践导向,资源完备
本书不仅是理论指南,更是实战手册,提供全栈开源代码与全流程实操指南,助力读者将知识转化为技能。
生态完整,工具先进
详解基于OpenCL与LLVM的现代GPGPU软件栈,涵盖编程、编译、驱动等核心环节,构建完整的开发与运行环境。
本书为渴望掌握通用并行计算核心技术的工程师、研究者和学生,点亮了“从零到一”设计和实现GPGPU的完整路径。"

精彩内容

本书聚焦通用并行计算GPGPU技术及其实践,系统回顾GPU从图形渲染到通用计算的演化历程,深入解析GPU指令集、微架构、软件工具链设计。本书分为4部分:第1部分回顾GPGPU的时代背景与发展历程,介绍主要开源项目;第2部分探讨GPU设计思想与指令集,并引出乘影GPGPU自定义指令集;第3部分剖析乘影GPGPU硬件微架构,包括流式多处理器单元、CTA调度器、缓存子系统、内存管理单元以及张量计算系统等关键模块;第4部分介绍基于OpenCL的编程模型、LLVM编译器及驱动工具链,构建完整的GPGPU软件生态。本书兼顾理论与实操,既涵盖GPU并行计算的核心原理与关键技术,又结合乘影开源项目的实践示例,帮助读者深入理解并掌握现代GPGPU的设计与实现路径。 本书适合对GPU架构、并行计算与开源硬件生态感兴趣的工程师、学生和研究人员阅读。



以下为对购买帮助不大的评价

此功能需要访问孔网APP才能使用
暂时不用
打开孔网APP