《大规模并行处理器程序设计》学习笔记
了解硬件架构特性,建立通用并行编程的基础,学习在大规模并行处理器上编写高性能的程序
致虚极 守静笃
分类
最近
了解硬件架构特性,建立通用并行编程的基础,学习在大规模并行处理器上编写高性能的程序
梳理 NVIDIA GPU 从固定图形流水线、CUDA 通用计算,到 Tensor Core、光线追踪及机架级 AI 系统的演进历程,深入分析各代架构的关键突破、设计取舍与性能瓶颈,揭示其从“渲染像素”走向“生产智能”的技术脉络。
记录在 Codex 客户端中复用 ChatGPT 登录会话的配置流程,包括会话信息导出、格式转换和本地认证文件处理。
介绍扫频式频谱仪的显示电平与测量模型,并通过仿真观察扫频过程对信号频谱显示的影响。
分析 lwIP 的内存管理实现,梳理动态堆内存与固定大小内存池的初始化、分配、释放流程及相关核心函数。
整理 HPC 学习中的 C/C++ 编译器生态、Fat-Tree 与双平面多轨网络,以及鲲鹏、灵衢平台和 Windows MPI 环境配置。
记录嵌入式 Linux 的网络、交叉编译与远程调试环境配置,以及内核源码下载、配置、编译、文件系统和驱动开发流程。
整理 Xilinx SoC 裸机与 RTOS 软件示例,重点分析内存测试流程、Zynq DRAM 读写测试及眼图测试方法。
记录 AlmaLinux 双系统安装后的配置过程,包括修复 Windows 启动项、挂载 NTFS 硬盘、切换软件源,以及安装 Xilinx、MATLAB、CUDA 等开发工具。
整理 LeetCode 探险模式中的数据结构、算法、数据库、系统设计和数学题目,作为刷题路线与知识点索引。
全站检索
输入关键词开始搜索