∑

数学知识体系

Observatory Archive of Mathematics
⌕2026/8/31
概念

高性能计算

MPI 并行与 GPU 加速让大规模模拟可行,稀疏矩阵存储与 Krylov 求解器是核心组件,支撑气象、核模拟等大科学工程。

所属主题:计算数学 ↗
阅读路径

参考可汗学院 Get ready 机制:先修概念 → 当前概念 → 进阶概念,✓ 表示已读。

当前概念

高性能计算计算数学

进阶概念

01定义

当问题规模超出单机能力,计算必须并行化:MPI 消息传递连接成千上万 CPU 核心,GPU 以海量线程加速规整计算,稀疏矩阵格式与 Krylov 求解器支撑迭代收敛——大科学工程的数值引擎是算法与硬件的联合设计。
CPU 0 CPU 1 CPU 2 CPU 3 MPI:边界数据交换 GPU:数千线程并行 加速比受限:通信开销 + 负载不均(Amdahl 定律) CSR 稀疏存储 + 预条件 Krylov = 大规模迭代标配
并行架构:CPU 集群与 GPU 的分工

02核心要点

01

并行模式

域分解把网格切片分给各进程,边界靠 MPI 交换;GPU 擅长大规模规整线程(SpMV、FFT);混合并行(MPI + OpenMP + CUDA)是百亿亿次超算的标准配方。

02

可扩展性

强扩展(固定总量加核)终将撞上通信墙;弱扩展(每核工作量固定)更现实:多重网格与域分解预条件保持迭代次数不随核数增长——算法可扩展性比硬件更关键。

03

可重复与验证

大规模模拟需代码验证(method of manufactured solutions)与不确定性量化;浮点不可重复性是并行规约的固有特性——科学计算也要软件工程的纪律。

03关键公式

S(p)=T1Tp≤1s+(1−s)/p (Amdahl)S(p)=\frac{T_1}{T_p}\leq\frac{1}{s+(1-s)/p}\ (\text{Amdahl})

04历史沿革

MPI 标准 1994 年发布;CUDA 2007 年开启 GPU 通用计算;美国能源部的 ASCI 计划(1995 年起)推动核武器数值模拟成为高性能计算的第一用户。

05应用与延伸

气候与天气预报、核聚变等离子体模拟、地震波传播与油气勘探、药物分子动力学(AlphaFold 背后的算力)。

06交互演示

Amdahl 定律:并行加速的天花板拖 s:串行占比决定加速比的极限 1/s;p 越大越贴近天花板

07相关概念