高性能计算
MPI 并行与 GPU 加速让大规模模拟可行,稀疏矩阵存储与 Krylov 求解器是核心组件,支撑气象、核模拟等大科学工程。
所属主题:计算数学 ↗阅读路径
参考可汗学院 Get ready 机制:先修概念 → 当前概念 → 进阶概念,✓ 表示已读。
01定义
当问题规模超出单机能力,计算必须并行化:MPI 消息传递连接成千上万 CPU 核心,GPU 以海量线程加速规整计算,稀疏矩阵格式与 Krylov 求解器支撑迭代收敛——大科学工程的数值引擎是算法与硬件的联合设计。
02核心要点
01
并行模式
域分解把网格切片分给各进程,边界靠 MPI 交换;GPU 擅长大规模规整线程(SpMV、FFT);混合并行(MPI + OpenMP + CUDA)是百亿亿次超算的标准配方。
02
可扩展性
强扩展(固定总量加核)终将撞上通信墙;弱扩展(每核工作量固定)更现实:多重网格与域分解预条件保持迭代次数不随核数增长——算法可扩展性比硬件更关键。
03
可重复与验证
大规模模拟需代码验证(method of manufactured solutions)与不确定性量化;浮点不可重复性是并行规约的固有特性——科学计算也要软件工程的纪律。
03关键公式
04历史沿革
MPI 标准 1994 年发布;CUDA 2007 年开启 GPU 通用计算;美国能源部的 ASCI 计划(1995 年起)推动核武器数值模拟成为高性能计算的第一用户。
05应用与延伸
气候与天气预报、核聚变等离子体模拟、地震波传播与油气勘探、药物分子动力学(AlphaFold 背后的算力)。
06交互演示
Amdahl 定律:并行加速的天花板拖 s:串行占比决定加速比的极限 1/s;p 越大越贴近天花板