编译与性能库
CPU代码编译建议:module load gcc/12.3 后使用 -O3 -march=native;OpenMPI程序加 -fopenmp 并设置 OMP_NUM_THREADS=$SLURM_CPUS_PER_TASK。
MKL/BLAS已预装,NumPy等会自动调用。确认链接库:ldd ./my_program。
跨节点MPI作业:--nodes=2 --ntasks-per-node=32 --cpus-per-task=1,并 module load openmpi/4.1 后用 srun mpirun ./a.out 方式启动(不要直接mpirun,否则可能只用到单节点)。
同分类文档