青苗网络安全大学智能计算中心 · 天枢算力平台 工作台| 校外访问| 网络信息中心| 学校主页
智能计算中心 INTELLIGENT COMPUTING CENTER · 天枢 TENGSU CLUSTER
当前位置:首页 > 用户文档 > 软件环境

编译与性能库

分类:软件环境 · 更新日期:2026年09月15日

CPU代码编译建议:module load gcc/12.3 后使用 -O3 -march=native;OpenMPI程序加 -fopenmp 并设置 OMP_NUM_THREADS=$SLURM_CPUS_PER_TASK。

MKL/BLAS已预装,NumPy等会自动调用。确认链接库:ldd ./my_program。

跨节点MPI作业:--nodes=2 --ntasks-per-node=32 --cpus-per-task=1,并 module load openmpi/4.1 后用 srun mpirun ./a.out 方式启动(不要直接mpirun,否则可能只用到单节点)。