24小时热门版块排行榜    

查看: 3574  |  回复: 9
当前只显示满足指定条件的回帖,点击这里查看本话题的所有回帖

Prettyswan

木虫 (小有名气)

[交流] 【求助】如何使用openmpi在多节点并行计算?已有3人参与

集群上使用的是openmpi,PBS有点问题,所以我一直用命令“mpirun -np 8 vasp”提交任务。不知道如何使用命令进行多节点的并行计算(把一个任务分配到多个节点上)。
在《并行计算导论》上查到关于mpich的使用:
引用回帖:
5. 运行MPICH程序
多机环境中运行MPICH程序与单机环境类似,可以用mpirun来进行。运行程序前先创建一个machinefile文件,其中列出要使用的结点机名,然后用命令“mpirun -machinefile 文件名 ...”来在指定的结点上运行程序。例如,假设用户登录在结点node2上,文件mfile中包含下述内容:
node3
node4
则命令:
mpirun -machinefile mfile -np 3 cpi
将用node2,node3 和node4来运行程序cpi,每个结点一个进程,这是因为默认情况下mpirun总是将当前结点添加到程序的结点机列表中。如果不希望使用当前结点(node2),可以加上-nolocal选项:
mpirun -nolocal -machinefile mfile -np 3 cpi
选项-np给出的进程数与-machinefile给出的文件中的结点机数不一定要相等。如果进程数少于结点机数,则程序只使用其中的一部分结点。如果进程数多于结点机数,则一些结点上会运行多于一个进程。

我参考着使用了一下
CODE:
[zhuqx_hp@node3 Se]$ nohup /home/software/openmpi-1.2.2-intel9/bin/mpirun -machiefile INCAR KPOINTS POTCAR POSCAR -np 8 /home/bin/vasp.openmpi >out

结果报错了
引用回帖:
--------------------------------------------------------------------------
Open RTE detected a parse error in the hostfile:
    INCAR
It occured on line number 1 on token 3.
--------------------------------------------------------------------------
[node3:26677] [0,0,0] ORTE_ERROR_LOG: Error in file rmgr_urm.c at line 358
[node3:26677] mpirun: spawn failed with errno=-1

machinefile:
引用回帖:
node2
node4
node5
node6
node7

请教了。谢谢

[ Last edited by Prettyswan on 2010-7-7 at 15:38 ]
回复此楼
已阅   回复此楼   关注TA 给TA发消息 送TA红花 TA的回帖

风间的记忆

铁杆木虫 (著名写手)


zzy870720z(金币+1):谢谢建议 2010-08-11 10:33:33
好吧

我说实话

你基本的MPIRUN的命令都不对~~~~~

1)咨询你们的系统管理员

2)使用说明上已经表述的很清楚,option很多,自己仔细看。肯定可以看明白的

[ Last edited by 风间的记忆 on 2010-8-11 at 09:51 ]
九州浩淼,任其东西,明日何在,但随我意。
10楼2010-08-11 09:43:29
已阅   回复此楼   关注TA 给TA发消息 送TA红花 TA的回帖
相关版块跳转 我要订阅楼主 Prettyswan 的主题更新
普通表情 高级回复(可上传附件)
信息提示
请填处理意见