24小时热门版块排行榜    

查看: 3619  |  回复: 17
当前只显示满足指定条件的回帖,点击这里查看本话题的所有回帖

sijifengsd

银虫 (小有名气)

[交流] 【经验】用Modeller补全残基学习心得已有8人参与

最近专注于分子动力学的模拟研究。发现好多的蛋白质晶体结构或多或少的有一部分残基丢失了,要做动力学模拟,就需要把丢失的残基给补上。看文献发现比较公认的、又是免费的软件当属Modeller了。所以本人花了两个周的时间研究了这个软件的使用方法。现把个人的心得体会奉献出来,希望给需要的同学们提供点帮助:
首先大家可以到这个网站 申请个序列号,下载个免费的软件:
http://salilab.org/modeller/registration.html
安装成功就可用了。
这个软件要用到一些脚本文件,补全残基可以带着配体,水,也可以不带。
一 没有配体、水分子:
第一步 处理大分子pdb 文件,删除杂原子 和水分子等。
第二步 建立一个get_ali.py 脚本文件

# get sequece of the 2FMX PDB file, and write to an alignment file.

log.verbose()
env = environ()

env.io.atom_files_directories = ['.', '../atom_file']

code = '2FMX'
m = model(env, file=code)
aln = alignment(env)

aln.append_model(m, align_codes=code)
aln.write(code+'.seq')

第三步 :运行 modpv7 get_ali.py 产生一个sequence 文件:2FMX.seq

>P1;2FMX
structureX:2FMX:  13 :A:+556 :B:MOL_ID  1; MOLECULE  GTP-BINDING PROTEIN SAR1B; CHAIN  A, B; FRAGMENT  RESIDUES 10-198; SYNONYM  SAR1, GTBPB; ENGINEERED  YES:MOL_ID  1; ORGANISM_SCIENTIFIC  CRICETULUS GRISEUS; ORGANISM_COMMON  CHINESE HAMSTER; ORGANISM_TAXID  10029; EXPRESSION_SYSTEM  ESCHERICHIA COLI; EXPRESSION_SYSTEM_TAXID  562; EXPRESSION_SYSTEM_VECTOR_TYPE  PLASMID; EXPRESSION_SYSTEM_PLASMID  PET11D: 1.82:-1.00
SSVLQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEELTIAGMTFTTFDLGRVWKNYLPAI
NGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEERLREMFGLYGQTTGKGSVSLKEL
NARPLEVFMCSVLKRQGYGEGFRWMAQYID
第四步:用产生的序列文件产生一个alignment.ali脚本文件:把上面的序列复制到脚本中

>P1;2FMX
structureX:2FMX.pdb:   13 :A:4872 :A:undefined:undefined:-1.00:-1.00
SSVL---QFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEELTIAGMTFTTFDLGRVWKNYLPAI
NGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEERLREMFGLYGQTTGKGSVSLKEL
NARPLEVFMCSVLKRQGYGEGFRWMAQYID---

>P1;2FMX_fill
sequence:2FMX_fill:     :A  :     :A ::: 0.00: 0.00
SSVLHJKQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEELTIAGMTFTTFDLGRVWKNYLPAI
NGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEERLREMFGLYGQTTGKGSVSLKEL
NARPLEVFMCSVLKRQGYGEGFRWMAQYIDLPO
注意:上面的一个序列是pdb源文件的残基,而下面是加上缺失残基的全序列。13 :A:4872 A:表示在源文件中开始和结束的残基序号。
第五步 建立一个select.py文件 ,在这个文件中我们只优化补全的那部分残基。

from modeller import *
from modeller.automodel import * # Load the automodel class

log.verbose()
env = environ()

# directories for input atom files
env.io.atom_files_directories = ['.', '../atom_file']
class MyModel(loopmodel):
    def select_atoms(self):
        return selection(self.residue_range('1:A', '9:A'),
                         self.residue_range('68:A', '73:A'),
               
a = MyModel(env,
            alnfile = 'alignment.ali',
            knowns = '2FMX',
            sequence = '2FMX_fill')

a.starting_model = 1
a.ending_model = 2

a.make()

注释: 上面的'1:A', '9:A','68:A', '73:A' 是加入的那部分残基在从1开始中的序列编号;下面的红字表示可以改动的地方。class MyModel(automodel) 中的automodel也可以换成loopmodel,这样对已loop区的优化更好。
第六步 运行 mod9v7 select.py 结果提取pdb文件即可。
二 包含配体和水分子
第一步 大分子就不要处理了。
第二步 建立一个get_ali.py 脚本文件

# get sequece of the 2FMX PDB file, and write to an alignment file.

log.verbose()
env = environ()

env.io.atom_files_directories = ['.', '../atom_file']

code = '2FMX'
m = model(env, file=code)
aln = alignment(env)

aln.append_model(m, align_codes=code)
aln.write(code+'.seq')

第三步 :运行 modpv7 get_ali.py 产生一个sequence 文件:2FMX.seq

>P1;2FMX
structureX:2FMX:  13 :A:+556 :B:MOL_ID  1; MOLECULE  GTP-BINDING PROTEIN SAR1B; CHAIN  A, B; FRAGMENT  RESIDUES 10-198; SYNONYM  SAR1, GTBPB; ENGINEERED  YES:MOL_ID  1; ORGANISM_SCIENTIFIC  CRICETULUS GRISEUS; ORGANISM_COMMON  CHINESE HAMSTER; ORGANISM_TAXID  10029; EXPRESSION_SYSTEM  ESCHERICHIA COLI; EXPRESSION_SYSTEM_TAXID  562; EXPRESSION_SYSTEM_VECTOR_TYPE  PLASMID; EXPRESSION_SYSTEM_PLASMID  PET11D: 1.82:-1.00
SSVLQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEELTIAGMTFTTFDLGRVWKNYLPAI
NGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEERLREMFGLYGQTTGKGSVSLKEL
NARPLEVFMCSVLKRQGYGEGFRWMAQYID
第四步:用产生的序列文件产生一个alignment.ali脚本文件:把上面的序列复制到脚本中

>P1;2FMX
structureX:2FMX.pdb:   13 :A:4890 :A:undefined:undefined:-1.00:-1.00
SSVL---QFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEELTIAGMTFTTFDLGRVWKNYLPAI
NGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEERLREMFGLYGQTTGKGSVSLKEL
NARPLEVFMCSVLKRQGYGEGFRWMAQYID---.wwwwwwwwwwww

>P1;2FMX_fill
sequence:2FMX_fill:     :A  :     :A ::: 0.00: 0.00
SSVLHJKQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEELTIAGMTFTTFDLGRVWKNYLPAI
NGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEERLREMFGLYGQTTGKGSVSLKEL
NARPLEVFMCSVLKRQGYGEGFRWMAQYIDLPO. wwwwwwwwwwww
注意:到这一步和上面有区别了,因为有配体和水分子就要在序列的后面加上”.(表示配体,有几个配体杂原子加几个点)” 和”w(表示水分子,有几个加几个w)”。如果水分子和配体时单独成链的要加/例如:/. Wwwwwwwwwwww,或者 . /wwwwwwwwwwww
第五步 建立一个select.py文件 ,在这个文件中我们只优化补全的那部分残基。

from modeller import *
from modeller.automodel import * # Load the automodel class

log.verbose()
env = environ()
env.io.water = True
env.io.hetatm = True

# directories for input atom files
env.io.atom_files_directories = ['.', '../atom_file']
class MyModel(loopmodel):
    def select_atoms(self):
        return selection(self.residue_range('1:A', '9:A'),
                         self.residue_range('68:A', '73:A'),
               
a = MyModel(env,
            alnfile = 'alignment.ali',
            knowns = '2FMX',
            sequence = '2FMX_fill')

a.starting_model = 1
a.ending_model = 2

a.make()

注释:这里加入了env.io.water = True  env.io.hetatm = True还识别水分子和配体。
第六步 运行 mod9v7 select.py 结果提取pdb文件即可
三 复杂点的 比如两条链的

第一步 下载pdb
第二步 建立一个get_ali.py 脚本文件

# get sequece of the 2FMX PDB file, and write to an alignment file.

log.verbose()
env = environ()
env.io.water = True
env.io.hetatm = True

env.io.atom_files_directories = ['.', '../atom_file']

code = '2FMX'
m = model(env, file=code)
aln = alignment(env)

aln.append_model(m, align_codes=code)
aln.write(code+'.seq')
注:这里直接用env.io.water = True  nv.io.hetatm = True 会直接把配体、水给你表示出来

第三步 :运行 modpv7 get_ali.py 产生一个sequence 文件:2FMX.seq
>P1;2FMX
structureX:2FMX:  13 :A:+556 :B:MOL_ID  1; MOLECULE  GTP-BINDING PROTEIN SAR1B; CHAIN  A, B; FRAGMENT  RESIDUES 10-198; SYNONYM  SAR1, GTBPB; ENGINEERED  YES:MOL_ID  1; ORGANISM_SCIENTIFIC  CRICETULUS GRISEUS; ORGANISM_COMMON  CHINESE HAMSTER; ORGANISM_TAXID  10029; EXPRESSION_SYSTEM  ESCHERICHIA COLI; EXPRESSION_SYSTEM_TAXID  562; EXPRESSION_SYSTEM_VECTOR_TYPE  PLASMID; EXPRESSION_SYSTEM_PLASMID  PET11D: 1.82:-1.00
SSVLQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEELTIAGMTFTTFDLGRVWKNYLPAI
NGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEERLREMFGLYGQTTGKGSVSLKEL
NARPLEVFMCSVLKRQGYGEGFRWMAQYID/SSVLQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDPTLHPTSEE
LTIAGMTFTTFDLGVWKNYLPAINGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEE
RLREMFGLYGQTTGKGSVSLKELNARPLEVFMCSVLKRQGYGEGFRWMAQYID/.x/.$x/wwwwwwwwwwwwww
wwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwww
wwwwwwwww/wwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwww
wwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwww*

第四步:用产生的序列文件产生一个alignment.ali脚本文件:把上面的序列复制到脚本中

>P1;2FMX
structureX:2FMX.pdb:   13 :A:4872 :B:undefined:undefined:-1.00:-1.00
---------SSVLQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEELTIAGMTFTTFDLG------RVWKNYLPAI
NGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEERLREMFGLYGQTTGKGSVSLKEL
NARPLEVFMCSVLKRQGYGEGFRWMAQYID/---------SSVLQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKD-------PTLHPTSEE
LTIAGMTFTTFDLG-------VWKNYLPAINGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEE
RLREMFGLYGQTTGKGSVSLKELNARPLEVFMCSVLKRQGYGEGFRWMAQYID/.x/.$x/wwwwwwwwwwwwww
wwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwww
wwwwwwwww/wwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwww
wwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwww*

>P1;2FMX_fill
sequence:2FMX_fill:     :A  :     :B ::: 0.00: 0.00
HHHHHHSGFSSVLQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEELTIAGMTFTTFDLGGHIQARRVWKNYLPAI
NGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEERLREMFGLYGQTTGKGSVSLKEL
NARPLEVFMCSVLKRQGYGEGFRWMAQYID/HHHHHHSGFSSVLQFLGLYKKTGKLVFLGLDNAGKTTLLHMLKDDRLGQHVPTLHPTSEE
LTIAGMTFTTFDLGGHIQARRVWKNYLPAINGIVFLVDCADHERLLESKEELDSLMTDETIANVPILILGNKIDRPEAISEE
RLREMFGLYGQTTGKGSVSLKELNARPLEVFMCSVLKRQGYGEGFRWMAQYID/.x/.$x/wwwwwwwwwwwwww
wwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwww
wwwwwwwww/wwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwww
wwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwwww*
第五步 建立一个select.py文件 ,在这个文件中我们只优化补全的那部分残基。

from modeller import *
from modeller.automodel import * # Load the automodel class

log.verbose()
env = environ()

# directories for input atom files
env.io.atom_files_directories = ['.', '../atom_file']
env.io.water = True
env.io.hetatm = True


class MyModel(loopmodel):
    def select_atoms(self):
        return selection(self.residue_range('1:A', '9:A'),
                         self.residue_range('68:A', '73:A'),
                         self.residue_range('196:B', '204:B'),
                         self.residue_range('240:B', '246:B'),
                         self.residue_range('270:B', '276:B'))
                        
                                      
a = MyModel(env,
            alnfile = 'ali-ligand.ali',
            knowns = '2FMX',
            sequence = '2FMX_fill')

a.starting_model = 1
a.ending_model = 2

a.make()
注释:这里因为有两条链所以编号时B链的是在A链的基础上编的
第六步 运行 mod9v7 select.py 结果提取pdb文件即可上面说的只是一些基本的东西,要想深入的学好Modeller 还要花点时间看看在线的tutorial
http://salilab.org/modeller/tutorial/

[ Last edited by lei0736 on 2009-11-24 at 22:03 ]
回复此楼

» 收录本帖的淘贴专辑推荐

分子模拟 值得借鉴的经验 分子模拟 高通量虚拟筛选

» 本帖已获得的红花(最新10朵)

» 猜你喜欢

» 本主题相关商家推荐: (我也要在这里推广)

» 本主题相关价值贴推荐,对您同样有帮助:

似水年华
已阅   回复此楼   关注TA 给TA发消息 送TA红花 TA的回帖

大宝贝壳

新虫 (初入文坛)


小木虫: 金币+0.5, 给个红包,谢谢回帖
你好,我也是初学者,不知道13 :A:4872 A:表示在源文件中开始和结束的残基序号是怎么数的呢,我数了一下,一共只有186个残基呀,非常期待你的答复
18楼2013-07-06 08:58:19
已阅   回复此楼   关注TA 给TA发消息 送TA红花 TA的回帖
相关版块跳转 我要订阅楼主 sijifengsd 的主题更新
最具人气热帖推荐 [查看全部] 作者 回/看 最后发表
[基金申请] 刚刚收到科研之友邮件 +9 olivermiaoer 2024-06-19 11/550 2024-06-20 06:49 by kobe0107
[基金申请] 工材口青年基金上会可能性 +5 今晚推荐22 2024-06-19 7/350 2024-06-20 01:49 by yifeng11
[基金申请] 面青地会评时间??? +5 Axvdvbfs 2024-06-19 5/250 2024-06-19 21:11 by 人民海军
[基金申请] F口信息学部拿面上,大概需要什么样的成果 +7 _奋黎_ 2024-06-16 18/900 2024-06-19 20:02 by _奋黎_
[论文投稿] 有化学投稿的期刊推荐吗 20+3 荣小撇 2024-06-13 3/150 2024-06-19 19:29 by 瓦列利安
[基金申请] 面上基金有一个(两个)C是不是就没戏了.... 5+4 zzzm116 2024-06-13 21/1050 2024-06-19 18:35 by 匿名374
[论文投稿] 审稿 +5 香瓜木香 2024-06-19 6/300 2024-06-19 17:44 by xli1984
[教师之家] 试用期辞职 +9 ZHONGWU_U 2024-06-18 14/700 2024-06-19 12:36 by ZHONGWU_U
[公派出国] 去英国的小伙伴儿都在哪儿租的房子呀? +7 65syn 2024-06-14 11/550 2024-06-19 10:19 by 65syn
[硕博家园] 关于硕博连读的一些疑问? +8 Lwenter 2024-06-14 10/500 2024-06-19 10:00 by qingdao001
[论文投稿] 审稿人含糊拒稿,还需要回复吗?如何回复? 20+4 BruceChum 2024-06-15 22/1100 2024-06-19 08:00 by kanyechris
[论文投稿] 二审返修送审10天了,原来一审的3个审稿人只有2个接受了审稿,会邀请新审稿人么? 50+3 huanpo116 2024-06-15 5/250 2024-06-16 10:27 by bobvan
[基金申请] 博士后创新人才支持计划公示 +9 aishida144 2024-06-14 15/750 2024-06-16 09:52 by msjy
[论文投稿] 投稿被一个审稿人恶意评审了怎么样? +5 1chen 2024-06-14 7/350 2024-06-15 23:15 by xy66xy
[论文投稿] 投稿时忘记修改一作 +7 gll123456 2024-06-13 11/550 2024-06-15 11:49 by gll123456
[基金申请] 博后基金,以往的结果点不开,怎么回事呢?最后一次机会了,两次都没中前面。 +7 kyukitu 2024-06-14 13/650 2024-06-15 06:46 by 我是王小帅
[基金申请] 博士后基金需要结题吗? +8 zhouchuck 2024-06-13 8/400 2024-06-14 17:27 by liuyupu132
[考博] 申博找导师 +4 疏影横斜水清浅3 2024-06-13 6/300 2024-06-14 14:31 by zxl_1105
[有机交流] ππ堆积会发生在有机溶剂中吗 5+3 zibuyu0420 2024-06-13 4/200 2024-06-14 14:17 by 小肉干
[基金申请] 博士后面上项目状态还是专家评审吗 10+9 Thatcheremu 2024-06-13 55/2750 2024-06-13 21:23 by 乌合麒麟
信息提示
请填处理意见