【发布时间】:2019-10-30 09:47:08
【问题描述】:
我的数据中有字符串,在我的输出中看起来像这样:
string_sequence = 'MLSPDLPDSAWNTRLLCRVMLCLLGAGSVAAGVIQSPRHLIKEKRETATLKCYPIPRHDTVYWYQQGPGQDPQFLISFYEKMQSDKGSIPDRFSAQQFSDYHSELNMSSLELGDSALYFCASSL'
在下一步中,我必须用 typsin-enzym 消化这个氨基酸序列,它将序列从字符串 K 和 R 中分离出来,但如果有 P 它就没有。
输出是我需要的肽,并保存在列表的数据类型中,如下所示:
list_sequence = ['MLSPDLPDSAWNTR', 'LLCR', 'VMLCLLGAGSVAAGVIQSPR', 'HLIK', 'EK', 'R', 'ETATLK', 'CYPIPR', 'HDTVYWYQQGPGQDPQFLISFYEK', 'MQSDK', 'GSIPDR', 'FSAQQFSDYHSELNMSSLELGDSALYFCASSL']
现在我的索引有问题,我可以在我的数据库中找到它。
在氨基酸序列的第 18 位是V。
我现在必须在我的列表数据类型中的完全相同的位置找到V。
我可以通过手工计算氨基酸来找到这一点,但在 1000 个氨基酸的序列长度中,这可能是个问题。
我现在的想法是这样的:
我知道每个list_sequence[i]的索引都是以0开头的。
有什么办法,我可以在我的代码中说list_sequence[1] 中的索引以len(list_sequence[0]) 开头,list_sequence[2] 的索引以18 开头。所以在最后一个位置之后的下一个数字list_sequence-index.
感谢您的贡献!
【问题讨论】:
-
你能澄清一下“list_sequence[2] 的索引以 18 开头”是什么意思吗?索引是一个数字,它不能以数字开头。你想让
list_sequence[2]返回V还是VMLCLLGAGSVAAGVIQSPR?或者您只是想要一个从list_sequence到string_sequence的索引的单独 映射? -
所有 list_sequence-indices 中都有一个字符串。这些索引总是从零开始。我的问题或目标是更改这些索引的起始编号。你知道python中有什么功能可以做到这一点吗?
-
所以你想让
list_sequence[2][18]返回V?和list_sequence[2][17]成为IndexError? -
list_sequence 中的第一个案例丢失了 18,因为我将字符串转换为列表。由于将所有 list_sequence[i] 的开头覆盖为零,因此位置会丢失
-
我了解您丢失了哪些信息。我了解您想保留它,但不是您需要的格式。
标签: python python-3.x list indexing