Python读取fasta格式数据成为字典形式。

本团队提供生物医学领域专业的AI(机器学习、深度学习)技术支持服务。如果您有需求,请扫描文末二维码关注我们。

在这里插入图片描述


Python读取fasta格式数据成为字典形式。

def read_fasta(file_path):
    """
    读取FASTA格式文件,并返回一个包含序列ID和序列的字典。
    
    :param file_path: FASTA文件的路径
    :return: 一个字典,键为序列ID,值为相应的序列
    """
    sequences = {}
    sequence_id = None
    sequence_lines = []
    
    with open(file_path, 'r') as file:
        for line in file:
            line = line.strip()
            if line.startswith('>'):
                if sequence_id is not None:
                    sequences[sequence_id] = ''.join(sequence_lines)
                sequence_id = line[1:]  # 去掉 '>' 并获取序列ID
                sequence_lines = []
            else:
                sequence_lines.append(line)
        
        # Don't forget to add the last sequence after the loop
        if sequence_id is not None:
            sequences[sequence_id] = ''.join(sequence_lines)
    
    return sequences


在这里插入图片描述

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值