码迷,mamicode.com
首页 > 其他好文 > 详细

187 Repeated DNA Sequences 重复的DNA序列

时间:2018-04-07 18:58:04      阅读:135      评论:0      收藏:0      [点我收藏+]

标签:识别   leetcode   lse   tps   www   字母   logs   seq   ++   

所有DNA由一系列缩写为A,C,G和 T 的核苷酸组成,例如:“ACGAATTCCG”。在研究DNA时,识别DNA中的重复序列有时非常有用。
编写一个函数来查找DNA分子中所有出现超多一次的10个字母长的序列(子串)。

详见:https://leetcode.com/problems/repeated-dna-sequences/description/

class Solution {
public:
    vector<string> findRepeatedDnaSequences(string s) {
        vector<string> res;
        if (s.size() <= 10)
        {
            return res;
        }
        int mask = 0x7ffffff;
        unordered_map<int, int> m;
        int cur = 0, i = 0;
        while (i < 9) 
        {
            cur = (cur << 3) | (s[i++] & 7);
        }
        while (i < s.size())
        {
            cur = ((cur & mask) << 3) | (s[i++] & 7);
            if (m.find(cur) != m.end())
            {
                if (m[cur] == 1)
                {
                    res.push_back(s.substr(i - 10, 10));
                }
                ++m[cur]; 
            } 
            else 
            {
                m[cur] = 1;
            }
        }
        return res;
    }
};

 参考:https://www.cnblogs.com/grandyang/p/4284205.html

187 Repeated DNA Sequences 重复的DNA序列

标签:识别   leetcode   lse   tps   www   字母   logs   seq   ++   

原文地址:https://www.cnblogs.com/xidian2014/p/8733860.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!