题解 | #DNA序列#

DNA序列

http://www.nowcoder.com/practice/e8480ed7501640709354db1cc4ffd42a

题目的主要信息:

给定一个很长的 DNA 序列,以及限定的子串长度 N ,请帮助研究人员在给出的 DNA 序列中从左往右找出 GC-Ratio 最高且长度为 N 的第一个子串。

方法一:

暴力方法。遍历一遍str的所有长度为len的子串,用max保存其中最大的G、C个数,index用来索引G、C个数最多的子串。遍历每一个子串,统计其中的G、C的个数count,count和max比较,如果count>max,则更新max和index的值。

最后用substr函数、index输出对应的子串。

具体做法:

#include<iostream>

using namespace std;

int main(){
    string str;
    int len;
    while(cin >> str >> len)
    {
        int index = 0, max = 0;
        for(int i = 0; i <= str.size()-len; ++i)//遍历每一个子串
        {
            int count = 0;
            for(int j = i; j < i+len; j++){//统计当前子串中G、C的个数
                if(str[j] == 'G' || str[j] == 'C')
                    count ++;
            }
            if(count > max){//如果当前子串的G、C个数比max大,则更新max的值
                max = count;
                index = i;//更新索引
            }
        }
        cout << str.substr(index, len) << endl;//输出子串
    }
    return 0;
}

复杂度分析:

  • 时间复杂度:O(n)O(n),需要遍历所有子串。
  • 空间复杂度:O(1)O(1),只用了常数空间。

方法二:

滑动窗口的思想。整体思想和方法一类似,但是滑动窗口可以减少子串内部的统计,每次窗口向右移动一格,变化的部分只有首位和末位,少了上一个窗口的首位,多了一个末位,我们只需要看这两个位置CG的变化情况,如果上一个窗口的首位是CG,那么count相对于上一个窗口的count少了1个;如果末位是CG,那么count相对于上一个窗口的count多了1个。更新完count后和max比较,判断是否要更新最大窗口的索引。 alt 具体做法:

#include<bits/stdc++.h>
using namespace std;

int main(){
    string str;
    int len;
    cin>>str>>len;
    int max=0;
    int count=0;
    int begin=0;//窗口起始位置
    int end=len-1;//窗口末位置
    map<char,int>map{{'A',0},{'C',1},{'G',1},{'T',0}};//便于快速统计CG数量
    for(int i=0;i<len;i++){//统计第一个窗口中CG的个数用于初始化max
        max+=map[i];
    }
    for(int i=len;i<str.size();i++){//滑动窗口,当前窗口为[i-len+1,i]
        count+=map[str[i]];//str[i]为当前窗口的末位置,判断是否为CG
        count-=map[str[i-len]];//str[i-len]为上一个窗口的起始位置,判断是否为CG
        if(max<count){//更新最大值的信息
            end=i;
            begin=i-len+1;
            max=count;
        }
    }
    cout<<str.substr(begin,len)<<endl;//输出CG个数最多的子串
}

复杂度分析:

  • 时间复杂度:O(n)O(n),需要滑动n次窗口。
  • 空间复杂度:O(1)O(1),只用了常数空间。
全部评论

相关推荐

头像
10-13 18:10
已编辑
东南大学 C++
。收拾收拾心情下一家吧————————————————10.12更新上面不知道怎么的,每次在手机上编辑都会只有最后一行才会显示。原本不想写凉经的,太伤感情了,但过了一天想了想,凉经的拿起来好好整理,就像象棋一样,你进步最快的时候不是你赢棋的时候,而是在输棋的时候。那废话不多说,就做个复盘吧。一面:1,经典自我介绍2,项目盘问,没啥好说的,感觉问的不是很多3,八股问的比较奇怪,他会深挖性地问一些,比如,我知道MMU,那你知不知道QMMU(记得是这个,总之就是MMU前面加一个字母)4,知不知道slab内存分配器-&gt;这个我清楚5,知不知道排序算法,排序算法一般怎么用6,写一道力扣的,最长回文子串反问:1,工作内容2,工作强度3,关于友商的问题-&gt;后面这个问题问HR去了,和中兴有关,数通这个行业和友商相关的不要提,这个行业和别的行业不同,别的行业干同一行的都是竞争关系,数通这个行业的不同企业的关系比较微妙。特别细节的问题我确实不知道,但一面没挂我。接下来是我被挂的二面,先说说我挂在哪里,技术性问题我应该没啥问题,主要是一些解决问题思路上的回答,一方面是这方面我准备的不多,另一方面是这个面试写的是“专业面试二面”,但是感觉问的问题都是一些主管面/综合面才会问的问题,就是不问技术问方法论。我以前形成的思维定式就是专业面会就是会,不会就直说不会,但事实上如果问到方法论性质的问题的话得扯一下皮,不能按照上面这个模式。刚到位置上就看到面试官叹了一口气,有一些不详的预感。我是下午1点45左右面的。1,经典自我介绍2,你是怎么完成这个项目的,分成几个步骤。我大致说了一下。你有没有觉得你的步骤里面缺了一些什么,(这里已经在引导我往他想的那个方向走了),比如你一个人的能力永远是不够的,,,我们平时会有一些组内的会议来沟通我们的所思所想。。。。3,你在项目中遇到的最困难的地方在什么方面4,说一下你知道的TCP/IP协议网络模型中的网络层有关的协议......5,接着4问,你觉得现在的socket有什么样的缺点,有什么样的优化方向?6,中间手撕了一道很简单的快慢指针的问题。大概是在链表的倒数第N个位置插入一个节点。————————————————————————————————————10.13晚更新补充一下一面说的一些奇怪的概念:1,提到了RPC2,提到了fu(第四声)拷贝,我当时说我只知道零拷贝,知道mmap,然后他说mmap是其中的一种方式,然后他问我知不知道DPDK,我说不知道,他说这个是一个高性能的拷贝方式3,MMU这个前面加了一个什么字母我这里没记,别问我了4,后面还提到了LTU,VFIO,孩子真的不会。
走呀走:华子二面可能会有场景题的,是有些开放性的问题了
点赞 评论 收藏
分享
评论
点赞
收藏
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务