华为OD机考2025B卷 - DNA序列(Java & Python& JS & C++ & C )

最新华为OD机试

真题目录:点击查看目录
华为OD面试真题精选:点击立即查看

2025华为od 机试2025B卷-华为机考OD2025年B卷

题目描述

一个 DNA 序列由 A/C/G/T 四个字母的排列组合组成。 G 和 C 的比例(定义为 GC-Ratio )是序列中 G 和 C 两个字母的总的出现次数除以总的字母数目(也就是序列长度)。在基因工程中,这个比例非常重要。因为高的 GC-Ratio 可能是基因的起始点。

给定一个很长的 DNA 序列,以及限定的子串长度 N ,请帮助研究人员在给出的 DNA 序列中从左往右找出 GC-Ratio 最高且长度为 N 的第一个子串。

DNA序列为 ACGT 的子串有: ACG , CG , CGT 等等,但是没有 AGT , CT 等等

数据范围:字符串长度满足 1≤n≤1000 1≤n≤1000 ,输入的字符串只包含 A/C/G/T 字母

输入描述

输入一个string型基因序列,和int型子串的长度

输出描述

找出GC比例最高的子串,如果有多个则输出第一个的子串

示例1

输入

ACGT
2

输出

CG

说明

ACGT长度为2的子串有AC,CG,GT3个,其中AC和GT2个的GC-Ratio都为0.5,CG为1,故输出CG

示例2

输入

AACTGTGCACGACCTGA
5

输出

GCACG

说明

虽然CGACC的GC-Ratio也是最高,但它是从左往右找到的GC-Ratio最高的第2个子串,所以只能输出GCACG。

解题思路

滑动窗口算法是解决这类子串问题的理想方法,尤其在需要查找固定长度子串的特定特性时。对于寻找最高GC比率的DNA子串问题:

  1. 窗口定义:固定大小为子串长度的窗口,在DNA序列上从左到右滑动

  2. 初始窗口:计算序列开头的第一个子串中G和C的数量,得到初始GC比率

  3. 窗口滑动:窗口向右移动时,只需考虑两个变化:

    • 移出窗口的字符(如果是G或C,GC计数减1)
    • 移入窗口的新字符(如果是G或C,GC计数加1)
  4. 增量计算:无需重新扫描整个子串,只需调整计数器

    • 时间复杂度从O

你可能感兴趣的:(华为OD机试真题,(Java/JS/Py/C),最新华为OD机试真题,java,华为od,python,javascript,c++)