DAY39:贪心算法(八)无重叠区间+划分字母区间+合并区间-程序员宅基地

技术标签: 算法  c++  贪心算法  leetcode  刷题记录  

435.无重叠区间

给定一个区间的集合 intervals ,其中 intervals[i] = [starti, endi] 。返回 需要移除区间的最小数量,使剩余区间互不重叠 。

示例 1:

输入: intervals = [[1,2],[2,3],[3,4],[1,3]]
输出: 1
解释: 移除 [1,3] 后,剩下的区间没有重叠。

示例 2:

输入: intervals = [ [1,2], [1,2], [1,2] ]
输出: 2
解释: 你需要移除两个 [1,2] 来使剩下的区间没有重叠。

示例 3:

输入: intervals = [ [1,2], [2,3] ]
输出: 0
解释: 你不需要移除任何区间,因为它们已经是无重叠的了。

提示:

  • 1 <= intervals.length <= 10^5
  • intervals[i].length == 2
  • -5 * 10^4 <= starti < endi <= 5 * 10^4

思路

本题和上一题的引爆气球有点像,也是重叠区间的问题。本题是判断删掉多少个区间,能够得到不重合的区间组合。如下图:

在这里插入图片描述
第一步仍然是按照左边界排序,让所有区间按照大小顺序排在一起。

判断相邻两个区间不重叠,也就是i区间左边界>=i-1区间的右边界

if(i>0&&nums[i][0]>nums[i-1][1]){
    
    continue;//不重叠直接继续遍历
}

判断区间如果重叠,那么计数+1(重叠的一定要删掉),和气球题目类似,依旧取最小右边界,看看下一个区间是否重叠

else{
    
    result++;
    //修改右边界
    nums[i][1]=min(nums[i][1],nums[i-1][1]);//修改后继续遍历即可
}

完整版

class Solution {
    
public:
    static bool cmp(vector<int>&a,vector<int>&b){
    
        if(a[0]<b[0])  return true;//左边界升序排序
        return false;
    }
    int eraseOverlapIntervals(vector<vector<int>>& intervals) {
    
        if(intervals.size()==0) return 0;
        sort(intervals.begin(),intervals.end(),cmp);
        int count=0;
        for(int i=1;i<intervals.size();i++){
    
            if(intervals[i][0]>=intervals[i-1][1])  continue;
            //如果重叠,更新最小右边界
            else{
    
                count++;
                intervals[i][1]=min(intervals[i][1],intervals[i-1][1]);
            }
        }
		return count;
    }
};
注意点

在我们自己画图模拟重叠区间的时候,一定要注意,更新最小右边界之后,实际上重叠的区间相当于已经被修改了!也就是说,当前重叠区间的右边界,已经成为最小右边界了

重叠区间原有右边界需要及时在图里删掉,否则容易出现看图看错逻辑的情况。模拟图如下图所示。

在这里插入图片描述
这种情况遍历到7的时候,实际上7前面和8重合的部分,8已经被删掉了,所以并不会出现i=3的重合。

在这里插入图片描述

右区间排序

  • 本题实际上改成右区间排序也能过,因为右区间其实找的还是重叠区间中的最小右区间,只修改cmp即可
class Solution {
    
public:
    static bool cmp(vector<int>&a,vector<int>&b){
    
        if(a[1]<b[1])  return true;//右边界升序排序
        return false;
    }
    int eraseOverlapIntervals(vector<vector<int>>& intervals) {
    
        if(intervals.size()==0) return 0;
        sort(intervals.begin(),intervals.end(),cmp);
        int count=0;
        for(int i=1;i<intervals.size();i++){
    
            if(intervals[i][0]>=intervals[i-1][1])  continue;
            //如果重叠,更新最小右边界
            else{
    
                count++;
                intervals[i][1]=min(intervals[i][1],intervals[i-1][1]);
            }
        }
		return count;
    }
};

763.划分字母区间

给你一个字符串 s 。我们要把这个字符串划分为尽可能多的片段,同一字母最多出现在一个片段中

注意,划分结果需要满足:将所有划分结果按顺序连接,得到的字符串仍然是 s

返回一个表示每个字符串片段的长度的列表。

示例 1:

输入:s = "ababcbacadefegdehijhklij"
输出:[9,7,8]
解释:
划分结果为 "ababcbaca""defegde""hijhklij" 。
每个字母最多出现在一个片段中。
像 "ababcbacadefegde", "hijhklij" 这样的划分是错误的,因为划分的片段数较少。 

示例 2:

输入:s = "eccbbbbdec"
输出:[10]

提示:

  • 1 <= s.length <= 500
  • s 仅由小写英文字母组成

思路

本题首先要理解题意。题目中说同一字母最多出现在一个片段中,也就是说,对字母a来说,划分出来的片段应该包括所有的a。同时还要保证划分出来的片段数目是最多的。

也就是说,一旦包含a,就要包含所有的a,一旦包含b就要包含所有的b

因此,本题的策略是找到每个元素的最远位置,然后看区间之间的包含关系。如下图所示:

在这里插入图片描述
a的最远位置包含了b和c的最远位置。因此第一个区间的分界线就在a的最远位置处。d的最远位置没有包含e,因此我们最后的区间是de最远位置的最大值。

  • 先确定每个元素的最远位置
  • 根据最远位置确定区间分界线在哪里

完整版

  • 记录最远出现位置,只需要hash[字母对应下标]=i就够了,因为出现位置就是是不断更新的i比较近的下标都会被远处的下标覆盖
  • 我们用right=max(right,hash[s[i]-‘a’])的方式,来记录目前为止遍历到的所有元素的最远下标位置。一旦到了这个位置,说明目前为止所有元素的最远下标就是这里,可以计算长度结果了
  • 重置左区间起始点的时候注意,本题区间不能重合
class Solution {
    
public:
    vector<int> partitionLabels(string s) {
    
        vector<int>result;
        //次数数组
        int hash[27]={
    0};
        //先统计每个元素的最远位置
        for(int i=0;i<s.size();i++){
    
            hash[s[i]-'a']=i;//下标i不断更新,最后hash里面的i就是最远位置的i
        }
        int left=0,right=0;
        int length=0;
        //用right记录目前为止所有遍历元素的最大下标
        for(int i=0;i<s.size();i++){
    
            right = max(right,hash[s[i]-'a']);
            //如果已经到了最大下标
            if(i==right){
    
                cout<<right<<endl;
                cout<<left<<endl;
                length=right-left+1;
                result.push_back(length);
                left=right+1;//重置左区间起始点,注意这里一定要left+1,区间不能重合
                length=0;//重置长度
            }
        }
        return result;
    }
};
如何确定区间分界线

如下图所示,本题主要是利用max来记录目前为止遍历过的所有元素里,最远距离最大的那一个

right遍历到了max,也就是说,right目前在的位置,是目前遍历过的所有元素里,最远距离最大的元素!此时right的位置,就是区间的分界线!

在这里插入图片描述

debug测试

第一次提交出现了很奇怪的结果,因为left没赋初值,所以每一次运行,left的值都不一样。修改left=0后问题解决。

在这里插入图片描述

时间复杂度
  • 时间复杂度:O(n),两个并列的for是n+n,实际上结果还是O(n)
  • 空间复杂度:O(1),计数数组是固定大小

总结

这道题目leetcode标记为贪心算法,其实没有太体现贪心策略,找不出局部最优推出全局最优的过程。

本质上还是重叠区间的问题,就是用最远出现距离模拟了圈字符的行为。最远出现距离,相当于重叠区间中包含所有区间的最大区间

56.合并区间(写法1比较考验思维,推荐写法2)

  • 重叠区间题目需要注意元素初值的问题,包括计数变量的初值,以及有时候需要考虑数组i=0时候的初值(因为重叠判断大都是i=1开始的)

以数组 intervals 表示若干个区间的集合,其中单个区间为 intervals[i] = [starti, endi] 。请你合并所有重叠的区间,并返回 一个不重叠的区间数组,该数组需恰好覆盖输入中的所有区间 。

示例 1:

输入:intervals = [[1,3],[2,6],[8,10],[15,18]]
输出:[[1,6],[8,10],[15,18]]
解释:区间 [1,3][2,6] 重叠, 将它们合并为 [1,6].

示例 2:

输入:intervals = [[1,4],[4,5]]
输出:[[1,5]]
解释:区间 [1,4][4,5] 可被视为重叠区间。

提示:

  • 1 <= intervals.length <= 10^4
  • intervals[i].length == 2
  • 0 <= starti <= endi <= 10^4

思路

本题是重叠区间经典题目,和 452.最少弓箭引爆气球 435.无重叠区间 的思路非常类似。

但是也有不同的地方,这道题如果完全按照无重叠区间思路来做,会有逻辑问题,本题因为是result数组收集合并后的区间,因此我们需要更新的是result的最后一个元素,而不是直接在原数组上修改,遇到重叠区间取最值加入result

写法1:直接在原数组上修改,更新i-1

  • 这种写法和更新result.back()很像,但是逻辑是错误的,原因是更新i-1再把i-1加入数组的话,遍历到i+1的时候,i+1并没有接收到i-1更新的信息
class Solution {
    
public:
    //原数组上直接合并的写法
    static bool cmp(vector<int>&a,vector<int>&b){
    
        if(a[0]<b[0]) return true;//左边界升序排序
        return false;
    }
    vector<vector<int>>result;
    vector<vector<int>> merge(vector<vector<int>>& intervals) {
    
        sort(intervals.begin(),intervals.end(),cmp); 
        for(int i=1;i<intervals.size();i++){
    
            //完全不重叠
            if(intervals[i][0]>intervals[i-1][1]){
    
                //cout<<intervals[i-1][1]<<" "<<intervals[i][0]<<endl;
                //把i-1放进去,而不是i
                result.push_back(intervals[i-1]);
                continue;
            }
            //<=都算重叠
            if(intervals[i][0]<=intervals[i-1][1]){
    
                //左边界已经排好序了不用管了
                //intervals[i-1][0]=min(intervals[i-1][0],intervals[i][0]);
                //更新i-1右边界
                intervals[i-1][1]=max(intervals[i-1][1],intervals[i][1]);
                result.push_back(intervals[i-1]);
            }
            //最后一个单独判断,如果不重叠加入自身
            if(i==intervals.size()-1&&intervals[i][0]>intervals[i-1][1])
            result.push_back(intervals[i]);
        }
        
		return result;
    }
};
debug测试

这种写法出现了逻辑错误,因为我们从i=1开始遍历,i=1时更新了i-1为新数组,但是遍历到i=2的时候,并没有接收到新数组的信息,而是依然在和i对比!

在这里插入图片描述

写法1修改版

  • 这种写法比较考验思维,核心在于重叠的时候更新i而不是i-1从而能让下一个元素接收到更新信息。还是推荐第二种写法
  • 最后一个元素,可以直接放入结果数组,是因为不重叠显然可以直接放,即使重叠也是修改完了当前的i,所以也可以直接push_back()
class Solution {
    
public:
    //原数组上直接合并的写法
    static bool cmp(vector<int>&a,vector<int>&b){
    
        if(a[0]<b[0]) return true;//左边界升序排序
        return false;
    }
    vector<vector<int>>result;
    vector<vector<int>> merge(vector<vector<int>>& intervals) {
    
        sort(intervals.begin(),intervals.end(),cmp); 
        for(int i=1;i<intervals.size();i++){
    
            //完全不重叠
            if(intervals[i][0]>intervals[i-1][1]){
    
                //cout<<intervals[i-1][1]<<" "<<intervals[i][0]<<endl;
                //把i-1放进去,而不是i
                result.push_back(intervals[i-1]);
                continue;
            }
            //<=都算重叠
            if(intervals[i][0]<=intervals[i-1][1]){
    
                //更新i而不是i-1
                intervals[i][0]=min(intervals[i-1][0],intervals[i][0]);
                //更新i右边界
                intervals[i][1]=max(intervals[i-1][1],intervals[i][1]);
                //更新之后直接遍历下一个即可,下一个发现不重叠会直接加入结果集
            }
        }
        //所有都结束之后再push_back
        result.push_back(intervals[intervals.size()-1]);
		return result;
    }
};

(推荐)写法2:更新result.back()

  • 由于本题是result存放结果,因此我们可以直接在结果数组中进行判断,这样就包含了第一个元素值的逻辑
  • 注意result.back()[1]就是上个元素的右边界
class Solution {
    
public:
    static bool cmp(vector<int>&a,vector<int>&b){
    
        if(a[0]<b[0]) return true;//左边界升序排序
        return false;
    }
    vector<vector<int>>result;
    vector<vector<int>> merge(vector<vector<int>>& intervals) {
    
        sort(intervals.begin(),intervals.end(),cmp);
        //先把第一个元素加进去
        result.push_back(intervals[0]);
        //开始遍历
        for(int i=1;i<intervals.size();i++){
    
            //完全不重叠,直接和.back()比较
            if(result.back()[1]<intervals[i][0]){
    
                result.push_back(intervals[i]);
            }
            else{
    
                //更新上个元素的右边界,左边界已经排好序了
                //这里需要取最大值,和他本身作比较
                result.back()[1]=max(intervals[i][1],result.back()[1]);
            }
        }
        return result;
    }
};

时间复杂度

  • 时间复杂度: O(nlogn)
  • 空间复杂度: O(n),结果数组大小
  1. 时间复杂度:代码中的排序操作是时间复杂度最高的部分。在C++中,std::sort的平均时间复杂度为O(N log N),其中N是intervals的长度。其余的操作,包括遍历和比较,时间复杂度为O(N)。因此,总的时间复杂度是O(N log N + N),但是在大O表示法中,我们通常只关心最高阶项,所以我们可以忽略掉O(N)部分,所以总的时间复杂度是O(N log N)
  2. 空间复杂度:代码中的空间复杂度主要取决于结果result的大小。在最坏的情况下,如果所有的区间都不重叠,那么result的大小和输入的intervals大小相同,即N。除此之外,sort操作使用的是原地排序,不需要额外的存储空间。所以总的空间复杂度是O(N)

总结

关于重叠区间类型的题目,其实主要就是靠画图模拟。

重叠区间题目需要注意元素初值的问题,包括计数变量的初值,以及有时候需要考虑数组i=0时候的初值(因为重叠判断大都是i=1开始的)。

比如本题,是结果收集不是记录重叠个数,此时就需要考虑数组初值也要被加入结果数组的情况!

版权声明:本文为博主原创文章,遵循 CC 4.0 BY-SA 版权协议,转载请附上原文出处链接和本声明。
本文链接:https://blog.csdn.net/CFY1226/article/details/131565519

智能推荐

分布式光纤传感器的全球与中国市场2022-2028年:技术、参与者、趋势、市场规模及占有率研究报告_预计2026年中国分布式传感器市场规模有多大-程序员宅基地

文章浏览阅读3.2k次。本文研究全球与中国市场分布式光纤传感器的发展现状及未来发展趋势,分别从生产和消费的角度分析分布式光纤传感器的主要生产地区、主要消费地区以及主要的生产商。重点分析全球与中国市场的主要厂商产品特点、产品规格、不同规格产品的价格、产量、产值及全球和中国市场主要生产商的市场份额。主要生产商包括:FISO TechnologiesBrugg KabelSensor HighwayOmnisensAFL GlobalQinetiQ GroupLockheed MartinOSENSA Innovati_预计2026年中国分布式传感器市场规模有多大

07_08 常用组合逻辑电路结构——为IC设计的延时估计铺垫_基4布斯算法代码-程序员宅基地

文章浏览阅读1.1k次,点赞2次,收藏12次。常用组合逻辑电路结构——为IC设计的延时估计铺垫学习目的:估计模块间的delay,确保写的代码的timing 综合能给到多少HZ,以满足需求!_基4布斯算法代码

OpenAI Manager助手(基于SpringBoot和Vue)_chatgpt网页版-程序员宅基地

文章浏览阅读3.3k次,点赞3次,收藏5次。OpenAI Manager助手(基于SpringBoot和Vue)_chatgpt网页版

关于美国计算机奥赛USACO,你想知道的都在这_usaco可以多次提交吗-程序员宅基地

文章浏览阅读2.2k次。USACO自1992年举办,到目前为止已经举办了27届,目的是为了帮助美国信息学国家队选拔IOI的队员,目前逐渐发展为全球热门的线上赛事,成为美国大学申请条件下,含金量相当高的官方竞赛。USACO的比赛成绩可以助力计算机专业留学,越来越多的学生进入了康奈尔,麻省理工,普林斯顿,哈佛和耶鲁等大学,这些同学的共同点是他们都参加了美国计算机科学竞赛(USACO),并且取得过非常好的成绩。适合参赛人群USACO适合国内在读学生有意向申请美国大学的或者想锻炼自己编程能力的同学,高三学生也可以参加12月的第_usaco可以多次提交吗

MySQL存储过程和自定义函数_mysql自定义函数和存储过程-程序员宅基地

文章浏览阅读394次。1.1 存储程序1.2 创建存储过程1.3 创建自定义函数1.3.1 示例1.4 自定义函数和存储过程的区别1.5 变量的使用1.6 定义条件和处理程序1.6.1 定义条件1.6.1.1 示例1.6.2 定义处理程序1.6.2.1 示例1.7 光标的使用1.7.1 声明光标1.7.2 打开光标1.7.3 使用光标1.7.4 关闭光标1.8 流程控制的使用1.8.1 IF语句1.8.2 CASE语句1.8.3 LOOP语句1.8.4 LEAVE语句1.8.5 ITERATE语句1.8.6 REPEAT语句。_mysql自定义函数和存储过程

半导体基础知识与PN结_本征半导体电流为0-程序员宅基地

文章浏览阅读188次。半导体二极管——集成电路最小组成单元。_本征半导体电流为0

随便推点

【Unity3d Shader】水面和岩浆效果_unity 岩浆shader-程序员宅基地

文章浏览阅读2.8k次,点赞3次,收藏18次。游戏水面特效实现方式太多。咱们这边介绍的是一最简单的UV动画(无顶点位移),整个mesh由4个顶点构成。实现了水面效果(左图),不动代码稍微修改下参数和贴图可以实现岩浆效果(右图)。有要思路是1,uv按时间去做正弦波移动2,在1的基础上加个凹凸图混合uv3,在1、2的基础上加个水流方向4,加上对雾效的支持,如没必要请自行删除雾效代码(把包含fog的几行代码删除)S..._unity 岩浆shader

广义线性模型——Logistic回归模型(1)_广义线性回归模型-程序员宅基地

文章浏览阅读5k次。广义线性模型是线性模型的扩展,它通过连接函数建立响应变量的数学期望值与线性组合的预测变量之间的关系。广义线性模型拟合的形式为:其中g(μY)是条件均值的函数(称为连接函数)。另外,你可放松Y为正态分布的假设,改为Y 服从指数分布族中的一种分布即可。设定好连接函数和概率分布后,便可以通过最大似然估计的多次迭代推导出各参数值。在大部分情况下,线性模型就可以通过一系列连续型或类别型预测变量来预测正态分布的响应变量的工作。但是,有时候我们要进行非正态因变量的分析,例如:(1)类别型.._广义线性回归模型

HTML+CSS大作业 环境网页设计与实现(垃圾分类) web前端开发技术 web课程设计 网页规划与设计_垃圾分类网页设计目标怎么写-程序员宅基地

文章浏览阅读69次。环境保护、 保护地球、 校园环保、垃圾分类、绿色家园、等网站的设计与制作。 总结了一些学生网页制作的经验:一般的网页需要融入以下知识点:div+css布局、浮动、定位、高级css、表格、表单及验证、js轮播图、音频 视频 Flash的应用、ul li、下拉导航栏、鼠标划过效果等知识点,网页的风格主题也很全面:如爱好、风景、校园、美食、动漫、游戏、咖啡、音乐、家乡、电影、名人、商城以及个人主页等主题,学生、新手可参考下方页面的布局和设计和HTML源码(有用点赞△) 一套A+的网_垃圾分类网页设计目标怎么写

C# .Net 发布后,把dll全部放在一个文件夹中,让软件目录更整洁_.net dll 全局目录-程序员宅基地

文章浏览阅读614次,点赞7次,收藏11次。之前找到一个修改 exe 中 DLL地址 的方法, 不太好使,虽然能正确启动, 但无法改变 exe 的工作目录,这就影响了.Net 中很多获取 exe 执行目录来拼接的地址 ( 相对路径 ),比如 wwwroot 和 代码中相对目录还有一些复制到目录的普通文件 等等,它们的地址都会指向原来 exe 的目录, 而不是自定义的 “lib” 目录,根本原因就是没有修改 exe 的工作目录这次来搞一个启动程序,把 .net 的所有东西都放在一个文件夹,在文件夹同级的目录制作一个 exe._.net dll 全局目录

BRIEF特征点描述算法_breif description calculation 特征点-程序员宅基地

文章浏览阅读1.5k次。本文为转载,原博客地址:http://blog.csdn.net/hujingshuang/article/details/46910259简介 BRIEF是2010年的一篇名为《BRIEF:Binary Robust Independent Elementary Features》的文章中提出,BRIEF是对已检测到的特征点进行描述,它是一种二进制编码的描述子,摈弃了利用区域灰度..._breif description calculation 特征点

房屋租赁管理系统的设计和实现,SpringBoot计算机毕业设计论文_基于spring boot的房屋租赁系统论文-程序员宅基地

文章浏览阅读4.1k次,点赞21次,收藏79次。本文是《基于SpringBoot的房屋租赁管理系统》的配套原创说明文档,可以给应届毕业生提供格式撰写参考,也可以给开发类似系统的朋友们提供功能业务设计思路。_基于spring boot的房屋租赁系统论文