news 2026/7/22 20:54:29

【LeetCode Hot100】128. 最长连续序列 - Java O(n) 解法详解

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
【LeetCode Hot100】128. 最长连续序列 - Java O(n) 解法详解

📝 前言

今天在刷 LeetCode 热题 100 时,碰到了第 128 题“最长连续序列”。这是一道非常经典的题目,考察的重点是如何在不排序的情况下,利用哈希表在 O(n) 的时间复杂度内完成查找。

乍一看这道题如果用Arrays.sort()排序后遍历,时间复杂度是 O(nlog n),但这道题明确要求O(n),所以必须换一种思路。记录一下我的解题心得和最终代码。

📚 题目描述

给定一个未排序的整数数组nums,找出数字连续的最长序列(不要求序列元素在原数组中连续)的长度。

示例 1:

输入: nums = [100,4,200,1,3,2]

输出: 4

解释: 最长数字连续序列是 [1, 2, 3, 4]。它的长度为 4。

提示:

  • 请设计并实现时间复杂度为 O(n) 的算法。


💡 解题思路

1. 为什么不能排序?

题目硬性要求时间复杂度为 O(n)。我们知道标准的排序算法(如快排、归并)最快也是 O(nlog n),所以排序这条路走不通。我们需要一种能够快速查找的数据结构,哈希表 (HashSet)是最佳选择。

2. 核心逻辑:去重与定位“起点”

我们可以分两步走:

  1. 去重与存储:先把所有数字放入HashSet中,这样我们不仅去除了重复元素,还能在 O(1) 的时间内判断一个数是否存在。

  2. 寻找序列起点

    • 如果我们对集合中的每一个数x都去尝试向后枚举 (x+1,x+2...),时间复杂度最坏会达到 O(n^2)。

    • 关键优化点:我们只从序列的起点开始查找。

    • 如何判断起点?如果一个数x,它的前驱x-1在集合中,那么x一定是某个连续序列的第一个数。

    • 只有当x是起点时,我们才开始向后匹配x+1,x+2等等,统计长度。

3. 一个小优化

在统计过程中,如果当前找到的最长序列长度已经超过了哈希表中剩余元素的一半(或者总数的一半),其实就可以提前结束循环了,因为剩下的元素数量不可能凑出更长的序列。


💻 代码实现 (Java)

代码相比官方题解做了变量名的语义化修改,使其更符合工程规范,方便阅读。

class Solution { public int longestConsecutive(int[] nums) { // 1. 预处理:将数组元素放入 HashSet,实现去重和 O(1) 查询 Set<Integer> numSet = new HashSet<>(); for (int num : nums) { numSet.add(num); } int maxLen = 0; int totalNums = numSet.size(); // 2. 遍历集合中的每个元素 for (int num : numSet) { // 核心剪枝逻辑: // 只有当 num-1 不存在时,num 才是一个连续序列的【起点】 // 如果 num-1 存在,说明 num 已经被计算过了,直接跳过 if (!numSet.contains(num - 1)) { int currentNum = num; int currentLen = 1; // 从起点开始,不断向后寻找连续的数字 while (numSet.contains(currentNum + 1)) { currentNum += 1; currentLen += 1; } // 更新最大长度 maxLen = Math.max(maxLen, currentLen); // 【可选优化】:如果当前找到的长度已经超过总数的一半, // 那么剩下的元素不可能组成更长的序列,直接退出 if (maxLen > totalNums / 2) { break; } } } return maxLen; } }

🔍 复杂度分析

  • 时间复杂度:O(n)

    • 虽然代码里有一个while循环嵌套在for循环里,但仔细分析会发现:由于if (!numSet.contains(num - 1))的限制,数组中的每个数最多只会被访问两次(一次是作为序列起点被访问,一次是作为序列的一部分被内部while访问)。

    • 因此总的操作次数是线性的。

  • 空间复杂度:O(n)

    • 我们需要一个HashSet来存储数组中的元素,以空间换时间。

🎯 总结

这道题是哈希表运用的典范。解决很多 O(n) 复杂度问题的秘诀往往就在于“如何避免重复计算”。在这道题里,通过判断x-1是否存在,精准地锁定了每个序列的头部,从而避免了大量的无效枚举。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/7/22 20:17:43

Day 39 MLP神经网络的训练

浙大疏锦行 神经网络是一种模拟人脑神经元连接结构的分层模型&#xff0c;核心通过“输入层→隐藏层→输出层”的架构实现端到端学习&#xff0c;无需手动设计特征&#xff0c;能自动提取数据中的高阶非线性关系&#xff08;如心脏病风险与年龄、血压的复杂关联&#xff09;。…

作者头像 李华
网站建设 2026/7/21 18:56:40

浏览器原理

浏览器原理 一、 宏观视角&#xff1a;Chrome 多进程架构 现在的浏览器更像是一个分布式操作系统&#xff0c;而非简单的应用程序。 1. 四大核心进程 Browser Process (主进程)&#xff1a; 职责&#xff1a;负责 UI&#xff08;地址栏、书签&#xff09;、协调子进程、管理存储…

作者头像 李华
网站建设 2026/7/22 15:50:34

XXL-TOOL v2.4.0 发布 | 布隆过滤器、Excel流式读写、高性能BeanCopy

Release Notes 1、【新增】BloomFilter&#xff08;布隆过滤器&#xff09;&#xff1a;一种基于多哈希函数和位数组的概率型数据结构&#xff0c;具有高效空间利用与快速查询特性&#xff1b;2、【新增】Trie&#xff08;前缀数&#xff09;&#xff1a;一种哈希树的变种&…

作者头像 李华
网站建设 2026/7/22 15:42:54

管理软件包

一.rpm管理软件包1.安装软件-i安装指定一个或多个软件包-v显示安装过程-h以#号显示安装进度2.查询软件-q查询软件包信息-a查询已经安装的软件包-c显示软件包的配置文件列表-d显示软件包的文本文件列表-p查询软件包文件&#xff0c;通常和其他选项组合使用-g查询所属组的软件包-…

作者头像 李华
网站建设 2026/7/21 21:19:24

DAY24 奇异值SVD分解

一、SVD的实际价值 1. 计算效率提升 特征从n维降至k维&#xff08;k<n&#xff09; 减少模型参数数量 加快训练和预测速度 2. 模型泛化能力 去除噪声和冗余信息 可能提高模型在测试集上的表现 减少过拟合风险 二、实际书写思路及其代码 针对心脏并数据集我们进行了…

作者头像 李华
网站建设 2026/7/21 23:19:50

GUID为什么不会重复?

GUID为什么不会重复? GUID/UUID &#xff08;全局唯一标识符&#xff09;之所以被认为“几乎不会重复”&#xff0c;是因为其庞大的组合空间和精心设计的生成算法&#xff0c;使得在现实世界中重复的概率低到可以忽略不计。 以下是 GUID 不会重复的核心原因&#xff1a; 1. 庞…

作者头像 李华