课程链接
在这里插入图片描述

前序知识

算法复杂度分析

为什么要进行复杂度分析

  • 指导你编写出性能更优的代码
  • 评判别人写的代码的好坏

时间复杂度

来评估代码的执行耗时的

public int sum(int n){
	int sum = 0;
	for(int i =1; i <= n; i++){
		sum = sum + i;
	}
	return sum;
}
  1. 例如每行代码的执行耗时一样:1ms
  2. 分析这段代码总执行多少行? 3n+3
  3. 代码耗时总时间:T(n) = (3n + 3) * 1ms
  • 大O表示法:不具体表示代码真正的执行时间,而是表示代码执行时间随数据规模增长的变化趋势
  • T(n)与代码的执行次数成正比(代码行数越多,执行时间越长)
    T(3n + 3) ----> T(n) = O(n)
  • 当n很大时,公式中的低阶、常量、系数三部分并不左右其增长趋势,因此可以忽略,我们只需要记录一个最大的量级就可以了
    常见复杂度表示形式
描述表示形式
常数O(1)
对数O(log n)
线性O(n)
线性对数O(n * log n)
平方O(n 2 ^2 2)
立方O(n 3 ^3 3)
k次方O(n k ^k k)
指数O(2 n ^n n)
阶乘O(n!)

性能越来越低 速记口诀:常对幂指阶

public void test04(int n){
	int i = 1;
	while(i<=n){
		i = i * 2;
	}
}

复杂度分析就是要弄清楚代码的执行次数和数据规模n之间的关系
在这里插入图片描述
由此分析,代码的时间复杂度表示为O(log n)

空间复杂度

空间复杂度全称是渐进空间复杂度,表示算法占用的额外存储空间数据规模之间的增长关系
在这里插入图片描述

一、List

1 底层实现

数组

数组(Array)是一种用连续的内存空间存储相同数据类型数据的线性数据结构

在这里插入图片描述
数组如何获取其他元素的地址值
在这里插入图片描述

1.1 为什么数组索引从0开始呢?假如从1开始不行吗?

在这里插入图片描述
回答:

  • 在根据数组索引获取元素的时候,会用索引和寻址公式来计算内存所对应的元素数据,寻址公式是:数组的首地址+索引乘以存储数据的类型大小
  • 如果数组的索引从1开始,寻址公式中就需要增加一次减法操作,对于CPU来说就多了一次指令,性能不高

1.2 操作数组的时间复杂度和空间复杂度(增删改查)

操作数组的时间复杂度(查找)

  1. 随机查询(根据索引查询)
    数组元素的访问是通过下标来访问的,计算机通过数组的首地址寻址公式能够很快速的找到想要访问的元素 O(1)
  2. 未知索引查询
    情况一:查找数组内的元素,查找55号数据
    在这里插入图片描述
    情况二:查找排序后数组内的元素,查找55号数据
    在这里插入图片描述
    操作数组的时间复杂度(插入、删除)
    数组是一段连续的内存空间,因此为了保证数组的连续性会使得数组的插入和删除的效率变得很低
    在这里插入图片描述
    最好情况下是O(1),最坏情况是O(n),平均情况下的时间复杂度是O(n)

1.3 源码分析

源码如何分析?

List<Integer> list = new ArrayList<Integer>();
list.add(1);
  • 成员变量
  • 构造函数
  • 关键方法
    源于jdk 1.8分析
    成员变量
    在这里插入图片描述
    构造函数
    在这里插入图片描述
    在这里插入图片描述
    将Collection对象转换成数组,然后将数组的地址赋给elementData
    关键方法
    添加和扩容操作(第1次添加数据)
    在这里插入图片描述
    添加和扩容操作(第2至10次添加数据)
    在这里插入图片描述
    添加和扩容操作(第11次添加数据)
    在这里插入图片描述

2 面试问题

2.1 ArrayList底层的实现原理是什么?

  • ArrayList底层是用动态数组实现的
  • ArrayList初始容量为0,当第一次添加数据的时候才会初始化容量为10
  • ArrayList在进行扩容的时候是原来的1.5倍,每次扩容都需要拷贝数组
  • ArrayList在添加数据的时候
    • 确保数组已使用长度size()加1之后足够存下下一个数据
    • 计算数组的容量,如果当前数组已使用长度+1后的大于当前数组长度,则调用grow方法扩容(原来的1.5倍)
    • 返回添加成功布尔值

2.2 ArrayList list = new ArrayList(10)中的list扩容几次?

在这里插入图片描述
参考回答:
该语句只是声明和实例了一个ArrayList指定了容量为10,未扩容

2.3 如何实现数组和List之间的转换

//数组转List
public static void testArray2List(){
	String[] strs = {"aaa","bbb","ccc"};
	List<String> list = Arrays.asList(strs);
	for(String s:list){
		System.out.println(s);
	}
}

数组转List,使用JDK中java.util.Arrays工具类的asList()方法

//List转数组
public static void testList2Array(){
	List<String> list = new ArrayList<String>();
	list.add("aaa");
	list.add("bbb");
	list.add("ccc");
	String[] array = list.toArray(new String[list.size()]);
	for(String s:array){
		System.out.println(s);
	}
}

List转数组,使用List的toArray方法。无参toArray方法返回Object数组,传入初始化长度的数组对象,返回该对象数组

2.3.1 用Arrays.asList转List后,如果修改了数组内容,list受影响吗?

在这里插入图片描述
ArrayList转换list之后,如果修改了数组的内容,list会受影响,因为它的底层使用的Arrays类中的一个内部类ArrayList来构造的集合,在这个集合的构造器中,把我们传入的这个集合进行了包装而已,最终指向的都是同一个内存地址

2.3.2 List用toArray转数组后,如果修改了List内容,数组受影响吗?

在这里插入图片描述
list用了toArray转数组后,如果修改了list内容,数组不会受影响,当调用了toArray以后,在底层他是进行了数组的拷贝,跟原来的元素就没有关系了,所以即使list修改了以后,数组也不受影响

2.4 ArrayList和LinkedList的区别是什么?

2.4.1 链表
2.4.1.1 单向链表

链表中的每一个元素称之为结点(Node)
物理存储单元上,非连续、非顺序的存储结构
单向链表:每个结点包括两部分:一个是存储数据元素的数据域,另一个是存储下一个结点地址的指针域。记录下个结点地址的指针叫做后继指针 next

在这里插入图片描述
在这里插入图片描述
单向链表时间复杂度分析 查询操作

  • 只有在查询头节点的时候不需要遍历链表,时间复杂度是O(1)
  • 查询其他结点需要遍历链表,时间复杂度是O(n)

单向链表时间复杂度分析 插入\删除操作
在这里插入图片描述

  • 只有在添加和删除节点的时候不需要遍历链表,时间复杂度是O(1)
  • 添加和删除其他结点需要遍历找到对应节点后,才能完成新增或删除节点,时间复杂度是O(n)
2.4.1.2 双向链表

而双向链表,顾名思义,它支持两个方向
每个结点不只有一个后继指针next指向后面的结点
有一个前驱指针prev指向前面的结点

在这里插入图片描述
在这里插入图片描述
对比单链表:

  • 双向链表需要额外的两个空间来存储后继节点和前驱节点的地址
  • 支持双向遍历,这样也带来了双向链表操作的灵活性

双向链表时间复杂度分析 查询操作
查询头尾结点的时间复杂度是O(1)
平均的查询时间复杂度是O(n)
给定节点找前驱节点的时间复杂度是O(1)
增删操作
头尾结点增删的时间复杂度为O(1)
其他部分结点增删的时间复杂度是O(n)
给定节点增删的时间复杂度为O(1)

2.4.2 单向链表和双向链表的区别
  • 单链表只有一个方向,结点只有一个后继指针next
  • 双向链表它支持两个方向,每个节点不只有一个后继指针next指向后面的节点,还有一个前驱指针prev指向前面的节点
2.4.3 ArrayList和LinkedList的区别是什么?
  1. 底层数据结构
  • ArrayList是动态数组的数据结构实现
  • LinkedList是双向链表的数据结构实现
  1. 操作数据效率
  • ArrayList按照下标查询的时间复杂度O(1)【内存是连续的,根据寻址公式】,LinkedList不支持下标查询
  • 查找(未知索引):ArrayList需要遍历,链表也需要遍历,时间复杂度都是O(n)
  • 新增和删除
    • ArrayList尾部插入和删除,时间复杂度是O(1);其他部分增删需要挪动数组,时间复杂度是O(n)
    • LinkedList头尾结点增删时间复杂度是O(1),其他都需要遍历链表,时间复杂度是O(n)
  1. 内存空间占用
  • ArrayList底层是数组,内存连续,节省内存
  • LinkedList是双向链表需要存储数据,和两个指针,更占用内存
  1. 线程安全
  • ArrayList和LinkedList都不是线程安全的
  • 如果需要保证线程安全,有两种方案:
    • 在方法内使用,局部变量则是线程安全的
    • 使用线程安全的ArrayList和LinkedList
List<Object> syncArrayList = Collections.synchronizedList(new ArrayList<>());
List<Object> syncLinkedList = Collections.synchronizedList(new LinkedList<>());

二、HashMap相关面试题

1. 数据结构

1.1 二叉树

二叉树,顾名思义,每个节点最多有两个“叉”,也就是两个子节点,分别是左子节点右子节点。不过,二叉树并不要求每个节点都有两个子节点,有的节点只有左子节点,有的节点只有右子节点。
二叉树每个节点的左子树和右子树也分别满足二叉树的定义

在这里插入图片描述
Java中有两个方式实现二叉树:数据存储,链式存储。
基于链式存储的树的节点可定义如下:
在这里插入图片描述在这里插入图片描述
二叉树分类
在二叉树中比较常见的二叉树有:

  • 满二叉树
  • 完全二叉树
  • 二叉搜索树
  • 红黑树 见知识点1.2
    二叉搜索树

二叉搜索树(Binary Search Tree,BST)又名二叉查找树,有序二叉树或者排序二叉树,是二叉树中比较常用的一种类型二叉查找树要求,在树中的任意一个节点,其左子树中的每个节点的值,都要小于这个节点的值,而右子树节点的值都大于这个节点的值

在这里插入图片描述
二叉搜索树-时间复杂度分析
实际上由于二叉查找树的形态各异,时间复杂度也不尽相同。
在这里插入图片描述
插入、查找、删除的时间复杂度O(log n)
在这里插入图片描述
对于图中这种情况属于最坏的情况,二叉查找树已经退化成了链表,左右子树极度不平衡,此时查找的时间复杂度肯定是O(n)

1.2 红黑树

红黑树(Red Black Tree):也是一种自平衡的二叉搜索树(BST),之前叫做平衡二叉树(Synmmetric Binary B-Tree)

在这里插入图片描述
红黑树的特质

  • 性质1:节点要么是红色,要么是黑色
  • 性质2:根节点是黑色
  • 性质3:叶子节点都是黑色的空节点
  • 性质4:红黑树中红色节点的子节点都是黑色
  • 性质5:从任一节点到叶子节点的所有路径都包含相同数目的黑色节点
    在添加或删除节点的时候,如果不符合这些性质会发生旋转,以达到所有的性质
    保证平衡
    红黑树的复杂度
  • 查找
    红黑树也是一颗BST(二叉搜索树)树,查找操作的时间复杂度为:O(log n)
  • 添加
    添加先要从根节点开始找到元素添加的位置,时间复杂度O(log n)
    添加完成后涉及到复杂度为O(1)的旋转调整操作
    故整体复杂度为:O(log n)
  • 删除
    首先从根节点开始找到被删除元素的位置,时间复杂度O(log n)
    删除完成后涉及到复杂度为O(1)的旋转调整操作
    故整体复杂度为:O(log n)

1.3 散列表

在HashMap中的最重要的一个数据结构就是散列表,在散列表中又使用到了红黑树和链表

  • 散列表的概念
  • 散列函数
  • 散列冲突
  • 拉链法

散列表(Hash Table)

散列表(Hash Table)又名哈希表/Hash表,是根据键(Key)直接访问在内存存储位置值(Value)的数据结构,它是由数组演化而来的,利用了数组支持按照下标进行随机访问数据的特性

散列函数
在这里插入图片描述
将键(key)映射为数组下标的函数叫做散列函数。可以表示为:hashValue = hash(key)
散列函数的基本要求:

  • 散列函数计算得到的散列值必须是大于等于0的正整数,因为hashValue需要作为数组的下标
  • 如果key1 == key2,那么经过hash后得到的哈希值也必相同即:hash(key1) == hash(key2)
  • 如果key1 != key2,那么经过hash后得到的哈希值也必不相同即:hash(key1) != hash(key2)

散列冲突

时机的情况下想找一个散列函数能够做到对于不同的key计算得到的散列值都不同是不可能的,即使像著名的MD5,SHA等哈希算法也无法避免这一情况,这就是散列冲突(或者哈希冲突,哈希碰撞,就是指多个key映射到同一个数组下标位置)

在这里插入图片描述
拉链法

在散列表中,数组的每个下标位置我们可以称之为桶(bucket)或者槽(slot),每个桶(槽)会对应一条链表,所有散列值相同的元素我们都放在相同槽位对应的链表中。

在这里插入图片描述
散列冲突-链表法(拉链)-时间复杂度
(1)插入操作,通过散列函数计算对应的散列槽位,将其插入到对应链表中即可,插入的时间复杂度是O(1)
(2)当查找、删除一个元素时,我们同样通过散列函数计算得出对应的槽,然后遍历链表查找或者删除

  • 平均情况下基于链表法解决冲突时查询的时间复杂度是O(1)

  • 散列表可能会退化为链表,查询的时间复杂度就从O(1)退化为O(n)
    在这里插入图片描述

  • 将链表法中的链表改造为其他高效的动态数据结构,比如红黑树,查询的时间复杂度是O(log n)
    在这里插入图片描述
    将链表法中的链表改造红黑树还有一个非常重要的原因,可以防止DDos攻击

DDos攻击:
分布式拒绝服务攻击(英文意思是Distributed Denial of Service,简称DDos)
指处于不同位置的多个攻击者同时向一个或数个目标发动攻击,或者一个攻击者控制了位于不同位置的多台机器并利用这些机器对受害者同时实施攻击。由于攻击的出发点是分布在不同地方的,这类攻击称为分布式拒绝服务攻击,其中的攻击者可以有多个

2. 相关面试题

2.1 HashMap实现原理?

HashMap的数据结构:底层使用hash表数据结构,即数组和链表或红黑树

  1. 当我们往HashMap中put元素时,利用key的hashCode重新hash计算出当前对象的元素在数组中的下标
  2. 存储时如果出现hash值相同的key,此时有两种情况
  • 如果key相同,则覆盖原始值;
  • 如果key不同(出现冲突),则将当前的key-value放入链表或红黑树中
  1. 获取时,直接找到hash值对应的下标,再进一步判断key是否相同哦,从而找到对应值。
    在这里插入图片描述

2.2 HashMap的jdk1.7和jdk1.8有什么区别?

  • JDK1.8之前采用的是拉链法。拉链法:将链表和数组相结合。也就是说创建一个链表数组,数组中每一格就是一个链表。若遇到哈希冲突,则将冲突的值加到链表中即可
  • JDK1.8在解决哈希冲突时有了较大变化,当链表长度大于阈值(默认为8)时并且数组长度达到64时,将链表转化为红黑树,以减少搜索时间。扩容resize()时,红黑树拆分成的树的结点数小于等于临界值6个,则退化成链表

2.3 HashMap的put方法的具体流程?

HashMap源码分析-常见属性

  • static final int DEFAULT_INTIAL_CAPACITY=1<<4;///aka 16
    默认的初始容量
  • static final float DEFAULT_LOAD_FACTOR=0.75f;
    默认的加载因子
    扩容阈值 == 数组容量 * 加载因子
  • transient HashMap.Node<K,V>[] table;
    在这里插入图片描述
  • transient int size;

在这里插入图片描述

  • HashMap是懒惰加载,在创建对象时并没有初始化数组
  • 在无参的构造函数中,设置了默认的加载因子是0.75

添加数据流程图
在这里插入图片描述

  1. 判断键值对数组table是否为空或为null,否则执行resize()进行扩容(初始化)
  2. 根据键值key计算hash值得到数组索引
  3. 判断table[i] == null,条件成立,直接新建节点添加
  4. 如果table[i] == null,不成立
  • 判断table[i]的首个元素是否和key一样,如果相同直接覆盖value
  • 判断table[i]是否为treeNode,即table[i]是否是红黑树,如果是红黑树,则直接在树中插入键值对
  • 遍历table[i],链表的尾部插入数据,然后判断链表长度是否大于8,大于8的话把链表转化成红黑树,在红黑树中执行插入操作,遍历过程中若发现key已经存在直接覆盖value
  1. 插入成功后,判断实际存在的键值对数量size是否超过了最大容量threshold(数组长度*0.75),如果超过,进行扩容

2.4 讲一讲HashMap的扩容机制?

在这里插入图片描述

  • 在添加元素或初始化的时候需要调用resize()方法进行扩容,第一次添加数据初始化数组长度为16,以后每次扩容都是达到了扩容阈值(数组长度 * 0.75)
  • 每次扩容的时候,都是扩容之前容量的2倍;
  • 扩容之后,会新创建一个数组,需要把老数组中的数据挪动到新的数组中
    • 没有hash冲突的节点,则直接使用e.hash & (newCap - 1)计算新数组的索引位置
    • 如果是红黑树,走红黑树的添加
    • 如果是链表,则需要遍历链表,可能需要拆分链表,判断(e.hash & oldCap)是否为0,该元素的位置要么停留在原始位置,要么移动到原始位置+增加的数组大小这个位置上

2.5 hashMap的寻址算法?

在这里插入图片描述

  • 计算对象的hashCode()
  • 在进行调用hash()方法进行二次哈希,hashCode值右移16位再异或运算,让哈希分布更为均匀
  • 最后(capacity - 1) & hash得到索引

2.6 为何HashMap的数组长度一定是2的次幂?

  • 计算索引时效率更高:如果是2的n次幂可以使用位与运算代替取模
  • 扩容时重新计算索引效率更高:hash & oldCap === 0的元素留在原来位置,否则新位置 = 旧位置 + oldCap

2.7 hashMap在1.7情况下的多线程死循环问题?

jdk7的数据结构是:数组+链表
在数组进行扩容的时候,因为链表是头插法,在进行数据迁移的过程中,有可能导致死循环
在这里插入图片描述
在这里插入图片描述
参考回答:
在jdk1.7的hashMap中在数组进行扩容的时候,因为链表是头插法,在进行数据迁移的过程中,有可能导致死循环
比如说,现在有两个线程
线程一:读取到当前的hashMap数据,数据中一个链表,在准备扩容时,线程二介入
线程二:也读取hashMap,直接进行扩容。因为是头插法,链表的顺序会进行颠倒过来。比如原来的顺序是AB,扩容后的顺序是BA,线程二执行结束
线程一:继续执行的时候就会出现死循环的问题
线程一先将A移入新的链表,再将B插入到链头,由于另外一个线程的原因,B的next指向了A,所以B->A->B,形成循环。当然,JDK8将扩容算法做了调整,不再将元素加入链表头(而是保持与扩容前一样的顺序),尾插法,就避免了jdk7中死循环的问题

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐