一、对象的创建过程
一个对象的创建过程大致可分为一下几步:
1.类加载检查:
虚拟机遇到一条 new 指令时,首先将去检查这个指令的参数是否能在常量池中定位到一个类的符号引用,并且检查这个 符号引用代表的类是否已被加载、解析和初始化过。如果没有,那必须先执行相应的类加载过程。 new指令对应到语言层面上讲是, new 关键词、对象克隆、对象序列化等。
2.内存分配:
在类加载检查通过后,接下来虚拟机将为新生对象分配内存。对象所需内存的大小在类加载完成后便可完全确定,为对象分配空间的任务等同于把一块确定大小的内存从Java 堆中划分出来。
这个步骤有两个问题:
1. 如何划分内存。
2. 在并发情况下, 可能出现正在给对象 A 分配内存,指针还没来得及修改,对象 B 又同时使用了原来的指针来分配内存的情况。
划分内存的方法:
“ 指针碰撞” ( Bump the Pointer ) ( 默认用指针碰撞 )
如果 Java 堆中内存是绝对规整的,所有用过的内存都放在一边,空闲的内存放在另一边,中间放着一个指针作为分界点的指示器,那所分配内存就仅仅是把那个指针向空闲空间那边挪动一段与对象大小相等的距离。
“ 空闲列表” (Free List)
如果 Java 堆中的内存并不是规整的,已使用的内存和空闲的内存相互交错,那就没有办法简单地进行指针碰撞了,虚拟机就必须维护一个列表,记录上哪些内存块是可用的,在分配的时候从列表中找到一块足够大的空间划分给对象实例,并更新列表上的记录
java堆中内存划分规则是由垃圾收集器决定的。
- 当使用 Serial、ParNew 等带压缩整理过程的收集器时,系统采用的分配算法是指针碰撞,既简单又高效
- 而当使用 CMS 这种基于清除(Sweep)算法的收集器时,理论上就只能采用较为复杂的空闲列表来分配内存
解决并发问题的方法:
CAS (compare and swap)
虚拟机采用 CAS 配上失败重试的方式保证更新操作的原子性来对分配内存空间的动作进行同步处理。
本地线程分配缓冲(Thread Local Allocation Buffer,TLAB)
把内存分配的动作按照线程划分在不同的空间之中进行,即每个线程在 Java 堆中预先分配一小块内存。通过 XX:+/ UseTLAB 参数来设定虚拟机是否使用 TLAB(JVM 会默认开启 XX:+ UseTLAB ) , XX:TLABSize 指定 TLAB 大小。如果这块区域放不下则走CAS的方法在堆上分配内存。
3. 初始化
内存分配完成后,虚拟机需要将分配到的内存空间都初始化为零值(不包括对象头),比如 boolean 字段都初始化为 false ,int 字段都初始化为 0 。 如果使用TLAB ,这一工作过程也可以提前至TLAB 分配时进行。这一步操作保证了对象的实例字段在 Java 代码中可以不赋初始值就直接使用,程序能访问到这些字段的数据类型所对应的零值。
4. 设置对象头
初始化零值之后,虚拟机要对对象进行必要的设置,例如这个对象是哪个类的实例、如何才能找到类的元数据信息、对象的哈希码、对象的GC 分代年龄等信息。这些信息存放在对象的对象头 Object Header 之中。 在HotSpot 虚拟机中,对象在内存中存储的布局可以分为 3 块区域:对象头( Header )、 实例数据(Instance Data) 和对齐填充(Padding)。 HotSpot 虚拟机的对象头包括两部分信息,第一部分用于存储对象自身的运行时数据, 如哈希码(HashCode )、 GC 分代年龄、锁状态标志、线程持有的锁、偏向线程 ID 、偏向时间戳等。对象头的另外一部分是类型指针,即对象指向它的类元数据的指针,虚拟机通过这个指针来确定这个对象是哪个类的实例。
5.执行<init>方法
执行<init>方法,即类的构造方法,对象按照程序员的意愿进行初始化。
二、对象大小与指针压缩
对象大小可以用 jolcore 包查看,引入依赖
<dependency> <groupId>org.openjdk.jol</groupId> <artifactId>jol‐core</artifactId> <version>0.9</version> </dependency>
import org.openjdk.jol.info.ClassLayout; /** * 计算对象大小 */ public class JOLSample { public static void main(String[] args) { ClassLayout layout = ClassLayout.parseInstance(new Object()); System.out.println(layout.toPrintable()); System.out.println(); ClassLayout layout1 = ClassLayout.parseInstance(new int[]{}); System.out.println(layout1.toPrintable()); System.out.println(); ClassLayout layout2 = ClassLayout.parseInstance(new A()); System.out.println(layout2.toPrintable()); } // ‐XX:+UseCompressedOops 默认开启的压缩所有指针 // ‐XX:+UseCompressedClassPointers 默认开启的压缩对象头里的类型指针Klass Pointer // Oops : Ordinary Object Pointers public static class A { //8B mark word //4B Klass Pointer 如果关闭压缩‐XX:‐UseCompressedClassPointers或‐XX:‐UseCompressedOops,则占用8B int id; //4B String name; //4B 如果关闭压缩‐XX:‐UseCompressedOops,则占用8B byte b; //1B Object o; //4B 如果关闭压缩‐XX:‐UseCompressedOops,则占用8B } } 运行结果: java.lang.Object object internals: OFFSET SIZE TYPE DESCRIPTION VALUE 0 4 (object header) 01 00 00 00 (00000001 00000000 00000000 00000000) (1) //mark word 4 4 (object header) 00 00 00 00 (00000000 00000000 00000000 00000000) (0) //mark word 8 4 (object header) e5 01 00 f8 (11100101 00000001 00000000 11111000) (‐134217243) //Klass Pointer 12 4 (loss due to the next object alignment) Instance size: 16 bytes 43 Space losses: 0 bytes internal + 4 bytes external = 4 bytes
什么是java对象的指针压缩?
1.jdk1.6 update14 开始,在 64bit 操作系统中, JVM 支持指针压缩
2.jvm 配置参数 :UseCompressedOops , compressed 压缩、 oop(ordinary object pointer) 对象指针
3. 启用指针压缩 :XX:+UseCompressedOops( 默认开启 ) ,禁止指针压缩 :XX:UseCompressedOops
为什么要进行指针压缩?
1. 在 64 位平台的 HotSpot 中使用 32 位指针,内存使用会多出 1.5 倍左右,使用较大指针在主内存和缓存之间移动数据, 占用较大宽带,同时 GC 也会承受较大压力
2. 为了减少 64 位平台下内存的消耗,启用指针压缩功能
3. 在 jvm 中, 32 位地址最大支持 4G 内存 (2 的 32 次方 ) ,可以通过对对象指针的压缩编码、取出后到CPU寄存器解码方式进行优化(对象指针在堆中是32位,在CPU寄存器中是35位,2的35次方等于32G),使得 jvm 只用32 位地址就可以支持更大的内存配置 ( 小于等于 32G)
4. 堆内存小于 4G 时,不需要启用指针压缩, jvm 会直接去除高 32 位地址,即使用低虚拟地址空间
5. 堆内存大于 32G 时,压缩指针会失效,会强制使用 64 位 ( 即 8 字节 ) 来对 java 对象寻址,这就会出现 1 的问题,所以堆内存不要大于32G 为好
三、对象内存分配
对象栈上分配
我们通过JVM内存分配可以知道JAVA中的对象都是在堆上进行分配,当对象没有被引用的时候,需要依靠GC进行回收内存,如果对象数量较多的时候,会给GC带来较大压力,也间接影响了应用的性能。为了减少临时对象在堆内分配的数量,JVM通过 逃逸分析 确定该对象不会被外部访问。 如果不会逃逸可以将该对象在栈上分配内存 ,这样该对象所占用的内存空间就可以随栈帧出栈而销毁,就减轻了垃圾回收的压力。
对象逃逸分析 :就是分析对象动态作用域,当一个对象在方法中被定义后,它可能被外部方法所引用,例如作为调用参数传递到其他地方中。
public User test1() { User user = new User(); user.setId(1); user.setName("zhuge"); //TODO 保存到数据库 return user; } public void test2() { User user = new User(); user.setId(1); user.setName("zhuge"); //TODO 保存到数据库 }
很显然test1方法中的user对象被返回了,这个对象的作用域范围不确定,test2方法中的user对象我们可以确定当方法结束这个对象就可以认为是无效对象了,对于这样的对象我们其实可以将其分配在栈内存里,让其在方法结束时跟随栈内存一起被回收掉。
JVM对于这种情况可以通过开启逃逸分析参数(-XX:+DoEscapeAnalysis)来优化对象内存分配位置,使其通过 标量替换 优先分配在栈上(栈上分配 ),JDK7之后默认开启逃逸分析,如果要关闭使用参数(-XX:-DoEscapeAnalysis)
标量替换: 通过逃逸分析确定该对象不会被外部访问,并且对象可以被进一步分解时, JVM不会创建该对象 ,而是将该对象成员变量分解若干个被这个方法使用的成员变量所代替,这些代替的成员变量在栈帧或寄存器上分配空间,这样就不会因为没有一大块连续空间导致对象内存不够分配。开启标量替换参数(-XX:+EliminateAllocations),JDK7之后默认开启。
标量与聚合量: 标量即不可被进一步分解的量,JAVA的基本数据类型就是标量(如:int,long等基本数据类型以及reference类型等),标量的对立就是可以被进一步分解的量,而这种量称之为聚合量。而在JAVA中对象就是可以被进一步分解的聚合量。
结论: 栈上分配依赖于逃逸分析和标量替换
大对象直接进入老年代
大对象就是需要大量连续内存空间的对象(比如:字符串、数组)。JVM参数 -XX:PretenureSizeThreshold 可以设置大对象的大小,如果对象超过设置大小会直接进入老年代,不会进入年轻代,这个参数只在 Serial 和ParNew两个收集器下有效(G1中的大对象不在年轻代,有个专门的地方存放)。比如设置JVM参数:-XX:PretenureSizeThreshold=1000000 (单位是字节) -XX:+UseSerialGC ,会发现大对象直接进了老年代
为什么要这样呢?
为了避免为大对象分配内存时的复制操作而降低效率。
长期存活的对象将进入老年代
既然虚拟机采用了分代收集的思想来管理内存,那么内存回收时就必须能识别哪些对象应放在新生代,哪些对象应放在 老年代中。为了做到这一点,虚拟机给每个对象一个对象年龄(Age)计数器。 如果对象在 Eden 出生并经过第一次 Minor GC 后仍然能够存活,并且能被 Survivor 容纳的话,将被移动到 Survivor空间中,并将对象年龄设为1。对象在 Survivor 中每熬过一次 MinorGC,年龄就增加1岁,当它的年龄增加到一定程度(默认为15岁,CMS收集器默认6岁,不同的垃圾收集器会略微有点不同),就会被晋升到老年代中。对象晋升到老年代的年龄阈值,可以通过参数 -XX:MaxTenuringThreshold 来设置。
对象动态年龄判断
如果一批对象放入suvivor区时,他们的总大小大于suvivor区的50%(-XX:TargetSurvivorRatio可以指定),则将偏大的对象直接放入老年代。对象动态年龄判断机制一般是在minor gc之后触发的。
老年代空间分配担保机制
年轻代 每次 minor gc 之前, JVM都会先判断当前年轻代总对象与老年代的剩余空间的大小关系,如果年轻代总对象大小比老年代的剩余空间小,则直接触发minor gc;如果年轻代总对象大小比老年代的剩余空间大,则判断是否配置了-XX:-HandlePromotionFailure参数(jdk1.8默认配置),如果配置了,则比较之前每一次minor gc后进入老年代的对象平均大小是否大于大于老年代的剩余空间,如果大于则先执行一次full gc后再执行一次minor gc。 对老年代和年轻代一起回收一次垃圾,如果回收完还是没有足够空间存放新的对象就会发生"OOM";如果小于则只执行一次minor gc。如果没配置-XX:-HandlePromotionFailure参数,则直接则先执行一次full gc后再执行一次minor gc。 对老年代和年轻代一起回收一次垃圾,如果回收完还是没有足够空间存放新的对象就会生"OOM";
当然,如果minor gc之后剩余存活的需要挪动到老年代的对象大小还是大于老年代可用空间,那么也会触发full gc,full gc完之后如果还是没有空间放minor gc之后的存活对象,则也会发生“OOM”