Java9 后String 为什么使用byte[]而不是char

作者: rhuanhuan | 来源:发表于2020-03-21 20:51 被阅读0次

Java9 后String 为什么使用byte[]而不是char
Java·String、StringBuilder、String
char、String转byte
【JAVA】Char、String、StringBuffer、S
C++基本数据类型之Byte和char
第二篇-流程控制与数组
值传递与引用传递
2018-07-03 Java类结构与编译指令--类型自动转换
scala学习（2）
Java中byte[]和String的转换问题

之前认知里面，java的String一直是使用char数组，但是今天点进去瞟了一眼，发现不对。
源码如下：

    /**
     * The value is used for character storage.
     *
     * @implNote This field is trusted by the VM, and is a subject to
     * constant folding if String instance is constant. Overwriting this
     * field after construction will cause problems.
     *
     * Additionally, it is marked with {@link Stable} to trust the contents
     * of the array. No other facility in JDK provides this functionality (yet).
     * {@link Stable} is safe here, because value is never null.
     */
    @Stable
    private final byte[] value;

这分明就是byte数组，哪里是char了？于是上网查了下，这个改动在 Java9以后就发生了。

为什么有这个改动？char -> byte

主要还是节省空间。

JDK9 之前的库的 String 类的实现使用了 char 数组来存放字符串，char 占用16位，即两字节。

private final char value[];

这种情况下，如果我们要存储字符A，则为0x00 0x41，此时前面的一个字节空间浪费了。但如果保存中文字符则不存在浪费的情况，也就是说如果保存 ISO-8859-1 编码内的字符则浪费，之外的字符则不会浪费。

而 JDK9 后 String 类的实现使用了 byte 数组存放字符串，每个 byte 占用8位，即1字节。
private final byte[] value
但是如果遇到ISO-8859-1 编码外的字符串呢？比如中文咋办？

Java9之后String的新属性，`coder`编码格式

借用网上盗的一个图：

Java String的演进

    private final byte coder;
    static final boolean COMPACT_STRINGS;
    static {
        COMPACT_STRINGS = true;
    }
    byte coder() {
        return COMPACT_STRINGS ? coder : UTF16;
    }
    @Native static final byte LATIN1 = 0;
    @Native static final byte UTF16  = 1;

是编码格式的标识，在计算字符串长度或者调用 indexOf() 函数时，需要根据这个字段，判断如何计算字符串长度。
coder 属性默认有 0 和 1 两个值。如果 String判断字符串只包含了 Latin-1，则 coder 属性值为 0 ，反之则为 1

0 代表Latin-1（单字节编码）
1 代表 UTF-16 编码。。
Java9 默认打开COMPACT_STRINGS, 而如果想要取消紧凑的布局可以通过配置 VM 参数-XX:-CompactStrings实现。

网友评论

本文标题：Java9 后String 为什么使用byte[]而不是char

本文链接：https://www.haomeiwen.com/subject/jwguyhtx.html

延伸阅读

深度阅读

您也可以注册成为美文阅读网的作者，发表您的原创作品、分享您的心情！

Java9 后String 为什么使用byte[]而不是char

为什么有这个改动？char -> byte

Java9之后String的新属性，`coder`编码格式

相关文章