使用字节数组创建String后通过getBytes()得到的数组与创建时不同

问题：使用默认编码创建字符串后，通过生成的字符串的getBytes()方法获得的数组与创建时的数组不同。demo代码如下

byte[] bytes=new byte[]{-42, -48, -50, -60, -78, -30, -54, -44};
System.out.println(Arrays.toString(bytes));
System.out.println(Arrays.toString(new String(bytes).getBytes()));

前后数组对比如下：

[-42, -48, -50, -60, -78, -30, -54, -44]
[-17, -65, -67, -17, -65, -67, -17, -65, -67, -60, -78, -17, -65, -67, -17, -65, -67, -17, -65, -67]

原因：创建字符串和getBytes时没有传入指定的字符编码，我的环境默认编码是UTF8，之所以出现上面的问题，是因为UTF8是多字节编码，会用一个或多个字节来表示一个一个字符，所以通过getBytes获得的字节数组会比之前的长。所以除非字节数组的所有值都在0-127之间，即UTF8可以用一个字节来表示时，才不会出现前后不一致的问题。比如：

byte[] bytes=new byte[]{127,65,25,0};
System.out.println(Arrays.toString(bytes));
System.out.println(Arrays.toString(new String(bytes).getBytes()));

执行前后结果一致。

解决办法：所以如果想要保持前后一致，需要中间过渡时使用单字节编码的编码格式，比如ISO-8859-1，这样字节数组才不会在中间转化的过程中被修改。这也是ISO-8859-1编码非常重要的一个特性。

ref: https://blog.csdn.net/asty9000/article/details/82228418

注意: 本文归作者所有, 未经作者允许, 不得转载. 若有谬误, 欢迎指出

热门文章

随机推荐

友情链接

网站统计