使用字节数组创建String后通过getBytes()得到的数组与创建时不同

博客指出使用默认编码创建字符串后,通过getBytes()方法获得的数组与创建时不同。原因是默认UTF8为多字节编码,除非字节值都在0 - 127间,否则会出现前后不一致。解决办法是使用单字节编码ISO - 8859 - 1,可避免数组在转化中被修改。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

问题:使用默认编码创建字符串后,通过生成的字符串的getBytes()方法获得的数组与创建时的数组不同。代码如下:

byte[] bytes=new byte[]{-42, -48, -50, -60, -78, -30, -54, -44};
System.out.println(Arrays.toString(bytes));
System.out.println(Arrays.toString(new String(bytes).getBytes()));

前后数组对比如下:

[-42, -48, -50, -60, -78, -30, -54, -44]
[-17, -65, -67, -17, -65, -67, -17, -65, -67, -60, -78, -17, -65, -67, -17, -65, -67, -17, -65, -67]

原因:创建字符串和getBytes时没有传入指定的字符编码,我的环境默认编码是UTF8,之所以出现上面的问题,是因为UTF8是多字节编码,会用一个或多个字节来表示一个一个字符,所以通过getBytes获得的字节数组会比之前的长。所以除非字节数组的所有值都在0-127之间,即UTF8可以用一个字节来表示时,才不会出现前后不一致的问题。比如:

byte[] bytes=new byte[]{127,65,25,0};
System.out.println(Arrays.toString(bytes));
System.out.println(Arrays.toString(new String(bytes).getBytes()));

执行前后结果一致。

解决办法:所以如果想要保持前后一致,需要中间过渡时使用单字节编码的编码格式,比如ISO-8859-1,这样字节数组才不会在中间转化的过程中被修改。这也是ISO-8859-1编码非常重要的一个特性。

评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值