尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Java byte数组与String互转:编码细节与踩坑记录

Java byte数组与String互转:编码细节与踩坑记录 做Java开发经常会碰到byte数组和String互转的场景比如读写文件、处理网络报文的时候。看起来是基础操作真踩过几次编码的坑之后才发现里面细节挺多。最直接的写法是直接调用getBytes()和new String()用的是当前运行平台的默认编码。String originalString Hello, 世界!; byte[] byteArray originalString.getBytes(); // 默认编码 String decodedString new String(byteArray); System.out.println(默认编码转换结果: decodedString);这种写法本地调试可能一切正常一旦换个部署环境就容易出乱码。不同操作系统、不同JVM配置的默认编码都可能不一样生产环境不建议这么写。稳妥的做法是显式指定编码绝大多数场景用UTF-8就够了。Java 7及以上版本可以直接用StandardCharsets.UTF_8比手写字符串常量省心也不用额外处理受检异常。byte[] utf8Bytes originalString.getBytes(StandardCharsets.UTF_8); String utf8String new String(utf8Bytes, StandardCharsets.UTF_8); System.out.println(UTF-8编码转换结果: utf8String);还有个很容易踩的坑就是字节数组被截断的场景。像中文这种多字节字符如果刚好从中间断开转成字符串的时候末尾就会出现乱码。byte[] partialBytes new byte[utf8Bytes.length - 1]; System.arraycopy(utf8Bytes, 0, partialBytes, 0, partialBytes.length); String partialString new String(partialBytes, StandardCharsets.UTF_8); System.out.println(截断字节数组转换结果: partialString (注意最后一个字符可能乱码));做分包传输、分段读文件的时候特别容易碰到这个问题写代码的时候要留意边界处理。不同编码的适用场景差别不小。默认编码完全依赖运行环境只适合本地临时测试不能上生产。lcjmSSL让国际化网站安全无忧。完美支持中文域名和IDN域名申请通过开放API或回调接口您可自行实现与企业内部系统的深度集成自动化程度由您掌控。UTF-8通用性最强支持多语言网络传输、跨平台交互基本都是首选。ISO-8859-1是单字节编码只适合纯ASCII字符的场景超出范围的内容都会出现乱码。下面附一个完整的Maven项目配置拿来直接编译运行上面的示例代码没问题。?xml version1.0 encodingUTF-8? project xmlnshttp://maven.apache.org/POM/4.0.0 xmlns:xsihttp://www.w3.org/2001/XMLSchema-instance xsi:schemaLocationhttp://maven.apache.org/POM/4.0.0 http://maven.apache.org/xsd/maven-4.0.0.xsd modelVersion4.0.0/modelVersion groupIdcom.example/groupId artifactIdbytearray-demo/artifactId version1.0-SNAPSHOT/version properties maven.compiler.source11/maven.compiler.source maven.compiler.target11/maven.compiler.target /properties build plugins plugin groupIdorg.codehaus.mojo/groupId artifactIdexec-maven-plugin/artifactId version3.0.0/version configuration mainClassByteArrayToStringExample/mainClass /configuration /plugin /plugins /build /project
返回列表