java转换字符串编码格式的方法

作者:du_xian_sheng 时间:2022-02-12 04:30:24 

java转换字符串编码格式 (解码错误,重新解码)

字符集概念:规定了某个文字对应的二进制数字存放方式(编码)和某串二进制数值代表了哪个文字(解码)的转换关系。

我们在计算机屏幕上看到的是实体化的文字,而在计算机存储介质中存放的实际是二进制的比特流。 

乱码场景(纯属瞎掰):

1) 前台输入utf-8编码的一串汉字(string1)。 (页面编码为utf-8, 在内存中会将这串汉字以utf-8编码为对应的二进制流存储)

2) 这串汉字(string1)的二进制流在经过http协议传输到后台时,这段比特流会被以iso-8859-1编码强行解码为字符串(string2)。

(2.1 http默认编码格式为iso-8859-1)

(2.2 这个默认编码在什么时候起作用呢? 应该是在到达tomcat之后, 到达servlet之前, tomcat对request请求强行使用iso-8859-1进行了解码)

(2.3 有什么办法阻止tomcat对request请求强行iso-8859-1解码呢?

apache-tomcat\conf\server.xml中添加URIEncoding="UTF-8"配置即可,还是来个图吧)

java转换字符串编码格式的方法

3) 在后台(servlet)接收字符串(string2)时毫无疑问的乱码了。

) 这时需要将接收到的字符串(string2)根据iso-8859-1编码重新转换为byte流。再将byte流根据utf-8编码重新解码为字符串(sting3)。

5) 这时的字符串(string3)和前台的字符串(string1)是对应同一个二进制流,并且使用的是同一种编码。也就不会乱码了。

乱码的另一种解决办法:

request.setCharacterEncoding("UTF-8"),这句话熟悉么,这句话的意思是:用"utf-8"编码对客户端的请求进行重新解码。

在步骤2之后(或步骤3中)执行,那么接收到的参数也不会乱码啦。 

一个小例子:


import java.io.UnsupportedEncodingException;

public class ConvertEncodingFormat {

/**
  * 将一段错误解码的字符串重新解码
  */
 public static String convertEncodingFormat(String str, String formatFrom, String FormatTo) {
   String result = null;
   if (!(str == null || str.length() == 0)) {
     try {
       result = new String(str.getBytes(formatFrom), FormatTo);
     } catch (UnsupportedEncodingException e) {
       e.printStackTrace();
     }
   }
   return result;
 }

/**
  * test
  */
 public static void main(String[] args) {
// utf-8编码
   String str = "你好,少年!";

// UTF-8编码的byte流强行用iso-8859-1解码,毫无疑问的乱码了
   String str1 = convertEncodingFormat(str, "UTF-8", "iso-8859-1");
   System.out.println(str1);

// 将str1再转化为byte流,重新用UTF-8解码,乱码问题解决
   String str2 = convertEncodingFormat(str1, "iso-8859-1", "UTF-8");
   System.out.println(str2);
 }

}

java字符串的各种编码转换


import java.io.UnsupportedEncodingException;

/**
* 转换字符串的编码
*/
public class ChangeCharset {
/** 7位ASCII字符,也叫作ISO646-US、Unicode字符集的基本拉丁块 */
public static final String US_ASCII = "US-ASCII";

/** ISO 拉丁字母表 No.1,也叫作 ISO-LATIN-1 */
public static final String ISO_8859_1 = "ISO-8859-1";

/** 8 位 UCS 转换格式 */
public static final String UTF_8 = "UTF-8";

/** 16 位 UCS 转换格式,Big Endian(最低地址存放高位字节)字节顺序 */
public static final String UTF_16BE = "UTF-16BE";

/** 16 位 UCS 转换格式,Little-endian(最高地址存放低位字节)字节顺序 */
public static final String UTF_16LE = "UTF-16LE";

/** 16 位 UCS 转换格式,字节顺序由可选的字节顺序标记来标识 */
public static final String UTF_16 = "UTF-16";

/** 中文超大字符集 */
public static final String GBK = "GBK";

/**
* 将字符编码转换成US-ASCII码
*/
public String toASCII(String str) throws UnsupportedEncodingException{
return this.changeCharset(str, US_ASCII);
}
/**
* 将字符编码转换成ISO-8859-1码
*/
public String toISO_8859_1(String str) throws UnsupportedEncodingException{
return this.changeCharset(str, ISO_8859_1);
}
/**
* 将字符编码转换成UTF-8码
*/
public String toUTF_8(String str) throws UnsupportedEncodingException{
return this.changeCharset(str, UTF_8);
}
/**
* 将字符编码转换成UTF-16BE码
*/
public String toUTF_16BE(String str) throws UnsupportedEncodingException{
return this.changeCharset(str, UTF_16BE);
}
/**
* 将字符编码转换成UTF-16LE码
*/
public String toUTF_16LE(String str) throws UnsupportedEncodingException{
return this.changeCharset(str, UTF_16LE);
}
/**
* 将字符编码转换成UTF-16码
*/
public String toUTF_16(String str) throws UnsupportedEncodingException{
return this.changeCharset(str, UTF_16);
}
/**
* 将字符编码转换成GBK码
*/
public String toGBK(String str) throws UnsupportedEncodingException{
return this.changeCharset(str, GBK);
}

/**
* 字符串编码转换的实现方法
* @param str 待转换编码的字符串
* @param newCharset 目标编码
* @return
* @throws UnsupportedEncodingException
*/
public String changeCharset(String str, String newCharset)
 throws UnsupportedEncodingException {
if (str != null) {
 //用默认字符编码解码字符串。
 byte[] bs = str.getBytes();
 //用新的字符编码生成字符串
 return new String(bs, newCharset);
}
return null;
}
/**
* 字符串编码转换的实现方法
* @param str 待转换编码的字符串
* @param oldCharset 原编码
* @param newCharset 目标编码
* @return
* @throws UnsupportedEncodingException
*/
public String changeCharset(String str, String oldCharset, String newCharset)
 throws UnsupportedEncodingException {
if (str != null) {
 //用旧的字符编码解码字符串。解码可能会出现异常。
 byte[] bs = str.getBytes(oldCharset);
 //用新的字符编码生成字符串
 return new String(bs, newCharset);
}
return null;
}

public static void main(String[] args) throws UnsupportedEncodingException {
ChangeCharset test = new ChangeCharset();
String str = "This is a 中文的 String!";
System.out.println("str: " + str);
String gbk = test.toGBK(str);
System.out.println("转换成GBK码: " + gbk);
System.out.println();
String ascii = test.toASCII(str);
System.out.println("转换成US-ASCII码: " + ascii);
gbk = test.changeCharset(ascii,ChangeCharset.US_ASCII, ChangeCharset.GBK);
System.out.println("再把ASCII码的字符串转换成GBK码: " + gbk);
System.out.println();
String iso88591 = test.toISO_8859_1(str);
System.out.println("转换成ISO-8859-1码: " + iso88591);
gbk = test.changeCharset(iso88591,ChangeCharset.ISO_8859_1, ChangeCharset.GBK);
System.out.println("再把ISO-8859-1码的字符串转换成GBK码: " + gbk);
System.out.println();
String utf8 = test.toUTF_8(str);
System.out.println("转换成UTF-8码: " + utf8);
gbk = test.changeCharset(utf8,ChangeCharset.UTF_8, ChangeCharset.GBK);
System.out.println("再把UTF-8码的字符串转换成GBK码: " + gbk);
System.out.println();
String utf16be = test.toUTF_16BE(str);
System.out.println("转换成UTF-16BE码:" + utf16be);
gbk = test.changeCharset(utf16be,ChangeCharset.UTF_16BE, ChangeCharset.GBK);
System.out.println("再把UTF-16BE码的字符串转换成GBK码: " + gbk);
System.out.println();
String utf16le = test.toUTF_16LE(str);
System.out.println("转换成UTF-16LE码:" + utf16le);
gbk = test.changeCharset(utf16le,ChangeCharset.UTF_16LE, ChangeCharset.GBK);
System.out.println("再把UTF-16LE码的字符串转换成GBK码: " + gbk);
System.out.println();
String utf16 = test.toUTF_16(str);
System.out.println("转换成UTF-16码:" + utf16);
gbk = test.changeCharset(utf16,ChangeCharset.UTF_16LE, ChangeCharset.GBK);
System.out.println("再把UTF-16码的字符串转换成GBK码: " + gbk);
String s = new String("中文".getBytes("UTF-8"),"UTF-8");
System.out.println(s);
}
}

来源:https://blog.csdn.net/H12KJGJ/article/details/68065637

标签:java,转换,字符串,编码
0
投稿

猜你喜欢

  • 基于Java Socket实现一个简易在线聊天功能(一)

    2023-09-23 17:18:35
  • 一文搞懂C++中的运算符重载

    2021-08-02 02:47:53
  • C#判断系统是32位还是64位的方法

    2022-04-01 12:44:04
  • Java设置PDF有序和无序列表的知识点总结

    2022-04-18 03:29:27
  • java模拟TCP通信实现客户端上传文件到服务器端

    2023-11-26 10:14:49
  • C# byte转为有符号整数实例

    2022-01-02 13:28:01
  • MyBatis-Plus工具使用之EntityWrapper解析

    2021-10-09 06:13:48
  • java中数组的定义及使用方法(推荐)

    2022-03-07 14:20:16
  • Java流程控制语句之If选择结构

    2023-11-11 04:02:29
  • C#中将ListView中数据导出到Excel的实例方法

    2023-12-07 04:00:08
  • 解析C#编程的通用结构和程序书写格式规范

    2022-12-22 03:41:41
  • WinForm实现自定义右下角提示效果的方法

    2023-01-19 08:19:57
  • java arrayList遍历的四种方法及Java中ArrayList类的用法

    2023-11-17 17:49:55
  • springboot中filter的用法详解

    2022-04-02 19:52:37
  • mybatis-plus 扩展批量新增的实现

    2023-07-14 14:24:13
  • 如何使用C#从word文档中提取图片

    2022-04-17 06:58:09
  • C#使用Socket实现本地多人聊天室

    2022-01-06 12:47:27
  • java&javascript自定义加密数据传输代码示例

    2021-11-29 02:09:33
  • 简略分析Android的Retrofit应用开发框架源码

    2023-09-17 22:12:30
  • InputStream数据结构示例解析

    2022-06-12 20:11:53
  • asp之家 软件编程 m.aspxhome.com