(1)Java代码默认以unicode存储。但是在操作系统选用一定的开发环境编辑java文件,却使用操作系统默认的编码方式,从而源文件的编码方式与编辑平台相关。在中文windows平台下开发的源文件,将以GB2312方式编码。 如果要将它以utf-8编码,在编译的时候要指它 -encoding GB2312 ,这样,编译后生成的字节文件编码为UTF-8,其中的硬编码信息也以UTF-8格式存储。
(2) 分析下网上的一个例子:(实践出真知,真正运行下程序才明白怎么回事)
import java.io.FileInputStream;
import java.io.InputStreamReader;
import java.io.BufferedReader;
public class Decode{
public static void main (String []args) throws Exception{
FileInputStream fis=new FileInputStream("./document.txt"); //文件字节流
InputStreamReader isr=new InputStreamReader(fis,"UTF-8");//字节流和字符流的桥梁,可以指定指定字符格式
String str=null;
//直接读取字符,只要编码问题没问题
int c=0;
while((c=isr.read())!=-1)
System.out.print((char)c); [ 1 ]
System.out.println(" first one______________________________________________________");
//将InputStreamReader 封装到缓冲流中,需要字符编码正确
BufferedReader br=new BufferedReader(isr);
str=br.readLine();
while(str!=null)
{
System.out.println(str);
str=br.readLine();
} [ 2 ]
System.out.println(" second one______________________________________________________");
//使用默认编码的InputStreamReader ,当为ANSI的时候没问题,但是读取UTF-8的时候出错。
BufferedReader br2=new BufferedReader(new InputStreamReader(fis));
str=br2.readLine();
while(str!=null)
{
System.out.println(str); [ 3 ]
str=br2.readLine();
}
System.out.println(" third one______________________________________________________");
}
}
Decode.java : ANSI
document.txt : UTF-8(无BOM)
新建txt文档,复制此处代码,保存到txt中,为Decode.java, 可以用nodtpad++看到采用ANSI编码,这里ANSI是和系统的默认字符集相关的,中文winodws下为GB2312, 运 行 javac Decode.java, OK; 然后运行java Decode: 【1】【2】正确输出中文,【3】输出乱码
Decode.java :ANSI
document.txt :ANSI
【1】【2】输出乱码 ,【3】正确输出中文
Decode.java :UTF-8(无BOM) document.txt :utf-8(无bom)
javac Decode.java 有警告,编码的GBK不可映射。 java Decode: 【1】【2】正确输出,【3】输出乱码
Decode.java :UTF-8(无BOM) document.txt:ANSI
javac Decode.java有警告,编码的GBK不可映射 java Decode: 【1】【2】输出乱码,【3】正确输出
从实际运行的结果可以看出,1、当java文件编码为ANSI时,如果要读取的文件采用UTF-8编码,需要指明 new InputStreamReader(fis,"UTF-8"), 这样才能正确读取UTF-8编码的中文,如果不指定,默认的InputStreamReader采用默认的字符集,这时就是ANSI了,无法读出UTF-8 编码的文件。但如果要读取的文件和java文件都一样采用默认的编码,刚可以用InputStreamReader的默认字符集。 2、当在Eclipse中为工程指定属性UTF-8后,我们的java源文件会采用UTF-8编码,这时读取的文件如果为ANSI,则采用 InputStreamReaderr的默认字符集。 3、到至读放流后,按字节读取,刚需要文件的编码与读入时设定的编码相同。
分享到:
相关推荐
中文乱码问题分析中文乱码问题分析中文乱码问题分析中文乱码问题分析中文乱码问题分析中文乱码问题分析
java中最头疼的可能就是中文乱码的问题,这个可以彻底解决中文乱码的问题
本资源参考网上原版为存取英文字符的ini操作,未考虑中文乱码问题。而网上另外也有资料如何处理中文编码,例如转码为utf-8,存能解决乱码,取又出现问题。本资源我重新整理,用unicode完美解决中文乱码问题。用法: ...
解决Lua文件反编译后汉字乱码问题。开发环境vs2013,语言c#
解决jspdf导出pdf中文乱码,详细说明地址:https://blog.csdn.net/jinggaoniao/article/details/108751020
c#控制台下的汉字输出乱码,可以通过这段程序解决
Java关于中文乱码问题的多种解决方法,中文乱码过滤器
本Demo主要针对jquery的$.getJSON操作,返回json, 针对传参出现的中文乱码, json里出现中文乱码。
jsoncpp解决中文乱码,测试ok,欢迎下载使用,ubuntu下测试ok的 ,里面有makefile,直接编译就可以,也可以自己修改交叉编译
sqlite3 for delphi 自己修改的版本 解决中文乱码问题
sqlite数据库存取中文乱码的全部解决方案(包括其它数据库oracle+sqlserver+mysql) 数据库的连接方式、数据库里存放数据的字体编码、所选编程语言的缺省字体编码。如果在编程中遇到不能正确显示中文时、、、、
SQL-SERVER-64位配置ORACLE连接-中文乱码问题
解决Navicat for MySql 导入EXCEL中文乱码问题解决的有效方法
小程序蓝牙打印,中文乱码已解决(安卓正常打印)小程序蓝牙打印,中文乱码已解决(安卓正常打印)小程序蓝牙打印,中文乱码已解决(安卓正常打印)小程序蓝牙打印,中文乱码已解决(安卓正常打印)
WebSevice 中文乱码
VC++编译后出现中文乱码解决方案借鉴.pdf
ZXing 2.1版GBK中文乱码解决办法: zxing中扫瞄二维码图片,如果包含Gbk中文,乱码解决办法是修改DecodedBitStreamParser.h文件,在里面加入GBK的判断。 在2.1版本中,解码的定义不在这个类中了,挪到了...
敝人近期整理的客户端与服务端通信实例,数据编码约定采用UTF-8编码,解决中文乱码问题.ServerSocket组件可以同时接受一个或多个ClientSocket组件的连接请求,并与每个ClientSocket组件建立单独的连接,进行单独的...
SAP DS数据抽取时中文乱码的解决方案
解决ultraeditor打开中文文件出现乱码的情况