国内最全IT社区平台 联系我们 | 收藏本站
华晨云阿里云优惠2
您当前位置:首页 > php开源 > php教程 > Invalid byte 1 of 1-byte UTF-8 sequence解决办法

Invalid byte 1 of 1-byte UTF-8 sequence解决办法

来源:程序员人生   发布时间:2014-03-31 21:02:50 阅读次数:3755次

错误提示:Invalid byte 1 of 1-byte UTF-8 sequence

原因分析:在中文版的window下java的默认的编码为GBK,也就是所虽然我们标识了要将xml保存为utf-8格式但实际上文件是以GBK格式来保存的,所以这也就是为什么能够我们使用GBK、GB2312编码来生成xml文件能正确的被解析,而以UTF-8格式生成的文件不能被xml解析器所解析的原因。

把xml的encoding属性值UTF-8改为UTF8,org.xml.sax.SAXParseException: Content is not allowed in trailing section,把先要解析和字符串trim()一下即可解决问题。

解决方法:

1、最简单就是把<?xml version="1.0" encoding="UTF-8"?>改成<?xml version="1.0" encoding="gbk"?>

2、或者把xml打开另存的时候把字符集改为UTF-8后保存或改程序,代码如下:

  1.  SAXReader reader = new SAXReader();   
  2.   org.dom4j.Document document = reader.read("D:ha.xml");   
  3.   OutputFormat of = new OutputFormat();   
  4.   of.setEncoding("UTF-8"); //改变编码方式   
  5. XMLWriter writer = new XMLWriter(new FileWriter "d:dom4j.xml"), of);  
我使用的是eclipse编辑器如下操作即可,可以在Eclipse中更改,在 eclipse 的功能表 [Project]→[Properties],?? [Resources],在右?的「Text file encoding」,把原?硎窍到y??的??,改? 「UTF-8」。
生活不易,码农辛苦
如果您觉得本网站对您的学习有所帮助,可以手机扫描二维码进行捐赠
程序员人生
------分隔线----------------------------
分享到:
------分隔线----------------------------
关闭
程序员人生