1. 首页
  2. 课程学习
  3. 网络管理
  4. 如何解决远程页面抓取中的乱码问题

如何解决远程页面抓取中的乱码问题

上传者: 2020-12-13 11:22:29上传 PDF文件 36.67KB 热度 14次
由于平时使用的网页文件基本上都是gb2312编码方式,如果通过xmlhttp控件读取的话,肯定会出现乱码问题,但是要把所有文件都改成utf-8编码,操作上比较麻烦。经过反复比较,我找到了相对实用的解决方法。 ff提供了overrideMimeType方法,可以指定返回值的编码,所以解决起来比较简单,只要把这个方法指向gb2312就可以了。对于IE,可以用vbs配合来作编码转换,用gb2utf8来转换接收到的二进制数据,其中利用到execScript方法来调用vbs的函数。 代码如下:<body></body> [removed] loadPage(“index.ht
用户评论