项目不少 lua 文件不是 utf-8格式,使用 EditPlus 查看的时候,显示为ASCII。还有的是带BOM的,带BOM倒好处理,以前写过,有必定规律。html
ASCII编码就比较蛋疼,经过搜索网上资源,反复测试对比,最终造成下面比较靠谱的方法(有一些 EditPlus显示编码为utf-8但node.js库返回的倒是其它编码>_<)node
判断修改是否无误,只须要在修改完以后,经过SVN提交,浏览提交列表,双击任意一项待提交文件,若是显示下图所示的对话框,则说明修改为功,其它都会看到中文反而变成乱码了git
var fs = require('fs'); var chardet = require('chardet'); var jschardet = require("jschardet"); var encoding = require("encoding"); var path = "lua目录"; function readDirectory(dirPath) { if (fs.existsSync(dirPath)) { var files = fs.readdirSync(dirPath); files.forEach(function (file) { var filePath = dirPath + "/" + file; var stats = fs.statSync(filePath); if (stats.isDirectory()) { // console.log('/n读取目录:\n', filePath, "\n"); readDirectory(filePath); } else if (stats.isFile() && /\.lua$/.test(filePath)) { var buff = fs.readFileSync(filePath); if (buff.length && buff[0].toString(16).toLowerCase() == "ef" && buff[1].toString(16).toLowerCase() == "bb" && buff[2].toString(16).toLowerCase() == "bf") { //EF BB BF 239 187 191 console.log('\n发现BOM文件:', filePath, "\n"); buff = buff.slice(3); fs.writeFile(filePath, buff.toString(), "utf8"); } // { encoding: 'UTF-8', confidence: 0.99 } // var charset = chardet.detectFileSync(filePath); var info = jschardet.detect(buff); if (info.encoding == "GB2312" || info.encoding == "ascii") { var resultBuffer = encoding.convert(buff, "UTF-8", info.encoding); fs.writeFile(filePath, resultBuffer, "utf8"); } else if (info.encoding != "UTF-8" && chardet.detectFileSync(filePath) != "UTF-8") { if (buff.toString().indexOf("\r\n") > -1) { var resultBuffer = encoding.convert(buff, "UTF-8", "GBK"); fs.writeFile(filePath, resultBuffer, "utf8"); } } } }); } else { console.log('Not Found Path : ', dirPath); } } readDirectory(path);
注意上面的判断,第一个明确是 GB2312或者ascii时,直接将相应的编码转为 utf-8。而若是返回是格式,先判断是否有PC下的换行符,若是有则所有将它视为GBK进行处理。github
整个思路实际上是比较简单,难点在于若是判断文件编码格式。这个真的很难>_<,获取原编码格式后,调用 encoding.convert(buff, 目标编码格式, 原始编码格式); 即可获得所须要的编码。若是有空并且有兴趣,能够下载Notepad++的源码,看它是如何判断文件的编码格式ide
注:上面的方法所修改的文件,跟 Mac 上须要提交的文件列表是一致的,至少能解决我目前遇到的问题。若是有特殊的,可对上面的代码进行修正。测试
用到的第三方库:ui
编码相关的基础知识,能够参考阮一峰的这篇文章:http://www.ruanyifeng.com/blog/2007/10/ascii_unicode_and_utf-8.html编码
维基百科和其它资料太过专业化了,并且对 ASCII 编码的介绍很少,再也不一一列举出来了。lua