js文件中,有些变量的值可能会含有汉字,画面引入js之后,有可能会由于字符集的缘由,把里面的汉字都变成乱码。后来发现网上的一些js里会把变量中的汉字都表示成”\u“开头的16进制编码,这样应该能够解决上面的问题。javascript
最近有时间在网上查找了一下实现方式,一种比较大众化的:html
function tounicode(data) { if(data == '') return '请输入汉字'; var str =''; for(var i=0;i<data.length;i++) { str+="\\u"+parseInt(data[i].charCodeAt(0),10).toString(16); } return str; } function tohanzi(data) { if(data == '') return '请输入十六进制unicode'; data = data.split("\u"); var str =''; for(var i=0;i<data.length;i++) { str+=String.fromCharCode(parseInt(data[i],16).toString(10)); } return str; }
还找到一个相对简单一些,但比较另类的: java
var GB2312UnicodeConverter={ ToUnicode:function(str){ return escape(str).toLocaleLowerCase().replace(/%u/gi,'\\u'); } ,ToGB2312:function(str){ return unescape(str.replace(/\\u/gi,'%u')); } };
不过都有些问题,这两种方式,都会把出汉字之外的其余字符都给转换掉,作个简单的加密解密算法仍是能够的,但要是用来处理js文件,把回车、换行、空格、tab字符全换了,转完之后,js文件也无法运行了。 算法
偷懒不成,只能本身按照上面代码处理逻辑写一个了,只要保证只转换汉字字符就能够了: 浏览器
// 汉字转为Unicode字符码表示 function toUnicode(s){ return s.replace(/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])/g,function(){ return "\\u" + RegExp["$1"].charCodeAt(0).toString(16); }); }
<head> <script language="javascript"> function Window_Load(){ var G = document.getElementById; G("cmdToU").onclick = function(){ clipboardData.setData("text",toUnicode(clipboardData.getData("text"))); } } // 汉字转为Unicode字符码表示
// 原函数是,红色是是错误的,致使多个中文时,结果都是最后一个汉字的unicode码; function toUnicode(s){ return s.replace(/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])/g,function(){ return "\\u" + RegExp["$1"].charCodeAt(0).toString(16); }); }
// 经@b4b4指正,现更改
function toUnicode(s){ return s.replace(/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])/g,function(newStr){ return "\\u" + newStr.charCodeAt(0).toString(16);
});
}
</script> </head> <body onload="Window_Load();"> <button id="cmdToU">汉字转为Unicode</button> </body> </html>
这个页面只能在IE内核的浏览器下才能正常运行,由于clipboardData对象好像只在IE下面有。函数
感谢编码
@b4b4阅读并指正;