JS 汉字与Unicode码的相互转化

时间 2019-11-18

原文原文链接

js文件中，有些变量的值可能会含有汉字，画面引入js之后，有可能会由于字符集的缘由，把里面的汉字都变成乱码。后来发现网上的一些js里会把变量中的汉字都表示成”\u“开头的16进制编码，这样应该能够解决上面的问题。javascript

最近有时间在网上查找了一下实现方式，一种比较大众化的：html

function tounicode(data)
{
   if(data == '') return '请输入汉字';
   var str =''; 
   for(var i=0;i<data.length;i++)
   {
      str+="\\u"+parseInt(data[i].charCodeAt(0),10).toString(16);
   }
   return str;
}
function tohanzi(data)
{
    if(data == '') return '请输入十六进制unicode';
    data = data.split("\u");
    var str ='';
    for(var i=0;i<data.length;i++)
    {
        str+=String.fromCharCode(parseInt(data[i],16).toString(10));
    }
    return str;
}

还找到一个相对简单一些,但比较另类的: java

var GB2312UnicodeConverter={
        ToUnicode:function(str){
          return escape(str).toLocaleLowerCase().replace(/%u/gi,'\\u');
        }
        ,ToGB2312:function(str){
          return unescape(str.replace(/\\u/gi,'%u'));
        }
      };

不过都有些问题，这两种方式，都会把出汉字之外的其余字符都给转换掉，作个简单的加密解密算法仍是能够的，但要是用来处理js文件，把回车、换行、空格、tab字符全换了，转完之后，js文件也无法运行了。算法

偷懒不成，只能本身按照上面代码处理逻辑写一个了，只要保证只转换汉字字符就能够了：浏览器

// 汉字转为Unicode字符码表示
      function toUnicode(s){ 
        return s.replace(/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])/g,function(){
          return "\\u" + RegExp["$1"].charCodeAt(0).toString(16);
        });
      }

方法写完了，为了方便转换js文件的内容，再作个简单的页面，加一个button在画面上。先要作的是在js文件Ctr+A，Ctr+C，把内容拷贝到剪贴板里，而后再新建的这个画面上，点button的时候，从剪贴板里把内容读出来，调用方法转一下，在把内容放回剪贴板。而后再到 js文件里Ctr+A，Ctr+V一下就能够了。代码以下：<html>

  <head>
    <script language="javascript">
      function Window_Load(){ var G = document.getElementById; G("cmdToU").onclick = function(){ clipboardData.setData("text",toUnicode(clipboardData.getData("text"))); } } // 汉字转为Unicode字符码表示

// 原函数是，红色是是错误的，致使多个中文时，结果都是最后一个汉字的unicode码；
      function toUnicode(s){ return s.replace(/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])/g,function(){ return "\\u" + RegExp["$1"].charCodeAt(0).toString(16); }); } 
　　　　
// 经@b4b4指正，现更改

　　　　function toUnicode(s){ 
          return s.replace(/([\u4E00-\u9FA5]|[\uFE30-\uFFA0])/g,function(newStr){ return "\\u" + newStr.charCodeAt(0).toString(16); 
　　　　　　}); 
　　　　}

</script> </head> <body onload="Window_Load();"> <button id="cmdToU">汉字转为Unicode</button> </body> </html>

这个页面只能在IE内核的浏览器下才能正常运行，由于clipboardData对象好像只在IE下面有。函数

感谢编码

@b4b4阅读并指正；