Python中还原JavaScript的escape函数编码后字符串的方法
戏曲网,欧冠直播吧,平定政府网
遇到一个问题需要用python把javascript中escape的中文给还原,但找了大半天,也没有找到答案,只好自己深入研究解决方案。
我们先来看在js中escape一段文字的编码
a = escape('这是一串文字');
alert(a);
输出:
%u8fd9%u662f%u4e00%u4e32%u6587%u5b57
咋一看,就感觉有点类似json格式,我们来看看标准的json格式编码同样的汉子“这是一串文字”
# encoding=utf-8
import json
a = '这是一串文字'
print json.dumps(a)
输出:
"\u8fd9\u662f\u4e00\u4e32\u6587\u5b57"
经过对比,其实就是js escape编码每个汉子都是“%u”符号加4位字符编码,而json编码每个汉子都是“\u”符号加4位字符编码,这样的话,我们可以利用字符串替换操作还原json格式,然后再使用json模块loads就好
# encoding=utf-8
import json
# js escape 字符串编码
c = '%u8fd9%u662f%u4e00%u4e32%u6587%u5b57'
# 还原json对象
jsonobj = '"'+"".join([(i and "\\"+i) for i in c.split('%')])+'"'
print json.loads(jsonobj)
特别记得在把“%”替换为“\”符号以后还要再使用双引号把字符串包一下,才能算是一个json对象,然后才能json.loads出来
后来,好不容易在一个站点上看到了更简便的方法。代码如下:
# encoding=utf-8
c = '%u8fd9%u662f%u4e00%u4e32%u6587%u5b57'
print "".join([(len(i)>0 and unichr(int(i,16)) or "") for i in c.split('%u')])
它的思路其实都差不多,把“%u”号替换掉,剩下每一个都是4位固定长度的字符编码,最后在unichr反编码回中文字符。
如对本文有疑问,请在下面进行留言讨论,广大热心网友会与你互动!!
点击进行留言回复
相关文章:
-
-
-
如何写python的配置文件
一、创建配置文件在d盘建立一个配置文件,名字为:test.ini内容如下:[baseconf]host=127.0.0.1port=3306user=rootp...
[阅读全文]
-
-
-
-
-
-
-
-
网友评论