设为首页 收藏本站
查看: 1208|回复: 0

[经验分享] python中json和字符编码的转换

[复制链接]
累计签到:1 天
连续签到:1 天
发表于 2016-9-14 10:16:50 | 显示全部楼层 |阅读模式
json是用来转换python object 和json format 的,字符编码有gb2312,gb18030/gbk,utf-8等。
在 Python 中出现的 str 都是用字符集编码的 ansi 字符串。Python 本身并不知道 str 的编码,需要由开发者指定正确的字符集 decode。
因为 Python 认为 16 位的 unicode 才是字符的唯一内码,而大家常用的字符集如 gb2312,gb18030/gbk,utf-8,以及 ascii 都是字符的二进制(字节)编码形式。把字符从 unicode 转换成二进制编码,当然是要 encode。
# 从 str 转换成 unicode  
print s.decode('utf-8')
# 从 unicode 转换成 str   
print u.encode('utf-8')
UnicodeEncodeError: 'ascii' codec can't encode characters in position 0-3: ordinal not in range(128)

  • json.dump(obj, fp, skipkeys=False, ensure_ascii=True, check_circular=True, allow_nan=True, cls=None, indent=None,separators=None, encoding="utf-8", default=None, sort_keys=False, **kw)
  • Serialize obj as a JSON formatted stream to fp (a .write()-supporting file-like object) using this conversion table.


  • json.dumps(obj, skipkeys=False, ensure_ascii=True, check_circular=True, allow_nan=True, cls=None, indent=None,separators=None, encoding="utf-8", default=None, sort_keys=False, **kw)
  • Serialize obj to a JSON formatted str using this conversion table. If ensure_ascii is false, the result may contain non-ASCII characters and the return value may be a unicode instance.


  • json.load(fp[, encoding[, cls[, object_hook[, parse_float[, parse_int[, parse_constant[, object_pairs_hook[,**kw]]]]]]]])
  • Deserialize fp (a .read()-supporting file-like object containing a JSON document) to a Python object using thisconversion table.


  • json.loads(s[, encoding[, cls[, object_hook[, parse_float[, parse_int[, parse_constant[, object_pairs_hook[,**kw]]]]]]]])
  • Deserialize s (a str or unicode instance containing a JSON document) to a Python object using this conversion table.


json有上面四种function,注意带s和不带s的区别,json.dumps是把python object转换为json format,反之,json.loads是把json str 转换为python object。
python object 有dict , list 等。
下面给出输出一个大的json字符串到文件,并以可读的格式输出。
#!/usr/bin/env python

import urllib2
import json
import sys

url = 'world.taobao.com/search/json.htm'

url = 'http://' + url

keyword = sys.argv[1]

url = url + '?q=' + keyword
print url

request = urllib2.Request(url)
response = urllib2.urlopen(request)
content = response.read()
if isinstance(content, basestring):
        print "content is string"
else:
        print "content is not string"
content = json.loads(content, encoding='gbk')
content = json.dumps(content, encoding='gbk', ensure_ascii=False, indent=4, separators=(',', ': '))
content = content.encode('utf-8')

file = keyword
f = open(file, 'w')
f.write(content)
f.close()



运维网声明 1、欢迎大家加入本站运维交流群:群②:261659950 群⑤:202807635 群⑦870801961 群⑧679858003
2、本站所有主题由该帖子作者发表,该帖子作者与运维网享有帖子相关版权
3、所有作品的著作权均归原作者享有,请您和我们一样尊重他人的著作权等合法权益。如果您对作品感到满意,请购买正版
4、禁止制作、复制、发布和传播具有反动、淫秽、色情、暴力、凶杀等内容的信息,一经发现立即删除。若您因此触犯法律,一切后果自负,我们对此不承担任何责任
5、所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其内容的准确性、可靠性、正当性、安全性、合法性等负责,亦不承担任何法律责任
6、所有作品仅供您个人学习、研究或欣赏,不得用于商业或者其他用途,否则,一切后果均由您自己承担,我们对此不承担任何法律责任
7、如涉及侵犯版权等问题,请您及时通知我们,我们将立即采取措施予以解决
8、联系人Email:admin@iyunv.com 网址:www.yunweiku.com

所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其承担任何法律责任,如涉及侵犯版权等问题,请您及时通知我们,我们将立即处理,联系人Email:kefu@iyunv.com,QQ:1061981298 本贴地址:https://www.yunweiku.com/thread-272108-1-1.html 上篇帖子: python中super出现的TypeError: must be type, not classobj 原因及解决 下篇帖子: 安装ipython报错"ImportError: No module named shutil_get_terminal_size" python
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

扫码加入运维网微信交流群X

扫码加入运维网微信交流群

扫描二维码加入运维网微信交流群,最新一手资源尽在官方微信交流群!快快加入我们吧...

扫描微信二维码查看详情

客服E-mail:kefu@iyunv.com 客服QQ:1061981298


QQ群⑦:运维网交流群⑦ QQ群⑧:运维网交流群⑧ k8s群:运维网kubernetes交流群


提醒:禁止发布任何违反国家法律、法规的言论与图片等内容;本站内容均来自个人观点与网络等信息,非本站认同之观点.


本站大部分资源是网友从网上搜集分享而来,其版权均归原作者及其网站所有,我们尊重他人的合法权益,如有内容侵犯您的合法权益,请及时与我们联系进行核实删除!



合作伙伴: 青云cloud

快速回复 返回顶部 返回列表