设为首页 收藏本站
查看: 916|回复: 0

[经验分享] python中json和字符编码的转换

[复制链接]

尚未签到

发表于 2018-8-11 12:15:16 | 显示全部楼层 |阅读模式
  json是用来转换python object 和json format 的,字符编码有gb2312,gb18030/gbk,utf-8等。
  在 Python 中出现的 str 都是用字符集编码的 ansi 字符串。Python 本身并不知道 str 的编码,需要由开发者指定正确的字符集 decode。
  因为 Python 认为 16 位的 unicode 才是字符的唯一内码,而大家常用的字符集如 gb2312,gb18030/gbk,utf-8,以及 ascii 都是字符的二进制(字节)编码形式。把字符从 unicode 转换成二进制编码,当然是要 encode。
  # 从 str 转换成 unicode
  print s.decode('utf-8')
  # 从 unicode 转换成 str
  print u.encode('utf-8')
  UnicodeEncodeError: 'ascii' codec can't encode characters in position 0-3: ordinal not in range(128)
  

  •   json.dump(obj, fp, skipkeys=False, ensure_ascii=True, check_circular=True, allow_nan=True, cls=None, indent=None,separators=None, encoding="utf-8", default=None, sort_keys=False, **kw)
  •   Serialize obj as a JSON formatted stream to fp (a .write()-supporting file-like object) using this conversion table.


  •   json.dumps(obj, skipkeys=False, ensure_ascii=True, check_circular=True, allow_nan=True, cls=None, indent=None,separators=None, encoding="utf-8", default=None, sort_keys=False, **kw)
  •   Serialize obj to a JSON formatted str using this conversion table. If ensure_ascii is false, the result may contain non-ASCII characters and the return value may be a unicode instance.


  •   json.load(fp[, encoding[, cls[, object_hook[, parse_float[, parse_int[, parse_constant[, object_pairs_hook[,**kw]]]]]]]])
  •   Deserialize fp (a .read()-supporting file-like object containing a JSON document) to a Python object using thisconversion table.


  •   json.loads(s[, encoding[, cls[, object_hook[, parse_float[, parse_int[, parse_constant[, object_pairs_hook[,**kw]]]]]]]])
  •   Deserialize s (a str or unicode instance containing a JSON document) to a Python object using this conversion table.
  json有上面四种function,注意带s和不带s的区别,json.dumps是把python object转换为json format,反之,json.loads是把json str 转换为python object。
  python object 有dict , list 等。
  下面给出输出一个大的json字符串到文件,并以可读的格式输出。
  #!/usr/bin/env python
  import urllib2
  import json
  import sys
  url = 'world.taobao.com/search/json.htm'
  url = 'http://' + url
  keyword = sys.argv[1]
  url = url + '?q=' + keyword
  print url
  request = urllib2.Request(url)
  response = urllib2.urlopen(request)
  content = response.read()
  if isinstance(content, basestring):
  print "content is string"
  else:
  print "content is not string"
  content = json.loads(content, encoding='gbk')
  content = json.dumps(content, encoding='gbk', ensure_ascii=False, indent=4, separators=(',', ': '))
  content = content.encode('utf-8')
  file = keyword
  f = open(file, 'w')
  f.write(content)
  f.close()

运维网声明 1、欢迎大家加入本站运维交流群:群②:261659950 群⑤:202807635 群⑦870801961 群⑧679858003
2、本站所有主题由该帖子作者发表,该帖子作者与运维网享有帖子相关版权
3、所有作品的著作权均归原作者享有,请您和我们一样尊重他人的著作权等合法权益。如果您对作品感到满意,请购买正版
4、禁止制作、复制、发布和传播具有反动、淫秽、色情、暴力、凶杀等内容的信息,一经发现立即删除。若您因此触犯法律,一切后果自负,我们对此不承担任何责任
5、所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其内容的准确性、可靠性、正当性、安全性、合法性等负责,亦不承担任何法律责任
6、所有作品仅供您个人学习、研究或欣赏,不得用于商业或者其他用途,否则,一切后果均由您自己承担,我们对此不承担任何法律责任
7、如涉及侵犯版权等问题,请您及时通知我们,我们将立即采取措施予以解决
8、联系人Email:admin@iyunv.com 网址:www.yunweiku.com

所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其承担任何法律责任,如涉及侵犯版权等问题,请您及时通知我们,我们将立即处理,联系人Email:kefu@iyunv.com,QQ:1061981298 本贴地址:https://www.yunweiku.com/thread-550132-1-1.html 上篇帖子: Python带权重随机数的简单实现 下篇帖子: Python Coding Guidelines
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

扫码加入运维网微信交流群X

扫码加入运维网微信交流群

扫描二维码加入运维网微信交流群,最新一手资源尽在官方微信交流群!快快加入我们吧...

扫描微信二维码查看详情

客服E-mail:kefu@iyunv.com 客服QQ:1061981298


QQ群⑦:运维网交流群⑦ QQ群⑧:运维网交流群⑧ k8s群:运维网kubernetes交流群


提醒:禁止发布任何违反国家法律、法规的言论与图片等内容;本站内容均来自个人观点与网络等信息,非本站认同之观点.


本站大部分资源是网友从网上搜集分享而来,其版权均归原作者及其网站所有,我们尊重他人的合法权益,如有内容侵犯您的合法权益,请及时与我们联系进行核实删除!



合作伙伴: 青云cloud

快速回复 返回顶部 返回列表