Python辞書をJSON配列に変換


98

現在、私はこの辞書を使っていpprintます:

{'AlarmExTempHum': '\x00\x00\x00\x00\x00\x00\x00\x00',  
'AlarmIn': 0,  
'AlarmOut': '\x00\x00',  
'AlarmRain': 0,  
'AlarmSoilLeaf': '\x00\x00\x00\x00',  
'BarTrend': 60,  
'BatteryStatus': 0,  
'BatteryVolts': 4.751953125,  
'CRC': 55003,
'EOL': '\n\r',
'ETDay': 0,
'ETMonth': 0,
'ETYear': 0,
'ExtraHum1': None,
'ExtraHum2': None,
'ExtraHum3': None,
'ExtraHum4': None,
'ExtraHum5': None,
'ExtraHum6': None,
'ExtraHum7': None,
'ExtraTemp1': None,
'ExtraTemp2': None,
'ExtraTemp3': None,
'ExtraTemp4': None,
'ExtraTemp5': None,
'ExtraTemp6': None,
'ExtraTemp7': None,
'ForecastIcon': 2,
'ForecastRuleNo': 122,
'HumIn': 31,
'HumOut': 94,
'LOO': 'LOO',
'LeafTemps': '\xff\xff\xff\xff',
'LeafWetness': '\xff\xff\xff\x00',
'NextRec': 37,
'PacketType': 0,
'Pressure': 995.9363359295631,
'RainDay': 0.0,
'RainMonth': 0.0,
'RainRate': 0.0,
'RainStorm': 0.0,
'RainYear': 2.8,
'SoilMoist': '\xff\xff\xff\xff',
'SoilTemps': '\xff\xff\xff\xff',
'SolarRad': None,
'StormStartDate': '2127-15-31',
'SunRise': 849,
'SunSet': 1611,
'TempIn': 21.38888888888889,
'TempOut': 0.8888888888888897,
'UV': None,
'WindDir': 219,
'WindSpeed': 3.6,
'WindSpeed10Min': 3.6}

私がこれをするとき:

import json
d = (my dictionary above)
jsonarray = json.dumps(d)

私はこのエラーを受け取ります: 'utf8' codec can't decode byte 0xff in position 0: invalid start byte


あなたの問題はここにあります:\xff
ベンジャミン・トゥグ2013

回答:


167

jsonに印刷不可能なシンボルが問題ない場合は、add ensure_ascii=Falseto dumpscall を使用します。

>>> json.dumps(your_data, ensure_ascii=False)

ensure_asciiがfalseの場合、戻り値は 、ASCIIにエスケープされるのではなく、unicode通常のPython strからunicode強制変換ルールの対象となる インスタンスになりますstr


1
indent=npretty printのオプションに追加します。ここnで、インデントするスペースの数です
RTF

17

Ensure_ascii = Falseは、実際には問題をデコード段階にのみ延期します。

>>> dict2 = {'LeafTemps': '\xff\xff\xff\xff',}
>>> json1 = json.dumps(dict2, ensure_ascii=False)
>>> print(json1)
{"LeafTemps": "����"}
>>> json.loads(json1)
Traceback (most recent call last):
  File "<stdin>", line 1, in <module>
  File "/usr/lib/python2.7/json/__init__.py", line 328, in loads
    return _default_decoder.decode(s)
  File "/usr/lib/python2.7/json/decoder.py", line 365, in decode
    obj, end = self.raw_decode(s, idx=_w(s, 0).end())
  File "/usr/lib/python2.7/json/decoder.py", line 381, in raw_decode
    obj, end = self.scan_once(s, idx)
UnicodeDecodeError: 'utf8' codec can't decode byte 0xff in position 0: invalid start byte

最終的には、未加工のバイトをJSONドキュメントに格納できないため、base64などの任意のバイトのシーケンスをASCII文字列として明確にエンコードする手段を使用する必要があります。

>>> import json
>>> from base64 import b64encode, b64decode
>>> my_dict = {'LeafTemps': '\xff\xff\xff\xff',} 
>>> my_dict['LeafTemps'] = b64encode(my_dict['LeafTemps'])
>>> json.dumps(my_dict)
'{"LeafTemps": "/////w=="}'
>>> json.loads(json.dumps(my_dict))
{u'LeafTemps': u'/////w=='}
>>> new_dict = json.loads(json.dumps(my_dict))
>>> new_dict['LeafTemps'] = b64decode(new_dict['LeafTemps'])
>>> print new_dict
{u'LeafTemps': '\xff\xff\xff\xff'}


1
可能かもしれませんが、jsonはutf-8を使用するように設計/意図されています。
Karl Knechtel、2013

2
@JFSebastian:確かに、比べて非常に非効率的b64encodeです。たとえば、256文字の文字列のs = ''.join(chr(i) for i in xrange(256))場合、len(json.dumps(b64encode(s))) == 346vs len(json.dumps(s.decode('latin1'))) == 1045です。
martineau 2013

10

Python 2を使用する場合は、スクリプトの最初の行にUTF-8ファイルエンコーディングコメントを追加することを忘れないでください。

# -*- coding: UTF-8 -*-

これにより、いくつかのUnicode問題が修正され、作業が楽になります。


2

私が使用する1つの可能な解決策は、python3を使用することです。それは多くのutf問題を解決するようです。

遅い答えで申し訳ありませんが、それは将来の人々を助けるかもしれません。

例えば、

#!/usr/bin/env python3
import json
# your code follows

4
もちろん、あなたは間違いなく、Python 3は多くのエンコーディングの問題を解決しました。しかし、それはその質問に対する答えではありません。明示的にpython-2.7でタグ付けされています。だからあなたが言っていることは次のようなものです:あなたの古い車には組み込みの掃除機がありません。古い車に掃除機を追加するのではなく、新しい車を購入してください。
コリディア
弊社のサイトを使用することにより、あなたは弊社のクッキーポリシーおよびプライバシーポリシーを読み、理解したものとみなされます。
Licensed under cc by-sa 3.0 with attribution required.