【发布时间】:2017-09-06 20:40:52
【问题描述】:
好的,所以我是整个 python 世界的新手,所以请耐心等待。
背景:我们正在尝试将日志卸载到 mongo 以便能够更快地查询和搜索它们。设备已经以合适的格式打印它们,除了在每个 }{ 开始和结束数据对象之间,如下所示:
¾ïúÀï{"id":"xxx","timestamp":xxx,"payloadType":"xxx","payload":{"protocol":"xxx","zoneID":xxx,"zoneName":"xxx","eventType":"xxx"}}’ÂCº¾ïúÀï{"id":"xxx","timestamp":xxx,"payloadType":"xxx","payload":{"protocol":"xxx","zoneID":xxx,"zoneName":"xxx","eventType":"xx}}
使用以下内容,我已经能够将其转换为字节,然后转换回输出为的字符串:
f = open('logfile', 'r')
file_data = f.read()
f.close()
data = file_data.encode('utf-8')
print(str(data))
>>>b'\xc2\xbe\xc3\xaf\xc3\xba\xc3\x80\x01\xc3\xaf{"id":"xxx","timestamp":xxx,"payloadType":"xxx","payload":{"protocol":"xxx","zoneID":xxx,"zoneName":"xxx","eventType":"xxx"}}
在我看来,这比上面看到的丑陋角色更容易处理,但我不知道。
这只是一个示例..此日志中返回了成千上万行。在我看来,理想情况下,解决此问题的最佳方法是删除 { 之前字符串开头的所有字符以及 }}{
之间的所有字符【问题讨论】:
-
使用 c# ;) 开个玩笑,我帮不了你!
标签: python mongodb python-3.x utf-8