【发布时间】:2014-04-16 14:24:45
【问题描述】:
我想将以下 nltk 树表示形式转换为 JSON 格式:
期望的输出:
{
"scores": {
"filler": [
[
"scores"
],
[
"for"
]
],
"extent": [
"highest"
],
"team": [
"India"
]
}
}
【问题讨论】:
-
它不是一个有效的 JSON:同一个对象中有两个“团队”名称。 JSON 对象是一组无序的名称/值对。不同的 json 解析器可能会产生不同的结果:解析器可能只保留第一个“团队”,或者只保留最后一个“团队”对,或者(不太可能)create a list
["India", "Pakistan"] -
另见rfc 7159:“当对象中的名称不唯一时,接收此类对象的软件的行为是不可预测的。许多实现只报告姓氏/值对. 其他实现报告错误或无法解析对象,并且一些实现报告所有名称/值对,包括重复项。"
-
源代码树再次包含重复的名称
('filler', 'filler')为什么要从输出中删除它们? -
它在构建字典时被自动删除。可以将它们删除,因为输出中不需要填充信息。
-
你怎么知道输出中不需要它?