【问题标题】:JSON to tree diagramJSON转树图
【发布时间】:2018-06-28 11:52:00
【问题描述】:

我有一个高度嵌套的 JSON 对象。有没有一种方法可以查看分层树形图?我浏览了几个资源,如 Pydot、Plotly 等,但没有什么能以我的格式呈现 JSON。

JSON 文件:

{
  "found_intents": {
    "_DATE": {}
  },
  "sentence": "What is your name",
  "tree": [
    [
      {
        "canonical": null,
        "concept": "_START_TAG",
        "correct_string": "<start>",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "<start>",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "<start>",
            "language": "english",
            "span": [
              0,
              1
            ],
            "span_string": "<start>",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "<start>",
        "language": "english",
        "span": [
          0,
          1
        ],
        "span_string": "<start>",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_WHAT_IS",
        "correct_string": "what is",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "what",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "what",
            "language": "english",
            "span": [
              1,
              2
            ],
            "span_string": "what",
            "weight": 1.0
          },
          {
            "canonical": null,
            "concept": "",
            "correct_string": "is",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "is",
            "language": "english",
            "span": [
              2,
              3
            ],
            "span_string": "is",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "what is",
        "language": "english",
        "span": [
          1,
          3
        ],
        "span_string": "what is",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_DICTIONARY",
        "correct_string": "your",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "your",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "your",
            "language": "english",
            "span": [
              3,
              4
            ],
            "span_string": "your",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "your",
        "language": "english",
        "span": [
          3,
          4
        ],
        "span_string": "your",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_DICTIONARY",
        "correct_string": "name",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "name",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "name",
            "language": "english",
            "span": [
              4,
              5
            ],
            "span_string": "name",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "name",
        "language": "english",
        "span": [
          4,
          5
        ],
        "span_string": "name",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_END_TAG",
        "correct_string": "<end>",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "<end>",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "<end>",
            "language": "english",
            "span": [
              5,
              6
            ],
            "span_string": "<end>",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "<end>",
        "language": "english",
        "span": [
          5,
          6
        ],
        "span_string": "<end>",
        "weight": 1.0
      }
    ],
    [
      {
        "canonical": null,
        "concept": "_START_TAG",
        "correct_string": "<start>",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "<start>",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "<start>",
            "language": "english",
            "span": [
              0,
              1
            ],
            "span_string": "<start>",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "<start>",
        "language": "english",
        "span": [
          0,
          1
        ],
        "span_string": "<start>",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_WHAT_IS",
        "correct_string": "what is",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "what",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "what",
            "language": "english",
            "span": [
              1,
              2
            ],
            "span_string": "what",
            "weight": 1.0
          },
          {
            "canonical": null,
            "concept": "",
            "correct_string": "is",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "is",
            "language": "english",
            "span": [
              2,
              3
            ],
            "span_string": "is",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "what is",
        "language": "english",
        "span": [
          1,
          3
        ],
        "span_string": "what is",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_DICTIONARY",
        "correct_string": "your",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "your",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "your",
            "language": "english",
            "span": [
              3,
              4
            ],
            "span_string": "your",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "your",
        "language": "english",
        "span": [
          3,
          4
        ],
        "span_string": "your",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_THEATRE_ID",
        "correct_string": "name",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "name",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "name",
            "language": "english",
            "span": [
              4,
              5
            ],
            "span_string": "name",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "name",
        "language": "english",
        "span": [
          4,
          5
        ],
        "span_string": "name",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_END_TAG",
        "correct_string": "<end>",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "<end>",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "<end>",
            "language": "english",
            "span": [
              5,
              6
            ],
            "span_string": "<end>",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "<end>",
        "language": "english",
        "span": [
          5,
          6
        ],
        "span_string": "<end>",
        "weight": 1.0
      }
    ],
    [
      {
        "canonical": null,
        "concept": "_START_TAG",
        "correct_string": "<start>",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "<start>",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "<start>",
            "language": "english",
            "span": [
              0,
              1
            ],
            "span_string": "<start>",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "<start>",
        "language": "english",
        "span": [
          0,
          1
        ],
        "span_string": "<start>",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_WHAT_IS",
        "correct_string": "what is",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "what",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "what",
            "language": "english",
            "span": [
              1,
              2
            ],
            "span_string": "what",
            "weight": 1.0
          },
          {
            "canonical": null,
            "concept": "",
            "correct_string": "is",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "is",
            "language": "english",
            "span": [
              2,
              3
            ],
            "span_string": "is",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "what is",
        "language": "english",
        "span": [
          1,
          3
        ],
        "span_string": "what is",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_THEATRE_ID",
        "correct_string": "your",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "your",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "your",
            "language": "english",
            "span": [
              3,
              4
            ],
            "span_string": "your",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "your",
        "language": "english",
        "span": [
          3,
          4
        ],
        "span_string": "your",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_DICTIONARY",
        "correct_string": "name",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "name",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "name",
            "language": "english",
            "span": [
              4,
              5
            ],
            "span_string": "name",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "name",
        "language": "english",
        "span": [
          4,
          5
        ],
        "span_string": "name",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_END_TAG",
        "correct_string": "<end>",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "<end>",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "<end>",
            "language": "english",
            "span": [
              5,
              6
            ],
            "span_string": "<end>",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "<end>",
        "language": "english",
        "span": [
          5,
          6
        ],
        "span_string": "<end>",
        "weight": 1.0
      }
    ],
    [
      {
        "canonical": null,
        "concept": "_START_TAG",
        "correct_string": "<start>",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "<start>",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "<start>",
            "language": "english",
            "span": [
              0,
              1
            ],
            "span_string": "<start>",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "<start>",
        "language": "english",
        "span": [
          0,
          1
        ],
        "span_string": "<start>",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_WHAT_IS",
        "correct_string": "what is",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "what",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "what",
            "language": "english",
            "span": [
              1,
              2
            ],
            "span_string": "what",
            "weight": 1.0
          },
          {
            "canonical": null,
            "concept": "",
            "correct_string": "is",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "is",
            "language": "english",
            "span": [
              2,
              3
            ],
            "span_string": "is",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "what is",
        "language": "english",
        "span": [
          1,
          3
        ],
        "span_string": "what is",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_THEATRE_ID",
        "correct_string": "your",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "your",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "your",
            "language": "english",
            "span": [
              3,
              4
            ],
            "span_string": "your",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "your",
        "language": "english",
        "span": [
          3,
          4
        ],
        "span_string": "your",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_THEATRE_ID",
        "correct_string": "name",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "name",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "name",
            "language": "english",
            "span": [
              4,
              5
            ],
            "span_string": "name",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "name",
        "language": "english",
        "span": [
          4,
          5
        ],
        "span_string": "name",
        "weight": 1.0
      },
      {
        "canonical": null,
        "concept": "_END_TAG",
        "correct_string": "<end>",
        "definition": "",
        "details": [
          {
            "canonical": null,
            "concept": "",
            "correct_string": "<end>",
            "definition": "",
            "details": [],
            "e.g.": [],
            "grammar": "<end>",
            "language": "english",
            "span": [
              5,
              6
            ],
            "span_string": "<end>",
            "weight": 1.0
          }
        ],
        "e.g.": [],
        "grammar": "<end>",
        "language": "english",
        "span": [
          5,
          6
        ],
        "span_string": "<end>",
        "weight": 1.0
      }
    ]
  ]
}

更准确地说,我想提取每个级别的平均分支数。

预期结果是:

Level 0: 4  
Level 1: (1 + 2 + 1 + 1)/4  
Level 2: 0

【问题讨论】:

    标签: python json dictionary


    【解决方案1】:

    尚不完全清楚您要做什么,但以下代码计算了每个嵌套深度的字典和列表的数量。我们使用collections.deque 作为堆栈来执行广度优先搜索,计算每个级别的嵌套容器的数量,将计数存储在列表的defaultdict 中,并将这些容器推入堆栈以供将来处理。当我们计算完所有对象后,我们计算每个级别的平均分支数。

    我不会将您的数据粘贴到这段代码中,因为它大约有 740 行长。我将该数据称为data_string,在我的机器上我只是将您的数据用三引号括起来,但当然您可以将其保存为文件,然后使用json.load 加载它。

    import json
    from collections import defaultdict, deque
    
    data = json.loads(data_string)
    
    def get_branches(obj):
        branches = defaultdict(list)
        stack = deque()
        stack.append((obj, 0))
        while stack:
            obj, depth = stack.pop()
            newdepth = depth + 1
            branch_count = 0
            if isinstance(obj, dict):
                obj = obj.values()
            for child in obj:
                if isinstance(child, (list, dict)):
                    branch_count += 1
                    stack.append((child, newdepth))
            if branch_count:
                branches[depth].append(branch_count)
        return branches
    
    branches = get_branches(data)
    for depth in sorted(branches.keys()):
        row = branches[depth]
        mean = sum(row) / len(row) if row else None
        print('Level', depth, row, mean)
    

    输出

    Level 0 [2] 2.0
    Level 1 [4, 1] 2.5
    Level 2 [5, 5, 5, 5] 5.0
    Level 3 [3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3] 3.0
    Level 4 [1, 1, 1, 2, 1, 1, 1, 1, 2, 1, 1, 1, 1, 2, 1, 1, 1, 1, 2, 1] 1.2
    Level 5 [3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3, 3] 3.0
    

    【讨论】:

    • 感谢您的回答。有没有办法让我得到整个 json 的哪一部分属于相应的级别?一个这样的例子是不言自明的。
    • @nikinlpds 这听起来像是一个新问题的好话题。 ;) 如果需要,您可以在新问题中添加一个链接回到这个问题。你需要准确地解释你想如何衡量它。我假设你想要它的节点(项目)数量,但也许你想用字符来衡量它。
    • 感谢您的快速回复。基本上,必须获取遍历时落在每个级别中的 JSON 的任何部分。我在这里提出了一个单独的问题 - stackoverflow.com/questions/51189250/…。我最终要做的是查看每个级别中存在多少与“概念”相对应的元素。
    • @nikinlpds 正如布鲁诺所说,您需要更清楚地解释您的问题,否则它将被搁置。
    • 好的。我会让它更简单。目前,我们计算了每个嵌套深度的字典和列表的数量。我只希望按级别提取整个字典/列表。现在清楚了吗?
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-08-07
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多