【发布时间】:2018-05-27 10:04:40
【问题描述】:
我目前正在 kaggle 中做一个数据分析项目on the tmdb dataset(顺便说一句,我是一个完全的菜鸟,所以请原谅我的无知),我在数据集中遇到了以下列(第 2 列):- `
类型
[{"id": 28, "name": "Action"}, {"id": 12, "name": "Adventure"}, {"id": 14, "name": "Fantasy"}, {"id": 878, "name": "Science Fiction"}]
[{"id": 12, "name": "Adventure"}, {"id": 14, "name": "Fantasy"}, {"id": 28, "name": "Action"}]
[{"id": 28, "name": "Action"}, {"id": 12, "name": "Adventure"}, {"id": 80, "name": "Crime"}]
[{"id": 28, "name": "Action"}, {"id": 80, "name": "Crime"}, {"id": 18, "name": "Drama"}, {"id": 53, "name": "Thriller"}]
[{"id": 28, "name": "Action"}, {"id": 12, "name": "Adventure"}, {"id": 878, "name": "Science Fiction"}]
[{"id": 14, "name": "Fantasy"}, {"id": 28, "name": "Action"}, {"id": 12, "name": "Adventure"}]
[{"id": 16, "name": "Animation"}, {"id": 10751, "name": "Family"}]
这里的genres是列名,该列每一行的数据用[]括起来
我想要做的是将它转换为以下类型的 fo 列(分隔符可以是除 ',' 之外的任何东西,因为它是一个 CSV 文件:-
genres
Action;Adventure;Fantasy;Fiction;
Adventure;Fantasy;Action;
Action;Adventure;Crime;
And so on...
这是我的代码:-
import numpy as np
import matplotlib.pyplot as plt
import pandas as pd
import csv
reviews = pd.read_csv("C:/Users/HP/Desktop/data science project/tmpd second attempt/2. prepared data/tmdb_5000_movies.csv")
print(reviews["genres"]);
PS:-这是我的第一个项目所以真的不知道如何处理这个
【问题讨论】:
标签: python json python-3.x csv