【发布时间】:2019-07-09 17:33:41
【问题描述】:
我正在使用 Python 3 和 Pandas 进行数据科学项目。但是,我在使用 panda 的语法时遇到了一些问题。
下面的代码做的事情接近我想要的:
import pandas as pd
import matplotlib.pyplot as plt
df = pd.read_csv('breast-cancer-wisconsin.data.txt')
print (df.groupby('class').describe())
我从link 获得了有关乳腺癌的数据。我正在使用的包含数据的特定文件是breast-cancer-wisconsin.data。
返回:
bland_chrom \
count mean std min 25% 50% 75% max
class
2 458.0 2.100437 1.080339 1.0 1.0 2.0 3.0 7.0
4 241.0 5.979253 2.273852 1.0 4.0 7.0 7.0 10.0
clump_thickness ... unif_cel_shape unif_cel_size \
count mean ... 75% max count
class ...
2 458.0 2.956332 ... 1.0 8.0 458.0
4 241.0 7.195021 ... 9.0 10.0 241.0
mean std min 25% 50% 75% max
class
2 1.325328 0.907694 1.0 1.0 1.0 1.0 9.0
4 6.572614 2.719512 1.0 4.0 6.0 10.0 10.0
[2 rows x 72 columns]
尽管如此,这不是完整的输出。三个连续的点... 表示由于截断而隐藏了一些东西。
我怎样才能得到完整的结果?
谢谢。
【问题讨论】:
标签: python pandas pandas-groupby truncation