【发布时间】:2021-11-12 12:03:14
【问题描述】:
我是一个只知道一小部分python基础知识的学生,我正在发布一个问题来解决统计作业中的问题。
https://i.stack.imgur.com/IPaRK.png
我需要从这些 excel 数据中提取值并在 python 中将它们输出为图形。
import numpy as np
import pandas as pd
from IPython.display import display
%matplotlib inline
pd.options.display.max_rows = 13
pd.set_option('display.max_columns',750)
file_name = 'C:\last_amb_hour_time.xls'
df = pd.read_excel(file_name, header=6, index_col=0)
dfdate = pd.read_excel(file_name, header=6, index_col=0, usecols='A')
dfpm10 = pd.read_excel(file_name, header=6, index_col=0, usecols='C')
dfpm25 = pd.read_excel(file_name, header=6, index_col=0, usecols='E')
dfozon = pd.read_excel(file_name, header=6, index_col=0, usecols='G')
dfno2 = pd.read_excel(file_name, header=6, index_col=0, usecols='I')
dfco = pd.read_excel(file_name, header=6, index_col=0, usecols='K')
dfso2 = pd.read_excel(file_name, header=6, index_col=0, usecols='M')
目前,数据已以这种方式提取。但是excel数据中很多空白都被当作NaN处理,所以无法输出图表。
https://i.stack.imgur.com/sayMh.png
喜欢这个
我想将一列中的 NaN 替换为 0。但是,如果我使用 dfpm10 = df.fillna(0) 或替换语法,则会输出整个 excel 数据,而不仅仅是一列。
我想知道使用哪个命令将提取的列中的 NaN 数据替换为 0。
这似乎是一个简单的问题,但由于我从未正确学习过python,因此即使尝试了几个小时也无法解决。对不起。
【问题讨论】:
-
简单地将
dataframe df['colname'] = df['colname'].fillna(0)子集化 -
对不起,我没听懂。我是否必须以与 col2 相同的方式放置 Excel 本身的列名?还是需要提前设置列名?
标签: python excel pandas dataframe numpy