【发布时间】:2020-08-13 08:51:46
【问题描述】:
这是我的代码试图规范化我的数据集,代码有效,但问题是当我创建新数据框(代码的最后一行)时,它不包括时间戳列,因为它只包括缩放值.
data_consumption2 = pd.read_excel(r"C:\Users\user\Desktop\Thesis\Tarek\Parent.xlsx", sheet_name="Consumption")
data_consumption2['Timestamp'] = pd.to_datetime(data_consumption2['Timestamp'], unit='s')
data_consumption2.fillna(0,inplace=True)
data_consumption2 = data_consumption2.set_index('Timestamp')
#returns a numpy array
min_max_scaler = preprocessing.MinMaxScaler()
x_scaled = min_max_scaler.fit_transform(data_consumption2.values)
data_consumption2 = pd.DataFrame(x_scaled)
我希望任何人都可以帮助我制作带有时间戳和缩放值的原始 dframe
【问题讨论】:
-
database-normalization 是关于规范化表,而不是碰巧存储在数据库中的数据集。通过点击标签来添加标签并阅读维基。
-
请在代码问题中给出minimal reproducible example--cut & paste & runnable code,包括最小的代表性示例输入为代码;期望和实际输出(包括逐字错误消息);标签和版本;明确的规范和解释。给出您可以给出的最少代码,即您显示的代码可以通过您显示的代码扩展为不正常。 (调试基础。)对于包含 DBMS 和 DDL(包括约束和索引)和输入为格式化为表格的代码的 R/SQL。 How to Ask 停止尝试编写您的总体目标并从给定的代码中解释您的期望以及原因。
标签: python pandas normalization