【发布时间】:2018-06-09 11:40:37
【问题描述】:
我有一个包含许多列的 DataFrame。有 3 列包含空白行,或者,如果该行对应于列变量,则具有随机数字/字母字符串。我想获取这些数据并创建另一列,其中包含一个字符串,其中包含每行的变量名称。
例如:
raw_data['A']
Out[192]:
0 00Q2400000GUxMjEAL
1 00Q2400000G5QDzEAN
2 NaN
3 NaN
4 NaN
5 NaN
到目前为止,我已经尝试编写一个函数来应用,但它只为每一行返回“xyz”。
def type(row):
if row['A'] is not None:
return 'xyz'
elif row['B'] is not None:
return 'acb'
else:
return 'efg'
raw_data['TUV'] = raw_data.apply(lambda row: type(row), axis = 1)
任何帮助将不胜感激。
【问题讨论】:
-
如果两个列值都具有
NaN或都具有字符串/数字值,会发生什么情况?
标签: python python-3.x pandas loops dataframe