【发布时间】:2020-06-16 12:32:57
【问题描述】:
我正在尝试遍历多个 CSV 文件并将每个数据帧的每个“序列”列连接到第一个值。以下是每个文件的样子:
ID Order Sequence
1773 1 'AAGG'
1773 2 'TTGG'
1773 3 'GGAA'
我需要每个 CSV 看起来像这样:
ID Sequence
1773 'AAGGTTGGGGAA'
在此之后我不再需要“订单”列。我尝试了许多不同的命令,但似乎找不到正确的命令。
现在我有:
path = r'C:\Users\CAAVR\Desktop\folder\*.csv'
for fname in glob.glob(path):
df = pd.read_csv(fname)
first = df['sequence'].iloc[:1]
next = df['sequence'].iloc[2:]
final = first.str.join(next)
print(final)
我知道 .join() 不对,但 concat 和 merge 似乎也不起作用。继续获取:
AttributeError: 'Series' object has no attribute 'join'
如果您需要任何其他信息,请告诉我,感谢您的帮助!
【问题讨论】: