【发布时间】:2020-04-23 12:59:08
【问题描述】:
对编码和 python 非常陌生,所以请多多包涵。我已经看了又看,但无法在任何地方找到解决方案。
我有一个来自大型 Excel 电子表格的数据框,其中在“示踪气体类型”列(随机行)中有连续“1”、“2”、“1”、“2”的模式...出现。这些行需要从电子表格的其余部分中拆分出来。数据框的示例部分:
df = {'col1': [1, 2, 3, 4, 5, 6, 7, 8, 9], 'col2': ['A', 'B', 'C', 'D', 'E', 'F', 'G', 'H', 'I'],
'Tracer gas type': ['1', '2', '1', '1', '0', '1', '2', '1', '2' ]}
df = pd.DataFrame(data=df)
模式总是从 1 开始,可能重复未知次数并在 2 结束。在这个例子中,如果正确拆分,新的 df 应该只包含旧 df 的前 2 行和最后 4 行:
作为起点,我已经能够拆分值为“1”的数据框,但无法拆分“1”、“2”、“1”、“2”...部分用这个方法:
self.new_df = self.df[self.df['Tracer gas type'] == '1']
提前感谢您的帮助!
【问题讨论】:
-
欢迎使用stackoverflow,能否请您尝试关注特定的代码部分,谢谢
-
@PV8 谢谢-重写了更具体的代码部分
标签: python arrays pandas dataframe split