【发布时间】:2017-12-20 13:24:40
【问题描述】:
import pandas as pd
rawDF = pd.read_csv('D:\Project\python\Grade\GradeDataRaw.csv',names=['GradeCol'])
filteredDF = rawDF[rawDF['GradeCol'].str.contains('EVCS:|BVCS:|LOW POINT STA')]
print(filteredDF)
filename = 'GradeOut.csv'
filteredDF.to_csv(filename,index=False, encoding='utf-8')
CSV 文件中的输出是
GradeCol
EVCS: 210+080.907
BVCS: 210+080.907
LOW POINT STA =208+108.133\PLOW POINT ELEV = 66.849\PPVI STA = 209+126.315\PPVI ELEV = 66.762\PA.D = 1.413%\PK
LOW POINT STA =208+108.133\PLOW POINT ELEV = 66.849\PPVI STA = 209+126.000\PPVI ELEV = 66.762\PA.D = 1.413%\PK
希望在有此字符串可用的数据框行中只有“PPVI STA = 209+126.315”,其他带有 EVCS 和 BVCS 的行保持不变,每行的数字部分可能会有所不同。 使用 extract 方法在不匹配的行中获取 NaN 值,这不是意图。
【问题讨论】:
-
你想要的输出是什么?你想订购所有的行吗?
-
"info \GPK HEK = 209+126.315\info ends here"- 是整个字符串/行还是行中的一列? -
大家好,希望以上包含更多信息的编辑有助于澄清预期的输出。
-
欢迎访问该网站:您可能需要阅读help center、How to Ask 和minimal reproducible example,并相应地重新表述您的问题。