【发布时间】:2017-07-13 02:21:31
【问题描述】:
我有类似下面示例数据的数据,我正在尝试进行模式匹配并对其进行解析以创建类似于输出数据的内容。这个想法是,如果我有一个包含“Aggr(”的字符串值,那么解析括号中的“stuff”并解析下一个括号之前的逗号后面的“something”。有没有一种巧妙的方法来做到这一点使用类似的正则表达式,还是需要几个循环?
Sample Data:
SampleDf=pd.DataFrame([['tom',"words Aggr(stuff),something1)"],['bob',"Morewords Aggr(Diffstuff),something2"]],columns=['ReportField','OtherField'])
Sample Output:
OutputDf=pd.DataFrame([['tom',"words Aggr(stuff),something1",'stuff', 'something1'],['bob',"Morewords Aggr(Diffstuff),something2",'Diffstuff','something2']],columns=['ReportField','OtherField','Part1','Part2'])
【问题讨论】:
-
看看regex101.com 它允许您在线测试python regexps。我相信你可以用正则表达式做得很好。