【发布时间】:2012-02-23 15:32:43
【问题描述】:
我在这样的数据框中有一列:
npt2$name
# [1] "Andreas Groll, M.D."
# [2] ""
# [3] "Pan-Chyr Yang, PHD"
# [4] "Suh-Fang Jeng, Sc.D"
# [5] "Mostafa K Mohamed Fontanet Arnaud"
# [6] "Thomas Jozefiak, M.D."
# [7] "Medical Monitor"
# [8] "Qi Zhu, MD"
# [9] "Holly Posner"
# [10] "Peter S Sebel, MB BS, PhD Chantal Kerssens, PhD"
# [11] "Lance A Mynderse, M.D."
# [12] "Lawrence Currie, MD"
我试过gsub,但没有运气。
完成toupper(x) 之后,我需要替换所有“MD”或“M.D.”实例或一无所有的“博士”。
有什么不错的小技巧吗?
事实上,我很想看看它是在单个字符串上完成的,以及它在整个列表中的一个命令中完成的不同之处。
【问题讨论】:
-
我希望避免使用正则表达式,因为我可以简单地枚举所有要删除的坏字符串。哦,我的....又一种技术(正则表达式)可以返回(重新掌握):-(
-
该字段应该只有姓氏,但数据不一致。目标是只得到姓氏或名字的数据,并删除所有学术或其他头衔
-
无需重新制作 - DWin、Justin 和 Tommy 已提供您需要知道的一切!只需复制和粘贴。虽然正则表达式是我多年来学到的更有用的东西之一......
-
好吧。但如果我使用一些代码,我需要确保我理解它并且我确实知道我在做什么。