【发布时间】:2017-09-10 21:13:40
【问题描述】:
需要帮助删除出现在地址之前的字符串中的随机文本(数据集有大约 5000 个观察值)。数据框test2$address 内容如下:
addresses <- c(
"140 National Plz Oxon Hill, MD 20745",
"6324 Windsor Mill Rd Gwynn Oak, MD 21207",
"23030 Indian Creek Dr Sterling, VA 20166",
"Located in Reston Town Center 18882 Explorer St Reston, VA 20190"
)
我希望它以通用格式吐出所有地址:
[885] "23030 Indian Creek Dr Sterling, VA 20166"
[886] "18882 Explorer St Reston, VA 20190"
不确定如何执行此操作,因为地址编号之前的文本没有特定的模式。
【问题讨论】:
标签: r regex dataframe street-address