【发布时间】:2021-09-20 09:38:41
【问题描述】:
我从 Python 开始,在创建从 URL 列获取域名的新列时遇到问题。
谁能给我解释一下怎么做?
import pandas as pd
concu = pd.read_csv(r'/Desktop/Concu.csv')
df = pd.DataFrame(concu, columns= ['URL'])
#df3['Domain'] = #GET THE DOMAIN NAME (NO HTTP/HTTPS/WWW. AND without everything
after .com, .io...)
print(df)
URL
0 https://smartkeyword.io/seo-outils-google-util...
1 https://smartkeyword.io/referencement-naturel-...
2 https://smartkeyword.io/seo-on-page-urls-optim...
3 https://smartkeyword.io/seo-outils-google-util...
4 https://smartkeyword.io/seo-outils-google-cach...
... ...
6758 https://www.primelis.com/consultant-seo/
6759 https://www.primelis.com/expertises/seo/aso/
6760 https://www.primelis.com/labo/consideration-li...
6761 https://www.primelis.com/faq/fonctionnement-re...
6762 https://www.primelis.com/blog/comment-est-ne-l...
[6763 rows x 1 columns]
非常感谢!
【问题讨论】:
标签: python regex pandas dataframe