【发布时间】:2020-04-12 10:06:57
【问题描述】:
我正在尝试使用 bs4 从脚本标签中获取链接
这是我要从中抓取链接的标签
html = """<script type="text/javascript">var player = new Clappr.Player({
sources: ["https://example.com/zx5x4vxkb52dxcne4zwsbbn6rpafhxnsodnlcjifkdqatbvqbc5axyv4dpuq/v.mp4","https://example.com/zx5x4vxkb52dxcne4zwsbbn6rpafhxnsodnlcjifkyyarbvqbc5dtluomera/v.mp4"]
poster: "image.jpg",
width: "100%",
height: "100%",
disableVideoTagContextMenu: true,
parentId: "#vplayer",
events: {
onReady: function() { },
}"""
如何获取“来源”中的链接?
link1 = "https://example.com/zx5x4vxkb52dxcne4zwsbbn6rpafhxnsodnlcjifkdqatbvqbc5axyv4dpuq/v.mp4"
link2 = "https://example.com/zx5x4vxkb52dxcne4zwsbbn6rpafhxnsodnlcjifkyyarbvqbc5dtluomera/v.mp4"
链接匹配,所以我只需要其中 1 个
注意: 域名每次都变 所以我无法搜索 example.com
【问题讨论】:
标签: python web-scraping beautifulsoup