【发布时间】:2020-01-03 23:39:24
【问题描述】:
我刚刚开始网页抓取。最终的想法是在我的网页上显示来自许多网站的此类信息。我的问题是我应该从哪里/从哪里开始阅读有关格式化 return 语句输出的内容。当前输出全是乱码。我已经尝试阅读它,但是无法理解它。有没有什么地方可以让我在网页上以一种很好的方式显示它的上下文中阅读它?
BSE Live Jan 03, 16:00 1537.25 1.90 (0.12%) 成交量 平均成交量 5 天 467,144 10 天 575,986 30 天 455,188 354,087收盘价 1535.35 开盘价 1534.40 1523.40 今日 L/H 1541.30 1081.25 52 周 L/H 1617.80 1381.85 L/U 价格区间 1688.85 买价(数量) 0.00 (0) 卖价(数量) 0.00 (0) VWAP 1535.08 市场深度03 Jan 2020) BUYSELL QTY PRICE PRICE QTY 500 1535.05 1535.65 33 301 1534.95 1536.60 21 424 1534.85 1536.70 21 510 1534.75 1536.85 23 1044 1534.70 1537.00 632 0 Total Total 0 Market Depth BUY 0 SELL 0 0% 0% NSE Live Jan 03, 15: 59 1537.15 1.85 (0.12%) 成交量 平均成交量 5 天 8,111,879 10 天 9,299,481 30 天 8,175,032 9,593,498收盘价 1535.30 开盘价 1533.00 1523.00 今日 L/H 1541.65 1081.10 52 Wk L/H 1617.55 1381.80 L/U 价格区间 1688.80 买价(数量) 0.00 (0) 卖价(数量) 1537.15 (5051) 1537.15 (5051) 代表VWAP日内交易是允许的,正常交易是在这个类别中进行的系列:EQ
from flask import Flask
from bs4 import BeautifulSoup
import requests
app = Flask(__name__)
@app.route('/')
# driver = webdriver.Chrome(executable_path="C:/Users/Abhi/Downloads/cd79/chromedriver.exe")
def scrape():
url = "https://www.moneycontrol.com/india/stockpricequote/refineries/relianceindustries/RI"
r = requests.get(url)
soup = BeautifulSoup(r.content, 'html.parser')
for el in soup.find_all('div', class_='bse_nse_livebox'):
return el.get_text()
if __name__ == '__main__':
app.run()
【问题讨论】:
-
爬取是从网站获取数据或信息,你应该知道网站是如何工作的,你可以从HTML的基础和结构这里开始w3schools.com/html/html_intro.asp
-
@NurFaizin ..我的意思是在哪里可以阅读有关美化烧瓶网页的此输出的信息。我知道网站是如何运作的。问题是..是在烧瓶网页的 HTML 上完成,或者可以在代码本身中完成一些事情来实现它。