av一区二区在线观看_亚洲男人的天堂网站_日韩亚洲视频_在线成人免费_欧美日韩精品免费观看视频_久草视

您的位置:首頁技術文章
文章詳情頁

python - 用urllib抓取網頁上的下載鏈接,目標文件是xls形式,但發現抓下來的xls是空表,里面只有一句報錯信息,求幫助。

瀏覽:189日期:2022-07-24 08:56:37

問題描述

想用urllib抓取上交所股票列表的xls下載鏈接,如下圖紅色小框:

python - 用urllib抓取網頁上的下載鏈接,目標文件是xls形式,但發現抓下來的xls是空表,里面只有一句報錯信息,求幫助。

發現抓下來的xls只有報錯信息:

python - 用urllib抓取網頁上的下載鏈接,目標文件是xls形式,但發現抓下來的xls是空表,里面只有一句報錯信息,求幫助。

請問要怎樣才能把有內容的xls抓下來?

代碼如下

from urllib import requestfrom datetime import datetime# -*- coding:utf-8 -*-url = ’http://query.sse.com.cn/security/stock/downloadStockListFile.do?’ ’csrcCode=&stockCode=&areaName=&stockType=1’myheaders = [(’User - Agent’, ’Mozilla/5.0 (Windows; U; Windows NT 5.2) AppleWebKit/525.13’ ’ (KHTML, like Gecko) Version/3.1 Safari/525.13’),]opener = request.build_opener()opener.addheaders = myheadersrequest.install_opener(opener)local = '/Users/Mty/Downloads/data/' + str(datetime.now().date()) + ' .xls'request.urlretrieve(url, local)

問題解答

回答1:

可以在標紅線的url上看到返回的公司信息,剩下的就是模擬瀏覽器請求這個url了,request header中的refer一定不能省略,不然會報403

記住要模擬 refer 這一項的值。

http://blog.csdn.net/ssshen14...這個是已有的解決方案

回答2:

查看cookie,referer

標簽: Python 編程
主站蜘蛛池模板: 黄色小视频免费在线观看 | 一级做a爰片久久毛片潮喷 视频一二区 | 欧美专区第一页 | 日韩 国产 欧美 | 亚洲精品乱码久久久久 | 久久精品亚洲 | 日韩不卡一区二区 | 成人毛片网 | 国产盗摄一区二区 | 久久激情综合 | 美国一级大黄一片免费中文 | 欧美视频在线观看 | 国产黄色片视频 | 亚洲欧美综合 | 日日干av| 午夜久久精品 | 十八岁毛片 | 精品国产99久久久久久宅男i | 久久免费高清视频 | 免费性网站 | 国产成人精品在线观看 | 成人国产精品 | 天天爽夜夜爽夜夜爽精品视频 | 午夜精品影院 | 久久性色 | 九九国产| 黄视频在线播放 | 精品久久网站 | 日韩午夜精品 | 97在线播放 | 日韩一区二区三区精品 | 欧美福利视频 | 欧美日韩小视频 | 亚洲欧美在线视频 | 成人欧美视频 | 欧美在线激情 | 色77777| 国产亚洲一区二区三区 | 久久精品一区二区三区四区 | 毛片视频免费 | 国产黄色一级片 |