文章詳情頁

html - Python爬蟲，翻頁數(shù)據(jù)怎么爬，URL不變

瀏覽：120日期：2022-08-09 14:14:12

問題描述

網(wǎng)址：http://quote.eastmoney.com/ce...我想爬所有頁的名稱數(shù)據(jù)，（這里只有兩頁），判斷有沒有下一頁的條件該怎么寫呢？代碼：

from selenium import webdriverdriver=webdriver.PhantomJS()url=’http://quote.eastmoney.com/center/list.html#28003684_0_2’driver.get(url)usoup = BeautifulSoup(driver.page_source, ’xml’)n=[]while True: t=usoup.find(’table’,{’id’:’fixed’}) utable=t.find_all(’a’,{’target’:’_blank’}) for i in range(len(utable)): if i % 6 ==1: n.append(utable[i].text) if #停止條件怎么寫: break driver.find_element_by_xpath(r’//*@id='pagenav']/a[2]’).click() usoup = BeautifulSoup(driver.page_source, ’xml’)

后面這里就不會寫了。。。

問題解答

回答1：

可以判斷每一頁的條目，每一頁共20條，如果當前頁不足20條的時候，說明此頁是最后一頁了，爬完當前頁就該停止了

回答2：

話說這個表格不是都有個jsonp的返回接口嗎？為什么還要爬？

回答3：

走的就是jsonp接口，直接拿就好了。

非要抓取的話，只能用selenium + phantomjs 之類的模擬頁面去獲取了。

回答4：

http://nufm.dfcfw.com/EM_Fina...{rank:[(x)],pages:(pc)}&token=7bc05d0d4c3c22ef9fca8c2a912d779c&jsName=quote_123&_g=0.5385195357178545

Python 編程

上一條：python - Django ManyToManyField 字段數(shù)據(jù)在 admin后臺顯示不正確，這是怎么回事？下一條：python - pyspider 如何獲取某個列表中的第n個元素

排行榜

					
					docker不顯示端口映射呢？
數(shù)組按鍵值封裝！
Docker for Mac 創(chuàng)建的dnsmasq容器連不上/不工作的問題
java - 阿里的開發(fā)手冊中為什么禁用map來作為查詢的接受類?
python3.x - git bash如何運行.bat文件？
python - flask _sqlalchemy 能否用中文作為索引條件
docker安裝后出現(xiàn)Cannot connect to the Docker daemon.
nignx - docker內(nèi)nginx 80端口被占用
關(guān)docker hub上有些鏡像的tag被標記““This image has vulnerabilities””
dockerfile - 我用docker build的時候出現(xiàn)下邊問題  麻煩幫我看一下
android - 百度地圖加載完成監(jiān)聽
				

熱門標簽

av一区二区在线观看_亚洲男人的天堂网站_日韩亚洲视频_在线成人免费_欧美日韩精品免费观看视频_久草视

html - Python爬蟲，翻頁數(shù)據(jù)怎么爬，URL不變