首頁手記 python爬蟲抓取二手設備網

python爬蟲抓取二手設備網

標簽：

Html5

本人是个爬虫小萌新，看了网上教程学着做爬虫爬取二手设备网，如果有什么问题请大佬们反馈，谢谢。

以下是用lxml来爬取的。

from lxml import etree

def getHTMLText(url):
kv = {
'cookie': 'ssids=1581214855718752; sfroms=JIAOYIMALL001; historyScanGame=%5B%225667%22%2Cnull%5D; session=1581214855718753-7; showFixGuideDialog=true'
, 'user-agent': 'Mozilla/5.0'}
r = requests.get(url, headers=kv)
r.raise_for_status()
r.encoding = 'utf-8'
return r.text

def shixian(url):
htmls = etree.HTML(url)
mc = htmls.xpath(
'//div[@class="wrap"]/div[@class="mod-con sel-content "]/div[@class="bd"]/ul[@class="list-con specialList"]/li[@name="goodsItem"]/span[@class="name"]/span[@class="is-account"]/a/text()')
price = htmls.xpath(
'//div[@class="wrap"]/div[@class="mod-con sel-content "]/div[@class="bd"]/ul[@class="list-con specialList"]/li[@name="goodsItem"]/span[@class="price"]')
count = 0
tplt = "{:4}\t{:12}\t{:20}"
print(tplt.format("二手设备网"))
for i in range(len(mc)):
count = count + 1
print(tplt.format(count, price[i].text, mc[i], chr(12288)))

if __name__ == '__main__':
url='https://www.91chuli.com/'
lists=[]
url=url+'-n'+'1'+'.html'
html=getHTMLText(url)
shixian(html)

點擊查看更多內容

為 TA 點贊

若覺得本文不錯，就分享一下吧！

評論

評論

共同學習，寫下你的評論

評論加載中...

展開查看更多評論

作者其他優質文章

正在加載中

慕數據7186066

手記
篇

粉絲

0

獲贊與收藏

11

關注作者，訂閱最新文章

閱讀免費教程

Html5 入門教程

25個小節 62419 829

后端通用面試教程

41個小節 32258 360

網絡編程入門教程

20個小節 13303 250

推薦

評論

收藏

共同學習，寫下你的評論



感謝您的支持，我會繼續努力的～

掃碼打賞，你說多少就多少

贊賞金額會直接到老師賬戶

支付方式

打開微信掃一掃，即可進行掃碼打賞哦

今天注冊有機會得

100積分直接送

付費專欄免費學

大額優惠券免費領

立即參與放棄機會

點擊
抽獎

慕課手記新用戶專享福利

恭喜你，你的運氣太好了，居然抽中了 100個積分！

恭喜你，抽中了價值元的專欄！

太棒了，直接落到你賬戶里！

積分商城里的羅技鼠標、機械鍵盤、
Kindle 閱讀器、小米平衡車
Apple iPad （10.2英寸）、大額優惠券
在等著你去兌換了噢

作者：

免費贈送

兌換碼：1111222211 復制

優惠券可用于購買實戰課、體系課
無門檻使用

先去看看，有什么好東西馬上兌換我愛學習，選課去


亚洲在线久爱草,狠狠天天香蕉网,天天搞日日干久草,伊人亚洲日本欧美

熱搜

最近搜索清空

python爬蟲抓取二手設備網

閱讀免費教程