python爬蟲怎麼寫

藏色散人
發布: 2019-08-01 16:11:08
原創
3277 人瀏覽過

python爬蟲怎麼寫

如今許多有程式設計能力的小夥伴已經不滿足手動搜尋內容了,都希望透過編寫爬蟲軟體來快速取得需要的內容,那麼如何使用python製作爬蟲呢?下面小編跟大家講解一下思路

寫python爬蟲的方法/步驟

首先我們需要確定要爬取的目標頁內容,如下圖所示例如要取得溫度值

python爬蟲怎麼寫

然後我們需要開啟瀏覽器的F12,找出所要取得內容的特徵,例如他有哪些樣式標籤或ID屬性

python爬蟲怎麼寫

接下來我們開啟cmd命令列介面,導入requests函式庫和html函式庫,如下圖所示,這個lxml需要大家自行下載安裝

python爬蟲怎麼寫

接著就是透過requests函式庫將頁面內容取得過來,然後用lxml下的html將其轉換為文本,如下圖所示

python爬蟲怎麼寫

接下來就是透過xpath語法進行特定元素內容的查找,這裡一般會用到class或id的名稱,如下圖所示

python爬蟲怎麼寫

#最後運行程式就可以取得到需要的內容了,如下圖所示

python爬蟲怎麼寫

綜上所述,運用python製作爬蟲主要是運用requests取得內容,然後根據內容進行特定元素查找,這只是最簡單的流程,不過即使在複雜的爬蟲也是這幾步。

相關推薦:《Python教學

以上是python爬蟲怎麼寫的詳細內容。更多資訊請關注PHP中文網其他相關文章!

相關標籤:
來源:php.cn
本網站聲明
本文內容由網友自願投稿,版權歸原作者所有。本站不承擔相應的法律責任。如發現涉嫌抄襲或侵權的內容,請聯絡admin@php.cn
熱門教學
更多>
最新下載
更多>
網站特效
網站源碼
網站素材
前端模板
關於我們 免責聲明 Sitemap
PHP中文網:公益線上PHP培訓,幫助PHP學習者快速成長!