python 多線程爬蟲中遇到的坑
python多執行緒爬蟲的方式包括函數式和類別物件方式。一、函數式start_new_thread(func,args[])。程式碼範例如下:
圖1:函數式多執行緒
二、呼叫Thread類別的類別物件方式程式碼範例如下:
圖2:類別物件方式多執行緒程式碼結構及流程:
引入threading模組
定義子類myThread繼承threading.Thread類別。
重定義父類別Thread的run()方法,在其中執行功能代碼
實例化執行緒物件
開始執行執行緒start()
加入執行緒佇列,直至執行完成,join()。
遇到的問題:
在定義子類別時候對類別的定義及類別內引用方法print_time()出現錯誤,具體程式碼和錯誤如圖2和圖3所示。
圖2:錯誤代碼
#圖3:錯誤提示
#2 .在具體的爬取http://www.78b2b.com/lianghuizhuanti/324826_1.html網頁資訊的應用過程遇到的問題。具體程式碼如圖4所示:
#圖4:具體應用程式碼
程式碼意圖是利用多執行緒爬取13個網頁中的2020年遼寧政府工作報告,並保存在本地TXT檔案中,執行過程中的現象,網頁被全部打開,但是TXT儲存資料不全並且有內容的重複寫入。
以上是python 多線程爬蟲中遇到的坑的詳細內容。更多資訊請關注PHP中文網其他相關文章!

熱AI工具

Undresser.AI Undress
人工智慧驅動的應用程序,用於創建逼真的裸體照片

AI Clothes Remover
用於從照片中去除衣服的線上人工智慧工具。

Undress AI Tool
免費脫衣圖片

Clothoff.io
AI脫衣器

AI Hentai Generator
免費產生 AI 無盡。

熱門文章

熱工具

記事本++7.3.1
好用且免費的程式碼編輯器

SublimeText3漢化版
中文版,非常好用

禪工作室 13.0.1
強大的PHP整合開發環境

Dreamweaver CS6
視覺化網頁開發工具

SublimeText3 Mac版
神級程式碼編輯軟體(SublimeText3)

熱門話題

Linux終端中查看Python版本時遇到權限問題的解決方法當你在Linux終端中嘗試查看Python的版本時,輸入python...

在使用Python的pandas庫時,如何在兩個結構不同的DataFrame之間進行整列複製是一個常見的問題。假設我們有兩個Dat...

如何在10小時內教計算機小白編程基礎?如果你只有10個小時來教計算機小白一些編程知識,你會選擇教些什麼�...

使用FiddlerEverywhere進行中間人讀取時如何避免被檢測到當你使用FiddlerEverywhere...

Uvicorn是如何持續監聽HTTP請求的? Uvicorn是一個基於ASGI的輕量級Web服務器,其核心功能之一便是監聽HTTP請求並進�...

在Python中,如何通過字符串動態創建對象並調用其方法?這是一個常見的編程需求,尤其在需要根據配置或運行...

本文討論了諸如Numpy,Pandas,Matplotlib,Scikit-Learn,Tensorflow,Tensorflow,Django,Blask和請求等流行的Python庫,並詳細介紹了它們在科學計算,數據分析,可視化,機器學習,網絡開發和H中的用途
