如何使用 BeautifulSoup 从纽约网站提取停车票数据?
使用 Python 的 BeautifulSoup 解析 HTML 表格
在处理网页抓取项目时,了解如何有效地解析 HTML 表格至关重要。 BeautifulSoup 是一个流行的 Python 库,它提供了一种从 HTML 文档中提取数据的强大方法。在本文中,我们将探讨一个特定场景:使用 BeautifulSoup 解析 NYC 停车罚单表。
问题:
要学习 Python 的请求和 BeautifulSoup 库,您需要我们的任务是编写一个简单的纽约停车罚单解析器。导航到指定 URL 并获得 HTML 响应后,您需要帮助提取“lineItemsTable”HTML 表格中列出的所有停车票。
如何解析表格:
解析表的关键在于利用BeautifulSoup的表解析功能。以下是完成此操作的修订版 Python 代码片段:
<code class="python">import requests from bs4 import BeautifulSoup plate = "T630134C" plateRequest = requests.get(f"https://paydirect.link2gov.com/NYCParking-Plate/ItemSearch?PlateNumber={plate}") soup = BeautifulSoup(plateRequest.text, "html.parser") table = soup.find("table", {"class": "lineItemsTable"}) table_body = table.find("tbody") rows = table_body.find_all("tr") data = [] for row in rows: cols = row.find_all("td") cols = [col.text.strip() for col in cols] data.append([col for col in cols if col])</code>
登录后复制
附加说明:
- 提取的数据中的最后一行包括“付款金额”标签,它不是表格的一部分。您可以通过检查行长度是否小于 7 来过滤掉此内容。
- 每行的最后一列是需要特殊处理的输入文本框。
通过以下操作步骤,您可以使用 BeautifulSoup 有效解析 NYC 停车罚单表,并提取项目所需的所有信息。
以上是如何使用 BeautifulSoup 从纽约网站提取停车票数据?的详细内容。更多信息请关注PHP中文网其他相关文章!
本站声明
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热AI工具

Undresser.AI Undress
人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover
用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool
免费脱衣服图片

Clothoff.io
AI脱衣机

AI Hentai Generator
免费生成ai无尽的。

热门文章
R.E.P.O.能量晶体解释及其做什么(黄色晶体)
2 周前
By 尊渡假赌尊渡假赌尊渡假赌
仓库:如何复兴队友
4 周前
By 尊渡假赌尊渡假赌尊渡假赌
Hello Kitty Island冒险:如何获得巨型种子
3 周前
By 尊渡假赌尊渡假赌尊渡假赌
击败分裂小说需要多长时间?
3 周前
By DDD
R.E.P.O.保存文件位置:在哪里以及如何保护它?
3 周前
By DDD

热工具

记事本++7.3.1
好用且免费的代码编辑器

SublimeText3汉化版
中文版,非常好用

禅工作室 13.0.1
功能强大的PHP集成开发环境

Dreamweaver CS6
视觉化网页开发工具

SublimeText3 Mac版
神级代码编辑软件(SublimeText3)