Rumah pembangunan bahagian belakang Tutorial Python Bagaimana untuk menukar entiti HTML ke rentetan Unicode dalam Python?

Bagaimana untuk menukar entiti HTML ke rentetan Unicode dalam Python?

Nov 05, 2024 am 05:21 AM

How to convert HTML entities to Unicode strings in Python?

Tukar Entiti XML/HTML ke dalam Rentetan Unikod dalam Python

Soalan: Bagaimana saya boleh menukar rentetan yang mengandungi entiti HTML kepada rentetan Unikod dalam Ular sawa? Contohnya, rentetan "ǎ" hendaklah ditukar kepada "ǎ" dengan tanda nada (u'u01ce').

Jawapan:

HTMLParser perpustakaan standard Python mempunyai fungsi tidak berdokumen dipanggil unescape(). Fungsi ini boleh menukar entiti HTML kepada setara Unicode mereka.

<code class="python">import HTMLParser
h = HTMLParser.HTMLParser()
h.unescape('&amp;amp;copy; 2010') # u'\xa9 2010'
h.unescape('&amp;amp;#169; 2010') # u'\xa9 2010'</code>
Salin selepas log masuk

Untuk Python 3.4 dan ke atas, kod berikut akan berfungsi menggunakan modul html:

<code class="python">import html
html.unescape('&amp;amp;copy; 2010') # u'\xa9 2010'
html.unescape('&amp;amp;#169; 2010') # u'\xa9 2010'</code>
Salin selepas log masuk

Atas ialah kandungan terperinci Bagaimana untuk menukar entiti HTML ke rentetan Unicode dalam Python?. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Kenyataan Laman Web ini
Kandungan artikel ini disumbangkan secara sukarela oleh netizen, dan hak cipta adalah milik pengarang asal. Laman web ini tidak memikul tanggungjawab undang-undang yang sepadan. Jika anda menemui sebarang kandungan yang disyaki plagiarisme atau pelanggaran, sila hubungi admin@php.cn

Tag artikel panas

Notepad++7.3.1

Notepad++7.3.1

Editor kod yang mudah digunakan dan percuma

SublimeText3 versi Cina

SublimeText3 versi Cina

Versi Cina, sangat mudah digunakan

Hantar Studio 13.0.1

Hantar Studio 13.0.1

Persekitaran pembangunan bersepadu PHP yang berkuasa

Dreamweaver CS6

Dreamweaver CS6

Alat pembangunan web visual

SublimeText3 versi Mac

SublimeText3 versi Mac

Perisian penyuntingan kod peringkat Tuhan (SublimeText3)

Bagaimana saya menggunakan sup yang indah untuk menghuraikan html? Bagaimana saya menggunakan sup yang indah untuk menghuraikan html? Mar 10, 2025 pm 06:54 PM

Bagaimana saya menggunakan sup yang indah untuk menghuraikan html?

Penapisan gambar di python Penapisan gambar di python Mar 03, 2025 am 09:44 AM

Penapisan gambar di python

Cara Menggunakan Python untuk Mencari Pengagihan Zipf Fail Teks Cara Menggunakan Python untuk Mencari Pengagihan Zipf Fail Teks Mar 05, 2025 am 09:58 AM

Cara Menggunakan Python untuk Mencari Pengagihan Zipf Fail Teks

Cara Bekerja Dengan Dokumen PDF Menggunakan Python Cara Bekerja Dengan Dokumen PDF Menggunakan Python Mar 02, 2025 am 09:54 AM

Cara Bekerja Dengan Dokumen PDF Menggunakan Python

Cara Cache Menggunakan Redis dalam Aplikasi Django Cara Cache Menggunakan Redis dalam Aplikasi Django Mar 02, 2025 am 10:10 AM

Cara Cache Menggunakan Redis dalam Aplikasi Django

Bagaimana untuk melakukan pembelajaran mendalam dengan Tensorflow atau Pytorch? Bagaimana untuk melakukan pembelajaran mendalam dengan Tensorflow atau Pytorch? Mar 10, 2025 pm 06:52 PM

Bagaimana untuk melakukan pembelajaran mendalam dengan Tensorflow atau Pytorch?

Serialization dan deserialisasi objek python: Bahagian 1 Serialization dan deserialisasi objek python: Bahagian 1 Mar 08, 2025 am 09:39 AM

Serialization dan deserialisasi objek python: Bahagian 1

Cara Melaksanakan Struktur Data Anda Sendiri di Python Cara Melaksanakan Struktur Data Anda Sendiri di Python Mar 03, 2025 am 09:28 AM

Cara Melaksanakan Struktur Data Anda Sendiri di Python

See all articles