


Bagaimana untuk menukar entiti HTML ke rentetan Unicode dalam Python?
Nov 05, 2024 am 05:21 AMTukar Entiti XML/HTML ke dalam Rentetan Unikod dalam Python
Soalan: Bagaimana saya boleh menukar rentetan yang mengandungi entiti HTML kepada rentetan Unikod dalam Ular sawa? Contohnya, rentetan "ǎ" hendaklah ditukar kepada "ǎ" dengan tanda nada (u'u01ce').
Jawapan:
HTMLParser perpustakaan standard Python mempunyai fungsi tidak berdokumen dipanggil unescape(). Fungsi ini boleh menukar entiti HTML kepada setara Unicode mereka.
<code class="python">import HTMLParser h = HTMLParser.HTMLParser() h.unescape('&amp;copy; 2010') # u'\xa9 2010' h.unescape('&amp;#169; 2010') # u'\xa9 2010'</code>
Untuk Python 3.4 dan ke atas, kod berikut akan berfungsi menggunakan modul html:
<code class="python">import html html.unescape('&amp;copy; 2010') # u'\xa9 2010' html.unescape('&amp;#169; 2010') # u'\xa9 2010'</code>
Atas ialah kandungan terperinci Bagaimana untuk menukar entiti HTML ke rentetan Unicode dalam Python?. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Artikel Panas

Alat panas Tag

Artikel Panas

Tag artikel panas

Notepad++7.3.1
Editor kod yang mudah digunakan dan percuma

SublimeText3 versi Cina
Versi Cina, sangat mudah digunakan

Hantar Studio 13.0.1
Persekitaran pembangunan bersepadu PHP yang berkuasa

Dreamweaver CS6
Alat pembangunan web visual

SublimeText3 versi Mac
Perisian penyuntingan kod peringkat Tuhan (SublimeText3)

Topik panas

Bagaimana saya menggunakan sup yang indah untuk menghuraikan html?

Cara Menggunakan Python untuk Mencari Pengagihan Zipf Fail Teks

Cara Bekerja Dengan Dokumen PDF Menggunakan Python

Cara Cache Menggunakan Redis dalam Aplikasi Django

Bagaimana untuk melakukan pembelajaran mendalam dengan Tensorflow atau Pytorch?

Serialization dan deserialisasi objek python: Bahagian 1

Cara Melaksanakan Struktur Data Anda Sendiri di Python
