Rumah pembangunan bahagian belakang Tutorial Python Bagaimana untuk Menghapuskan Aksara Tidak Boleh Cetak daripada Rentetan dalam Python?

Bagaimana untuk Menghapuskan Aksara Tidak Boleh Cetak daripada Rentetan dalam Python?

Oct 22, 2024 am 06:55 AM

How to Strip Non-Printable Characters from Strings in Python?

Melucutkan Aksara Tidak Boleh Cetak daripada Rentetan dalam Python

Dalam Perl, s/[^[:print:]]// g regex secara berkesan mengalih keluar semua aksara yang tidak boleh dicetak daripada rentetan. Walau bagaimanapun, dalam Python, tiada kelas regex POSIX yang setara, menyebabkan sesetengah orang tertanya-tanya bagaimana untuk mencapai tugas yang sama.

Memahami Unicode

Cabarannya terletak pada pengendalian aksara Unicode , kerana kaedah string.printable mungkin menanggalkannya secara tidak sengaja.

Membina Kelas Aksara Tersuai

Untuk menangani perkara ini, kami boleh membina kelas aksara tersuai menggunakan unicodedata modul. Fungsi unicodedata.category() menyediakan cerapan ke dalam kategori aksara. Contohnya, kita boleh mentakrifkan kelas aksara yang dipanggil control_characters untuk mewakili aksara yang tidak boleh dicetak seperti aksara kawalan dan aksara pengganti dengan menapis kategori tersebut daripada set aksara Unicode.

<code class="python">import unicodedata
import re

categories = {'Cc', 'Cf', 'Cs'}  # Include desired categories here
control_chars = ''.join(chr(i) for i in range(sys.maxunicode) if unicodedata.category(chr(i)) in categories)
control_char_re = re.compile('[%s]' % re.escape(control_chars))</code>
Salin selepas log masuk

Pendekatan ini menawarkan kecekapan yang lebih baik berbanding dengan lelaran atas rentetan.

<code class="python">def remove_control_chars(s):
    return control_char_re.sub('', s)</code>
Salin selepas log masuk

Penyesuaian Tambahan

Untuk senario yang menapis kategori tambahan (cth., aksara penggunaan persendirian) diperlukan, anda boleh mengembangkan kelas aksara sewajarnya.

<code class="python">categories.add('Co')  # Add private-use characters
# Rebuild the character class and regex</code>
Salin selepas log masuk

Dengan menggunakan pendekatan ini, anda boleh menanggalkan aksara tidak boleh cetak secara berkesan daripada rentetan Unicode dalam Python, memenuhi kedua-dua kes penggunaan asas dan tersuai.

Atas ialah kandungan terperinci Bagaimana untuk Menghapuskan Aksara Tidak Boleh Cetak daripada Rentetan dalam Python?. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Kenyataan Laman Web ini
Kandungan artikel ini disumbangkan secara sukarela oleh netizen, dan hak cipta adalah milik pengarang asal. Laman web ini tidak memikul tanggungjawab undang-undang yang sepadan. Jika anda menemui sebarang kandungan yang disyaki plagiarisme atau pelanggaran, sila hubungi admin@php.cn

Alat AI Hot

Undresser.AI Undress

Undresser.AI Undress

Apl berkuasa AI untuk mencipta foto bogel yang realistik

AI Clothes Remover

AI Clothes Remover

Alat AI dalam talian untuk mengeluarkan pakaian daripada foto.

Undress AI Tool

Undress AI Tool

Gambar buka pakaian secara percuma

Clothoff.io

Clothoff.io

Penyingkiran pakaian AI

AI Hentai Generator

AI Hentai Generator

Menjana ai hentai secara percuma.

Artikel Panas

R.E.P.O. Kristal tenaga dijelaskan dan apa yang mereka lakukan (kristal kuning)
2 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌
Repo: Cara menghidupkan semula rakan sepasukan
4 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌
Hello Kitty Island Adventure: Cara mendapatkan biji gergasi
3 minggu yang lalu By 尊渡假赌尊渡假赌尊渡假赌

Alat panas

Notepad++7.3.1

Notepad++7.3.1

Editor kod yang mudah digunakan dan percuma

SublimeText3 versi Cina

SublimeText3 versi Cina

Versi Cina, sangat mudah digunakan

Hantar Studio 13.0.1

Hantar Studio 13.0.1

Persekitaran pembangunan bersepadu PHP yang berkuasa

Dreamweaver CS6

Dreamweaver CS6

Alat pembangunan web visual

SublimeText3 versi Mac

SublimeText3 versi Mac

Perisian penyuntingan kod peringkat Tuhan (SublimeText3)

Cara Menggunakan Python untuk Mencari Pengagihan Zipf Fail Teks Cara Menggunakan Python untuk Mencari Pengagihan Zipf Fail Teks Mar 05, 2025 am 09:58 AM

Cara Menggunakan Python untuk Mencari Pengagihan Zipf Fail Teks

Cara memuat turun fail di python Cara memuat turun fail di python Mar 01, 2025 am 10:03 AM

Cara memuat turun fail di python

Penapisan gambar di python Penapisan gambar di python Mar 03, 2025 am 09:44 AM

Penapisan gambar di python

Bagaimana saya menggunakan sup yang indah untuk menghuraikan html? Bagaimana saya menggunakan sup yang indah untuk menghuraikan html? Mar 10, 2025 pm 06:54 PM

Bagaimana saya menggunakan sup yang indah untuk menghuraikan html?

Cara Bekerja Dengan Dokumen PDF Menggunakan Python Cara Bekerja Dengan Dokumen PDF Menggunakan Python Mar 02, 2025 am 09:54 AM

Cara Bekerja Dengan Dokumen PDF Menggunakan Python

Cara Cache Menggunakan Redis dalam Aplikasi Django Cara Cache Menggunakan Redis dalam Aplikasi Django Mar 02, 2025 am 10:10 AM

Cara Cache Menggunakan Redis dalam Aplikasi Django

Memperkenalkan Toolkit Bahasa Alam (NLTK) Memperkenalkan Toolkit Bahasa Alam (NLTK) Mar 01, 2025 am 10:05 AM

Memperkenalkan Toolkit Bahasa Alam (NLTK)

Bagaimana untuk melakukan pembelajaran mendalam dengan Tensorflow atau Pytorch? Bagaimana untuk melakukan pembelajaran mendalam dengan Tensorflow atau Pytorch? Mar 10, 2025 pm 06:52 PM

Bagaimana untuk melakukan pembelajaran mendalam dengan Tensorflow atau Pytorch?

See all articles