Bagaimana Mengendalikan Penanda BOM dalam Pembacaan Fail UTF-8?
Mengendalikan Penanda BOM dalam Pembacaan Fail UTF-8
Apabila berurusan dengan fail teks berkod UTF-8 yang mungkin mengandungi Tanda Pesanan Bait ( BOM), adalah penting untuk mengendalikan BOM dengan betul untuk mengelakkan keluaran yang tidak dijangka. BOM ialah jujukan bait khas yang menunjukkan susunan bait fail. Dalam UTF-8, BOM ialah jujukan tiga bait EF BB BF.
Pertimbangkan kod berikut:
fr = new FileReader(file); br = new BufferedReader(fr); String tmp = null; while ((tmp = br.readLine()) != null) { String text; text = new String(tmp.getBytes(), "UTF-8"); content += text + System.getProperty("line.separator"); }
Dalam kod ini, BOM akan disertakan dalam rentetan output teks kerana kaedah getBytes() mendapatkan semula bait mentah rentetan, termasuk BOM. Untuk mengendalikan BOM dengan betul, anda boleh menggunakan teknik berikut:
Kaedah 1: Tentukan Set Aksara BOM
Anda boleh menentukan set aksara sebagai UTF-8 dengan BOM menggunakan kelas Charset:
Charset charset = Charset.forName("UTF-8"); String text = new String(tmp.getBytes(charset), charset);
Kaedah 2: Baca dan Lepaskan BOM
Jika BOM tidak diperlukan, anda boleh membaca dan melepaskannya sebelum memproses fail yang lain:
char[] bom = new char[3]; int bytesRead = br.read(bom, 0, bom.length); if (bytesRead == bom.length && new String(bom).equals("\uFEFF")) { // BOM exists, drop it }
Dengan melaksanakan salah satu daripada teknik ini, anda boleh memastikan bahawa BOM dikendalikan dengan betul dan rentetan output tidak termasuk penanda BOM.
Atas ialah kandungan terperinci Bagaimana Mengendalikan Penanda BOM dalam Pembacaan Fail UTF-8?. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Alat AI Hot

Undresser.AI Undress
Apl berkuasa AI untuk mencipta foto bogel yang realistik

AI Clothes Remover
Alat AI dalam talian untuk mengeluarkan pakaian daripada foto.

Undress AI Tool
Gambar buka pakaian secara percuma

Clothoff.io
Penyingkiran pakaian AI

Video Face Swap
Tukar muka dalam mana-mana video dengan mudah menggunakan alat tukar muka AI percuma kami!

Artikel Panas

Alat panas

Notepad++7.3.1
Editor kod yang mudah digunakan dan percuma

SublimeText3 versi Cina
Versi Cina, sangat mudah digunakan

Hantar Studio 13.0.1
Persekitaran pembangunan bersepadu PHP yang berkuasa

Dreamweaver CS6
Alat pembangunan web visual

SublimeText3 versi Mac
Perisian penyuntingan kod peringkat Tuhan (SublimeText3)

Topik panas











Penyelesaian masalah dan penyelesaian kepada perisian keselamatan syarikat yang menyebabkan beberapa aplikasi tidak berfungsi dengan baik. Banyak syarikat akan menggunakan perisian keselamatan untuk memastikan keselamatan rangkaian dalaman. …

Penyelesaian untuk menukar nama kepada nombor untuk melaksanakan penyortiran dalam banyak senario aplikasi, pengguna mungkin perlu menyusun kumpulan, terutama dalam satu ...

Mula musim bunga menggunakan versi IntelliJideaultimate ...

Pemprosesan pemetaan medan dalam dok sistem sering menemui masalah yang sukar ketika melaksanakan sistem dok: bagaimana untuk memetakan medan antara muka sistem dengan berkesan ...

Apabila menggunakan Mybatis-Plus atau Rangka Kerja ORM yang lain untuk operasi pangkalan data, sering diperlukan untuk membina syarat pertanyaan berdasarkan nama atribut kelas entiti. Sekiranya anda secara manual setiap kali ...

Penukaran objek dan tatasusunan Java: Perbincangan mendalam tentang risiko dan kaedah penukaran jenis cast yang betul Banyak pemula Java akan menemui penukaran objek ke dalam array ...

Bagaimanakah penyelesaian caching Redis menyedari keperluan senarai kedudukan produk? Semasa proses pembangunan, kita sering perlu menangani keperluan kedudukan, seperti memaparkan ...

Penjelasan terperinci mengenai reka bentuk jadual SKU dan SPU di platform e-dagang Artikel ini akan membincangkan isu reka bentuk pangkalan data SKU dan SPU dalam platform e-dagang, terutamanya bagaimana menangani jualan yang ditentukan pengguna ...
