Java で文字ストリームを使用して非テキスト ファイルを読み書きする方法

王林
リリース: 2023-04-18 19:04:04
転載
1108 人が閲覧しました

    文字ストリームを使用してファイルを読み取る (非テキスト)

    Java の文字ストリームを例としてファイルを読み取ります。これは読み取りのみ可能です。 0 ~ 65535 の文字の場合、文字はすべて正の数であることがわかりますが、バイナリ バイトは負の数になる可能性があります。しかし、読み取り時には、正の数として読み取られるか、エンコーディング テーブルに見つからない文字が奇妙な記号 (あの奇妙な「?」を見たことがあるかもしれません) を返します。

    しかし、場合によっては、バイナリ データを表示するために文字を使用する必要があり、方法がありません。方法の 1 つである base64 エンコード を導入しましょう。

    Base64 エンコード

    base64 エンコードの概要

    base64 は、インターネット上で 8 ビット バイトコードを送信するために使用される一般的なエンコード方法の 1 つです。 on バイナリ データを 64 文字の印刷可能文字で表現する方法。 Base64 エンコードはバイナリから文字へのプロセスであり、HTTP 環境でより長い識別情報を送信するために使用できます。 Base64 エンコードは読み取ることができないため、読み取る前にデコードする必要があります。その中国語名は、バイナリ データを表す 64 個の印刷可能な文字に基づいています。

    エンコーディング ルール

    1. 3 バイトを 4 バイトに変換します。

    2. 76 文字と改行文字は使用できません。

    3. 最後のターミネータも処理する必要があります。

    エンコード方式の欠点

    エンコード ルールからわかるように、base64 では 3 つの 8 ビット バイトごとに 4 つの 6 ビット文字 (38 = 46 = 24) に変換する必要があります。次に、6 ビットに 2 つの上位ビット 0 を追加して、4 つの 8 ビット バイトを形成します。つまり、変換された文字列は理論的には元の文字列より 1/3 (33%) 長くなります。

    ここでは、コンセプトとより詳細な内容を紹介します。興味がある場合は、収集してさらに詳しく知ることができます。

    Java における Base64 のアプリケーション

    Java の Base64 ツール クラスは、次の 3 つの BASE64 コーデックを取得するための静的メソッドのセットを提供します。

    • 基本:出力は文字セット A-Za-z0-9/ にマップされ、エンコードでは行マーカーは追加されず、出力のデコードでは A-Za-z0-9/ のみがサポートされます。

    • URL: 出力は文字セット A-Za-z0-9 _ にマップされ、出力は URL とファイルです。

    • MIME: 出力は暗黙的に MIME 対応形式にマップされます。出力は 1 行あたり 76 文字以内で、「\r」とその後に続く「\n」で区切る必要があります。エンコードされた出力は最終的に行分割されません。

    次のメソッドに対応します:

    Encoder basicEncoder = Base64.getEncoder();
    Encoder mimeEncoder = Base64.getMimeEncoder();
    Encoder urlEncoder = Base64.getUrlEncoder();
    ログイン後にコピー

    Basic(basic) encoder をテストするための簡単なツール クラスを作成しました。 。

    package com.dragon;
    
    import java.io.BufferedInputStream;
    import java.io.ByteArrayOutputStream;
    import java.io.File;
    import java.io.FileInputStream;
    import java.io.FileNotFoundException;
    import java.io.IOException;
    import java.io.InputStream;
    import java.io.UnsupportedEncodingException;
    import java.util.Base64;
    import java.util.Base64.Decoder;
    import java.util.Base64.Encoder;
    
    /**
     * @author Alfred
     * */
    public class Base64Util {
    	private static Encoder encoder = Base64.getEncoder();
    	private static Decoder decoder = Base64.getDecoder();
    	private static String ENCODE = "UTF-8";
    	private static int LENGTH = 1024;
    	
    	/**
    	 * 静态方法:
    	 * 将文件等二进制数据(文本和非文本都可以)
    	 * 转为base64字符串。
    	 * @throws IOException 
    	 * @throws FileNotFoundException 
    	 * 
    	 * */
    	public static String dataToBase64(File src) throws FileNotFoundException, IOException {
    		Encoder encoder = Base64.getEncoder();
    		
    		int len = (int)src.length();
    		byte[] bar = new byte[(int)len];
    		int hasRead = 0;
    		byte[] b = new byte[LENGTH];
    		//使用专门处理 byte 的IO流比较方便,一次性读取较大文件对内存压力较大
    		try (InputStream in = new BufferedInputStream(new FileInputStream(src));
    				ByteArrayOutputStream bos = new ByteArrayOutputStream(len)) {
    			while ((hasRead = in.read(b)) != -1) {
    				bos.write(b, 0, hasRead);
    			}
    			bar = bos.toByteArray();
    		}
    		return encoder.encodeToString(bar);
    	}
    	
    	public static String dataToBase64(String src) throws UnsupportedEncodingException {
    		return encoder.encodeToString(src.getBytes(ENCODE));
    	}
    	
    	public static byte[] base64ToData(String src) {
    		return decoder.decode(src);
    	}
    }
    ログイン後にコピー

    読み取りおよび書き込みのために画像を Base64 文字列に変換します

    import java.io.BufferedReader;
    import java.io.BufferedWriter;
    import java.io.File;
    import java.io.FileNotFoundException;
    import java.io.FileReader;
    import java.io.FileWriter;
    import java.io.IOException;
    import java.io.UnsupportedEncodingException;
    import java.io.Writer;
    import java.nio.file.Path;
    import java.nio.file.Paths;
    
    public class Base64Test {
    	public static void main(String[] args) throws FileNotFoundException, IOException {
    		testPic();
    	}
    	
    	static void testPic() throws FileNotFoundException, IOException {
    		// 测试图片文件。
    		Path picPath = Paths.get("./src/com/dragon/001.jpg");
    		File picFile = picPath.toFile();
    		String picToBase64 = Base64Util.dataToBase64(picFile);
    		System.out.println(picToBase64);
    		long oldSize = picFile.length();
    		long newSize = picToBase64.getBytes("UTF-8").length;
    		System.out.println("图片原始大小(字节):" + oldSize);
    		System.out.println("转换后数据大小(字节):" + newSize);
    		System.out.println("转换后比原来扩大的比例为:" + (double)(newSize-oldSize)/(double)oldSize + " %");
    		
    		//将数据写入文件
    		try (Writer writer = new BufferedWriter(new FileWriter("./src/com/dragon/002.txt"))) {
    			writer.write(picToBase64);
    		}
    		
    		//从文件中读取数据
    		String line = null;
    		try (BufferedReader reader = new BufferedReader(new FileReader("./src/com/dragon/002.txt"))){
    			line = reader.readLine();
    		}
    		System.out.println(picToBase64.equals(line));
    	}
    }
    ログイン後にコピー

    スクリーンショットを実行します

    Java で文字ストリームを使用して非テキスト ファイルを読み書きする方法

    手順: この後画像を Base64 文字列に変換し、文字ストリームを使用してテキスト ファイルを書き込み、文字ストリームを使用してそれを読み出し、元の文字列と比較すると、結果は true になります。 これで、画像データの読み込みが完了しました。ここで画像のバイナリデータを読み込んでいないと言っているかもしれませんが、実際には、すべてのファイルはバイナリで保存されています。さらに、このbase64文字列をそのまま画像として使用することもできます。

    注: ここでは非常に小さな画像を選択しました。元のサイズはわずか 3639 バイトで、4 KB 未満であることがわかりますが、テキストに変換すると、たくさんあります ( つまり、非常に長く表示されます。 )。

    テスト画像

    Java で文字ストリームを使用して非テキスト ファイルを読み書きする方法

    #では、この文字列が上の画像であることをどのように証明するか尋ねるかもしれません。これも簡単に実行できます。フロントエンドについてある程度の知識がある場合は、フロントエンドの画像が Base64 文字列で表現できることを知っているはずです。テストするための HTML ファイルを作成してみましょう。

    image.html

    <!DOCTYPE>
    <html>
        <head>
            <meta charset="UTF-8"/>
            <title>base测试</title>
        </head>
        <body>
            <img src=""/>
        </body>
    <html>
    ログイン後にコピー

    ブラウザを開いてテストしてください

    Java で文字ストリームを使用して非テキスト ファイルを読み書きする方法

    手順: 具体的な使用方法は次のとおりです:

    <img src="https://img-blog.csdnimg.cn/2022010703315790409.jpeg">

    実際の絵のサイズは文字に比べてかなり大きいです。ここにある HTML コードは、完全な画像を Base64 でエンコードした文字列であり、ブログの文字数はさらに多くなります。

    文字列を Base64 エンコードに変換する

    public class Base64Test {
    	public static void main(String[] args) throws FileNotFoundException, IOException {
    		testStr("I love you yesterday and today!");
    	}
    	
    	static void testStr(String src) throws UnsupportedEncodingException {
    		//测试文本数据。
    		String strToBase64 = Base64Util.dataToBase64(src);
    		System.out.println("base64编码:" + strToBase64);
    		String base64ToStr = new String(Base64Util.base64ToData(strToBase64));
    		System.out.println("base64解码:" + base64ToStr);
    	}
    }
    ログイン後にコピー

    テスト スクリーンショット

    Java で文字ストリームを使用して非テキスト ファイルを読み書きする方法

    base64 の使用

    Base64 は、テキスト データが通常処理される状況で、バイナリ データを表現、送信、保存するためによく使用されます。 MIME 電子メール、MIME 経由の電子メール、XML での複雑なデータの保存が含まれます。注1: ​​インターネット上には、エンコードとデコードを実行できる Web サイトも多数ありますので、必要な場合は試してみてください。

    注2:可以观察一下这个base64字符串的特点,我上次学习Java爬虫的时候,爬了一个网站,发现这个网站的一个 script 脚本中,含有一个json对象,其中有一个属性是 url,但是对应的链接却看不懂(base64字符串是不可读的),但是我感觉它就是base64字符串,所以我利用base64编解码网站解码一看,真的是一个网站的地址。然后,就可以写一个解码方法,当爬到这个数据时,给它解码了,哈哈。

    举一个简单的例子:

    {"url":"aHR0cHMlM0ElMkYlMkZ3d3cuYmFpZHUuY29tJTJG"}
    ログイン後にコピー
    import java.io.UnsupportedEncodingException;
    import java.net.URLDecoder;
    import java.net.URLEncoder;
    import java.util.Base64;
    import java.util.Base64.Decoder;
    import java.util.Base64.Encoder;
    
    public class TestALittle {
    	public static void main(String[] args) throws UnsupportedEncodingException {
    		String base64Str = "aHR0cHMlM0ElMkYlMkZ3d3cuYmFpZHUuY29tJTJG";
    		String de_str = base64ToUrlEncoderToURL(base64Str);
    		System.out.println("解码:" + de_str);
    	}
    	
    	//base64解密为urlencoder,再解码为url
    	public static String base64ToUrlEncoderToURL(String base64Str) throws UnsupportedEncodingException {
    		Decoder decoder = Base64.getDecoder();
    		byte[] bt = decoder.decode(base64Str);
    		String en_str = new String(bt, 0, bt.length);
    		return URLDecoder.decode(en_str, "UTF-8");
    	}
    }
    ログイン後にコピー

    Java で文字ストリームを使用して非テキスト ファイルを読み書きする方法

    说明: 这个例子中的 url 进行了两次编码,第一次是将url中的非西欧字符编码(可以去了解一下为什么这么做?),然后再使用base64编码。但是,如果你掌握了解码技术,解码也是很简单的。(但是如果你看不出来它是base64编码,那估计就没有办法了!)

    以上がJava で文字ストリームを使用して非テキスト ファイルを読み書きする方法の詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。

    関連ラベル:
    ソース:yisu.com
    このウェブサイトの声明
    この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。
    人気のチュートリアル
    詳細>
    最新のダウンロード
    詳細>
    ウェブエフェクト
    公式サイト
    サイト素材
    フロントエンドテンプレート