HTMLファイルのメタ情報のエンコード方式を一括変更する
リリース: 2016-07-25 09:08:18
HTML ファイルのエンコード方法がメタ情報で指定されたエンコード方法と異なる場合があります。このコードを使用して修正できます。 このプログラムは jsoup および commons-io パッケージに依存しています
- import java.io.File;
- import java.io.FileWriter;
- import java.io.IOException;
- import java.io.Writer;
- import java.util.Iterator;
-
- import org.apache。 commons.io.FileUtils;
- import org.jsoup.Jsoup;
- import org.jsoup.nodes.Document;
- import org.jsoup.nodes.Element;
- import org.jsoup.select.Elements;
-
- public class main {
-
- /**
- * @param args
- * @throws IOException
- */
- public static void main(String[] args) throws IOException {
- // TODO 自動生成メソッドスタブ
-
- File input = new File("C:\Users\jack\Desktop \New Folder\jdk-zh");
- イテレータ it = FileUtils.iterateFiles(input, null, true);
- while (it.hasNext()) {
- File file = it.next();
- Document doc = Jsoup.parse(file, "gb2312");
- 要素コンテンツ = doc.getElementsByAttributeValueStarting("content", "text/html;");
- for (要素メタ : コンテンツ) {
- meta.attr("content " , "text/html; charset=utf-8");
- System.out
- .println("コンテンツの変更--------" + file.getName() + "---");
- }
- FileUtils.writeStringToFile(file, doc.html(),"utf-8");
- }
- }
- }
-
コードをコピー
|
このウェブサイトの声明
この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。
著者別の最新記事
-
2024-10-22 09:46:29
-
2024-10-13 13:53:41
-
2024-10-12 12:15:51
-
2024-10-11 22:47:31
-
2024-10-11 19:36:51
-
2024-10-11 15:50:41
-
2024-10-11 15:07:41
-
2024-10-11 14:21:21
-
2024-10-11 12:59:11
-
2024-10-11 12:17:31