ホームページ  >  記事  >  バックエンド開発  >  HTMLファイルのメタ情報のエンコード方式を一括変更する

HTMLファイルのメタ情報のエンコード方式を一括変更する

WBOY
WBOYオリジナル
2016-07-25 09:08:181064ブラウズ
HTML ファイルのエンコード方法がメタ情報で指定されたエンコード方法と異なる場合があります。このコードを使用して修正できます。 このプログラムは jsoup および commons-io パッケージに依存しています

  1. import java.io.File;
  2. import java.io.FileWriter;
  3. import java.io.IOException;
  4. import java.io.Writer;
  5. import java.util.Iterator;
  6. import org.apache。 commons.io.FileUtils;
  7. import org.jsoup.Jsoup;
  8. import org.jsoup.nodes.Document;
  9. import org.jsoup.nodes.Element;
  10. import org.jsoup.select.Elements;
  11. public class main {
  12. /**
  13. * @param args
  14. * @throws IOException
  15. */
  16. public static void main(String[] args) throws IOException {
  17. // TODO 自動生成メソッドスタブ
  18. File input = new File("C:\Users\jack\Desktop \New Folder\jdk-zh");
  19. イテレータ it = FileUtils.iterateFiles(input, null, true);
  20. while (it.hasNext()) {
  21. File file = it.next();
  22. Document doc = Jsoup.parse(file, "gb2312");
  23. 要素コンテンツ = doc.getElementsByAttributeValueStarting("content", "text/html;");
  24. for (要素メタ : コンテンツ) {
  25. meta.attr("content " , "text/html; charset=utf-8");
  26. System.out
  27. .println("コンテンツの変更--------" + file.getName() + "---");
  28. }
  29. FileUtils.writeStringToFile(file, doc.html(),"utf-8");
  30. }
  31. }
  32. }
コードをコピー


声明:
この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。