【Jsoup学习礼记】从一个文件加载一个文档

问题

在本机硬盘上有一个HTML文件,需要对它进行解析从中抽取数据或进行修改。

办法

可以使用静态Jsoup.parse(File in, String charsetName, String baseUri)方法:

File input = new File("/tmp/input.html");Document doc = Jsoup.parse(input, "UTF-8", "");说明

parse(File in, String charsetName, String baseUri)这个方法用来加载和解析一个HTML文件。如在加载文件的时候发生错误,将抛出IOException,应作适当处理。

baseUri参数用于解决文件中URLs是相对路径的问题。如果不需要可以传入一个空的字符串。

另外还有一个方法parse(File in, String charsetName),它使用文件的路径做为baseUri。 这个方法适用于如果被解析文件位于网站的本地文件系统,且相关链接也指向该文件系统。

,留下许多叫知识和情感的东西握在手里。

【Jsoup学习礼记】从一个文件加载一个文档

相关文章:

你感兴趣的文章:

标签云: