解析xml

最新推荐文章于 2024-04-15 15:35:05 发布

H千面

最新推荐文章于 2024-04-15 15:35:05 发布

阅读量230

点赞数

分类专栏： # 前端、javaweb 文章标签：前端

本文链接：https://blog.csdn.net/H200102/article/details/105983652

版权

前端、javaweb 专栏收录该内容

15 篇文章 1 订阅

订阅专栏

解析xml：操作xml文档，将文档中的数据读取到内存中

操作xml文档
1. 解析(读取)：将文档中的数据读取到内存中
2. 写入：将内存中的数据保存到xml文档中。持久化的存储
解析xml的方式：
1. DOM：将标记语言文档一次性加载进内存，在内存中形成一颗dom树
* 优点：操作方便，可以对文档进行CRUD的所有操作
* 缺点：占内存
2. SAX：逐行读取，基于事件驱动的。
* 优点：不占内存。
* 缺点：只能读取，不能增删改

xml常见的解析器：

	1. JAXP：sun公司提供的解析器，支持dom和sax两种思想
	2. DOM4J：一款非常优秀的解析器
	3. Jsoup：jsoup 是一款Java 的HTML解析器，可直接解析某个URL地址、HTML文本内容。它提供了一套非常省力的API，可通过DOM，CSS以及类似于jQuery的操作方法来取出和操作数据。
	4. PULL：Android操作系统内置的解析器，sax方式的。

Jsoup： jsoup 是一款Java 的HTML解析器，可直接解析某个URL地址、HTML文本内容。它提供了一套非常省力的API，可通过DOM，CSS以及类似于jQuery的操作方法来取出和操作数据。
快速入门步骤：

			1. 导入jar包
			2. 获取Document对象
			3. 获取对应的标签Element对象
			4. 获取数据


/**
 * Jsoup快速入门
 *
 */
public class JsoupDemo1 {
    public static  void  main(String[] args)throws IOException{
        // 2.获取Document对象，根据xml文档获取
        // 2.1 获取student.xml 的path
        String path = JsoupDemo1.class.getClassLoader().getResource("student.xml").getPath();
        //2.2 解析xml文档，加载文档进内存，获取dom 树 -- >Document
        Document document = Jsoup.parse(new File(path),"utf-8");

        // 3.获取元素对象 Element(继承ArrayList)
        Elements elements = document.getElementsByTag("name");
        System.out.println(elements.size());
        // 3.1 获取第一个name的Element对象
        Element element = elements.get(0);
        //3.2获取数据
        String name = element.text();
        System.out.println(name);

    }
}

快速查询

selector:选择器
* 使用的方法：Elements select(String cssQuery)
* 语法：参考Selector类中定义的语法
XPath：XPath即为XML路径语言，它是一种用来确定XML（标准通用标记语言的子集）文档中某部分位置的语言
* 使用Jsoup的Xpath需要额外导入jar包。
* 查询w3cshool参考手册，使用xpath的语法完成查询
XPath示例代码：

/**
 *XPath查询
 */
public class JsoupDemo6 {
    public static void main(String[] args) throws IOException, XpathSyntaxErrorException {
        //1.获取student.xml的path
        String path = JsoupDemo6.class.getClassLoader().getResource("student.xml").getPath();
        //2.获取Document对象
        Document document = Jsoup.parse(new File(path), "utf-8");

        //3.根据document对象，创建JXDocument对象
        JXDocument jxDocument = new JXDocument(document);

        //4.结合xpath语法查询
        //4.1查询所有student标签
        List<JXNode> jxNodes = jxDocument.selN("//student");
        for (JXNode jxNode : jxNodes) {
            System.out.println(jxNode);
        }

        System.out.println("--------------------");

        //4.2查询所有student标签下的name标签
        List<JXNode> jxNodes2 = jxDocument.selN("//student/name");
        for (JXNode jxNode : jxNodes2) {
            System.out.println(jxNode);
        }

        System.out.println("--------------------");

        //4.3查询student标签下带有id属性的name标签
        List<JXNode> jxNodes3 = jxDocument.selN("//student/name[@id]");
        for (JXNode jxNode : jxNodes3) {
            System.out.println(jxNode);
        }
        System.out.println("--------------------");
        //4.4查询student标签下带有id属性的name标签 并且id属性值为itcast

        List<JXNode> jxNodes4 = jxDocument.selN("//student/name[@id='itcast']");
        for (JXNode jxNode : jxNodes4) {
            System.out.println(jxNode);
        }
    }
}