1:  概述

* 代码:
//2.1获取student.xml的path
String path = JsoupDemo1.class.getClassLoader().getResource("student.xml").getPath();
//2.2解析xml文档,加载文档进内存,获取dom树--->Document
Document document = Jsoup.parse(new File(path), "utf-8");
//3.获取元素对象 Element
Elements elements = document.getElementsByTag("name"); System.out.println(elements.size());
//3.1获取第一个name的Element对象
Element element = elements.get(0);
//3.2获取数据
String name = element.text();
System.out.println(name);

* 对象的使用:
1. Jsoup:工具类,可以解析html或xml文档,返回Document

  • * parse:解析html或xml文档,返回Document
  • * parse​(File in, String charsetName):解析xml或html文件的。
  • * parse​(String html):解析xml或html字符串
  • * parse​(URL url, int timeoutMillis):通过网络路径获取指定的html或xml的文档对象

2. Document:文档对象。代表内存中的dom树
* 获取Element对象

  • * getElementById​(String id):根据id属性值获取唯一的element对象
  • * getElementsByTag​(String tagName):根据标签名称获取元素对象集合
  • * getElementsByAttribute​(String key):根据属性名称获取元素对象集合
  • * getElementsByAttributeValue​(String key, String value):根据对应的属性名和属性值获取元素对象集合
  • 3. Elements:元素Element对象的集合。可以当做 ArrayList<Element>来使用

4. Element:元素对象
1. 获取子元素对象

  • * getElementById​(String id):根据id属性值获取唯一的element对象
  • * getElementsByTag​(String tagName):根据标签名称获取元素对象集合
  • * getElementsByAttribute​(String key):根据属性名称获取元素对象集合
  • * getElementsByAttributeValue​(String key, String value):根据对应的属性名和属性值获取元素对象集合

2. 获取属性值

  • * String attr(String key):根据属性名称获取属性值

3. 获取文本内容

  • * String text():获取文本内容
  • * String html():获取标签体的所有内容(包括字标签的字符串内容)

所用到的数据:

<?xml version="1.0" encoding="UTF-8"?>
<users>
<user id='1'>
<name>zhangsan</name>
<age>23</age>
<gender>male</gender>
<address>环湖中路36</address>
</user> <user id='2'>
<name>lisi</name>
<age>24</age>
<gender>female</gender>
</user>
</users>

  层次关系:

1:Document 是一个xml文件的dom树,表示一个xml文件

2:Elements 表示多个元素(ELEMENT)的集合  findElementXXX() selectot() SetN() 系列API 返回的都是一个集合

3:Element  表示一个元素,xml理解为一个闭合的标签

2: 应用场景

  2.1 有类封装的 强制性解析 , 1: 类只需要三个属性, 但是xml属性多了 所以不能获取跟节点直接使用text()进行解析, 2: 按照常规遍历的方式进行解析

public class ParseFromStudent {

    public static void main(String[] args) throws IOException {
String path = "E:\\GItHubRepository\\Lear-Java\\java-growing\\src\\main\\java\\xml_jsoup\\Student.xml";
Document dom = Jsoup.parse(new File(path), "UTF-8");
class Student {
String name;
int age;
String gender; public Student(String name, int age, String gender) {
super();
this.name = name;
this.age = age;
this.gender = gender;
} @Override
public String toString() {
return "Student [name=" + name + ", age=" + age + ", gender=" + gender + "]";
}
}
Elements element = dom.getElementsByTag("user"); ArrayList<Student> slist = new ArrayList<>();
// element.forEach(v->System.out.println(v));
Iterator<Element> it = element.iterator();
while (it.hasNext()) {
Element next = it.next();
Elements childrens = next.children();
Iterator<Element> it_child = childrens.iterator();
String name = null;
int age = 0;
String gender = null;
while (it_child.hasNext()) {
Element child_node = it_child.next();
switch (child_node.nodeName()) {
case "name":
name=child_node.text();
break;
case "age":
age=Integer.parseInt(child_node.text());
break;
case "gender":
gender=child_node.text();
break;
}
}
slist.add(new Student(name, age, gender));
}
System.out.println(slist);
}
}

 有限制的用法:

public class ParseFromStudent2 {

    public static void main(String[] args) throws IOException {
String path = "E:\\GItHubRepository\\Lear-Java\\java-growing\\src\\main\\java\\xml_jsoup\\Student.xml";
Document dom = Jsoup.parse(new File(path), "UTF-8");
class Student {
String name;
int age;
String gender; public Student(String name, int age, String gender) {
super();
this.name = name;
this.age = age;
this.gender = gender;
} @Override
public String toString() {
return "Student [name=" + name + ", age=" + age + ", gender=" + gender + "]";
}
}
ArrayList<Student> list = new ArrayList<>();
Elements element = dom.getElementsByTag("user");
Iterator<Element> it = element.iterator();
Student stu=null;
/**
* 1: 这里是有局限性的 如果我们要的数据 中间穿插几个不需要的数据,或者xml文档以后变化 了 那么我们还得需要改代码
* 2: 最好的方式就行是使用匹配的方式, 无论 xml源文件 怎么发生变化, 最初的解析版本还是能够使用的
*/
while(it.hasNext()) {
Element next = it.next();
String[] split = next.text().split(" ");
stu=new Student(split[0], Integer.parseInt(split[1]), split[2]);
list.add(stu);
}
System.out.println(list);
}
}

 最好的方式:前面提到的问题,都解决了

public class ParseFromStudent3 {

    public static void main(String[] args) throws IOException {
String path = "E:\\GItHubRepository\\Lear-Java\\java-growing\\src\\main\\java\\xml_jsoup\\Student.xml";
Document dom = Jsoup.parse(new File(path), "UTF-8");
class Student {
String name;
int age;
String gender; public Student(String name, int age, String gender) {
super();
this.name = name;
this.age = age;
this.gender = gender;
} @Override
public String toString() {
return "Student [name=" + name + ", age=" + age + ", gender=" + gender + "]";
}
}
ArrayList<Student> list = new ArrayList<>();
Elements element = dom.getElementsByTag("user");
Iterator<Element> it = element.iterator();
Student stu=null;
/**
* 使用selector 语法
*/
while(it.hasNext()) {
Element next = it.next();
Elements name = next.select("name");
Elements age = next.select("age");
Elements gender = next.select("gender");
stu=new Student(name.text(), Integer.parseInt(age.text()), gender.text());
list.add(stu);
}
System.out.println(list);
BigInteger bigi = new BigInteger("1");
for(int i=1;i<=100;i++){
bigi=bigi.multiply(new BigInteger(i+""));
}
System.out.println(bigi);
}
}

3: Xpath 应用

2. XPath:XPath即为XML路径语言,它是一种用来确定XML(标准通用标记语言的子集)文档中某部分位置的语言
* 使用Jsoup的Xpath需要额外导入jar包。
* 查询w3cshool参考手册,使用xpath的语法完成查询
* 代码:
//1.获取student.xml的path
String path = JsoupDemo6.class.getClassLoader().getResource("student.xml").getPath();
//2.获取Document对象
Document document = Jsoup.parse(new File(path), "utf-8"); //3.根据document对象,创建JXDocument对象
JXDocument jxDocument = new JXDocument(document); //4.结合xpath语法查询
//4.1查询所有student标签
List<JXNode> jxNodes = jxDocument.selN("//student");
for (JXNode jxNode : jxNodes) {
System.out.println(jxNode);
} System.out.println("--------------------"); //4.2查询所有student标签下的name标签
List<JXNode> jxNodes2 = jxDocument.selN("//student/name");
for (JXNode jxNode : jxNodes2) {
System.out.println(jxNode);
} System.out.println("--------------------"); //4.3查询student标签下带有id属性的name标签
List<JXNode> jxNodes3 = jxDocument.selN("//student/name[@id]");
for (JXNode jxNode : jxNodes3) {
System.out.println(jxNode);
}
System.out.println("--------------------");
//4.4查询student标签下带有id属性的name标签 并且id属性值为itcast List<JXNode> jxNodes4 = jxDocument.selN("//student/name[@id='itcast']");
for (JXNode jxNode : jxNodes4) {
System.out.println(jxNode);
}

Jsoup解析Xml{详解}的更多相关文章

  1. C#解析XML详解(XPath以及带命名空间NameSpace)

    <?xml version="1.0" encoding="utf-8" ?> <bookstore> <book> < ...

  2. 17.JAVA-Dom、Sax解析XML详解

    在JAVA中,解析有三种方式: Dom解析(支持改删,耗内存). Sax解析(不支持改删,不耗内存). Pull解析(在Android中推荐使用的一种解析XML的方式,在下章学习). 1.支持Dom与 ...

  3. JavaEE实战——XML文档DOM、SAX、STAX解析方式详解

    原 JavaEE实战--XML文档DOM.SAX.STAX解析方式详解 2016年06月22日 23:10:35 李春春_ 阅读数:3445 标签: DOMSAXSTAXJAXPXML Pull 更多 ...

  4. Web.xml详解(转)

    这篇文章主要是综合网上关于web.xml的一些介绍,希望对大家有所帮助,也欢迎大家一起讨论. ---题记 一.            Web.xml详解: (一)  web.xml加载过程(步骤) 首 ...

  5. Maven-pom.xml详解

    (看的比较累,可以直接看最后面有针对整个pom.xml的注解) pom的作用 pom作为项目对象模型.通过xml表示maven项目,使用pom.xml来实现.主要描述了项目:包括配置文件:开发者需要遵 ...

  6. 【maven】 pom.xml详解

    pom.xml详解 <project xmlns="http://maven.apache.org/POM/4.0.0" xmlns:xsi="http://www ...

  7. Tomcat配置(二):tomcat配置文件server.xml详解和部署简介

    */ .hljs { display: block; overflow-x: auto; padding: 0.5em; color: #333; background: #f8f8f8; } .hl ...

  8. Tomcat(二):tomcat配置文件server.xml详解和部署简介

    Tomcat系列文章:http://www.cnblogs.com/f-ck-need-u/p/7576137.html 1. 入门示例:虚拟主机提供web服务 该示例通过设置虚拟主机来提供web服务 ...

  9. logback的使用和logback.xml详解,在Spring项目中使用log打印日志

    logback的使用和logback.xml详解 一.logback的介绍 Logback是由log4j创始人设计的另一个开源日志组件,官方网站: http://logback.qos.ch.它当前分 ...

随机推荐

  1. .NET Core环境变量和用户秘钥实现开发中的数据安全

    目录 一.注入 IConfiguration 二.从配置文件 appsettings.json 中获取环境变量 三.从项目中获取环境变量 四.用户秘钥设置环境变量 前言:有很多人将秘钥,数据库连接字符 ...

  2. java—将数据库读取的list转tree

    一.引言 有时候我们从数据库中读取出了一个表的数据,比如存储的是中国的省市县的ID.名称与父节点ID,读出来的数据并不是前台想要的,这个时候我们要想法处理一下都出来的list,将它变为一个树. 比如直 ...

  3. 我在知识星球上创建了免费的Web3D学习的星球~

    大家好,我是YYC. 我在知识星球创建了一个免费的星球-"YYC的Web 3D旅程",欢迎大家加入- 本星球完全免费,致力于打造专业的Web 3D技术学习区,分享各种3D技术和信息 ...

  4. WC集训DAY2笔记 组合计数 part.1

    目录 WC集训DAY2笔记 组合计数 part.1 基础知识 组合恒等式 错排数 卡特兰数 斯特林数 伯努利数 贝尔数 调和级数 后记 补完了几天前写的东西 WC集训DAY2笔记 组合计数 part. ...

  5. SpringCloud基础组件总结,与Dubbo框架、SpringBoot框架对比分析

    本文源码:GitHub·点这里 || GitEE·点这里 一.基础组件总结 1.文章阅读目录 1).基础组件 Eureka组件,服务注册与发现 Ribbon和Feign组件,实现负载均衡 Hystri ...

  6. Python面向对象-多重继承之MixIN

    以Animal类为例,假设要实现以下4种动物: Dog(狗).Bat(蝙蝠).Parrot(鹦鹉)和Ostrich(鸵鸟) 如果按照哺乳类和鸟类来区分的话,可以这样设计: Animal: |--Mam ...

  7. 【高可用架构】用Nginx实现负载均衡(三)

    前言 在上一篇,已经用Envoy工具统一发布了Deploy项目代码.本篇我们来看看如何用nginx实现负载均衡 负载均衡器IP 192.168.10.11 [高可用架构]系列链接:待部署的架构介绍 演 ...

  8. sshfs 相关材料索引

    这两天简单看了 sshfs 缓存相关的内容,下面对一些好的链接进行索引,防止以后忘了: OpenSSH: Difference between internal-sftp and sftp-serve ...

  9. Sublime Merge真正的Git客户端

    Sublime Merge好用吗?借助功能强大的跨平台UI工具包,无与伦比的语法高亮引擎和自定义高性能Git读取库,Sublime Merge为性能设定了标准.所有内容都是可扩展的.键绑定,菜单,主题 ...

  10. RabbitMQ 离线安装(带视频)

    疯狂创客圈 Java 高并发[ 亿级流量聊天室实战]实战系列 [博客园总入口 ] 架构师成长+面试必备之 高并发基础书籍 [Netty Zookeeper Redis 高并发实战 ] 疯狂创客圈 高并 ...