编写Java程序,使用 dom4j 解析上一节王者荣耀“英雄”对应的Xml文件数据内容,打印输出,具体格式

简介: 编写Java程序,使用 dom4j 解析上一节王者荣耀“英雄”对应的Xml文件数据内容,打印输出,具体格式

需求说明:


使用 dom4j 解析上一节王者荣耀“英雄”对应的Xml文件数据内容,打印输出,具体格式如图所示


49.png


实现思路:


创建ParseHeroXML用于解析Xml,创建Hero类用于封装解析的英雄对象数据

在ParseHeroXML中定义parse()解析方法,根据讲解SAXReader进行解析Xml文件,获取根节点,定义listNodes递归方法调用,传入根节点

在listNodes方法中,遍历节点信息,分别根据节点名称获取相关节点的属性,遇到hero节点时,代表是一个英雄信息, 创建Hero实体对象,存储至List集合中,然后调用获取子节点信息方法getAttrAndChildNode

getAttrAndChildNode为获取hero子节点下的信息的方法,该方法中,获取属性判断是name或id,存储至Hero对象中,继续遍历子节点递归调用

循环遍历List集合中的Hero对象信息,输出查看


实现代码:


用于解析Xml的ParseHeroXML


import java.io.File;
import java.util.ArrayList;
import java.util.Iterator;
import java.util.List;
import org.dom4j.Attribute;
import org.dom4j.Document;
import org.dom4j.DocumentException;
import org.dom4j.Element;
import org.dom4j.io.SAXReader;
public class ParserHeroXML {
  Document document = null;
  Element rootElement = null;
  Hero hero = null;
  // 用来保存所有的英雄数据
  List<Hero> heros = new ArrayList<>();
  // 解析XML文档
  public void parse() {
    try {
      // 创建saxReader对象
      SAXReader reader = new SAXReader();
      // 通过read方法读取一个文件,转换成Document对象
      document = reader.read(new File("H:/hero.xml"));
      // 获取根节点元素对象
      rootElement = document.getRootElement();
      // 遍历所有的元素节点
      listNodes(rootElement);
    } catch (DocumentException e) {
      e.printStackTrace();
    }
  }
  // 递归遍历节点信息
  public void listNodes(Element element) {
    // 获取节点名称
    String elementName = element.getName();
    // 获取节点的文本
    String elementText = element.getTextTrim();
    // 判断当前的节点名称
    switch (elementName) {
    case "hero":
      hero = new Hero();
      heros.add(hero);
      getAttrAndChildNode(element);
      break;
    case "gender":
      hero.setGender(elementText);
      break;
    case "profession":
      hero.setProfession(elementText);
      break;
    case "nationality":
      hero.setNationality(elementText);
      break;
    case "price":
      hero.setPrice(Double.parseDouble(elementText));
      break;
    case "heroList":
      getAttrAndChildNode(element);
      break;
    default:
      break;
    }
  }
  // 获取节点上的属性值和子节点对象
  public void getAttrAndChildNode(Element element) {
    // 获取节点的所有属性
    List<Attribute> attributes = element.attributes();
    Attribute attr = null;
    String attrValue = null;
    // 循环遍历节点的每个属性
    for (int i = 0; i < attributes.size(); i++) {
      // 获取节点中的每个属性
      attr = attributes.get(i);
      // 获取每个属性所对应的值
      attrValue = attr.getValue();
      // 判断是否是id节点还是name节点
      if ("id".equals(attr.getName())) {
        // 将id的值保存到hero对象内
        hero.setId(Integer.parseInt(attrValue));
      } else if ("name".equals(attr.getName())) {
        // 将name的值保存到hero对象内
        hero.setName(attrValue);
      }
    }
    // 获取当前节点下的所有子节点
    Iterator<Element> eleIterator = element.elementIterator();
    // 判断该节点下是否还有子节点
    while (eleIterator.hasNext()) {
      // 取出子节点
      Element e = eleIterator.next();
      // 递归遍历子节点的信息
      listNodes(e);
    }
  }
  // 遍历保存到集合中的英雄信息
  public void showHeroInfo() {
    for (Hero tempHero : heros) {
      System.out.printf("编号:%d,姓名:%s,性别:%s,职业:%s,国籍:%s,价格:%.2f\n", tempHero.getId(), tempHero.getName(),
          tempHero.getGender(), tempHero.getProfession(), tempHero.getNationality(), tempHero.getPrice());
    }
  }
  public static void main(String[] args) {
    ParserHeroXML parserHeroXML = new ParserHeroXML();
    parserHeroXML.parse();
    parserHeroXML.showHeroInfo();
  }
}


用于封装解析的英雄对象数据Hero


public class Hero {
  private int id;// 英雄编号
  private String name;// 英雄名称
  private String gender;// 英雄性别
  private String profession;// 英雄职业
  private String nationality;// 英雄国籍
  private double price; // 出售价格
  public int getId() {
    return id;
  }
  public void setId(int id) {
    this.id = id;
  }
  public String getName() {
    return name;
  }
  public void setName(String name) {
    this.name = name;
  }
  public String getGender() {
    return gender;
  }
  public void setGender(String gender) {
    this.gender = gender;
  }
  public String getProfession() {
    return profession;
  }
  public void setProfession(String profession) {
    this.profession = profession;
  }
  public String getNationality() {
    return nationality;
  }
  public void setNationality(String nationality) {
    this.nationality = nationality;
  }
  public double getPrice() {
    return price;
  }
  public void setPrice(double price) {
    this.price = price;
  }
}



相关文章
|
9月前
|
XML 数据采集 API
用Lxml高效解析XML格式数据:以天气API为例
免费Python教程:实战解析中国天气网XML数据,详解Lxml库高效解析技巧、XPath用法、流式处理大文件及IP封禁应对策略,助你构建稳定数据采集系统。
437 0
|
机器学习/深度学习 数据采集 JavaScript
用深度学习提升DOM解析——自动提取页面关键区块
本文介绍了一次二手车数据爬虫事故的解决过程,从传统XPath方案失效到结合深度学习语义提取的成功实践。面对懂车帝平台的前端异步渲染和复杂DOM结构,通过Playwright动态渲染、代理IP隐藏身份,以及BERT模型对HTML块级语义识别,实现了稳定高效的字段提取。此方法抗结构变化能力强,适用于复杂网页数据采集,如二手车、新闻等领域。架构演进从静态爬虫到动态爬虫再到语义解析,显著提升效率与稳定性。
519 13
用深度学习提升DOM解析——自动提取页面关键区块
|
机器学习/深度学习 数据采集 存储
深度学习在DOM解析中的应用:自动识别页面关键内容区块
本文探讨了如何通过深度学习模型优化东方财富吧财经新闻爬虫的性能。针对网络请求、DOM解析与模型推理等瓶颈,采用代理复用、批量推理、多线程并发及模型量化等策略,将单页耗时从5秒优化至2秒,提升60%以上。代码示例涵盖代理配置、TFLite模型加载、批量预测及多线程抓取,确保高效稳定运行,为大规模数据采集提供参考。
513 0
|
存储 Java 文件存储
微服务——SpringBoot使用归纳——Spring Boot使用slf4j进行日志记录—— logback.xml 配置文件解析
本文解析了 `logback.xml` 配置文件的详细内容,包括日志输出格式、存储路径、控制台输出及日志级别等关键配置。通过定义 `LOG_PATTERN` 和 `FILE_PATH`,设置日志格式与存储路径;利用 `&lt;appender&gt;` 节点配置控制台和文件输出,支持日志滚动策略(如文件大小限制和保存时长);最后通过 `&lt;logger&gt;` 和 `&lt;root&gt;` 定义日志级别与输出方式。此配置适用于精细化管理日志输出,满足不同场景需求。
3270 1
|
XML JavaScript Android开发
【Android】网络技术知识总结之WebView,HttpURLConnection,OKHttp,XML的pull解析方式
本文总结了Android中几种常用的网络技术,包括WebView、HttpURLConnection、OKHttp和XML的Pull解析方式。每种技术都有其独特的特点和适用场景。理解并熟练运用这些技术,可以帮助开发者构建高效、可靠的网络应用程序。通过示例代码和详细解释,本文为开发者提供了实用的参考和指导。
623 15
|
JavaScript 前端开发 Go
CSS 与 JS 对 DOM 解析和渲染的影响
【10月更文挑战第16天】CSS 和 JS 会在一定程度上影响 DOM 解析和渲染,了解它们之间的相互作用以及采取适当的优化措施是非常重要的。通过合理的布局和加载策略,可以提高网页的性能和用户体验,确保页面能够快速、流畅地呈现给用户。在实际开发中,要根据具体情况进行权衡和调整,以达到最佳的效果。
654 57
|
XML Web App开发 JavaScript
XML DOM 解析器
XML DOM 解析器
|
9月前
|
JSON 网络协议 安全
【Java】(10)进程与线程的关系、Tread类;讲解基本线程安全、网络编程内容;JSON序列化与反序列化
几乎所有的操作系统都支持进程的概念,进程是处于运行过程中的程序,并且具有一定的独立功能,进程是系统进行资源分配和调度的一个独立单位一般而言,进程包含如下三个特征。独立性动态性并发性。
429 1
|
9月前
|
JSON 网络协议 安全
【Java基础】(1)进程与线程的关系、Tread类;讲解基本线程安全、网络编程内容;JSON序列化与反序列化
几乎所有的操作系统都支持进程的概念,进程是处于运行过程中的程序,并且具有一定的独立功能,进程是系统进行资源分配和调度的一个独立单位一般而言,进程包含如下三个特征。独立性动态性并发性。
396 1
|
10月前
|
数据采集 存储 弹性计算
高并发Java爬虫的瓶颈分析与动态线程优化方案
高并发Java爬虫的瓶颈分析与动态线程优化方案

推荐镜像

更多
  • DNS