dom4j 订阅
dom4j是一个Java的XML API,是jdom的升级品,用来读写XML文件的。dom4j是一个十分优秀的JavaXML API,具有性能优异、功能强大和极其易使用的特点,它的性能超过sun公司官方的dom技术,同时它也是一个开放源代码的软件,可以在SourceForge上找到它。在IBM developerWorks上面还可以找到一篇文章,对主流的Java XML API进行的性能、功能和易用性的评测,所以可以知道dom4j无论在哪个方面都是非常出色的。如今可以看到越来越多的Java软件都在使用dom4j来读写XML,特别值得一提的是连Sun的JAXM也在用dom4j。这已经是必须使用的jar包, Hibernate也用它来读写配置文件。 展开全文
dom4j是一个Java的XML API,是jdom的升级品,用来读写XML文件的。dom4j是一个十分优秀的JavaXML API,具有性能优异、功能强大和极其易使用的特点,它的性能超过sun公司官方的dom技术,同时它也是一个开放源代码的软件,可以在SourceForge上找到它。在IBM developerWorks上面还可以找到一篇文章,对主流的Java XML API进行的性能、功能和易用性的评测,所以可以知道dom4j无论在哪个方面都是非常出色的。如今可以看到越来越多的Java软件都在使用dom4j来读写XML,特别值得一提的是连Sun的JAXM也在用dom4j。这已经是必须使用的jar包, Hibernate也用它来读写配置文件。
信息
外文名
dom4j
特    点
易用、开源
性    质
开源XML解析包
应    用
Java平台
dom4j概念
DOM4J是dom4j.org出品的一个开源XML解析包,它的网站中这样定义:Dom4j is an easy to use, open source library for working with XML, XPath and XSLT on the Java platform using the Java Collections Framework and with full support for DOM, SAX and JAXP.Dom4j是一个易用的、开源的库,用于XML,XPath和XSLT。它应用于Java平台,采用了Java集合框架并完全支持DOM,SAX和JAXP。DOM4J使用起来非常简单。只要你了解基本的XML-DOM模型,就能使用。然而他自己带的指南只有短短一页(html),不过说的到健全。国内的中文资料很少。因而俺写这个短小的教程方便大家使用,这篇文章仅谈及基本的用法,如需深入的使用,请……自己摸索或查找别的资料。之前看过IBM developer社区的文章(参见附录),提到一些XML解析包的性能比较,其中DOM4J的性能非常出色,在多项测试中名列前茅。(事实上DOM4J的官方文档中也引用了这个比较)所以这次的项目中我采用了DOM4J作为XML解析工具。在国内比较流行的是使用JDOM作为解析器,两者各擅其长,但DOM4J最大的特色是使用大量的接口,这也是它被认为比JDOM灵活的主要原因。大师不是说过么,“面向接口编程”。使用DOM4J的已经越来越多。如果你善于使用JDOM,不妨继续用下去,只看看本篇文章作为了解与比较,如果你正要采用一种解析器,不如就用DOM4J吧。它的主要接口都在org.dom4j这个包里定义:Attribute Attribute定义了XML的属性Branch Branch为能够包含子节点的节点如XML元素(Element)和文档(Docuemnts)定义了一个公共的行为,CDATA CDATA 定义了XML CDATA 区域CharacterDataCharacterData是一个标识接口,标识基于字符的节点。如CDATA,Comment, Text.Comment Comment 定义了XML注释的行为Document 定义了XML文档DocumentType DocumentType 定义XML DOCTYPE声明Element Element定义XML 元素ElementHandler ElementHandler定义了 Element 对象的处理器ElementPath 被 ElementHandler 使用,用于取得当前正在处理的路径层次信息Entity Entity定义 XML entityNode Node为所有的dom4j中XML节点定义了多态行为NodeFilter NodeFilter 定义了在dom4j节点中产生的一个滤镜或谓词的行为(predicate)ProcessingInstruction ProcessingInstruction 定义 XML 处理指令.Text Text 定义XML文本节点.Visitor Visitor 用于实现Visitor模式.XPath XPath 在分析一个字符串后会提供一个XPath表达式看名字大致就知道它们的涵义如何了。要想弄懂这套接口,关键的是要明白接口的继承关系:interface java.lang.Cloneableinterface org.dom4j.Nodeinterface org.dom4j.Attributeinterface org.dom4j.Branchinterface org.dom4j.Documentinterface org.dom4j.Elementinterface org.dom4j.CharacterDatainterface org.dom4j.CDATAinterface org.dom4j.Commentinterface org.dom4j.Textinterface org.dom4j.DocumentTypeinterface org.dom4j.Entityinterface org.dom4j.ProcessingInstruction一目了然,很多事情都清楚了。大部分都是由Node继承来的。知道这些关系,将来写程序就不会出现ClassCastException了。
收起全文
精华内容
参与话题
问答
  • xml SAXReader 的解析库。 Java ,Andriod。...如今可以看到越来越多的Java软件都在使用dom4j来读写XML,特别值得一提的是连Sun的JAXM也在用dom4j。这已经是必须使用的jar包, Hibernate也用它来读写配置文件。
  • Dom4jDom4j完整教程详解

    万次阅读 多人点赞 2018-11-22 14:48:22
    Dom4j完整教程 目录 1、DOM4J简介 2、XML文档操作1 2.1、读取XML文档: 2.2、获取根节点 2.3、.新增一个节点以及其下的子节点与数据 2.4、写入XML文件 2. 5、遍历xml节点 2.6、创建xml文件 2.7、...

    Dom4j完整教程

     

    目录

    Dom4j完整教程

    1、DOM4J简介

    2、XML文档操作1

    2.1、读取XML文档:

    2.2、获取根节点

    2.3、. 新增一个节点以及其下的子节点与数据

    2.4、 写入XML文件

    2. 5、 遍历xml节点

    2.6、创建xml文件

    2.7、修改节点属性

    2.8、删除节点

    2、XML文档操作2

    2.1、Document对象相关        

    1、读取XML文件,获得document对象.     

    2、解析XML形式的文本,得到document对象.      

    3、主动创建document对象.      

    2.2、节点相关        

    1、获取文档的根节点.      

    2、取得某节点的单个子节点.      

    3.取得节点的文字      

    4.取得某节点下指定名称的所有节点并进行遍历.      

    5.对某节点下的所有子节点进行遍历.      

    6.在某节点下添加子节点.      

    7.设置节点文字.      

    8.删除某节点.      

    9.添加一个CDATA节点.      

    2.3、属性相关.     

    1.取得节点的指定的属性      

    2.取得属性的文字      

    3.遍历某节点的所有属性      

    4.设置某节点的属性和文字.      

    5.设置属性的文字      

    6.删除某属性      

    2.4、将文档写入XML文件.     

    1.文档中全为英文,不设置编码,直接写入.      

    2.文档中含有中文,设置编码格式再写入.     

    2.5、字符串与XML的转换      

    1.将字符串转化为XML      

    2.将文档或节点的XML转化为字符串.     

    3、dom4j的事件处理模型涉及的类和接口:

    3.1、类:SAXReader

    3.2、接口ElementHandler

    3.3、Element类

    3.4、类DocumentHelper 

    4、通过xpath查找指定的节点

    4.1、 xpath语法

    1、选取节点

    2、谓语(Predicates)

    3、选取未知节点

    4、选取若干路径

    5、XPath 轴

    6、路径

    7、XPath 运算符


    1、DOM4J简介

        DOM4J是 dom4j.org 出品的一个开源 XML 解析包。DOM4J应用于 Java 平台,采用了 Java 集合框架并完全支持 DOM,SAX 和 JAXP。

        DOM4J 使用起来非常简单。只要你了解基本的 XML-DOM 模型,就能使用。

        Dom:把整个文档作为一个对象。

      DOM4J 最大的特色是使用大量的接口。它的主要接口都在org.dom4j里面定义:

    Attribute

    定义了 XML 的属性。

    Branch

    指能够包含子节点的节点。如XML元素(Element)和文档(Docuemnts)定义了一个公共的行为

    CDATA

    定义了 XML CDATA 区域

    CharacterData

    是一个标识接口,标识基于字符的节点。如CDATA,Comment, Text.

    Comment

    定义了 XML 注释的行为

    Document

    定义了XML 文档

    DocumentType

    定义 XML DOCTYPE 声明

    Element

    定义XML 元素

    ElementHandler

    定义了Element 对象的处理器

    ElementPath

    被 ElementHandler 使用,用于取得当前正在处理的路径层次信息

    Entity

    定义 XML entity

    Node

    为dom4j中所有的XML节点定义了多态行为

    NodeFilter

    定义了在dom4j 节点中产生的一个滤镜或谓词的行为(predicate)

    ProcessingInstruction

    定义 XML 处理指令

    Text

    定义 XML 文本节点

    Visitor

    用于实现 Visitor模式

    XPath

    在分析一个字符串后会提供一个 XPath 表达式

    接口之间的继承关系如下:

    interface java.lang.Cloneable

        interface org.dom4j.Node

               interface org.dom4j.Attribute

               interface org.dom4j.Branch

                      interface org.dom4j.Document

                      interface org.dom4j.Element

               interface org.dom4j.CharacterData

                      interface org.dom4j.CDATA

                      interface org.dom4j.Comment

                      interface org.dom4j.Text

               interface org.dom4j.DocumentType

               interface org.dom4j.Entity

               interface org.dom4j.ProcessingInstruction

    2、XML文档操作1

    2.1、读取XML文档:

         读写XML文档主要依赖于org.dom4j.io包,有DOMReader和SAXReader两种方式。因为利用了相同的接口,它们的调用方式是一样的。

    1. public static Document load(String filename) {  
          Document document = null;  
          try {  
              SAXReader saxReader = new SAXReader();  
              document = saxReader.read(new File(filename)); // 读取XML文件,获得document对象  
          } catch (Exception ex) {  
              ex.printStackTrace();  
          }  
          return document;  
      }  
        
      public static Document load(URL url) {  
          Document document = null;  
          try {  
              SAXReader saxReader = new SAXReader();  
              document = saxReader.read(url); // 读取XML文件,获得document对象  
          } catch (Exception ex) {  
              ex.printStackTrace();  
          }  
          return document;  
      }  
      

       

     

    //读取指定的xml文件之后返回一个Document对象,这个对象代表了整个XML文档,用于各种Dom运算。执照XML文件头所定义的编码来转换。

    2.2、获取根节点

    根节点是xml分析的开始,任何xml分析工作都需要从根开始

     

    Xml xml = new Xml();  
      
    Document dom = xml.load(path + "/" + file);  
      
    Element root = dom.getRootElement();  
    

     

    2.3、. 新增一个节点以及其下的子节点与数据

    Element menuElement = root.addElement("menu");  
      
    Element engNameElement = menuElement.addElement("engName");  
      
    engNameElement.setText(catNameEn);  
      
    Element chiNameElement = menuElement.addElement("chiName");  
      
    chiNameElement.setText(catName);  
    

     

    2.4、 写入XML文件

    注意文件操作的包装类是乱码的根源

     

    public static boolean doc2XmlFile(Document document, String filename) {  
        boolean flag = true;  
        try {  
            XMLWriter writer = new XMLWriter(new OutputStreamWriter(  
                    new FileOutputStream(filename), "UTF-8"));  
            writer.write(document);  
            writer.close();  
        } catch (Exception ex) {  
            flag = false;  
            ex.printStackTrace();  
        }  
        System.out.println(flag);  
        return flag;  
    }  
    
        Dom4j通过XMLWriter将Document对象表示的XML树写入指定的文件,并使用OutputFormat格式对象指定写入的风格和编码方法。调用OutputFormat.createPrettyPrint()方法可以获得一个默认的pretty print风格的格式对象。对OutputFormat对象调用setEncoding()方法可以指定XML文件的编码方法。
    
    public void writeTo(OutputStream out, String encoding)  
            throws UnsupportedEncodingException, IOException {  
        OutputFormat format = OutputFormat.createPrettyPrint();  
      
        format.setEncoding("gb2312");  
      
        XMLWriter writer = new XMLWriter(System.out, format);  
      
        writer.write(doc);  
      
        writer.flush();  
      
        return;  
      
    }  

    2. 5、 遍历xml节点

           对Document对象调用getRootElement()方法可以返回代表根节点的Element对象。拥有了一个Element对象后,可以对该对象调用elementIterator()方法获得它的子节点的Element对象们的一个迭代器。使用(Element)iterator.next()方法遍历一个iterator并把每个取出的元素转化为Element类型。

    public boolean isOnly(String catNameEn, HttpServletRequest request,  
            String xml) {  
        boolean flag = true;  
        String path = request.getRealPath("");  
        Document doc = load(path + "/" + xml);  
        Element root = doc.getRootElement();  
        for (Iterator i = root.elementIterator(); i.hasNext();) {  
            Element el = (Element) i.next();  
            if (catNameEn.equals(el.elementTextTrim("engName"))) {  
                flag = false;  
                break;  
            }  
        }  
        return flag;  
    }  
    

    2.6、创建xml文件

    public static void main(String args[]) {  
      
        String fileName = "c:/text.xml";  
      
        Document document = DocumentHelper.createDocument();// 建立document对象,用来操作xml文件  
      
        Element booksElement = document.addElement("books");// 建立根节点  
      
        booksElement.addComment("This is a test for dom4j ");// 加入一行注释  
      
        Element bookElement = booksElement.addElement("book");// 添加一个book节点  
      
        bookElement.addAttribute("show", "yes");// 添加属性内容  
      
        Element titleElement = bookElement.addElement("title");// 添加文本节点  
      
        titleElement.setText("ajax in action");// 添加文本内容  
      
        try {  
      
            XMLWriter writer = new XMLWriter(new FileWriter(new File(fileName)));  
             writer.write(document) //写入
     
            writer.close();  
      
        } catch (Exception e) {  
      
            e.printStackTrace();  
      
        }  
      
    }  
    

    2.7、修改节点属性

    public static void modifyXMLFile() {  
      
        String oldStr = "c:/text.xml";  
      
        String newStr = "c:/text1.xml";  
      
        Document document = null;  
      
        //修改节点的属性  
      
        try {  
      
        SAXReader saxReader = new SAXReader(); // 用来读取xml文档  
      
        document = saxReader.read(new File(oldStr)); // 读取xml文档  
      
        List list = document.selectNodes("/books/book/@show");// 用xpath查找节点book的属性  
      
        Iterator iter = list.iterator();  
      
        while (iter.hasNext()) {  
      
        Attribute attribute = (Attribute) iter.next();  
      
        if (attribute.getValue().equals("yes"))   
      
            attribute.setValue("no");  
      
        }  
      
        } catch (Exception e) {  
      
            e.printStackTrace();  
      
        }  
      
        //修改节点的内容  
      
        try {  
      
        SAXReader saxReader = new SAXReader(); // 用来读取xml文档  
      
        document = saxReader.read(new File(oldStr)); // 读取xml文档  
      
        List list = document.selectNodes("/books/book/title");// 用xpath查找节点book的内容  
      
        Iterator iter = list.iterator();  
      
        while (iter.hasNext()) {  
      
        Element element = (Element) iter.next();  
      
        element.setText("xxx");// 设置相应的内容  
      
        }  
      
        } catch (Exception e) {  
      
            e.printStackTrace();  
      
        }  
      
           
      
        try {  
      
        XMLWriter writer = new XMLWriter(new FileWriter(new File(newStr)));  
      
        writer.write(document);  
      
        writer.close();  
      
        } catch (Exception ex) {  
      
            ex.printStackTrace();  
      
        }  
      
    }  
     

     

    2.8、删除节点

     

    public static void removeNode() {  
      
        String oldStr = "c:/text.xml";  
      
        String newStr = "c:/text1.xml";  
      
        Document document = null;  
      
        try {  
      
            SAXReader saxReader = new SAXReader();// 用来读取xml文档  
      
            document = saxReader.read(new File(oldStr));// 读取xml文档  
      
            List list = document.selectNodes("/books/book");// 用xpath查找对象  
      
            Iterator iter = list.iterator();  
      
            while (iter.hasNext()) {  
      
                Element bookElement = (Element) iter.next();  
      
                // 创建迭代器,用来查找要删除的节点,迭代器相当于指针,指向book下所有的title节点  
      
                Iterator iterator = bookElement.elementIterator("title");  
      
                while (iterator.hasNext()) {  
      
                    Element titleElement = (Element) iterator.next();  
      
                    if (titleElement.getText().equals("ajax in action")) {  
      
                        bookElement.remove(titleElement);  
      
                    }  
      
                }  
      
            }  
      
        } catch (Exception e) {  
      
            e.printStackTrace();  
      
        }  
      
        try {  
      
            XMLWriter writer = new XMLWriter(new FileWriter(new File(newStr)));  
      
            writer.write(document);  
      
            writer.close();  
      
        } catch (Exception ex) {  
      
            ex.printStackTrace();  
      
        }  
      
    }  
     
    
    
    1.  

     

    2、XML文档操作2

    2.1、Document对象相关        

    1、读取XML文件,获得document对象.     

          
    
     SAXReader reader = new SAXReader();  
          Document   document = reader.read(new File("input.xml"));   
       

    2、解析XML形式的文本,得到document对象.      

              
       String text = "<members></members>";      
                 Document document = DocumentHelper.parseText(text);      

    3、主动创建document对象.      

               
      Document document = DocumentHelper.createDocument();      
                 Element root = document.addElement("members");// 创建根节点      

    2.2、节点相关        

    1、获取文档的根节点.      

    Element rootElm = document.getRootElement();      

    2、取得某节点的单个子节点.      

    Element memberElm=root.element("member");// "member"是节点名      

    3.取得节点的文字      

    String text=memberElm.getText();     
    String text=root.elementText("name");这个是取得根节点下的name字节点的文字.       

    4.取得某节点下指定名称的所有节点并进行遍历.      

    List nodes = rootElm.elements("member");      
    for (Iterator it = nodes.iterator(); it.hasNext();) {      
        Element elm = (Element) it.next();      
       // do something      
    }      

    5.对某节点下的所有子节点进行遍历.      

             
       for(Iterator it=root.elementIterator();it.hasNext();){      
                     Element element = (Element) it.next();      
                    // do something      
                 }      

    6.在某节点下添加子节点.      

    Element ageElm = newMemberElm.addElement("age");    
      

    7.设置节点文字.      

    ageElm.setText("29");      

    8.删除某节点.      

    parentElm.remove(childElm);    // childElm是待删除的节点,parentElm是其父节点   
       

    9.添加一个CDATA节点.      

          
       Element contentElm = infoElm.addElement("content");      
             contentElm.addCDATA(diary.getContent());      
          

    2.3、属性相关.     

    1.取得节点的指定的属性      

            
         Element root=document.getRootElement();          
                 Attribute attribute=root.attribute("size");    // 属性名name      

    2.取得属性的文字      

      
      String text=attribute.getText();    
    String text2=root.element("name").attributeValue("firstname");
    //这个是取得根节点下name字节点的firstname属性的值.      

    3.遍历某节点的所有属性      

    Element root=document.getRootElement();
    for(Iterator it=root.attributeIterator();it.hasNext();){
    Attribute attribute = (Attribute) it.next();
    String text=attribute.getText();
    System.out.println(text);
    }

    4.设置某节点的属性和文字.      

    newMemberElm.addAttribute("name", "sitinspring");    

    5.设置属性的文字      

             
        Attribute attribute=root.attribute("name");      
                 attribute.setText("sitinspring");      

    6.删除某属性      

                
     Attribute attribute=root.attribute("size");// 属性名name      
                 root.remove(attribute);      

    2.4、将文档写入XML文件.     

    1.文档中全为英文,不设置编码,直接写入.      

    XMLWriter writer = new XMLWriter(new FileWriter("output.xml"));      
    writer.write(document);      
    writer.close();     

    2.文档中含有中文,设置编码格式再写入.     

    OutputFormat format = OutputFormat.createPrettyPrint();
    format.setEncoding("GBK");    // 指定XML编码
    XMLWriter writer = new XMLWriter(new FileWriter("output.xml"),format);
    writer.write(document);
    writer.close();

    2.5、字符串与XML的转换      

    1.将字符串转化为XML      

    String text = "<members> <member>sitinspring</member> </members>";      
    Document document = DocumentHelper.parseText(text);      

    2.将文档或节点的XML转化为字符串.     

    S
    AXReader reader = new SAXReader();
    Document document = reader.read(new File("input.xml"));
    Element root=document.getRootElement();
    String docXmlText=document.asXML();
    String rootXmlText=root.asXML();
    Element memberElm=root.element("member");
    String memberXmlText=memberElm.asXML();
    
           
           

    3、dom4j的事件处理模型涉及的类和接口:

    3.1、类:SAXReader

     

         当解析到path指定的路径时,将调用参数handler指定的处理器。针对不同的节点可以添加多个handler实例。或者调用默认的Handler setDefaultHandler(ElementHandler handler);

    3.2、接口ElementHandler

     

         该方法在解析到元素的开始标签时被调用。

     

         该方法在解析到元素的结束标签时被调用

    3.3、接口:ElementPath (假设有参数:ElementPath path)

     

         该方法与SAXReader类中的addHandler()方法的作用相同。路径path可以是绝对路径(路径以/开头),也可以是相对路径(假设是当前路径的子节点路径)。

     

         移除指定路径上的ElementHandler实例。路径可以是相对路径,也可以是绝对路径。

     

         该方法得到当前节点的路径。该方法返回的是完整的绝对路径

     

         该方法得到当前节点。

    3.3、Element类

    getQName()

    元素的QName对象

    getNamespace()

    元素所属的Namespace对象

    getNamespacePrefix()

    元素所属的Namespace对象的prefix

    getNamespaceURI()

    元素所属的Namespace对象的URI

    getName()

    元素的local name

    getQualifiedName()

    元素的qualified name

    getText()

    元素所含有的text内容,如果内容为空则返回一个空字符串而不是null

    getTextTrim()

    元素所含有的text内容,其中连续的空格被转化为单个空格,该方法不会返回null

    attributeIterator()

    元素属性的iterator,其中每个元素都是Attribute对象

    attributeValue()

    元素的某个指定属性所含的值

    elementIterator()

    元素的子元素的iterator,其中每个元素都是Element对象

    element()

    元素的某个指定(qualified name或者local name)的子元素

    elementText()

    元素的某个指定(qualified name或者local name)的子元素中的text信息

    getParent

    元素的父元素

    getPath()

    元素的XPath表达式,其中父元素的qualified name和子元素的qualified name之间使用"/"分隔

    isTextOnly()

    是否该元素只含有text或是空元素

    isRootElement()

    是否该元素是XML树的根节点

     

    3.4、类DocumentHelper 

    DocumentHelper 是用来生成生成 XML 文档的工厂类

    4、通过xpath查找指定的节点

           采用xpath查找需要引入jaxen-xx-xx.jar,否则会报java.lang.NoClassDefFoundError: org/jaxen/JaxenException异常。

    
      List list=document.selectNodes("/books/book/@show");

     

    4.1、 xpath语法

    1、选取节点

    XPath 使用路径表达式在 XML 文档中选取节点,节点是沿着路径或者 step 来选取的。

    常见的路径表达式:

    表达式

    描述

    nodename

    选取当前节点的所有子节点

    /

    从根节点选取

    //

    从匹配选择的当前节点选择文档中的节点,而不考虑它们的位置

    .

    选取当前节点

    ..

    选取当前节点的父节点

    @

    选取属性

    实例

    路径表达式

    结果

    bookstore

    选取 bookstore 元素的所有子节点

    /bookstore

    选取根元素 bookstore

    bookstore/book

    选取bookstore 下名字为 book的所有子元素

    //book

    选取所有 book 子元素,而不管它们在文档中的位置。

    bookstore//book

    选取bookstore 下名字为 book的所有后代元素,而不管它们位于 bookstore 之下的什么位置。

    //@lang

    选取所有名为 lang 的属性。

    2、谓语(Predicates)

    谓语用来查找某个特定的节点或者包含某个指定的值的节点。

    谓语被嵌在方括号中。

    实例

    常见的谓语的一些路径表达式:

    路径表达式

    结果

    /bookstore/book[1]

    选取属于 bookstore 子元素的第一个 book 元素。

    /bookstore/book[last()]

    选取属于 bookstore 子元素的最后一个 book 元素。

    /bookstore/book[last()-1]

    选取属于 bookstore 子元素的倒数第二个 book 元素。

    /bookstore/book[position()<3]

    选取最前面的两个属于 bookstore 元素的子元素的 book 元素。

    //title[@lang]

    选取所有拥有名为 lang 的属性的 title 元素。

    //title[@lang='eng']

    选取所有 title 元素,要求这些元素拥有值为 eng 的 lang 属性。

    /bookstore/book[price>35.00]

    选取所有 bookstore 元素的 book 元素,要求book元素的子元素 price 元素的值须大于 35.00。

    /bookstore/book[price>35.00]/title

    选取所有 bookstore 元素中的 book 元素的 title 元素,要求book元素的子元素 price 元素的值须大于 35.00

    3、选取未知节点

    XPath 通配符可用来选取未知的 XML 元素。

    通配符

    描述

    *

    匹配任何元素节点

    @*

    匹配任何属性节点

    node()

    匹配任何类型的节点

    实例

    路径表达式

    结果

    /bookstore/*

    选取 bookstore 元素的所有子节点

    //*

    选取文档中的所有元素

    //title[@*]

    选取所有带有属性的 title 元素。

    4、选取若干路径

    通过在路径表达式中使用“|”运算符,您可以选取若干个路径。

    实例

    路径表达式

    结果

    //book/title | //book/price

    选取所有 book 元素的 title 和 price 元素。

    //title | //price

    选取所有文档中的 title 和 price 元素。

    /bookstore/book/title|//price

    选取所有属于 bookstore 元素的 book 元素的title 元素,以及文档中所有的 price 元素。

     

    5、XPath 轴

    轴可定义某个相对于当前节点的节点集。

    轴名称

    结果

    ancestor

    选取当前节点的所有先辈(父、祖父等)

    ancestor-or-self

    选取当前节点的所有先辈(父、祖父等)以及当前节点本身

    attribute

    选取当前节点的所有属性

    child

    选取当前节点的所有子元素。

    descendant

    选取当前节点的所有后代元素(子、孙等)。

    descendant-or-self

    选取当前节点的所有后代元素(子、孙等)以及当前节点本身。

    following

    选取文档中当前节点的结束标签之后的所有节点。

    namespace

    选取当前节点的所有命名空间节点

    parent

    选取当前节点的父节点。

    preceding

    选取文档中当前节点的开始标签之前的所有节点。

    preceding-sibling

    选取当前节点之前的所有同级节点。

    self

    选取当前节点。

    6、路径

     

    位置路径可以是绝对的,也可以是相对的。

    绝对路径起始于正斜杠( / ),而相对路径不会这样。在两种情况中,位置路径均包括一个或多个步,每个步均被斜杠分割:

     

    /step/step/...

     

    step/step/...

    每个步均根据当前节点集之中的节点来进行计算。

     

    轴(axis):定义所选节点与当前节点之间的树关系

    节点测试(node-test):识别某个轴内部的节点

    零个或者更多谓语(predicate):更深入地提炼所选的节点集

    步的语法轴名称::节点测试[谓语]

    实例

    例子

    结果

    child::book

    选取所有属于当前节点的子元素的 book 节点

    attribute::lang

    选取当前节点的 lang 属性

    child::*

    选取当前节点的所有子元素

    attribute::*

    选取当前节点的所有属性

    child::text()

    选取当前节点的所有文本子节点

    child::node()

    选取当前节点的所有子节点

    descendant::book

    选取当前节点的所有 book 后代

    ancestor::book

    选择当前节点的所有 book 先辈

    ancestor-or-self::book

    选取当前节点的所有book先辈以及当前节点(假如此节点是book节点的话)

    child::*/child::price

    选取当前节点的所有 price 孙。

     

    7、XPath 运算符

    运算符

    描述

    实例

    返回值

    |

    计算两个节点集

    //book | //cd

    返回所有带有 book 和 ck 元素的节点集

    +

    加法

    6 + 4

    10

    -

    减法

    6 - 4

    2

    *

    乘法

    6 * 4

    24

    div

    除法

    8 div 4

    2

    =

    等于

    price=9.80

    如果 price 是 9.80,则返回 true。

    如果 price 是 9.90,则返回 fasle。

    !=

    不等于

    price!=9.80

    如果 price 是 9.90,则返回 true。

    如果 price 是 9.80,则返回 fasle。

    小于

    price<9.80

    如果 price 是 9.00,则返回 true。

    如果 price 是 9.90,则返回 fasle。

    <=

    小于或等于

    price<=9.80

    如果 price 是 9.00,则返回 true。

    如果 price 是 9.90,则返回 fasle。

    大于

    price>9.80

    如果 price 是 9.90,则返回 true。

    如果 price 是 9.80,则返回 fasle。

    >=

    大于或等于

    price>=9.80

    如果 price 是 9.90,则返回 true。

    如果 price 是 9.70,则返回 fasle。

    or

    price=9.80 or price=9.70

    如果 price 是 9.80,则返回 true。

    如果 price 是 9.50,则返回 fasle。

    and

    price>9.00 and price<9.90

    如果 price 是 9.80,则返回 true。

    如果 price 是 8.50,则返回 fasle。

    mod

    计算除法的余数

    5 mod 2

    1

    展开全文
  • JAVA核心知识点--使用Dom4j解析XML

    万次阅读 2017-08-09 10:28:23
    一、Dom4j简介 二、文件下载 三、在Java中使用Dom4j解析XML 创建Document对象 操作节点对象 操作节点对象的属性 保存Document对象到XML文件 字符串与XML转换 一、Dom4j简介 dom4j是一个Java的XML API,是...

    目录

    一、Dom4j简介

    二、文件下载

    三、在Java中使用Dom4j解析XML

    创建Document对象

    操作节点对象

    操作节点对象的属性

    保存Document对象到XML文件

    字符串与XML转换


    一、Dom4j简介

    dom4j是一个Java的XML API,是jdom的升级品,用来读写XML文件的。dom4j是一个十分优秀的JavaXML API,具有性能优异、功能强大和极其易使用的特点,它的性能超过sun公司官方的dom技术,同时它也是一个开放源代码的软件,可以在SourceForge上找到它。在IBM developerWorks上面还可以找到一篇文章,对主流的Java XML API进行的性能、功能和易用性的评测,所以可以知道dom4j无论在哪个方面都是非常出色的。如今可以看到越来越多的Java软件都在使用dom4j来读写XML,特别值得一提的是连Sun的JAXM也在用dom4j。这已经是必须使用的jar包, Hibernate也用它来读写配置文件。 

    二、文件下载

    官网地址:http://www.dom4j.org/dom4j-1.6.1/  

    三、在Java中使用Dom4j解析XML

    创建Document对象

    在DOM4j中,Document对象就代表了整个XML文档,其内部将XML的数据信息以Dom4j树的形式进行储存。

    我们可以通过以下三种方式来获得Document对象:  

            // 读取XML文件,获得document对象
            SAXReader saxReader = new SAXReader();
            Document document1 = saxReader.read(new File("D:\\dom4j\\dom.xml"));
    
            // 解析XML形式的字符串,得到document对象.
            String xmlText = "<response><result>1</result><desc>保存成功</desc></response>";
            Document document2 = DocumentHelper.parseText(xmlText);
            
            //主动创建document对象
            Document document3 =DocumentHelper.createDocument(DocumentHelper.createElement("root").addAttribute("id", "1"));
            System.out.println(document3.getRootElement().attributeValue("id")); //打印结果:1

    操作节点对象

    在DOM4j中,使用Element对象来表示Dom4j树中的各个节点,Element对象可以包含有属性、文本内容、命名空间、子节点等内容。

    我们通过以对一个名为“dom.xml”的XML文件的操作为例,来对DOM4j节点操作的常用方法进行简要示范,该“dom.xml”的内容如下:  

    <?xml version="1.0" encoding="utf-8"?>
    <response>
    <result>1</result>
    <errorDesc>无错误信息</errorDesc>
    <errorCode>E000</errorCode>
    <assignIds>
    	<assignId>TEST106608821</assignId>
    	<assignId>TEST106608822</assignId>
    	<assignId>TEST106608823</assignId>
    </assignIds>
    </response>
    

    通过Java代码来操作DOM4j的节点对象,其完整代码如下。

    import java.io.FileOutputStream;
    import java.io.IOException;
    import java.io.OutputStreamWriter;
    import java.util.Iterator;
    import java.util.List;
    
    import org.dom4j.Document;
    import org.dom4j.DocumentException;
    import org.dom4j.Element;
    import org.dom4j.io.SAXReader;
    import org.dom4j.io.XMLWriter;
    
    public class HelloDom4j
    {
    
        @SuppressWarnings("unchecked")
        public static void main(String[] args) throws DocumentException, IOException
        {
            SAXReader saxReader = new SAXReader();
            Document document = saxReader.read("D:\\dom4j\\dom.xml");
    
            // 获取Document对象的根节点
            Element root = document.getRootElement();
            System.out.println(root.getName());
    
            // 取得根节点下的"assignIds"子节点
            Element assignIds = root.element("assignIds");
            System.out.println(assignIds.getName());
    
            // 取得"assignIds"节点下所有名为"assignId"的子节点,并进行遍历
            List<Element> elements = assignIds.elements("assignId");
            Iterator<Element> it = elements.iterator();
            while (it.hasNext())
            {
                Element element = it.next();
                // 打印节点的文本内容
                System.out.println(element.getText());
            }
    
            // 在"assignIds"节点下再添加一个"assignId"子节点
            Element element = assignIds.addElement("assignId");
    
            // 设置新节点的文本内容
            element.setText("TEST106608824");
    
            // 删除"assignIds"节点下第一个名为"assignId"的子节点
            Element firstAssingId = assignIds.element("assignId");
            assignIds.remove(firstAssingId);
    
            // 添加一个CDATA节点
            Element cddataElement = root.addElement("content");
            cddataElement.addCDATA("我是CDATA的内容!");
    
            // 将Document对象内容保存到XML文件
            XMLWriter xmlWriter = new XMLWriter(new OutputStreamWriter(new FileOutputStream("D:\\dom4j\\dom4j_dom.xml"), "UTF-8"));
            xmlWriter.write(document);
            xmlWriter.close();
        }
    
    }

    程序执行完毕之后,在计算机“D:\dom4j”目录下会自动创建一个名为“dom4j_dom.xml”的XML文件,其内容如下:  

    <?xml version="1.0" encoding="UTF-8"?>
    <response>
    <result>1</result>
    <errorDesc>无错误信息</errorDesc>
    <errorCode>E000</errorCode>
    <assignIds>
    	<assignId>TEST106608822</assignId>
    	<assignId>TEST106608823</assignId>
    	<assignId>TEST106608824</assignId>
    </assignIds>
    <content><![CDATA[我是CDATA的内容!]]></content>
    </response>

    操作节点对象的属性

    我们还是通过对一个XML文件的实际操作为例,来对DOM4j节点对象的属性操作的常用方法进行简要示范。在计算机“D:\dom4j”目录下有一个名为“attribute.xml”的XML文件,其内容如下: 

    <?xml version="1.0" encoding="utf-8"?>
    <Request service='OrderSearchService' lang='zh-CN'>
    	<Head name='head'>Hello Dom4j</Head>
    	<Body name='body' class="content">
    		<OrderSearch name='orderSearch' orderid='2019586321'/>
    	</Body>
    </Request>
    

    通过Java代码来操作DOM4j节点对象的属性,其完整代码如下。

    import java.io.FileWriter;
    import java.io.IOException;
    import java.util.Iterator;
    
    import org.dom4j.Attribute;
    import org.dom4j.Document;
    import org.dom4j.DocumentException;
    import org.dom4j.Element;
    import org.dom4j.io.SAXReader;
    import org.dom4j.io.XMLWriter;
    
    public class HelloDom4j
    {
    
        @SuppressWarnings("unchecked")
        public static void main(String[] args) throws DocumentException, IOException
        {
            SAXReader saxReader = new SAXReader();
            Document document = saxReader.read("D:\\dom4j\\attribute.xml");
    
            // 获取根节点
            Element root = document.getRootElement();
            System.out.println(root.getName()); // 打印结果:Request
    
            // 获取根节点的"service"属性
            Attribute attribute = root.attribute("service");
    
            // 获取并打印属性的值
            System.out.println(attribute.getText()); // 打印结果:OrderSearchService
            System.out.println(attribute.getData()); // 打印结果:OrderSearchService
            System.out.println(attribute.getValue()); // 打印结果:OrderSearchService
    
            // 删除根节点的"lang"属性
            Attribute lang = root.attribute("lang");
            System.out.println(lang.getData()); // 打印结果:zh-CN
            root.remove(attribute);
    
            // 为根节点添加"id"属性,并设置值为"request"
            root.addAttribute("id", "request");
    
            // 获取"Head"节点
            Element head = root.element("Head");
    
            // 修改"Head"节点的"name"属性值为"dom4j"
            Attribute nameAttr = head.attribute("name");
            System.out.println(nameAttr.getData());// 打印结果:head
            nameAttr.setValue("dom4j");
            System.out.println(nameAttr.getData());// 打印结果:dom4j
    
            // 获取"OrderSearch"节点
            Element orderSearch = root.element("Body").element("OrderSearch");
    
            // 遍历"OrderSearch"节点的所有属性
            Iterator<Attribute> it = orderSearch.attributeIterator();
            while (it.hasNext())
            {
                Attribute attr = it.next();
                System.out.println(attr.getText()); // 打印结果:orderSearch 2019586321
            }
    
            // 将Document对象内容保存到XML文件
            XMLWriter xmlWriter = new XMLWriter(new FileWriter("D:\\dom4j\\dom4j_attribute.xml"));
            xmlWriter.write(document);
            xmlWriter.close();
    
        }
    
    }

    程序执行完毕之后,在计算机“D:\dom4j”目录下会自动创建一个名为“dom4j_attribute.xml”的XML文件,其内容如下:

    <?xml version="1.0" encoding="UTF-8"?>
    <Request lang="zh-CN" id="request">
    	<Head name="dom4j">Hello Dom4j</Head>
    	<Body name="body" class="content">
    		<OrderSearch name="orderSearch" orderid="2019586321"/>
    	</Body>
    </Request>
    

    保存Document对象到XML文件

    // 无需设置字符集编码
            XMLWriter xmlWriter = new XMLWriter(new FileWriter("D:\\dom4j\\dom4j_attribute.xml"));
            xmlWriter.write(document);
            xmlWriter.close();
    
    // 需要设置字符集编码
            OutputFormat format=OutputFormat.createPrettyPrint(); //createPrettyPrint()自动缩进,createCompactFormat()自动压缩
            format.setEncoding("UTF-8");
    
            XMLWriter xmlWriter = new XMLWriter(new FileWriter("D:\\dom4j\\dom4j_attribute.xml"),format);
            xmlWriter.write(document);
            xmlWriter.close();
    

    字符串与XML转换

    我们继续以前例中的“attribute.xml”文件为例,对其进行转换示范。

    import org.dom4j.Document;
    import org.dom4j.DocumentException;
    import org.dom4j.DocumentHelper;
    import org.dom4j.Element;
    import org.dom4j.io.SAXReader;
    
    public class HelloDom4j
    {
    
        public static void main(String[] args) throws DocumentException
        {
            // 将XML转换为字符串
            SAXReader saxReader = new SAXReader();
            Document document = saxReader.read("D:\\dom4j\\attribute.xml");
    
            String documentStr = document.asXML();
            System.out.println(documentStr);
            /*
             * 打印结果:
             * <?xml version="1.0" encoding="utf-8"?>
             * <Request service="OrderSearchService" lang="zh-CN">
             * <Head name="head">Hello Dom4j</Head>
             * <Body name="body" class="content">
             *      <OrderSearch name="orderSearch" orderid="2019586321"/>
             * </Body>
             * </Request>
             */
    
            Element root = document.getRootElement();
    
            String rootStr = root.asXML();
            System.out.println(rootStr);
            /*
             * 打印结果:
             * <Request service="OrderSearchService" lang="zh-CN">
             * <Head name="head">Hello Dom4j</Head>
             * <Body name="body" class="content">
             *      <OrderSearch name="orderSearch" orderid="2019586321"/>
             * </Body>
             * </Request>
             */
    
            // 将字符串转换为XML
            String xmlStr = "<Head name='head'>Hello Dom4j</Head>";
            Document xmlDoc = DocumentHelper.parseText(xmlStr);
        }
    
    }

     

    展开全文
  • dom4j-1.6.1.jar (dom4j) 欢迎下载

    千次下载 热门讨论 2007-05-01 04:01:10
    dom4j-1.6.1.jar,Dom4j是一个Java的XML API接口,是jdom的进化版,dom4j基本用来读写xml文件,是一个十分优秀的JavaXML API接口
  • Java dom4j 操作Xml

    2018-12-26 10:27:14
    // 读Xml文件 Document document=null; try { SAXReader reader = new SAXReader(); document = reader.read(new File(filePath)); } catch (DocumentException e) { e.printStackTrace(...
            // 读Xml文件
            Document document=null;
    		try {
    			SAXReader reader = new SAXReader();
    			document = reader.read(new File(filePath));
    		} catch (DocumentException e) {
    			e.printStackTrace();
    		}
    		
    		if(document == null){
    			return;
    		}
    		
    		Element root = document.getRootElement();
    		Iterator rootIterator=root.elementIterator();
    		while (rootIterator.hasNext()) {
    			Element nextElement = (Element) rootIterator.next();
    			String nextElementName = nextElement.getName();
    			// 各元素同一属性
    			String a = nextElement.attributeValue("a");
    		}
    		
    		// 元素内容
    		root.element("A").getText();

    相关Jar包:

    dom4j-2.1.0

    Json+XML+Excel+DBFile相关的Jar包及关键操作代码:
    https://download.csdn.net/download/haoranhaoshi/10889219

    展开全文
  • Dom4j完整教程

    2020-01-16 14:35:40
    1、DOM4J简介 2、XML文档操作1 2.1、读取XML文档: 2.2、获取根节点 2.3、新增一个节点以及其下的子节点与数据 2.4、写入XML文件 2. 5、 遍历xml节点 2.6、创建xml文件 2.7、修改节点属性 2.8、删除节点 3...

    目录

    1、DOM4J简介

    2、XML文档操作1

    2.1、读取XML文档:

    2.2、获取根节点

    2.3、新增一个节点以及其下的子节点与数据

    2.4、 写入XML文件

    2. 5、 遍历xml节点

    2.6、创建xml文件

    2.7、修改节点属性

    2.8、删除节点

    3、XML文档操作2

    3.1、Document对象相关        

    1、读取XML文件,获得document对象.    

    2、解析XML形式的文本,得到document对象.      

    3、主动创建document对象.      

    3.2、节点相关        

    1、获取文档的根节点.      

    2、取得某节点的单个子节点.      

    3.取得节点的文字      

         4.取得某节点下指定名称的所有节点并进行遍历.      

    5.对某节点下的所有子节点进行遍历.   

    6.在某节点下添加子节点.      

    7.设置节点文字.      

     8.删除某节点.      

    9.添加一个CDATA节点.      

    3.3、属性相关.    

     1.取得节点的指定的属性      

    2.取得属性的文字      

    3.遍历某节点的所有属性      

    4.设置某节点的属性和文字.      

    5.设置属性的文字      

     6.删除某属性      

          3.4、将文档写入XML文件.   

      1.文档中全为英文,不设置编码,直接写入.      

    2.文档中含有中文,设置编码格式再写入.   

    3.5、字符串与XML的转换 

         1.将字符串转化为XML      

    2.将文档或节点的XML转化为字符串.  

    4、dom4j的事件处理模型涉及的类和接口:

    4.1、类:SAXReader

    4.2、接口ElementHandler

    4.3、接口:ElementPath (假设有参数:ElementPath path)

    4.3、Element类

    4.4、类DocumentHelper 

    5、通过xpath查找指定的节点

    5.1、 xpath语法

    1、选取节点

    2、谓语(Predicates)

    3、选取未知节点

    4、选取若干路径

    5、XPath 轴

    7、XPath 运算符


     

    1、DOM4J简介


        DOM4J是 dom4j.org 出品的一个开源 XML 解析包。DOM4J应用于 Java 平台,采用了 Java 集合框架并完全支持 DOM,SAX 和 JAXP。

        DOM4J 使用起来非常简单。只要你了解基本的 XML-DOM 模型,就能使用。

        Dom:把整个文档作为一个对象。

      DOM4J 最大的特色是使用大量的接口。它的主要接口都在org.dom4j里面定义:

    Attribute 定义了 XML 的属性。
    Branch 指能够包含子节点的节点。如XML元素(Element)和文档(Docuemnts)定义了一个公共的行为
    CDATA 定义了 XML CDATA 区域
    CharacterData 是一个标识接口,标识基于字符的节点。如CDATA,Comment, Text.

    Comment

    定义了 XML 注释的行为

    Document

    定义了XML 文档

    DocumentType

    定义 XML DOCTYPE 声明

    Element

    定义XML 元素

    ElementHandler

    定义了Element 对象的处理器

    ElementPath

     ElementHandler 使用,用于取得当前正在处理的路径层次信息

    Entity

    定义 XML entity

    Node

    dom4j中所有的XML节点定义了多态行为

    NodeFilter

    定义了在dom4j 节点中产生的一个滤镜或谓词的行为(predicate

    ProcessingInstruction

    定义 XML 处理指令

    Text

    定义 XML 文本节点

    Visitor

    用于实现 Visitor模式

    XPath

    在分析一个字符串后会提供一个 XPath 表达式

    接口之间的继承关系如下:

    interface java.lang.Cloneable

        interface org.dom4j.Node

               interface org.dom4j.Attribute

               interface org.dom4j.Branch

                      interface org.dom4j.Document

                      interface org.dom4j.Element

               interface org.dom4j.CharacterData

                      interface org.dom4j.CDATA

                      interface org.dom4j.Comment

                      interface org.dom4j.Text

               interface org.dom4j.DocumentType

               interface org.dom4j.Entity

               interface org.dom4j.ProcessingInstruction

    2XML文档操作1

    2.1、读取XML文档:

         读写XML文档主要依赖于org.dom4j.io包,有DOMReaderSAXReader两种方式。因为利用了相同的接口,它们的调用方式是一样的。

    public static Document load(String filename) {
    	Document document = null;
    	try {
    		SAXReader saxReader = new SAXReader();
    		document = saxReader.read(new File(filename)); // 读取XML文件,获得document对象
    	} catch (Exception ex) {
    		ex.printStackTrace();
    	}
    	return document;
    }
    
    public static Document load(URL url) {
    	Document document = null;
    	try {
    		SAXReader saxReader = new SAXReader();
    		document = saxReader.read(url); // 读取XML文件,获得document对象
    	} catch (Exception ex) {
    		ex.printStackTrace();
    	}
    	return document;
    }

    //读取指定的xml文件之后返回一个Document对象,这个对象代表了整个XML文档,用于各种Dom运算。执照XML文件头所定义的编码来转换。

    2.2、获取根节点

    根节点是xml分析的开始,任何xml分析工作都需要从根开始

    Xml xml = new Xml();
    
    Document dom = xml.load(path + "/" + file);
    
    Element root = dom.getRootElement();

    2.3、新增一个节点以及其下的子节点与数据

    Element menuElement = root.addElement("menu");
    
    Element engNameElement = menuElement.addElement("engName");
    
    engNameElement.setText(catNameEn);
    
    Element chiNameElement = menuElement.addElement("chiName");
    
    chiNameElement.setText(catName);

    2.4、 写入XML文件

    注意文件操作的包装类是乱码的根源

    public static boolean doc2XmlFile(Document document, String filename) {
    	boolean flag = true;
    	try {
    		XMLWriter writer = new XMLWriter(new OutputStreamWriter(new FileOutputStream(filename), "UTF-8"));
    		writer.write(document);
    		writer.close();
    	} catch (Exception ex) {
    		flag = false;
    		ex.printStackTrace();
    	}
    	System.out.println(flag);
    	return flag;
    }

    Dom4j通过XMLWriter将Document对象表示的XML树写入指定的文件,并使用OutputFormat格式对象指定写入的风格和编码方法。调用OutputFormat.createPrettyPrint()方法可以获得一个默认的pretty print风格的格式对象。对OutputFormat对象调用setEncoding()方法可以指定XML文件的编码方法。

    public void writeTo(OutputStream out, String encoding) throws UnsupportedEncodingException, IOException {
    	OutputFormat format = OutputFormat.createPrettyPrint();
    	format.setEncoding("gb2312");
    	XMLWriter writer = new XMLWriter(System.out, format);
    	writer.write(doc);
    	writer.flush();
    	return;
    }

    2. 5、 遍历xml节点


           对Document对象调用getRootElement()方法可以返回代表根节点的Element对象。拥有了一个Element对象后,可以对该对象调用elementIterator()方法获得它的子节点的Element对象们的一个迭代器。使用(Element)iterator.next()方法遍历一个iterator并把每个取出的元素转化为Element类型。

    public boolean isOnly(String catNameEn, HttpServletRequest request, String xml) {
    	boolean flag = true;
    	String path = request.getRealPath("");
    	Document doc = load(path + "/" + xml);
    	Element root = doc.getRootElement();
    	for (Iterator i = root.elementIterator(); i.hasNext();) {
    		Element el = (Element) i.next();
    		if (catNameEn.equals(el.elementTextTrim("engName"))) {
    			flag = false;
    			break;
    		}
    	}
    	return flag;
    }

    2.6、创建xml文件

    public static void main(String args[]) {
    	String fileName = "c:/text.xml";
    	Document document = DocumentHelper.createDocument();// 建立document对象,用来操作xml文件
    	Element booksElement = document.addElement("books");// 建立根节点
    	booksElement.addComment("This is a test for dom4j ");// 加入一行注释
    	Element bookElement = booksElement.addElement("book");// 添加一个book节点
    	bookElement.addAttribute("show", "yes");// 添加属性内容
    	Element titleElement = bookElement.addElement("title");// 添加文本节点
    	titleElement.setText("ajax in action");// 添加文本内容
    
    	try {
    		XMLWriter writer = new XMLWriter(new FileWriter(new File(fileName)));
            writer.write(document);
    		writer.close();
    	} catch (Exception e) {
    		e.printStackTrace();
    	}
    }

    2.7、修改节点属性

    public static void modifyXMLFile() {
        String oldStr = "c:/text.xml";
        String newStr = "c:/text1.xml";
        Document document = null;
        //修改节点的属性
        try {
            SAXReader saxReader = new SAXReader(); // 用来读取xml文档
            document = saxReader.read(new File(oldStr)); // 读取xml文档
            List list = document.selectNodes("/books/book/@show");// 用xpath查找节点book的属性
            Iterator iter = list.iterator();
            while (iter.hasNext()) {
                Attribute attribute = (Attribute) iter.next();
                if (attribute.getValue().equals("yes"))
                    attribute.setValue("no");
            }
        } catch (Exception e) {
            e.printStackTrace();
        }
    
        //修改节点的内容
        try {
            SAXReader saxReader = new SAXReader(); // 用来读取xml文档
            document = saxReader.read(new File(oldStr)); // 读取xml文档
            List list = document.selectNodes("/books/book/title");// 用xpath查找节点book的内容
            Iterator iter = list.iterator();
            while (iter.hasNext()) {
                Element element = (Element) iter.next();
                element.setText("xxx");// 设置相应的内容
            }
        } catch (Exception e) {
            e.printStackTrace();
        }
    
        try {
            XMLWriter writer = new XMLWriter(new FileWriter(new File(newStr)));
            writer.write(document);
            writer.close();
        } catch (Exception ex) {
            ex.printStackTrace();
        }
    }

    2.8、删除节点

    public static void removeNode() {
    	String oldStr = "c:/text.xml";
    	String newStr = "c:/text1.xml";
    	Document document = null;
    	try {
    		SAXReader saxReader = new SAXReader();// 用来读取xml文档
    		document = saxReader.read(new File(oldStr));// 读取xml文档
    		List list = document.selectNodes("/books/book");// 用xpath查找对象
    		Iterator iter = list.iterator();
    		while (iter.hasNext()) {
    			Element bookElement = (Element) iter.next();
    			// 创建迭代器,用来查找要删除的节点,迭代器相当于指针,指向book下所有的title节点
    			Iterator iterator = bookElement.elementIterator("title");
    			while (iterator.hasNext()) {
    				Element titleElement = (Element) iterator.next();
    				if (titleElement.getText().equals("ajax in action")) {
    					bookElement.remove(titleElement);
    				}
    			}
    		}
    	} catch (Exception e) {
    		e.printStackTrace();
    	}
    
    	try {
    		XMLWriter writer = new XMLWriter(new FileWriter(new File(newStr)));
    		writer.write(document);
    		writer.close();
    	} catch (Exception ex) {
    		ex.printStackTrace();
    	}
    }

    3、XML文档操作2


    3.1、Document对象相关        


    1、读取XML文件,获得document对象.    

     
           SAXReader reader = new SAXReader();  
          Document   document = reader.read(new File("input.xml"));      


    2、解析XML形式的文本,得到document对象.      


                 String text = "<members></members>";      
                 Document document = DocumentHelper.parseText(text);      


    3、主动创建document对象.      


                 Document document = DocumentHelper.createDocument();      
                 Element root = document.addElement("members");// 创建根节点      


    3.2、节点相关        


    1、获取文档的根节点.      


    Element rootElm = document.getRootElement();      


    2、取得某节点的单个子节点.      


    Element memberElm=root.element("member");// "member"是节点名      


    3.取得节点的文字      


    String text=memberElm.getText();     
    String text=root.elementText("name");这个是取得根节点下的name字节点的文字.  

         
    4.取得某节点下指定名称的所有节点并进行遍历.      


    List nodes = rootElm.elements("member");      
    for (Iterator it = nodes.iterator(); it.hasNext();) {      
        Element elm = (Element) it.next();      
       // do something      
    }      


    5.对某节点下的所有子节点进行遍历.   

       
                for(Iterator it=root.elementIterator();it.hasNext();){      
                     Element element = (Element) it.next();      
                    // do something      
                 }      


    6.在某节点下添加子节点.      


    Element ageElm = newMemberElm.addElement("age");      


    7.设置节点文字.      


    ageElm.setText("29");     

     
    8.删除某节点.      


    parentElm.remove(childElm);    // childElm是待删除的节点,parentElm是其父节点      


    9.添加一个CDATA节点.      


             Element contentElm = infoElm.addElement("content");      
             contentElm.addCDATA(diary.getContent()); 


    3.3、属性相关.    

     
    1.取得节点的指定的属性      


                 Element root=document.getRootElement();          
                 Attribute attribute=root.attribute("size");    // 属性名name      


    2.取得属性的文字      


        String text=attribute.getText();    
    String text2=root.element("name").attributeValue("firstname");
    //这个是取得根节点下name字节点的firstname属性的值.      


    3.遍历某节点的所有属性      


    Element root=document.getRootElement();
    for(Iterator it=root.attributeIterator();it.hasNext();){
    Attribute attribute = (Attribute) it.next();
    String text=attribute.getText();
    System.out.println(text);
    }


    4.设置某节点的属性和文字.      


    newMemberElm.addAttribute("name", "sitinspring");    


    5.设置属性的文字      


                 Attribute attribute=root.attribute("name");      
                 attribute.setText("sitinspring");     

     
    6.删除某属性      


                 Attribute attribute=root.attribute("size");// 属性名name      
                 root.remove(attribute);

          
    3.4、将文档写入XML文件.   

      
    1.文档中全为英文,不设置编码,直接写入.      


    XMLWriter writer = new XMLWriter(new FileWriter("output.xml"));      
    writer.write(document);      
    writer.close();      


    2.文档中含有中文,设置编码格式再写入.   

      
    OutputFormat format = OutputFormat.createPrettyPrint();
    format.setEncoding("GBK");    // 指定XML编码
    XMLWriter writer = new XMLWriter(new FileWriter("output.xml"),format);
    writer.write(document);
    writer.close();


    3.5、字符串与XML的转换 

         
    1.将字符串转化为XML      


    String text = "<members> <member>sitinspring</member> </members>";      
    Document document = DocumentHelper.parseText(text);   


    2.将文档或节点的XML转化为字符串.  

    SAXReader reader = new SAXReader();
    Document document = reader.read(new File("input.xml"));
    Element root=document.getRootElement();
    String docXmlText=document.asXML();
    String rootXmlText=root.asXML();
    Element memberElm=root.element("member");
    String memberXmlText=memberElm.asXML();

    4、dom4j的事件处理模型涉及的类和接口:


    4.1、类:SAXReader

         当解析到path指定的路径时,将调用参数handler指定的处理器。针对不同的节点可以添加多个handler实例。或者调用默认的Handler setDefaultHandler(ElementHandler handler);

    4.2、接口ElementHandler

         该方法在解析到元素的开始标签时被调用。

         该方法在解析到元素的结束标签时被调用

    4.3、接口:ElementPath (假设有参数:ElementPath path)

         该方法与SAXReader类中的addHandler()方法的作用相同。路径path可以是绝对路径(路径以/开头),也可以是相对路径(假设是当前路径的子节点路径)。

         移除指定路径上的ElementHandler实例。路径可以是相对路径,也可以是绝对路径。

         该方法得到当前节点的路径。该方法返回的是完整的绝对路径

         该方法得到当前节点。


    4.3、Element类

    getQName()

    元素的QName对象

    getNamespace()

    元素所属的Namespace对象

    getNamespacePrefix()

    元素所属的Namespace对象的prefix

    getNamespaceURI()

    元素所属的Namespace对象的URI

    getName()

    元素的local name

    getQualifiedName()

    元素的qualified name

    getText()

    元素所含有的text内容,如果内容为空则返回一个空字符串而不是null

    getTextTrim() 元素所含有的text内容,其中连续的空格被转化为单个空格,该方法不会返回null

    attributeIterator()

    元素属性的iterator,其中每个元素都是Attribute对象

    attributeValue()

    元素的某个指定属性所含的值

    elementIterator()

    元素的子元素的iterator,其中每个元素都是Element对象

    element()

    元素的某个指定(qualified name或者local name)的子元素

    elementText()

    元素的某个指定(qualified name或者local name)的子元素中的text信息

    getParent

    元素的父元素

    getPath()

    元素的XPath表达式,其中父元素的qualified name和子元素的qualified name之间使用"/"分隔

    isTextOnly()

    是否该元素只含有text或是空元素

    isRootElement()

    是否该元素是XML树的根节点

    4.4、类DocumentHelper 


    DocumentHelper 是用来生成生成 XML 文档的工厂类

    5、通过xpath查找指定的节点


     采用xpath查找需要引入jaxen-xx-xx.jar,否则会报java.lang.NoClassDefFoundError: org/jaxen/JaxenException异常。

      List list=document.selectNodes("/books/book/@show");

    5.1、 xpath语法


    1、选取节点


    XPath 使用路径表达式在 XML 文档中选取节点,节点是沿着路径或者 step 来选取的。

    常见的路径表达式:

    表达式

    描述

    nodename

    选取当前节点的所有子节点

    /

    从根节点选取

    //

    从匹配选择的当前节点选择文档中的节点,而不考虑它们的位置

    .

    选取当前节点

    ..

    选取当前节点的父节点

    @

    选取属性

     实例

    路径表达式

    结果

    bookstore

    选取 bookstore 元素的所有子节点

    /bookstore

       选取根元素 bookstore

    bookstore/book

    选取bookstore 下名字为 book的所有元素

    //book

    选取所有 book 子元素,而不管它们在文档中的位置。

    bookstore//book

    选取bookstore 下名字为 book的所有后代元素,而不管它们位于 bookstore 之下的什么位置。

    //@lang

    选取所有名为 lang 的属性。

    2、谓语(Predicates

    谓语用来查找某个特定的节点或者包含某个指定的值的节点。

    谓语被嵌在方括号中。

    实例

    常见的谓语的一些路径表达式:

    路径表达式

    结果

    /bookstore/book[1]

    选取属于 bookstore 子元素的第一个 book 元素。

    /bookstore/book[last()]

    选取属于 bookstore 子元素的最后一个 book 元素。

    /bookstore/book[last()-1]

    选取属于 bookstore 子元素的倒数第二个 book 元素。

    /bookstore/book[position()<3]

    选取最前面的两个属于 bookstore 元素的子元素的 book 元素。

    //title[@lang]

    选取所有拥有名为 lang 的属性的 title 元素。

    //title[@lang='eng']

    选取所有 title 元素,要求这些元素拥有值为 eng  lang 属性。

    /bookstore/book[price>35.00]

    选取所有 bookstore 元素的 book 元素,要求book元素的子元素 price 元素的值须大于 35.00

    /bookstore/book[price>35.00]/title

    选取所有 bookstore 元素中的 book 元素的 title 元素,要求book元素的子元素 price 元素的值须大于 35.00

    3、选取未知节点

    XPath 通配符可用来选取未知的 XML 元素。

    通配符

    描述

    *

    匹配任何元素节点

    @*

    匹配任何属性节点

    node()

    匹配任何类型的节点

    实例

    路径表达式

    结果

    /bookstore/*

    选取 bookstore 元素的所有子节点

    //*

    选取文档中的所有元素

    //title[@*]

    选取所有带有属性的 title 元素。

    4、选取若干路径

    通过在路径表达式中使用|运算符,您可以选取若干个路径。

    实例

    路径表达式

    结果

    //book/title | //book/price

    选取所有 book 元素的 title  price 元素。

    //title | //price

    选取所有文档中的 title  price 元素。

    /bookstore/book/title|//price

    选取所有属于 bookstore 元素的 book 元素的 title 元素,以及文档中所有的 price 元素。

    5XPath 

    轴可定义某个相对于当前节点的节点集。

    轴名称

    结果

    ancestor

    选取当前节点的所有先辈(父、祖父等)

    ancestor-or-self

    选取当前节点的所有先辈(父、祖父等)以及当前节点本身

    attribute

    选取当前节点的所有属性

    child

    选取当前节点的所有子元素。

    descendant

    选取当前节点的所有后代元素(子、孙等)。

    descendant-or-self

    选取当前节点的所有后代元素(子、孙等)以及当前节点本身。

    following

    选取文档中当前节点的结束标签之后的所有节点。

    namespace

    选取当前节点的所有命名空间节点

    parent

    选取当前节点的父节点。

    preceding

    选取文档中当前节点的开始标签之前的所有节点。

    preceding-sibling

    选取当前节点之前的所有同级节点。

    self

    选取当前节点。

    6、路径
     

    位置路径可以是绝对的,也可以是相对的。

    绝对路径起始于正斜杠( / ),而相对路径不会这样。在两种情况中,位置路径均包括一个或多个步,每个步均被斜杠分割:

     

    /step/step/...
     

    step/step/...
    每个步均根据当前节点集之中的节点来进行计算。

     

    轴(axis):定义所选节点与当前节点之间的树关系

    节点测试(node-test):识别某个轴内部的节点

    零个或者更多谓语(predicate):更深入地提炼所选的节点集

    步的语法:轴名称::节点测试[谓语]

    实例

    例子

    结果

    child::book

    选取所有属于当前节点的子元素的 book 节点

    attribute::lang

    选取当前节点的 lang 属性

    child::*

    选取当前节点的所有子元素

    attribute::*

    选取当前节点的所有属性

    child::text()

    选取当前节点的所有文本子节点

    child::node()

    选取当前节点的所有子节点

    descendant::book

    选取当前节点的所有 book 后代

    ancestor::book

    选择当前节点的所有 book 先辈

    ancestor-or-self::book

    选取当前节点的所有book先辈以及当前节点(假如此节点是book节点的话)

    child::*/child::price

    选取当前节点的所有 price 孙。

    7、XPath 运算符

    运算符

    描述

    实例

    返回值

    |

    计算两个节点集

    //book | //cd

    返回所有带有 book  ck 元素的节点集

    +

    加法

    6 + 4

    10

    -

    减法

    6 - 4

    2

    *

    乘法

    6 * 4

    24

    div

    除法

    8 div 4

    2

    =

    等于

    price=9.80

    如果 price  9.80,则返回 true

    如果 price  9.90,则返回 fasle

    !=

    不等于

    price!=9.80

    如果 price  9.90,则返回 true

    如果 price  9.80,则返回 fasle

    小于

    price<9.80

    如果 price  9.00,则返回 true

    如果 price  9.90,则返回 fasle

    <=

    小于或等于

    price<=9.80

    如果 price  9.00,则返回 true

    如果 price  9.90,则返回 fasle

    大于

    price>9.80

    如果 price  9.90,则返回 true

    如果 price  9.80,则返回 fasle

    >=

    大于或等于

    price>=9.80

    如果 price  9.90,则返回 true

    如果 price  9.70,则返回 fasle

    or

    price=9.80 or price=9.70

    如果 price  9.80,则返回 true

    如果 price  9.50,则返回 fasle

    and

    price>9.00 and price<9.90

    如果 price  9.80,则返回 true

    如果 price  8.50,则返回 fasle

    mod

    计算除法的余数

    5 mod 2

    1

    展开全文
  • 【转】Dom4j的使用(全而好的文章)

    万次阅读 2018-04-17 15:29:53
    Dom4j 使用简介 作者:冰云 icecloud(AT)sina.com 时间:2003.12.15 DOM4Jdom4j.org出品的一个开源XML解析包,它的网站中这样定义: Dom4j is an easy to use, open source library for working with XML, ...
  • dom4j

    2019-02-18 09:12:37
    https://blog.csdn.net/redarmy_chen/article/details/12969219 https://blog.csdn.net/yz357823669/article/details/79106732 https://www.cnblogs.com/hongwz/p/5514786.html
  • DOM4J

    2019-06-11 14:22:00
    DOM4J 1.DOM4J解析XML public class TestXml { public static void main(String[] args) throws Exception { //创建SAXReader对象,用于读取xml文件 SAXReader reader = ne...
  • Java dom4j生成和解析XML

    万次阅读 2018-08-18 23:20:30
    dom4j 使用:需先导入dom4j对应的jar,本章用的是dom4j-1.6.1.jar 优点:DOM4J使Java开发的灵活性和XML解析代码易于维护 dom4j相关操作类 Document:表示整个xml文档,是一个树形结构 Eelment:表示一个xml的...
  • 使用Dom4j解析XML

    万次阅读 多人点赞 2013-10-23 12:06:26
    dom4j是一个Java的XML API,类似于jdom,用来读写XML文件的。dom4j是一个非常非常优秀的Java XML API,具有性能优异、功能强大和极端易用使用的特点,同时它也是一个开放源代码的软件,可以在SourceForge上找到它. ...
  • Dom4j完整教程

    万次阅读 多人点赞 2011-03-17 00:48:00
    整理了下Dom4j的相关知识点.比较系统.目录1、DOM4J简介... 12、XML文档操作1. 2 2.1、读取XML文档:... 2 2.2、获取根节点... 3 2.3、. 新增一个节点以及其下的子节点与数据... 3 2.4、写入XML文件... 3 2. 5、...
  • dom4j 官方绿色完整jar包

    万次下载 热门讨论 2011-03-15 23:21:49
    dom4j完整jar包 下载 包括 dom4j-1.6.1.rar jaxen-1.1-beta-7.rar sitemesh-2.2.1.rar
  • DOMDOM4J的区别

    千次阅读 2018-08-24 20:12:33
    学习了DOMDOM4J以后,想总结出来这二者之间的区别,却发现自己说不上来二者之间的差距,有的理解,有的不理解,想来想去,还是转载一下别人总结的,自己再深刻体会之后再写总结吧。不多说,先表明转载原文链接: ...
  • Dom4j基本使用

    千次阅读 2018-05-06 00:29:53
    Dom4j基本使用2.1概述Dom4j是一个简单、灵活的开放源代码的库。Dom4j是由早期开发JDOM的人分离出来而后独立开发的。与JDOM不同的是,dom4j使用接口和抽象基类,虽然Dom4j的API相对要复杂一些,但它提供了比JDOM更好...
  • dom4j中文API

    万次阅读 2017-11-18 09:18:36
    dom4j中文API
  • DOM4J的用法

    万次阅读 多人点赞 2017-09-13 20:12:51
    一、基本使用方式  语法  1、获取根元素 Element root = document.getRootElement();  2、获取某个元素下的子元素 ...Element db_element = root.element("... db_list = db_element.eleme...
  • dom4j教程

    2007-07-25 23:25:31
    我在做项目的时候,要解析XML就用DOM4J只可惜没有好的教程,现在有了,特意分享给大家,希望一起学习快乐!!!
  • Dom4j是一个简单、灵活的开放源代码的库。Dom4j是由早期开发JDOM的人分离出来而后独立开发的。与JDOM不同的是,dom4j使用接口和抽象基类,虽然Dom4j的API相对要复杂一些,但它提供了比JDOM更好的灵活性。  Dom4j是...
  • 使用场景:最近参与了一个写三方接口的项目,期间学了一些小知识,记录一下。 一、XML和JSON两种数据交换格式的比较 ...格式统一,跨平台和语言,早已成为业界公认的标准。相比之JSON这种 轻量级...

空空如也

1 2 3 4 5 ... 20
收藏数 103,430
精华内容 41,372
关键字:

dom4j