如何从一个string中加载XML中的org.w3c.dom.Document?

我有一个完整的XML文档在一个string,并希望一个Document对象。 谷歌变成各种垃圾。 什么是最简单的解决scheme? (在Java 1.5中)

解决scheme感谢Matt McMinn ,我已经解决了这个问题。 它对我来说具有正确的input灵活性和exception粒度。 (很好地知道错误是否来自格式错误的XML – SAXException – 或只是错误的IO – IOException 。)

 public static org.w3c.dom.Document loadXMLFrom(String xml) throws org.xml.sax.SAXException, java.io.IOException { return loadXMLFrom(new java.io.ByteArrayInputStream(xml.getBytes())); } public static org.w3c.dom.Document loadXMLFrom(java.io.InputStream is) throws org.xml.sax.SAXException, java.io.IOException { javax.xml.parsers.DocumentBuilderFactory factory = javax.xml.parsers.DocumentBuilderFactory.newInstance(); factory.setNamespaceAware(true); javax.xml.parsers.DocumentBuilder builder = null; try { builder = factory.newDocumentBuilder(); } catch (javax.xml.parsers.ParserConfigurationException ex) { } org.w3c.dom.Document doc = builder.parse(is); is.close(); return doc; } 

4 Solutions collect form web for “如何从一个string中加载XML中的org.w3c.dom.Document?”

这在Java 1.5中适用于我 – 为了可读性,我除去了特定的exception。

 import javax.xml.parsers.DocumentBuilderFactory; import javax.xml.parsers.DocumentBuilder; import org.w3c.dom.Document; import java.io.ByteArrayInputStream; public Document loadXMLFromString(String xml) throws Exception { DocumentBuilderFactory factory = DocumentBuilderFactory.newInstance(); factory.setNamespaceAware(true); DocumentBuilder builder = factory.newDocumentBuilder(); return builder.parse(new ByteArrayInputStream(xml.getBytes())); } 

哇!

这个代码有一个潜在的严重问题,因为它忽略了String指定的字符编码(默认是UTF-8)。 当您调用String.getBytes() ,平台默认编码用于将Unicode字符编码为字节。 所以,parsing器可能会认为它正在获取UTF-8数据,而事实上它正在获取EBCDIC或者其他什么东西。

相反,使用带有一个InputSource的parsing方法,该方法可以使用Reader来构build,如下所示:

 import java.io.StringReader; import org.xml.sax.InputSource; … return builder.parse(new InputSource(new StringReader(xml))); 

这似乎不是什么大不了的事情,但是对字符编码问题的无知导致了阴险的代码与y2k类似。

只是有一个类似的问题,除了我需要一个NodeList而不是一个文档,这是我想出了。 它与以前大部分是相同的解决scheme,增加了根元素作为一个NodeList,并使用埃里克森的build议,而不是使用InputSource字符编码问题。

 private String DOC_ROOT="root"; String xml=getXmlString(); Document xmlDoc=loadXMLFrom(xml); Element template=xmlDoc.getDocumentElement(); NodeList nodes=xmlDoc.getElementsByTagName(DOC_ROOT); public static Document loadXMLFrom(String xml) throws Exception { InputSource is= new InputSource(new StringReader(xml)); DocumentBuilderFactory factory = DocumentBuilderFactory.newInstance(); factory.setNamespaceAware(true); DocumentBuilder builder = null; builder = factory.newDocumentBuilder(); Document doc = builder.parse(is); return doc; } 

为了在Java中操作XML,我总是倾向于使用Transformer API:

 import javax.xml.transform.Source; import javax.xml.transform.TransformerException; import javax.xml.transform.TransformerFactory; import javax.xml.transform.dom.DOMResult; import javax.xml.transform.stream.StreamSource; public static Document loadXMLFrom(String xml) throws TransformerException { Source source = new StreamSource(new StringReader(xml)); DOMResult result = new DOMResult(); TransformerFactory.newInstance().newTransformer().transform(source , result); return (Document) result.getNode(); } 
  • XPath获取没有父节点的所有子节点(元素,注释和文本)
  • Xml或Sqlite,何时删除数据库的Xml?
  • 如何读取用户上传的文件,而不保存到数据库
  • 如何查看由PHP SOAP客户机类生成的实际XML?
  • 从SQL Server 2008中的XML字段中select值
  • 将Xml转换为表SQL Server
  • 移动和消失的代码行; Eclipse的XML编辑器出现问题
  • 如何在Notepad ++中自动格式化/缩进XML / HTML
  • 如何控制.NET DataContract序列化,以便使用XML属性而不是元素?
  • 什么是最好的方式来将Java对象转换为XML与开放源码API
  • PHP SimpleXML:在某个位置插入节点