我有一个字符串形式的完整 XML 文档,并且想要一个Document
目的。谷歌会发现各种各样的垃圾。最简单的解决方案是什么? (在Java 1.5中)
Solution谢谢马特·麦克明,我已经决定了这个实现。它对我来说具有适当的输入灵活性和异常粒度。 (很高兴知道错误是否来自格式错误的 XML -SAXException
- 或者只是糟糕的 IO -IOException
.)
public static org.w3c.dom.Document loadXMLFrom(String xml)
throws org.xml.sax.SAXException, java.io.IOException {
return loadXMLFrom(new java.io.ByteArrayInputStream(xml.getBytes()));
}
public static org.w3c.dom.Document loadXMLFrom(java.io.InputStream is)
throws org.xml.sax.SAXException, java.io.IOException {
javax.xml.parsers.DocumentBuilderFactory factory =
javax.xml.parsers.DocumentBuilderFactory.newInstance();
factory.setNamespaceAware(true);
javax.xml.parsers.DocumentBuilder builder = null;
try {
builder = factory.newDocumentBuilder();
}
catch (javax.xml.parsers.ParserConfigurationException ex) {
}
org.w3c.dom.Document doc = builder.parse(is);
is.close();
return doc;
}
哇那儿!
这段代码存在一个潜在的严重问题,因为它忽略了在String
(默认为 UTF-8)。你打电话时String.getBytes()
平台默认编码用于将 Unicode 字符编码为字节。因此,解析器可能认为它正在获取 UTF-8 数据,而实际上它正在获取 EBCDIC 或其他数据……这不太好!
相反,请使用采用 InputSource 的 parse 方法,该方法可以使用 Reader 构造,如下所示:
import java.io.StringReader;
import org.xml.sax.InputSource;
…
return builder.parse(new InputSource(new StringReader(xml)));
这看起来似乎没什么大不了的,但对字符编码问题的无知会导致类似于 2000 年后的阴险代码腐烂。
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系:hwhale#tublm.com(使用前将#替换为@)