简化PHP DOM XML解析-怎么做?

简化PHP DOM XML解析-怎么做?,第1张

简化PHP DOM XML解析-怎么做?

解决问题1:

的W3C定义:
属性的含义

xml:id
如在XML文档的ID属性定义处理该属性来识别在没有确认的ID的,没有获取的外部资源,并且不依赖于内部子集。

换句话说,当您使用

$element->setAttribute('xml:id', 'test');

您无需调用

setIdAttribute
,也无需指定DTD或Schema。与DOM一起
xml:id
使用时,DOM可以识别该属性,
getElementById
而无需验证文档或其他任何内容。这是最省力的方法。但是请注意,根据您的 *** 作系统和libxml版本,您
getElementById
根本无法使用。

解决问题2:

即使无法使用来获取ID

getElementById
,您仍然可以使用XPath来获取它们:

$xpath->query('/pages/page[@id=1]');

肯定会工作。您还可以直接为特定页面获取产品子级:

$xpath->query('//pages/page[@id=1]/products');

除此之外,几乎没有什么可以使DOM代码看起来不太冗长,因为它确实是一个冗长的接口。由于DOM是语言不可知的接口,因此必须由W3C再次定义。


在下面的评论后编辑

就像我上面解释的那样。这是一个完整的测试用例。第一部分是使用DOM 编写
新的XML文件。那是您需要设置

xml:id
属性的地方。您可以使用它代替常规的非命名空间的id属性。

// Setup$dom = new DOMdocument;$dom->formatOutput = TRUE;$dom->preserveWhiteSpace = FALSE;$dom->loadXML('<pages/>');// How to set a valid id attribute when not using a DTD or Schema$page1 = $dom->createElement('page');$page1->setAttribute('xml:id', 'p1');$page1->appendChild($dom->createElement('product', 'foo1'));$page1->appendChild($dom->createElement('product', 'foo2'));// How to set an ID attribute that requires a DTD or Schema when reloaded$page2 = $dom->createElement('page');$page2->setAttribute('id', 'p2');$page2->setIdAttribute('id', TRUE);$page2->appendChild($dom->createElement('product', 'bar1'));$page2->appendChild($dom->createElement('product', 'bar2'));// Appending pages and saving XML$dom->documentElement->appendChild($page1);$dom->documentElement->appendChild($page2);$xml = $dom->saveXML();unset($dom, $page1, $page2);echo $xml;

这将创建一个XML文件,如下所示:

<?xml version="1.0"?><pages>  <page xml:id="p1">    <product>foo1</product>    <product>foo2</product>  </page>  <page id="p2">    <product>bar1</product>    <product>bar2</product>  </page></pages>

当您再次 读取
XML时,新的DOM实例不再知道您已使用声明了非命名空间

id
属性为ID属性
setIdAttribute
。它仍将保留在XML中,但id属性将只是常规属性。您必须注意,ID属性在XML中是特殊的。

// Load the XML we created above$dom = new DOMdocument;$dom->loadXML($xml);

现在进行一些测试:

echo "nn GETELEMENTBYID RETURNS ELEMENT WITH XML:ID nn";foreach( $dom->getElementById('p1')->childNodes as $product) {    echo $product->nodevalue; // Will output foo1 and foo2 with whitespace}

上面的方法有效,因为与DOM兼容的解析器必须识别

xml:id
出ID属性,而不管任何DTD或Schema。在上面链接的规范中对此进行了解释。它输出空白的原因是由于格式化输出,在开始标记,两个产品标记和结束标记之间存在DOMText节点,因此我们要遍历五个节点。节点概念对于理解使用XML至关重要。

echo "nn GETELEMENTBYID CANNOT FETCH NORMAL ID nn";foreach( $dom->getElementById('p2')->childNodes as $product) {    echo $product->nodevalue; // Will output a NOTICE and a WARNING}

上面的方法不起作用,因为

id
它不是ID属性。为了使DOM解析器能够识别出它,您需要DTD或Schema,并且必须针对它验证XML。

echo "nn XPATH CAN FETCH NORMAL ID nn";$xPath = new DOMXPath($dom);$page2 = $xPath->query('/pages/page[@id="p2"]')->item(0);foreach( $page2->childNodes as $product) {    echo $product->nodevalue; // Will output bar1 and bar2}

另一方面,XPath是关于属性的文字,这意味着您可以在DOM中查询具有属性的页面元素(

id
如果
getElementById
不可用)。请注意,要查询ID为p1的页面,您必须包含名称空间,例如
@xml:id="p1"

echo "nn XPATH CAN FETCH PRODUCTS FOR PAGE WITH ID nn";$xPath = new DOMXPath($dom);foreach( $xPath->query('/pages/page[@id="p2"]/product') as $product ) {    echo $product->nodevalue; // Will output bar1 and bar2 wout whitespace}

就像说的那样,您还可以使用XPath查询文档中的其他任何内容。这个不会输出空格,因为它只会返回

product
ID为p2的页面下方的元素。

您还可以从节点遍历整个DOM。这是一个树状结构。由于DOMNode是DOM中最重要的类,因此您需要熟悉它。

echo "nn TRAVERSING UP AND DOWN nn";$product = $dom->getElementsByTagName('product')->item(2);echo $product->tagName; // 'product'echo $dom->saveXML($product); // '<product>bar1</product>'// Going from bar1 to foo1$product = $product->parentNode // Page Node        ->parentNode // Pages Node        ->childNodes->item(1)  // Page p1        ->childNodes->item(1); // 1st Productecho $product->nodevalue; // 'foo1'// from foo1 to foo2 it is two(!) nodes because the XML is formattedecho $product->nextSibling->nodeName; // '#text' with whitespace and linebreakecho $product->nextSibling->nextSibling->nodeName; // 'product'echo $product->nextSibling->nextSibling->nodevalue; // 'foo2'

在一个旁注中,是的,我在上面的原始代码中确实有一个错字。这是

product
不是
products
。但是我发现当您只需要更改一个代码时,声称该代码不起作用几乎是没有道理的
s
。那简直太像想被喂饱了。



欢迎分享,转载请注明来源:内存溢出

原文地址: http://outofmemory.cn/zaji/5441387.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2022-12-11
下一篇 2022-12-11

发表评论

登录后才能评论

评论列表(0条)

保存