php dom xml解析,简化PHP DOM XML解析-怎么做？

最新推荐文章于 2021-03-24 23:33:31 发布

风神有理

最新推荐文章于 2021-03-24 23:33:31 发布

阅读量115

点赞数

文章标签： php dom xml解析

小编典典

解决问题1：

的W3C定义：

该属性的含义xml:id如在XML文档的ID属性定义处理该属性来识别在没有确认的ID的，没有获取的外部资源，并且不依赖于内部子集。

换句话说，当您使用

$element->setAttribute('xml:id', 'test');

您无需调用setIdAttribute，也无需指定DTD或Schema。与DOM一起xml:id使用时，DOM可以识别该属性，getElementById而无需验证文档或其他任何内容。这是最省力的方法。但是请注意，根据您的操作系统和libxml版本，您getElementById根本无法使用。

解决问题2：

即使无法使用来获取ID getElementById，您仍然可以使用XPath来获取它们：

$xpath->query('/pages/page[@id=1]');

肯定会工作。您还可以直接为特定页面获取产品子级：

$xpath->query('//pages/page[@id=1]/products');

除此之外，几乎没有什么可以使DOM代码看起来不太冗长，因为它确实是一个冗长的接口。由于DOM是语言不可知的接口，因此必须由W3C再次定义。

在下面的评论后编辑

就像我上面解释的那样。这是一个完整的测试用例。第一部分是使用DOM 编写

新的XML文件。那是您需要设置xml:id属性的地方。您可以使用它代替常规的非命名空间的id属性。

// Setup

$dom = new DOMDocument;

$dom->formatOutput = TRUE;

$dom->preserveWhiteSpace = FALSE;

$dom->loadXML('');

// How to set a valid id attribute when not using a DTD or Schema

$page1 = $dom->createElement('page');

$page1->setAttribute('xml:id', 'p1');

$page1->appendChild($dom->createElement('product', 'foo1'));

$page1->appendChild($dom->createElement('product', 'foo2'));

// How to set an ID attribute that requires a DTD or Schema when reloaded

$page2 = $dom->createElement('page');

$page2->setAttribute('id', 'p2');

$page2->setIdAttribute('id', TRUE);

$page2->appendChild($dom->createElement('product', 'bar1'));

$page2->appendChild($dom->createElement('product', 'bar2'));

// Appending pages and saving XML

$dom->documentElement->appendChild($page1);

$dom->documentElement->appendChild($page2);

$xml = $dom->saveXML();

unset($dom, $page1, $page2);

echo $xml;

这将创建一个XML文件，如下所示：

foo1

foo2

bar1

bar2

当您再次读取

XML时，新的DOM实例不再知道您已使用声明了非命名空间id属性为ID属性setIdAttribute。它仍将保留在XML中，但id属性将只是常规属性。您必须注意，ID属性在XML中是特殊的。

// Load the XML we created above

$dom = new DOMDocument;

$dom->loadXML($xml);

现在进行一些测试：

echo "\n\n GETELEMENTBYID RETURNS ELEMENT WITH XML:ID \n\n";

foreach( $dom->getElementById('p1')->childNodes as $product) {

echo $product->nodeValue; // Will output foo1 and foo2 with whitespace

}

上面的方法有效，因为与DOM兼容的解析器必须识别xml:id出ID属性，而不管任何DTD或Schema。在上面链接的规范中对此进行了解释。它输出空白的原因是由于格式化输出，在开始标记，两个产品标记和结束标记之间存在DOMText节点，因此我们要遍历五个节点。节点概念对于理解使用XML至关重要。

echo "\n\n GETELEMENTBYID CANNOT FETCH NORMAL ID \n\n";

foreach( $dom->getElementById('p2')->childNodes as $product) {

echo $product->nodeValue; // Will output a NOTICE and a WARNING

}

上面的方法不起作用，因为id它不是ID属性。为了使DOM解析器能够识别出它，您需要DTD或Schema，并且必须针对它验证XML。

echo "\n\n XPATH CAN FETCH NORMAL ID \n\n";

$xPath = new DOMXPath($dom);

$page2 = $xPath->query('/pages/page[@id="p2"]')->item(0);

foreach( $page2->childNodes as $product) {

echo $product->nodeValue; // Will output bar1 and bar2

}

另一方面，XPath是关于属性的文字，这意味着您可以在DOM中查询具有属性的页面元素(id如果getElementById不可用)。请注意，要查询ID为p1的页面，您必须包含名称空间，例如@xml:id="p1"。

echo "\n\n XPATH CAN FETCH PRODUCTS FOR PAGE WITH ID \n\n";

$xPath = new DOMXPath($dom);

foreach( $xPath->query('/pages/page[@id="p2"]/product') as $product ) {

echo $product->nodeValue; // Will output bar1 and bar2 w\out whitespace

}

就像说的那样，您还可以使用XPath查询文档中的其他任何内容。这个不会输出空格，因为它只会返回productID为p2的页面下方的元素。

您还可以从节点遍历整个DOM。这是一个树状结构。由于DOMNode是DOM中最重要的类，因此您需要熟悉它。

echo "\n\n TRAVERSING UP AND DOWN \n\n";

$product = $dom->getElementsByTagName('product')->item(2);

echo $product->tagName; // 'product'

echo $dom->saveXML($product); // 'bar1'

// Going from bar1 to foo1

$product = $product->parentNode // Page Node

->parentNode // Pages Node

->childNodes->item(1) // Page p1

->childNodes->item(1); // 1st Product

echo $product->nodeValue; // 'foo1'

// from foo1 to foo2 it is two(!) nodes because the XML is formatted

echo $product->nextSibling->nodeName; // '#text' with whitespace and linebreak

echo $product->nextSibling->nextSibling->nodeName; // 'product'

echo $product->nextSibling->nextSibling->nodeValue; // 'foo2'

在一个旁注中，是的，我在上面的原始代码中确实有一个错字。这是product不是products。但是我发现当您只需要更改一个代码时，声称该代码不起作用几乎是没有道理的s。那简直太像想被喂饱了。

2020-05-26

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
php dom xml解析,简化PHP DOM XML解析-怎么做？

小编典典解决问题1：的W3C定义：该属性的含义xml:id如在XML文档的ID属性定义处理该属性来识别在没有确认的ID的，没有获取的外部资源，并且不依赖于内部子集。换句话说，当您使用$element->setAttribute('xml:id', 'test');您无需调用setIdAttribute，也无需指定DTD或Schema。与DOM一起xml:id使用时，DOM可以识别该属性，ge...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。