如何使用 PHP 的 DOMDocument 和 XPath 从 HTML 中提取特定文本？-php教程-PHP中文网

首页

后端开发

php教程

如何使用 PHP 的 DOMDocument 和 XPath 从 HTML 中提取特定文本？

DDD

Nov 01, 2024 pm 01:00 PM

How do I extract specific text from HTML using PHP's DOMDocument and XPath?

使用 PHP 的 DOMDocument 解析 HTML

要使用 PHP 的 DOMDocument 从 HTML 中提取特定文本元素，利用 XPath 查询比单独依赖更有效在 DOMDocument::getElementsByTagName 上。 XPath 查询允许根据文档结构中的特定条件进行精确选择。

从嵌套 DIV 中捕获文本

提供的示例 HTML 包含嵌套

。标签，其中目标文本位于

内具有“text”类的元素，这些元素又嵌套在

中。

要捕获目标文本，可以使用 XPath 查询：

<code class="php">$xpath->query('//div[@class="main"]/div[@class="text"]');</code>

此查询选择所有

元素。类属性设置为“text”并且是

的后代的元素类属性设置为“main”的元素。结果是匹配元素的列表。

迭代和提取节点值

要访问实际的文本内容，可以迭代每个匹配元素及其节点值访问的属性：

<code class="php">foreach ($tags as $tag) {
    var_dump(trim($tag->nodeValue));
}</code>

trim() 函数用于从提取的文本中删除任何前导或尾随空格。

执行输出

执行代码将输出以下内容：

string 'Capture this text 1' (length=19)
string 'Capture this text 2' (length=19)

以上是如何使用 PHP 的 DOMDocument 和 XPath 从 HTML 中提取特定文本？的详细内容。更多信息请关注PHP中文网其他相关文章！

声明

本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

PHP和Python：解释了不同的范例Apr 18, 2025 am 12:26 AM

PHP主要是过程式编程，但也支持面向对象编程（OOP）；Python支持多种范式，包括OOP、函数式和过程式编程。PHP适合web开发，Python适用于多种应用，如数据分析和机器学习。

PHP和Python：深入了解他们的历史Apr 18, 2025 am 12:25 AM

PHP起源于1994年，由RasmusLerdorf开发，最初用于跟踪网站访问者，逐渐演变为服务器端脚本语言，广泛应用于网页开发。Python由GuidovanRossum于1980年代末开发，1991年首次发布，强调代码可读性和简洁性，适用于科学计算、数据分析等领域。

在PHP和Python之间进行选择：指南Apr 18, 2025 am 12:24 AM

PHP适合网页开发和快速原型开发，Python适用于数据科学和机器学习。1.PHP用于动态网页开发，语法简单，适合快速开发。2.Python语法简洁，适用于多领域，库生态系统强大。

PHP和框架：现代化语言Apr 18, 2025 am 12:14 AM

PHP在现代化进程中仍然重要，因为它支持大量网站和应用，并通过框架适应开发需求。1.PHP7提升了性能并引入了新功能。2.现代框架如Laravel、Symfony和CodeIgniter简化开发，提高代码质量。3.性能优化和最佳实践进一步提升应用效率。

PHP的影响：网络开发及以后Apr 18, 2025 am 12:10 AM

PHPhassignificantlyimpactedwebdevelopmentandextendsbeyondit.1)ItpowersmajorplatformslikeWordPressandexcelsindatabaseinteractions.2)PHP'sadaptabilityallowsittoscaleforlargeapplicationsusingframeworkslikeLaravel.3)Beyondweb,PHPisusedincommand-linescrip

PHP类型提示如何起作用，包括标量类型，返回类型，联合类型和无效类型？Apr 17, 2025 am 12:25 AM

PHP类型提示提升代码质量和可读性。1)标量类型提示：自PHP7.0起，允许在函数参数中指定基本数据类型，如int、float等。2)返回类型提示：确保函数返回值类型的一致性。3)联合类型提示：自PHP8.0起，允许在函数参数或返回值中指定多个类型。4)可空类型提示：允许包含null值，处理可能返回空值的函数。