
本文介绍如何使用 PHP 的 DOMDocument 高效解析两列 HTML 表格(+ 每行一对),生成结构清晰的二维关联数组,避免按列遍历导致的错位问题。
本文介绍如何使用 php 的 domdocument 高效解析两列 html 表格(`
在处理 HTML 表格数据时,一个常见误区是分别提取所有
以下为推荐实现方案:
$htmlContent = '
| test1 | test1-1 |
|---|---|
| test2 | test2-2 |
输出结果为:
[
['name' => 'test1', 'value' => 'test1-1'],
['name' => 'test2', 'value' => 'test2-2']
]
✅ 关键优势:
-
语义准确:每行
天然封装一组逻辑数据,无需手动维护跨列索引; - 鲁棒性强:自动跳过无
或 的异常行; - 可扩展性好:若后续表格变为三列(如
name value unit ),只需在循环内添加对应字段即可。⚠️ 注意事项:
- DOMDocument::loadHTML() 在处理不规范 HTML 时可能抛出警告,建议配合 libxml_use_internal_errors(true) 抑制;
- getElementsByTagName() 返回的是 DOMNodeList,需用 ->item(0) 获取首个匹配节点,避免直接访问不存在的索引;
- 使用 trim() 清除文本节点前后空白符,提升数据整洁度。
该方法简洁、可靠,适用于绝大多数两列配置型或键值对型 HTML 表格的结构化解析场景。
- 鲁棒性强:自动跳过无
前端入门到VUE实战笔记:立即使用
在学习笔记中,你将探索 前端 的入门与实战技巧!











