本人小白,想通过百度邮编搜索截取一个地址的邮编,在自己的网站空间里放了个php脚本。
因为要求不是很高,试图通过正则匹配找到第一组“首位不为0的六位数字”,作为结果输出,但是不管怎么尝试,得到的始终是一个空数组……
正则表达式是我从网上找的,也是过不同的形式,但是始终都得不到任何值
<code><?php $final_url = 'http://opendata.baidu.com/post/s?wd=%C9%BD%B6%AB%CA%A1%BC%C3%C4%CF%CA%D0%C0%FA%CF%C2%C7%F8&p=mini&rn=20'; $search_result = file_get_contents($final_url); $clear_result = strip_tags($search_result); echo mb_detect_encoding($search_result); echo("</br>"); echo($clear_result); echo(""); $zipcodes = search_for_zipcodes($clear_result); print_r($zipcodes); function search_for_zipcodes($test) { $rule = '/^[1-9]\d{5}$/'; preg_match_all($rule,$test,$result); return $result; } ?> </code>
mb_detect_encoding($search_result)
,写这一句是想看看返回回来的页面的编码,但是这个函数似乎也得不到任何结果……
如果漏洞百出烦请诸位大神耐心指教,本人真的是小白一只……
回复内容:
本人小白,想通过百度邮编搜索截取一个地址的邮编,在自己的网站空间里放了个php脚本。
因为要求不是很高,试图通过正则匹配找到第一组“首位不为0的六位数字”,作为结果输出,但是不管怎么尝试,得到的始终是一个空数组……
正则表达式是我从网上找的,也是过不同的形式,但是始终都得不到任何值
<code><?php $final_url = 'http://opendata.baidu.com/post/s?wd=%C9%BD%B6%AB%CA%A1%BC%C3%C4%CF%CA%D0%C0%FA%CF%C2%C7%F8&p=mini&rn=20'; $search_result = file_get_contents($final_url); $clear_result = strip_tags($search_result); echo mb_detect_encoding($search_result); echo("</br>"); echo($clear_result); echo(""); $zipcodes = search_for_zipcodes($clear_result); print_r($zipcodes); function search_for_zipcodes($test) { $rule = '/^[1-9]\d{5}$/'; preg_match_all($rule,$test,$result); return $result; } ?> </code>
mb_detect_encoding($search_result)
,写这一句是想看看返回回来的页面的编码,但是这个函数似乎也得不到任何结果……
如果漏洞百出烦请诸位大神耐心指教,本人真的是小白一只……
题主啊, 你好.
我觉得, 你这个任务, 用不到正则.
为什么呢?
请看里面的搜索结果是什么?
<code> <table class="table-list" cellspacing="0"> <tr> <th class="head-postcode">邮编</th> <th class="head-region">行政区域</th> </tr> <tr> <td>250102</td> <td> <em>山东省</em> <em>济南市</em> <em>历下区</em> 经十路双号2218-5150</td> </tr> <tr> <td>250102</td> <td> <em>山东省</em> <em>济南市</em> <em>历下区</em> 经十东路双号33188-33688</td> </tr> <tr> <td>250102</td> <td> <em>山东省</em> <em>济南市</em> <em>历下区</em> 经十路单号177-3799</td> </tr> <tr> <td>250102</td> <td> <em>山东省</em> <em>济南市</em> <em>历下区</em> 旅游路港沟水利站机关公寓</td> </tr> </table> </code>
好完整的结果, 这已经是一个列表了.
因为具体还没有看, 一会我来告诉你怎么处理.我先php试一下.
<code> <?php //有单独邮编的网址 $url = 'http://opendata.baidu.com/post/s?wd=%C9%BD%CE%F7&p=mini&rn=20'; // 没有单独邮编的网址 //$url= 'http://opendata.baidu.com/post/s?wd=%C9%BD%B6%AB%CA%A1%BC%C3%C4%CF%CA%D0%C0%FA%CF%C2%C7%F8%C6%BD%B0%B2%BA%FA%CD%AC&p=mini&rn=20'; // xpath 解析文档 $dom = new DOMDocument; libxml_use_internal_errors(TRUE); $dom->loadHTMLFile($url); libxml_clear_errors(); $xPath = new DOMXPath($dom); //起作用的语句 $trs = $xPath->query('//li/a/text()|//tr/td'); //输出结果 foreach($trs as $tr) { $str= $tr->nodeValue; if(strlen($str)>6){ $str = array_pop( explode(' ', $str)); } echo $str; break; } ?> </code>
http://phpfiddle.org/
你去phpfiddle 试一下吧, 还行. 做这种工作, xpath方便点.
<code><?php $final_url = 'http://opendata.baidu.com/post/s?wd=%C9%BD%B6%AB%CA%A1%BC%C3%C4%CF%CA%D0%C0%FA%CF%C2%C7%F8&p=mini&rn=20'; $search_result = file_get_contents($final_url); $search_result = iconv('gbk', 'utf-8', $search_result); preg_match_all("@<td>(\d+)<td>(.*?)</td>@is", $search_result, $match); $area = array_map("strip_tags", $match[2]); print_r($match[1]); print_r($area); </code>
把$rule = '/^[1-9]d{5}$/';换成
$rule = '/[1-9]d{5}/';试试
因为,你用了strip_tags.所以,很多内容,都直接合并成“一行”了。再用^,$应该是匹配不到的

使用数据库存储会话的主要优势包括持久性、可扩展性和安全性。1.持久性:即使服务器重启,会话数据也能保持不变。2.可扩展性:适用于分布式系统,确保会话数据在多服务器间同步。3.安全性:数据库提供加密存储,保护敏感信息。

在PHP中实现自定义会话处理可以通过实现SessionHandlerInterface接口来完成。具体步骤包括:1)创建实现SessionHandlerInterface的类,如CustomSessionHandler;2)重写接口中的方法(如open,close,read,write,destroy,gc)来定义会话数据的生命周期和存储方式;3)在PHP脚本中注册自定义会话处理器并启动会话。这样可以将数据存储在MySQL、Redis等介质中,提升性能、安全性和可扩展性。

SessionID是网络应用程序中用来跟踪用户会话状态的机制。1.它是一个随机生成的字符串,用于在用户与服务器之间的多次交互中保持用户的身份信息。2.服务器生成并通过cookie或URL参数发送给客户端,帮助在用户的多次请求中识别和关联这些请求。3.生成通常使用随机算法保证唯一性和不可预测性。4.在实际开发中,可以使用内存数据库如Redis来存储session数据,提升性能和安全性。

在无状态环境如API中管理会话可以通过使用JWT或cookies来实现。1.JWT适合无状态和可扩展性,但大数据时体积大。2.Cookies更传统且易实现,但需谨慎配置以确保安全性。

要保护应用免受与会话相关的XSS攻击,需采取以下措施:1.设置HttpOnly和Secure标志保护会话cookie。2.对所有用户输入进行输出编码。3.实施内容安全策略(CSP)限制脚本来源。通过这些策略,可以有效防护会话相关的XSS攻击,确保用户数据安全。

优化PHP会话性能的方法包括:1.延迟会话启动,2.使用数据库存储会话,3.压缩会话数据,4.管理会话生命周期,5.实现会话共享。这些策略能显着提升应用在高并发环境下的效率。

thesession.gc_maxlifetimesettinginphpdeterminesthelifespanofsessiondata,setInSeconds.1)它'sconfiguredinphp.iniorviaini_set().2)abalanceIsiseededeedeedeedeedeedeedto to to avoidperformance andununununununexpectedLogOgouts.3)

在PHP中,可以使用session_name()函数配置会话名称。具体步骤如下:1.使用session_name()函数设置会话名称,例如session_name("my_session")。2.在设置会话名称后,调用session_start()启动会话。配置会话名称可以避免多应用间的会话数据冲突,并增强安全性,但需注意会话名称的唯一性、安全性、长度和设置时机。


热AI工具

Undresser.AI Undress
人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover
用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool
免费脱衣服图片

Clothoff.io
AI脱衣机

Video Face Swap
使用我们完全免费的人工智能换脸工具轻松在任何视频中换脸!

热门文章

热工具

SublimeText3 英文版
推荐:为Win版本,支持代码提示!

记事本++7.3.1
好用且免费的代码编辑器

SublimeText3汉化版
中文版,非常好用

mPDF
mPDF是一个PHP库,可以从UTF-8编码的HTML生成PDF文件。原作者Ian Back编写mPDF以从他的网站上“即时”输出PDF文件,并处理不同的语言。与原始脚本如HTML2FPDF相比,它的速度较慢,并且在使用Unicode字体时生成的文件较大,但支持CSS样式等,并进行了大量增强。支持几乎所有语言,包括RTL(阿拉伯语和希伯来语)和CJK(中日韩)。支持嵌套的块级元素(如P、DIV),

禅工作室 13.0.1
功能强大的PHP集成开发环境