pack、unpack自制二进制“数据库”,packunpack
引言
pack、unpack函数,如果没有接触过socket,这个可能会比较陌生,这两个函数在socket交互的作用是组包,将数据装进一个二进制字符串,和对二进制字符串中的数据进行解包,这个里面有好多种格式,具体的格式可以去查查官方的手册(或者等看完本篇文章之后,去调用接口查看),我这里主要用了pack(“N”,int),pack(“a”,str)以及他们两个对应的解包函数,N在手册中的解释是下面这个,占4个字节,大端方式(其实就是低位在前还是在后的问题)。a是对字符串进行打包,不够指定的数值的时候用NULL(\0,或者说assic码0对应的字符)填充。
<p>N - unsigned long (always 32 bit, big endian byte order)</p>
<p>a - NUL-padded string</p>
我将用这个打包解包函数做一个函数手册查询小工具,或者可以说是一个自制小型二进制数据库。
设计数据格式
在做这个二进制文件数据库的时候我会创建两个文件,一个是索引文件,一个是要查询的数据的文件,分别看看他们的结构:
说明中括号内的数字为所占字节(bytes)数,"~"波浪线表示所占字节数不确定
数据文件,第一个php是一个正式的字符串"php",占4个字节,后面跟着版本说明,长度不确定(这个长度可以从后面的index文件中获取),接下来后面是存储信息的主体了。首先是一个函数名长度lenName占4个字节,接下来是函数名称,长度不确定,有前面的lenName对应的值确定,接下来是lenVal占4个字节,后面跟的是具体的函数说明内容,长度有前面的lenVal对应的值确定。
<pre class="code"><span> 内容存储格式定义 </span>++++++++++++++++++++++++++++++++++++++ |php(<span>4</span>) |版本说明(~) | ++++++++++++++++++++++++++++++++++++++ |lenName(<span>4</span>) |函数名称(~) | ++++++++++++++++++++++++++++++++++++++ |lenVal(<span>4</span>) |函数内容(~) | ++++++++++++++++++++++++++++++++++++++<span> ......</span>
索引文件,索引文件就比较简单了,其中全部存储了上面的存储文件中每个函数开始的指针位置,每个位置占用4个字节。
<pre class="code"><span>索引格式定义 </span>++++++++++++++++++++++++++++++++++++++ |position(<span>4</span>) | ++++++++++++++++++++++++++++++++++++++<span> ......</span>
查询的实现
由于存储文件中的内容是按照函数名顺序排序存储的,索引也是按照函数存储的顺序存储的,所以获取起来很方便,直接使用二分法就可以很轻松的获取到想要的函数
在查询的时候主要使用了下面几个方法:
第一、从制定位置获取一条索引的值(也就是对应的函数存储文件的指针位置)
<pre class="code"><span>/*</span><span>* * 从索引文件中获取一条记录的位置 * @param 索引文件中的开始位置,从开始位置获取四个字节为一个函数说明的开始位置 * @return 返回该索引位置所对应的存储位置指针偏移量 </span><span>*/</span> <span>private</span> <span>function</span> _getOneIndex(<span>$pos</span><span>) { </span><span>fseek</span>(<span>$this</span>->_indexHandle, <span>$pos</span><span>); </span><span>$len</span> = <span>unpack</span>("Nlen", <span>fread</span>(<span>$this</span>->_indexHandle, 4<span>)); </span><span>return</span> <span>$len</span>['len'<span>]; }</span>
第二、从指定的指针偏移位置获取一条len(4)+val(~)格式的内容
<pre class="code"><span>/*</span><span>* * 从制定的指针偏移量获取一个len+val型的内容 * @param $pos 文件的指针偏移量 * @return 返回数组,包括长度和值 </span><span>*/</span> <span>private</span> <span>function</span> _getStoreLenValFormat(<span>$pos</span><span>){ </span><span>fseek</span>(<span>$this</span>->_storeHandle, <span>$pos</span><span>); </span><span>$len</span> = <span>unpack</span>("Nlen", <span>fread</span>(<span>$this</span>->_storeHandle, 4<span>)); </span><span>$len</span> = <span>$len</span>['len'<span>]; </span><span>$val</span> = <span>fread</span>(<span>$this</span>->_storeHandle, <span>$len</span><span>); </span><span>return</span> <span>array</span><span> ( </span>'len' => <span>$len</span>, 'value' => <span>$val</span>,<span> ); }</span>
第三、获取制定函数的说明,这个也是最主要的一部分,使用二分法从数据文件中获取一条记录
<pre class="code"><span>/*</span><span>* * 获取函数内容 * @param 要查找的函数名称 * @return 返回函数说明的json字符串 </span><span>*/</span> <span>public</span> <span>function</span> get(<span>$func</span><span>) { </span><span>if</span>(!<span>$this</span>-><span>isInit()) </span><span>return</span><span>; </span><span>$begin</span> = 0<span>; </span><span>$end</span> = <span>filesize</span>(<span>$this</span>->_indexFile)/4<span>; </span><span>$ret</span> = '[]'<span>; </span><span>while</span>(<span>$begin</span> < <span>$end</span><span>){ </span><span>$mid</span> = <span>floor</span>((<span>$begin</span> + <span>$end</span>)/2<span>); </span><span>$pos</span> = <span>$mid</span>*4<span>; //$mid只是指针变量的位置,还需要乘上指针的长度4 </span><span>$pos</span> = <span>$this</span>->_getOneIndex(<span>$pos</span><span>); </span><span>$name</span> = <span>$this</span>->_getStoreLenValFormat(<span>$pos</span><span>); </span><span>$flag</span> = <span>strcmp</span>(<span>$func</span>, <span>$name</span>['value'<span>]); </span><span>if</span>(<span>$flag</span> == 0<span>){ </span><span>$val</span> = <span>$this</span>->_getStoreLenValFormat(<span>$pos</span>+4+<span>$name</span>['len'<span>]); </span><span>$ret</span> = <span>$val</span>['value'<span>]; </span><span>break</span><span>; }</span><span>elseif</span>(<span>$flag</span> < 0<span>){ </span><span>$end</span> = <span>$end</span> == <span>$mid</span> ? <span>$mid</span>-1 : <span>$mid</span><span>; }</span><span>else</span><span>{ </span><span>$begin</span> = <span>$begin</span> == <span>$mid</span> ? <span>$mid</span>+1 : <span>$mid</span><span>; } } </span><span>return</span> <span>$ret</span><span>; }</span>
使用很简单,只需包含类库文件和存储文件数据库,然后调用几句代码就可以
<pre class="code"><?<span>php </span><span>include_once</span>("./manual/phpManual.php"<span>); </span><span>$t</span> = <span>new</span><span> phpManual(); </span><span>$t</span>->init('zh'<span>); </span><span>echo</span> <span>$t</span>->get("unpack");
输出的是json字符串,转化后如下所示,其中有详细的说明,以及简洁的例子
<pre class="code"><span>{ </span>"name": "unpack"<span>, </span>"desc": "Unpack data from binary string."<span>, </span>"long_desc": "Unpacks from a binary string into an array according to the given `format`.\\n\\nThe unpacked data is stored in an associative array. To accomplish this you have to name the different format codes and separate them by a slash /. If a repeater argument is present, then each of the array keys will have a sequence number behind the given name."<span>, </span>"ver": "PHP 4, PHP 5"<span>, </span>"ret_desc": "Returns an associative array containing unpacked elements of binary string."<span>, </span>"seealso"<span>: [ </span>"pack"<span> ], </span>"url": "function.unpack"<span>, </span>"class": <span>null</span><span>, </span>"params"<span>: [ { </span>"list"<span>: [ { </span>"type": "string"<span>, </span>"var": "$format"<span>, </span>"beh": 0<span>, </span>"desc": "See pack() for an explanation of the format codes."<span> }, { </span>"type": "string"<span>, </span>"var": "$data"<span>, </span>"beh": 0<span>, </span>"desc": "The packed data."<span> } ], </span>"ret_type": "array"<span> } ], </span>"examples"<span>: [ { </span>"title": "unpack() example"<span>, </span>"source": "$binarydata = \"\\x04\\x00\\xa0\\x00\";\n$array = unpack(\"cchars/nint\", $binarydata);"<span>, </span>"output": <span>null</span><span> }, { </span>"title": "unpack() example with a repeater"<span>, </span>"source": "$binarydata = \"\\x04\\x00\\xa0\\x00\";\n$array = unpack(\"c2chars/nint\", $binarydata);"<span>, </span>"output": <span>null</span><span> }, { </span>"title": "unpack() example with unnamed keys"<span>, </span>"source": "$binarydata = \"\\x32\\x42\\x00\\xa0\";\n$array = unpack(\"c2/n\", $binarydata);\nvar_dump($array);"<span>, </span>"output": <span>null</span><span> } ] }</span>
最后再附上目录结构:
<pre class="code">+<span>phpManual </span>+<span>manual </span>+<span>phpManual </span>+<span>zh </span>|<span>_manualIndex </span>|<span>_manualStore </span>|<span>_phpManual.php </span>|_test.php
这个是程序的完整地址:
完整例子地址
参考
https://github.com/aizuyan/php-doc-parser 从这里拿到的phpmanual的全部数据
本文版权归作者iforever(luluyrt@163.com)所有,未经作者本人同意禁止任何形式的转载,转载文章之后必须在文章页面明显位置给出作者和原文连接,否则保留追究法律责任的权利。

PHP主要是過程式編程,但也支持面向對象編程(OOP);Python支持多種範式,包括OOP、函數式和過程式編程。 PHP適合web開發,Python適用於多種應用,如數據分析和機器學習。

PHP起源於1994年,由RasmusLerdorf開發,最初用於跟踪網站訪問者,逐漸演變為服務器端腳本語言,廣泛應用於網頁開發。 Python由GuidovanRossum於1980年代末開發,1991年首次發布,強調代碼可讀性和簡潔性,適用於科學計算、數據分析等領域。

PHP適合網頁開發和快速原型開發,Python適用於數據科學和機器學習。 1.PHP用於動態網頁開發,語法簡單,適合快速開發。 2.Python語法簡潔,適用於多領域,庫生態系統強大。

PHP在現代化進程中仍然重要,因為它支持大量網站和應用,並通過框架適應開發需求。 1.PHP7提升了性能並引入了新功能。 2.現代框架如Laravel、Symfony和CodeIgniter簡化開發,提高代碼質量。 3.性能優化和最佳實踐進一步提升應用效率。

PHPhassignificantlyimpactedwebdevelopmentandextendsbeyondit.1)ItpowersmajorplatformslikeWordPressandexcelsindatabaseinteractions.2)PHP'sadaptabilityallowsittoscaleforlargeapplicationsusingframeworkslikeLaravel.3)Beyondweb,PHPisusedincommand-linescrip

PHP類型提示提升代碼質量和可讀性。 1)標量類型提示:自PHP7.0起,允許在函數參數中指定基本數據類型,如int、float等。 2)返回類型提示:確保函數返回值類型的一致性。 3)聯合類型提示:自PHP8.0起,允許在函數參數或返回值中指定多個類型。 4)可空類型提示:允許包含null值,處理可能返回空值的函數。

PHP中使用clone關鍵字創建對象副本,並通過\_\_clone魔法方法定制克隆行為。 1.使用clone關鍵字進行淺拷貝,克隆對象的屬性但不克隆對象屬性內的對象。 2.通過\_\_clone方法可以深拷貝嵌套對象,避免淺拷貝問題。 3.注意避免克隆中的循環引用和性能問題,優化克隆操作以提高效率。

PHP適用於Web開發和內容管理系統,Python適合數據科學、機器學習和自動化腳本。 1.PHP在構建快速、可擴展的網站和應用程序方面表現出色,常用於WordPress等CMS。 2.Python在數據科學和機器學習領域表現卓越,擁有豐富的庫如NumPy和TensorFlow。


熱AI工具

Undresser.AI Undress
人工智慧驅動的應用程序,用於創建逼真的裸體照片

AI Clothes Remover
用於從照片中去除衣服的線上人工智慧工具。

Undress AI Tool
免費脫衣圖片

Clothoff.io
AI脫衣器

AI Hentai Generator
免費產生 AI 無盡。

熱門文章

熱工具

Dreamweaver CS6
視覺化網頁開發工具

Atom編輯器mac版下載
最受歡迎的的開源編輯器

禪工作室 13.0.1
強大的PHP整合開發環境

SublimeText3 Mac版
神級程式碼編輯軟體(SublimeText3)

DVWA
Damn Vulnerable Web App (DVWA) 是一個PHP/MySQL的Web應用程序,非常容易受到攻擊。它的主要目標是成為安全專業人員在合法環境中測試自己的技能和工具的輔助工具,幫助Web開發人員更好地理解保護網路應用程式的過程,並幫助教師/學生在課堂環境中教授/學習Web應用程式安全性。 DVWA的目標是透過簡單直接的介面練習一些最常見的Web漏洞,難度各不相同。請注意,該軟體中