搜索
首页php教程php手册PHP搜索引挚支持中文搜索 技术日记
PHP搜索引挚支持中文搜索 技术日记Jun 06, 2016 pm 07:59 PM
php中文技术搜索支持日记环境索引

环境:window/Linux 工具:PHP mysql apache 注意:本人对在Linux环境下操作生熟,而且没有权限对公网上服务器进行配置,本地环境为window xp.所以要对环境没有需要. 最近一直在查相关PHP搜索引挚有知识,因为想做一个玩玩,不用不知道,一用可是把人愁死了.没想到,

环境:window/Linux

工具:PHP mysql apache

注意:本人对在Linux环境下操作生熟,而且没有权限对公网上服务器进行配置,本地环境为window xp.所以要对环境没有需要.

 

      最近一直在查相关PHP搜索引挚有知识,因为想做一个玩玩,不用不知道,一用可是把人愁死了.没想到,现在网上对针对中文搜索功能如此馈乏.头疼啊.

     

      记录一:前面已经说过,由于环境的原因.所以现在最流行的搜索工具sphinx,lucene都不能使用了.我哭.........

 

      记录二:risearch php

花了几天的时间终于把配置文件读明白,可以还是白费功夫,因为不支持中文检索。从网上也找不到方法使它支持.

 

      记录三:phpdig

不支持中文分词,我从网上查不到如可才能让它中文检索,否则是个不错的选择。

 

      记录四:sphider 它支持中文搜索,但是用不好会有编问题,昨天晚上我调到晚上12半了都没调好,而且对中文的分词的效果不是很好,只能说可以用。但还是不用为好.

 


试验了这么多都不可以,头痛啊,本来想从网上直接找一个省事,没想到中文搜索的支持效果这么差,只能是自己写了,省事省不了了。哞

 

不能直接使用网上开源搜索引挚的原因是不能进行中文匹配,也就是说不能进行中文分词,哪就只能从网上找个中文分词工具了。从网上查找到PHPCWS ,天呢,“HTTPCWS 是一款基于HTTP协议的开源中文分词系统,目前仅支持Linux系统”,还是不能用。

 

不过天无绝人之路,最终还是让我找到了一个分词工具HJ_SegWord(PHP无组件分词),是个人写的,还好用,分词技术的问题解决了,下一个问题就要解决算法的问题了。明天再说了,我的头快痛死了。

 

 

 

 

声明
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
php怎么把负数转为正整数php怎么把负数转为正整数Apr 19, 2022 pm 08:59 PM

php把负数转为正整数的方法:1、使用abs()函数将负数转为正数,使用intval()函数对正数取整,转为正整数,语法“intval(abs($number))”;2、利用“~”位运算符将负数取反加一,语法“~$number + 1”。

php怎么实现几秒后执行一个函数php怎么实现几秒后执行一个函数Apr 24, 2022 pm 01:12 PM

实现方法:1、使用“sleep(延迟秒数)”语句,可延迟执行函数若干秒;2、使用“time_nanosleep(延迟秒数,延迟纳秒数)”语句,可延迟执行函数若干秒和纳秒;3、使用“time_sleep_until(time()+7)”语句。

php字符串有没有下标php字符串有没有下标Apr 24, 2022 am 11:49 AM

php字符串有下标。在PHP中,下标不仅可以应用于数组和对象,还可应用于字符串,利用字符串的下标和中括号“[]”可以访问指定索引位置的字符,并对该字符进行读写,语法“字符串名[下标值]”;字符串的下标值(索引值)只能是整数类型,起始值为0。

php怎么除以100保留两位小数php怎么除以100保留两位小数Apr 22, 2022 pm 06:23 PM

php除以100保留两位小数的方法:1、利用“/”运算符进行除法运算,语法“数值 / 100”;2、使用“number_format(除法结果, 2)”或“sprintf("%.2f",除法结果)”语句进行四舍五入的处理值,并保留两位小数。

php怎么读取字符串后几个字符php怎么读取字符串后几个字符Apr 22, 2022 pm 08:31 PM

在php中,可以使用substr()函数来读取字符串后几个字符,只需要将该函数的第二个参数设置为负值,第三个参数省略即可;语法为“substr(字符串,-n)”,表示读取从字符串结尾处向前数第n个字符开始,直到字符串结尾的全部字符。

php怎么根据年月日判断是一年的第几天php怎么根据年月日判断是一年的第几天Apr 22, 2022 pm 05:02 PM

判断方法:1、使用“strtotime("年-月-日")”语句将给定的年月日转换为时间戳格式;2、用“date("z",时间戳)+1”语句计算指定时间戳是一年的第几天。date()返回的天数是从0开始计算的,因此真实天数需要在此基础上加1。

php怎么替换nbsp空格符php怎么替换nbsp空格符Apr 24, 2022 pm 02:55 PM

方法:1、用“str_replace(" ","其他字符",$str)”语句,可将nbsp符替换为其他字符;2、用“preg_replace("/(\s|\&nbsp\;||\xc2\xa0)/","其他字符",$str)”语句。

php怎么查找字符串是第几位php怎么查找字符串是第几位Apr 22, 2022 pm 06:48 PM

查找方法:1、用strpos(),语法“strpos("字符串值","查找子串")+1”;2、用stripos(),语法“strpos("字符串值","查找子串")+1”。因为字符串是从0开始计数的,因此两个函数获取的位置需要进行加1处理。

See all articles

热AI工具

Undresser.AI Undress

Undresser.AI Undress

人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

Undress AI Tool

免费脱衣服图片

Clothoff.io

Clothoff.io

AI脱衣机

AI Hentai Generator

AI Hentai Generator

免费生成ai无尽的。

热门文章

R.E.P.O.能量晶体解释及其做什么(黄色晶体)
3 周前By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O.最佳图形设置
3 周前By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O.如果您听不到任何人,如何修复音频
3 周前By尊渡假赌尊渡假赌尊渡假赌

热工具

EditPlus 中文破解版

EditPlus 中文破解版

体积小,语法高亮,不支持代码提示功能

SecLists

SecLists

SecLists是最终安全测试人员的伙伴。它是一个包含各种类型列表的集合,这些列表在安全评估过程中经常使用,都在一个地方。SecLists通过方便地提供安全测试人员可能需要的所有列表,帮助提高安全测试的效率和生产力。列表类型包括用户名、密码、URL、模糊测试有效载荷、敏感数据模式、Web shell等等。测试人员只需将此存储库拉到新的测试机上,他就可以访问到所需的每种类型的列表。

禅工作室 13.0.1

禅工作室 13.0.1

功能强大的PHP集成开发环境

Atom编辑器mac版下载

Atom编辑器mac版下载

最流行的的开源编辑器

SublimeText3汉化版

SublimeText3汉化版

中文版,非常好用