百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 编程网 > 正文

ThinkPHP5 使用迅搜 (XunSearch) 实现全文检索的安装以及使用教程

yuyutoo 2024-11-16 02:38 6 浏览 0 评论

近期有朋友说应用的数据库数据过多,使用mysql原生的查询很慢,问有没有解决的方式,于是就有了这一篇记录文。

讯搜(XunSearch)可以帮助一般开发者针对既有的海量数据,快速而方便地建立自己的全文搜索引擎。全文检索可以帮助您降低服务器搜索负荷、极大程度的提高搜索速度和用户体验。

优点是:

1、后端是采用 C/C++ 开发多线程服务端,索引设计基于 Xapian 和 scws 中文分词。单库最多支持 40 亿条数据,在 5 亿网页大约 1.5TB 的数据中检索时间不超过 1 秒(非缓存)

2、除支持基础的自定义分词、字段检索、布尔搜索外,还直接支持用户急需的相关搜索、拼音搜索、搜索建议等专业功能。

一、安装教程

Xunsearch PHP-SDK 是与 xunsearch 后端服务协同工作的,所以后先必须先在您的服务器 上安装服务端,服务器操作系统要求必须是 Linux、BSD 或其它类 UNIX 系统,同时安装了 gcc、make 等基础编译环境。这里使用的是Linux系统。安装步骤如下:

1、进入想把XunSearch安装的目录(你也可以自定义)

cd /usr/local/

2、运行下面指令下载、解压安装包

wget http://www.xunsearch.com/download/xunsearch-full-latest.tar.bz2 tar -xjf xunsearch-full-latest.tar.bz2

3、执行安装脚本,根据提示进行操作,主要是输入 xunsearch 软件包的安装目录,建议单独规划一个目录,而不是混到别的软件目录中。

cd xunsearch-full-1.4.15/ sh setup.sh

4、待命令运行结束后,如果没有出错中断,则表示顺利安装完成,使用下面指令即可启动。

/usr/local/xunsearch/bin/xs-ctl.sh restart

PS:如果该程序和应用程序不在一个服务器上面,则使用下面的指令启动,并放行8383与8384端口。

/usr/local/xunsearch/bin/xs-ctl.sh -b inet start

5、设置开机启动。

将脚本指令 "/usr/local/xunsearch/bin/xs-ctl.sh -b inet start"写进 "/etc/rc.local" 文件,然后保存退出即可。

PS:安装中可能会出现一些常见的错误,我们后面的章节记录一下。

二、Thinkphp5使用讯搜(XunSearch)查询数据

1、将上面服务器安装好的讯搜目录中SDK 代码整个目录复制到相应的服务器上,放在app/extends/文件夹下面。

2、配置SDK目录中app/demo.ini中的配置参数改成与需要全文检索的字段相对应(需要注意字段的属性以及服务器参数配置)。

string 字符型,适用多数情况,也是默认值

numeric 数值型,包含整型和浮点数,仅当字段需用于以排序或区间检索时才设为该类型,否则请使用 string?即可

date 日期型,形式为 YYYYmmdd 这样固定的 8 字节,如果没有区间检索或排序需求不建议使用

id 主键型,确保每条数据具备唯一值,是索引更新和删除的凭据,每个搜索项目必须有且仅有一个 id 字段,该字段的值不区分大小写

title 标题型,标题或名称字段,至多有一个该类型的字段

body 内容型,主内容字段, 即本搜索项目中内容最长的字段,至多只有一个该类型字段,本字段不支持字段检索

3、添加数据至索引库

require_once CONF_PATH.'../extend/sdk/php/lib/XS.php';

$xs = new \XS('demo'); // 创建 XS 对象,项目名称为:demo

$index = $xs->index; // 获取索引对象

$data = array(

'pid' => 234, // 此字段为主键,必须指定

'subject' => '测试文档的标题',

'message' => '测试文档的内容部分',

'chrono' => time() ); // 创建文档对象

$doc = new \XSDocument;

$doc->setFields($data); // 添加到索引数据库中

$index->add($doc);

4、使用讯搜(XunSearch)查询数据

require_once CONF_PATH.'../extend/sdk/php/lib/XS.php';

$xs = new \XS('demo'); // 创建 XS 对象,项目名称为:demo

$search= $xs->search; // 获取搜索对象

$query = '项目测试'; // 这里的搜索语句很简单,就一个短语

$search->setQuery($query); // 设置搜索语句

$search->addWeight('subject', 'xunsearch'); // 增加附加条件:提升标题中包含 'xunsearch' 的记录的权重

$search->setLimit(5, 10); // 设置返回结果最多为 5 条,并跳过前 10 条

$docs = $search->search(); // 执行搜索,将搜索结果文档保存在 $docs 数组中

$count = $search->count(); // 获取搜索结果的匹配总数估算值

你也可以使用串接操作:

$docs = $search->setQuery('项目测试')->addWeight('subject', 'xunsearch')->setLimit(5, 10)->search();

你可以使用print_r来查看返回的数据。

相关推荐

墨尔本一华裔男子与亚裔男子分别失踪数日 警方寻人

中新网5月15日电据澳洲新快网报道,据澳大利亚维州警察局网站消息,22岁的华裔男子邓跃(Yue‘Peter’Deng,音译)失踪已6天,维州警方于当地时间13日发布寻人通告,寻求公众协助寻找邓跃。华...

网络交友须谨慎!美国犹他州一男子因涉嫌杀害女网友被捕

伊森·洪克斯克(图源网络,侵删)据美国广播公司(ABC)25日报道,美国犹他州一名男子于24日因涉嫌谋杀被捕。警方表示,这名男子主动告知警局,称其杀害了一名在网络交友软件上认识的25岁女子。雷顿警...

一课译词:来龙去脉(来龙去脉 的意思解释)

Mountainranges[Photo/SIPA]“来龙去脉”,汉语成语,本指山脉的走势和去向,现比喻一件事的前因后果(causeandeffectofanevent),可以翻译为“i...

高考重要考点:range(range高考用法)

range可以用作动词,也可以用作名词,含义特别多,在阅读理解中出现的频率很高,还经常作为完形填空的选项,而且在作文中使用是非常好的高级词汇。...

C++20 Ranges:现代范围操作(现代c++白皮书)

1.引言:C++20Ranges库简介C++20引入的Ranges库是C++标准库的重要更新,旨在提供更现代化、表达力更强的方式来处理数据序列(范围,range)。Ranges库基于...

学习VBA,报表做到飞 第二章 数组 2.4 Filter函数

第二章数组2.4Filter函数Filter函数功能与autofilter函数类似,它对一个一维数组进行筛选,返回一个从0开始的数组。...

VBA学习笔记:数组:数组相关函数—Split,Join

Split拆分字符串函数,语法Split(expression,字符,Limit,compare),第1参数为必写,后面3个参数都是可选项。Expression为需要拆分的数据,“字符”就是以哪个字...

VBA如何自定义序列,学会这些方法,让你工作更轻松

No.1在Excel中,自定义序列是一种快速填表机制,如何有效地利用这个方法,可以大大增加工作效率。通常在操作工作表的时候,可能会输入一些很有序的序列,如果一一录入就显得十分笨拙。Excel给出了一种...

Excel VBA入门教程1.3 数组基础(vba数组详解)

1.3数组使用数组和对象时,也要声明,这里说下数组的声明:'确定范围的数组,可以存储b-a+1个数,a、b为整数Dim数组名称(aTob)As数据类型Dimarr...

远程网络调试工具百宝箱-MobaXterm

MobaXterm是一个功能强大的远程网络工具百宝箱,它将所有重要的远程网络工具(SSH、Telnet、X11、RDP、VNC、FTP、MOSH、Serial等)和Unix命令(bash、ls、cat...

AREX:携程新一代自动化回归测试工具的设计与实现

一、背景随着携程机票BU业务规模的不断提高,业务系统日趋复杂,各种问题和挑战也随之而来。对于研发测试团队,面临着各种效能困境,包括业务复杂度高、数据构造工作量大、回归测试全量回归、沟通成本高、测试用例...

Windows、Android、IOS、Web自动化工具选择策略

Windows平台中应用UI自动化测试解决方案AutoIT是开源工具,该工具识别windows的标准控件效果不错,但是当它遇到应用中非标准控件定义的UI元素时往往就无能为力了,这个时候选择silkte...

python自动化工具:pywinauto(python快速上手 自动化)

简介Pywinauto是完全由Python构建的一个模块,可以用于自动化Windows上的GUI应用程序。同时,它支持鼠标、键盘操作,在元素控件树较复杂的界面,可以辅助我们完成自动化操作。我在...

时下最火的 Airtest 如何测试手机 APP?

引言Airtest是网易出品的一款基于图像识别的自动化测试工具,主要应用在手机APP和游戏的测试。一旦使用了这个工具进行APP的自动化,你就会发现自动化测试原来是如此简单!!连接手机要进行...

【推荐】7个最强Appium替代工具,移动App自动化测试必备!

在移动应用开发日益火爆的今天,自动化测试成为了确保应用质量和用户体验的关键环节。Appium作为一款广泛应用的移动应用自动化测试工具,为测试人员所熟知。然而,在不同的测试场景和需求下,还有许多其他优...

取消回复欢迎 发表评论: