首先了解一下sphinx全文索引的相关知识,考虑到Sphinx全文索引使用的实际需要,主要介绍Sphinx全文索引中文方面的支持。这里需要感谢李沫南同学对Sphinx全文索引中文支持的贡献!

官方网站:http://www.sphinxsearch.com/

官方文档:http://www.sphinxsearch.com/docs/

中文支持:http://www.coreseek.cn/

中文使用手册下载:http://www.coreseek.cn/uploads/pdf/sphinx_doc_zhcn_0.9.pdf

中文在线手册:http://www.coreseek.cn/docs/coreseek_3.2-sphinx_0.9.9.html

1.Windows下安装Sphinx

1.1.开始前的准备工作

先从http://www.coreseek.cn/products/ft_down/下载Coreseek 3.2.13,这里我们就以Windows环境为例:

下载后直接解压coreseek-3.2.13-win32.zip,我们这里假设解压到:D:coreseek-3.2.13-win32.这里我们需要简单了解几个目录:

[D:coreseek-3.2.13-win32api]API接口目录,其中包括了php,python,ruby等操作实例,其中test_coreseek.php是一个不错的中文检索的例子.

[D:****bin]应用程序目录,其中包含以下几个文件

* indexer: 用于创建全文索引;

* search: 一个简单的命令行(CLI) 的测试程序,用于测试全文索引;

* searchd: 一个守护进程,其他软件可以通过这个守护进程进行全文检索;

* sphinxapi: 一系列searchd 的客户端API 库,用于流行的Web脚本开发语言(PHP, Python, Perl, Ruby, Java).

* spelldump: 一个简单的命令行工具,用于从 ispell 或 MySpell (OpenOffice内置绑定) 格式的字典中提取词条。当使用 wordforms 时可用这些词条对索引进行定制.

* indextool: 工具程序,用来转储关于索引的多项调试信息。 此工具是从版本Coreseek 3.1(Sphinx 0.9.9-rc2)开始加入的。

* mmseg: 工具程序和库,Coreseek用于提供中文分词和词典处理。

[D:****etc]sphinx配置目录

[D:****var]sphinx变量&索引&日志存放目录

1.2.创建配置文件

由于dedecms使用的是mysql,所以我们需要来配置一个mysql的sphinx模板配置,可以复制csft_mysql.conf改名为:csft_dedecmsv57.conf,例如我们这里仅做文章的全文检索,我们需要做如下配置:

先在DedeCMS中创建一个统计表,方法可以在DedeCMS后台[系统]->[SQL命令行工具]中执行下列代码:

CREATE TABLE `dede_sphinx` (

`countid` int(11) unsigned NOT NULL,

`maxaid` int(11) unsigned NOT NULL,

PRIMARY KEY (`countid`)

) ENGINE=MyISAM DEFAULT CHARSET=gbk

这是一个sphinx内容统计表,为了适合数据量较大的情况下分批生成索引而使用的.

创建完数据表后,我们对sphinx的配置文件,即csft_dedecmsv57.conf修改,内容如下,其中包含注释:

——————————————————————————————–

#源定义

source mysql

{

type                    = mysql

# 数据库服务器基本配置信息

sql_host                = 192.168.0.103

sql_user                = dedev57

sql_pass                = dedecms

sql_db                  = dedecmsv57gbk

sql_port                = 3306

# 设定编码,这里我们是gbk编码,如果是utf-8,可以设置:

# sql_query_pre            = SET NAMES utf8

sql_query_pre            = SET NAMES gbk

# 数据检索增量

sql_range_step = 1000

#当前最新文档id数

sql_query_pre = REPLACE INTO dede_sphinx SELECT 1, MAX(id) FROM dede_archives

#检索条件

sql_query               = SELECT ARC.id,ARC.typeid,ARC.typeid2,ARC.sortrank,ARC.flag,ARC.channel,ARC.ismake,ARC.arcrank,ARC.click,ARC.title,ARC.shorttitle,ARC.color,ARC.writer,ARC.source,ARC.litpic,ARC.pubdate,ARC.senddate,ARC.mtype,ARC.description,ARC.badpost,ARC.goodpost,ARC.scores,ARC.lastpost,ARC.keywords,ARC.mid,ART.body FROM dede_archives AS ARC LEFT JOIN dede_addonarticle AS ART ON ARC.id = ART.aid WHERE ARC.id>=$start AND ARC.id<=$end #sql_query第一列id需为整数

#title、body作为字符串/文本字段,被全文索引

# 获取当前最大检索id

sql_query_range  = SELECT 1,maxaid FROM dede_sphinx WHERE countid=1

sql_attr_uint             = typeid            #从SQL读取到的值必须为整数

sql_attr_uint            = typeid2

sql_attr_uint            = channel

sql_attr_uint            = click

sql_attr_uint            = badpost

sql_attr_uint            = goodpost

sql_attr_uint            = scores

sql_attr_uint            = mid

sql_attr_timestamp  = pubdate    #从SQL读取到的值必须为整数,作为时间属性

sql_attr_timestamp  = senddate

sql_attr_timestamp  = lastpost

#命令行查询时,从数据库读取原始数据信息

sql_query_info            = SELECT ARC.*,ART.body FROM dede_archives AS ARC LEFT JOIN dede_addonarticle AS ART ON ARC.id = ART.aid WHERE ARC.id=$id

}

source delta

{

type                    = mysql

# 数据库服务器基本配置信息

sql_host                = 192.168.0.103

sql_user                = dedev57

sql_pass                = dedecms

sql_db                  = dedecmsv57gbk

sql_port                = 3306

sql_query_pre            = SET NAMES gbk

# 增量索引,从最大id开始

sql_query = SELECT ARC.id,ARC.typeid,ARC.typeid2,ARC.sortrank,ARC.flag,ARC.channel,ARC.ismake,ARC.arcrank,ARC.click,ARC.title,ARC.shorttitle,ARC.color,ARC.writer,ARC.source,ARC.litpic,ARC.pubdate,ARC.senddate,ARC.mtype,ARC.description,ARC.badpost,ARC.goodpost,ARC.scores,ARC.lastpost,ARC.keywords,ARC.mid,ART.body FROM dede_archives AS ARC LEFT JOIN dede_addonarticle AS ART ON ARC.id = ART.aid WHERE ARC.id > ( SELECT maxaid FROM dede_sphinx WHERE countid=1 )

#从SQL读取到的值必须为整数

sql_query_post = REPLACE INTO dede_sphinx SELECT 1, MAX(id) FROM dede_archives

sql_attr_uint             = typeid

sql_attr_uint            = typeid2

sql_attr_uint            = channel

sql_attr_uint            = click

sql_attr_uint            = badpost

sql_attr_uint            = goodpost

sql_attr_uint            = scores

sql_attr_uint            = mid

sql_attr_timestamp  = pubdate    #从SQL读取到的值必须为整数,作为时间属性

sql_attr_timestamp  = senddate

sql_attr_timestamp  = lastpost

#命令行查询时,从数据库读取原始数据信息

sql_query_info            = SELECT ARC.*,ART.body FROM dede_archives AS ARC LEFT JOIN dede_addonarticle AS ART ON ARC.id = ART.aid WHERE ARC.id=$id

}

#index定义

index mysql

{

source            = mysql             #对应的source名称

path            = D:/coreseek-3.2.13-win32/var/data/mysql

docinfo            = extern

mlock            = 0

morphology        = none

min_word_len        = 1

html_strip                = 0

#charset_dictpath = /usr/local/mmseg3/etc/    #BSD、Linux环境下设置,/符号结尾

charset_dictpath = D:/coreseek-3.2.13-win32/etc/                        #Windows环境下设置,/符号结尾

charset_type        = zh_cn.gbk

}

index delta : mysql

{

min_word_len        = 1

source = delta

path            = D:/coreseek-3.2.13-win32/var/data/delta.new

}

#全局index定义

indexer

{

mem_limit            = 128M

}

#searchd服务定义

searchd

{

listen                  =   9312

read_timeout        = 5

max_children        = 30

max_matches            = 1000

seamless_rotate        = 0

preopen_indexes        = 0

unlink_old            = 1

pid_file = D:/coreseek-3.2.13-win32/var/log/searchd_mysql.pid

log = D:/coreseek-3.2.13-win32/var/log/searchd_mysql.log

query_log = D:/coreseek-3.2.13-win32/var/log/query_mysql.log

}

——————————————————————————————————-

1.3.建立索引

配置完成后,我们要先建立索引,在开始菜单中打开[运行],输入"cmd",确认后打开命令行.输入下列代码:

d:&cd D:coreseek-3.2.13-win32bin

先切换到sphinx的bin目录,然后再执行:

indexer.exe -c D:coreseek-3.2.13-win32etccsft_dedecmsv57.conf mysql –rotate

这个时候sphinx开始构建索引,如果数据量比较大,这个时间可能比较长,需要耐心等待(如图1).

然后再创建下增量索引,使用下列命令:

indexer.exe -c D:coreseek-3.2.13-win32etccsft_dedecmsv57.conf delta –rotate

1.4.测试检索是否正常

建立完索引之后我们来检测下是否能够正常搜索到匹配内容,可以继续在cmd中输入下列命令:

search.exe -c D:coreseek-3.2.13-win32etccsft_dedecmsv57.conf dedecms

如果能够正常返回数据(如图2),则说明已经成功建立索引.

2.结合DedeCMS程序使用sphinx

2.1.开启sphinx服务

在上面的步骤中我们已经成功生成了索引,接下来为了能够使用客户端调用则需要开启sphinx服务.

可以直接在cmd中执行:

searchd.exe -c D:coreseek-3.2.13-win32etccsft_dedecmsv57.conf

这样我们就开启了sphinx服务(如图3),我们可以写一个简单的例子进行测试:

sphinx_test.php

——————————————————————————————————–

set_time_limit(0);

require_once (dirname(__FILE__) . "/include/common.inc.php");

$sphinx = new SphinxClient;

$mode = SPH_MATCH_ANY;            //匹配模式

$host = "localhost";            //服务ip

$port = 9312;    //服务端口

$sphinx->SetServer($host, $port);

$sphinx->SetArrayResult(true);

$sphinx->SetMatchMode($mode);

$res = $sphinx->Query(‘织梦内容管理系统’);

//var_dump($sphinx);

//var_dump($res);

$total = count($res['matches']);

for($i=0; $i < $total; $i++)

{

var_dump($res['matches'][$i]);

}

—————————————————————————————————–

执行sphinx_test.php,可以看到已经能够正常通信,并且返回了内容.

2.2.创建一个DedeSphinx服务

上面我们通过searchd.exe开启了服务,但不好的是,我们关闭了cmd窗口就不能继续访问了,解决办法如下:

同样切换到bin目录下,执行:

searchd.exe –install -c D:coreseek-3.2.13-win32etccsft_dedecmsv57.conf –servicename DedeSphinx

这样就在系统中成功创建了一个DedeSphinx服务,无需再打开窗口(如图5).

dedecms模板|dede仿站|dede模板制作|dede防站-Dede之家-www.2d30.cn

3.更新与维护

对于全文检索的索引,我们是需要不定期生成的,如果是数据量比较小,直接使用上述生成索引的命令重建就可以,如果数据量比较大,我们则需要定义的更新全文索引.

如果内容更新比较频繁,下列的命令需要每分钟被执行一次(可以创建一个脚本,使用windows计划任务定期执行)

生成增量索引:

indexer.exe -c D:coreseek-3.2.13-win32etccsft_dedecmsv57.conf delta –rotate

当然每一天都需要将增量索引合并到主索引mysql中去,需要执行:

indexer.exe -c D:coreseek-3.2.13-win32etccsft_dedecmsv57.conf –merge mysql delta –rotate

dede mysql query_DedeCMS V5.7版本全文检索功能使用教程相关推荐

  1. MySQL 5.7最新版本下载与安装教程

    目录 一.下载 二.配置环境变量 三.cmd安装 一.下载 官网地址:MySQL 二.配置环境变量 此电脑→属性→高级系统设置→环境变量→系统变量→Path 点击新建,复制下载好的mysql所在文件夹 ...

  2. mysql 全文检索 教程_MySQL:详细说明MySQL全文检索图文详细教程

    软件安装:装机软件必备包 本站电脑知识提供电脑入门知识,计算机基础知识,计算机网络应用基础知识,电脑配置知识,电脑故障排除和电脑常识大全,帮助您更好的学习电脑!不为别的,只因有共同的爱好,为中国互联网 ...

  3. mysql全文搜索插件_MySQL 全文检索 ngram插件

    InnoDB默认的全文索引parser非常合适于Latin,因为Latin是通过空格来分词的.但对于像中文,日文和韩文来说,没有这样的分隔符.一个词可以由多个字来组成,所以我们需要用不同的方式来处理. ...

  4. 使用vue-cli+element-ui+expsess+mysql做一个简易的登录功能

    使用vue-cli+element-ui+expsess+mysql做一个简易的登录功能 1使用webpack下载vue模板 vue init webpack aaa(aaa为项目名称) cd到aaa ...

  5. MySQL的4大版本

    MySQL Community Server 社区版本,开源免费,自由下载,但不提供官方技术支持,适用于大多数普通用户. MySQL Enterprise Edition 企业版本,需付费,不能在线下 ...

  6. mysql下载哪一代版本好_潮一代更好的设计

    mysql下载哪一代版本好 I think we can all agree that quarantined life has been strange. And while most of the ...

  7. CentOS以及Oracle数据库发展历史及各版本新功能介绍, 便于构造环境时有个对应关系...

    CentOS版本历史 版本 CentOS版本号有两个部分,一个主要版本和一个次要版本,主要和次要版本号分别对应于RHEL的主要版本与更新包,CentOS采取从RHEL的源代码包来构建.例如CentOS ...

  8. php友情链接大于3换行,细节见真情 PHPWind v5.3友情链接功能改进

    PHPWind v5.3从官方公开测试到发布rc1测试版本,得到了非常多会员的支持与肯定.在PHPWind v5.3版本中,还增加了不少很好用的小功能,在这里和大家相互交流一下. 今天要说的是PHPW ...

  9. mysql workbench企业_甲骨文发布MySQL Workbench 6.0版本

    甲骨文近日发布了最新的MySQL Workbench 6.0,该版本的用户界面得到了重新设计并拥有新功能,从而简化MySQL数据库的开发.设计和管理. MySQL Workbench是世界上最流行的开 ...

最新文章

  1. 自己动手,做一款抬头显示的「Todo Hud」
  2. C++设计模式--抽象工厂模式
  3. java实现的简单程序登录界面
  4. 搞懂nginx的proxy模块-01
  5. 苹果公布App审查新机制 禁止发布疫情相关娱乐程序和游戏
  6. 基于MDC的SOA方案
  7. 「动手学深度学习」在B站火到没谁,加这个免费实操平台,妥妥天花板
  8. ELK-filbeate收集tomcat日志
  9. 开源GIS(二十)——CAD数据添加属性转GIS数据
  10. 【学术】论文写作葵花宝典
  11. 洞察|2019年混合云发展:前景广阔 巨头混战 SD-WAN成重要推手
  12. 现代操作系统---1.操作系统的结构
  13. matlab 指定ccs编译器,在CCS5.5中导入CCS3.3工程——指定编译器和修改prj文件
  14. 错误代码warning C4013: ‘sqrt‘ undefined; assuming extern returning int怎么解决?
  15. Arranging The Sheep 中位数定理
  16. python开发html_Python开发——16.HTML
  17. 2022年智能手机市场概括
  18. AO是什么?GO是什么?深度解析JS预编译遇见AO和GO
  19. webmatrix3 php,webmatrix下载_webmatrix v3.0 官方版_魅蓝下载
  20. 0x80070070 错误

热门文章

  1. keil的数据波形如何在电脑示波器软件keil array visualization显示
  2. yolo cfg文件解析
  3. 1 用Matlab 程序对AM调制,基于matlab的AM调制系统的仿真
  4. GJB438B/438C如何制定软件开发计划
  5. JUnit5使用教程及简单的测试案例(Idea,Android studio)
  6. Python 当中的list
  7. 赛元单片机触摸按键调节及避坑指南(以SC92F8461B的高灵敏触摸为例)
  8. Kubernetes学习(六)—— Pod控制器
  9. 计算机知识竞赛策划案,大学计算机基础知识竞赛活动策划书(含题目).doc
  10. 认识区块链,认知区块链— —数据上链