加入收藏 | 设为首页 | 会员中心 | 我要投稿 PHP编程网 - 黄冈站长网 (http://www.0713zz.com/)- 数据应用、建站、人体识别、智能机器人、语音技术!
当前位置: 首页 > 站长学院 > PHP教程 > 正文

php 运用scws实现mysql全文搜索功能

发布时间:2022-02-18 07:27:02 所属栏目:PHP教程 来源:互联网
导读:scws这样的中文分词插件比较不错,简单的学习了一下,它包涵一些专有名称、人名、地名、数字年代等规则集合,可以直接将语句按这些规则分开成一个一个关键词,准确率在90%-95%之间,按照安装说明把scws的扩展放入php的扩展目录里,下载规则文件和词典文件,并在ph
  scws这样的中文分词插件比较不错,简单的学习了一下,它包涵一些专有名称、人名、地名、数字年代等规则集合,可以直接将语句按这些规则分开成一个一个关键词,准确率在90%-95%之间,按照安装说明把scws的扩展放入php的扩展目录里,下载规则文件和词典文件,并在php配置文件中引用它们,就可以用scws进行分词了.
 
  1) 修改 php 扩展代码以兼容支持 php 5.4.x
 
  2) 修正 php 扩展中 scws_get_tops 的 limit 参数不允许少于 10 的问题
 
  3) libscws 增加 scws_fork() 从既有的 scws 实例产生分支并共享词典/规则集,主要用于多线程开发.
 
  4) 新增部分版本的 win32 的 dll 扩展
 
  PHP实例代码如下:
 
  <?php
  //实例化分词插件核心类
  $so = scws_new();
  //设置分词时所用编码
  $so->set_charset(‘utf-8’);
  //设置分词所用词典(此处使用utf8的词典)
  $so->set_dict('/path/dict.utf8.xdb');
  //设置分词所用规则
  $so->set_rule('/path/rules.utf8.ini ');
  //分词前去掉标点符号
  $so->set_ignore(true);

  $so->close();
  ?>
  注:如以上例子,输入的文字,词典,规则文件这三者的字符集必须统一,另外mysql 4.XX有的是不支持中文全文搜索的,可以存入关键字对应的区位码以方便全文搜索.
 
  版本列表
 
  版本 类型 平台 性能 其它
 
  SCWS-1.1.x C 代码 *Unix*/*PHP* 准确: 95%, 召回: 91%, 速度: 1.2MB/sec
 
  PHP扩展分词速度: 250KB/sec [下载] [文档] [安装说明]
 
  php_scws.dll(1) PHP扩展库 Windows/PHP 4.4.x 准确: 95%, 召回: 91%,
 
  php_scws.dll(2) PHP扩展库 Windows/PHP 5.2.x 准确: 95%, 召回: 91%,
 
  php_scws.dll(3) PHP扩展库 Windows/PHP 5.3.x 准确: 95%, 召回: 91%,  
 
  php_scws.dll(4) PHP扩展库 Windows/PHP 5.4.x 准确: 95%, 召回: 91%,
 
  PSCWS23 PHP源代码 不限 (不支持UTF-8) 准确: 93%, 召回: 89%,
 
  PSCWS4 PHP源代码 不限 准确: 95%, 召回: 91%,
 
 

(编辑:PHP编程网 - 黄冈站长网)

【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容!

    热点阅读