mysql5.6 InnoDB 全文索引 FULLTEXT 中文解决方案 base64
内容导读
互联网集市收集整理的这篇技术教程文章主要介绍了mysql5.6 InnoDB 全文索引 FULLTEXT 中文解决方案 base64,小编现在分享给大家,供广大互联网技能从业者学习和参考。文章包含3638字,纯文字阅读大概需要6分钟。
内容图文
* * 关键词整理函数(用作mysql的全文索引制作的搜索) * 1.将字符串全角转半角、去空格、大写转小写、分成单个字符并base64编码、最后用空格连接类,方便mysql索引,做搜索关键字 * 2.将数字转全角做索引区分标识,全角数字为标识专用 **/ function keywords($str){ // 全角转半角 $str = strtr($str,[ ‘1‘ => ‘1‘,‘2‘ => ‘2‘,‘3‘ => ‘3‘,‘4‘ => ‘4‘,‘5‘ => ‘5‘,‘6‘ => ‘6‘,‘7‘ => ‘7‘,‘8‘ => ‘8‘,‘9‘ => ‘9‘,‘0‘ => ‘0‘, ‘A‘ => ‘A‘,‘B‘ => ‘B‘,‘C‘ => ‘C‘,‘D‘ => ‘D‘,‘E‘ => ‘E‘,‘F‘ => ‘F‘,‘G‘ => ‘G‘,‘H‘ => ‘H‘,‘I‘ => ‘I‘,‘J‘ => ‘J‘,‘K‘ => ‘K‘,‘L‘ => ‘L‘,‘M‘ => ‘M‘,‘N‘ => ‘N‘,‘O‘ => ‘O‘,‘P‘ => ‘P‘,‘Q‘ => ‘Q‘,‘R‘ => ‘R‘,‘S‘ => ‘S‘,‘T‘ => ‘T‘,‘U‘ => ‘U‘,‘V‘ => ‘V‘,‘W‘ => ‘W‘,‘X‘ => ‘X‘,‘Y‘ => ‘Y‘,‘Z‘ => ‘Z‘, ‘a‘ => ‘a‘,‘b‘ => ‘b‘,‘c‘ => ‘c‘,‘d‘ => ‘d‘,‘e‘ => ‘e‘,‘f‘ => ‘f‘,‘g‘ => ‘g‘,‘h‘ => ‘h‘,‘i‘ => ‘i‘,‘j‘ => ‘j‘,‘k‘ => ‘k‘,‘l‘ => ‘l‘,‘m‘ => ‘m‘,‘n‘ => ‘n‘,‘o‘ => ‘o‘,‘p‘ => ‘p‘,‘q‘ => ‘q‘,‘r‘ => ‘r‘,‘s‘ => ‘s‘,‘t‘ => ‘t‘,‘u‘ => ‘u‘,‘v‘ => ‘v‘,‘w‘ => ‘w‘,‘x‘ => ‘x‘,‘y‘ => ‘y‘,‘z‘ => ‘z‘, ‘~‘ => ‘~‘,‘`‘ => ‘`‘,‘!‘ => ‘!‘,‘@‘ => ‘@‘,‘#‘ => ‘#‘,‘$‘ => ‘$‘,‘%‘ => ‘%‘,‘^‘ => ‘^‘,‘&‘ => ‘&‘,‘*‘ => ‘*‘,‘(‘ => ‘(‘,‘)‘ => ‘)‘,‘_‘ => ‘_‘,‘-‘ => ‘-‘,‘+‘ => ‘+‘,‘=‘ => ‘=‘, ‘{‘ => ‘{‘,‘}‘ => ‘}‘,‘[‘ => ‘[‘,‘]‘ => ‘]‘,‘|‘ => ‘|‘,‘\‘ => ‘\\‘,‘:‘ => ‘:‘,‘;‘ => ‘;‘,‘"‘ => ‘"‘,‘'‘ => ‘\‘‘, ‘<‘ => ‘<‘,‘,‘ => ‘,‘,‘>‘ => ‘>‘,‘.‘ => ‘.‘,‘?‘ => ‘?‘,‘/‘ => ‘/‘,‘ ‘ => ‘ ‘ ]); // 去空格 $str = str_replace(‘ ‘,‘‘,$str); // 大写转小写 $str = strtolower($str); // 数字统一格式为阿拉伯数字 $str = strtr($str,[‘零‘ => 0,‘一‘ => 1,‘二‘ => 2,‘三‘ => 3,‘四‘ => 4,‘五‘ => 5,‘六‘ => 6,‘七‘ => 7,‘八‘ => 8,‘九‘ => 9]); // 分成单个字符并base64编码 $str_len = strlen($str); // 获取关键字集合 $arr = []; $str_len = mb_strlen($str); for($i = 0;$i < $str_len;++ $i){ $keyword = strtr(base64_encode(mb_substr($str,$i,1)),‘+/=‘,‘abc‘); if(!in_array($keyword,$arr)){ // 去除重复的关键字 $arr[] = $keyword; } } return $arr; }例如将字符串 ‘小明小红是朋友‘ 输入改函数,返回的结果是数组如下
array(6) { [0]=> string(4) "5bCP" [1]=> string(4) "5piO" [2]=> string(4) "57qi" [3]=> string(4) "5piv" [4]=> string(4) "5pyL" [5]=> string(4) "5YaL" }
分别对应相应的汉字,注意小明和小红都有小这个字,所以去掉重复的字,只有六个编码。
然后用空格将数组连起来
$keywords = implode(‘ ‘,keywords($keyword));
将$keywords 存入数据库。
进阶:
如果匹配的关键词包含一些常用的字,会出现大量的结果。
例如搜索书名 霸道总裁,可能会出现,裁缝,总经理,这样的结果
全文搜索是按照相关度从高到底返回的结果,可以只去去前面一些相关度较高的结果。
或者先查询出相关度最高是多少(相关度是一个数值),然后除以二,限定结果的相关度都大于这个最大相关度的一半。
参考
// 通过最大相关度/2过滤一部分无关结果
//查询出最大相关度是多少 $score = $this->sql(‘xs.nh‘)->query(‘SELECT MATCH(keywords_base) AGAINST (?) AS score FROM nh ORDER BY score DESC LIMIT 1‘,[$keywords]); //构造查询语句 $this->where[‘MATCH(keywords_base) AGAINST‘] = [$keywords,‘> ‘.$score[0][‘score‘] / 2];
mysql5.6 InnoDB 全文索引 FULLTEXT 中文解决方案 base64
标签:相关度 base64 myisam rom limit sele 编码 ring 多少
本文系统来源:https://www.cnblogs.com/tingfengqieyu/p/8608376.html
内容总结
以上是互联网集市为您收集整理的mysql5.6 InnoDB 全文索引 FULLTEXT 中文解决方案 base64全部内容,希望文章能够帮你解决mysql5.6 InnoDB 全文索引 FULLTEXT 中文解决方案 base64所遇到的程序开发问题。 如果觉得互联网集市技术教程内容还不错,欢迎将互联网集市网站推荐给程序员好友。
内容备注
版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 gblab@vip.qq.com 举报,一经查实,本站将立刻删除。
内容手机端
扫描二维码推送至手机访问。