中文分词是个坑
unicode61 分词器把连续中文当成一个 token,搜不到子串。
解决方案:逐字分词。
-- 写入时:正文内容 -> 正 文 内 容
INSERT INTO posts_fts(content_md) VALUES ('正 文 内 容');
查询端同样处理即可实现中文子串搜索。
unicode61 分词器把连续中文当成一个 token,搜不到子串。
解决方案:逐字分词。
-- 写入时:正文内容 -> 正 文 内 容
INSERT INTO posts_fts(content_md) VALUES ('正 文 内 容');
查询端同样处理即可实现中文子串搜索。
评论
评论加载中…