仓库 Issues 博客
语言: 全部
排序: 最佳匹配
找到相关仓库约为11711
搜索工具
基于HanLP自然语言处理包的elasticsearch分词
Java 35 137 37 更新于 2024-02-05
1+elasticsearch6.5.3搭建的企业级搜索平台,支持PB级数据(elasticsearch分布式部署),目前已经支持中文分词,检索关键词高亮操作,如果帮到您,麻烦点下Star,谢谢。
Java 231 1.4k 532 更新于 2024-02-20
pkuseg-python:一个高准确度的中文分词工具包 pkuseg-python 简单易用,支持多领域分词,在不同领域的数据上都大幅提高了分词的准确率
Python 11 37 9 更新于 2023-11-23
利用IK分词器,扩展了solr4.7.2,luence4.7.2,拼音分词,基于IK2012FF,JDK1.6,
Java 11 16 4 更新于 2021-12-13
针对mmseg4j (1.10.0)的拓展,弥补了多处不足,分词,随心所欲
Java 9 15 7 更新于 2020-12-19
ansj分词.ict的真正java实现.分词效果速度都超过开源版的ict. 中文分词,人名识别,词性标注,用户自定义词典
1 27 2 更新于 2022-01-31
PHP 中文工具类,支持汉字转拼音、拼音分词、简繁互转、数字、金额大写;QQ群:17916227。本仓库仅用于存档,不再发布更新日志,请移步 Github:
PHP 62 304 70 更新于 2024-02-19
中文词法分析(LAC) 中文分词(Word Segmentation)是将连续的自然语言文本,切分出具有语义合理性和完整性的词汇序列的过程
C++ 7 27 4 更新于 2023-09-12
elasticsearch的ik分词器动态扩展词库
Java 7 18 10 更新于 2024-01-31
分词中文分词
PHP 2 2 1 更新于 2021-03-30

推荐博客

...