找到相关仓库约为1078个
搜索工具
排序方式:
最多watches
基于 NLP 技术实现的中文分词插件,准确度比常用的分词器高太多,同时提供 ElasticSearch 和 OpenSearch 插件。
H5可以使用的汉字转拼音库 实现汉字转拼音 实现汉语单词转拼音 实现汉语句子转拼音,在一定程度解决多音字问题
利用IK分词器,扩展了solr4.7.2,luence4.7.2,拼音分词,基于IK2012FF,JDK1.6,
pkuseg-python:一个高准确度的中文分词工具包 pkuseg-python 简单易用,支持多领域分词,在不同领域的数据上都大幅提高了分词的准确率
一个简单易学,支持汉语,拓展性强,跨平台,面向对象的轻量级编程语言 可在linux-x86/-x86_64 ,rasberry,windows-x86/-x64等系统上正常运行
一个好用的数据查重引擎。包含了数据建模,清洗算法设计,查重,结构导出等功能。查重的算法中对数据每个属性均可以设定权重和灵活选择比对算法。使用的中文分词引擎对较长中文句子进行分司和比对。
逐浪字库专注中文字体研发,领先的字体研发团队,专注汉语基础数据元研究与文明基石拓荒者,我们试图创造一个更加开放自由的文字创作与使用世界,是中文业界首个开放开源字库企业。~
推荐博客
...