Skip to main content

梵文动词和名词的基于规则的词干分析器

项目描述

圣干

Sanstem 是一种用于词干梵文动词和名词的工具。词干提取是应用于许多 NLP 算法的预处理程序,通过该程序删除单词的后缀以获得其词干/词根形式。该工具是使用简单的基于规则的方法构建的。

安装

pip install sanstem


用法

from sanstem import SanskritStemmer

#create a SanskritStemmer object
stemmer = SanskritStemmer()
词干名词
inflected_noun = 'गजेन' 
stemmed_noun = stemmer.noun_stem(inflected_noun)
print(stemmed_noun)
# output : गज्
词干动词
inflected_verb = 'गच्छामि'
stemmed_verb = stemmer.verb_stem(inflected_verb)
print(stemmed_verb)
# output : गच्छ्

请注意,仅在 梵文 文本中输入一个单词作为函数和.verb_stem()noun_stem()


贡献

  • 目前,该工具只能词干梵文动词和名词。它可以扩展到更多的词类,如形容词、副词等。
  • 该工具可以灵活地接受任何约定中的梵文输入,如 IAST、HK、iTrans 等。
  • 它不仅可以对单个单词进行词干,还可以使其能够对一个句子甚至整个文件进行词干。

问题

如果遇到任何错误,请在此处打开一个问题。邮箱:nairsooraj2000@gmail.com

项目详情


下载文件

下载适用于您平台的文件。如果您不确定要选择哪个,请了解有关安装包的更多信息。

源分布

sanstem-1.0.2.tar.gz (5.6 kB 查看哈希

已上传 source

内置分布

sanstem-1.0.2-py3-none-any.whl (6.6 kB 查看哈希

已上传 py3