Skip to main content

一个用于文本生成器的小模块,可让您过滤字符串中的坏词。

项目描述

词过滤器

一个用于文本生成器的小模块。它使您可以过滤字符串中的坏词。

入门

安装模块:npm install wordfilter

var wordfilter = require('wordfilter');
wordfilter.blacklisted('does this string have a bad word in it?'); // "false"

// clear the list entirely
wordfilter.clearList();

// add new words
wordfilter.addWords(['zebra','elephant']);
wordfilter.blacklisted('this string has zebra in it'); // "true"

// remove a word
wordfilter.removeWord('zebra');
wordfilter.blacklisted('this string has zebra in it'); // "false"

或使用 Python:使用以下命令安装模块:pip install wordfilter

from wordfilter import Wordfilter
wordfilter = Wordfilter()
wordfilter.blacklisted('does this string have a bad word in it?')  # False

# clear the list entirely
wordfilter.clearList()

# add new words
wordfilter.addWords(['zebra','elephant'])
wordfilter.blacklisted('this string has zebra in it')  # True

文档

这是一个文字过滤器,改编自我在很多 Twitter 机器人中使用的代码。它基于我精心挑选的要从我的机器人中排除的单词列表:本质上,它是我自己不会说的事情的列表。一般来说,它们是“压迫的话”,也就是我不会说的种族主义/性别歧视/能力主义的东西。

该列表并非包罗万象,我总是在其中添加单词。如果您想提交问题或拉取请求以添加更多单词,请这样做,但请理解这主要用于我自己的项目中,我可能不同意添加某些单词。(例如,我对脏话没意见,所以“shit”和“fuck”永远不会出现在这个列表中。)

单词不区分大小写。

另请注意,由于英语的复杂性,我正在考虑将包含坏词子字符串的任何内容列入黑名单。例如,即使“homogenous”不是一个坏词,它也包含子字符串“homo”并且会被过滤掉。原因是新的俚语总是用复合词冒出来,我跟不上。为了避免误报,我愿意丢掉“同质”和“巴基斯坦”之类的几个词。

贡献

代替正式的样式指南,请注意维护现有的编码样式。为任何新的或更改的功能添加单元测试。使用Grunt对代码进行 Lint 和测试。

执照

版权所有 (c) 2013 Darius Kazemi 在 MIT 许可下获得许可。

项目详情


下载文件

下载适用于您平台的文件。如果您不确定要选择哪个,请了解有关安装包的更多信息。

源分布

wordfilter-0.2.7.ta​​r.gz (4.4 kB 查看哈希)

已上传 source

内置分布

wordfilter-0.2.7-py3-none-any.whl (4.4 kB 查看哈希)

已上传 py3