一个用于文本生成器的小模块,可让您过滤字符串中的坏词。
项目描述
词过滤器
一个用于文本生成器的小模块。它使您可以过滤字符串中的坏词。
入门
安装模块:npm install wordfilter
var wordfilter = require('wordfilter');
wordfilter.blacklisted('does this string have a bad word in it?'); // "false"
// clear the list entirely
wordfilter.clearList();
// add new words
wordfilter.addWords(['zebra','elephant']);
wordfilter.blacklisted('this string has zebra in it'); // "true"
// remove a word
wordfilter.removeWord('zebra');
wordfilter.blacklisted('this string has zebra in it'); // "false"
或使用 Python:使用以下命令安装模块:pip install wordfilter
from wordfilter import Wordfilter
wordfilter = Wordfilter()
wordfilter.blacklisted('does this string have a bad word in it?') # False
# clear the list entirely
wordfilter.clearList()
# add new words
wordfilter.addWords(['zebra','elephant'])
wordfilter.blacklisted('this string has zebra in it') # True
文档
这是一个文字过滤器,改编自我在很多 Twitter 机器人中使用的代码。它基于我精心挑选的要从我的机器人中排除的单词列表:本质上,它是我自己不会说的事情的列表。一般来说,它们是“压迫的话”,也就是我不会说的种族主义/性别歧视/能力主义的东西。
该列表并非包罗万象,我总是在其中添加单词。如果您想提交问题或拉取请求以添加更多单词,请这样做,但请理解这主要用于我自己的项目中,我可能不同意添加某些单词。(例如,我对脏话没意见,所以“shit”和“fuck”永远不会出现在这个列表中。)
单词不区分大小写。
另请注意,由于英语的复杂性,我正在考虑将包含坏词子字符串的任何内容列入黑名单。例如,即使“homogenous”不是一个坏词,它也包含子字符串“homo”并且会被过滤掉。原因是新的俚语总是用复合词冒出来,我跟不上。为了避免误报,我愿意丢掉“同质”和“巴基斯坦”之类的几个词。
贡献
代替正式的样式指南,请注意维护现有的编码样式。为任何新的或更改的功能添加单元测试。使用Grunt对代码进行 Lint 和测试。
执照
版权所有 (c) 2013 Darius Kazemi 在 MIT 许可下获得许可。
项目详情
下载文件
下载适用于您平台的文件。如果您不确定要选择哪个,请了解有关安装包的更多信息。
源分布
wordfilter-0.2.7.tar.gz
(4.4 kB
查看哈希)
内置分布
wordfilter-0.2.7-py3-none-any.whl
(4.4 kB
查看哈希)
关
wordfilter -0.2.7.tar.gz 的哈希值
| 算法 | 哈希摘要 | |
|---|---|---|
| SHA256 | 81b5d8077d1004d5a6fd56e02c506e93f49ef30920e235fa28ff7950a7b44c31 |
|
| MD5 | 58b2ad5b141594ee825b466e65381cc7 |
|
| 布莱克2-256 | 40230674c5228f9f45079fa82821ec7861fb81c5d4943b73e2d58501595a9664 |
关
wordfilter -0.2.7-py3-none-any.whl 的哈希值
| 算法 | 哈希摘要 | |
|---|---|---|
| SHA256 | bca1959109fed57051e2484dc2b47f1f8b1d3241eaa6ea50a6151d19f2466638 |
|
| MD5 | d6309fc326520413af0ef830130dead5 |
|
| 布莱克2-256 | ea695093450f36945ba1e06163a5cb3feb414468cf3fa25fb13ad6c06fa2064b |