检查 html 文件或网站中的死链接。作为 DPS 909-塞内卡学院的一部分完成
项目描述
linkReaper-cli - 版本 0.1
用于查找 html 文件和网站中的死链接的 Python cli 工具。作为塞内卡学院 DPS909 开源课程的一部分完成。
功能和特点
linkReaper 搜索本地存储的 html 文件和从 Web 提取的文件,并确定文件中的任何链接是否已失效。它收集链接的响应,然后显示状态代码和相应的链接以及结果的简短描述。为方便用户并轻松识别死链接,这些都采用颜色编码。
可选功能
- 在给定 url 的情况下通过网页查找死链接
- 彩色输出
- 红色表示错误的网址
- 绿色的好网址
- 黄色表示任何具有异常/未知行为的 URL
- 在浏览本地文件和网页时检查 http 链接是否作为 https 工作的选项
- 找到的所有 http 链接都将其方案更改为 https 并输出结果
- 优化为仅搜索标题而不是全文
- 寻找回复时不下载整页
- 仅输出好、坏和所有链接的选项
- 好的选项只会输出带有 200 响应代码的链接
- 错误的选项将输出其他任何内容
- all 选项是默认选项,将输出所有
- 选择以 json 格式输出
- 这适用于好、坏和所有输出选项
用法
该程序有两个主要功能:
- 在本地 html 文件中查找损坏的链接
- 在给定 url 的网站中查找损坏的链接
输入不带参数的程序名称将显示帮助页面。
本地文件
选项
-s , --s
检查 http 链接是否作为 https 工作
-bad, --b
仅输出没有成功响应的链接
-good, --g
仅输出响应成功的链接
-all, --a
默认,输出所有链接
-json, --j
将结果输出为 json 数组。此选项适用于“-good”、“-all”和“-bad”选项。
命令:
查看本地文件
linkreaper readfile [file path]
检查 http 链接是否适用于 https 方案
linkreaper readfile -s [file path]
以 json 格式输出所有好的链接
linkreaper readfile --g --j [filepath]
网站
命令:
浏览网页
linkreaper readwebsite [website url]
检查 http 链接是否适用于 https 方案
linkreaper readwebsite -s [website url]
将所有不能作为 https 工作的 http 链接输出为 json
linkreaper readwebsite -s --b --j [website url]
覆盖范围
pip install coverage
代码覆盖率
发布
该项目已在pypi上发布。要安装,请在终端中执行以下命令。
pip install linkreaper
依赖项
项目详情
下载文件
下载适用于您平台的文件。如果您不确定要选择哪个,请了解有关安装包的更多信息。
源分布
linkreaper-0.0.6.tar.gz
(5.5 kB
查看哈希)
内置分布
linkreaper-0.0.6-py3-none-any.whl
(6.3 kB
查看哈希)
关
linkreaper -0.0.6.tar.gz 的哈希值
| 算法 | 哈希摘要 | |
|---|---|---|
| SHA256 | 988c48f7e9c15b0202dc7fce547fae94570b6ab7f26409fedaf9644d2fad973b |
|
| MD5 | 382e230cac99c6771a1ea1c5570e4b33 |
|
| 布莱克2-256 | b0b5c6c53d0fe5d73b1eb47257a69e4eee982af4b3b174d22a21934943f6949e |
关
linkreaper -0.0.6-py3-none-any.whl 的哈希值
| 算法 | 哈希摘要 | |
|---|---|---|
| SHA256 | 6ebd7edfbfbdac72381e6a80a8fc4eca09f173e36b01053eba44bcb448120983 |
|
| MD5 | 24a51dc879b89cf39c8890ff66f6af5d |
|
| 布莱克2-256 | bf6c5f46e9c83902a2de3b361849a51d0a22da2a5fde9c23389b5218dc1e4d0e |