一个简单的 python 库,用于从 coursera 中抓取一些数据
项目描述
ce刮刀(coursera刮刀)
这是一个简单的库,有助于从 coursera 获取一些数据,内容聚合器可以使用这些数据
用法
一、从pypi安装打包发行版
pip install ce-scraper
1.简单的搜索功能
此功能为我们提供了搜索的前 10 个结果
以执行简单搜索。
首先导入search_courses模块并调用
from ce_scraper import search_courses
courses=search_courses.simple_search(search_phrase='machine learning',type='json')
print(courses)
##输出
[
{
"course_title": "Machine Learning",
"partner": "Stanford University",
"rating_value": "4.9",
"rating_count": "154,848",
"enrollment_numbers": "3.9m",
"course_difficulty": "Mixed",
"type": "COURSE"
},
{
"course_title": "Deep Learning",
"partner": "DeepLearning.AI",
"rating_value": "4.8",
"rating_count": "117,652",
"enrollment_numbers": "990k",
"course_difficulty": "Intermediate",
"type": "SPECIALIZATION"
},
{
"course_title": "Machine Learning",
"partner": "University of Washington",
"rating_value": "4.6",
"rating_count": "14,496",
"enrollment_numbers": "400k",
"course_difficulty": "Intermediate",
"type": "SPECIALIZATION"
},
{
"course_title": "Mathematics for Machine Learning",
"partner": "Imperial College London",
"rating_value": "4.6",
"rating_count": "10,371",
"enrollment_numbers": "250k",
"course_difficulty": "Beginner",
"type": "SPECIALIZATION"
},
{
"course_title": "IBM Machine Learning",
"partner": "IBM",
"rating_value": "4.6",
"rating_count": "211",
"enrollment_numbers": "11k",
"course_difficulty": "Intermediate",
"type": "PROFESSIONAL CERTIFICATE"
},
{
"course_title": "Applied Data Science with Python",
"partner": "University of Michigan",
"rating_value": "4.5",
"rating_count": "28,245",
"enrollment_numbers": "700k",
"course_difficulty": "Intermediate",
"type": "SPECIALIZATION"
},
{
"course_title": "Machine Learning for All",
"partner": "University of London",
"rating_value": "4.7",
"rating_count": "2,290",
"enrollment_numbers": "80k",
"course_difficulty": "Beginner",
"type": "COURSE"
},
{
"course_title": "IBM Data Science",
"partner": "IBM",
"rating_value": "4.6",
"rating_count": "68,872",
"enrollment_numbers": "740k",
"course_difficulty": "Beginner",
"type": "PROFESSIONAL CERTIFICATE"
},
{
"course_title": "Naive Bayes 101: Resume Selection with Machine Learning",
"partner": "Coursera Project Network",
"rating_value": "Not Available",
"rating_count": "Not Available",
"enrollment_numbers": "Not Available",
"course_difficulty": "Intermediate",
"type": "GUIDED PROJECT"
},
{
"course_title": "Advanced Machine Learning",
"partner": "HSE University",
"rating_value": "4.4",
"rating_count": "3,701",
"enrollment_numbers": "300k",
"course_difficulty": "Advanced",
"type": "SPECIALIZATION"
}
]
search_phrase是用于搜索课程的关键字
type是我们想要从搜索结果中获得的文件类型。
这些是type此版本支持的值。
一世。list
ii. json
iii.dataframe
2. 高级搜索
为了执行高级搜索,我们在搜索课程模块中调用高级搜索,并将
过滤器字典作为参数。此功能目前仅支持页码作为过滤器。
from ce_scraper import search_courses
courses=search_courses.advanced_search(search_phrase='deep learning', filters={'pages': 2}, type=list)
print(courses)
上面的代码用关键字搜索,deep learning并从 coursera 页面上的两页结果中返回课程,大约 30 门课程。更多过滤器和功能将包含在该库的下一个版本中。
项目详情
下载文件
下载适用于您平台的文件。如果您不确定要选择哪个,请了解有关安装包的更多信息。
源分布
ce_scraper-0.0.2.tar.gz
(3.9 kB
查看哈希)
内置分布
ce_scraper-0.0.2-py3-none-any.whl
(4.6 kB
查看哈希)
关
ce_scraper -0.0.2.tar.gz 的哈希值
| 算法 | 哈希摘要 | |
|---|---|---|
| SHA256 | 4d3a6f154e53880e7a22304fe4513df9ccf397ec448b7ce6496bad802546e0bf |
|
| MD5 | d6923c9ca6ba787f3e291756dec4a798 |
|
| 布莱克2-256 | a9c742853a4e647f62024f56c496c5a8c369b3d232dfe79c0697a6ddb38b66bd |
关
ce_scraper -0.0.2-py3-none-any.whl 的哈希值
| 算法 | 哈希摘要 | |
|---|---|---|
| SHA256 | c652c8b3db744b0fe1893b699f312dcaf049a8627e540f1e740aa2ba7e175af5 |
|
| MD5 | 1e8f2e3b979dc9ec205186ed3ac595de |
|
| 布莱克2-256 | c6239ae85de9298fbed10bd9dcdce4a7a9c98db369c46f6162de464acd27399f |