C
crawlee-python
apify/crawlee-python
Crawlee——一个用于Python的网络爬取和浏览器自动化库,用于构建可靠的爬虫。为AI、LLM、RAG或GPT提取数据。从网站下载HTML、PDF、JPG、PNG和其他文件。可与Parsel、BeautifulSoup、Playwright和原始HTTP配合使用。支持有头和无头模式。带有代理轮换。
★9.4kstars
Python
Apache-2.0
更新: 今天
📋 项目速览
点击展开
这是什么?开源智能体项目,用Python构建、核心能力在apify/automation
作者是谁?由 apify 团队维护,GitHub 9.4K⭐,在 智能体 分类 2166 个项目中排名第 203
为什么诞生?随着apify和automation在智能体中的普及,apify打造了crawlee-python作为一站式解决方案。
能干什么?核心场景:beautifulsoup、crawler、crawling
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 pip 安装和虚拟环境配置。
🔗 github.com/apify/crawlee-python | 官网 https://crawlee.dev/python/
🔗 github.com/apify/crawlee-python | 官网 https://crawlee.dev/python/
标签
apifyautomationbeautifulsoupcrawlercrawlingheadlessheadless-chromeparselpipplaywrightpythonscraperscrapingseleniumweb-crawlerweb-crawlingweb-scraping