C
crawlee
apify/crawlee
Crawlee——用于 Node.js 的 Web 抓取和浏览器自动化库,可构建可靠的爬虫。支持 JavaScript 和 TypeScript。为 AI、LLM、RAG 或 GPT 提取数据。从网站下载 HTML、PDF、JPG、PNG 等文件。兼容 Puppeteer、Playwright、Cheerio、JSDOM 和原始 HTTP。支持有头和无头模式。带代理轮换。
★25.2kstars
TypeScript
Apache-2.0
更新: 今天
📋 项目速览
点击展开
这是什么?开源智能体项目,用TypeScript构建、核心能力在apify/automation
作者是谁?由 apify 团队维护,GitHub 25.2K⭐,在 智能体 分类 2166 个项目中排名第 80
为什么诞生?apify在智能体中的需求持续增长,apify发现现有方案不够直观,于是创造了crawlee来降低automation使用门槛。
能干什么?核心场景:crawler、crawling、headless
怎么用 AI 安装?推荐使用 AI 编码助手根据 GitHub README 自动完成 npm/pnpm 安装和项目配置。
🔗 github.com/apify/crawlee | 官网 https://crawlee.dev
🔗 github.com/apify/crawlee | 官网 https://crawlee.dev
标签
apifyautomationcrawlercrawlingheadlessheadless-chromejavascriptnodejsnpmplaywrightpuppeteerscraperscrapingtypescriptweb-crawlerweb-crawlingweb-scraping