Repository #66670819 · stable identity

crawlee|网页爬取与自动化库apify/crawlee

apify/crawleeAI 译

基于 Node.js 的网页爬取和浏览器自动化库,支持 AI、LLMs、RAG、GPTs,支持下载 HTML、PDF、JPG、PNG 文件,兼容 JSDOM 和 HTTP,支持代理轮换 Crawlee—A web scraping and browser automation library for Node.js to build reliable crawlers. In JavaScript and TypeScript. Extract data for AI, LLMs, RAG, or GPTs. Download HTML, PDF, JPG, PNG, and other files from websites. Works with Puppeteer, Playwright, Cheerio, JSDOM, and raw HTTP. Both headful and headless mode. With proxy rotation.

打开 GitHub ↗
当前 Star
24,826
作者 / 所有者
apify
主要语言
TypeScript
GitHub 创建
待补充
最近代码推送
待补充
已发布
发布天数待补充
首次发现
2026-07-16
最近追踪
2026-07-21

Decision brief

项目速览

它解决什么

基于 Node.js 的网页爬取和浏览器自动化库,支持 AI、LLMs、RAG、GPTs,支持下载 HTML、PDF、JPG、PNG 文件,兼容 JSDOM 和 HTTP,支持代理轮换

适合谁

需要智能体与自动化、RAG 与知识库、搜索与抓取能力的开发者或团队。

为什么上榜

2026-07-18 获得 1 个公开唯一加星用户,全站公开事件榜第 197 名。

中文名称、简介和分类属于辅助理解层;GitHub 原始仓库信息始终是权威来源。

Project taxonomy

方向与适用场景

项目方向
开发者工具
产品形态
库/框架
适用场景
智能体与自动化、RAG 与知识库、搜索与抓取
分类来源
GitHub Models 生成 · 词表 1.0.0

Public event history

公开事件新增历史

日期唯一新增全站名次
+1 #197

来自 GH Archive 归档的公开 WatchEvent,按用户—仓库唯一对计数;不扣除取消 Star。

30 day true history

真实历史

日期总 Star净增日榜排名
24,826 +20
24,754 +29

— 表示当日缺少有效连续快照,或项目当日不在可比较候选中;不补零,不插值。

Related repositories

相似项目

收藏这个项目

登录后,“收藏”会直接同步为你的 GitHub Star;也可以只保存在当前浏览器。