它解决什么
基于 Node.js 的网页爬取和浏览器自动化库,支持 AI、LLMs、RAG、GPTs,支持下载 HTML、PDF、JPG、PNG 文件,兼容 JSDOM 和 HTTP,支持代理轮换
Repository #66670819 · stable identity
基于 Node.js 的网页爬取和浏览器自动化库,支持 AI、LLMs、RAG、GPTs,支持下载 HTML、PDF、JPG、PNG 文件,兼容 JSDOM 和 HTTP,支持代理轮换 Crawlee—A web scraping and browser automation library for Node.js to build reliable crawlers. In JavaScript and TypeScript. Extract data for AI, LLMs, RAG, or GPTs. Download HTML, PDF, JPG, PNG, and other files from websites. Works with Puppeteer, Playwright, Cheerio, JSDOM, and raw HTTP. Both headful and headless mode. With proxy rotation.
Decision brief
基于 Node.js 的网页爬取和浏览器自动化库,支持 AI、LLMs、RAG、GPTs,支持下载 HTML、PDF、JPG、PNG 文件,兼容 JSDOM 和 HTTP,支持代理轮换
需要智能体与自动化、RAG 与知识库、搜索与抓取能力的开发者或团队。
2026-07-18 获得 1 个公开唯一加星用户,全站公开事件榜第 197 名。
中文名称、简介和分类属于辅助理解层;GitHub 原始仓库信息始终是权威来源。
Project taxonomy
Public event history
来自 GH Archive 归档的公开 WatchEvent,按用户—仓库唯一对计数;不扣除取消 Star。
30 day true history
— 表示当日缺少有效连续快照,或项目当日不在可比较候选中;不补零,不插值。
Related repositories