~/home / tags / 爬虫

# 爬虫

24 个相关产品 · 中文解读 · 按热度排序
截至 2026-09-12,KanonAgent 库内有 24 个带「爬虫」标签的 AI agent 与工具,本页按真实热度排序。标签由中文拆解自动归纳,不是人工打的;数据可经公开 API 复核。
camofox-browser
一款专为AI代理设计的隐身无头浏览器,可绕过Cloudflare等反爬机制,替代Puppeteer/Playwright,帮助开发者高效抓取数据
Scrapling
一个自适应网络爬虫框架,支持从单页请求到大规模爬取的全流程自动化,具备智能反反爬和数据解析能力。
Clawoxy
Clawoxy 是一套智能代理路由系统,通过动态代理轮换与深度无头浏览器调优,智能匹配目标网站响应,提升爬虫成功率,专为高难度数据抓取场景设计。
LinkedIn Company Scraper
LinkedIn 公司信息爬虫工具,可将公开的公司页面 URL 转换为结构化数据,提取公司名称、行业、融资、职位等信息,适合销售、招聘和市场调研人员
Cockroach Crawler
一个开源的 Node.js 工具包,用于安全、智能地爬取网页,支持动态渲染、自适应遍历、截图、PDF 生成和结构化数据提取。
apify/apify-mcp-server
Apify MCP 服务器提供可扩展的 AI 数据采集框架,支持调用数千个现成爬虫和自动化工具,快速从社交媒体、电商等网站抓取数据。
unclecode/crawl4ai
Crawl4AI 是一个面向大语言模型的开源网页爬虫与数据抓取工具,支持智能解析和 LLM 友好输出,适合 AI 数据采集场景。
Social Scraper+
Social Scraper+ 可一键抓取 Reddit 和 X(原 Twitter)的完整帖子线程,方便内容研究、舆情分析或素材收集,适合内容创作者与研究者。
Botsol Google Maps Crawler
Botsol Google Maps Crawler 可快速从 Google Maps 抓取企业信息,生成潜在客户线索,是营销人员的自动化获客利器。
Scrapemint
一个提供90多个按行计费的网页数据抓取器的平台,专为市场调研和销售线索获取设计,支持灵活、低成本的数据采集。
10times Events Scraper
10times Events Scraper 可自动抓取10times平台的活动数据并清洗为结构化表格,适合销售与市场团队使用,亮点是高效获取高质量潜在客户线索
OmniScrape
无阻塞网页爬虫API,结合智能代理路由技术,可高效抓取反爬网站数据,适用于数据采集与监控场景。
XNXX Video Downloader
一款用于从XNXX提取视频媒体链接并存入Apify数据集的工具,适合需要批量抓取视频资源的开发者或内容研究者
CockroachCrawler–1 package for crawling,browsers,PDF,extraction,and MCP
CockroachCrawler 是一个多功能爬虫工具包,支持浏览器自动化、PDF 解析、数据提取与 MCP 协议,适合需要高效抓取与结构化数据的开发者。
ScrapeGraphAI/Scrapegraph-ai
ScrapeGraphAI是一个基于AI的智能网页爬虫框架,能自动理解页面结构并提取关键信息,适合复杂网站的数据采集任务。
1Scrape
1Scrape 是一款无需编码的快速网络爬虫工具,专为 Google 和社交媒体数据采集设计,支持高效抓取结构化信息
Trawl – a self-hosted engine for scraping sites behind challenge walls
Trawl 是一个自托管的网页爬虫引擎,可绕过验证码、挑战墙等反爬机制,适合开发者进行数据采集与监控。
KingScraper: One-Click Product Scraper
一键式商品爬虫工具,无需代码即可从Yupoo和Shopify等平台快速抓取商品信息,适合电商卖家和市场调研人员快速采集竞品数据。
schemafetch
schemafetch 是一个 API 工具,能将任意网页内容自动提取并结构化为清晰的数据格式,适合数据采集与内容分析场景
PyScrappy, self-healing web scraping selectors plus an MCP server
PyScrappy 是一个具备自愈能力的网页抓取工具,能自动修复失效的选择器,并内置 MCP 服务器,提升爬虫稳定性与维护效率
webHarvest
webHarvest 可将任意网页自动转化为结构化、持续更新的数据,适用于爬虫与数据采集场景。
ScoutLayer
API 工具,能从任意网站自动提取公开联系人信息(如邮箱、电话),适用于销售线索挖掘与市场调研
OpticParse
零CSS配置的网页抓取工具兼AI代理安全防护层,可防止爬虫被反爬机制拦截,适合AI自动化场景
MapScraper Pro
Google地图数据抓取工具,自动提取商家信息,适合市场调研、本地SEO和商业分析人员。
其他标签

常见问题

「爬虫」这个标签是怎么归的?

标签来自每个产品的中文拆解(解决什么场景、面向谁),由模型从产品自述里归纳,不是人工逐条打的,也不接受付费打标。

这里的排序依据是什么?

按库内真实热度:投票数 / MRR / 增速,取产品实际有的那个。不是编辑推荐,也不卖位置。

数据多久更新?

追踪持续进行(分钟级),本页于 2026-09-12 生成。全部数字可经公开只读 API 复核:https://kanonagent.com/data