~/home / tags / 数据采集

# 数据采集

31 个相关产品 · 中文解读 · 按热度排序
截至 2026-09-12,KanonAgent 库内有 31 个带「数据采集」标签的 AI agent 与工具,本页按真实热度排序。标签由中文拆解自动归纳,不是人工打的;数据可经公开 API 复核。
apify-mcp-server
一个为 AI 代理提供支持的自动化数据抓取服务器,让 AI 能自动从社交媒体、搜索引擎、电商网站等提取数据,适用于需要实时网络信息的 AI 应用开发者。
Context.dev
一个统一的API工具,帮助开发者一键抓取、增强和提取网络数据,解决多源数据获取与处理的碎片化问题,适合开发者和数据驱动型产品团队使用
SocLeads 3.0
SocLeads 3.0 是一个无需代码的全球社交媒体邮箱采集工具,支持从 Instagram、LinkedIn、YouTube 等平台按国家地理筛选,批量获取潜在客户邮箱。
Webclaw
Webclaw 是专为 AI 代理设计的超高效网络爬虫,以极低 token 消耗和亚毫秒级数据提取能力,解决 AI 代理在信息获取环节的性能瓶颈,适合 AI 工程师与自动化系统开发
Scrapling
一个自适应网络爬虫框架,支持从单页请求到大规模爬取的全流程自动化,具备智能反反爬和数据解析能力。
BrowserAct Cloud
仅用一个提示词即可从任意网站抓取数据,实现零代码网页数据采集
Screencap
Screencap 记录真实工作流中的屏幕操作、点击、键盘输入和窗口上下文,将这些行为转化为结构化数据,用于自动化与 AI 训练。
crw
高性能 Rust 实现的 Firecrawl/Tavily 替代方案,提供网页抓取、爬虫和搜索 API,兼容 Firecrawl 接口,专为 AI Agent 提供数据获取能力。
RapidAPI Scraper
一个基于RapidAPI的网页爬虫工具,可将API市场中的搜索结果、分类、收藏夹和主页链接转化为结构化数据集,助力开发者研究API市场与竞品分析
RedGifs Bulk Downloader
批量下载 RedGifs 公开视频的完整数据,包括直接 MP4 链接、缩略图、标签、播放量等,支持导出为 ZIP 或用于 API 工作流,适合内容采集与归档。
Argentic – An L402 Lightning toll booth for AI scraping agents
一个专为 AI 抓取代理设计的高速收费亭,解决 AI 自动化爬虫在高并发场景下的性能瓶颈与成本控制问题,面向需要大规模数据采集的 AI 开发者和研究团队
VK Videos Search Scraper
VK Videos Search Scraper 是一个用于从 VK 及 VKVideo 平台按关键词或链接抓取公开视频数据的工具,支持导出标题、链接、缩略图、互动数据等结构化信息
Uneed Scraper
一个用于自动抓取公开网页数据(如产品、类别、替代品)的爬虫工具,将信息转化为Apify数据集,服务于市场研究、初创企业调研与销售线索生成,目标用户为市场分析师与创业者。
Uline Scraper
从Uline公开页面自动抓取并结构化产品数据,提取SKU、价格、规格、图片等信息,助力采购与商品目录管理,适合B2B采购与数据采集场景
Quorel
Quorel 将公开网站自动转化为可查询、带版本记录的结构化数据集,每晚自动更新并保存变更历史,支持通过 MCP 服务器直接访问,适合需要追踪网页内容变化的研究或监控场景。
MapLeads Pro
从 Google Maps 快速提取 B2B 客户线索,支持批量搜索多个城市,一键导出企业名称、电话、邮箱等完整信息,提升销售线索获取效率。
Webstractor – Pay-as-You-Go Web Data API for AI Agents
按使用量计费的网页数据提取API,专为AI代理设计,支持动态抓取和结构化数据输出。
Foxpull
无需注册即可抓取网页数据,实时预览可提取字段,按实际爬取成本报价,支持定时导出到 Excel/Sheets,解决网页数据采集的低门槛问题。
The TikTok Investigator
The TikTok Investigator 能实时监控 TikTok 账号直播状态,并自动记录礼物、聊天和触发事件,防止直播内容消失。
G2 Products Scraper
G2 Products Scraper 可将 G2 平台的产品链接、搜索词或分类转化为结构化数据,自动提取评分、评论数、厂商信息、定价信号及竞品对比,助力销售与市场分析
I built a scraping engine where the LLM writes configs, not code
一个由大模型自动生成配置而非编写代码的网页爬虫引擎,让非技术人员也能轻松构建爬虫,解决传统爬虫开发门槛高的问题,适合需要数据采集的个人或小团队
Scrapio
一个支持JS渲染和代理管理的网页抓取API,还能监控品牌在主流大模型回答中是否被提及,面向需要数据监控和爬虫能力的开发者与企业。
DomScan
一个API服务,帮助开发者和AI代理从公开互联网信号中提取结构化数据,支持域名查询与网络信息分析
MapScraper Pro
MapScraper Pro 可自动从 Google Maps 抓取企业数据,支持按关键词和城市/国家筛选,获取名称、地址、电话、网站、评分等信息。
Social Scraper+
Social Scraper+ 是一款 Chrome 扩展,可本地抓取 Reddit 和 X(原 Twitter)帖子的评论与回复,支持导出为 CSV、JSON 或 AI 处理,适
Agent API Gateway
专为AI代理设计的结构化网页数据API,可将任意URL转化为干净的JSON数据,替代脆弱的网页爬虫,提升AI应用数据获取效率
XNXX Video Downloader
将公开的XNXX视频链接转换为结构化数据集,提取标题、缩略图、视频链接等信息,用于内容归档、分析或自动化处理
Etherscan Scraper
Etherscan Scraper 允许用户无需API密钥即可从Etherscan提取顶级ETH持有者、Gas费快照和代币排行榜等数据,为加密分析、开发者和运营团队提供干净的原始数
GeoLeads
GeoLeads 是一款桌面软件,可实时抓取谷歌地图上的本地企业信息,提取邮箱、电话等数据,替代高价过时的销售线索列表。
Buffering Britain
一款用于测试并上报英国各地手机信号质量的工具类应用,帮助用户参与改善英国糟糕的移动网络覆盖问题,适合关心通信基础设施的普通用户和环保/技术爱好者。
Webstractor
Webstractor 是一个按使用量计费的网页数据 API,专为 AI 代理和开发者设计,可精准抓取网页结构化数据,解决数据获取的合规与效率难题。
其他标签

常见问题

「数据采集」这个标签是怎么归的?

标签来自每个产品的中文拆解(解决什么场景、面向谁),由模型从产品自述里归纳,不是人工逐条打的,也不接受付费打标。

这里的排序依据是什么?

按库内真实热度:投票数 / MRR / 增速,取产品实际有的那个。不是编辑推荐,也不卖位置。

数据多久更新?

追踪持续进行(分钟级),本页于 2026-09-12 生成。全部数字可经公开只读 API 复核:https://kanonagent.com/data