Skip to content

Latest commit

 

History

History
30 lines (28 loc) · 2.26 KB

File metadata and controls

30 lines (28 loc) · 2.26 KB

Web 抓取服务

Web 数据提取服务

  • Dataflow kit - 使用简单的点击式工具包将网站数据转换为结构化数据。
  • Crawlbase - 提供 JavaScript 渲染、反机器人处理和地理路由的网页抓取 API。
  • ProxyClaw - 住宅代理SDK,支持AI代理,2M+ IP,195+国家,反检测绕过,地理定位。pip install iploop-sdk
  • ScraperAPI - 管理代理的服务和无头浏览器,暴露一个 API 端点来抓取任何 url。
  • import.io
  • ScraperWiki
  • Mozenda
  • PhantomJs.Cloud
  • CloudScrape
  • DiffBot
  • Apify - 无服务器网络抓取、数据提取和网络自动化平台。
  • Portia - 也在 GitHub 上:scrapinghub/portia
  • Dexi
  • Morph.io - 免费,完全开源 服务。
  • Page.REST
  • ParseHub
  • WrapAPI
  • Agenty
  • ScrapingBee - 处理旋转代理和无头浏览器的网络抓取 API。
  • SearchApi - 实时 Google 及其他搜索引擎结果 API。
  • SerpApi - 访问搜索引擎结构化搜索结果的实时 API。
  • ScrapingAnt - 具有数千个住宅代理和无头 Chrome 集群的 Web Scraping API。
  • Xquik - X 数据 API,提供搜索、帖子、用户资料、关注者、媒体、监控和 Webhook。Not affiliated with X Corp.
  • Zyte(Scrapinghub) - Web 数据提取服务和平台,也是 Scrapy 的主要维护者。
  • ProxiesAPI - 具有自动重试、验证码处理和 JavaScript 渲染的旋转代理 API。
  • ZenRows - Web Scraping API 和代理服务器,可绕过任何反机器人解决方案,同时提供 JavaScript 渲染、旋转代理和地理定位。