eBay 在其全球市场上处理的 实时商品刊登数量超过 23 亿条。如果你曾经试过手动追踪竞品价格、研究已售商品的对比成交价,或者只是想从其中一小部分页面里搭一个产品数据库,那你其实已经知道答案:这根本没法规模化。
我在 Thunderbit 做自动化工具开发很多年了,而我从电商卖家、转售商和分析师那里最常听到的一句话是:找到一个 eBay 爬虫不难,难的是找到一个在 eBay 开始反制时还能继续跑的爬虫——比如遇到 CAPTCHA、IP 封禁和会话指纹识别。某位 Reddit 用户形容,想跨过 eBay 的验证墙“可能要尝试好几分钟,十到十五次才过得去”(来源),而 eBay 社区里的另一位发帖者则表示,他们在“3 个不同的浏览器和 2 个不同的网络”上都遇到了同样的问题(来源)。
这就是 2026 年 eBay 数据抓取的真实情况,也是这篇文章的出发点。我横向评测了 9 款工具,覆盖 Chrome 扩展、桌面应用、云端 API 和企业级平台——Thunderbit、Octoparse、Apify、ScrapingBee、Bright Data、ParseHub、Oxylabs、Crawlbase 和 Helium Scraper——而且我做了大多数同类文章都会跳过的事:把浏览器扩展类爬虫单独列成一个类别,把价格统一换算成“每 1,000 页成本”,还比较了各工具面对 eBay 当前反爬机制时的真实表现。
为什么 2026 年还要抓取 eBay 数据?
企业抓取 eBay 的原因其实没怎么变,但紧迫性更强了。eBay 在 2025 年第四季度及全年财报中披露,其平台拥有 1.35 亿活跃买家,而像盲盒这类品类还出现了 同比增长 470%+。市场上的定价信号和需求变化已经大到不可能靠人工盯。
常见应用场景可以这样分:
| 使用场景 | 所需数据 | 抓取的价值 |
|---|---|---|
| 竞品价格监控 | 标题、价格、运费、成色、卖家、促销信息 | 不用再手动刷新搜索结果,直接响应真实上架变化 |
| 已售商品需求分析 | 已售/已完成刊登、成交价、售出日期、成色、卖家数量 | 在进货前验证需求并估算可比成交价 |
| 产品目录搭建 | 标题、商品属性、图片链接、品牌、UPC/MPN、类目 | 把 eBay 刊登整理成结构化产品数据库 |
| 卖家情报分析 | 卖家名称、反馈评分、售出数量、店铺库存、退货政策 | 识别头部卖家、代发货卖家和定价模式 |
| 供应链选品与货源挖掘 | 店铺页面、所在地、批量数量、运费、可售库存 | 寻找重复卖家或稳定货源 |
这里有两个大多数指南都会忽略的关键点。第一,eBay 的官方 API 对实时市场数据的覆盖还算可以,但并不能覆盖所有场景。第二,已售/已完成刊登数据恰恰是用户最容易卡住的地方。eBay 的 Marketplace Insights API 仍处于 Limited Release,按类目限制开放,而且只允许特定获批用途。2025 和 2026 年的社区帖子显示,很多未获批准的开发者都在问,在旧的 findCompletedItems 接口下线后还能有哪些替代方案。
如果你的业务依赖价格对比、已售价格研究或商品动销追踪,那么网页抓取往往就是唯一现实的路。
eBay API vs. 网页抓取:一个更诚实的选择框架
在选工具之前,先想清楚你是不是真的需要爬虫。要是 eBay API 已经覆盖你的流程,那它更干净,也完全合规。但如果你需要已售数据、更完整的页面内容,或者任何超出 API 暴露字段的内容,网页抓取就会更实际。
| 因素 | eBay 官方 API | 网页抓取 |
|---|---|---|
| 获取在售刊登 | 可以,通过 Browse API | 可以,所有工具都支持 |
| 获取已售/已完成数据 | 受限——Marketplace Insights 只做有限开放 | 可以,只要页面可公开访问 |
| 频率限制 | 严格——默认每个应用每天 5,000 次调用,搜索结果上限 10,000 条 | 取决于工具、代理和反爬处理能力 |
| 数据丰富度 | 结构化,但只限于公开字段 | 可拿到完整页面内容,包括卖家备注、图片、商品属性 |
| 配置复杂度 | OAuth、应用注册、生产环境审批 | 从两次点击到自定义代码不等 |
| 法律明确性 | eBay 完全授权 | 处于灰色地带——需查看服务条款并谨慎使用 |
2026 年 eBay API 的现状大概是这样:
- Finding API 已于 2025 年 2 月 4 日停用,这让许多旧的已售刊登流程失效。
- Browse API 搜索结果被限制在 10,000 条。
- Marketplace Insights API(已售商品历史数据所在)并没有向所有人开放。
这就是本文后半部分的判断框架:当官方 API 不够用时,该用什么。
什么样的 eBay 爬虫才算优秀?我们的评估标准
我用 8 个维度来评估这 9 款工具,这些维度基本都对应我从用户那里最常听到的痛点:
- 易用性——非技术卖家能不能不写代码就把 eBay 数据抓出来?
- eBay 反爬应对能力——是否真的能扛住限流、验证码和指纹识别?
- 标准化价格——能否不用拆解复杂计费方式,就估算出每 1,000 页的可用成本?
- 导出格式——数据能否顺利导出到 CSV、Excel、JSON、Sheets 或 API?
- 子页面补充——能否从搜索结果页出发,再逐个进商品页补更多字段?
- 定时任务——能否自动重复运行,用于价格监控或库存追踪?
- 工具类型——浏览器扩展、云端 API 还是桌面应用,会影响安装、维护和登录处理方式。
- 免费版或试用——小卖家通常会先试再决定要不要付费。
这些标准反映的就是用户真实会抱怨的问题。论坛里大家反复提到的不是“功能不够炫”,而是被封、API 限制,或者需要一个不用代理栈的无代码方案。成本当然重要,但前提是爬虫得先撑得住足够多的页面,才谈得上价值。
为什么浏览器扩展类 eBay 爬虫也该上榜
大多数“最佳 eBay 爬虫”榜单只盯着 API、代理平台或桌面构建器,忽略了一个真实存在的需求类别。2025 年 Reddit 上 r/eBaySellers 的一条帖子 就明确在找一种浏览器扩展或软件,用来在竞价前自动比较已售价格。浏览器扩展类工具就是为这种场景准备的。
| 因素 | Chrome 扩展(如 Thunderbit) | 云端 API(如 ScrapingBee) | 桌面应用(如 Octoparse) |
|---|---|---|---|
| 安装时间 | 2 分钟内 | 10–30 分钟 | 5–15 分钟 |
| 是否需要编程 | 不需要 | 通常需要 | 通常不需要 |
| 能否在 eBay 登录态下工作 | 可以,使用浏览器抓取模式 | 需要会话或 Cookie 处理 | 有时可以 |
| 反爬处理方式 | 直接使用你的真实浏览器会话 | 内置代理轮换 | 取决于具体配置 |
浏览器扩展类爬虫不一定是大规模场景下最便宜的,但它们解决的是另一类问题:让非技术用户直接抓取自己正在浏览的页面,包括登录状态下的内容。
9 款最佳 eBay 爬虫一览
在详细展开之前,先看总表。价格说明:下面的“每 1K 页成本”尽量采用厂商最低可用付费档位。对于按月订阅但不按页计费的桌面工具,估算默认你的 1,000 页任务能在一个计费月内完成。Helium Scraper 的价格则按一次性授权费用摊销到 10,000 页计算。
| 工具 | 工具类型 | 易用性 | eBay 反爬能力 | 每 1K 页成本(估算) | 导出格式 | 子页面补充 | 定时任务 | 免费版 | 最适合 |
|---|---|---|---|---|---|---|---|---|---|
| Thunderbit | Chrome 扩展 + 云端 | 非常容易 | 高 | $12.67–$30 | CSV、JSON、Excel、Sheets、Airtable、Notion | 支持 | 支持 | 有 | 新手、无代码用户 |
| Octoparse | 桌面端 + 云端 | 容易–中等 | 中高 | $83–$299 | CSV、Excel、JSON、HTML、XML、DB、API | 部分–支持 | 支持 | 有 | 可视化流程搭建 |
| Apify | 云市场 | 中等 | 中高 | $5–$50+ | JSON、CSV、Excel、API | 部分 Actor 支持 | 支持 | 有 | 灵活的云端工作流 |
| ScrapingBee | API | 中等 | 高 | $0.91–$2.16 | HTML、JSON、自定义提取 | 需自定义 | 外部实现 | 试用 | 开发者 |
| Bright Data | 企业级 API + 数据集 | 中等–困难 | 非常高 | $1.30–$1.50 | JSON、CSV、API、交付式输出 | 支持 | 支持 | 有 | 企业级采集 |
| ParseHub | 桌面端 + 云端 | 中等 | 中等 | $189+ | JSON、CSV、Sheets | 手动 | 付费方案 | 有 | 免费小项目 |
| Oxylabs | API | 中等–困难 | 非常高 | $1.10–$1.35 | HTML、交付式输出 | 需自定义 | 支持 | 试用 | 高并发全球数据 |
| Crawlbase | API | 中等 | 中高 | $4.00–$4.90 | JSON、CSV、Excel | 需自定义 | 支持 | 有(20K 请求) | 匿名 API 抓取 |
| Helium Scraper | Windows 桌面端 | 中等–困难 | 中等 | $9.90–$19.90(摊销后) | CSV、XLSX、JSON、XML | 手动 | 部分支持 | 试用 | 离线 Windows 项目 |
下面开始逐个拆解。
1. Thunderbit
Thunderbit 是你想抓 eBay、但又不想自己搭流程、配代理或者写任何代码时最省心的方案。虽然我对它有点偏向——毕竟是我们团队做的——但产品的使用路径和实际工作流完全一致:打开 eBay 搜索页或商品页,点 AI Suggest Fields,再点 Scrape。对新手来说,这比堆一堆功能更重要。
eBay 抓取核心功能
Thunderbit 提供了专门的 eBay 爬虫模板,明确支持搜索页、品牌页和类目页。已验证字段包括 product name、price、member price、item number、rating 和 review count。
它在 eBay 场景下的优势主要有:
- AI Suggest Fields 会自动读取 eBay 页面并推荐列字段,不用 CSS 选择器,也不用手动映射
- Scrape Subpages 会逐个进入商品页,补充更多列,比如成色、卖家信息、运费或商品属性。这正是把浅层搜索结果列表变成完整产品数据库的关键功能。
- 浏览器抓取模式 使用你真实的 Chrome 会话,对登录态页面尤其有用,而且比纯机器人会话更不容易失效
- 云端抓取 可一次处理最多 50 个公开页面
- 内置定时任务,适合循环价格监控
- 可免费导出到 Excel、Google Sheets、Airtable、Notion、CSV 和 JSON,不会把导出功能锁起来
价格、优点与局限
- 免费版,包含有限试用额度
- Starter:15 美元/月(按年付约 9 美元/月),每月 500 credits
- Pro 1:38 美元/月(按年付约 24 美元/月),每月 3,000 credits
- 1 credit = 1 行输出
对应的大致成本为:
- Starter:约 每 1,000 行/页 30 美元
- Pro 1:约 每 1,000 行/页 12.67 美元
优点:
- 本榜单里上手最快——从安装到出数据不到 2 分钟
- 不用代码、不用选择器、不用代理配置
- AI 对 eBay 页面变动的适应性比固定模板更强
- 单个工作流就能完成子页面补充
- 导出支持很全,而且不额外收费
局限:
- Credit 计费很透明,但在超大规模行数下成本会升高
- 它更偏浏览器工作流,而不是独立的企业级 API
- 一些 Trustpilot 用户提到,在某些网站上分页会在有限页数后停止
如果你是卖家、研究人员或分析师,希望尽快把 eBay 页面变成表格,Thunderbit 会是我优先推荐的起点。
2. Octoparse
Octoparse 现在是面向 eBay 的传统无代码桌面爬虫里最强的一个。它有活跃的 eBay 专用模板、云端模式和定时任务。它没有 Thunderbit 那么直接,但如果你想要可视化工作流构建器,它的可配置性更强。
它的 eBay 模板已验证可输出的字段包括 Title、Product_URL、Price、Condition、Shipping、Rating、Followers、Sales、Seller_Name、Positive_feedback 和 Ebay_item_number 等组合。
价格、优点与局限
- 有免费方案
- Standard:83 美元/月(按年付 69 美元/月)
- Professional:249 美元/月
- Enterprise:定制定价
优点:
- 在桌面无代码工具里,当前 eBay 模板覆盖最强
- 本地控制和云端自动化之间平衡得不错
- 定时任务和导出功能已经很成熟
- 支持 CSV、Excel、JSON、HTML、XML、数据库、Google Sheets、Dropbox、S3、Zapier 和 API 访问
局限:
- 实际成本可能会因附加项上升——住宅代理需额外付费(约 3 美元/GB),验证码识别也要额外收费(约每 1,000 次 1–1.5 美元)
- 对快速上手来说,不如 Thunderbit 顺手
- 在非常动态的页面或需要手动调整流程时,可能不够稳
- 没有 Thunderbit 那种一键式 AI 子页面补充能力
如果你知道自己会反复抓 eBay,而且希望在不写代码的情况下用模板和云端自动化,Octoparse 是一个更稳妥的可视化选择。更详细的对比可参考我们的 Octoparse 评测与替代方案。
3. Apify
Apify 不是单一的 eBay 爬虫,而是一个 eBay 专用 “Actor” 的市场。这既是它最大的优势,也是最大的风险。如果你选中了一个维护得不错的 Actor,它的性价比会非常高;但如果维护者在 eBay 页面变化后不再更新,你就得自己承担不稳定性。
有些 Actor 能输出很丰富的字段,比如 seller details、watchCount、soldCount、availableQuantity、shipping terms 和 return policies。甚至还有专门的 eBay sold-listings scraper Actor,这对转售商和可比成交价研究来说非常有价值。
价格、优点与局限
- 平台方案:Free、Starter 29 美元、Scale 199 美元、Business 999 美元,另加用量费用
- 示例 eBay Actor 的价格大约从每 1,000 个产品 5 美元到每 1,000 条结果 50 美元不等,具体取决于 Actor
优点:
- 灵活性很强——可以快速测试多个 eBay 抓取流程
- 适合想把云端运行和导出结合起来的开发者、分析师
- 原生支持定时任务、API 访问,以及 JSON、CSV、Excel 的数据集导出
- 一些 Actor 已经可以处理“搜索页到详情页”或已售数据流程
局限:
- Actor 质量取决于维护者——最好把每个 Actor 都当成一个小供应商来看
- 总成本可能会悄悄升高,因为平台用量、存储、代理和 Actor 费用并不总会在一张简单账单里体现
- 对非技术用户来说,市场化的产品模式可能有点绕
如果你想要的是“可选很多的爬虫市场”,而不是单一产品思路,Apify 是最合适的。更深入的比较可查看我们的 Apify 评测与替代方案。
4. ScrapingBee
ScrapingBee 最适合开发者:他们想要的是一个简单的 API 调用,而不是可视化工具。它会在后台处理代理、无头渲染和反爬基础设施,而解析逻辑基本交给你自己。
ScrapingBee 有专门的 eBay 爬虫落地页,支持 JavaScript 渲染、高级代理轮换、地理位置定位,以及 CSS/XPath + AI 提取 这类结构化输出方式。
价格、优点与局限
按每页大约 11 credits 的混合 eBay 工作负载假设,当前定价 约合:
- Freelance:每 1,000 页约 2.16 美元
- Business:每 1,000 页约 0.91 美元
优点:
- 面向开发者的简洁 API
- 反爬能力强,不需要自己搭代理栈
- 很适合定制化的 eBay 数据管道
局限:
- 需要写代码——没有面向非技术用户的可视化构建器
- 没有原生的“子页面补充”按钮;循环逻辑要自己写
- 真正成本取决于是否需要 JS 渲染和高级代理模式
如果你的团队已经会解析 HTML,只是想要一个稳定的抓取层,ScrapingBee 就是合适答案。
5. Bright Data
Bright Data 是本次榜单里最接近企业级生产环境的选择。它把抓取基础设施、代理网络、数据集交付和 eBay 专用产品 结合在一起。如果你需要很高吞吐量,或者更愿意直接买现成数据而不是维护抓取代码,Bright Data 值得列入候选。
它的核心能力包括带 eBay 明确模板的 Web Scraper API、批处理任务、带 webhook 交付的定时采集,以及购买预采集 eBay 数据集的选项,数据可覆盖标题、价格、竞价、图片、运费、卖家信息和已完成交易流程。
价格、优点与局限
- 按量付费的 Web Scraper API:每 1,000 条记录约 1.50 美元
- Scale 方案的有效费率:每 1,000 条记录约 1.30 美元
- 数据集价格因内容而异
- 有免费版(每月 5,000 credits,无需信用卡)
优点:
- 企业团队里整体可靠性最高之一
- 获取 eBay 数据的方式很多:API、浏览器自动化、数据集
- 住宅代理和解锁基础设施很强
- 如果你更看重稳定性而不是易用性,它比大多数工具都更合适
局限:
- 仪表盘复杂,上手门槛高
- 对个人项目或小卖家来说偏贵
- 对轻量项目来说有点“大炮打蚊子”
如果 eBay 抓取不是边缘任务,而是核心数据管道的一部分,Bright Data 会是很强的选择。
6. ParseHub
ParseHub 仍然能用,尤其是如果你想找一款带免费版的经典桌面爬虫,但它已经不是 eBay 场景下最精致的可视化方案了。其 官方 eBay 教程 覆盖搜索结果、商品页和分页,已验证字段包括 product name、URL、price、days left、shipping cost、units sold、seller name、seller rating 和 seller review count。
价格、优点与局限
当前价格:
- 有免费方案,但限制较多(每次运行约 200 页、公共项目限制等)
- Standard:189 美元/月
- Professional:599 美元/月
优点:
- 有免费版本,适合实验
- 能处理 JavaScript 页面、点击和分页
- 对可视化抽取来说,界面比较适合教学和学习
局限:
- 在 eBay 工作流上,比 Thunderbit 或 Octoparse 更手动
- 免费版对真正的重复性工作来说限制太多
- 反爬能力弱于更高级的 API 产品
- 对外公开的 eBay 指南比竞品更老
ParseHub 仍适合小项目和学习用途,但在这个类别里已经不是最强的无代码推荐。更多细节可参考我们的 ParseHub 评测与替代方案。
7. Oxylabs
Oxylabs 是面向重视吞吐量、并发和全球覆盖的团队的高端方案。它不是这里最容易上手的工具,但如果配合成熟的解析管道,它是最稳的一类。
Oxylabs 为搜索、商品和通用 URL 抓取提供 eBay 目标,支持高覆盖率全球代理、调度器,以及用于更难页面的无头浏览器产品。
价格、优点与局限
公开价格:
- 不带 JS 的情况下约每 1,000 结果 1.15 美元
- 启用 JS 时约每 1,000 结果 1.35 美元
- Headless Browser 另起价,约 300 美元/月起
优点:
- 很适合高并发、全球化抓取
- 代理和反爬基础设施强大
- 比起个人用户,更适合企业买家
局限:
- 需要写代码
- 搜索和商品输出往往更偏 HTML 原始数据,解析逻辑要自己处理
- 已售商品流程可以做,但不是开箱即用的独立产品
如果你正在搭建一个认真的电商数据采集团队,Oxylabs 是 API 层最强的选择之一。
8. Crawlbase
Crawlbase(前身为 ProxyCrawl)处在预算型 API 工具和高端企业级方案之间。它提供 API-first 路径,带 CAPTCHA 绕过和轮换 IP,而且不要求你直接上企业级投入。
Crawlbase 有专门的 eBay 爬虫页面,支持匿名云端抓取、CAPTCHA 绕过、IP 轮换,以及面向 JSON/CSV/Excel 的输出。
价格、优点与局限
当前价格:
- 前 20,000 次请求免费
- 普通页面请求每 1,000 次 4.90 美元
- JS 渲染请求每 1,000 次 4.00 美元
优点:
- 免费额度对测试很有用
- API 入口简单
- 比自己写的普通脚本更能应对反爬
局限:
- 仍然需要编程
- 在 eBay 专属性上,不如 Bright Data 那么完整
- 面向非开发者的流程功能较少
如果你想要的是一个匿名 API 爬虫,而且希望试用门槛低,Crawlbase 很有吸引力。
9. Helium Scraper
Helium Scraper 是本榜单中的异类。它是 Windows 桌面软件,采用一次性授权模式。它不是为新手优先设计,但如果你想要本地控制、又不喜欢每月订阅,它会很有吸引力。
它的功能包括点选式抽取界面、自定义 JavaScript 动作、并行浏览器支持,以及导出到 CSV、XLSX、JSON 和 XML 的强大能力。它还支持 命令行自动化。
价格、优点与局限
- Basic:99 美元
- Professional:199 美元
- Business:399 美元
- Enterprise:699 美元
如果把授权费用摊销到 10,000 页,估算成本为:
- Basic:约每 1,000 页 9.90 美元
- Professional:约每 1,000 页 19.90 美元
优点:
- 一次性购买,没有月费
- 适合离线或本地项目
- 如果你愿意自己搭抓取逻辑,灵活性不错
局限:
- 仅支持 Windows
- 不包含云端、解锁器或代理栈
- 没有官方现成的 eBay 模板
- 学习曲线比第一眼看上去更陡
- 没有 AI 字段建议或子页面补充能力
Helium Scraper 更适合熟悉技术的 Windows 用户,他们想要的是本地桌面工具,而不是最省事的工作流。
每 1,000 页成本:别人都没给的价格对比
不同厂商按行数、请求数、记录数、credits 或月度席位收费,直接比会很乱。我看过 6 篇竞争对手的“最佳 eBay 爬虫”文章里有 5 篇都列了价格,但没有一篇把它统一成标准指标。与此同时,用户又总是把成本列为最大的门槛之一。
下表使用的是最低付费档位,在有必要时也会用中间档或规模档。它不完美——有些工具按输出行计费,有些按请求计费——但比单看月费更有参考价值。
| 工具 | 最低付费档位 | 中间/规模档位 | 每 1K 页成本(估算) | 是否包含代理/渲染 | 备注 |
|---|---|---|---|---|---|
| Thunderbit | Starter | Pro 1 | $30 / $12.67 | 包含 | 1 credit = 1 行 |
| Octoparse | Standard | Professional | $83 / $299 | 不包含 | 代理和验证码额外收费 |
| Apify | 取决于 Actor | 取决于 Actor | $5–$50+ | 部分包含 | Actor 费用 + 平台用量 |
| ScrapingBee | Freelance | Business | $2.16 / $0.91 | 大部分包含 | 取决于 JS/代理 credit 组合 |
| Bright Data | 按量付费 | Scale | $1.50 / $1.30 | 大部分包含 | 按记录计费 |
| ParseHub | Standard | Professional | $189 / $599 | 部分包含 | 更偏订阅方案而不是按页计费 |
| Oxylabs | Micro | Starter | $1.15–$1.35 / $1.10–$1.30 | 大部分包含 | JS 和无头浏览器会抬高成本 |
| Crawlbase | 普通页面 | JS 渲染 | $4.90 / $4.00 | 大部分包含 | 按请求计费 |
| Helium Scraper | Basic 授权 | Professional | $9.90 / $19.90(摊销后) | 不包含 | 一次性桌面授权 |
从规模角度看,哪些工具最划算?
- 每月少于 5K 页:如果你更看重速度而不是纯经济性,Thunderbit 很合理。Crawlbase 的免费额度和 Apify 的小型 Actor 也能胜任。
- 每月 5K 到 50K 页:ScrapingBee、Bright Data、Oxylabs,以及更成熟的 Apify Actor,通常比按行计费的无代码工具更划算。
- 每月 50K+ 页:Bright Data 和 Oxylabs 是最站得住脚的企业级选择。如果你已经信任某个 Actor 和它的平台模型,Apify 也能用。
一个常见但隐藏的成本模式是:桌面和无代码工具往往把成本藏在附加项或人工时间里,而 API 工具则会把成本藏在渲染倍数、代理类型或提取复杂度里。
2026 年哪些 eBay 爬虫真的能扛住反爬?
eBay 的反爬体系是分层的。近期社区反馈、厂商文档和反机器人研究都指向同一个模式:eBay 使用限流、验证码挑战、依赖 JavaScript 的验证、Cookie/会话检测、IP 信誉判断以及浏览器指纹识别。这也是为什么那么多脆弱脚本即使能抓到一两页,也很快就失效。
第三方机器人数据也说明了为什么市场类网站越来越难抓。Akamai 报告称,2024 年机器人占了 42% 的网页流量,而 Radware 发现,在 2024 年购物季,机器人占到了 57% 的线上购物流量。
| 工具 | 反爬策略 | 住宅代理 | 验证码处理 | 在 eBay 上的典型成功率 |
|---|---|---|---|---|
| Thunderbit | 浏览器模式下使用真实浏览器会话;云端模式为公开页面提供内置路由 | 云端模式内置 | 云端模式可处理 | 对非技术工作流来说很高 |
| Octoparse | 云端抽取 + IP 轮换 | 付费方案/附加项可用 | 通过云端栈支持 | 中高 |
| Apify | 取决于 Actor;通常是 Playwright + 代理支持 | 可用 | 因 Actor 而异 | 如果 Actor 维护得好则中高 |
| ScrapingBee | 渲染后的浏览器抓取 + 高级代理 | 是,走高级路由 | 属于托管栈的一部分 | 高 |
| Bright Data | Unlocker + 住宅网络 + 浏览器自动化 | 是 | 是 | 非常高 |
| ParseHub | 桌面/浏览器模拟 + 付费 IP 轮换 | 部分 | 部分 | 中等 |
| Oxylabs | 住宅/ISP/移动代理 + Scraper API + 无头浏览器 | 是 | 平台级托管 | 非常高 |
| Crawlbase | 匿名 API + 轮换 IP + CAPTCHA 绕过 | 托管 | 托管 | 中高 |
| Helium Scraper | 用户自建浏览器自动化;如配置可用代理 | 自备 | 手动/用户管理 | 中等 |
数据中心代理 vs. 住宅代理:那场老争论
这是少数厂商建议和用户体验能高度一致的领域之一。Apify 的 Actor 文档明确警告,eBay 会更积极地封禁数据中心 IP,并建议使用住宅代理。Oxylabs 在其 eBay 代理页面上也持相同观点。说白了就是:数据中心 IP 更便宜,但要持续稳定地抓 eBay,住宅代理或 ISP 流量更可能扛得住。
这也是为什么从反爬角度看,Thunderbit 的浏览器模式很有意思。它不是从一个全新的云端机器人身份开始,而是直接基于用户真实浏览器会话运行,从而绕开了常见爬虫指纹问题中的一部分。
超越搜索结果页:已售商品、子页面和完整产品数据库
大多数 eBay 抓取项目不会止步于搜索结果页。真正的流程通常分三步:
- 抓取搜索结果页或已售结果页
- 进入每个商品链接
- 把更丰富的详情字段追加到同一张合并表里
这才是严肃商品研究需要的流程,因为搜索页通常不会包含全部信息。商品属性、成色说明、卖家政策、运费详情以及更完整的描述字段,往往都在详情页里。
这也是 eBay API 缺口最关键的地方。官方 API 适合在售商品,但已售/已完成数据依然受限。如果你需要可比成交价、转售验证或已完成刊登的历史价格研究,除非你的组织已经拿到了 Marketplace Insights 的访问权限,否则网页抓取仍然是最现实的方法。
这里不同工具的差异很大:
- Thunderbit 通过 Scrape Subpages 原生支持这一流程——这是它对非技术用户最大的优势之一。点一下按钮,AI 就会逐个访问商品 URL,并把新列追加到原表中。
- Octoparse 和 ParseHub 也能做到,但流程更手动,需要单独配置。
- Apify 只要对应 Actor 支持从搜索页展开到详情页,也可以完成。
- Bright Data 和 Oxylabs 当然支持,但通常需要你自己搭循环,或者直接购买结构化数据集。
- Helium Scraper 可以在本地完成,但需要手动设计项目。
如果你的目标是一个完整产品数据库,而不是只有标题和价格的浅层列表,那么子页面补充就不是可选项,而是核心流程。想了解子页面抓取在实践中怎么运作,可以看我们的 如何搭建网页爬虫 指南。
关于抓取 eBay 的合法性与伦理,简单说几句
一句话概括:抓取公开数据不一定违法,但也绝不是想抓什么就抓什么。hiQ v. LinkedIn 相关判例与《计算机欺诈与滥用法案》(CFAA)至今仍与公共网页抓取相关,而后续如 Meta v. Bright Data 争议 也强化了这样一个现实:在某些情况下,围绕公开数据抓取的法律主张依然可能在法庭上成立。
不过,eBay 现行的 用户协议 明确禁止机器人、蜘蛛程序、爬虫和数据挖掘工具,除非事先得到 eBay 的明确许可。实践中,建议用户:
- 只抓取公开可访问的数据
- 避免抓取个人数据
- 合理控制抓取频率
- 查看 eBay 最新条款和 robots 相关要求
- 商业或敏感场景下咨询律师
本文重点是工具,不是法律建议。关于更多法律层面的讨论,可参考我们的 网页抓取法律影响 文章。
哪个 eBay 爬虫最适合你?
如果你只想要一个简短的推荐矩阵:
- 最适合新手 / 无代码用户:Thunderbit —— 2 步上手、AI 字段推荐、原生子页面补充、浏览器抓取模式、可免费导出
- 最适合想要 API 的开发者:ScrapingBee —— API 简洁、反爬能力强、没有可视化负担
- 最适合企业级规模:Bright Data —— 基础设施强、支持数据集交付、住宅代理网络完善
- 最适合预构建爬虫市场:Apify —— Actor 库庞大、覆盖已售数据、云端灵活
- 最适合可视化工作流搭建(桌面端):Octoparse —— eBay 模板强、云端模式、定时任务成熟
- 最适合小项目的免费桌面工具:ParseHub —— 有免费版、能处理动态页面、适合学习
- 最适合高并发全球数据采集:Oxylabs —— 企业级代理栈、支持无头浏览器、稳定性强
- 最适合预算有限的匿名 API 抓取:Crawlbase —— 低门槛、带免费请求、CAPTCHA 绕过能力不错
- 最适合一次性授权的桌面爬虫:Helium Scraper —— 本地控制、无月费、如果你能接受配置,灵活度不错
如果你还是不确定,先选一个和你的技术水平、数据量相匹配的工具。对大多数非技术用户来说,那通常是 Thunderbit——尤其当你想把 eBay 页面两次点击就变成电子表格时。
使用 Thunderbit 试用 AI eBay 抓取 Get Started Free
了解更多


