eBay xử lý hơn 2 tỷ tin đăng đang hoạt động mỗi ngày trên toàn bộ thị trường toàn cầu của mình. Nếu từng cố theo dõi giá đối thủ thủ công, nghiên cứu dữ liệu các tin đăng đã bán, hoặc xây dựng cơ sở dữ liệu sản phẩm từ chỉ một phần nhỏ trong số đó, bạn sẽ biết câu trả lời: cách làm thủ công không thể масштаб hóa.
Tôi đã dành nhiều năm xây dựng các công cụ tự động hóa tại Thunderbit, và điều tôi nghe đi nghe lại từ các nhà bán hàng ecommerce, reseller và nhà phân tích là: tìm được một eBay scraper không phải là phần khó nhất. Phần khó là tìm một công cụ vẫn hoạt động sau khi eBay bắt đầu chặn bằng CAPTCHA, khóa IP và lấy dấu vân tay phiên truy cập. Một người dùng Reddit mô tả việc phải mất "vài phút thử đi thử lại, có lẽ 10-15 lần mới vượt qua được" các lớp xác minh của eBay, trong khi một bài đăng trên cộng đồng eBay nói rằng họ gặp lỗi trên "3 trình duyệt khác nhau và 2 mạng khác nhau".
Đó là thực tế của việc thu thập dữ liệu eBay trong năm 2026, và cũng là bối cảnh của hướng dẫn này. Tôi đã đánh giá 9 công cụ trải dài từ tiện ích mở rộng Chrome, ứng dụng desktop, API đám mây cho đến nền tảng enterprise — Thunderbit, Octoparse, Apify, ScrapingBee, Bright Data, ParseHub, Oxylabs, Crawlbase và Helium Scraper — và làm một việc mà đa số bài so sánh khác bỏ qua: đưa cả scraper dạng tiện ích mở rộng trình duyệt vào cùng nhóm, chuẩn hóa giá theo chi phí trên mỗi 1.000 trang, và so sánh cách từng công cụ thực sự xử lý lớp chống bot hiện tại của eBay.
Dùng thử Thunderbit cho việc thu thập dữ liệu eBay
Vì sao nên thu thập dữ liệu eBay trong năm 2026?
Lý do doanh nghiệp thu thập dữ liệu từ eBay không thay đổi quá nhiều, nhưng tính cấp thiết thì đã tăng lên. Với 135 triệu người mua đang hoạt động được công bố trong kết quả Q4/FY2025 của eBay và các danh mục như blind box tăng trưởng hơn 470% so với cùng kỳ, thị trường này đang tạo ra tín hiệu giá và nhu cầu quá lớn để theo dõi bằng tay.
Dưới đây là các trường hợp sử dụng chính:
| Trường hợp sử dụng | Dữ liệu cần có | Vì sao thu thập dữ liệu lại hữu ích |
|---|---|---|
| Theo dõi giá đối thủ | Tiêu đề, giá, phí vận chuyển, tình trạng, người bán, khuyến mãi | Phản ứng theo thay đổi thực tế của tin đăng thay vì tự kiểm tra kết quả tìm kiếm |
| Nghiên cứu nhu cầu từ tin đã bán | Tin đăng đã bán/hoàn tất, giá cuối, ngày bán, tình trạng, số lượng người bán | Xác thực nhu cầu và ước tính giá so sánh trước khi nhập hàng |
| Xây dựng danh mục sản phẩm | Tiêu đề, thông số sản phẩm, URL ảnh, thương hiệu, UPC/MPN, danh mục | Biến tin đăng eBay thành cơ sở dữ liệu sản phẩm có cấu trúc |
| Phân tích người bán | Tên người bán, điểm phản hồi, số món đã bán, tồn kho cửa hàng, chính sách đổi trả | Xác định người bán hàng đầu, dropshipper và mô hình giá |
| Tìm nguồn cung ứng | Trang cửa hàng, vị trí, số lượng theo lô, phí vận chuyển, số lượng còn lại | Tìm người bán lặp lại hoặc nguồn hàng |
Có hai điểm quan trọng mà hầu hết các hướng dẫn thường bỏ qua. Thứ nhất, API chính thức của eBay có thể xử lý khá tốt dữ liệu thị trường đang hoạt động, nhưng không bao phủ mọi trường hợp sử dụng. Thứ hai, dữ liệu tin đăng đã bán/hoàn tất chính là nơi người dùng thường gặp rào cản API. Marketplace Insights API của eBay đang ở trạng thái Limited Release, giới hạn theo danh mục và chỉ dành cho các trường hợp sử dụng đã được phê duyệt. Các bài đăng cộng đồng từ năm 2025 và 2026 cho thấy những nhà phát triển chưa được phê duyệt đang hỏi rõ còn cách nào khác sau khi endpoint findCompletedItems cũ đã bị gỡ bỏ.
Nếu doanh nghiệp của bạn phụ thuộc vào giá so sánh, nghiên cứu giá bán đã chốt hoặc theo dõi tốc độ bán sản phẩm, thì web scraping thường là con đường thực tế duy nhất.
API eBay vs. Web Scraping: Khung ra quyết định thẳng thắn
Trước khi lao vào chọn công cụ, đáng để tự hỏi liệu bạn có thật sự cần scraper hay không. Nếu API của eBay đã đáp ứng được quy trình làm việc của bạn, đó là cách sạch sẽ và hoàn toàn được phép. Nhưng nếu bạn cần dữ liệu đã bán, nội dung trang phong phú hơn, hoặc bất cứ thứ gì vượt ngoài các trường API hiển thị, thì scraping trở thành lựa chọn thực tế.
| Yếu tố | API chính thức của eBay | Web Scraping |
|---|---|---|
| Truy cập tin đăng đang hoạt động | Có, qua Browse API | Có, với mọi công cụ |
| Truy cập dữ liệu đã bán/hoàn tất | Bị giới hạn — Marketplace Insights là Limited Release | Có, nếu trang được truy cập công khai |
| Giới hạn tốc độ | Rất nghiêm ngặt — mặc định 5.000 lệnh/ngày cho mỗi app, tìm kiếm bị chặn ở 10.000 kết quả | Tùy công cụ, proxy và cách xử lý anti-bot |
| Độ giàu dữ liệu | Có cấu trúc nhưng chỉ trong phạm vi các trường được công khai | Toàn bộ nội dung trang, gồm ghi chú người bán, ảnh, thông số sản phẩm |
| Độ phức tạp khi thiết lập | OAuth, đăng ký app, duyệt production | Từ 2 cú nhấp chuột đến code tùy chỉnh |
| Mức độ rõ ràng về pháp lý | Được eBay cho phép hoàn toàn | Vùng xám — cần xem ToS và sử dụng có trách nhiệm |
Bức tranh API eBay hiện tại trong năm 2026:
- Finding API đã bị ngừng hoạt động vào ngày 4 tháng 2 năm 2025, làm hỏng nhiều workflow cũ liên quan đến tin đăng đã bán.
- Kết quả tìm kiếm của Browse API bị giới hạn ở tập kết quả 10.000 mục.
- Marketplace Insights API, nơi lưu lịch sử món hàng đã bán, không mở cho tất cả mọi người.
Đó là khung để hiểu phần còn lại của bài viết này: nên dùng gì khi API chính thức là chưa đủ.
Điều gì tạo nên một eBay Scraper tốt nhất? Tiêu chí đánh giá của chúng tôi
Tôi đã đánh giá 9 công cụ theo 8 tiêu chí bám sát các điểm đau mà người dùng nhắc đến nhiều nhất:
- Dễ sử dụng — Người bán không rành kỹ thuật có thể lấy dữ liệu từ eBay mà không cần viết code không?
- Xử lý anti-bot của eBay — Công cụ có lối đi thực tế qua giới hạn tốc độ, CAPTCHA và fingerprinting không?
- Giá đã chuẩn hóa — Có thể ước tính chi phí hữu dụng trên 1.000 trang mà không phải đảo ngược mô hình tính phí không?
- Định dạng xuất dữ liệu — Dữ liệu có thể rời khỏi công cụ một cách gọn gàng sang CSV, Excel, JSON, Sheets hoặc qua API không?
- Làm giàu dữ liệu trang con — Công cụ có thể bắt đầu từ trang kết quả tìm kiếm rồi vào từng trang sản phẩm để thêm cột không?
- Lập lịch — Có thể tự chạy lại cho theo dõi giá hoặc tồn kho không?
- Loại công cụ — Tiện ích mở rộng trình duyệt, API đám mây hay ứng dụng desktop ảnh hưởng đến cài đặt, bảo trì và xử lý đăng nhập.
- Gói miễn phí hoặc bản dùng thử — Người bán nhỏ thường muốn thử trước khi quyết định.
Những tiêu chí này phản ánh đúng điều người dùng hay phàn nàn. Các bài trên diễn đàn liên tục nhắc đến việc bị chặn, hạn chế API, hoặc cần một lựa chọn không cần code mà không đòi hỏi cả một stack proxy. Chi phí cũng quan trọng, nhưng chỉ sau khi scraper sống sót đủ số trang để thật sự hữu ích.
Vì sao scraper eBay dạng tiện ích mở rộng trình duyệt xứng đáng có mặt trong danh sách này
Phần lớn các danh sách “eBay scraper tốt nhất” chỉ tập trung vào API, nền tảng proxy hoặc bộ dựng desktop. Như vậy là bỏ sót một nhóm nhu cầu rất thực. Một chủ đề Reddit năm 2025 trong r/eBaySellers đã hỏi thẳng về một tiện ích mở rộng trình duyệt hoặc phần mềm có thể tự động so sánh giá đã bán trước khi đấu giá. Đó chính là nơi các công cụ dạng extension phát huy tác dụng.
| Yếu tố | Tiện ích mở rộng Chrome (ví dụ: Thunderbit) | API đám mây (ví dụ: ScrapingBee) | Ứng dụng desktop (ví dụ: Octoparse) |
|---|---|---|---|
| Thời gian thiết lập | Dưới 2 phút | 10–30 phút | 5–15 phút |
| Cần code không | Không | Thường là có | Thường là không |
| Hoạt động sau khi đăng nhập eBay | Có, ở chế độ thu thập trong trình duyệt | Cần xử lý session hoặc cookie | Đôi khi |
| Xử lý anti-bot | Dùng phiên trình duyệt thật của bạn | Tích hợp xoay proxy | Tùy cấu hình |
Scraper dạng extension không phải lúc nào cũng rẻ nhất ở quy mô lớn, nhưng chúng giải quyết một vấn đề khác: cho phép người dùng không rành kỹ thuật thu thập ngay trang mà họ đang xem, kể cả các trang nằm sau phiên đăng nhập trình duyệt.
9 eBay Scraper tốt nhất nhìn nhanh
Trước khi đi vào từng công cụ, đây là bảng so sánh tổng quan. Lưu ý về giá: cột “chi phí trên 1K trang” dùng gói trả phí thấp nhất thực tế của nhà cung cấp nếu có thể. Với các công cụ desktop theo thuê bao mà không tính theo trang, ước tính giả định job 1.000 trang của bạn nằm gọn trong một tháng tính phí. Với Helium Scraper, ước tính là chi phí giấy phép một lần được khấu hao trên 10.000 trang.
| Công cụ | Loại công cụ | Mức độ dễ dùng | Anti-bot của eBay | Chi phí trên 1K trang (ước tính) | Định dạng xuất | Làm giàu trang con | Lập lịch | Gói miễn phí | Phù hợp nhất cho |
|---|---|---|---|---|---|---|---|---|---|
| Thunderbit | Tiện ích Chrome + cloud | Rất dễ | Cao | $12.67–$30 | CSV, JSON, Excel, Sheets, Airtable, Notion | Có | Có | Có | Người mới, người dùng không cần code |
| Octoparse | Desktop + cloud | Dễ-trung bình | Trung bình-cao | $39–$83 | CSV, Excel, JSON, HTML, XML, DB, API | Một phần – có | Có | Có | Xây dựng quy trình trực quan |
| Apify | Chợ công cụ cloud | Trung bình | Trung bình-cao | $5–$50+ | JSON, CSV, Excel, API | Một số actor có | Có | Có | Workflow cloud linh hoạt |
| ScrapingBee | API | Trung bình | Cao | $0.91–$3.16 | HTML, JSON, trích xuất tùy chỉnh | Tùy chỉnh | Bên ngoài | Dùng thử | Nhà phát triển |
| Bright Data | API enterprise + bộ dữ liệu | Trung bình-khó | Rất cao | $1.30–$1.50 | JSON, CSV, API, giao nhận dữ liệu | Có | Có | Dùng thử | Thu thập quy mô enterprise |
| ParseHub | Desktop + cloud | Trung bình | Trung bình | $189+ | JSON, CSV, Sheets | Thủ công | Gói trả phí | Có | Dự án nhỏ miễn phí |
| Oxylabs | API | Trung bình-khó | Rất cao | $1.10–$1.35 | HTML, dữ liệu được giao | Tùy chỉnh | Có | Dùng thử | Dữ liệu toàn cầu khối lượng lớn |
| Crawlbase | API | Trung bình | Trung bình-cao | $0.60–$3.00 | JSON, CSV, Excel | Tùy chỉnh | Có | Có (1K request) | Scraping API ẩn danh |
| Helium Scraper | Desktop Windows | Trung bình-khó | Trung bình | $9.90–$19.90 đã khấu hao | CSV, XLSX, JSON, XML | Thủ công | Một phần | Dùng thử | Dự án offline trên Windows |
Bây giờ là phần phân tích chi tiết.
1. Thunderbit
Thunderbit là lựa chọn gọn nhất nếu bạn muốn thu thập dữ liệu eBay mà không phải dựng workflow, cấu hình proxy hay viết một dòng code nào. Tôi có thiên vị — vì đội ngũ của tôi xây dựng nó — nhưng cách giới thiệu sản phẩm cũng khớp với quy trình thực tế: mở trang tìm kiếm hoặc trang sản phẩm trên eBay, nhấp AI Suggest Fields, rồi nhấp Scrape. Với người mới, điều đó quan trọng hơn số lượng tính năng.
Tính năng thu thập dữ liệu eBay nổi bật
Thunderbit có mẫu eBay scraper chuyên dụng, hỗ trợ rõ ràng cho trang tìm kiếm, trang thương hiệu và trang danh mục. Các trường đã được xác minh gồm product name, price, member price, item number, rating và review count.
Điểm khiến nó nổi bật trong workflow eBay:
- AI Suggest Fields đọc trang eBay và tự đề xuất cột — không cần CSS selector, không cần map thủ công
- Scrape Subpages đi vào từng trang sản phẩm và nối thêm các cột như tình trạng, thông tin người bán, vận chuyển hoặc thông số sản phẩm. Đây là tính năng biến một danh sách kết quả tìm kiếm nông thành một cơ sở dữ liệu sản phẩm đầy đủ.
- Chế độ thu thập trong trình duyệt dùng phiên Chrome thật của bạn, rất hữu ích cho các trang đã đăng nhập và thường ít dễ gãy hơn phiên bot thuần cloud
- Thu thập trên cloud có thể xử lý tới 50 trang cùng lúc cho các tin đăng công khai
- Lập lịch tích hợp sẵn cho việc theo dõi giá định kỳ
- Xuất miễn phí sang Excel, Google Sheets, Airtable, Notion, CSV và JSON — không khóa tính năng xuất
Giá, ưu điểm và điểm cần lưu ý
- Gói miễn phí với mức dùng thử giới hạn
- Starter: $15/tháng (hoặc khoảng $9/tháng nếu tính theo năm), 500 credit/tháng
- Pro 1: $38/tháng (hoặc khoảng $16.5/tháng nếu tính theo năm), 3.000 credit/tháng
- 1 credit = 1 dòng đầu ra
Suy ra chi phí xấp xỉ:
- Starter: khoảng $30 cho mỗi 1.000 dòng/trang
- Pro 1: khoảng $12.67 cho mỗi 1.000 dòng/trang
Ưu điểm:
- Thiết lập nhanh nhất trong danh sách này — chưa tới 2 phút từ lúc cài đến lúc có dữ liệu
- Không cần code, không cần selector, không cần cấu hình proxy
- AI thích ứng với thay đổi giao diện eBay tốt hơn các template cứng nhắc
- Làm giàu trang con ngay trong một workflow duy nhất
- Hỗ trợ xuất rộng rãi mà không thu thêm phí
Điểm cần lưu ý:
- Giá theo credit minh bạch nhưng có thể tốn kém khi khối lượng dòng cực lớn
- Đây là workflow thiên về trình duyệt, không phải API enterprise độc lập
- Một số người dùng trên Trustpilot cho biết việc phân trang dừng lại sau một số trang giới hạn trên vài website nhất định
Nếu bạn là người bán, nhà nghiên cứu hoặc nhà phân tích muốn đi nhanh nhất từ trang eBay sang bảng tính, Thunderbit là nơi tôi sẽ bắt đầu.
Dùng thử tiện ích Thunderbit Chrome
2. Octoparse
Octoparse hiện là scraper desktop no-code truyền thống mạnh nhất cho eBay. Nó có template dành riêng cho eBay đang hoạt động, chế độ cloud và lập lịch. Nó không tức thì như Thunderbit, nhưng linh hoạt hơn nếu bạn muốn một trình dựng workflow trực quan.
Các trường đầu ra đã được xác minh từ template eBay của nó gồm tổ hợp Title, Product_URL, Price, Condition, Shipping, Rating, Followers, Sales, Seller_Name, Positive_feedback và Ebay_item_number.
Giá, ưu điểm và điểm cần lưu ý
- Có gói miễn phí
- Basic: $39/tháng
- Standard: từ khoảng $83/tháng
- Professional: từ khoảng $299/tháng
Ưu điểm:
- Phủ template eBay mạnh nhất trong số các công cụ desktop no-code hiện tại
- Cân bằng tốt giữa kiểm soát cục bộ và tự động hóa cloud
- Lập lịch và xuất dữ liệu đã trưởng thành
- Tích hợp với CSV, Excel, JSON, HTML, XML, database, Google Sheets, Dropbox, S3, Zapier và API access
Điểm cần lưu ý:
- Chi phí thực tế có thể tăng vì tiện ích bổ sung — proxy dân cư tính riêng (khoảng $3/GB), giải CAPTCHA tính riêng (khoảng $1–$1.5 cho mỗi 1.000)
- Không thanh thoát bằng Thunderbit khi bắt đầu nhanh
- Có thể khó với các trang thay đổi liên tục hoặc khi workflow cần chỉnh thủ công
- Không có làm giàu trang con bằng AI tích hợp kiểu một cú nhấp như Thunderbit
Octoparse là lựa chọn trực quan an toàn hơn nếu bạn biết mình sẽ thu thập eBay thường xuyên và muốn template cùng tự động hóa cloud mà không phải đụng đến code. Nếu muốn xem so sánh sâu hơn, hãy xem đánh giá và phương án thay thế Octoparse.
3. Apify
Apify không phải chỉ là một eBay scraper. Nó là một chợ các “Actor” chuyên cho eBay. Đây vừa là thế mạnh lớn nhất vừa là rủi ro lớn nhất. Nếu chọn được một Actor được duy trì tốt, nó có thể cực kỳ tiết kiệm chi phí. Nhưng nếu người duy trì để nó lỗi thời sau một lần eBay đổi giao diện, bạn sẽ phải gánh sự thiếu ổn định đó.
Một số Actor xuất ra các trường phong phú như seller details, watchCount, soldCount, availableQuantity, shipping terms và return policies. Thậm chí còn có một Actor chuyên thu thập tin đã bán của eBay, đây là lợi thế thật sự cho reseller và nghiên cứu giá so sánh.
Giá, ưu điểm và điểm cần lưu ý
- Gói nền tảng: Free, Starter $49, Scale $499, Business $999, cộng thêm usage
- Các eBay Actor ví dụ dao động khoảng $5 cho mỗi 1.000 sản phẩm đến $50 cho mỗi 1.000 kết quả, tùy Actor
Ưu điểm:
- Linh hoạt rất lớn — có thể thử nhanh nhiều workflow eBay khác nhau
- Phù hợp cho nhà phát triển và nhà phân tích muốn chạy trên cloud rồi xuất dữ liệu
- Lập lịch gốc, API access và xuất dataset sang JSON, CSV, Excel
- Một số actor đã xử lý sẵn workflow từ kết quả tìm kiếm sang trang chi tiết hoặc tin đã bán
Điểm cần lưu ý:
- Chất lượng Actor khác nhau theo người duy trì — nên xem mỗi Actor như một nhà cung cấp nhỏ
- Chi phí tổng có thể tăng dần vì usage nền tảng, lưu trữ, proxy và giá Actor không phải lúc nào cũng gộp chung thành một hóa đơn đơn giản
- Người không rành kỹ thuật có thể thấy mô hình chợ công cụ khá khó hiểu
Nếu bạn muốn một chợ scraper dựng sẵn thay vì một sản phẩm đơn lẻ mang quan điểm riêng, Apify là lựa chọn phù hợp nhất. Để so sánh sâu hơn, xem đánh giá và phương án thay thế Apify.
4. ScrapingBee
ScrapingBee phù hợp nhất với nhà phát triển muốn gọi API đơn giản thay vì dùng công cụ trực quan. Nó xử lý proxy, headless rendering và hạ tầng chống bot ở phía sau, còn logic phân tích dữ liệu phần lớn là do bạn tự làm.
ScrapingBee có trang đích dành riêng cho eBay scraper và hỗ trợ render JavaScript, xoay premium proxy, định vị theo địa lý, cùng CSS/XPath và trích xuất bằng AI cho đầu ra có cấu trúc.
Giá, ưu điểm và điểm cần lưu ý
Với giả định khối lượng eBay hỗn hợp khoảng 11 credit mỗi trang, giá hiện tại tương đương khoảng:
- Freelance: khoảng $3.16 cho mỗi 1.000 trang
- Business: khoảng $0.91 cho mỗi 1.000 trang
Ưu điểm:
- API gọn cho nhà phát triển
- Tư thế chống bot mạnh mà không cần tự xây stack proxy
- Phù hợp cho các pipeline eBay tùy chỉnh
Điểm cần lưu ý:
- Cần code — không có visual builder cho người không rành kỹ thuật
- Không có nút “làm giàu trang con” gốc; bạn phải tự viết vòng lặp
- Chi phí thực tế còn phụ thuộc vào việc có cần JS rendering và chế độ premium proxy hay không
ScrapingBee là lựa chọn đúng khi nhóm của bạn đã biết parse HTML và chỉ cần một lớp lấy dữ liệu đáng tin cậy.
5. Bright Data
Bright Data là lựa chọn sẵn sàng cho enterprise nhất trong danh sách này. Nó kết hợp hạ tầng scraping, mạng proxy, giao nhận dataset và sản phẩm chuyên cho eBay. Nếu bạn cần throughput lớn hoặc muốn mua dữ liệu đã được thu sẵn thay vì tự duy trì code scraping, Bright Data xứng đáng có mặt trong shortlist.
Các tính năng chính gồm Web Scraper API với template eBay rõ ràng, batch job, thu thập theo lịch kèm giao qua webhook, và tùy chọn mua dataset eBay đã thu sẵn bao phủ tiêu đề, giá, đấu giá, ảnh, vận chuyển, dữ liệu người bán và workflow bán hoàn tất.
Giá, ưu điểm và điểm cần lưu ý
- Web Scraper API tính theo mức dùng: khoảng $1.50 cho mỗi 1.000 bản ghi
- Tỷ lệ hiệu dụng của gói Scale: khoảng $1.30 cho mỗi 1.000 bản ghi
- Giá dataset thay đổi
- Có bản dùng thử doanh nghiệp
Ưu điểm:
- Độ tin cậy tổng thể cao nhất cho nhóm enterprise
- Nhiều cách lấy dữ liệu eBay: API, tự động hóa trình duyệt, dataset
- Hạ tầng proxy dân cư và unlocker mạnh
- Phù hợp hơn đa số công cụ khác nếu uptime quan trọng hơn sự dễ dùng
Điểm cần lưu ý:
- Dashboard phức tạp và đường cong học tập dốc
- Tốn kém cho hobby hoặc người bán nhỏ
- Làm quá mức cần thiết với dự án nhẹ
Bright Data là lựa chọn khi việc thu thập dữ liệu eBay không còn là việc phụ, mà là một phần của pipeline dữ liệu cốt lõi.
6. ParseHub
ParseHub vẫn dùng được nếu bạn muốn một scraper desktop kiểu cổ điển có gói miễn phí, nhưng hiện không còn là lựa chọn trực quan tinh tế nhất cho eBay. Hướng dẫn eBay chính thức của nó bao phủ kết quả tìm kiếm, trang sản phẩm và phân trang, với các trường đã xác minh gồm product name, URL, price, days left, shipping cost, units sold, seller name, seller rating và seller review count.
Giá, ưu điểm và điểm cần lưu ý
- Có gói miễn phí nhưng bị giới hạn (khoảng 200 trang mỗi lần chạy, ràng buộc dự án công khai)
- Standard: $189/tháng
- Professional: $599/tháng
Ưu điểm:
- Có bản miễn phí và dùng được cho thử nghiệm
- Xử lý được trang JavaScript, cú nhấp và phân trang
- Giao diện kiểu “học qua làm” khá tốt cho trích xuất trực quan
Điểm cần lưu ý:
- Thủ công hơn Thunderbit hoặc Octoparse cho workflow eBay
- Gói miễn phí quá hạn chế cho công việc lặp lại nghiêm túc
- Xử lý anti-bot yếu hơn các sản phẩm API cao cấp
- Hướng dẫn công khai về eBay đã cũ hơn so với các công cụ cạnh tranh
ParseHub vẫn hợp lý cho dự án nhỏ và mục đích học tập, nhưng không còn là khuyến nghị no-code mạnh nhất trong nhóm này. Xem thêm đánh giá và phương án thay thế ParseHub.
7. Oxylabs
Oxylabs là lựa chọn cao cấp nhắm tới các nhóm quan tâm đến throughput, concurrency và phạm vi toàn cầu. Nó không phải công cụ dễ dùng nhất ở đây, nhưng lại là một trong những công cụ ổn định nhất khi ghép với một pipeline phân tích dữ liệu mạnh.
Oxylabs cung cấp target eBay cho tìm kiếm, sản phẩm và scraping URL tổng quát, phạm vi proxy toàn cầu rộng, hỗ trợ scheduler và một sản phẩm headless-browser cho các trang khó hơn.
Giá, ưu điểm và điểm cần lưu ý
- Khoảng $1.15 cho mỗi 1.000 kết quả nếu không dùng JS
- Khoảng $1.35 cho mỗi 1.000 kết quả nếu có JS
- Headless Browser có giá riêng, từ khoảng $300/tháng
Ưu điểm:
- Rất phù hợp cho scraping toàn cầu khối lượng lớn
- Hạ tầng anti-bot và proxy mạnh
- Hợp với khách hàng enterprise hơn là người dùng hobby
Điểm cần lưu ý:
- Cần code
- Đầu ra từ tìm kiếm và sản phẩm thường ưu tiên HTML, nên phần parse là do bạn tự xử lý
- Workflow tin đã bán có thể làm được nhưng không được đóng gói như một sản phẩm out-of-the-box chuyên biệt
Nếu bạn đang xây dựng một hoạt động thu thập dữ liệu ecommerce nghiêm túc, Oxylabs là một trong những lựa chọn lớp API mạnh nhất.
8. Crawlbase
Crawlbase (trước đây là ProxyCrawl) nằm ở khoảng giữa giữa công cụ API giá mềm và bộ enterprise cao cấp. Nó cho bạn một hướng đi ưu tiên API với khả năng vượt CAPTCHA và xoay IP, mà không đòi hỏi cam kết ở mức enterprise.
Crawlbase có trang scraper riêng cho eBay và hỗ trợ scraping cloud ẩn danh, bypass CAPTCHA, xoay IP và đầu ra thiên về JSON/CSV/Excel.
Giá, ưu điểm và điểm cần lưu ý
- Miễn phí 1.000 request đầu tiên
- Khoảng $3.00 cho mỗi 1.000 request ở mức sử dụng trả phí khởi điểm
- Gần $0.60 cho mỗi 1.000 ở các gói khối lượng cao hơn
Ưu điểm:
- Có gói miễn phí hữu ích để thử nghiệm
- Điểm vào API khá dễ
- Hỗ trợ anti-bot tốt hơn các script DIY đơn giản
Điểm cần lưu ý:
- Vẫn cần code
- Ít productization dành riêng cho eBay hơn Bright Data
- Ít tính năng workflow bóng bẩy cho người không phải nhà phát triển
Crawlbase hấp dẫn nếu bạn muốn một scraper API ẩn danh với rào cản thử nghiệm thấp.
9. Helium Scraper
Helium Scraper là công cụ khác biệt trong danh sách này. Đây là sản phẩm desktop Windows với mô hình giấy phép mua một lần. Nó không phải lựa chọn dành cho người mới trước tiên, nhưng có thể hấp dẫn nếu bạn muốn kiểm soát cục bộ và không thích thuê bao định kỳ.
Tính năng gồm giao diện trích xuất point-and-click, hành động JavaScript tùy chỉnh, hỗ trợ nhiều trình duyệt song song và khả năng xuất mạnh sang CSV, XLSX, JSON và XML. Nó cũng hỗ trợ tự động hóa qua dòng lệnh.
Giá, ưu điểm và điểm cần lưu ý
- Basic: $99
- Professional: $199
- Business: $399
- Enterprise: $699
Chi phí ước tính sau khi khấu hao giấy phép trên 10.000 trang:
- Basic: khoảng $9.90 cho mỗi 1.000 trang
- Professional: khoảng $19.90 cho mỗi 1.000 trang
Ưu điểm:
- Mô hình mua một lần — không có phí thuê bao hằng tháng
- Tốt cho dự án offline hoặc cục bộ
- Linh hoạt nếu bạn sẵn sàng tự dựng logic scraping
Điểm cần lưu ý:
- Chỉ chạy trên Windows
- Không có cloud, unlocker hoặc proxy stack đi kèm
- Không có template eBay chính thức hiện tại
- Đường cong học tập dốc hơn vẻ ngoài ban đầu
- Không có gợi ý trường bằng AI hay làm giàu trang con
Helium Scraper hợp nhất với người dùng Windows rành kỹ thuật, muốn một công cụ desktop cục bộ chứ không phải workflow dễ nhất có thể.
Chi phí trên mỗi 1.000 trang: bảng so sánh giá mà ít ai khác cung cấp
Các nhà cung cấp khác nhau tính theo dòng, request, bản ghi, credit hoặc số ghế theo tháng. Điều đó làm việc so sánh trực tiếp trở nên rối rắm. Tôi đã thấy 5 trong số 6 bài “eBay scraper tốt nhất” khác có nêu giá nhưng không chuẩn hóa về một chỉ số chung. Trong khi đó, người dùng luôn coi chi phí là một rào cản hàng đầu.
Bảng dưới đây dùng gói trả phí thấp nhất và, khi cần, một gói trung cấp hoặc scale. Nó không hoàn hảo — một số công cụ tính theo dòng đầu ra, số khác theo request — nhưng vẫn hữu ích hơn nhiều so với việc chỉ nhìn giá theo tháng.
| Công cụ | Gói trả phí thấp nhất | Gói trung cấp/scale | Chi phí trên 1K trang (ước tính) | Kèm proxy/render không? | Ghi chú |
|---|---|---|---|---|---|
| Thunderbit | Starter | Pro 1 | $30 / $12.67 | Có | 1 credit = 1 dòng |
| Octoparse | Basic | Standard | $39 / $83 | Không | Proxy và CAPTCHA tính thêm |
| Apify | Tùy Actor | Tùy Actor | $5–$50+ | Một phần | Phí Actor + usage nền tảng |
| ScrapingBee | Freelance | Business | $3.16 / $0.91 | Phần lớn | Phụ thuộc vào mix credit JS/proxy |
| Bright Data | PAYG | Scale | $1.50 / $1.30 | Phần lớn | Tính theo bản ghi |
| ParseHub | Standard | Professional | $189 / $599 | Một phần | Gói thuê bao quan trọng hơn metering theo trang |
| Oxylabs | Micro | Starter | $1.15–$1.35 / $1.10–$1.30 | Phần lớn | JS và headless có thể làm tăng chi phí |
| Crawlbase | Gói trả phí khởi điểm | Khối lượng cao | $3.00 / $0.60 | Phần lớn | Tính theo request |
| Helium Scraper | Giấy phép Basic | Professional | $9.90 / $19.90 đã khấu hao | Không | Giấy phép desktop một lần |
Công cụ nào tiết kiệm nhất theo quy mô?
- Dưới 5K trang/tháng: Thunderbit là hợp lý nếu bạn ưu tiên tốc độ hơn kinh tế thuần túy. Gói miễn phí của Crawlbase và các Actor nhỏ hơn của Apify cũng có thể dùng được.
- 5K đến 50K trang/tháng: ScrapingBee, Bright Data, Oxylabs và các Actor mạnh hơn của Apify thường đem lại giá trị tốt hơn các công cụ no-code tính theo dòng.
- Trên 50K trang/tháng: Bright Data và Oxylabs là những lựa chọn enterprise thuyết phục nhất. Apify có thể dùng được nếu bạn đã tin vào Actor và kinh tế của nền tảng.
Mẫu chi phí ẩn quan trọng: công cụ desktop và no-code thường giấu chi phí trong add-on hoặc nhân lực, còn công cụ API thường giấu chi phí trong hệ số render, loại proxy hoặc độ phức tạp của trích xuất.
Những eBay Scraper nào thật sự vượt qua được lớp chống bot năm 2026?
Stack chống scraping của eBay là nhiều tầng. Các báo cáo cộng đồng gần đây, tài liệu nhà cung cấp và nghiên cứu chống bot đều chỉ về cùng một mô hình: eBay dùng giới hạn tốc độ, thử thách CAPTCHA, xác minh phụ thuộc JavaScript, kiểm tra cookie/session, độ tin cậy IP và fingerprinting trình duyệt. Đó là lý do rất nhiều script mong manh thất bại, dù có thể tải được một hoặc hai trang.
Dữ liệu bot từ bên thứ ba giúp giải thích vì sao scraping trên các marketplace ngày càng khó hơn. Akamai cho biết bot chiếm 42% lưu lượng web vào năm 2024, và Radware phát hiện bot chiếm 57% lưu lượng mua sắm trực tuyến trong mùa mua sắm cuối năm 2024.
| Công cụ | Cách tiếp cận anti-bot | Proxy dân cư | Xử lý CAPTCHA | Mức thành công điển hình trên eBay |
|---|---|---|---|---|
| Thunderbit | Phiên trình duyệt thật ở chế độ browser; routing cloud tích hợp cho trang công khai | Tích hợp trong chế độ cloud | Chế độ cloud xử lý | Cao với workflow không cần kỹ thuật |
| Octoparse | Trích xuất cloud + xoay IP | Có ở gói trả phí / add-on | Được hỗ trợ qua stack cloud | Trung bình-cao |
| Apify | Tùy Actor; thường dùng Playwright + proxy | Có | Tùy Actor | Trung bình-cao nếu Actor còn được duy trì |
| ScrapingBee | Fetch trình duyệt được render + proxy premium | Có qua routing premium | Nằm trong stack được quản lý | Cao |
| Bright Data | Unlocker + mạng dân cư + tự động hóa trình duyệt | Có | Có | Rất cao |
| ParseHub | Mô phỏng desktop/trình duyệt + xoay IP trả phí | Một phần | Một phần | Trung bình |
| Oxylabs | Proxy dân cư/ISP/mobile + scraper API + headless browser | Có | Được quản lý ở cấp nền tảng | Rất cao |
| Crawlbase | API ẩn danh + xoay IP + bypass CAPTCHA | Được quản lý | Được quản lý | Trung bình-cao |
| Helium Scraper | Tự xây automation trình duyệt; hỗ trợ proxy nếu cấu hình | Tự chuẩn bị | Thủ công / do người dùng quản lý | Trung bình |
Tranh luận proxy datacenter vs. residential
Đây là một trong số ít lĩnh vực mà hướng dẫn của nhà cung cấp và trải nghiệm người dùng khớp khá rõ. Tài liệu của các Actor trên Apify nêu thẳng rằng eBay chặn IP datacenter mạnh hơn và khuyến nghị proxy dân cư. Oxylabs cũng nói điều tương tự trên các trang proxy eBay của mình. Nói đơn giản: IP datacenter rẻ hơn, nhưng traffic dân cư hoặc ISP có nhiều khả năng sống sót hơn khi thu thập eBay trong thời gian dài.
Đó cũng là lý do chế độ browser của Thunderbit khá thú vị từ góc nhìn anti-bot. Nó né được một phần vấn đề fingerprinting scraper thông thường bằng cách làm việc từ phiên trình duyệt thật của người dùng thay vì bắt đầu từ một danh tính bot cloud hoàn toàn mới.
Thu thập vượt ngoài kết quả tìm kiếm: tin đã bán, trang con và cơ sở dữ liệu sản phẩm đầy đủ
Phần lớn dự án thu thập dữ liệu eBay không dừng ở kết quả tìm kiếm. Workflow thực sự gồm ba bước:
- Thu thập trang kết quả tìm kiếm hoặc trang kết quả đã bán
- Vào từng URL tin đăng
- Ghép thêm các trường chi tiết phong phú vào một bảng duy nhất
Đó là workflow bạn cần cho nghiên cứu sản phẩm nghiêm túc vì trang tìm kiếm hiếm khi chứa mọi thứ. Thông số sản phẩm, ghi chú về tình trạng, chính sách người bán, chi tiết vận chuyển và phần mô tả mở rộng đều nằm trên trang chi tiết.
Đây cũng là nơi khoảng trống của API eBay trở nên rõ nhất. API chính thức ổn cho tin đăng đang hoạt động, nhưng dữ liệu đã bán/hoàn tất vẫn bị giới hạn. Nếu bạn cần giá so sánh, xác thực khả năng bán lại, hoặc nghiên cứu lịch sử giá trên các tin đã hoàn tất, web scraping vẫn là đường đi thực tế trừ khi tổ chức của bạn đã có quyền truy cập Marketplace Insights.
Sự khác biệt giữa các công cụ ở đây là rất đáng kể:
- Thunderbit xử lý sẵn với Scrape Subpages — một trong những lợi thế lớn nhất cho người không rành kỹ thuật. Chỉ cần nhấp nút, AI sẽ vào từng URL sản phẩm và nối các cột mới vào bảng gốc.
- Octoparse và ParseHub có thể làm được, nhưng workflow thủ công hơn và cần cấu hình riêng.
- Apify có thể làm nếu actor hỗ trợ fan-out từ tìm kiếm sang chi tiết.
- Bright Data và Oxylabs chắc chắn hỗ trợ, nhưng thường bạn phải tự dựng vòng lặp hoặc mua dataset có cấu trúc.
- Helium Scraper có thể làm tại chỗ, nhưng cần thiết kế dự án thủ công.
Nếu mục tiêu của bạn là một cơ sở dữ liệu sản phẩm đầy đủ thay vì chỉ một danh sách nông về tiêu đề và giá, thì làm giàu trang con không phải tùy chọn. Nó là workflow cốt lõi. Để xem cách scrape trang con hoạt động trong thực tế, hãy xem hướng dẫn của chúng tôi về cách xây dựng web scraper.
Ghi chú ngắn về tính hợp pháp và đạo đức khi thu thập dữ liệu eBay
Bản ngắn gọn: thu thập dữ liệu công khai không tự động là bất hợp pháp, nhưng cũng không có nghĩa là muốn làm gì cũng được. Chuỗi vụ kiện hiQ v. LinkedIn vẫn còn liên quan đến việc scraping dữ liệu web công khai và Đạo luật Computer Fraud and Abuse Act, và các phán quyết sau đó như tranh chấp Meta v. Bright Data cũng cho thấy lập luận về scraping dữ liệu công khai vẫn có thể thắng tại tòa trong một số hoàn cảnh.
Tuy vậy, Thỏa thuận người dùng hiện tại của eBay nêu rõ rằng robot, spider, scraper và công cụ khai thác dữ liệu đều bị cấm trừ khi eBay cho phép trước bằng văn bản. Trên thực tế, người dùng nên:
- Tập trung vào dữ liệu có thể truy cập công khai
- Tránh thu thập dữ liệu cá nhân
- Giới hạn tốc độ một cách có trách nhiệm
- Xem lại điều khoản hiện tại và kỳ vọng robots của eBay
- Tham khảo tư vấn pháp lý cho các trường hợp dùng thương mại hoặc nhạy cảm
Bài viết này nói về công cụ, không phải tư vấn pháp lý. Để hiểu sâu hơn về bối cảnh pháp lý, xem bài viết của chúng tôi về hệ quả pháp lý của web scraping.
eBay Scraper nào phù hợp với bạn?
Nếu muốn một bảng khuyến nghị ngắn gọn:
- Tốt nhất cho người mới / người dùng không cần code: Thunderbit — thiết lập 2 cú nhấp, gợi ý trường bằng AI, làm giàu trang con gốc, chế độ thu thập trong trình duyệt, xuất miễn phí
- Tốt nhất cho nhà phát triển muốn dùng API: ScrapingBee — API gọn, anti-bot mạnh, không có gánh nặng trực quan
- Tốt nhất cho quy mô enterprise: Bright Data — hạ tầng vượt trội, giao dataset, mạng proxy dân cư
- Tốt nhất cho chợ scraper dựng sẵn: Apify — thư viện Actor khổng lồ, phủ dữ liệu tin đã bán, cloud linh hoạt
- Tốt nhất cho xây workflow trực quan (desktop): Octoparse — template eBay mạnh, chế độ cloud, lập lịch
- Tùy chọn desktop miễn phí tốt nhất cho dự án nhỏ: ParseHub — có gói miễn phí, xử lý trang động, phù hợp để học
- Tốt nhất cho dữ liệu toàn cầu khối lượng lớn: Oxylabs — stack proxy enterprise, hỗ trợ headless browser, uptime mạnh
- Tốt nhất cho scraping API ẩn danh với ngân sách vừa phải: Crawlbase — chi phí khởi điểm thấp, request miễn phí, bypass CAPTCHA ổn
- Tốt nhất cho scraper desktop mua một lần: Helium Scraper — kiểm soát cục bộ, không phí tháng, linh hoạt nếu bạn tự lo phần thiết lập
Nếu vẫn chưa chắc, hãy bắt đầu bằng công cụ phù hợp với mức độ thoải mái và khối lượng dữ liệu của bạn. Với đa số người dùng không rành kỹ thuật, đó là Thunderbit — đặc biệt nếu bạn muốn đi từ một trang eBay sang bảng tính chỉ trong hai cú nhấp.
Dùng thử AI thu thập eBay với Thunderbit Get Started Free
Tìm hiểu thêm


