10 công cụ Google Shopping Scraper tốt nhất: Cái nào hiệu quả, cái nào thất bại

Cập nhật lần cuối vào April 23, 2026
10 công cụ Google Shopping Scraper tốt nhất: Cái nào hiệu quả, cái nào thất bại

Cơ sở dữ liệu sản phẩm của Google Shopping hiện chứa hơn 50 tỷ danh sách sản phẩm, với hơn 2 tỷ danh sách được làm mới mỗi giờ. Với các đội ngũ thương mại điện tử, đây là một mỏ vàng dữ liệu cạnh tranh — giá, người bán, đánh giá, tình trạng còn hàng, vị trí PLA — tất cả đều công khai.

Thế nhưng, nếu bạn từng thử scrape Google Shopping một cách thực sự, rất có thể bạn đã gặp ngõ cụt. Tôi đã dành nhiều năm xây dựng các công cụ tự động hóa tại Thunderbit, và một trong những lời than phiền phổ biến nhất tôi nghe từ các đội ngũ thương mại điện tử là một biến thể của câu: "Tôi mua một Google scraper, nó chạy ổn trên tìm kiếm thường, rồi đến Shopping thì... chết." Các chủ đề trên Reddit cũng phản ánh đúng sự bực bội đó. Một người dùng tóm gọn như sau: "Tôi đã thử hết các scraper... hầu hết đều thất bại trên Shopping." Một người khác báo cáo các IP AWS bị chặn chỉ sau 1–2 yêu cầu.

Vì vậy, tôi quyết định tổng hợp một bài so sánh trung thực nhất có thể, chỉ tập trung vào Shopping — 10 công cụ, được thử nghiệm và đánh giá trên Google Shopping chứ không chỉ trên SERP chung. Nếu một công cụ thực sự không hoạt động trên Shopping, tôi sẽ nói thẳng.

Thử thu thập Google Shopping bằng AI

Vì sao hầu hết "Google Scraper" lại thất bại trên Google Shopping

Trước khi đi vào từng công cụ, cần hiểu vì sao Google Shopping khác hẳn so với Google Search thông thường. Nếu bạn từng thử một scraper tổng quát rồi nhận về kết quả trống rỗng, bạn không hề đơn độc — và đó không phải lỗi của bạn.

Shopping khó hơn vì 3 lý do chính:

  1. Thẻ sản phẩm nặng JavaScript, tải bất đồng bộ. Kết quả Google Search thường có thể phân tích ngay từ HTML ban đầu. Ngược lại, kết quả Shopping tải thẻ sản phẩm thông qua các lời gọi JavaScript chạy nền. Một yêu cầu HTTP đơn giản tới URL Shopping thường chỉ trả về một “vỏ” mỏng, không có sản phẩm thật bên trong.
  2. Token ẩn và tham số phía máy chủ. Lớp chi tiết sản phẩm trên Shopping dùng các tham số mã hóa như catalogid, gpcidved — những thứ không hề hiện trên thanh địa chỉ. Hướng dẫn kỹ thuật của Scrape.do mô tả cách Shopping lấy chi tiết sản phẩm qua các endpoint /async/oapv với những token ẩn này.
  3. Phát hiện bot rất gắt. Google xem truy vấn Shopping là tín hiệu ý định mua hàng có giá trị cao. Việc phát hiện bot ở đây nghiêm ngặt hơn so với SERP thông thường, và các IP cloud/datacenter (như AWS) bị gắn cờ rất nhanh. Một README scraper trên GitHub thậm chí nói rõ rằng nó không hỗ trợ Google Shopping.

Điều gì khiến Google Shopping khác với Google Search thông thường

Khía cạnhGoogle Search thông thườngGoogle Shopping
Cấu trúc trangChủ yếu là các thẻ kết quả tiêu chuẩnThẻ sản phẩm, khối nhà bán, ưu đãi, bộ lọc, trang sản phẩm giàu tương tác
Kết xuấtThường có thể phân tích từ HTML trả vềNặng JS, tải thẻ sản phẩm bất đồng bộ, yêu cầu chi tiết có token
Hành vi URLChuẩn search?q=tbm=shop, udm=28, các liên kết bộ lọc đã mã hóa
Độ phức tạp dữ liệuTiêu đề, đoạn trích, liên kếtTiêu đề, giá, người bán, tình trạng còn hàng, đánh giá, review, vận chuyển, ID sản phẩm, cờ PLA/quảng cáo
Mức độ nhạy với botCao nhưng đã quen thuộcKhó hơn — các truy vấn có ý định mua sắm cần được bảo vệ hơn

Một Google scraper tổng quát có thể chạy rất tốt trên SERP thường nhưng vẫn thất bại trên Shopping theo đúng thiết kế. Mọi công cụ trong bài này đều được đánh giá riêng trên kết quả Shopping — không chỉ trên tìm kiếm bình thường.

Google Shopping API vs. Google Shopping Scraper: Bạn thực sự cần cái nào?

"Google Shopping API" có thể ám chỉ hai thứ hoàn toàn khác nhau, và sự nhầm lẫn này khiến người dùng mất rất nhiều thời gian:

LoạiGoogle Content API for Shopping (chính thức)Google Shopping Scraper của bên thứ ba
Mục đíchQuản lý danh sách sản phẩm CỦA BẠN trong Merchant CenterTrích xuất dữ liệu sản phẩm CỦA ĐỐI THỦ từ kết quả Shopping
Truy cậpCần tài khoản Merchant Center + API keyDữ liệu công khai; không cần tài khoản Google
Dữ liệu trả vềFeed sản phẩm của bạn, trạng thái, chẩn đoánGiá, người bán, đánh giá, vị trí PLA cho bất kỳ truy vấn nào
Trường hợp sử dụngQuản lý feed, đồng bộ tồn khoTheo dõi giá, phân tích cạnh tranh, nghiên cứu thị trường
Chi phíMiễn phí (quyền truy cập API)Tùy công cụ ($0–$300+/tháng)

Merchant API chính thức của Google được dùng để quản lý danh mục cửa hàng của chính bạn trên Google Shopping. Nó KHÔNG cung cấp dữ liệu đối thủ. Nếu bạn muốn theo dõi mức giá mà người bán khác đang niêm yết, theo dõi vị trí PLA hay làm nghiên cứu thị trường, bạn cần một scraper của bên thứ ba. Đó là nội dung bài viết này.

(Lưu ý thêm: Content API sẽ ngừng hỗ trợ vào ngày 18/08/2026 và được thay bằng Merchant API. Dù là phiên bản nào thì cũng không cung cấp kết quả Shopping của đối thủ.)

Cách chúng tôi đánh giá các Google Shopping Scraper tốt nhất

Chưa có bài so sánh nào trong ngành đưa ra một ma trận đánh giá thống nhất riêng cho Shopping. Dưới đây là 8 tiêu chí tôi dùng:

Tiêu chíVì sao quan trọng
Hỗ trợ riêng cho Google ShoppingNhiều "Google scraper" chỉ xử lý SERP thường; đa số thất bại trên Shopping
Kiểu tiếp cậnKhông cần code (tiện ích trình duyệt) vs. API vs. thư viện Python — phục vụ những nhóm người dùng rất khác nhau
Giá (mỗi 1K kết quả)Người dùng xem chi phí là một trong 2 nỗi đau lớn nhất; cần chuẩn hóa để so sánh công bằng
Xử lý chống bot / CAPTCHAChống bot của Google Shopping là rào cản số 1 được báo cáo nhiều nhất
Các điểm dữ liệu trích xuấtTiêu đề sản phẩm, giá, người bán, hình ảnh, đánh giá, cờ quảng cáo/PLA, tình trạng còn hàng
Phân trang & lập lịchRất quan trọng cho việc theo dõi liên tục; chỉ khoảng một phần ba công cụ hỗ trợ lập lịch
Định dạng xuấtCSV, JSON, Google Sheets, Airtable, Notion — người dùng cần linh hoạt
Dễ sử dụng (1–5)Phần lớn nội dung xếp hạng hiện nay gần như bỏ qua người không biết kỹ thuật

Với mỗi công cụ, tôi cũng ghi rõ liệu hỗ trợ Google Shopping là Đã xác minh (có endpoint, template hoặc field map riêng cho Shopping), Một phần (có thể chạy nhưng không có parser riêng cho Shopping trong tài liệu công khai), hay Chưa xác minh. Phân biệt này quan trọng hơn các tuyên bố marketing.

Không cần code vs. API vs. code tùy biến: Chọn cách nào là đúng?

Nhiều bài tổng hợp gom tiện ích trình duyệt, API và thư viện Python vào chung một danh sách phẳng. Điều đó giống như so sánh lò vi sóng với một bếp công nghiệp — đều dùng để nấu ăn, nhưng người mua hoàn toàn khác nhau.

Cách tiếp cậnMức kỹ năngThời gian thiết lậpPhù hợp nhất cho
Tiện ích trình duyệt (không cần code)Người mớiDưới 2 phútNghiên cứu một lần, catalog nhỏ, đội ngũ không kỹ thuật
API (ít code)Trung cấp15–60 phútQuy trình lặp lại, quy mô vừa, đội ngũ có dev hỗ trợ
Python/tuỳ biến (toàn code)Nâng caoVài giờ trở lênTùy biến sâu, quy mô lớn, workflow tự host

Bài viết này là một trong số ít tài nguyên thực sự bao phủ tầng tiện ích trình duyệt cho việc scrape Google Shopping. Nếu bạn là quản lý PPC hay người vận hành thương mại điện tử chỉ muốn dữ liệu trong bảng tính, bạn không cần học Python.

1. Thunderbit

thunderbit-ai-web-scraper.webp Thunderbit là công cụ do công ty chúng tôi xây dựng, nên tôi xin nói rõ điều đó trước — nhưng tôi cũng sẽ nói cụ thể về điểm mạnh và điểm yếu của nó khi làm việc với Google Shopping.

Thunderbit là một tiện ích Chrome dùng AI để trích xuất dữ liệu có cấu trúc từ bất kỳ trang web nào, bao gồm cả Google Shopping. Thunderbit có trang scraper riêng cho Google Shopping với các trường dữ liệu dành riêng cho Shopping, điều mà phần lớn công cụ khác không có. Quy trình thực tế chỉ có hai cú nhấp: mở trang kết quả Shopping, nhấp AI Suggest Fields (AI đọc trang và đề xuất các cột như Tên sản phẩm, Giá, Người bán, Đánh giá), rồi nhấp Scrape. Không cần API key, không cần code, không cần thiết lập backend.

Cách làm trên trình duyệt có một lợi thế rất thực tế với Shopping: vì Thunderbit chạy ngay trong phiên Chrome thật của bạn, Google nhìn thấy một trình duyệt thật với cookie thật — không phải IP datacenter đang bắn các yêu cầu API đáng ngờ. AI cũng đọc lại cấu trúc trang mỗi lần, nên nó không vỡ khi Google thay đổi bố cục Shopping (thường xuyên hơn bạn nghĩ).

Tính năng chính cho Google Shopping

  • AI Suggest Fields: Tự động phát hiện và đề xuất các cột dành riêng cho Shopping (Tên sản phẩm, URL sản phẩm, Giá hiện tại, Giá gốc, Đánh giá, Số lượng review, Nhà bán lẻ)
  • Scrape trang con: Nhấp vào từng trang sản phẩm và làm giàu bảng của bạn bằng dữ liệu chi tiết
  • Scrape phân trang: Xử lý tự động kết quả nhiều trang của Shopping
  • Scheduled scraper: Mô tả khoảng thời gian bằng ngôn ngữ tự nhiên (ví dụ: "mỗi thứ Hai lúc 9 giờ sáng"), nhập URL Shopping của bạn và nó sẽ tự chạy
  • Browser vs. Cloud scraping: Chọn chế độ trình duyệt để tăng khả năng chống chặn hoặc chế độ cloud để tốc độ cao hơn
  • Xuất miễn phí: Excel, Google Sheets, Airtable, Notion, CSV, JSON — không khóa tính năng xuất

Giá

Thunderbit dùng hệ thống tín dụng, trong đó 1 credit = 1 dòng đầu ra:

  • Gói miễn phí: 6 trang
  • Dùng thử miễn phí: 10 trang
  • Starter: khoảng $9/tháng (năm) hoặc $15/tháng (tháng) cho 500 credits
  • Với 1.000 dòng Shopping, chi phí thường vào khoảng $18–$30/tháng tùy gói

Xem Thunderbit Pricing để biết thông tin mới nhất.

Ưu và nhược điểm

  • Ưu điểm: Thiết lập dễ nhất trong danh sách này, đã được xác minh với Shopping và có field map riêng, chống chặn trên trình duyệt, AI thích ứng với thay đổi bố cục, xuất miễn phí sang các công cụ doanh nghiệp, có lập lịch sẵn
  • Nhược điểm: Cần Chrome, không lý tưởng cho pipeline doanh nghiệp quy mô rất lớn (50K+ kết quả/ngày), lượng bài đánh giá độc lập ít hơn một số API lâu đời

2. SerpApi

serper-google-search-api.webp SerpApi là một trong những nhà cung cấp SERP API lâu đời nhất, và họ có một endpoint Google Shopping API riêng trả về JSON có cấu trúc cho kết quả Shopping. Nếu bạn là dev đang xây dựng một data pipeline, đây là một trong những lựa chọn mạnh nhất.

Bạn gửi một API request với engine=google_shopping, và SerpApi trả về shopping_results với các trường như title, product_link, product_id, source, price, old_price, rating, reviews, deliverythumbnail. Họ cũng có Google Shopping Light API cho các truy vấn nhanh và rẻ hơn khi bạn không cần mọi trường. Tài liệu rất tốt — thuộc hàng hay nhất trong lĩnh vực này.

Tính năng chính cho Google Shopping

  • Endpoint Shopping riêng với JSON có cấu trúc
  • Trường dữ liệu gồm tiêu đề, giá, giá cũ, người bán, đánh giá, review, giao hàng, thumbnail, ID sản phẩm
  • Hỗ trợ geo-targeting và tham số ngôn ngữ
  • Hỗ trợ phân trang qua serpapi_pagination.next
  • Giao diện Playground để thử truy vấn trước khi code

Giá

SerpApi tính phí theo lượt tìm kiếm, không tính theo dòng:

Nếu một truy vấn Shopping trả về khoảng 10 kết quả mỗi trang, 1.000 dòng cần khoảng 100 lượt tìm kiếm — về mặt kỹ thuật vẫn trong gói miễn phí, nhưng phân trang thực tế và các lần thử lại sẽ nhanh chóng đẩy hầu hết người dùng sang gói trả phí.

Ưu và nhược điểm

  • Ưu điểm: Hỗ trợ Shopping được xây dựng chuyên biệt, schema trưởng thành, tài liệu rất tốt, JSON có cấu trúc, điểm G2 cao
  • Nhược điểm: Chỉ có API (không có UI trực quan cho người không kỹ thuật), không có xuất bảng tính gốc, giá theo mỗi lượt tìm kiếm có thể tăng nhanh khi phân trang sâu

3. Oxylabs

oxylabs-data-for-ai-proxies.webp Oxylabs cung cấp scraping cấp doanh nghiệp với hỗ trợ Google Shopping rõ ràng thông qua cả nguồn google_shopping_search và nguồn riêng google_shopping_product. Cách tiếp cận hai bước này — dữ liệu cấp tìm kiếm cộng với dữ liệu cấp chi tiết sản phẩm — toàn diện hơn phần lớn đối thủ.

Các trường ở cấp tìm kiếm gồm title, price, token, rating, currency, delivery, merchant.name, merchant.urlreviews_count. Ở cấp sản phẩm, các trường bổ sung gồm description, images, pricing, reviewsvariants. Hạ tầng proxy rất lớn, và họ tự xử lý CAPTCHA cũng như render JavaScript.

Tính năng chính cho Google Shopping

  • Endpoint riêng cho tìm kiếm và sản phẩm trong Shopping
  • Phủ dữ liệu phong phú ở cả cấp tìm kiếm và chi tiết sản phẩm
  • Pool proxy cao cấp (residential + datacenter)
  • Render JavaScript, vượt CAPTCHA, geo-targeting
  • Hỗ trợ xử lý hàng loạt và lập lịch
  • Định dạng đầu ra: JSON, CSV, TXT, Markdown, HTML, PNG

Giá

Giá của Oxylabs cho kết quả Google bắt đầu từ khoảng $1.35 cho 1.000 kết quả với JavaScript rendering (gói bạn cần cho Shopping). Dùng thử miễn phí bao gồm tối đa 2.000 kết quả. Gói enterprise sẽ giảm chi phí trên mỗi kết quả hơn nữa.

Ưu và nhược điểm

  • Ưu điểm: Hỗ trợ Shopping rõ ràng ở hai cấp, hạ tầng chống bot mạnh, SLA doanh nghiệp, có lập lịch
  • Nhược điểm: Chỉ có API, quy trình hai bước kỹ thuật hơn, đắt hơn no-code hoặc API nhẹ, có yêu cầu chi tiêu tối thiểu

4. Bright Data

Screenshot 2026-04-22 at 12.27.50 PM_compressed.webp Bright Data không hẳn là một endpoint Shopping đơn lẻ mà là một nền tảng dữ liệu đầy đủ. Họ cung cấp Google Scraper API có hỗ trợ Shopping, một dataset Google Shopping chuyên biệt (hơn 7,2 tỷ bản ghi, 15 trường), và cả Google Shopping Price Tracker để theo dõi liên tục.

Cách tiếp cận bằng dataset rất thú vị: thay vì tự scrape, bạn có thể mua dữ liệu Shopping đã được thu sẵn ở quy mô lớn. Price tracker hỗ trợ cập nhật theo giờ, theo ngày hoặc theo tuần, kèm cảnh báo qua email, Slack hoặc thông báo file. Với các hoạt động bán lẻ lớn, cách này có thể thực tế hơn nhiều so với việc tự xây pipeline scrape từ đầu.

Tính năng chính cho Google Shopping

  • SERP API có hỗ trợ Shopping
  • Dataset Google Shopping dựng sẵn (hơn 7,2 tỷ bản ghi)
  • Google Shopping Price Tracker với cảnh báo
  • MAP Monitoring để tuân thủ giá niêm yết tối thiểu
  • Hơn 72 triệu IP residential, vượt CAPTCHA, render trình duyệt
  • Giao tới JSON, NDJSON, CSV, webhook, S3, GCS, Azure, Snowflake, SFTP

Giá

Kinh tế của dataset vào khoảng $0.50 cho 1.000 bản ghi, nhưng có mức đơn hàng tối thiểu $50. Giá SERP API thay đổi theo khối lượng và cấu hình. Price tracker có mức giá riêng. Có thể rất tiết kiệm ở quy mô lớn, nhưng độ phức tạp là có thật.

Ưu và nhược điểm

  • Ưu điểm: Nhiều lựa chọn sản phẩm (API, dataset, tracker), nhiều điểm đến giao dữ liệu, dataset Shopping rõ ràng, hỗ trợ doanh nghiệp
  • Nhược điểm: Cấu trúc giá phức tạp, chi tiêu tối thiểu đáng lưu ý, quá dư thừa cho việc nhỏ, người không kỹ thuật sẽ mất thời gian làm quen

5. Apify

apify-web-data-scrapers.webp Apify đi theo mô hình marketplace: thay vì một scraper Shopping chuẩn duy nhất, có nhiều "Actor" do Apify và cộng đồng xây dựng. Các Actor Shopping đang hoạt động gồm automation-lab, burbnSolidCode, mỗi cái có phạm vi trường dữ liệu và mức giá hơi khác nhau.

Sự linh hoạt đó có hai mặt. Một số actor chạy rất tốt trên Shopping; một số khác có thể trả về dữ liệu thưa hoặc trống tùy truy vấn, khu vực địa lý và trạng thái chống bot hiện tại của Google. Tài liệu của actor ghi chú rằng Google Shopping thường chỉ đạt khoảng 200–300 kết quả mỗi truy vấn, và imageUrl có thể bị trống vì ảnh Shopping tải chậm.

Tính năng chính cho Google Shopping

  • Marketplace với nhiều actor Shopping
  • Giao diện cấu hình không cần code kèm truy cập API
  • Lập lịch, quản lý proxy, chống chặn
  • Xuất: JSON, CSV, XML, RSS, Excel, HTML
  • Tích hợp với Google Sheets và webhook

Giá

Giá thay đổi theo actor:

Ưu và nhược điểm

  • Ưu điểm: Marketplace linh hoạt, có lập lịch, nhiều định dạng xuất, kinh tế khá tốt, có cả UI và API
  • Nhược điểm: Thành công trên Shopping phụ thuộc vào actor bạn chọn, schema không đồng nhất, phải xử lý sự cố nhiều hơn so với API chuẩn, chất lượng bảo trì actor không đều

6. ScrapingBee

scrapingbee-website-homepage.webp ScrapingBee là một API tầm trung với trang Google Shopping scraper riêng, trong đó tài liệu hóa rõ các trường dành cho Shopping: name, price, rating, reviews, store, delivery, rank, product_link, featuresproduct_id. Đó là tài liệu chuyên biệt cho Shopping nhiều hơn nhiều nền tảng lớn khác.

API xử lý xoay proxy, render trình duyệt headless và thực thi JavaScript. Phân trang được hỗ trợ qua các tham số startnext_start. Thiết lập đơn giản hơn các nền tảng doanh nghiệp như Oxylabs hay Bright Data, nhưng vẫn cần tích hợp qua API.

Tính năng chính cho Google Shopping

  • Parser Shopping riêng với đầu ra trường có cấu trúc
  • Render trình duyệt headless và xoay proxy
  • Hỗ trợ phân trang
  • 1.000 lượt gọi API miễn phí để bắt đầu
  • Dễ tích hợp (n8n, Zapier, v.v.)

Giá

Mỗi lượt tìm kiếm Shopping tốn khoảng 10 credits. Nếu một trang trả về khoảng 20 kết quả, 1.000 dòng Shopping tương đương khoảng 50 request hoặc 500 credits.

Ưu và nhược điểm

  • Ưu điểm: Parser chuyên cho Shopping, đơn giản hơn các stack doanh nghiệp, có sẵn render headless, gói miễn phí hào phóng, dễ tích hợp
  • Nhược điểm: Chỉ có API, cách tính credit khó trực quan hơn mô hình tính theo dòng, không có lập lịch tích hợp sẵn (cần điều phối bên ngoài)

7. Serper.dev

serper-google-search-api.webp Serper.dev là một trong những Google SERP API có giá dễ tiếp cận nhất, với mức giá thấp tới khoảng $0.30 cho 1.000 truy vấn ở quy mô lớn và 2.500 truy vấn miễn phí để bắt đầu. Nó nhanh, đơn giản và thân thiện với developer.

Một lưu ý quan trọng: tôi không tìm thấy endpoint Google Shopping riêng hoặc schema trường dành riêng cho Shopping trong tài liệu công khai hiện tại của Serper.dev. Nó xử lý Google Search thường rất tốt, nhưng không có bằng chứng công khai rằng nó phân tích dữ liệu riêng của Shopping (thẻ sản phẩm, tên người bán, cờ PLA) thành các trường có cấu trúc. Vì vậy, đây là đề xuất Một phần cho Shopping — giá rất tốt, nhưng có thể bạn sẽ phải tự phân tích hoặc chấp nhận các trường SERP chung.

Tính năng chính cho Google Shopping

  • REST API nhanh, đơn giản
  • Giá theo truy vấn rất phải chăng
  • Tham số vị trí và ngôn ngữ
  • Đầu ra JSON

Giá

Ưu và nhược điểm

  • Ưu điểm: Rất tiết kiệm, nhanh, dễ tích hợp, gói miễn phí hào phóng
  • Nhược điểm: Không có endpoint hoặc field map Shopping riêng công khai, chỉ có API, tính năng nâng cao hạn chế, có thể trả về dữ liệu SERP chung thay vì các trường Shopping có cấu trúc

8. Scrapingdog

scrapingdog-web-scraping-api.webp Scrapingdog là một API giá phải chăng với endpoint Google Shopping API riêng, trả về shopping_results cùng các trường như title, product_link, product_id, source, price, extracted_price, old_price, rating, reviews, delivery, extensionsposition. Nó cũng xử lý bộ lọc Shopping và các liên kết bộ lọc đã mã hóa.

Mức giá khá hấp dẫn — 1.000 credits miễn phí để bắt đầu, và các request Shopping tốn khoảng 10 credits mỗi request. Một lưu ý: cách diễn đạt giá trên các trang công khai của Scrapingdog khá không nhất quán, nên hãy kiểm tra lại mức giá hiện tại trước khi chốt.

Tính năng chính cho Google Shopping

  • Endpoint Shopping riêng với JSON có cấu trúc
  • Xử lý bộ lọc cho các bộ lọc đặc thù của Shopping
  • Xoay proxy, render JS, thử lại
  • Hỗ trợ geo-targeting
  • Gói miễn phí để kiểm thử

Giá

  • 1.000 credits miễn phí
  • Request Shopping: khoảng 10 credits mỗi request
  • Các gói trả phí tăng dần từ đó, nhưng hãy kiểm tra giá hiện tại vì tài liệu công khai có vài điểm không nhất quán

Ưu và nhược điểm

  • Ưu điểm: Hỗ trợ Shopping rõ ràng, xử lý bộ lọc, có gói miễn phí, định vị giá thân thiện ngân sách
  • Nhược điểm: Diễn đạt giá cả không nhất quán trên các trang công khai, mạng proxy nhỏ hơn các lựa chọn doanh nghiệp, chỉ có API, tín hiệu đánh giá lẫn lộn

9. Firecrawl

Screenshot 2026-04-22 at 4.20.59 PM_compressed.webp Firecrawl là một công cụ web scraping dùng AI, chuyển trang web thành dữ liệu sạch và có cấu trúc. Nó hỗ trợ các chế độ search, crawl và scrape với đầu ra JSON, Markdown, HTML hoặc ảnh chụp màn hình.

Cách trích xuất bằng AI của Firecrawl đọc và diễn giải nội dung trang thay vì dựa vào CSS selector cố định — cùng triết lý khá giống cách tiếp cận của Thunderbit. Tuy nhiên, tôi không tìm thấy parser Google Shopping riêng hay schema trường dành riêng cho Shopping trong tài liệu công khai hiện tại của Firecrawl. Endpoint tìm kiếm của họ trả về các trường chung như title, descriptionurl. Vì vậy, đây là đề xuất Một phần cho Shopping: AI extraction có thể xử lý các trang Shopping, nhưng chưa có hỗ trợ Shopping chuyên biệt được xác minh.

Tính năng chính cho Google Shopping

  • Trích xuất dữ liệu bằng AI
  • Xử lý các trang được render bằng JavaScript
  • Chế độ search, crawl và scrape
  • Đầu ra: JSON, Markdown, HTML, ảnh chụp màn hình
  • Xử lý hàng loạt và truy cập API

Giá

  • 500 credits miễn phí
  • Hobby: $16/tháng
  • Standard: $83/tháng
  • Growth: $333/tháng
  • Search tốn 2 credits cho mỗi 10 kết quả; scrape tốn 1 credit mỗi trang

Ưu và nhược điểm

  • Ưu điểm: AI extraction thích ứng tốt với thay đổi bố cục, xử lý nội dung động tốt, nhiều định dạng đầu ra, phù hợp scraping đa mục đích
  • Nhược điểm: Không có parser Shopping được xác minh, thiên về API/dev, sản phẩm còn khá mới, chi phí tăng nhanh ở quy mô lớn

10. Scrape.do

scrape-do-website-homepage.webp Scrape.do là một API web scraping ưu tiên developer, sở hữu một trong những tài liệu kỹ thuật hay nhất về scraping Google Shopping mà bạn có thể tìm thấy. Hướng dẫn scraping Shopping của họ giải thích việc tải bất đồng bộ, token ẩn và tham số phía máy chủ khiến Shopping khó xử lý — đọc rất có giá trị.

Bên dưới, nó cung cấp xoay proxy, giải CAPTCHA, render JavaScript và API AI Mode để xuất dữ liệu có cấu trúc. Các target Google tốn 10 credits mỗi request, với 1.000 credits miễn phí trong gói free. Nhưng trong tài liệu Google Search API của họ không có schema trường Shopping gọn gàng — bạn được kỳ vọng sẽ tự xây parser dựa trên hạ tầng đó.

Tính năng chính cho Google Shopping

  • API web scraping với xoay proxy và giải CAPTCHA
  • Render JavaScript và hành vi trình duyệt được quản lý
  • AI Mode API để xuất dữ liệu có cấu trúc
  • Tài liệu scraping Google Shopping rất chi tiết
  • Khả năng vượt chống bot mạnh

Giá

Ưu và nhược điểm

  • Ưu điểm: Chuyên môn sâu về Google Shopping (có hướng dẫn đã xuất bản), xử lý chống bot và CAPTCHA tốt, AI Mode API, linh hoạt và tùy biến cao
  • Nhược điểm: Cần kỹ năng code, không có UI trực quan, đường học khá dốc, không có schema trường Shopping đóng gói sẵn — thiên về hạ tầng hơn là sản phẩm hoàn chỉnh

So sánh các Google Shopping Scraper tốt nhất: Bảng đầy đủ đặt cạnh nhau

Đây là bảng mà không bài nào khác có: một ma trận thống nhất của cả 10 công cụ, được đánh giá riêng cho Google Shopping.

Công cụHỗ trợ ShoppingCách tiếp cậnChi phí ước tính mỗi 1K kết quảChống botĐiểm dữ liệu chínhPhân trang & lập lịchĐịnh dạng xuấtDễ sử dụng
ThunderbitĐã xác minhKhông cần code~$18–30 (dựa trên credits)Chế độ trình duyệt + cloudSản phẩm, URL, giá, giá gốc, đánh giá, review, nhà bán lẻCó / CóExcel, Sheets, Airtable, Notion, CSV, JSON5/5
SerpApiĐã xác minhAPI~$75 cho 5K lượt tìm kiếmTrình duyệt được quản lý + CAPTCHATiêu đề, link, ID sản phẩm, nguồn, giá, giá cũ, đánh giá, review, giao hàngCó / Bên ngoàiJSON, HTML thô4/5
OxylabsĐã xác minhAPI~$1.35/1K (gói JS)Proxy cao cấp, vượt CAPTCHATrường cấp tìm kiếm + cấp chi tiết sản phẩmCó / CóJSON, CSV, TXT, Markdown, HTML, PNG3/5
Bright DataĐã xác minhAPI / Nền tảng~$0.50/1K bản ghi (tối thiểu $50)Proxy, CAPTCHA, parsingID sản phẩm, tiêu đề, giá, review, ảnh, biến thểCó / Có (tracker)JSON, NDJSON, CSV, webhook, cloud storage3/5
ApifyĐã xác minhKết hợp~$0.50–$7.04/1K (phụ thuộc actor)Actor trình duyệt + proxy residentialTùy actor: tiêu đề, giá, người bán, review, giao hàngCó / CóJSON, CSV, XML, RSS, Excel, HTML3/5
ScrapingBeeĐã xác minhAPI~500 credits cho 1K dòngXoay proxy, trình duyệt headlessTên, giá, đánh giá, review, cửa hàng, giao hàng, thứ hạng, link sản phẩmCó / Qua tích hợpJSON, xuất qua tích hợp4/5
Serper.devMột phầnAPI~$1/1K truy vấnStack thử lại chungChỉ các trường SERP chungBên ngoài / Bên ngoàiJSON4/5
ScrapingdogĐã xác minhAPI~500 credits cho 1K dòngXoay proxy, render JSTiêu đề, giá, giá cũ, đánh giá, review, giao hàng, bộ lọcCó / YếuJSON4/5
FirecrawlMột phầnAPI / AI~200 credits cho 1K kết quảProxy, render JSĐầu ra tìm kiếm + scrape chungBên ngoài / Bên ngoàiJSON, Markdown, HTML, ảnh chụp màn hình3/5
Scrape.doMột phầnAPI / Code~500 credits cho 1K dòngChống bot mạnh, trình duyệt được quản lýGoogle chung + trích xuất Shopping thôBên ngoài / Bên ngoàiJSON, workflow thô2/5

Các điểm rút ra chính từ bảng:

  • Hỗ trợ Shopping đã xác minh đến từ Thunderbit, SerpApi, Oxylabs, Bright Data, Apify, ScrapingBee và Scrapingdog.
  • Dễ nhất cho người không kỹ thuật: Thunderbit (dễ dùng 5/5, không cần code).
  • API tốt nhất cho developer: SerpApi (schema trưởng thành, tài liệu tuyệt vời).
  • Lựa chọn enterprise tốt nhất: Oxylabs và Bright Data.
  • Lựa chọn tiết kiệm: Scrapingdog và Serper.dev (dù Serper.dev chưa có bằng chứng Shopping đã xác minh).

Chi phí thực tế để scrape Google Shopping: Các mức ngân sách cho từng đội ngũ

Giá cả trong thị trường này thực sự rất rối. Công cụ tính theo lượt tìm kiếm, theo dòng, theo credit, theo bản ghi hoặc theo mức tối thiểu của dataset — và các đơn vị này hiếm khi khớp nhau. Khung ngân sách dưới đây gắn với các trường hợp sử dụng thực tế:

Khối lượng hàng thángTầng khuyến nghịCông cụ ví dụChi phí hàng tháng ước tính
Dưới 500 kết quảMiễn phí / tiện ích trình duyệtGói miễn phí Thunderbit, gói miễn phí SerpApi, credit miễn phí của Scrapingdog$0
500–5.000 kết quảAPI chi phí thấp hoặc gói pro của tiện íchThunderbit Pro, Serper.dev, Scrapingdog, ScrapingBee$0–$50
5.000–50.000 kết quảAPI tầm trungSerpApi, ScrapingBee, Oxylabs, actor của Apify$50–$300
50.000+ kết quảAPI doanh nghiệp hoặc nền tảng dữ liệuBright Data, Oxylabs Enterprise$300+

Một vài cái bẫy chi phí cần để ý:

  • API tính theo lượt tìm kiếm trông rẻ cho đến khi bạn phân trang sâu — mỗi trang kết quả tính là một lượt tìm kiếm riêng
  • Công cụ tính theo dòng (như Thunderbit) dễ lập ngân sách hơn vì bạn biết chính xác 1.000 dòng tốn bao nhiêu
  • Công cụ dataset (như Bright Data) có đơn giá thấp nhưng mức tối thiểu cao ($50+)
  • Marketplace actor (như Apify) có thể rất đáng tiền nhưng giá giữa các actor không đồng đều

Người dùng than phiền rằng "$50 cho khoảng 20K request" thấy quá cao đối với một dự án sở thích là có lý. Hãy chọn công cụ đúng với khối lượng thực tế của bạn — đừng trả giá doanh nghiệp cho một catalog nhỏ.

Từ scrape một lần sang theo dõi Google Shopping liên tục

Hầu hết hướng dẫn scraping dừng lại ở mức "đây là cách scrape một lần." Nhưng đội ngũ thương mại điện tử cần theo dõi liên tục: kiểm tra giá hằng ngày, theo dõi PLA hằng tuần, cảnh báo khi đối thủ đổi giá. Dưới đây là cách thiết lập.

Bước 1: Xác định phạm vi theo dõi

Bắt đầu từ những điều cơ bản: cần theo dõi từ khóa nào, đối thủ nào, thị trường hoặc khu vực nào. Kết quả Google Shopping thay đổi theo vị trí, nên geo-targeting rất quan trọng. Các công cụ như SerpApi, Oxylabs và ScrapingBee đều hỗ trợ tham số vị trí. Thunderbit chạy trong trình duyệt của bạn, nên bạn có thể dùng VPN hoặc proxy để mô phỏng các khu vực khác nhau.

Bước 2: Thiết lập scraping theo lịch

Đây là điểm các công cụ phân hóa rất rõ:

  • Thunderbit: Mô tả lịch bằng ngôn ngữ tự nhiên (ví dụ: "mỗi thứ Ba lúc 8 giờ sáng"), nhập URL Google Shopping của bạn, và scraper sẽ tự chạy. Không cần cron job, không cần điều phối bên ngoài.
  • Apify: Actor hỗ trợ Apify Scheduler cho các lần chạy định kỳ — hằng ngày, hằng tuần hoặc khoảng thời gian tùy chỉnh.
  • Bright Data: Google Shopping Price Tracker hỗ trợ cập nhật theo giờ, theo ngày hoặc theo tuần, với cảnh báo qua email, Slack hoặc thông báo file.
  • Công cụ chỉ có API (SerpApi, Serper.dev, ScrapingBee, Scrapingdog, Firecrawl, Scrape.do): Bạn sẽ cần bộ lập lịch bên ngoài — cron job, Zapier, n8n hoặc công cụ tương tự.

Bước 3: Xuất sang hệ thống theo dõi của bạn

  • Google Sheets: Tốt nhất cho dashboard đơn giản và đội nhỏ. Thunderbit, Apify và ScrapingBee (qua tích hợp) đều hỗ trợ xuất thẳng sang Sheets.
  • Airtable hoặc Notion: Tốt hơn cho cộng tác nhóm và các chế độ xem dữ liệu phong phú. Thunderbit xuất trực tiếp sang cả hai.
  • Pipeline API: Với hoạt động lớn hơn, đẩy JSON đầu ra vào kho dữ liệu hoặc công cụ BI của bạn.

Bước 4: Phát hiện bất thường và hành động

Những gì cần để ý trong dữ liệu:

  • Giá giảm hoặc tăng đột biến từ một số người bán nhất định
  • Người bán mới xuất hiện ở sản phẩm bạn theo dõi
  • Thay đổi vị trí PLA (quảng cáo của bạn so với đối thủ)
  • Cảnh báo hết hàng
  • Số lượng review hoặc điểm đánh giá thay đổi

Ví dụ nhỏ: Theo dõi 50 sản phẩm đối thủ mỗi tuần

Công cụKiểu thiết lậpChi phí thực tếPhù hợp nhất
ThunderbitKhông cần code, ưu tiên trình duyệt~50 dòng/tuần × 4 tuần = 200 dòng/tháng; vừa một gói chi phí thấpNhanh nhất cho đội nhỏ
SerpApiPipeline API~50 lượt tìm kiếm/tuần × 4 = 200 lượt tìm kiếm/tháng; có thể nằm trong gói miễn phí (có lưu ý)Tốt nhất cho đội dev quy mô nhỏ
Bright DataTracker doanh nghiệpQuá mức cần thiết cho 50 sản phẩm, trừ khi bạn cần cảnh báo, tuân thủ và theo dõi thị trường rộng hơnTốt nhất cho vận hành bán lẻ lớn hơn

Có hợp pháp khi scrape kết quả Google Shopping không?

Câu hỏi này đủ thường xuyên nên cần trả lời ngắn gọn.

Kết quả Google Shopping là dữ liệu công khai. Việc scrape dữ liệu công khai cho mục đích kinh doanh hợp pháp — theo dõi giá, nghiên cứu cạnh tranh, phân tích thị trường — nhìn chung được xem là hợp pháp theo án lệ hiện hành của Hoa Kỳ. Phán quyết năm 2022 của Tòa phúc thẩm Khu vực 9 trong vụ hiQ v. LinkedIn khẳng định rằng việc truy cập các trang công khai không tự động tạo ra trách nhiệm theo CFAA về truy cập "không được phép".

Tuy vậy, Điều khoản Dịch vụ của Google (có hiệu lực từ tháng 5/2024) có đề cập việc cấm truy cập tự động vi phạm các chỉ dẫn máy đọc được như robots.txt. Người dùng doanh nghiệp nên rà soát điều này cùng tư vấn pháp lý cho quy trình cụ thể của mình.

Tuyên bố miễn trừ trách nhiệm tiêu chuẩn: đây không phải là tư vấn pháp lý. Để hiểu thêm về hệ quả pháp lý của web scraping, hãy tham khảo chuyên gia pháp lý.

Google Shopping Scraper nào phù hợp với bạn?

Tôi sẽ ghép từng nhóm người mua với một công cụ như sau:

  • Đội không kỹ thuật (vận hành e-commerce, quản lý PPC, sales): Thunderbit. Scrape hai cú nhấp, không cần code, AI thích ứng với thay đổi bố cục, lập lịch tích hợp sẵn, xuất miễn phí sang Sheets/Airtable/Notion. Đây là công cụ duy nhất trong danh sách được thiết kế cho những người không muốn chạm vào terminal.
  • Developer xây dựng data pipeline: SerpApi. Endpoint Shopping riêng, schema trưởng thành, tài liệu tuyệt vời, JSON có cấu trúc. Chuẩn vàng cho scraping Shopping ưu tiên API.
  • Vận hành quy mô doanh nghiệp: Oxylabs hoặc Bright Data. Mạng proxy khổng lồ, SLA, xử lý mọi khối lượng. Bright Data bổ sung dataset và price tracker cho các đội muốn giám sát dựng sẵn.
  • Người dùng API nhạy cảm về ngân sách: Scrapingdog hoặc Serper.dev. Chi phí thấp nhất theo request và có gói miễn phí. Scrapingdog đã xác minh hỗ trợ Shopping; Serper.dev rẻ hơn nhưng chưa có bằng chứng công khai cho Shopping.
  • Trích xuất ưu tiên AI: Thunderbit hoặc Firecrawl. Cả hai dùng AI để diễn giải cấu trúc trang thay vì selector cố định. Chỉ Thunderbit có xác minh công khai mạnh mẽ dành riêng cho Shopping.
  • Linh hoạt theo kiểu marketplace: Apify. Nhiều actor Shopping, có lập lịch, nhiều định dạng xuất — nhưng kết quả phụ thuộc vào actor bạn chọn.
  • Kiểm soát hoàn toàn cho developer: Scrape.do. Tài liệu kỹ thuật tốt nhất về cơ chế Shopping, stack chống bot mạnh, nhưng cần Python và thời gian thiết lập đáng kể.

Nếu bạn muốn xem scraping Google Shopping không cần code hoạt động thế nào, hãy thử miễn phí Thunderbit Chrome Extension. Hai cú nhấp, dữ liệu thật, không cần API key. Và nếu Thunderbit không phù hợp, tôi hy vọng bài so sánh này giúp bạn tìm được công cụ phù hợp. Chúc bạn scraping vui vẻ — và mong dữ liệu Shopping của bạn luôn có cấu trúc, luôn mới và luôn sẵn sàng để hành động.

Thử Thunderbit Chrome Extension Get Started Free

Thử Thunderbit miễn phí

Câu hỏi thường gặp

Có thể scrape Google Shopping miễn phí không?

Có, nhưng ở mức giới hạn. Thunderbit có gói miễn phí (6 trang), SerpApi cung cấp 250 lượt tìm kiếm miễn phí/tháng, Serper.dev cho 2.500 truy vấn miễn phí, Scrapingdog bao gồm 1.000 credits miễn phí, và Firecrawl bắt đầu với 500 credits miễn phí. Gói miễn phí rất tốt cho việc thử nghiệm và nghiên cứu quy mô nhỏ, nhưng việc theo dõi liên tục ở bất kỳ khối lượng thực tế nào sẽ cần gói trả phí.

Chi phí scrape kết quả Google Shopping là bao nhiêu?

Điều đó phụ thuộc vào khối lượng và công cụ bạn chọn. Dưới 500 kết quả/tháng, chi phí là $0 (gói miễn phí). Với 500–5.000 kết quả, hãy kỳ vọng $0–$50/tháng với các công cụ như Thunderbit Pro, Serper.dev hoặc Scrapingdog. Dùng API tầm trung (5.000–50.000 kết quả) sẽ vào khoảng $50–$300/tháng với SerpApi, ScrapingBee hoặc Oxylabs. Vận hành quy mô doanh nghiệp (50.000+ kết quả) thường tốn $300+ với Bright Data hoặc Oxylabs Enterprise.

Có thể trích xuất dữ liệu gì từ Google Shopping?

Trong các công cụ đã xác minh, những trường phổ biến nhất là: tiêu đề sản phẩm, giá (hiện tại và gốc), tên người bán/nhà bán lẻ, link sản phẩm, ID sản phẩm, đánh giá, số lượng review, thông tin giao hàng/vận chuyển, URL hình ảnh hoặc thumbnail, và tình trạng còn hàng. Một số công cụ còn thu thập cờ quảng cáo/PLA, tính năng sản phẩm và dữ liệu bộ lọc. Các trường chính xác sẽ khác nhau theo từng công cụ — xem bảng so sánh ở trên để biết chi tiết.

Tôi có cần kỹ năng code để scrape Google Shopping không?

Không. Các tiện ích trình duyệt như Thunderbit không cần code — bạn chỉ cần nhấp nút và nhận dữ liệu có cấu trúc. Các công cụ API (SerpApi, ScrapingBee, Scrapingdog) cần kỹ năng developer cơ bản hoặc tích hợp qua nền tảng như Zapier hay n8n. Các scraper tùy biến hoàn toàn (Scrape.do, Firecrawl) cần Python hoặc kiến thức lập trình tương tự. Nếu bạn không chuyên kỹ thuật, hãy bắt đầu bằng công cụ no-code và chỉ chuyển sang API khi quy mô buộc phải làm vậy.

Nên scrape Google Shopping bao lâu một lần để theo dõi giá?

Với các ngành thay đổi nhanh như điện tử, thời trang hoặc nhóm có nhiều khuyến mãi, theo dõi hằng ngày là mức cơ bản hợp lý — giá có thể thay đổi nhiều lần trong ngày khi có sự kiện giảm giá. Với các ngành biến động chậm hơn (đồ nội thất, vật tư công nghiệp), mỗi tuần có thể đủ. Các công cụ có lập lịch tích hợp sẵn (Thunderbit, Apify, price tracker của Bright Data) giúp thiết lập các lần scrape lặp lại rất dễ. Hãy bắt đầu với tần suất hằng tuần và tăng lên nếu bạn nhận ra mình đang bỏ lỡ những thay đổi giá quan trọng.

Thử AI Web Scraper cho Google Shopping Get Started Free

Tìm hiểu thêm

Mục lục

Cào một trang web chỉ bằng cách hỏi

Nói bạn cần gì bằng tiếng Anh đơn giản. Hoặc tốt hơn, không cần nói gì cả.

Dùng Thunderbit ngay miễn phí
Trích xuất dữ liệu bằng AI
Dễ dàng chuyển dữ liệu sang Google Sheets, Airtable hoặc Notion
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week