Nếu bạn từng cố lấy dữ liệu Twitter miễn phí vào năm 2023 rồi quay lại vào 2026 với kỳ vọng mọi thứ vẫn y như cũ, thì bạn sẽ phải ngỡ ngàng. API miễn phí đã biến mất, luồng nghiên cứu học thuật cũng không còn, và một nửa số công cụ mã nguồn mở từng vận hành cả phòng lab nghiên cứu giờ đã thành “hóa thạch số”.
Những thay đổi về giá của X đã buộc các nhóm nghiên cứu, đội sales, marketer và data scientist phải xây dựng lại những quy trình vốn phụ thuộc vào quyền truy cập miễn phí hoặc giá rẻ. Tính đến mốc nghiên cứu tháng 8/2026, có 12 lựa chọn còn hoạt động, với mức chi phí, cách lấy dữ liệu và nhóm nhu cầu mục tiêu khác nhau. “Vẫn còn hoạt động” chỉ có nghĩa là sản phẩm hoặc danh sách hiện tại có thể được xác minh — không có nghĩa mọi lựa chọn đều được X ủy quyền, đầy đủ, hay phù hợp để dùng trong môi trường production.
Vì sao “nhà cung cấp dữ liệu Twitter” lại trở thành một cụm từ tìm kiếm?
Vài năm trước, hầu như chẳng ai đi tìm “Twitter data providers”. Bạn chỉ cần dùng API miễn phí, hoặc chạy snscrape, hoặc lấy một thư viện như Tweepy là có thể triển khai ngay. Rồi thương vụ Elon Musk diễn ra, và các domino đổ rất nhanh:
- Đầu 2023: Quyền truy cập miễn phí vào API v1.1 bị chấm dứt. Các gói trả phí được đưa vào thay thế.
- Giữa 2023: Track Academic Research bị khai tử — một “phao cứu sinh” của hàng nghìn nhà nghiên cứu, biến mất chỉ sau một đêm.
- 2023–2024: X dùng các gói thuê bao có tên như Basic và Pro. Những gói này giờ chỉ còn là bối cảnh lịch sử, không còn là hướng dẫn mua hiện tại.
- 2025–2026: X chuyển sang mô hình credit trả trước, tính phí theo mức sử dụng. Không còn gói tháng cố định. Mức đọc Post tiêu chuẩn: $0.005. Đọc User: $0.010. Trần tự phục vụ: hai triệu lượt đọc Post mỗi tháng.
Kỷ nguyên dùng thư viện miễn phí cũng suy yếu song song. Tìm kiếm X của snscrape không còn đáng tin, Twint đã được lưu trữ như dự án ngừng phát triển, và hệ sinh thái Nitter công khai nhiều lần bị X chặn hoặc làm gián đoạn. Đó là lý do “Twitter data providers” trở thành một truy vấn tìm kiếm thực sự: các đội ngũ cần những phương án thay thế bền hơn.
Cái gì đã “chết”, cái gì đã hỏng: kiểm tra các công cụ Twitter miễn phí cho năm 2026
Trước khi đi vào 12 lựa chọn hiện tại, cần tách bạch API client với phương thức thu thập dữ liệu và loại bỏ những khuyến nghị không còn mang lại khả năng truy cập ổn định.
| Công cụ | Trạng thái (2026) | Ghi chú |
|---|---|---|
| snscrape | ⚠️ Hỏng / không được duy trì | Commit đáng tin cậy cuối cùng là năm 2023; thay đổi endpoint của X đã làm nó không còn hoạt động |
| Twint | ❌ Đã chết | Repo đã được lưu trữ; không còn chạy được từ khi API v1.1 bị ngừng |
| Nitter | ⚠️ Không ổn định nếu dùng như lớp cung cấp dữ liệu | Các instance công khai và cách truy cập liên tục bị X làm gián đoạn |
| Tweepy | ✅ Hoạt động (với API key trả phí) | Vẫn được duy trì, nhưng cần API key trả phí của X — không còn miễn phí |
| twarc | ✅ Hoạt động (với API key trả phí) | Được cộng đồng học thuật duy trì; cũng cần key trả phí |
Tweepy và twarc là API client, không phải nhà cung cấp dữ liệu; chúng chỉ hữu ích khi đi kèm quyền truy cập API X hợp lệ ở thời điểm hiện tại. snscrape, Twint và Nitter không nên được xem là lớp thu thập dữ liệu bền vững cho một workflow production mới.
Hiện vẫn có các phương án thay thế, nhưng không phương án nào tái tạo được sự kết hợp cũ: truy cập rộng, bền, miễn phí và thiết lập tối giản.
Các nhà cung cấp dữ liệu Twitter thực sự lấy dữ liệu bằng cách nào

Không phải “Twitter data providers” nào cũng hoạt động giống nhau, và sự khác biệt này rất quan trọng — về độ tin cậy, tuân thủ và chi phí. Đây là cách tôi phân loại:
-
Truy cập API chính thức — Bạn dùng API key X của chính mình, gọi trực tiếp endpoint của X, và tuân thủ rate limit cùng chính sách nhà phát triển của X. Tweepy và twarc thuộc nhóm này. API X cũng vậy.
-
API dựa trên scraping — Nhà cung cấp vận hành quá trình thu thập tự động từ web công khai (trình duyệt, endpoint đảo ngược kỹ thuật, v.v.) rồi bán cho bạn đầu ra dưới dạng API sạch sẽ. Nhanh hơn và thường rẻ hơn, nhưng Điều khoản Dịch vụ và quy tắc tự động hóa của X cấm thu thập hoặc scraping nếu không có chấp thuận bằng văn bản trước. Bright Data, SocialData.tools và phần lớn Apify Actors nằm ở nhóm này.
-
Nền tảng social listening được cấp phép — Các nhà cung cấp enterprise như Brandwatch và Meltwater trước đây có thỏa thuận cấp độ firehose với Twitter. Một số vẫn giữ quan hệ đối tác chính thức; số khác vận hành theo các hợp đồng đang thay đổi. Phạm vi dữ liệu, quyền export và quy tắc che dữ liệu khác nhau tùy gói.
-
Công cụ trích xuất dựa trên trình duyệt — Những công cụ như Thunderbit có thể cấu trúc dữ liệu hiển thị trên các trang tương thích khi người dùng có quyền tự động hóa. Điều này khác với API hàng loạt hay firehose, và không được dùng như cách lách kiểm soát truy cập của X.
Hiểu một nhà cung cấp thuộc nhóm nào sẽ cho bạn biết khá nhiều về độ bền, vị thế pháp lý và chuyện gì sẽ xảy ra khi X thay đổi hệ thống.
Cần nhìn vào điều gì khi chọn nhà cung cấp dữ liệu Twitter

Mỗi lựa chọn được đánh giá theo sáu tiêu chí thực tế:
- Phương thức truy cập dữ liệu — API chính thức, scraping, social listening được cấp phép, hay dựa trên trình duyệt?
- Minh bạch giá và chi phí khởi điểm — Có xem được giá trước khi nói chuyện với sales không?
- Loại dữ liệu trả về — Posts, profiles, chỉ số tương tác, kho dữ liệu lịch sử?
- Tư thế tuân thủ — Có phù hợp với ToS, sẵn sàng cho GDPR/CCPA, và xử lý xóa dữ liệu ra sao?
- Rào cản kỹ thuật — Chỉ dành cho developer, hay người không biết code cũng dùng được?
- Bằng chứng độ tin cậy — Có SLA, lịch sử trạng thái, tín hiệu bảo trì và quy trình thông báo thay đổi không?
Không có nhà cung cấp nào thắng ở cả sáu tiêu chí. Lựa chọn đúng phụ thuộc vào khối lượng, ngân sách, kỹ năng kỹ thuật và mức độ bạn chấp nhận phải bảo trì. Với khung đó, đây là 12 lựa chọn.
So sánh 12 nhà cung cấp dữ liệu Twitter (2026)
Trước khi đi sâu, đây là bảng so sánh đầy đủ. Giá được ghi nhận tại thời điểm xuất bản — hãy luôn kiểm tra lại trên website của nhà cung cấp vì thị trường này thay đổi rất nhanh.
| Nhà cung cấp | Phương thức truy cập | Giá khởi điểm | Dữ liệu lịch sử | Thời gian thực | Tùy chọn no-code | Phù hợp nhất cho |
|---|---|---|---|---|---|---|
| X Official API | API trực tiếp từ chính bên thứ nhất | $0.005/Post read (trả theo lượt dùng) | Full Archive tới tháng 3/2006 | Có (Filtered Stream) | Không | Developer cần endpoint chính thức |
| Bright Data | Scraper được quản lý + datasets | Miễn phí 5K bản ghi/tháng; PAYG $1.50/1K | Tùy chọn theo dataset/khoảng ngày; không thấy cam kết full archive | Scrape live theo yêu cầu | Một phần (bảng điều khiển) | Thu thập web công khai ở quy mô lớn, được quản lý |
| SocialData.tools | API dựa trên scraping | ~$0.20/1K items | Tùy truy vấn/cursor | Có | Không | Thử nghiệm của developer với chi phí thấp |
| Apify | Marketplace (tùy Actor) | Nền tảng miễn phí $5/tháng; giá từng Actor khác nhau | Tùy Actor | Có | Một phần (GUI của Actor) | Workflow tự động hóa, tạo mẫu |
| Netrows | API làm giàu dữ liệu công khai | €99/tháng cho 10K credits | Không có archive | Có (live, không cache) | Một phần | Làm giàu dữ liệu B2B, tạo mẫu |
| PhantomBuster | Tự động hóa theo session/trình duyệt | $56/tháng (giá hiệu dụng theo năm tại mốc nghiên cứu) | Không có archive đảm bảo | Polling theo lịch / chế độ watcher | Có | Workflow lead-gen quy mô nhỏ |
| RapidAPI endpoints | Marketplace (tùy danh sách) | Miễn phí 200 request → $9.99/10K | Tùy | Tùy | Không | Test API nhanh, tạo mẫu |
| Phyllo | Hạ tầng API đa nền tảng | Báo giá tùy chỉnh | Chưa rõ độ sâu riêng cho X | Claim webhook/thời gian thực | Không | Phân tích creator/influencer |
| Brandwatch | Social listening enterprise (nhà cung cấp tự xác định là Official X Partner) | Báo giá tùy chỉnh | Tùy sản phẩm/gói; có gói full-firehose | Có, tùy sản phẩm | Có (dashboard) | Quản lý thương hiệu, sentiment, nghiên cứu |
| Meltwater | Media + social intelligence enterprise | Báo giá tùy chỉnh | 15 tháng lịch sử social tức thì | Có | Có (dashboard) | PR, truyền thông, media intelligence |
| Sprout Social | Quản lý social + add-on Listening | $199/seat/tháng (theo năm) + Listening trả thêm | Lấy mẫu; tự backfill 30 ngày | Có (theo mẫu) | Có (dashboard) | Đội social, đăng bài + phân tích |
| Thunderbit | Trích xuất dựa trên trình duyệt | Có gói miễn phí | Chỉ ở cấp trang | Ở cấp trang | Có (extension) | Người dùng không chuyên cần trích xuất dữ liệu hiển thị |
Bây giờ là phần chi tiết.
1. X (Twitter) Official API

API chính thức của X là nguồn first-party duy nhất trong danh sách này và là lựa chọn duy nhất có kho tìm kiếm đầy đủ được ghi nhận quay lại tháng 3/2006. Nếu tuân thủ và nguồn gốc dữ liệu là ưu tiên hàng đầu, đây là nơi bạn nên bắt đầu.
Cách hoạt động: Các endpoint REST và streaming trực tiếp. Bạn đăng ký ứng dụng, lấy API key, xác thực qua OAuth và truy vấn các endpoint cho Posts, Users, lượt thích, list, v.v.
Tính năng chính:
- Recent Search bao phủ 7 ngày gần nhất (tối đa 100 Posts mỗi phản hồi)
- Full-Archive Search truy ngược tới tháng 3/2006 (tối đa 500 Posts mỗi phản hồi, theo mô hình trả theo lượt dùng và Enterprise)
- Filtered Stream trả về các Public Post phù hợp gần thời gian thực (~6–7 giây độ trễ P99)
- Đầy đủ đối tượng Post, hồ sơ người dùng, chỉ số tương tác, endpoint tuân thủ
Giá: X đã chuyển sang credit trả trước, không còn thuê bao hay cam kết tối thiểu. Tại mốc nghiên cứu tháng 8/2026: đọc Post $0.005, đọc User $0.010, đọc Like $0.001. Tài khoản tự phục vụ bị giới hạn hai triệu lượt đọc Post mỗi tháng. Giá Enterprise là báo giá tùy chỉnh. Hãy kiểm tra Developer Console trước khi lập ngân sách vì X cho biết giá có thể thay đổi.
Lưu ý: Tính đến đợt di chuyển search index của X ngày 4/5/2026, tìm kiếm REST theo từ khóa không còn trả về reposts. Filtered Stream không bị ảnh hưởng. Điều này làm thay đổi thành phần corpus so với các hướng dẫn cũ.
Phù hợp nhất cho: Developer cần dữ liệu thô chính thức, có thể tái lập. Tổ chức nhạy cảm với compliance. Bất kỳ ai cần toàn bộ kho lịch sử.
Không lý tưởng cho: Người không chuyên, đội có ngân sách eo hẹp, hoặc bất kỳ ai cần dữ liệu số lượng lớn vượt trần tự phục vụ.
2. Bright Data

Bright Data cung cấp cả API scraping X được quản lý và bộ dataset dựng sẵn. Các trang sản phẩm được xem xét cho thấy khả năng thu thập và phân phối hiện tại, nhưng không cho thấy quan hệ đối tác chính thức với X hay một kho lưu trữ lịch sử đầy đủ.
Tính năng chính:
- Hồ sơ, Posts, URL và các tác vụ discovery
- Job đồng bộ (tối đa 20 URL) và bất đồng bộ (tối đa 5,000 URL)
- Xuất ra JSON, NDJSON hoặc CSV qua API, webhook, cloud storage hoặc data warehouse
- 5,000 bản ghi miễn phí mỗi tháng; PAYG ở mức $1.50 cho mỗi 1,000 bản ghi thành công; gói Scale $499/tháng bao gồm 384,000 bản ghi
Lưu ý về compliance: Bright Data có công bố các kiểm soát về bảo mật và tuân thủ, nhưng các trang được xem xét không xác nhận ủy quyền hay partnership chính thức từ X. Đây là scraper cho web công khai được quản lý, không phải nhà bán lại API chính thức. Công cụ vận hành giúp giảm công bảo trì collector, nhưng không xóa bỏ trách nhiệm của người mua theo điều khoản X, luật riêng tư hoặc các hạn chế sử dụng đầu ra.
Phù hợp nhất cho: Đội enterprise cần pipeline dữ liệu X lớn, chạy liên tục và chấp nhận tư thế tuân thủ của việc thu thập dựa trên scraping.
Dataset của Bright Data so với Live Scraping
Bright Data có cả sản phẩm dataset dựng sẵn lẫn live scraping qua hạ tầng của mình. Dataset phù hợp cho nghiên cứu một lần hoặc snapshot lịch sử; live scraping phù hợp cho giám sát liên tục. Hãy chọn theo nhu cầu: bộ dữ liệu tĩnh hay luồng dữ liệu liên tục.
3. SocialData.tools

SocialData.tools quảng bá hơn 30 endpoint chỉ đọc cho Posts, profile, search, followers, mentions, replies, quotes, threads, lists, Communities và Spaces. Mức giá phổ biến là $0.20 cho mỗi 1,000 items, một số endpoint chuyên biệt có giá cao hơn.
Tính năng chính:
- REST/JSON API kèm hỗ trợ MCP server
- Trả phí theo request, không thuê bao
- Bao phủ rất nhiều kiểu dữ liệu X
Điểm cần lưu ý (và rất quan trọng): Điều khoản của SocialData.tools mô tả rõ dịch vụ như một dịch vụ scraping nội dung. Nguồn dữ liệu chỉ được ghi là “nhiều nguồn khác nhau”. Khách hàng phải đảm bảo việc thu thập là được phép. Nhà cung cấp có thể ngừng dịch vụ nếu nguồn đích phản đối. Tài liệu search của họ cũng thừa nhận có thể bỏ sót và lỗi cursor. Dù có ngôn ngữ “Try for Free”, không thấy gói miễn phí công khai — chỉ có thể có bản demo do support cung cấp.
Phù hợp nhất cho: Developer muốn dữ liệu Post và profile giá thấp, đồng thời chấp nhận rủi ro về nguồn gốc và chính sách sau khi tự thẩm định.
4. Apify

Apify là nền tảng scraping và tự động hóa web, lưu trữ các “Actor” do cộng đồng xây dựng — những scraper dựng sẵn chạy trên cloud. Trên marketplace có nhiều Actor X độc lập, mỗi Actor có giá, chất lượng và lịch bảo trì khác nhau.
Tính năng chính:
- Nền tảng bắt đầu với $5 sử dụng miễn phí mỗi tháng, sau đó là $29/$199/$999 mỗi tháng
- Actor đại diện: xquik/x-tweet-scraper — từ $0.00015 cho mỗi dòng được giao trên gói trả phí; hỗ trợ Posts, replies, profiles, search, threads, quotes, retweeters, media và bộ lọc ngày
- Tích hợp với Zapier, Make, webhooks
Lưu ý quan trọng: Điều khoản của Apify nêu rõ Community Actors không được xem xét, xác minh, chứng thực hay đảm bảo về chất lượng, bảo mật, độ chính xác, tuân thủ pháp lý hoặc bảo trì. Bài viết phải nêu rõ Actor cụ thể đang được đánh giá — câu “Apify có giá X” là vô nghĩa nếu không chỉ ra Actor nào và đơn vị tính phí nào.
Phù hợp nhất cho: Workflow tự động hóa, dự án thu thập dữ liệu một lần, và developer muốn thử nhiều cách scraping trên cùng một nền tảng.
Chọn đúng Twitter Actor trên Apify
Trước khi quyết định, hãy kiểm tra ngày cập nhật cuối của Actor, đánh giá người dùng và trạng thái bảo trì. Một số Actor chậm hơn nhiều tuần so với thay đổi của X và có thể trả về kết quả lỗi thời hoặc hỏng. Huy hiệu hoạt động trên marketplace giúp sàng lọc sơ bộ nhưng không đảm bảo độ tin cậy.
5. Netrows

Netrows là một API làm giàu dữ liệu công khai B2B mới hơn, cung cấp endpoint X bên cạnh dữ liệu LinkedIn. Nền tảng này liệt kê 26 loại endpoint X bao gồm profile, followers, Posts, replies, quotes, threads, search, lists, Communities, trends và Spaces.
Tính năng chính:
- €99/tháng cho 10K credits (50 req/phút), €499 cho 100K, €1,499 cho 500K
- Phản hồi live, không cache (theo công bố của nhà cung cấp)
- Tại mốc nghiên cứu, trang trạng thái công khai vẫn hoạt động; chưa xác minh được SLA công khai riêng cho X
Điểm cần lưu ý: Chi phí credit chính xác cho từng endpoint và schema phản hồi cần API key để kiểm tra. Tài liệu của Netrows cho biết họ không cung cấp archive lịch sử. Điều khoản của họ mô tả việc tự động thu thập từ nguồn công khai, phủ nhận liên kết với X, và yêu cầu người dùng tự chịu trách nhiệm về điều khoản bên thứ ba.
Phù hợp nhất cho: Tạo mẫu và các use case SMB, đặc biệt là các đội cũng cần dữ liệu LinkedIn từ cùng một API.
6. PhantomBuster

PhantomBuster về cơ bản là một công cụ rất khác so với các API ở trên. Đây là tự động hóa trình duyệt dựa trên session cho mục đích prospecting, không phải API dữ liệu hay nguồn cấp được cấp phép. Cần nói rõ điều đó ngay từ đầu.
PhantomBuster kết nối với session X của người dùng qua extension trình duyệt và có thể xuất các kết quả tìm kiếm hiển thị, dữ liệu profile và thông tin follower ra CSV hoặc JSON. Nó có thể chạy theo lịch hoặc ở chế độ watcher.
Tính năng chính:
- GUI no-code được thiết kế cho đội sales và marketing
- Giá hiệu dụng theo năm: $56/tháng (Start), $128/tháng (Grow), $352/tháng (Scale)
- Tập trung vào các trường phục vụ lead-gen, không phải kho tweet đầy đủ
Rủi ro quan trọng: Tài liệu của PhantomBuster cảnh báo rằng vượt giới hạn nền tảng có thể dẫn tới cảnh báo, hạn chế, gắn cờ hoặc khóa. Đây là tự động hóa chạy trong session tài khoản X của bạn — không phải nguồn dữ liệu được ủy quyền. Hãy dùng thận trọng và hiểu rõ rủi ro cho tài khoản.
Phù hợp nhất cho: Workflow sales prospecting quy mô nhỏ, nơi bạn cần dựng danh sách mục tiêu từ profile và follower trên X.
7. RapidAPI Twitter Endpoints

RapidAPI là một marketplace chứa hàng chục endpoint X của bên thứ ba do các developer độc lập cung cấp. Đây không phải một nhà cung cấp duy nhất — mà là một khu chợ.
Listing đại diện: datahungrybeast/twitter154 (“The Old Bird”) — gói Basic miễn phí với 200 request, $9.99 cho 10K, $49.99 cho 100K, $299.99 cho 1M. Cung cấp endpoint cho user, follower, Post, reply, search và list.
Tính năng chính:
- Giao diện REST thống nhất cho nhiều API bên thứ ba
- Có gói miễn phí ở một số listing
- Cách nhanh để thử nhiều hướng tiếp cận
Rủi ro là có thật: Listing này không có website sản phẩm, không có điều khoản dịch vụ riêng cho API, không có ủy quyền từ X, không có cam kết archive, không có SLA thời gian thực, và cũng không có quy trình tuân thủ xóa dữ liệu. Tài liệu của RapidAPI xác nhận rằng nhà xuất bản kiểm soát listing, giá, version và endpoint của họ. Nhiều endpoint được liệt kê đã bị bỏ quên hoặc hỏng.
Cách tránh endpoint “chết” trên RapidAPI
Hãy kiểm tra thống kê thời gian phản hồi, đánh giá người dùng, ngày cập nhật cuối và luôn test bằng gói miễn phí trước khi chuyển sang trả phí. Số người đăng ký cao không phải là SLA.
Phù hợp nhất cho: Test API nhanh và tạo mẫu. Không khuyến nghị làm nguồn dữ liệu production nếu chưa thẩm định kỹ nguồn gốc và pháp lý.
8. Phyllo

Phyllo tiếp thị các API dữ liệu xã hội chuẩn hóa, công khai và xác thực trên nhiều mạng, bao gồm X. Nền tảng mô tả các tác vụ phát hiện keyword và đối thủ, fetch Post có cấu trúc, creator analytics, job bất đồng bộ, polling và webhook alert.
Tính năng chính:
- Hạ tầng API đa nền tảng (X, Instagram, YouTube, TikTok, v.v.)
- Mô hình dựa trên consent cho dữ liệu gắn với creator
- Claim về webhook và real-time cho marketing
Điểm cần lưu ý: Các trang chính thức được xem xét không công bố SLA độ trễ riêng cho X, phần trăm độ đầy đủ, ngày bắt đầu archive, cam kết full-firehose, hay partnership X có tên cụ thể. Giá là tùy chỉnh (cần liên hệ sales).
Phù hợp nhất cho: Developer xây dựng sản phẩm dữ liệu creator, influencer hoặc đa nền tảng, cần một lớp API chuẩn hóa — sau khi xác minh trực tiếp phạm vi dữ liệu X với Phyllo.
9. Brandwatch

Brandwatch tự nhận là Official X Partner. Sản phẩm Consumer Research quảng bá full X firehose và Posts công khai lịch sử; Listen quảng bá quyền truy cập full-firehose với 12 tháng lịch sử X.
Tính năng chính:
- Kho lịch sử sâu (một trong những kho sâu nhất hiện có trên thị trường)
- Phân tích sentiment, phân tích xu hướng, dashboard competitive intelligence
- Tài liệu tuân thủ cấp enterprise, sẵn sàng cho GDPR
Điểm cần chú ý về export: Tài liệu developer của Brandwatch cho biết text Post X và phần lớn metadata bị loại khỏi phản hồi API vì mục đích tuân thủ. Để lấy đầy đủ nội dung Post, bạn có thể phải dùng Post ID và “rehydrate” qua X API. Đây là khác biệt rất quan trọng giữa truy cập dashboard trong sản phẩm và xuất dữ liệu thô không giới hạn.
Giá: Báo giá tùy chỉnh. Không thấy mức giá công khai hiện tại trên trang gói Brandwatch được xem xét.
Phù hợp nhất cho: Thương hiệu toàn cầu, nhóm nghiên cứu và vận hành giám sát khủng hoảng cần archive X sâu và phân tích cấp enterprise.
10. Meltwater

Meltwater kết hợp social listening với news và media intelligence. Phần giới thiệu sản phẩm xác nhận 15 tháng dữ liệu social lịch sử tức thì bao gồm X, cùng cảnh báo thời gian thực, tìm kiếm Boolean, dashboard, competitive intelligence và reporting.
Tính năng chính:
- Kết hợp news, PR và social intelligence trong cùng một nền tảng
- Cảnh báo và dashboard thời gian thực
- Export và API Analytics/Streaming (tùy gói)
Điểm cần lưu ý: Không xác minh được full archive X hay SLA độ trễ riêng cho X. Phạm vi dữ liệu có thể phụ thuộc vào gói và khu vực. Changelog cho developer của Meltwater ghi nhận việc che field X/Twitter vì tuân thủ. Meltwater tự giới thiệu là full enterprise partner của X, nhưng trong nghiên cứu này chưa xác nhận được chứng thực độc lập hiện tại trên thư mục do X sở hữu.
Giá: Báo giá tùy chỉnh, hợp đồng theo năm.
Phù hợp nhất cho: Đội PR và truyền thông cần dữ liệu X đi cùng theo dõi tin tức, media intelligence và phân tích social đa kênh.
11. Sprout Social

Sprout Social chủ yếu là nền tảng quản lý mạng xã hội — đăng bài, tương tác, chăm sóc khách hàng, phê duyệt, phân tích sở hữu và báo cáo. Add-on Social Listening trả phí của họ có thể giám sát các Post công khai, replies, mentions, quote reposts và reposts trên X.
Tính năng chính:
- Gói cốt lõi: $199/$299/$399 mỗi seat/tháng (thanh toán theo năm); Listening là add-on trả thêm
- Dựa trên dashboard, được thiết kế cho social media manager
- Website doanh nghiệp của X mô tả Sprout là đối tác chính thức của X
Vấn đề lấy mẫu: Trung tâm trợ giúp của Sprout nêu rõ X Listening sử dụng dữ liệu lấy mẫu, không phải full firehose. Tự động backfill là 30 ngày hoặc 200,000 tin nhắn gần nhất. Public API của Sprout hỗ trợ phân tích dữ liệu từ profile sở hữu, nhưng dữ liệu X Listening Topic hiện không khả dụng qua API này.
Phù hợp nhất cho: Đội social media đã dùng Sprout để đăng bài và quản lý cộng đồng, và muốn có phân tích X mang tính định hướng trong cùng một dashboard. Không phù hợp nếu mục tiêu chính của bạn là trích xuất dữ liệu X thô ở quy mô lớn.
12. Thunderbit

Thunderbit là công cụ AI web scraping và tự động hóa, có sẵn dưới dạng Chrome browser extension, được thiết kế cho người dùng doanh nghiệp cần cấu trúc dữ liệu web được phép mà không phải viết code.
Cách đặt vào bối cảnh ở đây: Thunderbit có thể gợi ý trường dữ liệu, đi qua pagination hoặc subpage tương thích, bổ sung enrichment dựa trên prompt, và export sang Excel, CSV, Google Sheets, Airtable hoặc Notion. Đây là các năng lực dữ liệu web nói chung. Chúng không tạo ra nguồn cấp X được ủy quyền, không đảm bảo độ phủ X đầy đủ, và cũng không trao quyền tự động hóa X.
Tính năng chính:
- Gợi ý trường dữ liệu và xuất có cấu trúc không cần code
- Phát hiện trường bằng AI thích ứng với thay đổi bố cục
- Cần kiểm tra gói và giới hạn sử dụng tại thunderbit.com/pricing
- Chỉ phù hợp với các trang tương thích và trường hợp người dùng có quyền tự động hóa
Thunderbit không phải là gì: Không phải nhà cung cấp dữ liệu X chính thức, không phải API X hàng loạt, không phải thay thế firehose, và cũng không phải dataset X đóng gói sẵn. Điều khoản hiện tại của X cấm browser scraping nếu không có chấp thuận bằng văn bản trước. Với dữ liệu X, hãy bắt đầu từ API chính thức, nhà cung cấp được ủy quyền có tài liệu, hoặc archive tài khoản của chính bạn. Dùng Thunderbit cho workflow dữ liệu web tương thích và được phép — không phải để lách quyền truy cập hoặc giá API của X.
Nếu bạn muốn hiểu thêm cách trích xuất dữ liệu web trong thực tế, blog của chúng tôi có các bài về web scraping là gì, cách làm mà không cần code, và các cách thực tế để thu thập dữ liệu Twitter.
Nhà cung cấp dữ liệu Twitter nào phù hợp với ngân sách và nhu cầu của bạn?
Không có nhà cung cấp nào phù hợp với tất cả mọi người. Đây là khung ra quyết định được tổ chức theo use case và mức ngân sách:
| Use Case | Lựa chọn tiết kiệm | Lựa chọn tầm trung | Lựa chọn enterprise |
|---|---|---|---|
| Nghiên cứu học thuật / lưu trữ | X Official API (trả theo lượt) + twarc | Đối tác dữ liệu được cấp phép | X Enterprise / đối tác cấp phép theo hợp đồng |
| Theo dõi thương hiệu / sentiment | Official API với truy vấn giới hạn rõ ràng | Sprout Social (add-on Listening lấy mẫu) | Brandwatch hoặc Meltwater sau khi rà soát hợp đồng |
| Lead gen / sales prospecting | Nghiên cứu thủ công / dựa trên consent | Tự động hóa được phép sau khi rà soát chính sách | Nhà cung cấp được ủy quyền + pipeline CRM được quản trị |
| Trích xuất nhanh một lần (không code) | Archive tài khoản hoặc export được ủy quyền | Workflow trên trang tương thích được phép | Dashboard/export enterprise |
| Phân tích influencer / creator | Phyllo (sau khi kiểm tra phạm vi X) | Phyllo | Brandwatch |
| Pipeline NLP / data science | X Official API (trả theo lượt) | Nhà cung cấp được ủy quyền có quyền export | X Enterprise / nguồn cấp được cấp phép |
Một vài điểm nổi bật:
- Nếu compliance và nguồn gốc dữ liệu là bắt buộc, X Official API là điểm chuẩn của bạn. Mọi lựa chọn khác đều phải đánh đổi ở mức nào đó.
- Nếu bạn cần archive lịch sử sâu và dashboard cấp enterprise, Brandwatch và Meltwater là những cái tên lâu năm — nhưng hãy chuẩn bị cho hợp đồng tùy chỉnh và dữ liệu export đã bị che bớt.
- Nếu bạn là người dùng không chuyên, hãy ưu tiên nguồn được ủy quyền có export CSV hoặc Sheets. Chỉ dùng tự động hóa trình duyệt trên các trang tương thích khi quyền được xác nhận rõ ràng; nó không thay thế được một pipeline dữ liệu production.
Lưu ý nhanh về compliance: ToS, GDPR và điều cần hỏi team pháp lý

Phần này chỉ là hướng dẫn vận hành, không phải tư vấn pháp lý.
Điều khoản dịch vụ của X cấm crawl, scraping hoặc scripting website nếu không có chấp thuận bằng văn bản trước. Chính sách nhà phát triển của X bổ sung các yêu cầu về riêng tư, minh bạch, quyền kiểm soát của người dùng, tuân thủ xóa dữ liệu, và hạn chế với suy luận dữ liệu nhạy cảm, đối sánh, tái phân phối và huấn luyện mô hình. Việc truy cập được về mặt kỹ thuật không đồng nghĩa với việc được phép.
GDPR, CCPA và các quy định riêng tư khác có thể áp dụng khi thu thập handle, vị trí, bio profile hoặc nội dung Post. Việc dữ liệu hiển thị công khai tự thân không quyết định quyền sử dụng trên nền tảng, quyền riêng tư, hợp đồng, bản quyền, luật truy cập máy tính hay quyền sử dụng đầu ra. Hãy áp dụng nguyên tắc giảm thiểu dữ liệu, đặt giới hạn lưu trữ và xin rà soát pháp lý cho đúng khu vực pháp lý và mục đích sử dụng.
Ba nguyên tắc thực tế:
- Chỉ thu thập dữ liệu công khai khi bạn có mục đích hợp pháp rõ ràng.
- Đừng lưu quá nhiều — đặt giới hạn lưu giữ và tôn trọng yêu cầu xóa.
- Hỏi team pháp lý trước khi xây dựng thứ gì đó ở quy mô lớn.
Những câu hỏi nên hỏi bất kỳ nhà cung cấp nào: Bạn có phải là X Official Partner không? Chính xác phương thức nào đang cung cấp dữ liệu cho sản phẩm? Post đã bị xóa và tài khoản được bảo vệ được xử lý ra sao? Bạn có thể lưu toàn văn hay chỉ ID và số liệu tổng hợp?
Kết luận
Mô hình truy cập miễn phí kiểu cũ đã không còn nữa. Mười hai lựa chọn ở đây bao gồm API first-party, dịch vụ web công khai được quản lý, bộ social listening enterprise, marketplace và công cụ no-code; chúng không mang lại mức ủy quyền, độ đầy đủ hay rủi ro giống nhau.
Lựa chọn đúng phụ thuộc vào công việc. Với dữ liệu thô, có thể tái lập và có nguồn gốc first-party, hãy bắt đầu từ API X. Với dashboard enterprise và social listening được quản trị, hãy đánh giá Brandwatch, Meltwater hoặc Sprout theo nhu cầu hợp đồng và export của bạn. Hãy xem các collector độc lập và listing marketplace là những lựa chọn rủi ro cao hơn, cần test trực tiếp, công bố phương pháp nguồn và rà soát pháp lý. Dùng Thunderbit cho workflow dữ liệu web tương thích và được phép — không phải như một nguồn cấp X.
Bức tranh dữ liệu của X vẫn đang thay đổi. Hãy kiểm tra giá theo thời gian thực, đọc kỹ điều khoản liên quan, ghi lại nguồn dữ liệu và truy vấn của bạn, và trao đổi với pháp lý cùng an ninh thông tin trước khi xây dựng workflow nhạy cảm hoặc khối lượng lớn.
Tìm hiểu thêm:
- Cách thực hiện phân tích cảm xúc Twitter để ra quyết định tốt hơn
- Cách làm chủ việc thu thập dữ liệu Twitter bằng Thunderbit
- Công cụ scraping mạng xã hội là gì và hoạt động ra sao?
- Web scraping có hợp pháp không? Hiểu tác động pháp lý
- Web Scraping mà không cần code
Câu hỏi thường gặp
1. Điều gì đã xảy ra với quyền truy cập Twitter API miễn phí?
X đã xóa tier đọc miễn phí vào đầu năm 2023. Mô hình hiện tại là credit trả trước, tính theo mức sử dụng — một lượt đọc Post tiêu chuẩn có giá $0.005, và tài khoản tự phục vụ bị giới hạn ở hai triệu lượt đọc Post mỗi tháng. Track Academic Research cũng đã bị chấm dứt, khiến các nhà nghiên cứu không còn quyền truy cập bulk miễn phí như trước.
2. Các nhà cung cấp dữ liệu Twitter bên thứ ba lấy dữ liệu từ đâu?
Họ thường rơi vào ba nhóm chính: (1) các wrapper dùng API chính thức, hoạt động bằng chính X API key của bạn và chịu giới hạn rate limit của X; (2) API dựa trên scraping, thu thập dữ liệu qua trình duyệt tự động hoặc endpoint đảo ngược kỹ thuật — rẻ hơn nhưng có rủi ro về ToS và tính liên tục; và (3) các nền tảng social listening được cấp phép như Brandwatch và Meltwater, có thỏa thuận dữ liệu doanh nghiệp với X. Công cụ dựa trên trình duyệt như Thunderbit là nhóm thứ tư — chúng trích xuất những gì hiển thị trong session trình duyệt của bạn.
3. Nhà cung cấp dữ liệu Twitter nào rẻ nhất để bắt đầu?
Tại mốc tháng 8/2026, X Official API niêm yết $0.005 cho mỗi lượt đọc Post tiêu chuẩn và không yêu cầu cam kết tối thiểu. Bright Data quảng cáo 5,000 bản ghi miễn phí mỗi tháng, Apify có $5 sử dụng nền tảng miễn phí hàng tháng, listing RapidAPI được nêu có 200 request miễn phí, và SocialData.tools thường tính khoảng $0.20 cho mỗi 1,000 items. Các đơn vị này không tương đương nhau, và lựa chọn rẻ nhất đã được ủy quyền, đầy đủ cho một use case có thể khác với lựa chọn request thô rẻ nhất. Hãy kiểm tra từng mức giá live trước khi mua.
4. Tôi có thể lấy tweet lịch sử mà không phải trả cho X Enterprise API không?
Có. Full-Archive Search của X Official API có thể truy ngược tới tháng 3/2006 theo mô hình trả theo lượt dùng và Enterprise, nên Enterprise không phải là con đường chính thức duy nhất. Brandwatch quảng bá khả năng nghiên cứu lịch sử sâu, nhưng việc khả dụng phụ thuộc vào sản phẩm và gói. Các collector độc lập có thể mở ra các cửa sổ ngày hoặc dataset do nhà cung cấp lưu giữ, nhưng phạm vi và độ đầy đủ của chúng không tương đương với full archive được ghi nhận của X.
5. Có cách no-code nào để lấy dữ liệu Twitter không?
Có. Sprout Social và Brandwatch cung cấp workflow dựa trên dashboard không cần code, và các nhà cung cấp được ủy quyền có thể hỗ trợ export CSV hoặc bảng tính. Thunderbit có thể cấu trúc dữ liệu trên các trang tương thích khi bạn có quyền tự động hóa; nó không phải là nguồn cấp X chính thức. PhantomBuster cung cấp tự động hóa dựa trên session nhưng có cảnh báo về rủi ro tài khoản và rate limit. Hãy xác nhận phạm vi dữ liệu, quyền ủy quyền, mức độ lấy mẫu và quyền export trước khi chọn bất kỳ lộ trình no-code nào.


