Thunderbit против Data Miner: агентное извлечение или переиспользуемые рецепты?

Последнее обновление: August 18, 2026
Thunderbit против Data Miner: агентное извлечение или переиспользуемые рецепты?
AI-сводка
Thunderbit и Data Miner оба извлекают структурированные данные со страниц, но их модели настройки отличаются. Thunderbit использует агентный сценарий One Click Extract: он анализирует текущую страницу и запускается автоматически, тогда как Data Miner опирается на переиспользуемые public, generic или private Recipes, построенные на строках, столбцах и навигационных селекторах. В этом сравнении рассматриваются сбор списков, пагинация, обход страниц деталей, работа в браузере, экспорт, автоматизация, цены, сопровождение рецептов и то, что лучше подходит нетехническим командам и пользователям, предпочитающим управление через селекторы.

Data Miner уже больше десяти лет тихо лежит в папке расширений Chrome у множества пользователей, незаметно помогая целой армии людей, которые собрали собственную библиотеку скрапинг‑«рецептов». Я не раз видел, как его упоминали на форумах, когда кто-то спрашивал, как вытащить таблицу с сайта без написания кода. Это действительно рабочий инструмент. Но он же хорошо показывает, что «no-code» всё ещё может означать «без кода, но логику вы строите сами».

На самом деле именно это и имеют в виду люди, когда вводят в Google запрос «Thunderbit vs Data Miner»: хочу ли я сам собирать переиспользуемые правила или мне нужен агент, который разберётся со страницей за меня? Давайте ответим на этот вопрос честно и по пунктам, а не как это делает большинство статей — сначала разбирают Data Miner, а потом внезапно переходят к рекламе Thunderbit, так и не сравнив их напрямую.

Thunderbit vs Data Miner: кратко

Сразу скажу честно: я руковожу Thunderbit, поэтому к моему углу обзора стоит относиться с понятной долей осторожности. Но я постарался сделать таблицу максимально объективной — не о том, что обещает маркетинг, а о том, что инструменты реально умеют.

КатегорияData MinerThunderbit
Способ извлеченияРучные «рецепты», собранные на CSS/HTML-селекторахАгентный ИИ — нажимаете One Click Extract, он распознаёт страницу и запускается сам
Первичная настройкаСоздать приватный рецепт или найти/предпросмотреть публичныйБез селекторов и схем — один осознанный клик на поддерживаемых страницах
ПагинацияДобавить селектор «Next» в List RecipeПоддерживаемая пагинация обрабатывается автоматически
Обогащение страницами деталейДвухшаговый процесс: List Recipe → сохранить URL → Detail Recipe → CrawlПоддерживаемое обогащение подстраниц, объединённое в одну таблицу
Страницы после входа в аккаунтРаботает с видимым контентом в авторизованной сессии браузераРаботает с видимым контентом в авторизованной сессии браузера
ЭкспортCSV, Excel, буфер обмена, Google Sheets (на платных тарифах)Экспорт в поддерживаемые сервисы (Sheets, Airtable, Notion) и загрузки файлов
АвтоматизацияБраузерная автоматизация, переход на следующую страницу, кастомный JS, автоматические обходыЗапуск в браузере и в облаке, расписания там, где поддерживаются, Open API, MCP Server, CLI
ПереиспользованиеРецепты можно делиться и повторно использовать — огромная библиотека сообществаИИ заново интерпретирует каждую страницу; библиотеку рецептов не нужно поддерживать
Модель ценыЕжемесячные кредиты за страницы, тарифы зависят от объёмаОплата по тарифу, см. текущие цены
Лучше всего подходит дляСтабильных повторяющихся задач, если уже есть рабочий рецептНовых или разных страниц, нетехнических пользователей, быстрых разовых задач

Никто больше не ставил эти два инструмента рядом именно таким образом. Я проверил. И это странный пробел, учитывая, как часто ищут этот запрос.

Что такое Thunderbit?

Thunderbit — это то, что я бы назвал агентным веб-скрапером. Слово «агентный» здесь важно: он не просто автоматизирует клики, а интерпретирует страницу так, как это сделал бы человек, а затем решает, какие данные, скорее всего, важны. Вы устанавливаете расширение Chrome, открываете страницу, к которой у вас есть доступ, и нажимаете One Click Extract. Это, по сути, и есть всё необходимое действие. Агент читает страницу, определяет полезные поля и запускается — при желании можно нажать Run Now, чтобы стартовать сразу, но если просто подождать, он обычно стартует сам.

Thunderbit

Я сделал это решение именно потому, что устал смотреть, как нетехнические коллеги на прошлых местах работы стопорятся в тот момент, когда инструмент для скрапинга просит их указать «селектор». Большинство людей не знают, что такое CSS-селектор, и, честно говоря, не должны знать.

Помимо расширения, есть веб-приложение, Open API для разработчиков, которым нужен программный доступ, MCP Server для рабочих процессов с ИИ-агентами (например, Claude, Cursor и всей этой экосистемы) и CLI для автоматизации из терминала. На совместимых страницах Thunderbit умеет работать с пагинацией и обогащать строки списка данными со страниц деталей, затем объединяя всё в одну таблицу.

Что такое Data Miner?

Data Miner старше, более известен и построен вокруг совершенно другой философии: рецептов. Рецепт — это сохранённый набор инструкций, по сути селекторы, привязанные к строкам и столбцам, которые соответствуют HTML-структуре конкретного сайта. В собственной справке Data Miner объясняется, что рецепты бывают трёх типов: public — созданные и опубликованные другими пользователями, generic — рассчитанные на широкий круг сайтов, и private — те, которые вы создаёте сами.

Data Miner

На сайте заявлено более 50 000 публичных рецептов, охватывающих свыше 15 000 популярных сайтов — хотя любопытно, что в другой части их же сайта фигурирует цифра «60 000». Я бы просто сказал: «десятки тысяч», а выводы о точности подсчёта оставил вам.

Data Miner поддерживает Page Scrape, Next Page Automation, URL Crawl (для скрапинга списков URL), автоматическое заполнение форм и кастомный JavaScript для продвинутых пользователей. Он работает в браузере, а значит, может видеть контент в авторизованной сессии так же, как его видите вы вручную, а для корпоративных клиентов доступны варианты запуска на сервере.

Главное отличие: понимание страницы в реальном времени против сохранённых рецептов

Вот здесь, на мой взгляд, большинство сравнительных статей начинают лениться. Они пишут: «Data Miner работает на рецептах, Thunderbit — на ИИ» — и на этом всё. Ни примера, ни сценария, по которому можно действительно представить разницу.

runtime-vs-recipes

Thunderbit передаёт интерпретацию агенту. Каждый раз, когда вы открываете новую страницу, ИИ смотрит на неё заново. Он не обращается к сохранённому набору правил для этого конкретного сайта — он читает DOM, понимает структуру и принимает решение, какие данные важны. Это означает нулевую настройку на странице, которую вы раньше не видели, но также и то, что ИИ каждый раз выполняет реальную работу в момент запуска, а не просто повторяет запомненный сценарий.

Data Miner повторно использует инструкции селекторов. Как только рецепт создан — неважно, вами или кем-то другим — повторный запуск проходит быстро, потому что логика уже зафиксирована. Компромисс, который прямо признают в документации Data Miner, в том, что если HTML сайта меняется, рецепт может сломаться. Тогда вы уже отлаживаете селекторы вместо того, чтобы просто собирать данные.

Когда любой из подходов становится «в один клик»: Data Miner действительно может работать в один клик — если для вашей конкретной цели уже есть публичный рецепт, и он всё ещё работает. Но здесь есть большое «если». Заявление Thunderbit про один клик тоже относится к страницам, которые агент способен корректно интерпретировать; это тоже не гарантия для всего интернета, особенно для сайтов с жёсткой антибот-защитой или нестандартной версткой.

Ни у одного из инструментов нет монополии на слово «просто». Они просто по-разному понимают простоту: один за счёт готовых решений от сообщества, другой — за счёт интерпретации страницы в реальном времени.

Практическое сравнение рабочих сценариев

Скрапинг простой таблицы: в Data Miner вы сначала проверяете, есть ли публичный рецепт для сайта, просматриваете его и запускаете, если он подходит. Если нет — вручную строите строки и столбцы через Easy Finder. В Thunderbit вы просто нажимаете One Click Extract и позволяете системе самой определить структуру таблицы.

subpage-vs-two-recipe-crawl

Постраничный сбор каталога или списка товаров: в Data Miner нужно добавить селектор навигации в List Recipe, чтобы инструмент понимал, как выглядит «Next». Thunderbit на поддерживаемых страницах обрабатывает совместимую пагинацию без этого ручного шага.

Обогащение строк списка данными со страниц деталей: здесь различие особенно заметно. В документации Data Miner по Crawl описан по-настоящему многошаговый процесс: создаёте List Recipe, чтобы собрать URL страниц деталей, сохраняете список URL, затем делаете отдельный Detail Recipe, создаёте задачу Crawl, связывающую оба рецепта, проверяете URL, запускаете и только потом экспортируете результат. Это работает, но требует нескольких отдельных шагов и двух разных рецептов. В Thunderbit совместимое обогащение подстраниц собирает данные со страниц деталей прямо в ту же таблицу, без этого танца с двумя рецептами — хотя, если честно, надёжно это работает только на страницах, которые агент умеет хорошо разбирать.

Работа после входа в аккаунт: оба инструмента работают с контентом, который виден в вашей браузерной сессии, так что если вы вошли в авторизованный аккаунт, оба увидят то, что видите вы. Ни один из них не «обходит» авторизацию магическим образом — они просто работают с тем, что уже отрисовано на экране.

Автоматизация, расширения и доступ для разработчиков

Автоматизация Data Miner живёт в браузере: переходы на следующую страницу, автоматизированные URL crawl и кастомный JavaScript для тех, кто готов писать собственные скрипты. Интеграция с Google Sheets доступна на платных тарифах. Корпоративные клиенты могут перенести выполнение задач на серверы Data Miner вместо локального запуска.

У Thunderbit набор возможностей шире в другом направлении. Помимо выполнения в браузере и в облаке, с расписаниями там, где это поддерживается, есть Open API для серверных интеграций и MCP Server — и это важнее, чем может показаться. MCP позволяет ИИ-агентам (Claude Code, Cursor и похожим инструментам) вызывать Thunderbit напрямую в рамках собственных рабочих процессов. Если вы строите систему, где ИИ-агент должен получать структурированные данные с веб-страниц как один из шагов более крупного пайплайна, это уже качественно иная возможность, чем «я написал немного кастомного JavaScript в расширении браузера».

Чтобы было ясно: кастомный JS в Data Miner действительно полезен для продвинутых пользователей, которым нужен тонкий контроль. Просто это не та же категория инструмента, что публичный API или MCP-сервер, к которому может обращаться агент.

Экспорт, приватность и работа с данными

Data Miner экспортирует данные в CSV, Excel, буфер обмена или Google Sheets на платных планах. В FAQ по ценам указано, что собранные данные не продаются и не передаются третьим лицам, а в документации по браузерному crawl говорится, что во время стандартных автоматизированных обходов данные не хранятся на серверах Data Miner — после завершения задачи вы сами должны их сохранить. У корпоративных серверных задач — уже другая модель исполнения.

Thunderbit экспортирует в поддерживаемые направления вроде Google Sheets, Airtable и Notion, а также в стандартные файлы, и предлагает как браузерный, так и облачный режим работы — в зависимости от вашего сценария.

Я не буду утверждать, что одна архитектура всегда «более приватная», чем другая — всё действительно зависит от того, что именно вы собираете, насколько это чувствительно и какой режим исполнения выбираете. Если конфиденциальность данных для вас критична, этот вопрос лучше заранее обсудить с поставщиком, а не делать выводы по статье-сравнению.

Цены: лимиты по страницам и стоимость рецептов

Вот текущие цены Data Miner на момент написания:

ТарифЦенаСтраниц/мес
Free$0500 (некоторые домены ограничены)
Solo$19.99/мес500
Small Business$49/мес1 000
Business$99/мес4 000
Business Plus$200/мес9 000
EnterpriseИндивидуальноИндивидуально

Кредиты обновляются ежемесячно и не переносятся на следующий месяц — и в их же FAQ указано, что превышение бесплатного лимита в 500 страниц может заблокировать бесплатный аккаунт до перехода на платный тариф. Это полезно знать ещё до того, как вы окажетесь на середине проекта.

То, о чём почти никто не говорит, когда рассматривает Data Miner: они также продают разработку кастомных рецептов как платную услугу. Один кастомный рецепт стоит $150 единоразово; многоуровневый рецепт (тот самый, который нужен для crawling от списка к деталям) — $300 единоразово; всё более сложное считается по индивидуальному запросу. Если у вашего целевого сайта нет рабочего публичного рецепта и вы не хотите создавать его сами, это уже реальные дополнительные расходы поверх подписки.

total-cost

Актуальные цены Thunderbit лучше смотреть на живой странице тарифов, а не доверять цифрам, которые я мог бы привести здесь: планы меняются, и я предпочитаю отправить вас к источнику, чем рисковать устаревшими данными.

Если честно, главный вопрос стоимости — не столько цена тарифа на витрине, сколько общее время. Создание и поддержка рецептов съедают часы, за которые вам никто не платит, если только не считать вашу собственную зарплату. Агентная переинтерпретация убирает эту нагрузку по сопровождению, но означает, что ИИ заново работает каждый запуск — это уже другой вид затрат: не ваше время, а вычисления.

Что выбрать?

Выбирайте Thunderbit, если... вы не технический специалист, хотите собрать данные со страницы, которую ещё ни разу не скрапили, или хотите вообще пропустить этап поиска/создания рецепта. Это удобно для sales ops, которые вытаскивают списки лидов из каталогов, для маркетинговых исследователей, которые каждую неделю проверяют цены конкурентов, и для всех, кому нужны данные прямо сейчас, без длительной настройки.

Выбирайте Data Miner, если... у вас повторяющаяся и стабильная цель, для которой уже есть рабочий публичный рецепт, или если вы из тех, кому действительно нравится тонкий контроль через селекторы и не жалко переделывать рецепт, когда сайт обновляет дизайн. Продвинутым пользователям, которые комфортно чувствуют себя с кастомным JavaScript, тоже будет здесь удобно.

Используйте оба инструмента, если... у вас смешанный набор задач: старые процессы на сайтах, где уже есть рабочие рецепты Data Miner, и новые, разнообразные цели, ради которых не хочется тратить полдня на настройку селекторов. Я знаю команды, которые работают именно так: оставляют старые рецепты в работе и пробуют Thunderbit для всего нового. Это не решение по принципу «либо-либо», как часто намекают статьи формата «vs».

Итог

Всё действительно сводится к агентной интерпретации против переиспользуемых рецептов — и ни один из подходов не является объективно лучшим во всех случаях. Data Miner вознаграждает терпение и инвестиции в конкретный сайт по-настоящему быстрыми повторными запусками. Thunderbit даёт максимально быстрый результат с первого раза, но при этом никогда не «запоминает» сайт так, как это делает рецепт.

Мой честный совет: возьмите один реальный, авторизованный сайт, с которого вам действительно нужны данные, и протестируйте оба варианта. Засеките, сколько времени занимает настройка, посчитайте, сколько чистых и полезных строк вы получаете, посмотрите, что будет после изменения сайта (рецепты ломаются, агенты обычно адаптируются), и сложите реальную стоимость, включая возможные сборы за кастомные рецепты.

Если хотите увидеть вариант с одним кликом в деле, расширение Thunderbit для Chrome можно попробовать бесплатно — без необходимости создавать рецепты.

FAQ

Data Miner действительно работает в один клик? Да, если для нужного сайта уже существует рабочий публичный рецепт. Если нет, рецепт придётся собирать с нуля в их Recipe Creator, а это уже требует времени на настройку.

Нужно ли программирование для Data Miner? Для базовых рецептов — нет. Easy Finder позволяет выбирать строки и столбцы кликами. Кастомный JavaScript и продвинутая работа с селекторами — это опционально для тех, кому нужен более тонкий контроль.

Может ли Data Miner собирать данные с нескольких страниц и страниц деталей? Да, через Next Page Automation для пагинации и двухрецептный Crawl-процесс (List Recipe + Detail Recipe) для извлечения данных со связанных страниц деталей.

Использует ли Thunderbit CSS-селекторы? Нет. Агент интерпретирует структуру страницы во время выполнения, поэтому на поддерживаемых страницах не нужно вручную задавать селекторы.

Что лучше работает после входа в аккаунт? Оба инструмента работают с контентом, видимым в вашей авторизованной браузерной сессии, поэтому результат больше зависит от того, что отрисовано на экране, чем от самого инструмента.

Как Data Miner считает страницы? Каждый тариф даёт месячный лимит кредитов за страницы — 500 на Free и Solo, до 9 000 на Business Plus. Кредиты обновляются ежемесячно и не переносятся.

Есть ли у какого-либо продукта API? У Thunderbit есть Open API, MCP Server и CLI для разработчиков и агентных сценариев. Автоматизация Data Miner в основном браузерная, а серверные варианты доступны для корпоративных клиентов.

Может ли какой-то из этих скраперов работать на любом сайте? Нет. Оба инструмента зависят от совместимости страницы, наличия доступа и структуры сайта — антибот-защита, нестандартная верстка или тяжёлая JavaScript-отрисовка могут ограничить возможности любого из них.

Shuai Guan
Shuai Guan
Генеральный директор Thunderbit | Эксперт по автоматизации данных с помощью ИИ Shuai Guan — генеральный директор Thunderbit и выпускник инженерного факультета Мичиганского университета. Опираясь почти на десятилетний опыт в сфере технологий и SaaS-архитектуры, он специализируется на том, чтобы превращать сложные модели ИИ в практичные no-code инструменты для извлечения данных. В этом блоге он делится честными, проверенными в деле инсайтами о веб-скрейпинге и стратегиях автоматизации, чтобы помочь вам выстраивать более умные, data-driven рабочие процессы. Когда он не занимается оптимизацией потоков данных, тот же внимательный подход к деталям он переносит в своё увлечение фотографией.
Topics
Thunderbit против Data Minerрецепты для веб-скрапингаагентный веб-скрапер
Содержание
Thunderbit · AI-агент для веб-данных

Извлекай данные с любой страницы за 1 клик

Нам доверяют более 250 000 пользователей
доступен бесплатный тариф
От веб-страницы к таблице
Опиши, что тебе нужно, — AI-агент Thunderbit соберет это и экспортирует в Excel, Google Sheets, Airtable или Notion. Старт бесплатный.
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week