

































































按语义读取字段、设置定时重复运行,并在各类公开网站上复用同一套流程。
Thunderbit 会根据语义读取可见的标题、导语、日期、摘要和文章正文。当新闻网站调整页面版式时,这个流程对固定位置的依赖会更小。

如果你会反复查看某个公开的新闻页、博客页或栏目页,可以设置重复运行。Thunderbit 能采集最新可见文章,并把新行发送到你选择的文件或应用中。

同一套工作流可以用于任何带文章内容的公开网站。只需命名你需要的字段,Thunderbit 就会把每个页面放进相同的列中。

固定选择器依赖位置。Thunderbit AI 会按你指定的文章字段去识别内容。
从 30 个可见的内容、作者、发布者、日期、链接、主题、媒体和页面元数据字段中自由选择。
In these user videos, editors and researchers gather article text, bylines, dates, and source links for review.
新闻网站的版式和页面细节各不相同,因此最终能拿到哪些字段,取决于你抓取的具体文章页面。
加入已在使用 Thunderbit 自动化网页抓取流程的 20 万+ 专业人士。
免费试用可获得 8 个网页的无限额度。