เริ่มใช้งานได้ภายในไม่กี่นาที ลองใช้ในเทอร์มินัลของคุณได้เลยตอนนี้
Distill Extract
>_ Python Node.js cURL
1 import requests
2
3 resp = requests.post (
4 "https://openapi.thunderbit.com/openapi/v1/distill" ,
5 headers = { "Authorization" : f"Bearer {API_KEY}" } ,
6 json = { "url" : "https://example.com/article" }
7 )
8
9 markdown = resp.json ( ) [ "data" ] [ "markdown" ]
ความสามารถหลัก 2 อย่าง Distill สำหรับเนื้อหาที่สะอาดตา ส่วน Extract สำหรับข้อมูลที่มีโครงสร้าง
Distill
URL → Markdown
ตัดโฆษณา เมนูนำทาง และสิ่งรบกวนออก — เหลือเฉพาะเนื้อหาที่สำคัญ มีการเรนเดอร์ JS แบบเต็มรูปแบบและระบบหลบเลี่ยงบอทในตัว ประมวลผลได้สูงสุด 100 URL ต่อคำขอ Extract
URL + Schema → JSON / CSV
Schema เดียวใช้ได้กับทุกเว็บไซต์ — ไม่ต้องดูแลแยกตามแต่ละเว็บไซต์ ยังใช้งานได้แม้เว็บไซต์จะออกแบบใหม่โดยอัตโนมัติ ประมวลผลได้สูงสุด 50 URL ต่อคำขอ ทำไมต้องใช้ Thunderbit โครงสร้างพื้นฐานสำหรับสแครปและดึงข้อมูลที่เอเจนต์ AI ของคุณคู่ควร
กำหนดว่าอะไร ไม่ใช่วิธีการ
ไม่ต้องใช้ CSS selector ไม่ต้องใช้ XPath ไม่ต้องตั้งกฎแยกตามเว็บไซต์ อธิบายข้อมูลที่ต้องการด้วย JSON Schema — ให้ AI จัดการว่าข้อมูลอยู่ที่ไหนและจะดึงออกมาอย่างไร
Schema เดียว ใช้ได้ทุกเว็บไซต์
schema เดียวใช้ได้กับเว็บไซต์อีคอมเมิร์ซ รายการขาย หรือ URL ใดก็ตามที่คุณใส่เข้ามา การเพิ่มแหล่งข้อมูลใหม่เป็นแค่การเปลี่ยนค่า config ไม่ใช่งานวิศวกรรมขนาดใหญ่
ยังใช้งานได้แม้เว็บไซต์จะเปลี่ยน
สแครปเปอร์แบบดั้งเดิมมักพังทุกครั้งที่เว็บไซต์ออกแบบใหม่ Thunderbit อ่านความหมาย ไม่ใช่โครงสร้าง DOM — จึงยังดึงข้อมูลได้ต่อเนื่องแม้ HTML ข้างใต้จะเปลี่ยนไป
กรณีการใช้งาน สิ่งที่คุณสร้างได้ด้วย Thunderbit
เอเจนต์ AI ที่เข้าถึงเว็บได้
ให้เอเจนต์ของคุณสามารถอ่านและเข้าใจหน้าเว็บใดก็ได้ เรียก API ครั้งเดียวก็ได้บริบทที่มีโครงสร้าง พร้อมสำหรับขั้นตอนถัดไปของเอเจนต์
RAG และฐานความรู้
แปลง URL ใดก็ได้ให้เป็น Markdown ที่สะอาดและส่งตรงเข้าเวกเตอร์ฐานข้อมูลของคุณได้เลย ไม่ต้องแยกวิเคราะห์ HTML ไม่ต้องมีสคริปต์ทำความสะอาดเนื้อหา
เปลี่ยนทุกเว็บไซต์ให้เป็น API
กำหนด schema ชี้ไปที่ URL แล้วรับ JSON กลับมา สร้าง API ราคาสินค้า API รายการงาน หรือ API ฟีดข่าวได้ — โดยไม่ต้องเขียนสแครปเปอร์แม้แต่ตัวเดียว
การเพิ่มคุณค่าให้ฐานข้อมูล
ทำให้ฐานข้อมูลของคุณอัปเดตอยู่เสมอด้วยข้อมูลเว็บแบบสด ดึงโปรไฟล์บริษัท ข้อมูลติดต่อ หรือรายละเอียดรายการตามกำหนดเวลา — schema ยังคงเดิมแม้แหล่งข้อมูลจะเปลี่ยน
การติดตามคู่แข่ง
ติดตามราคา สินค้าคงคลัง รีวิว หรือการเปลี่ยนแปลงของเนื้อหาบนหลายร้อยหน้า Schema เดียว ไปป์ไลน์เดียว เพิ่มแหล่งข้อมูลใหม่ได้ในไม่กี่วินาที
การสร้างชุดข้อมูล
สร้างชุดข้อมูลฝึกสอน เกณฑ์วัดผล หรือชุดข้อมูลวิจัยจากเว็บสาธารณะ ประมวลผล URL หลายพันรายการแบบแบตช์ให้ออกมาเป็นผลลัพธ์ที่มีโครงสร้างสม่ำเสมอ
เราสร้าง Thunderbit บน API นี้ API เดียวกับที่คุณกำลังดูอยู่นี้เป็นพลังขับเคลื่อน Chrome Extension และเว็บแอปของ Thunderbit — ถูกใช้โดยผู้ใช้กว่า 200,000+ คนเพื่อดึงข้อมูลจากหน้าหลายสิบล้านหน้าทุกเดือน
นี่ไม่ใช่โปรเจกต์เสริม แต่มันคือโครงสร้างพื้นฐานที่ เราลงเดิมพันกับผลิตภัณฑ์ของเราเอง
0M+
จำนวนหน้าที่ประมวลผลต่อเดือนและเติบโตขึ้นเรื่อย ๆ
0K+
ผู้ใช้บน Thunderbit Extension
ราคา เริ่มใช้ฟรี จ่ายตามการใช้งานที่เพิ่มขึ้น
รายเดือน รายปี -33%
วิธีทดลองสแครปแบบเบา ๆ ไม่มีค่าใช้จ่าย ไม่ต้องใช้บัตร ไม่ยุ่งยาก
เหมาะสำหรับโปรเจกต์เสริมหรือเครื่องมือขนาดเล็ก เร็ว เรียบง่าย ไม่เกินความจำเป็น
$16 /เดือน
เรียกเก็บเงินรายปี ชำระหน่วยทั้งหมดล่วงหน้า
สร้างมาเพื่อปริมาณงานสูงและความเร็ว Thunderbit แบบเต็มพลัง
$40 /เดือน
เรียกเก็บเงินรายปี ชำระหน่วยทั้งหมดล่วงหน้า
คำถามที่พบบ่อย
questions ทุกสิ่งที่คุณควรรู้เกี่ยวกับผลิตภัณฑ์และการเรียกเก็บเงิน
ความแตกต่างระหว่าง Distill กับ Extract คืออะไร?
ใช้งานได้กับเว็บไซต์ที่ใช้ JavaScript หนัก ๆ ไหม?
การดึงข้อมูลจะพังไหมเมื่อเว็บไซต์ออกแบบใหม่?
งานแบบแบตช์ใช้เวลานานเท่าไร?