Fetch real-time data from 100+ websites,No development or maintenance required.
Over 100 million real residential IPs from genuine users across 190+ countries.
SCRAPING SOLUTIONS
Get accurate and in real-time results sourced from Google, Bing, and more.
With 120+ prebuilt and custom scrapers ready for any use case.
No blocks, no CAPTCHAs—unlock websites seamlessly at scale.
Execute scripts in stealth browsers with full rendering and automation
PROXY INFRASTRUCTURE
Over 100 million real residential IPs from genuine users across 190+ countries.
Reliable mobile data extraction, powered by real 4G/5G mobile IPs.
For time-sensitive tasks, utilize residential IPs with unlimited bandwidth.
Fast and cost-efficient IPs optimized for large-scale scraping.
SCRAPING SOLUTIONS
PROXY INFRASTRUCTURE
DATA FEEDS
Full details on all features, parameters, and integrations, with code samples in every major language.
LEARNING HUB
ALL LOCATIONS Proxy Locations
TOOLS
RESELLER
Get up to 50%
Contact sales:partner@thordata.com
Products $/GB
Fetch real-time data from 100+ websites,No development or maintenance required.
Get real-time results from search engines. Only pay for successful responses.
Execute scripts in stealth browsers with full rendering and automation.
Bid farewell to CAPTCHAs and anti-scraping, scrape public sites effortlessly.
Dataset Marketplace Pre-collected data from 100+ domains.
Over 100 million real residential IPs from genuine users across 190+ countries.
Reliable mobile data extraction, powered by real 4G/5G mobile IPs.
For time-sensitive tasks, utilize residential IPs with unlimited bandwidth.
Fast and cost-efficient IPs optimized for large-scale scraping.
Data for AI $/GB
Pricing $0/GB
Docs $/GB
Full details on all features, parameters, and integrations, with code samples in every major language.
Resource $/GB
EN $/GB
产品 $/GB
AI数据 $/GB
定价 $0/GB
产品文档 $/GB
资源 $/GB
简体中文 $/GB

JavaScript 密集的目標會擊垮簡單爬蟲,於是團隊升級到無頭瀏覽器——然後發現,規模化的瀏覽器自動化,其實是一個穿著工具外衣的頻寬與可靠性問題。本文是一份壓力測試紀實:工作負載、活下來的架構、Thordata Scraping Browser 的成本算術,以及 Oxylabs Web Scraper API 在哪些情境才是更優選擇的誠實評估。沒有虛構的基準測試——只有公開定價、文件記載的能力,以及你可以自己重跑一遍的算術。
每個爬蟲作業最終都會遇到那個網站:對 requests.get() 回傳空殼,然後在機器人偵測層後面用 JavaScript 渲染一切。那就是你安裝 Playwright 的那一週。
測試團隊的工作負載是經典的困難案例:JavaScript 渲染後的電商品類頁與商品頁,外加一組被激進反爬防護的目標。需求如下:
以每頁 2 MB 計,1,000 萬次載入約等於 20,000 GB(20 TB) 的瀏覽器流量。記住這個數字,整個成本故事都掛在它上面。
在壓力測試中存活下來的模式,是用「瀏覽器等級的端點」取代自管的瀏覽器機隊:Thordata 的 Scraping Browser,一個 $2.50/GB 的無頭瀏覽器服務,相容 Puppeteer、Playwright、Selenium 與 Scrapy,反爬偵測、指紋管理與驗證碼處理內建在連線層。既有的 Playwright 程式碼換個端點就能接上:
# 之前:本機瀏覽器、自己的基礎設施、自己的代理輪替、自己的驗證碼
browser = await playwright.chromium.launch(headless=True)
# 之後:Scraping Browser 端點——同一套 Playwright API,上游全部受管
browser = await playwright.chromium.connect_over_cdp(
"wss://browser.thordata.com?apikey=YOUR_KEY"
)
page = await browser.new_page()
await page.goto("https://protected-target.example/category/1")
html = await page.content() # 完整渲染後的內容
測試得到的工程觀察是:規模化瀏覽器爬蟲最難的部分從來不是瀏覽器——而是繞著它的全部:代理輪替品質、指紋一致性、驗證碼頻率,以及決定 1,000 萬次載入最後產出 1,000 萬頁、還是 600 萬頁加 400 萬次昂貴失敗的重試經濟學。把這些顧慮上移到服務層,改變更多的是團隊的待命負擔,而不是程式碼。
公開牌價、本工作負載的數字、透明的假設:
| 情境 | 算式 | 每月成本 |
|---|---|---|
| Scraping Browser 走滿 20 TB | 20,000 GB × $2.50/GB | $50,000——明確的「重新議價或重新架構」訊號 |
| Scraping Browser,頁面優化後 | 阻擋媒體/CSS,有效約 0.6 MB → 6 TB | 約 $15,000 |
| 同批目標改走 Web Scraper API(現成爬蟲) | 約 70% 目標有現成爬蟲;700 萬筆結果 × 約 $0.50/千筆 | 約 $3,500 |
| 長尾餘量走 Scraping Browser | 300 萬次載入 × 0.6 MB → 1.8 TB | 約 $4,500 |
| 混合總計 | 能現成就現成,必須才用瀏覽器 | 約 $8,000 |
算術掉出兩個教訓。第一,渲染後的頁面重量是成本槓桿:在資料就在 DOM 裡的頁面上阻擋媒體與樣式表,把有效流量砍了約 70%——一個標準的 Playwright 技巧,突然有了具體的美元價值。第二,而且更重要:瀏覽器該是例外,不是常態。 任何一頁能用現成爬蟲服務的,成本都只有瀏覽器渲染頁的一小部分。壓力測試真正的發現是架構層面的——按目標難度路由,約 70% 的工作負載根本不碰瀏覽器。
這場比較需要誠實,所以直接說。Oxylabs 的 Web Scraper API——每月 $49 起,背後是公開規模 1.75 億以上 IP、涵蓋 195 個國家的網路——是一個成熟的企業級抓取平台,而且對特定的買家是正確選擇:
Oxylabs 是一款優秀的產品,優勢真實且方向不同。測試團隊的算術展示的是:對自助式、按用量計價的這種形狀的工作負載,Thordata 技術棧上的混合模式——公開牌價下每月約 $8,000——以遠低於純瀏覽器或純訂閱路線的成本完成同樣的採集,由公開住宅滑桿($2.00/GB 一路到 5,000 GB 的 $0.65/GB)與按結果計費扛下主要工作量。
有一類目標該整個拉出瀏覽器層:搜尋引擎結果頁。它們 JavaScript 密集(把團隊推向瀏覽器)、HTML 肥大(懲罰按 GB 計費)、又容易觸發驗證碼(懲罰一切)——但你想從它們身上拿的資料卻輕巧而結構化。用瀏覽器採 SERP,等於用貨運費率寄一封信。
正確路由是按次計費:Thordata 的 SERP API 量價約 每 1,000 次結構化回應 $0.70;需求是排程追蹤而非一次性查詢時,則用完整受管的 SERP 監控解決方案。在本次測試工作負載中,把排名追蹤作業移出瀏覽器層、改上持續 SERP 資料爬取,再砍掉兩位數百分比的瀏覽器帳單,而且資料品質更好——結構化欄位,而不是爬回來的 HTML。
$2.50/GB 對一個抓取瀏覽器來說貴嗎? 看情境。自管瀏覽器機隊每 GB 帳面上免費,但成本落在基礎設施、代理、驗證碼破解服務與待命負擔上;$2.50/GB 是「不用營運那一整套」的價格。真正重要的優化是路由:瀏覽器只留給真的需要它的目標。
怎麼知道哪些目標需要瀏覽器? 用實驗回答:每個目標先丟給 Web Scraper API;只有失敗或沒有現成爬蟲的目標,才升級到瀏覽器層。多數團隊會發現瀏覽器層只有他們擔心的 20–30%。
Scraping Browser 支援反偵測瀏覽器嗎? 支援——Thordata 的瀏覽器技術棧整合 AdsPower、BitBrowser、GoLogin 等工具,適合自動化與手動作業階段混合的工作流。
規模化之後的可靠性呢? Thordata 公布其網路成功率 99.7%、正常運作率 99.9%;瀏覽器層繼承同一個池與反爬處理。與任何供應商一樣,先用試用在自家目標上驗證再投入量——一週的鏡像運行能回答規格表回答不了的事。
那路由表最後長什麼樣?
| 目標類型 | 路線 | 計價 |
|---|---|---|
| 主要平台、求職網站、電商 | Web Scraper API(現成爬蟲) | 約 $0.50–1.00/千筆結果 |
| 搜尋結果 | SERP API 或 | 約 $0.70/千次回應 |
| 有防護的 JS 密集長尾 | Scraping Browser | $2.50/GB |
| 簡單的靜態頁面 | 原始住宅代理 | 量價 $0.65–2.00/GB |
一千萬次請求之後,活下來的原則濃縮成那張一行路由表:能現成就現成、必須才用瀏覽器、資料結構化就按次計費、真正簡單的才用原始代理。用公開費率在你自己的工作負載上重跑一遍算術——免費試用額度涵蓋每一層——讓數字替你選架構。
Looking for
Top-Tier Residential Proxies?
您在寻找顶级高质量的住宅代理吗?
Test Thordata Residential Proxies Free: Get Up to 500MB for Your First Project
New users can test Thordata Re ...
greta
2026-09-11
Proxy IP Reputation and Clean IPs: Why a “Fresh” Proxy Still Gets Blocked
What decides a proxy IP’s repu ...
Chris
2026-09-11
Shared vs. Dedicated Proxies: When Exclusive IPs Are Worth the Extra Cost
Shared or dedicated proxies? H ...
Chris
2026-09-11
1,000 美元能買到幾筆職缺?一個招聘數據分析團隊的實際計算
勞動市場情報是一門資料算術的生意——每美元採到最多職缺的團隊 ...
Xyla Huxley
2026-09-11
六週、六十億支影片:一個影片搜尋產品的建造日誌
打造一個影片搜尋產品——使用者輸入一句話,就能在數百萬支影片 ...
Xyla Huxley
2026-09-11
你的 AI Agent 讀文字讀得很漂亮,但它對其他一切是盲的
企業 AI Agent 的檢索語料以文字為主,而它們被問到的 ...
Xyla Huxley
2026-09-11
那支活了九天的仿冒商品:一次廣告驗證監控的完整事故复盘
一個品牌保護團隊的監控平台,在整個區域的仿冒品浪潮持續九天未 ...
Xyla Huxley
2026-09-11
Why More AI Teams Are Choosing Ready-to-Use Structured Datasets
Training modern LLMs and visio ...
Jenny Avery
2026-09-10
How to Bypass Anti-Scraping Blocks: 4 Practical Tips for Reliable Data Collection in 2026
Facing frequent IP bans, CAPTC ...
Jenny Avery
2026-09-10