Context.dev 整合多種檔案格式的網頁爬取 API

iconKuCoinFlash
分享
AI summary icon精華摘要
Context.dev 簡化了加密貨幣新聞和通脹數據的網絡爬取,推出 Scrape Anything。開發者輸入 URL 並選擇輸出格式,如 Markdown、HTML 或結構化欄位。該工具支援 40 多種檔案類型、JavaScript 渲染和反爬蟲防禦。標準爬取耗用 1 個信用點,瀏覽器爬取耗用 2 個,PDF OCR 按頁計費。

ME News 消息,9 月 23 日(UTC+8),動察 Beating AI 快訊,YC S26 創始公司 Context.dev 推出 Scrape Anything,將原本分散的網頁抓取 API 整合為單一介面。開發者只需提供一個網頁或線上檔案 URL,並選擇所需格式,即可一次獲取 Markdown、HTML、截圖、頁面圖片、原始檔案或結構化欄位。除了處理普通網頁,它目前還支援 PDF、DOCX、PPT、XLSX 等約 40 種檔案格式。JavaScript 渲染、代理切換、反爬處理與重試均由 Context.dev 負責,開發者無需自行維護瀏覽器與代理基礎設施。此前這些功能已存在,此次主要是將不同輸入與輸出統一至同一個 /v1/web/scrape 介面。一次普通抓取消耗 1 個 credit,請求多種輸出格式仍共用此次基礎計費;使用瀏覽器操作則為 2 個 credits,PDF OCR 則另按恢復頁數計費。(來源:BlockBeats)

免責聲明:本頁面資訊可能來自第三方,不一定反映KuCoin的觀點或意見。本內容僅供一般參考之用,不構成任何形式的陳述或保證,也不應被解釋為財務或投資建議。 KuCoin 對任何錯誤或遺漏,或因使用該資訊而導致的任何結果不承擔任何責任。 虛擬資產投資可能存在風險。請您根據自身的財務狀況仔細評估產品的風險以及您的風險承受能力。如需了解更多信息,請參閱我們的使用條款風險披露