Web 內容擷取
將 URL 擷取成乾淨的 markdown,供 LLM pipeline 與內容處理使用。定價頁面也將 HTML 與 sitemap 擷取列為獨立的 web extraction 端點。
Context.dev 是專為 AI agents 與 LLM 應用打造的 web scraping 與 crawl API。它提供單一 REST API,可擷取即時網頁內容、爬取網站,並從頁面與網站抽取結構化資料。
此產品的定位是以一項服務取代內部 scraping 基礎架構或多個供應商。網站強調的輸出包含 markdown、渲染後的 HTML、sitemap、截圖、品牌資料,以及基於 JSON Schema 的擷取,並提供可在瀏覽器中完成的 agentic 設定流程。
將 URL 擷取成乾淨的 markdown,供 LLM pipeline 與內容處理使用。定價頁面也將 HTML 與 sitemap 擷取列為獨立的 web extraction 端點。
爬取網站並將資料擷取成你定義的 JSON Schema,當你需要結構化輸出而非原始頁面文字時特別實用。
爬取網站 sitemap 以發現整個網域中的頁面 URL,協助團隊在進一步處理前建立內容索引或盤點站點內容。
依據網域、公司名稱、電子郵件或股票代號擷取品牌詳細資料,包括網站上提及的 logo 與其他中繼資料。
產生 viewport 或 full-page 截圖;在啟用 enrichment 時,另有獨立的圖片擷取端點。
使用 agentic 設定流程,透過 `auth.md` 註冊,然後在瀏覽器中完成 claim,之後再輪詢存取權限。
將即時頁面內容以 markdown 形式提供給 AI agent 或 RAG pipeline,讓模型使用最新的網頁資料,而不是固定快照。
當你需要用於資料庫、工作流程或下游自動化的結構化記錄時,將網站爬取成 JSON Schema 定義的輸出。
透過爬取 sitemap 並沿著網域內的站點結構前進,盤點頁面、文件或產品區段。
擷取品牌中繼資料,例如 logo 與識別資訊,用於產品體驗中的上手、增補或個人檔案顯示。
產生截圖或擷取頁面素材,供審查、QA 或內容擷取流程使用。
是。Context.dev 提供免費方案。定價頁面說,使用工作電子郵件的新用戶可獲得 500 點 API credits,使用免費電子郵件服務商則可獲得 250 點,並搭配不同的請求速率。
當你呼叫端點時會消耗 API credits。Web scraping 端點每次呼叫消耗 1 點 credit,而品牌相關端點,例如 logo 擷取、顏色提取、字型偵測與品牌檔案,每次呼叫消耗 10 點 credits。Logo Link 使用獨立額度。
Context.dev 提供 TypeScript、Python、Ruby、Go 和 PHP 的官方 SDK。
是。FAQ 說明完整支援子網域。
此服務支援 agentic 註冊。Agent 可以使用使用者的電子郵件註冊,傳送設定連結與代碼,接著使用者在瀏覽器中完成 claim ceremony,之後 agent 便會輪詢存取權限。
ByteAsk 是專為 C 與 C++ 打造的終端機優先 AI coding agent,先編輯儲存庫再用真實編譯器、除錯器、sanitizer 與測試驗證變更,並提供免費方案與付費方案。
hob 是一個獨立的 coding agents 工作區,整合 agent sessions、終端機、歷史紀錄與後續工作,並維持你既有的工具與供應商設定。適合想保有本機路由、歷史與工作區結構控制權的開發者。
Ably Chat 是一個聊天 API 平台,適合打造自訂即時聊天應用程式。支援聊天室訊息、輸入中提示、在線狀態、表情回應與訊息更新,並提供依使用量計費選項。
Manta AI 是一款自動化網頁應用測試工具,從 URL 即可開始探索、建立行為地圖,並以自然語言產生測試與回歸檢查,無需撰寫腳本或維護 selector。
SonOf 串接你的 repo 與 PM 工具,審核程式碼庫與產品脈絡,將核准工作轉為可交付的 ticket,並由資深工程師審查,協助創辦人與工程主管快速補足 backlog。
Ghost 是一款終端機 AI 助手,可在命令列中聊天、產生程式碼並執行任務。內建免費模型,支援 Linux、macOS、Windows,且為開源工具。