网页内容抓取
将 URL 抓取为适合 LLM 管道和内容处理的干净 markdown。定价页面还将 HTML 和 sitemap 检索区分为单独的网页提取端点。
Context.dev 是面向 AI agents 和 LLM 应用的网页抓取与 crawl API,可通过一个 REST API 拉取实时网页内容、抓取网站并提取结构化数据。
该产品的定位是用一项服务替代内部抓取基础设施或多个供应商。网站展示的输出包括 markdown、渲染后的 HTML、sitemaps、截图、品牌数据,以及基于 JSON Schema 的提取,另外还提供一个可在浏览器中完成的 agentic 设置流程。
将 URL 抓取为适合 LLM 管道和内容处理的干净 markdown。定价页面还将 HTML 和 sitemap 检索区分为单独的网页提取端点。
抓取网站并将数据提取为你定义的 JSON Schema;当你需要结构化输出而不是原始页面文本时,这很有用。
抓取站点 sitemap 以发现整个域名下的页面 URL,帮助团队在进一步处理前对站点内容进行索引或清点。
根据域名、公司名称、邮箱或股票代码获取品牌详情,包括网站上提到的 logo 和其他元数据。
生成视口或整页截图,并在启用丰富信息时提供单独的图像检索端点。
使用 agentic 设置流程通过 `auth.md` 注册,然后在浏览器中完成认领,再轮询获取访问权限。
将当前页面内容作为 markdown 输入 AI agent 或 RAG 管道,让模型基于实时网页数据而不是静态快照工作。
当你需要用于数据库、工作流或下游自动化的结构化记录时,将网站抓取为由 JSON Schema 定义的输出。
通过抓取 sitemaps 并沿着站点结构遍历整个域名,对页面、文档或产品部分进行清点。
提取品牌元数据,例如用于入驻、丰富信息或产品体验中的资料展示的 logo 和标识符。
生成截图或抓取到的页面资源,用于审核、QA 或内容采集工作流。
是。Context.dev 提供免费套餐。定价页面说明,使用工作邮箱的新用户可获得 500 个 API credits,使用免费邮箱服务的新用户可获得 250 个 credits,且请求速率不同。
当你调用端点时会消耗 API credits。网页抓取端点每次调用消耗 1 个 credit,而品牌相关端点(如 logo 获取、颜色提取、字体检测和品牌资料)每次调用消耗 10 个 credits。Logo Link 使用单独的配额。
Context.dev 提供 TypeScript、Python、Ruby、Go 和 PHP 的官方 SDK。
是的。FAQ 说明完全支持子域名。
该服务支持 agentic 注册。agent 可以使用用户邮箱注册,发送设置链接和代码,然后用户在浏览器中完成认领流程,之后 agent 轮询获取访问权限。
ByteAsk 是面向 C 和 C++ 的终端优先 AI 编码 agent,可直接编辑仓库,并在展示 diff 前用真实编译器、调试器、sanitizers 和测试验证修改。提供免费版与付费方案。
hob 是面向编码 agent 的独立工作区,可将 agent 会话、终端、历史记录和后续工作围绕你已在用的工具与提供商有序管理,适合重视本地路由、历史和工作区结构控制的开发者。
Ably Chat 是用于构建自定义实时聊天应用的 chat API 平台,支持房间消息、输入指示、在线状态、表情回应与消息更新,并提供按使用量计费选项。
Manta AI 是面向团队的自治式网页应用测试工具,可从 URL 自动探索应用、映射行为、捕捉回归,并用自然语言生成测试,无需脚本或维护选择器。
SonOf 连接你的代码仓库和 PM 工具,审计代码库与产品上下文,将已批准工作转为可交付工单,并由资深工程复审,适合缺少完整团队的创始人和技术负责人。
Ghost 是一款基于终端的 AI 助手,可在命令行中聊天、生成代码并运行任务。内置免费模型,支持 Linux、macOS 和 Windows,且为开源项目。