单装饰器记录
在 Python 中添加 `@retrace.record`,或在 TypeScript 中用 `trace()` 包装异步函数。Retrace 会捕获执行过程,而无需在代理代码中手动处理 span。
Retrace 是面向 AI 代理的执行回放引擎。它会记录代理运行、回放这些运行,并允许你从某个特定步骤分叉,以便在发布前检查某项更改如何影响后续行为。
该产品围绕调试和回归工作流构建:每一次已记录的运行都可以变成可回放的 trace,失败路径可以被分支和对比,提出的修复也可以针对原始失败进行检查并给出结论。网站将其定位为一款面向开发者的工具,帮助理解代理工作流中的模型调用、工具调用、成本、延迟和错误。
在 Python 中添加 `@retrace.record`,或在 TypeScript 中用 `trace()` 包装异步函数。Retrace 会捕获执行过程,而无需在代理代码中手动处理 span。
模型调用、工具调用、决策、错误、提示、响应、token 用量、延迟和成本会汇集到一个可交互的时间线中,你可以搜索、拖动查看并回放。
从导致失败的确切步骤分叉一次运行,回放后续路径,并将原始运行和分叉运行并排比较成本与延迟差异。
将拟议变更与失败运行进行回放比对,并获得改进、回退、无变化或无法判定等结论;同时支持依赖感知的重新执行和二分定位到第一个分歧步骤。
Retrace 包含 CI 回归门控、护栏、强制执行、失败分类法、会话以及多代理检测器,用于更广泛的评估和控制工作流。
网站称,敏感值会在存储前被脱敏,离线缓冲区加上传输回退机制可帮助事件在临时连接问题期间继续保存。
捕获生产环境中的代理运行,使失败变成可回放的 trace,并保留原始 LLM 调用、工具调用和错误。
从导致行为变化的确切步骤分叉,回放后续路径,并对比原始运行与修改后的运行,以定位回归原因。
将拟议的提示、工具、模型或 temperature 变更重新应用到失败 trace 上,并根据结论判断修复是否真的更好。
使用 CI 回归门控和评估工作流,在代理输出相对已知良好运行出现回退时阻止其上线。
将跟踪和会话可见性应用于多代理系统,在仅靠日志时很难梳理的交接环节中追踪问题。
Retrace 会记录 AI 代理的执行过程,让你可以回放一次运行、从失败步骤分叉,并检查其中涉及的具体 LLM 调用、工具调用和错误。网站还描述了“修复验证”工作流,即将变更后的运行与失败结果进行回放比对,并判断为改进、回退、无变化或无法判定。
源内容显示了 Python 装饰器 `@retrace.record` 和 TypeScript 的 `trace()` 包装器。文档还说明了用于摄取、获取、列出 traces 以及创建分叉/回放工作流的 REST API 端点。
定价页面包含免费方案,以及付费的 Starter、Pro、Teams 和 Enterprise 方案。付费层级增加了更高的 trace 限额、更长的保留期、回放功能、修复验证运行、评估门控和协作功能。
Retrace 面向一种工作流:生产环境中的失败会变成一条已记录的 trace,变更后的步骤会被分叉并回放,然后在上线前对结果进行比较。源内容还提到回归测试、CI 评估门控、护栏、强制执行、失败分类法和多代理会话等相关能力。
所提供的来源没有列出完整的集成目录。不过其中确实展示了对 Python 和 TypeScript 埋点、主要模型提供方调用以及 REST API 的支持。
ByteAsk 是面向 C 和 C++ 的终端优先 AI 编码 agent,可直接编辑仓库,并在展示 diff 前用真实编译器、调试器、sanitizers 和测试验证修改。提供免费版与付费方案。
Manta AI 是面向团队的自治式网页应用测试工具,可从 URL 自动探索应用、映射行为、捕捉回归,并用自然语言生成测试,无需脚本或维护选择器。
CreateOS Sandbox 是基于 Firecracker 微型虚拟机的隔离计算环境,用于运行代码和 agent 工作负载,支持私有网络、SDK、CLI 和 MCP 程序化控制。
hob 是面向编码 agent 的独立工作区,可将 agent 会话、终端、历史记录和后续工作围绕你已在用的工具与提供商有序管理,适合重视本地路由、历史和工作区结构控制的开发者。
SonOf 连接你的代码仓库和 PM 工具,审计代码库与产品上下文,将已批准工作转为可交付工单,并由资深工程复审,适合缺少完整团队的创始人和技术负责人。
Ghost 是一款基于终端的 AI 助手,可在命令行中聊天、生成代码并运行任务。内置免费模型,支持 Linux、macOS 和 Windows,且为开源项目。