Retrace

AI Agent 执行回放引擎——录制、回放、分叉和分享 AI Agent 的每一次执行,调试和迭代只需秒级

📅 收录: 2026-07-08 🔄 更新: 2026-07-08

Retrace 快速入门

AI Agent 执行回放引擎——录制、回放、分叉、分享,像 Git 一样管理 Agent 的每次执行。

这是什么?适合谁?

Retrace 是一个 AI Agent 的执行回放引擎。它录制 AI Agent 的每一次 LLM 调用、工具调用和错误,让你可以像调试普通代码一样调试 AI Agent 的行为。它的核心能力是「确定性回放」——从失败步骤精确重现,并且支持 Git 式的「分叉」——从失败点创建分支,尝试不同修复方案。

传统 AI Agent 调试的痛点:Agent 执行失败了,你只能看日志猜测原因,无法重现。Retrace 解决了这个问题。

适合:AI Agent 开发者和调试者、需要 Agent CI/CD 的团队、多 Agent 系统的执行可视化、Agent 回归测试。

准备工作

  • 注册账号:访问 retraceai.tech 注册
  • Free tier:1,000 traces/月,适合个人开发者
  • Pro tier:$99/月,50,000 traces + Eval Gates + 无限 Guardrails
  • 安装 SDK:npm install @retraceai/sdkpip install retraceai

3 步快速上手

第 1 步:安装 SDK

# Python
pip install retraceai

# Node.js
npm install @retraceai/sdk

第 2 步:集成到 Agent 代码

from retraceai import Retrace

# 初始化,自动开始录制
retrace = Retrace(api_key="your_key")

@retrace.trace
def agent_execute(task):
    # 你的 Agent 执行逻辑
    result = llm_call(task)
    tool_result = tool_execute(result)
    return tool_result

或使用上下文管理器:

with retrace.session("debug-session"):
    agent.run("帮我修复这个 bug")

第 3 步:查看和回放

登录 retraceai.tech 控制台,你会看到每次执行的完整录制:

  • 每次 LLM 调用的 prompt 和 response
  • 每次工具调用的输入和输出
  • 错误发生时的完整上下文
  • 点击「Replay」从任意步骤精确重现

进阶用法

分叉执行

类似 Git 分支,从失败步骤创建新分支尝试不同修复:

# 从失败点分叉
fork = retrace.fork(session_id="debug-session", from_step=3)
fork.run("换一种方式处理这个错误")

Eval Gates(Pro 功能)

修复后自动验证 Agent 行为:

retrace.add_eval_gate(
    name="no_error",
    check=lambda result: result.error is None
)

Guardrails(Pro 功能)

设置无限护栏规则,防止 Agent 越界:

retrace.add_guardrail(
    name="no_file_delete",
    rule=lambda action: "rm -rf" not in action.command
)

常见问题 FAQ

Q1:Retrace 和 LangSmith 有什么区别?

A:LangSmith 侧重 LLM 调用的追踪和评估,Retrace 专注 Agent 执行的录制、回放和分叉。LangSmith 更适合 LLM 应用开发,Retrace 更适合 Agent 调试和 CI/CD。

Q2:录制会影响 Agent 性能吗?

A:SDK 开销极小,通常 <50ms 延迟。录制数据异步上传,不影响 Agent 主流程。

Q3:数据安全吗?录制了什么?

A:录制内容包括 LLM 调用的 prompt/response、工具调用的输入输出、错误信息。数据存储在 Retrace 云端。Pro 版支持数据保留策略配置。

Q4:支持哪些 Agent 框架?

A:支持 Python 和 Node.js SDK,可集成 LangChain、CrewAI、AutoGen、自定义 Agent 等主流框架。

参考链接

📊 评分与标签

评分说明

总分 8.2/10 · P_优选

📊 可观测社区指标(数据核验日期:2026-07-08)

⚙️ 功能完整度 2.2/2.5

  • 录制+回放+分叉+Eval Gates+Guardrails 全链路
  • 确定性回放精确重现 Agent 执行
  • Git 式分叉快速实验不同修复方案
  • 来源:retraceai.tech
  • 对比 LangSmith:Retrace 有执行分叉+防火墙 vs LangSmith 侧重追踪和评估
  • 对比 Arize Phoenix:Retrace 专注 Agent 回放 vs Phoenix 侧重模型监控

✨ 输出质量 2.0/2.5

  • 确定性回放精确可靠,不遗漏任何执行细节
  • SDK 开销 <50ms,对 Agent 性能影响极小
  • 来源:retraceai.tech
  • 对比 LangSmith:Retrace 的回放功能更精准,LangSmith 的追踪更全面
  • 对比 Braintrust:Retrace 有执行录制+分叉 vs Braintrust 侧重数据集评估

🖐️ 易用性 1.0/1.5

  • Python/Node.js SDK 一行代码集成
  • 需一定配置,但文档清晰
  • 来源:retraceai.tech
  • 对比 LangSmith(LangChain 原生集成):Retrace 需额外 SDK 集成
  • 对比自建日志方案:Retrace 开箱即用更简单

💰 性价比 1.0/1.5

  • Free tier 1,000 traces/月,个人开发者够用
  • Pro $99/月 含 50,000 traces + Eval + Guardrails
  • 来源:retraceai.tech/pricing
  • 对比 LangSmith(免费额度有限):Retrace Free tier 更慷慨
  • 对比自建方案零成本:Retrace 的价值在于节省开发时间

🔒 稳定性 0.7/1.0

  • 2026-07-02 发布,仅 6 天产品历史
  • Product Hunt 101 upvotes,初期反响良好
  • 来源:Product Hunt
  • 对比 LangSmith(LangChain 出品,2 年+):Retrace 稳定性待验证
  • 对比 Arize Phoenix(开源):Retrace 闭源 SaaS 依赖第三方

🛡️ 隐私安全 0.7/1.0

  • 录制 Agent 执行数据需信任 SaaS 平台
  • 包含 LLM prompt/response 和工具调用信息
  • 来源:retraceai.tech
  • 对比自建方案:自建可完全控制数据
  • 对比 LangSmith:安全性相当,均为 SaaS

🏷️ 标签说明

  • 免费增值: Free 1,000 traces, Pro $99/mo。来源: retraceai.tech/pricing
  • 云端: SaaS 平台。来源: 官网
  • 编程: 开发者工具。来源: Product Hunt
  • 自动化: Agent CI/CD。来源: Product Hunt
  • Agent: AI Agent 调试。来源: Product Hunt
  • 海外: 国际团队。来源: Product Hunt

📋 来源与核验记录

  • ✅ 已核验: retraceai.tech — 官网正常,定价确认
  • ✅ 已核验: Product Hunt — 101 upvotes,#16 日榜
  • ⚠️ 未验证(需注册): Retrace SDK 实际录制体验 — 需注册测试
  • ⚠️ 未验证: 分叉执行和 Eval Gates — 需 Pro 版测试

同分类推荐

AI编程 分类下的其他工具

)}