Excalibur

面向产品工程师的开源全周期 AI 编程 Agent,覆盖 Discover->Plan->Build->Test->Docs->Review->Ship->Audit 八阶段,自带时间旅行事件日志和对抗验证网格

📅 收录: 2026-07-09 🔄 更新: 2026-07-09

Excalibur 快速入门

开源全周期 AI 编程 Agent,不只写代码—决定做什么、验证做对了、审计做过什么,一条命令跑完整个产品周期。

这是什么?适合谁?

Excalibur 是一个面向产品工程师(Product Engineer)的开源 AI 编程 Agent,核心定位是覆盖完整产品周期而不仅仅是代码生成。它的全周期包含八个阶段:Discover(发现/评估需求)-> Plan(规划)-> Build(构建)-> Test(测试)-> Docs(文档)-> Review(审查)-> Ship(发布)-> Audit(审计)。

与 Claude Code、Cursor Agent 等纯编码工具相比,Excalibur 有三个差异化能力:

  1. Discovery 阶段:在写任何代码之前,Excalibur 先评估”是否值得做”—衡量范围、证据和风险,给出 build/validate/don’t-build 的建议。这是其他 AI 编程工具没有的能力。
  2. Time-travel 事件日志:每次运行都是一个不可变的追加式事件日志(immutable append-only event log),可以像视频一样回放、从任意步骤分叉新运行。live 视图、replay、dashboard 和 audit trail 是同一份数据,字节级一致。
  3. Adversarial Verification Mesh(对抗验证网格):发布前通过类型化 claims 门控(tests_passed/type_safe/no_secrets)确保质量,不是简单的测试通过就放行。

适合谁?三类人最受益:一是产品工程师,需要从需求评估到发布审计的全流程自动化;二是技术团队 lead,需要审计 Agent 的工作过程和决策依据;三是有治理需求的企业,Enterprise 版提供 SSO/RBAC/合规审计/SIEM 集成。注意:Excalibur 需要自备 LLM API Key(支持 Anthropic/OpenAI/Ollama 等),核心功能免费开源(Apache-2.0)。

准备工作

  • 设备要求:macOS 或 Linux(CLI + 本地 Web Dashboard),Node.js 环境
  • 账号要求:无需注册账号,Core 版完全本地运行;Enterprise 版需联系销售
  • API Key:需自备至少一个 LLM API Key(Anthropic/OpenAI/Azure 等兼容 OpenAI 协议的提供商)
  • 安装方式npm install -g @excalibur-oss/excalibur
  • 许可协议:Apache-2.0 开源免费

3 步快速上手

第 1 步:安装 Excalibur

npm install -g @excalibur-oss/excalibur

安装后验证:

excalibur --version

第 2 步:配置 API Key 并启动

# 设置 API Key(以 Anthropic 为例)
export ANTHROPIC_API_KEY=sk-ant-xxxxx

# 启动交互式 shell
excalibur

首次启动会自动检测 Key 并引导配置。你也可以在运行中用 /models 命令切换模型:

/models
  ● claude-opus-4     good · default
  ○ gpt-4o
  ○ llama-3.3-70b     fast · paired
  ○ ollama/qwen       local

第 3 步:运行第一个全周期任务

在 m-shell(交互式 shell)中输入任务:

Add rate limiting to the public API

Excalibur 会自动进入全周期流程:

L4 - Full agentic · kimi-k2.7-code

✓ Plan          4 steps
│ ⠹ Implement   api/limiter.ts
│   └ edit api/limiter.ts     +38 −4
│   └ ▸ pnpm test api         running…
│ ○ Verify
│ ○ Document
│ ○ Review
│ ○ Pull Request

████░░░░ 1m12s · $0.42 · standard-safe · no push

进阶用法

Discovery 阶段:评估是否值得做

excalibur discover "Add AI invoice summaries"

Excalibur 会从五个维度评估:clarity(清晰度)、evidence(证据)、scope(范围)、risk(风险)、readiness(就绪度),最终给出建议(如 needs_validation),并创建工作项 WI-142。

Time-travel:回放和分叉

在运行中按 Esc-Esc 可以实时回退到任意步骤。回放视图支持从任意步骤分叉新运行(fork from here),好的前缀免费重放,只有变化部分重新执行。

本地 Web Dashboard

excalibur serve

打开浏览器访问 localhost:7878,你得到一个任务看板(Kanban)、运行浏览器、成本图表和实时编排时间线。无需账号、无需云端,完全本地运行。

  • --write 模式:从浏览器面板驱动运行
  • --share 模式:生成只读分享链接

自主级别(L0-L4)

Excalibur 支持五级自主度,逐任务调整:

  • L0:快速回答,不执行操作
  • L1:建议方案,需人工批准每步
  • L2:执行简单任务,关键操作需批准
  • L3:自主执行,仅高危操作需批准
  • L4:完全自主,在隔离分支中运行

多 Agent 编排(Swarm)

大任务自动拆分为多个 Agent 并行执行,每个在隔离的 worktree 中工作:

excalibur run "Refactor auth module and add OAuth2 support" --autonomy L4

Excalibur 会自动评估任务规模,分配 3 个独立 Agent 在隔离 worktree 中并行工作。

内置工作流

14 个内置工作流 + 14 个方法论,YAML 可定制,每个含质量门控:

excalibur workflow list
  standard-feature    绿地功能开发
  bug-fix             缺陷修复
  refactor            重构
  migration           技术迁移
  ...

常见踩坑

踩坑 1:全周期执行耗时较长

  • 症状:L4 全周期任务运行 5-10 分钟才完成
  • 原因:Discovery + Plan + Build + Test + Docs + Review 全阶段串行执行,每步都调用 LLM
  • 解决:简单任务用 L2 级别跳过 Discovery/Docs/Review;或用 --quick 模式只跑 Build+Test

踩坑 2:API 费用超预期

  • 症状:一次 L4 运行花费 $0.50-$2.00
  • 原因:全周期多步调用 frontier 模型,Token 消耗大
  • 解决:配置 good+fast 模型对,简单步骤自动用 cheap 模型;Dashboard 有实时成本追踪和预算告警

踩坑 3:Discovery 评估质量依赖模型能力

  • 症状:Discovery 给出的建议过于保守或过于乐观
  • 原因:Discovery 阶段完全依赖 LLM 的产品判断力,弱模型表现差
  • 解决:用 Claude Opus 4 或 GPT-4o 等 frontier 模型跑 Discovery;/models 切换

常见问题 FAQ

Q1:Excalibur 和 Claude Code 有什么区别?

A:Claude Code 是纯编码 Agent,Excalibur 覆盖完整产品周期(含 Discovery 决策阶段和 Audit 审计阶段)。Excalibur 还有 Time-travel 事件日志(可回放/分叉)和本地 Web Dashboard,这些 Claude Code 没有。

Q2:需要联网吗?

A:Core 版完全本地运行,无需注册账号。但需要访问 LLM API(Anthropic/OpenAI 等)。如果用 Ollama 本地模型,可以完全离线。

Q3:支持哪些 IDE?

A:提供 VS Code、Cursor、Windsurf 的 IDE 扩展。也可以纯 CLI 使用。

Q4:支持哪些模型?

A:所有 OpenAI 兼容协议的模型(含 Azure)、Anthropic Claude 系列、Ollama 本地模型。支持 good+fast 模型对,自动在复杂和简单步骤间切换。

参考链接


本文基于官方文档和公开资料整理,AI辅助生成。如有错误或过时信息,请通过 contact@magicnetworld.com 反馈。

📊 评分与标签

评分说明

总分 8.6/10 · P_优选

📊 可观测社区指标(数据核验日期:2026-07-09)

⚙️ 功能完整度 2.4/2.5

  • 覆盖完整产品周期八阶段:Discover->Plan->Build->Test->Docs->Review->Ship->Audit,是市面唯一覆盖 Discovery(需求评估)和 Audit(审计)的 AI 编程 Agent
  • 14 个内置工作流 + 14 个方法论,YAML 可定制,每个含质量门控;5 级自主度(L0-L4)逐任务调整
  • Time-travel 事件日志(不可变追加式,可回放/分叉)、Adversarial Verification Mesh(对抗验证网格)、多 Agent Swarm 编排(隔离 worktree 并行)、本地 Web Dashboard
  • 对比 Claude Code:Claude Code 仅覆盖编码+测试,无 Discovery 决策阶段、无 Time-travel 回放、无本地 Dashboard
  • 对比 Cursor Agent:Cursor Agent 聚焦 IDE 内编码,无全周期流程、无对抗验证网格、无审计日志
  • 对比 Devin:Devin 覆盖部分周期但闭源付费,Excalibur 开源免费且多了 Discovery+Audit 两端

✨ 输出质量 2.2/2.5

  • Adversarial Verification Mesh 通过类型化 claims 门控(tests_passed/type_safe/no_secrets)确保发布质量,不是简单测试通过就放行
  • Time-travel 事件日志保证 live= replay= dashboard= audit 四视图字节级一致,审计可追溯
  • 支持 good+fast 模型对,复杂步骤用 frontier 模型(如 Claude Opus 4),简单步骤自动用 cheap 模型,平衡质量和成本
  • 对比 Claude Code:Claude Code 输出质量依赖单模型,Excalibur 的模型对策略在成本控制下保持高质量
  • 对比 Cursor Agent:Cursor Agent 无对抗验证网格,测试通过即放行,Excalibur 多一层类型化 claims 门控

🖐️ 易用性 1.3/1.5

  • 一条 npm 命令安装:npm install -g @excalibur-oss/excalibur,首次运行自动配置
  • 交互式 m-shell + CLI 双界面,支持斜杠命令(/models 等)和脚本化 one-shot 模式
  • IDE 扩展支持 VS Code/Cursor/Windsurf,MCP + LSP 集成,自定义 Agent personas
  • 对比 Claude Code:Claude Code 安装同样简单但无 Web Dashboard,Excalibur 的 localhost:7878 看板体验更直观
  • 对比 Devin:Devin 需注册账号且为 SaaS,Excalibur 完全本地运行无需账号,上手门槛更低

💰 性价比 1.5/1.5

  • Core 版完全免费,Apache-2.0 开源,所有核心功能含 Time-travel/Discovery/Swarm/Dashboard 全部免费
  • 支持自带 API Key(BYOK),Key 存在环境变量不进仓库;支持 Ollama 本地模型实现零 API 成本
  • Enterprise 版按 seats+usage 定制 pricing,提供 SSO/RBAC/合规审计/SIEM 集成
  • 对比 Devin:Devin 闭源付费($500/月起),Excalibur 开源免费且功能覆盖更广,性价比碾压
  • 对比 Cursor Agent:Cursor Agent $20/月起,Excalibur Core 零成本(仅需自备 API Key)

🔒 稳定性 0.8/1.0

  • 524 commits、39 tags、3 branches,v1.16.4 两天前发布,迭代活跃
  • 处于 Public Beta 阶段,文档有公开 Roadmap 和 Changelog
  • standard-safe 默认安全模式:不推送代码、沙箱执行、隔离分支、密钥保护
  • 对比 Claude Code:Claude Code 已 GA 稳定运行,Excalibur 仍在 Beta,稳定性有差距
  • 对比 Cursor Agent:Cursor Agent 商业产品有 SLA 保障,Excalibur 作为开源 Beta 项目无 SLA

🛡️ 隐私安全 0.4/1.0

  • Core 版完全本地运行,代码不离开设备,API Key 存环境变量不进仓库
  • standard-safe 默认安全:沙箱执行、隔离分支、密钥保护、审批门控、不自动推送
  • Apache-2.0 开源可审计,代码完全公开
  • 需自备 LLM API Key,代码内容会发送至第三方模型提供商(Anthropic/OpenAI 等),存在数据暴露风险
  • 对比 Claude Code:Claude Code 同样需发送代码至 Anthropic API,隐私级别相当
  • 对比 Cursor Agent:Cursor Agent 有隐私模式但默认可能上传,Excalibur 的 Ollama 本地模型选项可完全离线更安全

评分依据可追溯至公开来源,每项分数均有明确理由和数据支撑。

🏷️ 标签说明

  • 免费增值: Core 免费 Apache-2.0 开源,Enterprise 按需付费。来源:定价页
  • 编程: AI 编程 Agent,覆盖全产品周期。来源:官网首页
  • 自动化: 全周期自动化(Discover->Audit),多 Agent Swarm 编排。来源:官网首页
  • Agent: AI Agent 工具,5 级自主度。来源:文档
  • 多 Agent: Swarm 编排,隔离 worktree 并行。来源:官网首页
  • 海外: 国际开源项目。来源:GitHub

📋 来源与核验记录

  • ✅ 已核验: Excalibur 官网首页 - 产品功能确认,含 Time-travel/Discovery/Swarm/Dashboard
  • ✅ 已核验: Excalibur 定价页 - Core 免费 Apache-2.0,Enterprise 定制 pricing
  • ✅ 已核验: GitHub ExcaliburOSS/excalibur-core - Stars 15, Forks 0, 524 commits, v1.16.4
  • ✅ 已核验: Excalibur 文档页 - 14 工作流/14 方法论/L0-L4 自主度/MCP+LSP
  • ✅ 已核验: HN Algolia 搜索 - Show HN 帖子 7 points, Rafael_Casuso
  • ✅ curl 已验证: npm API - 近月下载 6,654 次
  • ⚠️ 未验证(需安装实测): 全周期执行质量和耗时 - 需实际安装运行 L4 任务
  • ⚠️ 未验证(需安装实测): Discovery 阶段评估质量 - 需实际运行 discover 命令
  • ❌ 已删除死链: 无

同分类推荐

AI编程 分类下的其他工具

)}