Excalibur
面向产品工程师的开源全周期 AI 编程 Agent,覆盖 Discover->Plan->Build->Test->Docs->Review->Ship->Audit 八阶段,自带时间旅行事件日志和对抗验证网格
Excalibur 快速入门
开源全周期 AI 编程 Agent,不只写代码—决定做什么、验证做对了、审计做过什么,一条命令跑完整个产品周期。
这是什么?适合谁?
Excalibur 是一个面向产品工程师(Product Engineer)的开源 AI 编程 Agent,核心定位是覆盖完整产品周期而不仅仅是代码生成。它的全周期包含八个阶段:Discover(发现/评估需求)-> Plan(规划)-> Build(构建)-> Test(测试)-> Docs(文档)-> Review(审查)-> Ship(发布)-> Audit(审计)。
与 Claude Code、Cursor Agent 等纯编码工具相比,Excalibur 有三个差异化能力:
- Discovery 阶段:在写任何代码之前,Excalibur 先评估”是否值得做”—衡量范围、证据和风险,给出 build/validate/don’t-build 的建议。这是其他 AI 编程工具没有的能力。
- Time-travel 事件日志:每次运行都是一个不可变的追加式事件日志(immutable append-only event log),可以像视频一样回放、从任意步骤分叉新运行。live 视图、replay、dashboard 和 audit trail 是同一份数据,字节级一致。
- Adversarial Verification Mesh(对抗验证网格):发布前通过类型化 claims 门控(tests_passed/type_safe/no_secrets)确保质量,不是简单的测试通过就放行。
适合谁?三类人最受益:一是产品工程师,需要从需求评估到发布审计的全流程自动化;二是技术团队 lead,需要审计 Agent 的工作过程和决策依据;三是有治理需求的企业,Enterprise 版提供 SSO/RBAC/合规审计/SIEM 集成。注意:Excalibur 需要自备 LLM API Key(支持 Anthropic/OpenAI/Ollama 等),核心功能免费开源(Apache-2.0)。
准备工作
- 设备要求:macOS 或 Linux(CLI + 本地 Web Dashboard),Node.js 环境
- 账号要求:无需注册账号,Core 版完全本地运行;Enterprise 版需联系销售
- API Key:需自备至少一个 LLM API Key(Anthropic/OpenAI/Azure 等兼容 OpenAI 协议的提供商)
- 安装方式:
npm install -g @excalibur-oss/excalibur - 许可协议:Apache-2.0 开源免费
3 步快速上手
第 1 步:安装 Excalibur
npm install -g @excalibur-oss/excalibur
安装后验证:
excalibur --version
第 2 步:配置 API Key 并启动
# 设置 API Key(以 Anthropic 为例)
export ANTHROPIC_API_KEY=sk-ant-xxxxx
# 启动交互式 shell
excalibur
首次启动会自动检测 Key 并引导配置。你也可以在运行中用 /models 命令切换模型:
/models
● claude-opus-4 good · default
○ gpt-4o
○ llama-3.3-70b fast · paired
○ ollama/qwen local
第 3 步:运行第一个全周期任务
在 m-shell(交互式 shell)中输入任务:
Add rate limiting to the public API
Excalibur 会自动进入全周期流程:
L4 - Full agentic · kimi-k2.7-code
✓ Plan 4 steps
│ ⠹ Implement api/limiter.ts
│ └ edit api/limiter.ts +38 −4
│ └ ▸ pnpm test api running…
│ ○ Verify
│ ○ Document
│ ○ Review
│ ○ Pull Request
████░░░░ 1m12s · $0.42 · standard-safe · no push
进阶用法
Discovery 阶段:评估是否值得做
excalibur discover "Add AI invoice summaries"
Excalibur 会从五个维度评估:clarity(清晰度)、evidence(证据)、scope(范围)、risk(风险)、readiness(就绪度),最终给出建议(如 needs_validation),并创建工作项 WI-142。
Time-travel:回放和分叉
在运行中按 Esc-Esc 可以实时回退到任意步骤。回放视图支持从任意步骤分叉新运行(fork from here),好的前缀免费重放,只有变化部分重新执行。
本地 Web Dashboard
excalibur serve
打开浏览器访问 localhost:7878,你得到一个任务看板(Kanban)、运行浏览器、成本图表和实时编排时间线。无需账号、无需云端,完全本地运行。
--write模式:从浏览器面板驱动运行--share模式:生成只读分享链接
自主级别(L0-L4)
Excalibur 支持五级自主度,逐任务调整:
- L0:快速回答,不执行操作
- L1:建议方案,需人工批准每步
- L2:执行简单任务,关键操作需批准
- L3:自主执行,仅高危操作需批准
- L4:完全自主,在隔离分支中运行
多 Agent 编排(Swarm)
大任务自动拆分为多个 Agent 并行执行,每个在隔离的 worktree 中工作:
excalibur run "Refactor auth module and add OAuth2 support" --autonomy L4
Excalibur 会自动评估任务规模,分配 3 个独立 Agent 在隔离 worktree 中并行工作。
内置工作流
14 个内置工作流 + 14 个方法论,YAML 可定制,每个含质量门控:
excalibur workflow list
standard-feature 绿地功能开发
bug-fix 缺陷修复
refactor 重构
migration 技术迁移
...
常见踩坑
踩坑 1:全周期执行耗时较长
- 症状:L4 全周期任务运行 5-10 分钟才完成
- 原因:Discovery + Plan + Build + Test + Docs + Review 全阶段串行执行,每步都调用 LLM
- 解决:简单任务用 L2 级别跳过 Discovery/Docs/Review;或用
--quick模式只跑 Build+Test
踩坑 2:API 费用超预期
- 症状:一次 L4 运行花费 $0.50-$2.00
- 原因:全周期多步调用 frontier 模型,Token 消耗大
- 解决:配置 good+fast 模型对,简单步骤自动用 cheap 模型;Dashboard 有实时成本追踪和预算告警
踩坑 3:Discovery 评估质量依赖模型能力
- 症状:Discovery 给出的建议过于保守或过于乐观
- 原因:Discovery 阶段完全依赖 LLM 的产品判断力,弱模型表现差
- 解决:用 Claude Opus 4 或 GPT-4o 等 frontier 模型跑 Discovery;
/models切换
常见问题 FAQ
Q1:Excalibur 和 Claude Code 有什么区别?
A:Claude Code 是纯编码 Agent,Excalibur 覆盖完整产品周期(含 Discovery 决策阶段和 Audit 审计阶段)。Excalibur 还有 Time-travel 事件日志(可回放/分叉)和本地 Web Dashboard,这些 Claude Code 没有。
Q2:需要联网吗?
A:Core 版完全本地运行,无需注册账号。但需要访问 LLM API(Anthropic/OpenAI 等)。如果用 Ollama 本地模型,可以完全离线。
Q3:支持哪些 IDE?
A:提供 VS Code、Cursor、Windsurf 的 IDE 扩展。也可以纯 CLI 使用。
Q4:支持哪些模型?
A:所有 OpenAI 兼容协议的模型(含 Azure)、Anthropic Claude 系列、Ollama 本地模型。支持 good+fast 模型对,自动在复杂和简单步骤间切换。
参考链接
- Excalibur 官网:https://getexcalibur.dev
- GitHub 仓库:https://github.com/ExcaliburOSS/excalibur-core
- 文档:https://getexcalibur.dev/docs/
- 定价:https://getexcalibur.dev/pricing/
- npm 包:@excalibur-oss/excalibur
- Apache-2.0 License
本文基于官方文档和公开资料整理,AI辅助生成。如有错误或过时信息,请通过 contact@magicnetworld.com 反馈。
📊 评分与标签
评分说明
总分 8.6/10 · P_优选
📊 可观测社区指标(数据核验日期:2026-07-09)
- GitHub: ExcaliburOSS/excalibur-core ★15, 🔱0, 524 commits, 39 tags
- 页面访问核验:Apache-2.0,最新版本 v1.16.4(2 天前发布),由 RafaelCasuso 维护
- npm: @excalibur-oss/excalibur 近月下载 6,654 次
- 来源:npm api
- HN: Show HN: Excalibur 7 points, by Rafael_Casuso
- 页面访问核验:Show HN 帖子存在,发布于 2026-07-06
⚙️ 功能完整度 2.4/2.5
- 覆盖完整产品周期八阶段:Discover->Plan->Build->Test->Docs->Review->Ship->Audit,是市面唯一覆盖 Discovery(需求评估)和 Audit(审计)的 AI 编程 Agent
- 14 个内置工作流 + 14 个方法论,YAML 可定制,每个含质量门控;5 级自主度(L0-L4)逐任务调整
- 来源:Excalibur 文档
- Time-travel 事件日志(不可变追加式,可回放/分叉)、Adversarial Verification Mesh(对抗验证网格)、多 Agent Swarm 编排(隔离 worktree 并行)、本地 Web Dashboard
- 对比 Claude Code:Claude Code 仅覆盖编码+测试,无 Discovery 决策阶段、无 Time-travel 回放、无本地 Dashboard
- 对比 Cursor Agent:Cursor Agent 聚焦 IDE 内编码,无全周期流程、无对抗验证网格、无审计日志
- 对比 Devin:Devin 覆盖部分周期但闭源付费,Excalibur 开源免费且多了 Discovery+Audit 两端
✨ 输出质量 2.2/2.5
- Adversarial Verification Mesh 通过类型化 claims 门控(tests_passed/type_safe/no_secrets)确保发布质量,不是简单测试通过就放行
- Time-travel 事件日志保证 live= replay= dashboard= audit 四视图字节级一致,审计可追溯
- 支持 good+fast 模型对,复杂步骤用 frontier 模型(如 Claude Opus 4),简单步骤自动用 cheap 模型,平衡质量和成本
- 对比 Claude Code:Claude Code 输出质量依赖单模型,Excalibur 的模型对策略在成本控制下保持高质量
- 对比 Cursor Agent:Cursor Agent 无对抗验证网格,测试通过即放行,Excalibur 多一层类型化 claims 门控
🖐️ 易用性 1.3/1.5
- 一条 npm 命令安装:
npm install -g @excalibur-oss/excalibur,首次运行自动配置 - 交互式 m-shell + CLI 双界面,支持斜杠命令(/models 等)和脚本化 one-shot 模式
- IDE 扩展支持 VS Code/Cursor/Windsurf,MCP + LSP 集成,自定义 Agent personas
- 对比 Claude Code:Claude Code 安装同样简单但无 Web Dashboard,Excalibur 的 localhost:7878 看板体验更直观
- 对比 Devin:Devin 需注册账号且为 SaaS,Excalibur 完全本地运行无需账号,上手门槛更低
💰 性价比 1.5/1.5
- Core 版完全免费,Apache-2.0 开源,所有核心功能含 Time-travel/Discovery/Swarm/Dashboard 全部免费
- 支持自带 API Key(BYOK),Key 存在环境变量不进仓库;支持 Ollama 本地模型实现零 API 成本
- Enterprise 版按 seats+usage 定制 pricing,提供 SSO/RBAC/合规审计/SIEM 集成
- 对比 Devin:Devin 闭源付费($500/月起),Excalibur 开源免费且功能覆盖更广,性价比碾压
- 对比 Cursor Agent:Cursor Agent $20/月起,Excalibur Core 零成本(仅需自备 API Key)
🔒 稳定性 0.8/1.0
- 524 commits、39 tags、3 branches,v1.16.4 两天前发布,迭代活跃
- 来源:GitHub 仓库
- 处于 Public Beta 阶段,文档有公开 Roadmap 和 Changelog
- standard-safe 默认安全模式:不推送代码、沙箱执行、隔离分支、密钥保护
- 对比 Claude Code:Claude Code 已 GA 稳定运行,Excalibur 仍在 Beta,稳定性有差距
- 对比 Cursor Agent:Cursor Agent 商业产品有 SLA 保障,Excalibur 作为开源 Beta 项目无 SLA
🛡️ 隐私安全 0.4/1.0
- Core 版完全本地运行,代码不离开设备,API Key 存环境变量不进仓库
- standard-safe 默认安全:沙箱执行、隔离分支、密钥保护、审批门控、不自动推送
- Apache-2.0 开源可审计,代码完全公开
- 需自备 LLM API Key,代码内容会发送至第三方模型提供商(Anthropic/OpenAI 等),存在数据暴露风险
- 对比 Claude Code:Claude Code 同样需发送代码至 Anthropic API,隐私级别相当
- 对比 Cursor Agent:Cursor Agent 有隐私模式但默认可能上传,Excalibur 的 Ollama 本地模型选项可完全离线更安全
评分依据可追溯至公开来源,每项分数均有明确理由和数据支撑。
🏷️ 标签说明
- 免费增值: Core 免费 Apache-2.0 开源,Enterprise 按需付费。来源:定价页
- 编程: AI 编程 Agent,覆盖全产品周期。来源:官网首页
- 自动化: 全周期自动化(Discover->Audit),多 Agent Swarm 编排。来源:官网首页
- Agent: AI Agent 工具,5 级自主度。来源:文档
- 多 Agent: Swarm 编排,隔离 worktree 并行。来源:官网首页
- 海外: 国际开源项目。来源:GitHub
📋 来源与核验记录
- ✅ 已核验: Excalibur 官网首页 - 产品功能确认,含 Time-travel/Discovery/Swarm/Dashboard
- ✅ 已核验: Excalibur 定价页 - Core 免费 Apache-2.0,Enterprise 定制 pricing
- ✅ 已核验: GitHub ExcaliburOSS/excalibur-core - Stars 15, Forks 0, 524 commits, v1.16.4
- ✅ 已核验: Excalibur 文档页 - 14 工作流/14 方法论/L0-L4 自主度/MCP+LSP
- ✅ 已核验: HN Algolia 搜索 - Show HN 帖子 7 points, Rafael_Casuso
- ✅ curl 已验证: npm API - 近月下载 6,654 次
- ⚠️ 未验证(需安装实测): 全周期执行质量和耗时 - 需实际安装运行 L4 任务
- ⚠️ 未验证(需安装实测): Discovery 阶段评估质量 - 需实际运行 discover 命令
- ❌ 已删除死链: 无
同分类推荐
AI编程 分类下的其他工具