T3MP3ST
自主红队平台——多Agent进攻性安全元框架,将AI编码Agent变成零日漏洞猎手,XBEN基准90.1% pass@1
T3MP3ST 快速入门
T3MP3ST 是一个多 Agent 进攻性安全元框架,由安全研究员 elder-plinius(Pliny)创建。它的核心设计哲学是”不造轮子,而是驾驭已有的 AI 编码 Agent”——你已经在用的 Claude Code、Codex 或 Hermes Agent 就是它的”大脑”,T3MP3ST 提供武器化的编排层:侦察→漏洞利用→报告,全链路自动化。
T3MP3ST 2026 年 7 月 2 日开源(AGPL-3.0),仅 4 天就收获了 1,494 Stars 和 387 Forks。它内置 35 个安全工具,在 XBEN 基准测试(104 个挑战)上达到 90.1% pass@1 的通过率,并且所有声称的数据都可以通过 npm run verify-claims 从提交数据中重新计算验证——“不靠感觉,靠可复现的数据”。
功能特性
多 Agent 协同杀链
T3MP3ST 将进攻性安全测试结构化为”侦察→漏洞利用→报告”三步杀链。它不是单一 Agent 的自动化脚本,而是一个多 Agent 编排层——你可以启动多个 Agent 实例同时攻击不同目标或协同完成复杂攻击链。每个 Agent 有明确分工:侦察 Agent 收集信息、漏洞利用 Agent 尝试突破、报告 Agent 生成可操作的修复建议。
零密钥架构
这是 T3MP3ST 最颠覆性的设计:它不需要任何新的 API 密钥。你已经在本地运行的 AI 编码 Agent(Claude Code、Codex、Hermes)就是计算引擎。T3MP3ST 通过 Agent 的原生接口驱动它们完成安全测试任务。没有额外的账单,没有云依赖,没有第三方数据泄露风险。
可复现的基准测试
T3MP3ST 的 README 中有 24 项可验证声明,全部通过 npm run verify-claims 自动重新计算。在 XBEN(XBOW 的 104 挑战套件)上达到 90.1% pass@1,还完成了无提示 CTF 解题和对真实 CVE 的冷启动漏洞挖掘。所有数据从提交的测试结果中生成,不接受”信任我”式的数字。
Web 作战室 + CLI 双界面
T3MP3ST 提供 Web 界面的作战室(War Room),可视化监控所有 Agent 的攻击进度、发现的漏洞和实时状态。同时也支持纯 CLI 模式,方便集成到 CI/CD 流水线或自动化脚本中。
竞品对比
与 PentestGPT 对比:PentestGPT 是单 Agent 的 AI 渗透测试辅助工具,依赖 ChatGPT API 进行推理。T3MP3ST 是多 Agent 编排框架,不需要额外的 API 密钥,直接驾驭你已有的编码 Agent。PentestGPT 更适合单人辅助测试,T3MP3ST 更适合自动化批量红队。
与 AutoGPT Security 对比:AutoGPT 是通用 AI Agent 框架,可以通过 prompt 定制为安全测试工具。T3MP3ST 是专门为进攻性安全设计的元框架,内置 35 个安全工具和完整的杀链编排,而 AutoGPT 需要从零构建安全能力。
与 Metasploit 对比:Metasploit 是传统漏洞利用框架(无需 AI),T3MP3ST 利用 AI Agent 的推理能力进行智能化的漏洞发现和利用决策。两者不是替代关系——T3MP3ST 可以调用 Metasploit 模块作为其工具链的一部分。
适用场景
安全红队自动化:安全团队可以用 T3MP3ST 对内部系统进行持续的自动化红队测试,Agent 自主完成从信息收集到漏洞利用的全过程,大幅降低人工测试成本。
CTF 和安全研究:T3MP3ST 的 Agent 编排能力让安全研究人员可以快速验证攻击思路——给 Agent 一个目标描述,它会自动探索攻击面并尝试利用。
授权渗透测试:渗透测试公司可以将 T3MP3ST 集成到测试流程中,多个 Agent 并行测试不同目标,提高测试覆盖率和效率。
参考链接
📊 评分与标签
评分说明
总分 8.5/10 · P_优选
📊 可观测社区指标(数据核验日期:2026-07-07)
- GitHub: elder-plinius/T3MP3ST ★2,952, 🔱689
- 来源:GitHub API
- 项目背景: AGPL-3.0 开源,仓库创建于 2026-07-02,5 天即获 2.9K stars 和 689 forks,爆炸式增长
- 来源:GitHub API — pushed_at: 2026-07-06T16:35:07Z
🤖 Agent 能力 2.0/2.0
- 多 Agent 红队编排:侦察→漏洞利用→报告完整杀链,多个 Agent 实例可并行攻击不同目标或协同完成复杂攻击链
- XBEN 基准 90.1% pass@1(104 个挑战),24/24 可验证声明(
npm run verify-claims从提交数据中重新计算),内置 35 个安全工具 - 竞品对比 1(PentestGPT):PentestGPT 是单 Agent 的 AI 渗透测试辅助工具,依赖 ChatGPT API;T3MP3ST 是多 Agent 编排框架,不需要额外的 API 密钥
- 竞品对比 2(AutoGPT Security):AutoGPT 是通用 AI Agent 框架需从零构建安全能力;T3MP3ST 内置 35 个安全工具 + 完整杀链编排
🖐️ 易用性 1.0/1.5
- TypeScript 项目,npm 安装,CLI + Web 作战室双界面;零密钥设计降低接入门槛——不需要任何新 API 密钥
- 缺点:需要安全领域知识才能有效使用(理解侦察→漏洞利用→报告流程);仅 5 天历史,文档仍在完善中
- 竞品对比 1(PentestGPT):ChatGPT 自然语言界面,安全新手更易上手
- 竞品对比 2(Metasploit):成熟的 msfconsole GUI,20 年文档和社区积累,学习曲线更低
🔌 生态集成 1.5/2.0
- 兼容 Claude Code、Codex、Hermes Agent 三种主流编码 Agent,通过 Agent 原生接口驱动完成安全测试任务,可扩展元框架架构允许挂载自定义工具
- 竞品对比 1(Claude Code):Claude Code 通用编码无安全领域定制,T3MP3ST 提供专门的安全编排层
- 竞品对比 2(PentestGPT):仅支持 ChatGPT API 单一后端,T3MP3ST 跨多 Agent 生态更灵活
👥 社区支持 1.5/1.5
- 5 天 2,952 Stars,689 Forks,28 open issues(社区反馈活跃),增长曲线远超同期开源项目平均水平
- 来源:GitHub API
- ⚠️ 项目仅 5 天历史,社区能否持续活跃待观察
- 竞品对比 1(同阶段开源项目):Star 增长速度远超平均水平(5 天 2.9K vs. 同类首周通常 <500)
- 竞品对比 2(PentestGPT):更早发布(2023),已积累成熟社区和用户基础
💡 创新程度 1.5/1.5
- 零密钥架构:不依赖新 API,直接驾驭你已在本地运行的编码 Agent,业界首创;安全+多 Agent 交叉领域,独特定位
- 24/24 可验证声明:所有基准数据可通过
npm run verify-claims从提交数据中重新计算——可复现性在安全工具中罕见 - 竞品对比 1(所有现有安全 Agent):Metasploit/PentestGPT/Burp Suite AI 等均需独立 API 密钥或许可证
- 竞品对比 2(Metasploit):Metasploit 是传统漏洞利用框架(无 AI 推理),T3MP3ST 利用 AI Agent 的推理能力进行智能化漏洞发现和利用决策
🔒 稳定性 1.0/1.5
- 2026 年 7 月 2 日创建,仅 5 天,极早期项目;AGPL-3.0 协议(对商业使用有限制)
- 来源:GitHub
- TypeScript 类型安全,代码架构清晰;活跃维护:最后更新 2026-07-06;⚠️⚠️ 版本 0.x 阶段,API 可能 breaking change
- 竞品对比 1(PentestGPT):更成熟(发布更早),稳定性更好,MIT 协议商业友好
- 竞品对比 2(Metasploit):20 年历史,企业级稳定性,Rapid7 商业支持
评分依据可追溯至公开来源,每项分数均有明确理由和数据支撑。
🏷️ 标签说明
- 开源免费: AGPL-3.0 许可证开源,可自部署。来源:GitHub LICENSE
- 多Agent: 多 Agent 红队协作编排,侦察→漏洞利用→报告完整杀链。来源:GitHub Topics
- 安全: 进攻性安全测试元框架,专为红队和授权渗透测试设计。来源:GitHub Topics
- 自动化: 安全测试全链路自动化,从信息收集到漏洞利用自主完成。来源:GitHub README
📋 来源与核验记录
- ✅ GitHub REST API 已验证:stars=2952 / forks=689 / open_issues=28 / license=AGPL-3.0 / pushed=2026-07-06
- ✅ 浏览器已验证:GitHub README(XBEN 90.1% pass@1, 24/24 verify-claims, 35 tools)
- ✅ 第三方报道:CybersecurityNews 已独立报道
- ⚠️ 未验证(被拦截/需登录/无权限):无
- ❌ 已删除死链:无
同分类推荐
开源框架 分类下的其他 Agent