本实验即综合实践项目(capstone) M7,全学期收口。在「已加固 + 自带 AI 能力 + 已可观测」的集成系统上跑一次红蓝演练 → 取证复盘 + 能力框架自评矩阵。本里程碑「自评」权重上调到 0.20(回看整学期 M0-M6),并设现场演示。
完成本实验后,在
docs/m7/report.md自评:点亮全簇 · L3。M7 评审会回看 M0-M6——自评矩阵每项都要能指回仓库证据。
milestone/m6 分支 tip(M6
末系统:已加固 + AI 能力 + 加固证据 + 集中日志)。milestone/m6 切
milestone/m7,MR 目标 =
milestone/m6。设计演练场景(攻击面 = 自己的系统)、目标 / 规则 / 停战条件、评分维度;明确仅授权环境。
复用 M3 / M6 的概念验证(PoC)编排一条多阶段攻击链(侦察 → 渗透 → AI 对抗 / 提示词注入 → 横向),记录每步。
检测 / 取证 / 欺骗闭环(复用 M4 / M5):哪些被拦、哪些漏检、纵深防御各层命中率;度量防御纵深度。
对照 capability-framework.md
的 6 簇 × 3 级,逐项回看 M0-M6 证据,标注是否点亮 + 证据路径 +
本里程碑练了哪个思维范式。覆盖 ≥3
个簇,无虚点亮。
评估 AI 在本次演练中的综合表现:赋能侧(检测 / 分诊)+ 对抗侧(AI 被攻破的路径)+ 局限(什么场景 AI 失效 / 误报)。
现场跑一次红蓝对抗演示(或提交录屏 / 动态证据包——动态证据静态无法核验,不交录屏则判为降级观察(observation))。
在 docs/m7/ 下提交(在 milestone/m7
分支上完成、push、开 MR @ 助教,目标 = milestone/m6):
docs/m7/
├── redblue-record.md # 任务 A/B/C:场景 + 红队攻击链 + 蓝队复盘 + 纵深度量
├── forensics-report.md # 取证报告(时间线 + IoC)
├── self-matrix.md # 任务 D:能力自评矩阵(6 簇 × 3 级 → 证据 + 范式)
└── report.md # AI 综合评估(含局限)+ 演示录屏引用 + 自评
评分量规(绑定全簇 · L3,满分 100;详细维度释义见 评价指南):
| 维度 | 权重 | 优秀 [90,100] | 合格 [60,90) | 不合格 [0,60) |
|---|---|---|---|---|
| 完成度 | 0.20 | 红蓝演练 + 取证报告 + 自评矩阵齐备 + 分支 milestone/m7 + MR + 现场演示 | 主要项完成 | 关键项缺失 |
| 深度 | 0.25 | 红蓝含编排多阶段利用链 + 纵深防御度量;复盘有权衡取舍 | 能跑通演练 | 仅贴记录无复盘 |
| AI 双向 | 0.20 | 红蓝中综合运用攻防 + AI,并评估 AI 局限(簇⑥·L3) | 仅提及 AI | 无 AI 综合评估 |
| 安全严谨 | 0.15 | 全链路审计、人在回路、最小权限贯穿全簇验证 | 基本防护验证 | 高危裸奔未修复 |
| 自评 | 0.20 | 自评矩阵与作品一致(逐簇 × 级回看 M0-M6 证据,无虚点亮) | 有自评 | 无自评 |
M7 是全簇 L3 收口,评审会校验全部 8 个里程碑分支齐备(
m7_branch_chain)。学期全部评审完成后,由助教统一把milestone/m7合回main。
| 簇 × 级 | 能力描述 | 是否点亮 | 证据 |
|---|---|---|---|
| ①·L3 / ②·L3 / ③·L3 / ④·L3 / ⑤·L3 / ⑥·L3 | 综合工程化:在集成系统上编排红蓝、纵深防御、检测-取证-欺骗闭环、AI 综合评估 | ☐(逐簇回看 M0-M6) | M7 自评矩阵(每项挂 M0-M6 证据路径) |
本实验是整学期综合实践项目的收口——自评矩阵即你的「能力成绩单」。完成后
milestone/m7就是你的最终作品分支。