Skip to content

About

让 Codex 审计 Codex:升级协作方式,检查配置冲突,恢复项目进度和下一步行动顺序。

Resources

Stars

0 stars

Watchers

0 watching

Forks

Latest commit

 

History

15 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 
 
 

Repository files navigation

Codex Checkup

让 Codex 审计 Codex:帮助你升级与 Codex 的协作方式,找出互相打架的规则和做到一半被遗忘的项目,再把下一步执行到验证通过。

Version Python Local First Tests

codex-checkup 是一个本地优先、默认只读的个人 Codex 工作台审计 Skill。

它不再停在报告交付:用户批准后,可以从上次体检继续整改、记录进度,并按相同范围复测问题是否真正消失。

它把指定范围内的历史协作、Codex 配置、AGENTS.md、Skills、MCP 和项目现场串成证据链,优先回答真正影响工作的题目:

  1. 我和 Codex 哪些流程反复绕路,为什么总在同一个地方返工?
  2. 哪些重复人工工作值得做成 Skill,哪些只该写进 AGENTS.md 或自动检查?
  3. 我的配置、规则和 Skills 哪里冲突或失效?
  4. 哪些项目需要继续、验证、解除阻塞或决定放弃?
  5. 下一步应该先做什么,具体改成什么流程?

它解决什么 · 你会得到什么 · 怎样工作 · 快速开始 · 当前进度

它解决什么

很多 Codex 问题并不是模型不够强,而是工作方式失去反馈:同一种错误反复纠正、规则散落在不同文件、Skill 装了却没有触发、项目写到一半没有验证,最后谁也说不清下一步从哪里继续。

你遇到的情况 体检后应该得到什么
经常需要说“继续”“不是这样”“只改这里” 协作弯路、主要归因和新的协作协议
Codex 写完代码,却没有测试、构建或交付 缺失的完成闭环和可执行验证动作
Skills 装了很多,不知道哪些真正发挥作用 确认使用、可能漏用、范围内未观察和无法判断
用户级与项目级 AGENTS.md 越写越乱 指令关系、重复、作用域错位和明确冲突
多个项目同时推进,忘了各自做到哪里 项目恢复地图、未完成事项和阻塞点
每个项目都能继续,但不知道先做哪个 有理由、有依赖、有完成条件的行动顺序

“没有发现 Skill 被使用”不会被写成“这个 Skill 没用”。正确的结论应该是:

过去 90 天的 120 次任务中,没有发现该 Skill 被触发的记录;其中 8 次任务可能符合它的触发范围,需要进一步检查描述或调用流程。

一次体检会得到什么

1. 协作诊断

比较顺利完成与发生摩擦的对话,找出值得保留的成功模式,以及返工、范围扩大、过早停止、缺少验证、降级交付和任务切换等弯路。

问题 历史证据 影响 优化动作
反复补充验收标准 多个相关任务 增加返工轮次 开始前定义可验证完成条件
完成后没有验证 工具与交付记录 结果不稳定 固定增加完成前验证
适用 Skill 可能漏触发 任务与 Skill 描述 重复手工处理 调整触发描述并做真实任务测试

主报告会把重复工作分成五类:适合新建 Skill、适合优化现有 Skill、应写入 AGENTS.md、应交给测试/脚本、证据不足先观察。不会为了显得有价值而硬造 Skill。

2. 配置诊断

检查配置、AGENTS.md、Skills 与 MCP 的作用关系,区分明确冲突、重复、作用域错位、潜在张力和疑似过期。

用户级 AGENTS.md
├── 全局交流与工作原则
├── 与项目规则重复
└── 与项目规则存在潜在张力

项目级 AGENTS.md
├── 构建与测试命令
├── 完成和验收标准
└── 已经失效的目录说明

已安装 Skills
├── 确认使用
├── 可能漏用
├── 范围内未观察
└── 触发描述重叠

3. 项目恢复地图

从历史会话中的工作目录、Codex 最近项目记录和用户指定目录发现项目,再结合 Git、文件、计划、测试和交付证据恢复状态。

项目 当前状态 已完成 未完成 阻塞 建议下一步
项目 A 部分完成/待验证 核心功能 测试和发布 无 先补测试,再发布
项目 B 被阻塞 原型 数据导入 API 权限 先解除权限阻塞
项目 C 已完成 目标交付并验证 无 无 归档,不再占用注意力

表格内容是输出结构示意,不代表当前仓库扫描结果。项目状态必须有证据,不能因为 Codex 在聊天中说“完成”就直接判定已完成。

4. 建议行动顺序

Skill 不使用无法解释的综合分数。任务依次考虑:

  1. 用户当前明确目标和截止时间
  2. 正在阻塞其他工作的任务
  3. 补少量工作即可形成交付的任务
  4. 已有投入但疑似遗忘的项目
  5. 持续制造返工的配置和协作流程
  6. 尚未开始的新项目和新功能

最终输出的是建议顺序,不替用户决定项目价值或是否继续。

一个入口,三个引擎

用户只需要安装和触发一个 Skill。三个引擎共享审计范围、隐私规则、证据等级、项目状态机和行动排序器。

flowchart LR
    A["本地会话与工具记录"] --> C["交互协作引擎"]
    B["配置、AGENTS.md、Skills、MCP"] --> W["Codex 工作台引擎"]
    P["项目目录、Git、计划与验证"] --> R["项目恢复引擎"]
    C --> E["统一证据链"]
    W --> E
    R --> E
    E --> O1["协作流程与 Skill 机会"]
    E --> O2["配置诊断"]
    E --> O3["项目恢复地图"]
    E --> O4["建议行动顺序"]
Loading

交互协作引擎

  • 比较顺利完成样本与摩擦样本
  • 识别返工、范围控制、自治程度、证据纪律和验证闭环
  • 区分用户输入、Codex 执行、共同流程和环境工具问题
  • 关联适用 Skill 与可观察调用证据

Codex 工作台引擎

  • 审核用户级、项目级和嵌套 AGENTS.md
  • 检查 config.toml、权限、沙箱、网络与 MCP
  • 检查 Skill 完整性、触发清晰度、重复与语义重叠
  • 比较规则要求与 Codex 实际行为

项目恢复引擎

  • 发现审计范围内可识别的项目
  • 恢复目标、最近活动、Git 和工作区状态
  • 区分尚未开始、进行中、待验证、被阻塞、疑似遗忘、已完成、已归档和状态不明
  • 提取未完成事项、阻塞、依赖和下一步

完整产品契约见 audit-contract.md。

不靠感觉下结论

证据等级与置信度分开记录:

等级 含义 典型来源
A 已验证 当前审计直接确认 配置、文件、Git、测试、构建、交付结果
B 已佐证 至少两个独立来源一致 聊天承诺与仓库产物相符
C 单源观察 尚未交叉验证 单条聊天或一个间接信号
D 范围内未观察 在明确范围内没有发现 指定天数、任务数和解析覆盖率
U 无法判断 来源缺失、冲突或无法解析 未知格式、目录不可访问、证据矛盾

这意味着:

  • 不根据 Skill 数量直接判断上下文浪费
  • 不根据一次纠正建立全局规则
  • 不根据聊天长度判断项目失败
  • 不根据插件目录存在就认定插件已启用
  • 不根据助手自称完成就认定项目已完成

建议来自一张可追溯的实践网络

体检不会只说“建议你写清楚一点”。它把本地症状路由到具体实践节点,例如:

反复说继续
  -> PRA001 强目标契约
  -> PRA003 结果反馈环
  -> 放在当前 prompt 或 /goal
  -> 用完成证据和阻塞条件复测

知识网络同时保存官方文档、OpenAI 官方 X 动态、具名开发者实践和社区反例。官方规范与社区技巧分层记录;高点赞不会自动升级成最佳实践。完整网络见 codex-practice-network.md。

快速开始

安装到 Codex

克隆仓库后,将标准 Skill 子目录复制到用户级 Skill 目录。

PowerShell:

git clone https://github.com/fanshouheng/codex-checkup.git .\spcodex
Copy-Item -Recurse .\spcodex\codex-checkup "$HOME\.codex\skills\codex-checkup"

macOS / Linux:

git clone https://github.com/fanshouheng/codex-checkup.git ./spcodex
cp -R ./spcodex/codex-checkup "$HOME/.codex/skills/codex-checkup"

要求 Python 3.11 或更高版本,不依赖第三方 Python 包。

从 codex-health-check 旧版升级时,确认新 Skill 可用后移除旧目录;不要同时安装两个名称,否则可能出现重复触发。

第一次体检

安装后直接对 Codex 说:

请使用 $codex-checkup 对我最近 30 天的 Codex 使用做一次只读全景体检。
输出协作诊断、配置诊断、项目恢复地图和建议行动顺序。

也可以只检查一个方向:

只检查我和 Codex 的协作问题,比较顺利完成和发生返工的对话。
只检查 Codex 配置、用户和项目 AGENTS.md、Skills 与 MCP。
只恢复最近项目的进度,告诉我哪些待验证、被阻塞或疑似遗忘。

命令行扫描

基础扫描:

python .\codex-checkup\scripts\run_audit.py --project . --days 30

只运行部分确定性模块:

python .\codex-checkup\scripts\run_audit.py `
  --modules config,skills,sessions,portfolio,project `
  --output .\codex-health-report

生成顺利样本与摩擦样本组成的私有协作证据包:

python .\codex-checkup\scripts\prepare_collaboration_evidence.py `
  --days 30 `
  --max-samples 12 `
  --max-task-samples 100

基础脚本生成:

  • report.md:便于阅读的确定性检查结果
  • report.json:便于继续分析的结构化数据
  • .codex-health-private/collaboration-evidence.json:私有、脱敏的短上下文与任务开场清单
  • health-check.md:先讲协作弯路、重复成本、Skill 机会和具体改法的人话主报告
  • health-check-evidence.md:覆盖范围、证据等级、完整项目表和规则台账

私有证据包不应提交或分享。主报告不再以审计覆盖和内部字段开头。

继续优化

体检完成后可以直接说:

$codex-checkup 按 health-check.md 的顺序开始优化,先处理第 1 项。

也可以跨任务继续:

$codex-checkup 继续上次整改,并在本批完成后按原范围复测。

Skill 会保持原报告不变,把进度写入 .codex-health-private/remediation-state.json。可逆的限定范围修改按用户选择执行;删除、全局配置、凭据/权限、Git 写操作、推送和项目关闭仍需单独确认。

当前实现进度

0.10.0 将输出拆为人话主报告和技术证据附录,并为正常与摩擦会话增加脱敏任务清单,用于识别反复流程和可靠的 Skill 候选。三个体检引擎与整改动作的自动化程度仍不同。

能力 当前状态 已实现 仍在建设
交互协作 可用 正常/摩擦样本、最多 100 个任务开场、重复流程诊断、Skill 候选分流 更强的跨语言任务聚类
Codex 工作台 基础可用 配置、Skill/MCP 风险、用户/项目/嵌套 AGENTS.md 清单与质量信号 AGENTS.md 语义冲突和实际遵守关系图
项目恢复 风险雷达可用 Git 根归一化、最近活动、分支/工作区、计划文件、TODO 和保守状态 聊天承诺与产物对照、测试结果和完整依赖排序
人话报告 可用 协作弯路、重复成本、可复制流程、Skill 机会与独立证据附录 更多真实用户报告复测
整改闭环 可用 报告后入口、按行动恢复、私有进度状态、动作验证与同口径复测 更多配置类动作的确定性执行器
实践知识网络 可用 20 个实践节点、官方/X 来源分层、症状路由和反例 定期刷新与更多真实用户复测

当前版本通过 28 项回归测试、Skill 格式校验、对抗夹具和真实本地会话前向测试。测试通过不代表所有结论都可靠;完整覆盖状态和无法判断项仍会保存在证据附录。

项目结构

codex-checkup/
├── SKILL.md                         # 一个安装和触发入口
├── agents/openai.yaml               # Codex UI 元数据
├── scripts/
│   ├── run_audit.py                 # 确定性基础扫描
│   ├── prepare_collaboration_evidence.py
│   ├── validate_human_report.py     # 阻止技术字段回流主报告
│   └── codex_health/                # 配置、Skills、会话、项目等模块
└── references/
    ├── audit-contract.md             # 三引擎与统一证据契约
    ├── human-report.md               # 人话主报告与技术附录分层
    ├── remediation.md                # 整改状态、授权和同口径复测
    ├── codex-practice-network.md     # 官方与 X 实践知识网络
    ├── collaboration-rubric.md       # 协作语义诊断
    ├── checks.md                     # 稳定检查规则
    ├── privacy.md                    # 隐私边界
    └── reporting.md                  # 报告解释方式

隐私与安全边界

  • 默认只读,不自动修改配置、聊天、Skills、插件缓存或项目文件
  • 不上传聊天内容,不执行远程分析服务
  • 公开报告不包含密钥、完整私人路径或长聊天原文
  • 深度协作诊断读取少量脱敏片段和有限任务开场清单,并明确告知用户
  • 只有用户明确选择后才进入整改;删除 Skill、全局配置、Git 写操作和归档项目等高影响动作需要单独确认
  • 不扫描整块磁盘,只检查用户指定范围和可识别项目来源

为什么不提供总分

一个 87/100 的健康分无法解释真正的问题。配置风险、协作返工、Skill 漏用和项目阻塞来自不同证据,压成单一分数只会制造虚假的精确感。

本 Skill 只给出:发生了什么、证据有多强、造成什么影响、应该先做什么,以及怎样验证改进是否有效。

About

让 Codex 审计 Codex:升级协作方式,检查配置冲突,恢复项目进度和下一步行动顺序。

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages