Imported from wubq511/english-reading-cognitive-modeling (
AGENTS.md). Install upstream withnpx skills add wubq511/english-reading-cognitive-modeling. Copyright stays with the author.
Project Agent Rules
Mission and phases
研究自然英语阅读 UI 过程证据能够支持哪些行为、过程、认知与技能推断。
- 当前阶段先实现并尽量优化不含 LLM、生成式 AI 或 Agent 的 runtime baseline,得到可复现的能力上限与失败边界。
- Baseline 对应 Module 的 Interface、数据、split、metric 和结果冻结后,再研究两类 AI 扩展:纵向提升既有环节,或横向增加 baseline 无法完成的新能力。
- AI/Agent 在当前 research/experiment plane 已经允许且重要,可辅助文献、编码、合成数据、实验编排、候选标注和 QA;其输出始终是待验证工件,不能自造真值。
当前阶段和完成度只以 reports/project_state/CURRENT_STATE.md 为准,不在本文件维护动态状态。
Start every task
- 在首个进度更新中告知用户正在执行项目预检;macOS/Linux 运行
scripts/bootstrap,Windows 运行.\scripts\bootstrap.cmd,并报告OK或精确未决项。若 skills 或 sources gate 未通过,停止依赖缺失能力/原件的工作。 - 依次阅读
CONTEXT.md、reports/project_state/CURRENT_STATE.md、reports/project_state/RESEARCH_QUESTIONS.md。 - 系统设计读
reports/synthesis/SYSTEM_DESIGN.md;来源/结论冲突读reports/provenance/SOURCE_POLICY.md。 - 涉及 AI、真人、实验或数据时,分别读取对应
reports/protocols/、experiments/README.md或data/README.md。
不要把 webchat_raw_materials/ 或 migration package 当作日常入口。只有 canonical 资产矛盾或需要审计谱系时,才按 SOURCE_POLICY.md 回查。
Evidence invariants
- 当前用户决定高于历史项目状态;科学事实以原文、正式标准、官方资料和可复现实验为权威。
- 区分
observed、derived、inferred、validated与simulation-only;模型拟合、预测增益和 synthetic recovery 都不自动构成构念效度。 - 保留 alternatives、uncertainty、negative/null result 与
UNKNOWN;禁止为了完整画像强制推断。 - 依赖全文的判断必须先通过
scripts/sources doctor,引用稳定 source ID 与页码/章节。 - 文档齐备与 source/rights-record closure 默认是门禁;只有用户明确点名具体任务与跳过项时,才按
docs/agents/research-workflow.md记为WAIVED_BY_OWNER并缩窄交付与主张范围。豁免不把缺失原件、来源或权利状态变成validated。 - Raw event append-only;派生资产必须可回到输入、代码、配置和版本。
Single-source knowledge maintenance
- 每个事实只指定一个 owner 文档;其他文件只给受众所需摘要并链接 owner,不复制整段规则、清单或当前状态。
- 修改观点、决策、ID、路径或阶段状态时:先更新 owner;全仓搜索旧表述;更新或改为指针;重要变更记录 supersession/ADR;最后运行
scripts/verify。 - 不静默覆盖旧实验或原始证据。保留可审计版本关系,但不要让已被取代的结论继续以“当前事实”出现。
- 主题 owner 与变更流程由
reports/provenance/SOURCE_POLICY.md唯一维护。
Sources and workspace
reports/:项目产出的 canonical 研究资产;sources/:外部论文、标准、题目和第三方数据;data/:项目生成/采集数据;artifacts/:可重建运行输出。- 所有人工下载论文统一放
tmp/pdfs/。Agent 核实身份、版本、权利和 SHA 后更新 catalog,再运行scripts/sources inbox;只有迁移后复验通过才删除 inbox 副本。 - 新增来源必须同步更新
sources/catalog.yaml、sources/checksums.sha256和必要 crosswalk/报告;不猜 DOI、许可或版本。 - 不移动或改名已有来源,除非同一变更更新 catalog、checksum、crosswalk、链接和验证。
webchat_raw_materials/本地冻结且不删除;它是追溯证据,不是研究资产。members/<member-id>/:成员个人空间(如briefings/展示材料);只呈现、不拥有事实,不是 canonical 研究资产,不作为结论引用源。
Member activity logs
- 任何日志目录之外的改动在 commit 前必须同时新增
logs/members/<member-id>/条目;Agent 负责创建、填写、验证并 stage,不把流程转给用户记忆。 - 日志只记录工作结果、研究/决策影响、验证和遗留项;Git 已记录精确 diff,不复制 diff,不写 Agent 思维过程或敏感数据。
- 已提交日志 append-only;更正时新建
supersedes条目,不修改、删除或改名旧记录。 - 首次 commit 前配置
scripts/logs init <member-id>;生成命令、schema、category 和门禁唯一说明见logs/README.md。
Member-facing language
- 首要读者是研究成员的内容——聊天汇报、
reports/research/human-tasks/、成员日志——用中文写。 reports/研究资产用中文论述(分析、论断、局限、决策含义);英文只保留在不可翻的部分:文献标题、引文原文、检索式、source ID 与术语锚点。每个研究资产开头仍有中文「结论速览」段(核心结论、怎么得出的、未决项)。- 状态/判定枚举值(如
OPEN、CURRENT、PROVEN、Resolved)无论反引号还是粗体排版都保持英文,保证跨文件检索一致。 - Agent 操作手册类文档(
.agents/skills/、docs/agents/)维持现用语言,不受此约束。
AI, human data, and publication
- Baseline runtime 不调用 AI/Agent;研究外环遵守
AI_RESEARCH_TOOLING_POLICY.md。 - 团队外真人活动先按
HUMAN_RESEARCH_GATES.md分类;NONRESEARCH_DEBUG_ONLY永不转研究数据。 - 真人原始/假名化数据、录屏、音视频、gaze、身份映射、同意材料、密钥和 token 不进公开 Git、日志或未经批准的外部 AI。
- Git 默认只发布外部来源的 metadata/checksum,不发布第三方原件。创建公开仓库、push、Release 或分发第三方文件都需最终审计后再次获得用户明确批准。
Implementation and experiment skeleton
- 本轮实现前代码边界见
src/README.md;不要在 benchmark 前把候选算法写成既定架构或创建假想 Adapter。 - 实验规范、状态和 run manifest 见
experiments/README.md;大体积输出写artifacts/runs/,审查后的结论才进入reports/。 - 代码变更增加对应测试;不得靠注释报错、跳过 gate 或修改指标定义来制造通过。
Project workflow skills
- Wayfinder → Spec → Tickets → Implement 的状态机只由
docs/agents/research-workflow.md定义;GitHub 操作只由docs/agents/issue-tracker.md定义。 - 五个对外入口
ercm-workflow、ercm-wayfinder、ercm-to-spec、ercm-to-tickets、ercm-implement都必须由用户显式调用;Codex 使用$skill-name,Claude Code 使用/skill-name。所有项目适配技能统一使用ercm-前缀,避免与全局上游技能混淆。 - ERCM Wayfinder 和 Implement 都不得自动领取 frontier ticket;用户未点名时,Agent 必须只读展示候选、给出有理由的推荐与取舍,再等待用户用
/ercm-wayfinder <decision-child>/$ercm-wayfinder <decision-child>或/ercm-implement <execution-ticket>/$ercm-implement <execution-ticket>明确选择;推荐不得触发分配、改标签或执行。 .agents/skills/是唯一物理技能源;.claude/skills/<name>只能是 bootstrap 管理并指向它的映射,不得复制技能正文。- GitHub Issue 是协作入口;科学实验 spec、run 和 reviewed claim 仍分别由
EXP-*、run manifest 和 canonical report 所有,禁止把 Issue 变成竞争真相源。
Completion contract
- 文档/来源/知识变更:运行
scripts/verify。 - 来源变更:另运行
scripts/sources inbox、scripts/sources doctor和 catalog/checksum 检查。 - 用户明确声明某次提交不需要本地 source/raw 文件时,可仅对该次 push 使用
ERCM_VERIFY_MODE=public;仍须运行scripts/verify --public,并记录WAIVED_BY_OWNER的范围与后果。不得用该选项跳过 catalog/checksum、skill、日志或公开快照完整性检查。 - 代码变更:运行相关测试与 lint;实验变更验证 manifest、split、metric 与 source lock。
- Skill/Agent 工作流变更:运行
scripts/skills doctor(Windows 用.\scripts\skills.cmd doctor)和对应 eval,再运行scripts/verify。 - 提交前:确保本次成员日志与改动同时 staged;
pre-commit和远端verify会 fail closed。 - 失败、未运行或缺证据的项目保持
pending/open,不得报告完成。 AGENTS.md是唯一规则正文;根级CLAUDE.md必须保持为只含@AGENTS.md的跨平台导入 shim,禁止复制成第二份规则。