Imported from xhuandy666/VoxCanvas (
AGENTS.md). Install upstream withnpx skills add xhuandy666/VoxCanvas. Copyright stays with the author.
AGENTS.md
项目定位
本项目是企业实训营选题二的参赛作品:AI 语音绘图工具。
核心目标是做出一个稳定、可演示、可解释、可持续提交的纯语音绘图应用。正式 Demo 中,用户应通过语音完成绘图创作,不依赖鼠标或键盘操作画布。
技术路线约束
- MVP 主链路使用浏览器语音识别。
- 必须通过
SpeechProvider抽象隔离语音识别来源。 - 初期只实现
BrowserSpeechProvider。 LocalSpeechProvider只预留接口和文档说明,作为未来计划,不在 MVP 阶段强行实现。- 简单指令优先走本地规则解析,降低延迟。
- 复杂指令可进入 AI 指令规划层,拆解为多个绘图操作。
- API key、模型配置、隐私数据不得提交到仓库。
开发纪律
每次正式开发前先阅读:
docs/project-development-document.mddocs/development-discipline.mddocs/iteration-plan.md
每个 PR 只做一件事,必须包含:
- 功能描述
- 实现思路
- 测试方式
- 影响范围
- 是否更新 README 或设计文档
严禁临尾一次性导入大批代码。所有 commit 时间戳必须落在本次实训营允许的开发周期内。
质量底线
- 主分支任意时刻应保持可运行。
- 新增核心逻辑必须配套测试或明确的手动验证记录。
- 引用第三方库、框架、模型、过去代码片段时,必须在 README 和 PR 描述中说明。
- 不提交
.env、录音样本中的个人隐私、浏览器本地缓存、构建产物和大模型权重文件。
