让 coding agent 对话中的逐段反馈更容易表达、检查和回看。
TurnAnnotation 的目标是在原生 agent 客户端中批注回复,将本次批注与输入框中的其他文字组装为一条普通 user message,继续当前会话。批注界面和历史记录保留在用户侧;它们不会作为额外规则或记忆反复注入模型。
状态:项目定义与技术调研阶段。尚无可安装插件,尚未执行模型实验,尚未证明质量提升或 token 节省。
- 阅读 agent 回复,选中一句或一段,在旁边写批注。
- 继续添加、编辑、删除批注;这些操作不发起模型请求。
- 在正常输入框中补充其他问题,不要求与批注相关。
- 查看本次将发送的批注和完整消息预览。
- 一次提交,作为当前会话的普通用户输入。
- 以后可以回看各轮批注、对应原文和当时实际发送的文本。
| 部分 | 职责 |
|---|---|
| 批注界面 | 原生显示、选区、高亮、批注草稿、普通输入合并与发送预览 |
| 批注记录 | 本地保存原文快照、批注及发送关联,供用户回看 |
| 反馈组装 | 确定性地生成简洁、完整、可理解的普通用户消息 |
反馈组装是研究重点。 第一版不通过额外模型调用改写批注,不代理模型网络请求,不依赖截图、OCR、坐标或界面抓取。
已确认首个接入路线为 Claude Code Mods;选区与输入框组合体验通过实测后再承诺支持。Codex 作为后续适配目标。已有近似实现包括 Plannotator 和 Herdr Annotate,详见调研文档;本项目不声称首创该交互。
比较普通编号反馈、认真组织的短引用反馈、TurnAnnotation 组装反馈;固定修改意图和任务起点。分别测量请求覆盖率、实际落实率、产物正确性、回归错误、完整任务 token 和延迟。没有足够精度的置信区间时,结论必须是证据不足。
已确认复用 Promptfoo 的运行和断言能力,自建少量适配、任务评分和配对非劣效统计;实际适配仍需原生行为一致性验证。
MIT License。提交通用文档、代码和人工构造的测评案例;本地真实会话、批注档案、凭据及原始运行日志默认不提交。