## 现象 - `grok-review.sh` 首轮只将最终评审输出写到 stdout;state 只保存会话元数据。 - 高 effort / agent-style review 可运行超过调用宿主约 600 秒的前台等待上限。 - 宿主超时转后台后,Grok 可继续成功完成,但上层调用已经失去 stdout,不能获得 verdict/findings;用户看到的是无产物或超时。 ## 已验证边界 - 不是登录、网络、CLI 参数不兼容或 Grok 自身取消;实际会话可在超时后完成。 - 非致命 pre-tool hook 错误可单独跟踪,不是本 Bug 根因。 ## 期望 - `pr-review` 明确支持超过 600 秒的 review,不能依赖单一前台 stdout 通道。 - 建议:脚本持久化完整 stdout/stderr 到安全权限的产物文件;状态记录产物路径/完成状态;skill 将长审查派发为 harness 跟踪的后台任务,完成通知后读取产物;失败、超时、取消和完成须有可区分状态;复核能重用原 session 而不覆盖首轮结果。 ## 验收标准 - 模拟或实际耗时超过前台上限的评审,调用方仍能在完成后获取完整 verdict/findings。 - 产物权限私有、清理生命周期明确,且不默认泄露工作区敏感文件。 - 成功、失败、取消、仍运行四态可机器判定。 - 不重跑同一首轮或覆盖已有 session 就能恢复评审正文。
现象
grok-review.sh首轮只将最终评审输出写到 stdout;state 只保存会话元数据。已验证边界
期望
pr-review明确支持超过 600 秒的 review,不能依赖单一前台 stdout 通道。验收标准