{"sample_id":"train-replay-001-oracle","dialogue_id":"train-replay-001","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 嘉乐：用户回来后现在只能看到文字日报，感受不到离开期间发生了什么。\n[T2] 同伴：可以把动作重新播放，但完整回放可能太长。\n[T3] 嘉乐：只回放有意义的动作节点，空闲时间直接跳过。\n[T4] 同伴：随机动作和真实社交行为怎么区分？\n[T5] 嘉乐：第一版只覆盖已落库的用户互动和 Agent 社交事件，随机待机先不做。\n[T6] 同伴：这个边界可以，先做事件回放、跳过空闲段。\n[T7] 嘉乐：好，我们继续讨论 heartbeat 怎样错开。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[{\"candidate_turn\":6,\"earliest_safe_turn\":6,\"latest_useful_turn\":6,\"task\":\"实现第一版离线事件回放\",\"evidence_turns\":[3,5,6],\"final_status\":\"stable\",\"later_changed\":false,\"actual_rework\":\"none\",\"parallel_execution_was_useful\":true,\"rationale\":\"后续转向 heartbeat 议题，回放范围保持稳定。\"}]}"}]}
{"sample_id":"train-export-002-oracle","dialogue_id":"train-export-002","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 产品：搜索结果页最好能让运营导出数据。\n[T2] 开发：导全部结果还是只导当前页？格式也要定。\n[T3] 产品：第一版导出当前筛选条件下的全部结果，用 CSV。\n[T4] 开发：字段按当前表格列顺序，最多一万条，超过就提示缩小范围，可以吗？\n[T5] 产品：可以，按钮放在筛选栏右侧就行。\n[T6] 开发：那分页样式我们再单独看。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[{\"candidate_turn\":5,\"earliest_safe_turn\":5,\"latest_useful_turn\":5,\"task\":\"实现搜索结果 CSV 导出\",\"evidence_turns\":[3,4,5],\"final_status\":\"stable\",\"later_changed\":false,\"actual_rework\":\"none\",\"parallel_execution_was_useful\":true,\"rationale\":\"后续没有修改导出规格。\"}]}"}]}
{"sample_id":"train-theme-003-oracle","dialogue_id":"train-theme-003","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 设计：我觉得下一版应该上深色模式。\n[T2] 产品：先别动，我们还没确定是跟随系统还是提供手动切换。\n[T3] 设计：那我更倾向于跟随系统。\n[T4] 产品：也不一定，企业客户可能需要固定主题，我去问一下。\n[T5] 设计：好，等客户反馈再定。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[]}"}]}
{"sample_id":"train-research-004-oracle","dialogue_id":"train-research-004","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 甲：我们要不要先看看三个竞品的协作空间怎么做？\n[T2] 乙：赞成，重点比较邀请流程、权限和消息提醒。\n[T3] 甲：我今晚整理成一页文档，明早发群里。\n[T4] 乙：可以，截图也带上。\n[T5] 甲：然后我们再决定做哪套。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[]}"}]}
{"sample_id":"train-notification-005-oracle","dialogue_id":"train-notification-005","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 产品：用户说群聊通知太多，想做免打扰。\n[T2] 开发：是全局免打扰还是每个房间单独设置？\n[T3] 产品：先做房间级开关，默认关闭免打扰。\n[T4] 开发：开启后保留被 @ 的通知，普通消息不推送。\n[T5] 产品：对，入口放房间设置里。\n[T6] 开发：后面可能再补定时免打扰。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[{\"candidate_turn\":5,\"earliest_safe_turn\":5,\"latest_useful_turn\":5,\"task\":\"实现房间级免打扰\",\"evidence_turns\":[3,4,5],\"final_status\":\"minor_change\",\"later_changed\":true,\"actual_rework\":\"low\",\"parallel_execution_was_useful\":true,\"rationale\":\"后来增加定时选项，但不推翻第一版开关和通知规则。\"}]}"}]}
{"sample_id":"train-auth-006-oracle","dialogue_id":"train-auth-006","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 产品：海外版需要第三方登录。\n[T2] 开发：Google 和 Apple 都做，还是只先做一个？\n[T3] 产品：我倾向 Google，但 iOS 审核可能要求 Apple。\n[T4] 开发：回调域名和开发者账号也还没准备好。\n[T5] 产品：那先别接，等账号和合规一起确认。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[]}"}]}
{"sample_id":"train-empty-007-oracle","dialogue_id":"train-empty-007","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 设计：项目列表为空时现在是一片白，用户不知道下一步做什么。\n[T2] 产品：加一个空状态，引导用户创建第一个项目。\n[T3] 设计：我画一个插图，再放标题、说明和创建按钮。\n[T4] 产品：第一版先不用插图，直接用现有图标，文案写“还没有项目”，按钮沿用创建项目。\n[T5] 设计：可以，先按这个轻量版本做。\n[T6] 产品：插图以后统一做品牌升级时再补。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[{\"candidate_turn\":5,\"earliest_safe_turn\":5,\"latest_useful_turn\":5,\"task\":\"实现项目列表轻量空状态\",\"evidence_turns\":[2,4,5],\"final_status\":\"stable\",\"later_changed\":false,\"actual_rework\":\"none\",\"parallel_execution_was_useful\":true,\"rationale\":\"轻量版本在对话结束时保持稳定。\"}]}"}]}
{"sample_id":"train-migration-008-oracle","dialogue_id":"train-migration-008","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 开发甲：旧的 event_type 字段很乱，我想直接重命名并删除旧枚举。\n[T2] 开发乙：线上还有旧客户端在写，直接删会不会把数据弄坏？\n[T3] 开发甲：可以先写迁移脚本一次性改历史数据。\n[T4] 开发乙：但灰度期间新旧版本会并存，需要双写还是兼容读取还没定。\n[T5] 开发甲：确实，先做方案评审，不改线上结构。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[]}"}]}
{"sample_id":"train-mobile-nav-009-oracle","dialogue_id":"train-mobile-nav-009","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 设计：移动端顶部导航挤不下，想改成底部栏。\n[T2] 开发：底部放哪些入口？桌面端要不要一起改？\n[T3] 设计：只改小于 768px 的布局，放首页、空间、消息、我的四项。\n[T4] 开发：现有路由和图标都能复用，二级页面仍保留返回按钮。\n[T5] 设计：对，先这样，选中态用现有主色。\n[T6] 开发：平板断点之后再根据数据调整。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[{\"candidate_turn\":5,\"earliest_safe_turn\":5,\"latest_useful_turn\":5,\"task\":\"实现移动端底部导航\",\"evidence_turns\":[3,4,5],\"final_status\":\"stable\",\"later_changed\":false,\"actual_rework\":\"none\",\"parallel_execution_was_useful\":true,\"rationale\":\"当前版本范围完整且稳定。\"}]}"}]}
{"sample_id":"train-conditional-010-oracle","dialogue_id":"train-conditional-010","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 销售：如果客户下周还坚持，我们可能得做 SAML 登录。\n[T2] 产品：先看看合同规模，太小就不做定制。\n[T3] 销售：我周五前确认预算和 IdP 类型。\n[T4] 产品：拿到信息后再排期，现在不要动开发。\n[T5] 销售：明白。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[]}"}]}
{"sample_id":"train-parser-tests-011-oracle","dialogue_id":"train-parser-tests-011","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 开发甲：turn 文本解析最近又被全角冒号搞坏了。\n[T2] 开发乙：先补回归测试，覆盖全角冒号、可选 T 编号和没有 speaker 的行。\n[T3] 开发甲：没有 speaker 的行按 P1、P2 轮换，跟现有行为一致。\n[T4] 开发乙：同意，只加测试，不改解析规则。\n[T5] 开发甲：那异常日志格式我们后面再看。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[{\"candidate_turn\":4,\"earliest_safe_turn\":4,\"latest_useful_turn\":4,\"task\":\"补充 turn 文本解析回归测试\",\"evidence_turns\":[2,3,4],\"final_status\":\"stable\",\"later_changed\":false,\"actual_rework\":\"none\",\"parallel_execution_was_useful\":true,\"rationale\":\"测试任务与后续日志议题完全解耦。\"}]}"}]}
{"sample_id":"train-payment-012-oracle","dialogue_id":"train-payment-012","split":"train","messages":[{"role":"system","content":"你是 LobbyAgent 的离线全景标注器。你会看到一段已经结束的多人协作式 vibe-coding 讨论。你的任务不是 code review、主持会议或总结全部内容，而是识别讨论中适合让 Coding Agent 在后台并行开始的局部功能任务。\n\n你可以利用未来 turn 判断候选任务后来是否稳定、是否被推翻以及可能返工，但必须区分：\n- causal readiness：在当时已经出现的证据是否足以支持介入；\n- hindsight outcome：后来事实如何发展。\n\n严格输出 JSON：{\"episodes\":[{\"candidate_turn\":1,\"earliest_safe_turn\":1,\"latest_useful_turn\":1,\"task\":\"...\",\"evidence_turns\":[1],\"final_status\":\"stable|minor_change|invalidated|unknown\",\"later_changed\":false,\"actual_rework\":\"none|low|medium|high|unknown\",\"parallel_execution_was_useful\":true,\"rationale\":\"...\"}]}。\n\n只识别满足以下方向的候选：参与者对局部功能已经形成共识；产物可由 Coding Agent 实现；不依赖当前未解决的核心分歧；可在隔离分支中低风险、可逆地开始。不要把研究分析、论文写作、会议总结、联系人员或泛泛设想标成实现任务。未来信息只用于结果验证和候选定位，不能伪造当时尚未出现的证据。最多返回 8 个 episode。"},{"role":"user","content":"<complete_dialogue>\n[T1] 产品：付费版想接微信支付。\n[T2] 开发：商户号、回调证书和退款规则都准备了吗？\n[T3] 产品：商户号还在申请，退款由财务确认。\n[T4] 开发：我可以先搭一个假的支付页吗？\n[T5] 产品：先不要，价格方案也可能改，等资料齐了再做。\n</complete_dialogue>\n只返回 JSON。"},{"role":"assistant","content":"{\"episodes\":[]}"}]}
