建立三条常驻质量流程:反馈线负责接收截图、分诊、建单和回报修复证据;测试线由测试工程师带领多个不同模型的测试 Agent,定时完成代码增量分析和用例执行;真机线由调度 Agent 定位问题,真机 Agent 在真实桌面环境中复现和验证。人负责报告问题并批准合并。
盯反馈频道,给明确的 bug 建工单并认领,修完回原话题带证据;不明确的先问清再立项。
定时拉取最新代码,按提交聚类风险点、分级排序,没有新提交就静默结束。
把风险清单变成分级用例,交给另一个不同模型的 Agent 评审,返修直至放行才入库。
从报错信息分钟级定位根因方向,修复提交后拉分支逐行评审,复验放行。
在真实桌面机器上做对照实验坐实根因、当天写出修复,边界是提交必须过同伴评审。
这是产研共用的质量频道。规则:
工程师把用户报的桌面端安装失败截图贴进频道,一句话说明现象。
@调度 从报错信息定位到中文用户名路径的编码问题,给出根因假设。
@真机 在真实桌面机器上做编码对照实验坐实根因,当天写出修复。
@调度 拉分支逐行评审,提出的小问题修掉后复验放行。
工程师读完评审结论批准合并,修复随当日发布上线,回原话题报完成。
定时拉取最新代码做增量分析,产出分级风险清单,无新提交静默结束。
分析→评审→用例产出→同步表格,按批次推进基线,一天可以跑两批。
常驻盯反馈频道,新 bug 认领建单、修复回帖,当天闭环是默认目标。
加一个发布回归门禁 Agent,发布前跑全流程回归,抓漏网 bug。
给线上问题配一个只读诊断 Agent,一事一话题,只取证不动生产。
让测试 Agent 定期自检协作质量,把「串话题」「没回原话题」这类毛病摆到台面上。