chore: sync knowledge base updates - agent projects, docs reorg, daily cleanup
Co-Authored-By: Claude Opus 4.6 <noreply@anthropic.com>
This commit is contained in:
@@ -80,5 +80,74 @@ D:\aaa\aiagent\上传git仓.md 上传git仓
|
||||
4.项目熟悉D:\aaa\aiagent\docs\
|
||||
5.可以在git仓查看历史D:\aaa\aiagent\上传git仓.md
|
||||
|
||||
任务,生成一个家庭医生的agent
|
||||
http://localhost:3001/agents
|
||||
|
||||
|
||||
|
||||
本地数据库:localhost root 3306端口 密码123456
|
||||
|
||||
云数据库:
|
||||
项目 │ 地址 │
|
||||
├──────────┼─────────────────────────────────────────────────┤
|
||||
│ 主机 │ gz-cynosdbmysql-grp-d26pzce5.sql.tencentcdb.com │
|
||||
├──────────┼─────────────────────────────────────────────────┤
|
||||
│ 端口 │ 24936 │
|
||||
├──────────┼─────────────────────────────────────────────────┤
|
||||
│ 数据库 │ agent_db │
|
||||
├──────────┼─────────────────────────────────────────────────┤
|
||||
│ 配置位置 │ D:\aaa\aiagent\backend\.env
|
||||
|
||||
|
||||
|
||||
|
||||
|
||||
现有[天工智能体平台](http://localhost:3001/teams),里面有很多的虚拟团队,你可以调用他们来给我干活吗,你来当指挥,虚拟团队在干活中遇到的各种问题,报告给我来决定是不是要进行修复。
|
||||
|
||||
|
||||
你可以给系统应用测试团队下达: 测试Android客户端 D:\aaa\aiagent\android 的代码质量和潜在bug,让团队中每个agent都能扫描真实源码(可以参考设计文档),对标商业化产品,有哪些交互体验等等问题
|
||||
|
||||
|
||||
要求:当你发现问题后,停止任务,然后及时修改纠正,完成后继续指挥虚拟团队完成任务。
|
||||
目的:将虚拟团队打造成高效协作,可以高标准高质量完成任务的团队。
|
||||
|
||||
|
||||
|
||||
|
||||
你来当指挥,虚拟团队系统应用测试团队来干活
|
||||
使用步骤
|
||||
|
||||
1. 访问 http://localhost:3001/teams
|
||||
2. 点击 "系统应用测试团队" 按钮(黄色按钮)
|
||||
3. 6 个角色槽位自动填充完毕,团队名固定为"系统应用测试团队"
|
||||
4. 在底部输入框输入要测试的项目描述,例如:
|
||||
▎ 请深度测试 D:\aaa\aiagent\android 项目的功能完整性、交互体验、边界容错和性能瓶颈
|
||||
5. 建议点击 "流式执行"(可实时看到每个 Agent 的思考/工具调用/输出)
|
||||
|
||||
执行流程
|
||||
|
||||
阶段0: 系统架构师
|
||||
├─ list_files 递归扫描目录 (depth 3-4)
|
||||
├─ project_scan 自动识别技术栈
|
||||
├─ file_read 读取 5-7 个核心文件 (不超过10次)
|
||||
└─ 输出: 架构上下文文档(技术栈/目录结构/核心模块/数据流/架构风险)
|
||||
|
||||
阶段1: 测试规划师
|
||||
├─ 读取架构师文档
|
||||
├─ file_read 自扫 3-5 个关键源文件
|
||||
└─ 输出: JSON 测试计划 (project_name + phases[4-6] + acceptance_criteria)
|
||||
phases 支持 depends_on 实现并行执行
|
||||
|
||||
阶段2-N: 各测试角色并行/顺序执行
|
||||
├─ 功能测试员: 扫 5-6 个核心文件 → 输出 ≥12 个 bug (含文件路径+行号+修复代码)
|
||||
├─ 体验审核员: 扫 4-5 个 UI 文件 → 对比 ChatGPT/豆包 输出 UX 评审
|
||||
├─ 边界探索员: 扫 5-6 文件 + 2-3 次 grep 查 !!、?.let、catch 等 → 边界用例报告
|
||||
└─ 性能评估员: 扫 5-6 文件 → 查 runBlocking、GlobalScope、callbackFlow 等反模式
|
||||
|
||||
最终: 汇总全部报告 → 输出项目文件路径 + 文件清单
|
||||
|
||||
关键设计
|
||||
|
||||
- 真实代码优先: 每个角色被强制要求 file_read 真实源文件(限制 4-7 次),禁止只看文档输出空泛结论
|
||||
- STOP-SCANNING 规则: 超过 10 次迭代仍未产出则强制写 file_write
|
||||
- 架构师先行: 架构师扫描代码生成上下文文档,后续测试角色基于该文档 + 自己扫描开展工作
|
||||
- 并行支持: 测试规划师的 phases JSON 中的 depends_on 字段支持 DAG 并行(互不依赖的阶段同时执行)
|
||||
- 产出文件: 所有测试报告写入 team_projects/{team_id}/{project_name}/ 目录
|
||||
Reference in New Issue
Block a user