天工智能体平台 — 商业化落地计划
从「能跑的项目」到「能卖的产品」的 4 周路线图。
一、现状基线
| 维度 |
当前状态 |
商业化差距 |
| 核心引擎 |
Agent ReAct + DAG工作流 + 多Agent编排 已就绪 |
稳定性未验证 |
| 测试覆盖 |
10 万行代码,仅 10 个测试文件 |
无回归保护,不敢迭代 |
| 安全 |
刚修复 35 个缺陷 |
需持续加固 |
| 文档 |
8 篇技术文档 |
缺产品/商业文档 |
| 模板 |
模板市场页面已有,内容为空 |
用户无法开箱即用 |
| 飞书集成 |
6 个 Bot 已运行 |
体验细节粗糙 |
| 知识进化 |
提取/检索/入库框架已有 |
未自动化运行 |
| 部署 |
docker-compose 就绪 |
缺一键安装和一键升级 |
| 多租户 |
权限模型已有 |
未实现团队隔离 |
结论:技术底座 70 分,产品化 20 分。差距在稳定性、易用性和商业化包装。
二、目标与时间线
三、详细任务分解
🔴 第一优先级:保稳定(Week 1)
3.1 核心测试补齐
当前 10 万行代码仅 10 个测试文件,这是最大的技术债务。
| 测试模块 |
内容 |
覆盖风险点 |
工作量 |
| Agent ReAct 循环 |
正常对话 / 工具调用 / 预算熔断 / max_iterations 截断 |
core.py 是全部 Agent 的运行时依赖 |
2天 |
| 工作流 DAG 执行 |
线性/条件分支/循环/审批 节点执行 |
workflow_engine.py 6K行,改动连锁影响 |
2天 |
| 工具调用参数过滤 |
LLM 生成错误参数名 → 过滤 → 正常执行 |
上次 type/keyword 冲突导致通知静默失败 |
1天 |
| 登录/认证 |
JWT 签发/验证/过期 + 401 拦截 |
刚修完 FormData/JWT padding 多个 Bug |
1天 |
| 工具执行异常保护 |
工具抛异常 → Agent 不崩溃 → 返回 error JSON |
刚加 try/except,需验证 |
0.5天 |
验收标准:pytest --cov 核心模块覆盖率 > 60%。
3.2 安全加固
| 任务 |
操作 |
优先级 |
| 数据库密码轮换 |
生成新密码 → 更新 .env → 确认 Celery/API/Worker 正常 |
紧急 |
.env 模板化 |
提供 .env.example 不含真实密钥 |
高 |
| API 速率限制 |
对登录/Webhook 接口加 slowapi 限流 |
中 |
| HTTPS 强制 |
Nginx 配置 HSTS + 证书自动续期 |
中 |
3.3 数据库模型迁移确认
init_db() 刚补全 13 个缺失模型导入,需确认所有表可正常创建。
🟡 第二优先级:补功能(Week 2)
3.4 知识进化闭环
| 任务 |
内容 |
工作量 |
| 部署知识提取 Celery 定时任务 |
每小时从 agent_execution_log 提取高质量执行记录 → LLM 提炼知识条目 |
1天 |
| 补全知识仪表盘 |
KnowledgeDashboard.vue 补知识增长曲线、复用次数排行、类别分布 |
1.5天 |
| 实测验证 |
选智能学习助手 Agent,跑 10 次对话 → 观察知识库增长 → 验证后续对话是否检索到之前经验 |
1天 |
验收标准:Agent 执行 5 次后,第 6 次能检索到前 5 次提炼的知识。
3.5 模板市场上架
这是「从开发者工具到商业产品」最关键的一步。非技术用户通过模板 5 分钟内看到价值。
| 模板名称 |
目标用户 |
核心配置 |
工作量 |
| 智能客服机器人 |
电商/SaaS 客服团队 |
RAG知识库 + 飞书群Bot + 工单升级审批 |
0.5天 |
| 每日研发日报 |
研发经理/TL |
定时8点 + Git汇总 + CI状态 + 飞书推送 |
0.5天 |
| PR Code Review 助手 |
研发团队 |
GitLab Webhook + Agent Review + 飞书通知 |
0.5天 |
| 面试调度助手 |
HR/招聘 |
飞书日历 + Agent对话 + 日程创建 |
0.5天 |
| 竞品监控日报 |
市场/产品团队 |
定时搜索 + LLM分析 + 飞书推送 |
0.5天 |
| 自动化测试报告 |
QA 团队 |
Jenkins 集成 + 失败分析 + 周报生成 |
已有Agent |
| 新员工入职引导 |
HR/行政 |
RAG员工手册 + 定时学习任务 + 问答Bot |
0.5天 |
| 项目风险预警 |
项目经理 |
Gitea/Jira 逾期扫描 + LLM评估 + 飞书告警 |
0.5天 |
验收标准:模板市场页展示 8 个模板,每个模板可一键创建 Agent。
3.6 模板即 Agent 的发布标准
每个模板必须包含:
🟢 第三优先级:磨体验(Week 3)
3.7 飞书 Bot 体验打磨
当前 6 个 Bot 已运行,但用户体验细节粗糙。
| 优化项 |
说明 |
工作量 |
| 消息反馈按钮 |
飞书消息卡片增加"👍有用 / 👎没用 / 🔄重新生成" |
1天 |
| 反馈数据接入学习 |
feedback_learner.py 已有框架,接入飞书反馈事件 |
0.5天 |
| 对话历史摘要 |
长对话自动摘要压缩,避免超过 token 上限 |
1天 |
| Bot 状态指示 |
飞书群内显示"正在思考...""正在执行工具..."等状态 |
0.5天 |
| 错误友好提示 |
Agent 崩溃时不显示技术错误,改成"我遇到了一点问题,请稍后再试" |
0.5天 |
3.8 演示 Demo 制作
| 内容 |
形式 |
时长 |
| 5 分钟创建智能客服 |
录屏:模板市场 → 一键创建 → 飞书群对话 |
3分钟 |
| PR Review 自动化 |
录屏:提交 PR → Webhook → Agent Review |
3分钟 |
| 工作流可视化设计 |
录屏:拖拽节点 → 配置LLM → 执行 → 看结果 |
4分钟 |
3.9 官网/落地页
🔵 第四优先级:可交付(Week 4)
3.10 多租户最小可用方案
| 层次 |
方案 |
工作量 |
| 数据隔离 |
Agent/工作流/知识库 增加 workspace_id 字段 |
1天 |
| 飞书应用隔离 |
每个 workspace 绑定独立飞书应用配置 |
0.5天 |
| 权限隔离 |
已有 role 模型,扩展 workspace_admin / workspace_member |
1天 |
| 管理面板 |
Admin 可查看/管理所有 workspace |
1天 |
3.11 一键部署脚本
| 交付物 |
说明 |
工作量 |
install.sh |
交互式一键安装脚本 |
1天 |
upgrade.sh |
增量升级脚本(保留数据) |
0.5天 |
uninstall.sh |
清理脚本 |
0.5天 |
| 部署文档 |
图文教程,包含常见问题 |
0.5天 |
3.12 商业化定价
| 版本 |
价格 |
包含 |
| 社区版(开源) |
免费 |
单租户、5个Agent、社区支持 |
| 专业版 |
¥19,800/年 |
多租户、50个Agent、飞书集成、邮件支持 |
| 企业版 |
¥98,000/年 |
不限Agent、私有部署、SLA 99.9%、专属客户经理 |
| 定制开发 |
¥2,000/人天 |
行业解决方案、系统集成、培训 |
四、技术债务清理计划
| 债务 |
风险等级 |
计划 |
| 测试覆盖率 < 5% |
高 |
Week 1 核心模块到 60%,持续提升 |
| 工作流引擎 6K 行单体文件 |
中 |
按节点类型拆分为独立模块 |
workflow_engine.py eval() |
中 |
替换为 asteval 或自定义表达式引擎 |
| 前端 4 处 v-html |
中 |
评估 DOMPurify 集成 |
| AgentChat localStorage |
低 |
迁移到 IndexedDB + 加密 |
| AsyncOpenAI 客户端生命周期 |
低 |
重构为长生命周期单例 |
五、商业里程碑
六、风险与应对
| 风险 |
概率 |
影响 |
应对 |
| LLM API 成本过高 |
中 |
高 |
默认使用 DeepSeek(低成本),缓存命中已有框架 |
| 飞书 API 变更 |
低 |
高 |
抽象飞书适配层,隔离平台逻辑 |
| 竞品(Dify/Coze)快速迭代 |
高 |
中 |
差异化飞书深度集成 + 国内部署优势 |
| 安全事件 |
中 |
高 |
Week 1 密码轮换 + 后续渗透测试 |
| 用户增长不达预期 |
中 |
中 |
模板市场驱动 + 飞书开发者社区推广 |
七、团队需求(最小配置)
| 角色 |
人数 |
职责 |
| 全栈工程师 |
1-2人 |
后端 Python + 前端 Vue,核心功能开发 |
| 产品/运营 |
1人 |
模板制作、文档、社区、客户沟通 |
| 兼职安全顾问 |
按需 |
渗透测试、安全审计 |
八、附录
A. 已修复的 35 个缺陷分类
| 分类 |
数量 |
示例 |
| 安全漏洞 |
12 |
JWT绕过、Webhook无认证、密码硬编码、路径遍历 |
| Agent 运行时 |
7 |
工具异常崩溃、budget泄漏、self_review误判 |
| 前端缺陷 |
12 |
登录失败、SSE消息重复、XSS风险、状态不一致 |
| 工作流引擎 |
4 |
DAG环路、审批冲突、eval沙箱 |
B. 关键文件清单
| 文件 |
行数 |
角色 |
backend/app/agent_runtime/core.py |
1,253 |
Agent ReAct 运行时 |
backend/app/services/workflow_engine.py |
6,188 |
工作流 DAG 引擎 |
backend/app/agent_runtime/orchestrator.py |
988 |
多Agent编排器 |
backend/app/services/builtin_tools.py |
6,290 |
54 个内置工具 |
backend/app/services/tool_registry.py |
380 |
工具注册表 |
frontend/src/views/WorkflowDesigner.vue |
- |
可视化工作流设计器 |
frontend/src/views/AgentChat.vue |
- |
Agent 对话页面 |
frontend/src/views/TemplateMarket.vue |
- |
模板市场 |
C. 外部依赖服务
| 服务 |
用途 |
备注 |
| MySQL 8.0 |
主数据库 |
生产: 腾讯云 CDB |
| Redis 7 |
缓存 + Celery Broker |
- |
| Celery Worker |
异步任务执行 |
工作流/Agent 后台执行 |
| Celery Beat |
定时调度 |
Cron 触发 Agent |
| DeepSeek API |
主力 LLM |
低成本,中文友好 |
| SiliconFlow |
Embedding 向量化 |
bce-embedding-base_v1 |
| 飞书开放平台 |
Bot 消息 |
6 套独立应用 |
| Gitea |
Issue/PR 集成 |
自建 Git 服务 |
文档版本: v1.0
编制日期: 2026-05-10
下一步: Week 1 启动核心测试 + 密码轮换