内容纲要
Agent 研发全流程架构
架构图

源代码
<html style="margin:0;padding:0;">
<title>Agent研发全流程架构</title>
<style>
body{margin:0;padding:16px;background:#f5f7fa;font-family:-apple-system,"PingFang SC","Microsoft YaHei",sans-serif;color:#1f2d3d;}
.wrap{max-width:1900px;margin:0 auto;}
h1{font-size:20px;margin:0 0 4px 0;color:#0b2545;}
.sub{font-size:12px;color:#5b6b7c;margin-bottom:14px;}
.legend{display:flex;gap:14px;flex-wrap:wrap;font-size:12px;color:#3a4a5c;margin-bottom:12px;}
.legend i{display:inline-block;width:10px;height:10px;border-radius:2px;margin-right:4px;vertical-align:middle;}
.grid{display:grid;grid-template-columns:100px repeat(8,1fr) 120px;gap:6px;align-items:stretch;}
.rowlabel{font-size:12px;font-weight:600;color:#0b2545;display:flex;align-items:center;justify-content:flex-end;padding-right:8px;border-right:2px solid #c9d4e0;}
.stage{background:#0b2545;color:#fff;border-radius:6px;padding:6px 4px;text-align:center;font-size:12px;font-weight:600;}
.stage .gate{display:block;font-size:9.5px;font-weight:400;color:#ffd166;margin-top:2px;}
.cell{background:#fff;border:1px solid #d8e1ec;border-radius:6px;padding:6px;font-size:11px;line-height:1.5;display:flex;flex-direction:column;gap:3px;}
.cell b{color:#0b2545;font-size:12px;}
.tag{display:inline-block;background:#eaf2fb;color:#1d4e89;border-radius:3px;padding:1px 5px;font-size:10.5px;margin:1px 2px 1px 0;}
.tag.green{background:#e6f4ea;color:#1e7e34;}
.tag.orange{background:#fff1e0;color:#b2620a;}
.tag.purple{background:#efe7fb;color:#5b21b6;}
.col-obs{background:#f3ecff;border:1px dashed #7c3aed;border-radius:6px;padding:6px;font-size:11px;color:#4c1d95;display:flex;flex-direction:column;gap:3px;}
.col-obs b{color:#5b21b6;font-size:12px;}
.infra{margin-top:10px;background:#fff;border:1px solid #d8e1ec;border-radius:6px;padding:10px;}
.infra h3{margin:0 0 8px 0;font-size:13px;color:#0b2545;}
.infra-row{display:grid;grid-template-columns:repeat(auto-fit,minmax(240px,1fr));gap:8px;}
.infra-cell{background:#f7f9fc;border-left:3px solid #1d4e89;padding:6px 8px;font-size:11.5px;line-height:1.5;}
.infra-cell b{display:block;color:#0b2545;font-size:12px;margin-bottom:2px;}
.flow-note{margin-top:10px;font-size:11.5px;color:#5b6b7c;background:#fff8e6;border:1px solid #f1d99a;border-radius:6px;padding:8px 10px;}
.arrow-row{display:flex;justify-content:space-between;font-size:11px;color:#1d4e89;margin:2px 0 6px 100px;}
</style>
<div class="wrap">
<!-- <h1>Agent研发全流程架构</h1> -->
<h1 style="text-align: center;">Agent研发全流程架构</h1>
<div class="sub">横向:需求 → 上线 8 阶段流水线(含阶段门)| 纵向:接入 / 编排 / 组件 / 数据 / 模型 分层 | 右侧纵切:LangSmith 全链路可观测</div>
<!-- <div class="legend">
<span><i style="background:#1d4e89;"></i>LangChain 核心</span>
<span><i style="background:#1e7e34;"></i>LangGraph 编排</span>
<span><i style="background:#7c3aed;"></i>LangSmith 可观测</span>
<span><i style="background:#b2620a;"></i>部署 / 基础设施</span>
</div> -->
<!-- 阶段表头 -->
<div class="grid">
<div></div>
<div class="stage">① 业务梳理<span class="gate">Gate:场景梳理评审 </span> <span class="gate">Pass:痛点场景明确 + Agent可解性有依据(这个业务痛点,是否适合用Agent来解决) + 收益可算与优先级可排</span> </div>
<div class="stage">② 立项开发<span class="gate">Gate:立项评审 </span> <span class="gate">Pass:需求由业务部门自己提出或者该场景被业务部门认可,可推广可落地 + ROI被认可 + 责任人与资源到位</span> </div>
<div class="stage">③ 需求接入<span class="gate">Gate:PRD评审 </span> <span class="gate">Pass:场景与边界清晰 + 输入输出格式明确 + 成功指标可量化可验收</span> </div>
<div class="stage">④ 方案设计<span class="gate">Gate:技术方案评审</span> <span class="gate"> Pass:架构选型有依据 + State Schema/Tool清单是完整 + 成本和风险已经评估 </span> </div>
<div class="stage">⑤ 编排开发<span class="gate">Gate:联调通过</span> <span class="gate">Pass:主流程跑通 + 异常分支有兜底 + 核心节点可回放</span> </div>
<div class="stage">⑥ 测试评估<span class="gate">Gate:评测达标</span> <span class="gate">Pass:Golden Dataset覆盖核心场景 + 自动化回归通过率达标 + Bad Case闭环可追溯</span> </div>
<div class="stage">⑦ 发布上线<span class="gate">Gate:灰度验收</span> <span class="gate">Pass:小流量灰度(比如 1 个部门跑一周),无 P0 问题,数据权限审计通过</span> </div>
<div class="stage">⑧ 运营迭代<span class="gate">Gate:运营复盘月评审会</span> <span class="gate">Pass:Trace可追溯 + 业务价值有据且可固化 + Backlog回流</span> </div>
<div class="col-obs" style="background:#0b2545;color:#fff;border:none;text-align:center;">
<b style="color:#ffd166;">LangSmith</b>
<div style="font-size:10.5px;line-height:1.6;">Trace、Dataset、Eval、Prompt Hub、Monitoring</div>
</div>
<!-- 行:阶段与产物 -->
<div class="rowlabel">Owner / 产物</div>
<div class="cell"><b>职能岗位作业人员</b><span class="tag">业务人员编写的需求文档</span><span class="tag">候选场景清单(所有能想到的痛点场景的耗时/频次/出错率)</span><span class="tag">Agent可解性标记</span><span class="tag">开发优先级排序表</span><span class="tag">待开发需求登记表</span></div>
<div class="cell"><b>项目经理、职能人员、AI工程师</b><span class="tag">业务矩阵表</span><span class="tag">立项申请表</span><span class="tag">立项评审决议记录</span><span class="tag">项目启动章程</span></div>
<div class="cell"><b>项目经理、职能人员、AI工程师</b><span class="tag">PRD文档</span><span class="tag">项目开发计划追踪表</span><span class="tag">中泰数字化工作管理表</span><span class="tag">需求评审记录与决议</span><span class="tag">资源需求清单(数据/模型/算力/接口)</span></div>
<div class="cell"><b>AI工程师</b><span class="tag">Agent 流程图</span><span class="tag">Tool 清单</span><span class="tag">State Schema(状态字段与流转定义)</span><span class="tag">架构选型说明</span></div>
<div class="cell"><b>AI工程师</b><span class="tag green">StateGraph代码(Gitlab仓库地址+分支)</span><span class="tag green">节点/边定义清单</span><span class="tag">Prompt模板库(版本化管理)</span><span class="tag">本地联调记录/LangSmith Trace调试日志</span></div>
<div class="cell"><b>AI工程师、职能人员</b><span class="tag purple">Golden Dataset</span><span class="tag purple">Eval 脚本</span><span class="tag">回归测试报告</span><span class="tag">Bad Case清单与分级(致命/严重/一般)</span><span class="tag">评测结论与放行建议</span></div>
<div class="cell"><b>AI工程师</b><span class="tag orange">Docker容器+k8s部署的配置文件</span><span class="tag orange">GitLab Release Tag</span><span class="tag">钉钉工作台发布版本</span><span class="tag">灰度观察报告</span></div>
<div class="cell"><b>项目经理、职能人员、AI工程师</b><span class="tag purple">Agent运营月报(运行数据看板)</span><span class="tag">业务价值核算报告(节省工时、差错降低、推广度)</span><span class="tag">BadCase清单&迭代Backlog</span><span class="tag">新版Prompt/Graph评估报告</span><span class="tag">版本迭代记录</span></div>
<div class="col-obs"><br>① Trace链路树 <br>② Dataset版本库<br> ③ Eval报告 <br>④ Prompt Hub <br>⑤ 监控看板</div>
<!-- 行:技术实现 -->
<div class="rowlabel">任务 / 实现</div>
<div class="cell"><b>单点场景选择</b><span class="tag">痛点场景挖掘(高频、高耗、易错)</span><span class="tag">Agent可解性评估</span><span class="tag">优先级排序与清单输出<br>- 价值评估(优化工时、差错、用户体验)<br>- 可行性评估<br>- 优先级矩阵(价值 X 可行性)<br>- 待开发清单确认</span></div>
<div class="cell"><b>立项流程</b><span class="tag">立项申请准备<br>- 填写立项申请表并完成审批流程<br>- 按场景清单排出开发优先级</span><span class="tag">组织评审会,确定业务矩阵</span><span class="tag">项目启动<br>- 业务矩阵确认<br>- 任务分工 <br>- 项目里程碑与初排计划 <br>- 确定组织架构和例会节奏</span></div>
<div class="cell"><b>需求对接</b><span class="tag">需求调研(跟职能部门逐条查场景、痛点、现行业务动作)</span><span class="tag">需求拆解与边界划定(逐条界定可行性和输入输出内容)</span><span class="tag">项目启动准备<br>- 成功指标定义<br>- 资源需求盘点<br>- 项目计划和进度排期 <br>- 确定例会章程 </span></div>
<div class="cell"><b>方案选型</b><span class="tag">架构模式选型</span><span class="tag">状态与流程设计</span><span class="tag">工具与集成设计</span></div>
<div class="cell"><b>LangGraph编排</b><span class="tag green">图结构定义</span><span class="tag green">节点与工具集成</span><span class="tag green">运行时能力<br>- Checkpointer<br>- Memory<br>- Human-in-loop<br>- 异常分支兜底</span></div>
<div class="cell"><b>评测与回归</b><span class="tag">数据集构建</span><span class="tag">自动化评测</span><span class="tag">人工&大模型联合评审<br>- LangSmith Dataset回放,对照Trace逐会话核查<br>- Custom Evaluator/LLM-as-Judge自动打分<br>- 人工标注与分歧裁决(职能提供)<br>- 新旧版本回归对比(Prompt/Tool/Graph变更前后)</span></div>
<div class="cell"><b>发布上线</b><span class="tag purple">容器化部署</span><span class="tag purple">灰度发布</span><span class="tag">发布 & 监控接入</div>
<div class="cell"><b>业务活动</b><span class="tag orange">Agent上线验收(业务价值核算)</span><span class="tag orange">过程复盘+价值总结+固化经验</span><span class="tag orange">运维&优化<br>- LangSmithTrace监控与BadCase挖掘<br>- 业务指标埋点与效果归因<br>- Golden Dataset增量沉淀,回归测试<br>- 版本灰度/回滚与钉钉工作台发布</span></div>
<div class="col-obs"><br>① Trace采集:自动捕获每步输入/输出/时延/Token,串起会话调用树;每次检索、召回、重排都进Trace,用于定位召回质量 <br>② 评测闭环:Dataset回放->LLM-as-Judge自动打分->新旧版本回归对比 <br>③ 版本与监控</div>
<!-- 行:依赖资产 -->
<div class="rowlabel">依赖资产</div>
<div class="cell"><span class="tag">相关业务人员的专业知识和能力</span><span class="tag">业务流程文档/SOP(标准作业程序)</span><span class="tag">历史业务痛点记录/工单数据</span><span class="tag">Agent能力清单(评估当前哪些能做,比如自主规划行程并预订机票,缺少外挂航班Tool,不能做)</span><span class="tag">场景评估模板/评分表模板(方便业务人员快速评估是否是伪需求)</span></div>
<div class="cell"><span class="tag">OA立项申请表模板(IT10-数字化项目立项审批流程)</span><span class="tag">成本收益测算模板(投资回报模型)</span><span class="tag">业务梳理输出的场景清单和优先级排序</span><span class="tag">公司项目管理制度和研发流程规范</span></div>
<div class="cell"><span class="tag"> PRD模板与需求文档规范</span><span class="tag"> 业务术语表与业务流程文档</span><span class="tag">模型API清单与调用配额 </span><span class="tag">数据接口文档与数据字典 </span></div>
<div class="cell"><span class="tag">标准化开发文档</span><span class="tag">历史Agent方案库</span><span class="tag">外部API文档和系统接口清单</span><span class="tag">可用模型清单(模型能力说明、专项任务指定模型)</span><span class="tag">成本估算公式(Token消耗、Tool调用包月收费、服务器资源)</span></div>
<div class="cell"><span class="tag"> 模型API</span><span class="tag"> 系统接口/数据文档</span><span class="tag">服务器(开发与测试环境) </span><span class="tag">算力 </span><span class="tag">可视化调试环境(LangGraph Studio、LangSmith Trace)</span></div>
<div class="cell"><span class="tag">测试用例集</span><span class="tag">业务预期答案与标注规范或者过往已验证的数据和结果文档(职能提供)</span><span class="tag">LangSmith Dataset/Eval的运行环境</span><span class="tag">评审模型的API</span><span class="tag">之前版本的Prompt/Graph/模型输出(做回归对照)</span></div>
<div class="cell"><span class="tag">发布上线标准手册</span><span class="tag">镜像仓库</span><span class="tag">钉钉应用开发平台</span></div>
<div class="cell"><span class="tag">LangSmith监控看板</span><span class="tag">业务指标口径与价值核算规则</span><span class="tag">监控告警配置(日志SLS、网关告警、运行状态看板)</span><span class="tag">线上用户反馈系统+业务管理人员的意见收集和反馈</span><span class="tag">上一版本部署产物(Docker镜像、k8s配置、gitlab版本,方便回滚)</span></div>
<div class="col-obs">① LangSmith平台账号、项目空间与鉴权<br>② 成员权限与角色<br>③ 线上服务Trace接入配置</div>
</div>
<div class="arrow-row">
<span>▶ 阶段门准入:上一阶段产物评审通过,方可进入下一阶段</span>
</div>
<!-- 共享底座 -->
<div class="infra">
<h3>共享底座(贯穿所有阶段)</h3>
<div class="infra-row">
<div class="infra-cell"><b>模型推理层</b><span class="tag orange">LLM</span> 混合调用:部署开源 LLM(Qwen、MiniMax等)+ 购买顶尖通用模型API(deepseek、claude)<br><span class="tag">模型网关</span> 统一模型入口、多模型路由、流量和安全策略。</div>
<div class="infra-cell"><b>数据存储层</b>向量库(Milvus):RAG知识库向量检索|对象存储(Minio):文档、图片、文件等原始数据|业务库(MySQL):业务数据、配置、用户与权限信息|会话缓存(Redis):短期对话记忆、热点数据| / LangGraph Checkpointer(Postgres):状态持久化、断点恢复)。</div>
<!-- <div class="infra-cell"><b>平台工程层</b>Docker 镜像仓库 | GitLab CI | 阿里云 PAI-EAS / DSW | 日志(SLS))。</div> -->
<div class="infra-cell"><b>安全与治理</b>访问控制:API网关鉴权、SSO、角色与权限管理 | 数据安全:敏感信息识别、数据脱敏、储存加密 | 内容安全:输入/输出内容审核、Prompt注入防护、沙盒 | 审计合规:全链路调用日志留存、Trace可追溯 | 秘钥统一管理。</div>
</div>
</div>
<div class="flow-note">
<b>闭环反馈:</b>线上运行的每一次调用都被 LangSmith Trace 捕获 → 按失败率、人工评分、业务指标筛出 Bad Case → 自动/人工加入 Golden Dataset → 触发 Eval 回归 → 不通过则回到 ⑤ 编排开发 调 Prompt / Tool / Graph;通过则随下一次发版灰度上线。LangSmith 因此同时是"调试器 + 评测台 + Prompt 仓库 + 监控面板"。
</div>
</div>
</html>