直接回答
先定义工作,再建设智能体
从 0 到 1 需要明确六件事:谁提出任务、输入从哪里来、系统要交付什么、允许调用哪些工具、哪些动作必须人工确认、怎样判断结果被采用。六件事说不清时,先做流程梳理;说清以后,才进入框架和模型选型。
起点选择
第一个任务要同时满足四个条件
系统分层
一套可上线的智能体至少有五层
明确使用者、触发条件、交付物和最终责任人。
保留来源、版本、权限和引用,不把文件堆成无边界知识库。
拆解步骤、调用业务系统、保存状态,并能处理超时和失败。
按任务评测质量、延迟和成本,配置主模型与备用路线。
身份、最小权限、人工确认、日志、评测和回滚不能最后再补,它们决定系统是否能进入真实业务。
建设路线
买平台、用框架还是自研?
最小准备
先做一个可复测的任务包
试点不需要先建设完整数据中台。准备一份任务说明、10 至 30 个代表性输入、3 至 5 个历史合格结果、禁止动作清单和一个业务复核人,即可建立第一轮基线。材料必须覆盖正常、缺资料、规则冲突和高风险样本。
30 天路径
每一周都要留下可验证结果
- 第 1 周
冻结任务边界、人工基线、责任人、成功标准和禁止动作。
- 第 2 周
接入最小数据范围与只读工具,完成来源、权限和日志设计。
- 第 3 周
用同一任务包评测模型和工作流,记录失败、追问、重试与人工修改。
- 第 4 周
小范围真实运行,按最终采用、返工、证据、人工介入和一次成功成本决定继续、更新或停止。
开放标准
协议能降低集成成本,但不能替代治理
MCP 规范用于连接模型上下文与工具,A2A 规范用于智能体之间的发现和任务协作。它们解决互操作问题,不会自动定义企业权限、责任和验收。
下载清单
把讨论变成一张岗位评估表
表格包含任务频率、资料可得性、结果复核、风险、责任人和建议路线,适合课程现场或企业访谈直接使用。
下载数字员工岗位评估表建设完成的判断标准是什么?
不是“能演示”,而是同类任务可以重复进入、关键结论有证据、异常会停止、重要动作由人确认、过程有日志,且业务人员愿意采用结果。达到这些条件后,再扩展相邻任务。
