旗舰指南 · 企业智能体建设

企业智能体怎么从 0 到 1 建设?

先锁定一个有负责人、有真实输入、有明确交付物的岗位任务,再连接数据和工具,最后通过任务评测选择模型。智能体不是一个聊天页面,而是一条可追溯、可停止、可验收的工作链。

智能体建设指南公开责任:研究负责人 How发布:2026-07-13更新:2026-09-08研究与证据方法

直接回答

先定义工作,再建设智能体

从 0 到 1 需要明确六件事:谁提出任务、输入从哪里来、系统要交付什么、允许调用哪些工具、哪些动作必须人工确认、怎样判断结果被采用。六件事说不清时,先做流程梳理;说清以后,才进入框架和模型选型。

起点选择

第一个任务要同时满足四个条件

判断维度适合先做暂缓
发生频率每天或每周重复,样本可持续获得一年只发生一两次
输入材料制度、表格、对话或系统数据可授权主要依赖个人感觉且没有记录
结果复核业务人员能快速判断是否可用数月后才知道结果
失败风险可以停止、撤销或交给人工错误会直接造成重大且不可逆损失

系统分层

一套可上线的智能体至少有五层

岗位与任务

明确使用者、触发条件、交付物和最终责任人。

数据与知识

保留来源、版本、权限和引用,不把文件堆成无边界知识库。

工作流与工具

拆解步骤、调用业务系统、保存状态,并能处理超时和失败。

模型与路由

按任务评测质量、延迟和成本,配置主模型与备用路线。

贯穿所有层的治理

身份、最小权限、人工确认、日志、评测和回滚不能最后再补,它们决定系统是否能进入真实业务。

建设路线

买平台、用框架还是自研?

路线更适合主要代价
托管智能体平台标准任务、团队小、需要快速验证定制、数据边界和迁移能力受产品约束
工作流 / 智能体框架需要连接内部系统、明确控制执行图需要工程、评测和持续运维能力
自主运行型智能体研究、开发或开放式长任务行为边界、成本和失败恢复更难控制
完全自研核心流程、强合规、已有平台团队建设周期和长期维护成本最高

最小准备

先做一个可复测的任务包

试点不需要先建设完整数据中台。准备一份任务说明、10 至 30 个代表性输入、3 至 5 个历史合格结果、禁止动作清单和一个业务复核人,即可建立第一轮基线。材料必须覆盖正常、缺资料、规则冲突和高风险样本。

30 天路径

每一周都要留下可验证结果

  1. 第 1 周

    冻结任务边界、人工基线、责任人、成功标准和禁止动作。

  2. 第 2 周

    接入最小数据范围与只读工具,完成来源、权限和日志设计。

  3. 第 3 周

    用同一任务包评测模型和工作流,记录失败、追问、重试与人工修改。

  4. 第 4 周

    小范围真实运行,按最终采用、返工、证据、人工介入和一次成功成本决定继续、更新或停止。

开放标准

协议能降低集成成本,但不能替代治理

MCP 规范用于连接模型上下文与工具,A2A 规范用于智能体之间的发现和任务协作。它们解决互操作问题,不会自动定义企业权限、责任和验收。

下载清单

把讨论变成一张岗位评估表

表格包含任务频率、资料可得性、结果复核、风险、责任人和建议路线,适合课程现场或企业访谈直接使用。

下载数字员工岗位评估表

建设完成的判断标准是什么?

不是“能演示”,而是同类任务可以重复进入、关键结论有证据、异常会停止、重要动作由人确认、过程有日志,且业务人员愿意采用结果。达到这些条件后,再扩展相邻任务。

继续决策

先选场景还是先选模型企业大模型怎么选智能体项目怎么验收

场景评估 · 商务负责人 孙景璐

从一个真实任务开始。

查看服务流程