
2026-07-31·定制 Agent
企业定制 AI Agent 交付清单:从需求纪要到上线验收要交哪些物
定制 AI Agent 项目翻车,常见不是「模型不够强」,而是交付物含糊——上线时才发现没有意图表、没有拒答规则、没有验收指标。采购方习惯问模型与价格;交付方若只答「做一个客服 Agent」,双方对「做完」的理解会差一整条审计链。GeonAI 的定制交付以可验收工件为准;官网 /agents 仅为能力参考(363+ 预设非公众全量试用)。评估请邮件 [email protected]。试点指标见 /blog/poc-to-production-agent-checklist;交付节奏见 /blog/enterprise-ai-agent-delivery-4-steps。
为什么要先谈「交什么」而不是「用哪个模型」
模型可以换,边界与验收换不了口头约定。先冻结工件清单,再谈路由与选型,能少打一半变更单。
阶段一:需求与边界(立项周)
| 交付物 | 作用 | 缺了会怎样 |
|---|---|---|
| 场景一页纸 | 用户、入口、成功定义 | 范围无限膨胀 |
| 意图表 v0 | Top 意图与优先级 | 无法设计知识与工具 |
| 能力边界三表草稿(/blog/custom-agent-scope-boundary-in-contract) | 可做 / 不做 / 须人工 | 上线后争议不断 |
| 数据与系统清单 | 知识源、CRM/工单、权限 | 联调延期 |
阶段二:方案与设计
- Agent 架构说明:单一助手或多 Agent(见 /blog/multi-agent-vs-single-assistant)
- 知识架构:库/标签/ACL、更新责任人
- 工具白名单:只读/可写、确认策略(见 /blog/agent-function-call-mcp-integration)
- 转人工规则:触发条件、话术、工单字段
- 评测集 v0:≥50–100 条金标问答(含拒答样例)
阶段三:构建与联调
| 交付物 | 说明 |
|---|---|
| 可运行环境说明 | 测试/预发 URL、账号、配置项 |
| 知识入库报告 | 文档数、失败解析列表、版本号 |
| 联调记录 | API 用例、错误码、幂等策略 |
| 安全检查表 | 密钥不进前端、无万能工具 |
阶段四:试点与验收
对照 POC 验收清单:缺引用率、越权率、漏转率、错误承诺率等写入签字版验收表。预设页与 Demo 不是验收标准。
阶段五:上线与移交
- 运维 Runbook(故障、降级、回滚)
- 知识发布制度(谁改、谁审、如何回滚)
- 周报指标模板
- 培训纪要(业务 Owner + 一线)
- 剩余风险与迭代 Backlog
最小可签 SOW 附件包(建议一次性列出)
意图表、边界三表、工具白名单、评测集、验收指标表、Runbook、知识发布流程——七件套缺三件以上,不建议宣称「已交付生产」。
找 GeonAI 时怎么描述
说明优先场景、现有系统、希望写入合同的验收指标。邮件 [email protected]、服务方案 或 Live chat。我们按可验收工件交付,不贩卖空泛「做一个智能体」。
常见问题
没有评测集能不能上线?
可以灰度,但不应签「生产验收通过」。无金标等于无法证明变好还是变差。
363+ 案例算交付物吗?
不算。那是能力类型展示,不含你们的意图、ACL 与工具。
交付物是否含模型权重?
多数项目交付的是配置、知识、网关与流程;权重归属按合同。私有化另议。
谁保存这些文档?
建议企业侧知识库 + 合同附件双存;GeonAI 可代管工作副本。
和四步交付法什么关系?
四步法讲节奏;本文讲每步必须落下的文件。两者一起写进 SOW 最稳。
Demo 环境算不算交付完成?
不算。完成以签字验收表与移交件为准,不是一次演示。
定制 AI Agent交付清单SOW验收GeonAI