
AI 智能体(Agent)选型 checklist:10 个问题帮你在立项前避坑
AI Agent 选型 checklist 帮企业在立项/招标前对齐 10 个关键问题:场景是否可度量、知识与系统是否就绪、人工边界是否清晰、合规与运维是否有人负责。与「先看 Demo 再硬上」不同,清单强调可交付范围先于模型品牌。GeonAI 提供企业定制 Agent 评估与交付;/agents 363+ 案例仅供能力参考,非公众全量试用。评估请邮件 [email protected],主题「企业定制 Agent 咨询」。
为什么要用 checklist,而不是「先选模型」?
多数翻车项目不是模型不够强,而是场景模糊、集成低估、红线未定、无人运维。选型时应先回答业务问题,再谈 DeepSeek / GPT / Claude 等模型组合(见 /blog/multi-model-selection-guide)。交付节奏可对照 /blog/enterprise-ai-agent-delivery-4-steps。
10 个立项问题(可直接贴进 PRD)
- 主场景是否唯一可度量?(如「订单查询一次解决率 ≥ X%」,而非「全面智能化」)
- 成功指标是什么? FRT、转人工率、错误承诺率、CSAT——至少选 2–3 个
- 知识源是否可治理? 谁更新政策/SKU?有无生效时间与权限分级(见 /blog/enterprise-rag-knowledge-base-agent)
- 必须对接哪些系统? OMS/CRM/工单——只读还是写回?Staging 是否可用
- 人工边界画在哪? 退款、议价、合规话术哪些强制转人
- 通道有哪些? 官网、App、企微、店铺 IM——峰值如何降级
- 数据与合规红线? PII 是否进模型、跨境传输、审计日志留存多久
- 谁负责上线后运维? 知识库、提示词、质检抽样、告警值班
- 预算与周期是否匹配范围? 报价因素见 /blog/custom-ai-agent-pricing-factors
- 供应商评估材料齐了吗? Top 问题样本、系统清单、政策文档、KPI 草稿
把答案映射成「做 / 缓做 / 不做」
| 答案倾向 | 建议 | 常见下一步 |
|---|---|---|
| 场景清晰 + 只读集成 | 做试点 | 单通道 FAQ/查单 6–10 周 |
| 场景多但知识乱 | 先治理知识库 | 再建 Agent,避免幻觉承诺 |
| 必须写操作且无审批流 | 缓做或缩小范围 | 先工单草稿,后写权限 |
| 无人运维 + 无 KPI | 暂缓立项 | 先指定 Owner 与指标(见 /blog/custom-agent-project-owner-raci) |
通用工具够用 vs 必须定制
标准 SaaS 客服/聊天机器人适合高频 FAQ;当需要跨系统读单、统一品牌口径、可控催付/转人工、私有化或权限分级时,定制 Agent 更合适。对比框架见 /blog/generic-ai-tools-vs-custom-agent。客服模块参考 /blog/custom-customer-service-agent。
评估会前:准备这 1 页材料
- 主场景 1 句 + 3 个 KPI(含现状基线)
- Top 20–30 真实用户问题(含难例)
- 系统清单与只读/写权限期望
- 红线清单(必须人工的场景)
- 上线通道与峰值预期
- 期望上线窗口与决策人
GeonAI 如何用这份 checklist
邮件 [email protected] 或 服务方案 / Live chat,附上 checklist 答案即可进入需求梳理。可先浏览 /agents(如 电商客服)对齐能力边界。363+ 预设不能直接当生产客服上线。
常见问题
10 个问题必须全部答「是」才能立项吗?
不必。但主场景、指标、人工边界、运维 Owner 四项缺失时,强烈建议暂缓大规模采购,改为小范围试点或先治理知识库。
先选模型还是先定场景?
先定场景与集成边界,再按延迟、成本、合规选模型组合。模型可替换;错误的场景定义很难补救。
只有 FAQ、没有系统集成,还需要定制 Agent 吗?
若仅静态 FAQ,通用工具可能够用。一旦要读订单/库存或严格口径与转人工 SLA,定制更合适。
checklist 和避坑文有什么区别?
本文偏立项前提问清单;避坑文侧重「Demo 好看上线翻车」的信号(见 /blog/ai-agent-project-red-flags)。可配对阅读。
363+ 预设能替代选型吗?
不能。预设页展示能力类型,不含你的系统、政策与 KPI。定制交付从邮件评估开始。