Agent 适合「多步骤、需调工具、目标明确」的任务,不适合无人值守的高风险决策。个人阶段先用固定工作流 + 单点模型调用;只有当分支与工具调用变复杂时,再上 Agent,并在付款、删除、对外承诺处保留人工确认。
三个层次,先别混为一谈
| 形态 | 你在做什么 | 典型例子 |
|---|---|---|
| 聊天助手 | 单轮/多轮问答 | 改文案、解释报错 |
| 固定工作流 | 预定义步骤,偶发调用模型 | 表单 → 分类 → 通知 |
| Agent | 模型在目标下选择工具与步骤 | 查资料→写草稿→开 issue |
很多人把「会调用工具的聊天」都叫 Agent。对个人业务来说,先问是否真的需要自主规划。
什么时候值得上 Agent
满足多数条件再考虑:
- 任务步骤不固定,或依赖中间结果分支
- 需要组合 2 个以上工具(搜索、表格、仓库、浏览器)
- 失败可回滚或可重试
- 你愿意花时间写约束与评测集
什么时候不要用
- 价格/合同/权限变更的自动执行
- 不可逆删除、批量改生产数据
- 你自己都说不清成功标准
- 只是想「显得更先进」
这些场景用 清单 + 固定流程 + 人工按钮 更安全。
个人可用的最小架构
目标描述
→ 计划(可展示给人)
→ 工具调用(只读优先)
→ 中间结果检查
→ 写操作(需批准)
→ 日志归档
权限分层
| 级别 | 允许 | 示例 |
|---|---|---|
| L0 只读 | 搜索、摘要、起草 | 读文档 |
| L1 草稿写 | 写入「待审」区 | 草稿邮件 |
| L2 生产写 | 改正式数据 | 需你点确认 |
| L3 高风险 | 付款、删库、权限 | 默认禁止自动 |
与 n8n 的分工
- n8n:稳定、可观测、定时与 Webhook 强
- Agent:探索性、多分支、工具选择灵活
常见组合:
n8n 触发 → 调用模型做分类/起草 → 人工确认节点 → 继续执行
而不是:Agent 7×24 直接对客户承诺。
一周验证法
选一个低风险任务,例如「把本周星标邮件整理成待办摘要」:
- 先纯手工做一次,写下步骤
- 改成固定工作流(能固定就别 Agent)
- 仍有大量分支,再试 Agent
- 对比:时间、错误率、你的焦虑程度
若焦虑上升、错误增多,回退到工作流。
评测清单(上线前)
- 有明确成功定义
- 有最大步数/超时
- 写操作默认关闭或需批准
- 全程日志可回放
- 准备了「一键停」
下一步
RELATED / 相关推荐
接着读这些
按同一栏目、标签与技术栈为你挑选。
指南14 分钟
AI 内容工作流:从选题到多渠道复用
为个人站与一人业务设计可重复的内容流水线:选题、提纲、起草、人工校对、拆条分发与归档。
Claude · ChatGPT · n8n
指南15 分钟
个人 AI 知识库:从聊天记录到可检索资产
用最小成本搭建个人/小团队知识库:收集、切片、检索、注入 Prompt,避免上下文只存在于聊天窗口。
Claude · ChatGPT · Markdown
指南13 分钟
ChatGPT 与 Claude:个人开发者怎么选主力模型
从写代码、长文、中文表达、附件与工作流集成等维度对比 ChatGPT 与 Claude,给出个人与小团队的务实选型建议。
ChatGPT · Claude