不讲代码 · 只讲业务感受——用户等多久 · 能不能中途看到进度 · 出错怎么办 ·
运营能不能干预方向 · 未来能不能加"重新出这套图"这种功能。
结论:现在是一根绳子拽到底,agent 化后是几个工种并行接力。
每一格是一步智力活。现在的问题:后端 4 步(深化 6 方向 · 出图 · 对比 · 装配报告)本来彼此不用等,但代码里是硬串行,一步接一步排队做。 Agent 化后:同一时间多个"工种"并行开工,总时长压掉一半以上。
两张真实感的界面 mockup。左边是现在——转圈 + 百分比,黑盒 14 分钟。 右边是 Agent 化后——每个 agent · 每次工具调用(联网搜索 / 生成图片 / 写文案 / 装配报告)都实时打出来,像看厨房出菜。
不是抽象的架构好坏 · 是下面这 6 类具体情况下,用户 / 运营 / 客服的实际体验差多少。
12~16 分钟(中位数 14)
只能看进度条从 1% 爬到 100%。中间任何一步慢,整个报告都要跟着等 —— 因为下一步一定在等上一步的结果。
5~8 分钟(中位数 6)
用户能实时看到"情报研究员 · 已完成 / 品牌顾问 · 完成 / 6 位设计师 · 4 完成 2 进行中"——像看厨房出菜。
报告跑到第 9 步(出图)失败 = 前 8 步全部作废,从头再来。
已经跑好的品牌情报、6 个方向,统统丢掉。用户看到"生成失败请重试"。
已扣积分不自动退。
系统记得每步的进度(存盘)。第 9 步失败,只重跑第 9 步。
用户体验:"图生成失败,正在重试主推方案"——前 8 步的分析结果都在,秒级恢复。
不能。系统一旦启动就跑到底,运营只能事后打回让用户重出。
比如总监 AI 挑了 6 个方向,但运营看第 2 个明显走偏,只能等报告出完再说。
能在关键节点暂停等人。比如"总监选完 6 个方向"这一步后暂停,运营看一眼没问题再继续。
vip 客户可以有"总监选完 → 客户扫一眼 → 确认后再深化"的模式,复用同一流水线。
有"重生成第 X 张"按钮,但走的是另一条特殊代码路径,跟主流程逻辑分叉 —— 出过几次 bug。
用户要重新出报告全部内容?整份 200 积分重跑,前面的策略分析白算。
任何一步都能单独重跑——重挑 6 方向 / 重深化某个方向 / 重出某张图 / 重写报告结论。都是同一套流水线,不用另写代码。
后续可以做"保留策略只换风格" 这种精细化服务。
要加"礼盒专属流程"或"跨境 SKU 特殊阶段"—— 得动主循环代码 · 改 10 个阶段的分派器 · 各种 if-else。
结果:PM 想加什么都要排开发档期,新品类上线周期 2~4 周。
阶段是独立模块,新加"礼盒仪式感检查员"这种 agent 只需 2~3 天——写个新 agent + 决定它接在哪一步后面。
不同套餐/品类走不同流水线,而不是所有客户走同一条硬编码链。
要工程师翻 log · 手工拼时间线 · 猜是哪一步的 AI 出问题。一次排查 30~60 分钟。
而且失败了就没了 —— 想复现同一个用户的报告基本不可能。
每一步的中间产物都存下来——后台直接看"这个报告在总监阶段产出了这 6 个方向,然后设计师给了这份 brief..."
能直接复现某步:"重跑这个用户的总监阶段看看这次挑什么方向"。
并行、可暂停、每步都能单跑 · 这三样合起来解锁一批新的产品形态。挑 4 个最容易赚钱的。
每 6 方向出完后暂停,由真人设计总监(或 vip 客户本人)扫一眼,确认后再进入深化 + 出图阶段。
可能定价:¥299~499/份 · 加 100 积分为 VIP 附加值
用户之前生成过的品牌策略、目标用户判断整套保留,只换发散阶段拿到 6 个新方向。省 60% 积分。
可能定价:80 积分/份(vs 全新 200)· 提升用户复购
用户看了主推图不满意,单独让"设计师 + 出图"两步重跑,策略不动。秒出而不是 14 分钟。
可能定价:30 积分/次 · 现在的重生成是全流程,可以这样优化
每个特殊品类挂自己的合规检查员 + 特殊阶段(礼盒的仪式感检查 / 跨境的语言层级检查 / 药妆的功效边界检查)。
可能定价:作为 pro/vip 独有权益,或按品类差异化定价
Agent 版本是新建的独立模块 · 老 workflow 完全不动 · 界面加一个开关让用户主动 opt-in 试用。
所以不存在"迁移事故 / 灰度切换风险",风险主要在下面这 3 处。
Prompt 改一次要同步到老 workflow + agent 版本两个入口。schema 变更 · 品类新增 · 合规规则更新都得改两遍,长期是双倍维护成本。
老版本是串行,一次一个;agent 版并行后同一时刻要打 6 个 image API。供应商限流可能拦截,高峰时段可能不稳定。
过去 48 小时进了 6 个 commit —— 团队还在冲刺阶段。做 agent 新模块会占用一部分开发精力,可能拖延其他功能上线。
现在生产里一个 stage 只是 "prompt + 输出 schema" 两样东西 · 分散在 7 个不同文件里。 Agent 化后每个 agent 变成 一个 YAML 声明式定义,7 件事集中在一起——加新 agent = 加一个 YAML · 改 agent = 改一个文件。这才是 "能力包" 的真正含义。
| Agent | 业务边界 | 独有工具 | 独有 Gate | 可调项 |
|---|---|---|---|---|
| intake-dialogue | 只采集不判断 · 反问补齐 confirmation 字段 | - | confirmation 字段齐全 | 对话轮次上限 · 反问深度 · 智能默认值 |
| source-intake | 纯装配 · 无 LLM · 从 intake 域搬素材到 workflow 域 | - | requiredFields 4 项 | 无(系统步骤) |
| packaging-intelligence | 品类竞争判断 · 唯一联网阶段 | web_searchweb_extract | minReferences: 3 · 每 ref 5 字段必填 | 检索深度 · 竞品数量 · 每维度必备字段 |
| brand-strategy | 商业判断 · 禁"高级 / 年轻 / 差异化" 空词 | - | requireSections 3 项(定位/用户/差异化) | 目标用户深度 · 差异化切入维度 |
| copy-compliance | 文案白名单 · 品类风控 | compliance-router | requirePass: true | 品类分流规则 · 每品类高风险表达列表 |
| creative-exploration | 发散 12–18 · 不筛选 · 覆盖 10 路线 | - | minConcepts: 12 · maxConcepts: 18 | 10 路线覆盖率 · 每 territory 长度约束 |
| director-selection | 收敛 6 · 100 分制打分排序 · 关键漏斗 | quality-scorer | 正好 6 · id 稳定 · tier 分布 · rec=1 且在前 3 | 5 维评分权重 · 主推硬规则清单 |
| designer-directions | 6 方向深化 · fan-out × 6 并行 | - | 继承 tier/id 禁改 · 每方向 14 字段 | 深化模块清单 · imagePrompt 长度约束 |
| image-brief | 出图 · 主推同步 · 其他异步 · fan-out × 6 | image_generatelogo_reader | 主推失败 = workflow fail | size / quality / n / input_fidelity 参数 |
| difference-review | 仅 upgrade · 6 维新旧对比 | - | allowEmptyWhenNoLegacy | 对比维度权重 |
| report-presentation | 装配 + 改稿 · 不重新发明策略 · final | report-template | 9 sections · 6 directions · rec ≥ 1 | section 骨架 · conclusion 结构模板 |
现在这三样东西都硬编码在 prompt 字符串里,agent 化时抽成独立工具 · 让运营改规则不用改 prompt · 直接改 tool config。
Agent 化不是一次性交付 · 是每周都在跑的常态化工作流。调优的本质是"缩短反馈闭环" —— 从"发现问题"到"改完上线"的时间从现在的数天压到分钟级。
每一阶段都是独立可停的 —— 做完 Phase 0 也已经修了当前最痛的债,后续不做也不亏。老 workflow 永远不动,新模块跑不好用户还能用老的。
现在:AI 报告像流水线上一根绳子拽到底 —— 一步接一步 · 中间挂了从头再来 · 用户等 14 分钟 · 运营不能干预 · 加新品类要 2~4 周。
Agent 化后:变成几个专业工种同时开工 —— 一队 AI 顾问 · 一队设计师 · 一队图片模型并行接力 · 每步进度可见 · 失败只重跑那一步 · 用户等 6 分钟 · 关键路口能踩刹车 · 加新品类 2~3 天。
怎么落地?Agent 版是新建独立模块 · 老 workflow 永远不动 · 生成页加个开关让用户 opt-in。先做 Phase 0(1 周 · 零风险,修当前 prompt drift 债 · 两版都受益)—— 不管后续做不做,这步都稳赚。做完再决定要不要走 Phase 1 spike 验证。
每个任务包含 Owner / 时长 / 依赖 / 输入 / 输出 / 验收标准,可打钩执行。
含 7 里程碑 · 6 决策点 · 7 风险与护栏 · 附录含文件路径速查和老 workflow 黑名单。
核心约束:老 workflow 完全不动 · 用户端加开关 opt-in · 老版永远兜底。