为什么我越来越觉得,Agent Workflow 真正碰到真实任务以后,最先暴露出来的不是能力,而是可托付性 #1138
lostlight530
started this conversation in
Ideas
Replies: 0 comments
Sign up for free
to join this conversation on GitHub.
Already have an account?
Sign in to comment
Uh oh!
There was an error while loading. Please reload this page.
最近刷到一些 Agent Workflow 的正式实践,我越来越有一个很强的感觉
当 workflow 还停留在 demo 阶段时,很多问题其实都比较好看
节点能串起来
工具能接进去
模型能调起来
流程也能顺利跑完
这时候我们很容易觉得,问题已经差不多解决了
但一旦 workflow 真开始碰真实任务,味道就变了
因为系统接下来最先暴露出来的,往往不是“它还会不会做”
而是“我还敢不敢继续把事交给它做”
这种变化其实很微妙
一开始各位讨论的是流程组织
后来讨论的是工具调用
再后来开始讨论记忆、异步任务、轨迹面板、长期运行
但越往后走,我反而越觉得,这些都只是把问题慢慢推到了另一层
那一层不是“能力上限”
而是“可托付性”
比如有些问题一开始不显眼
可一旦任务变长、工具变多、状态开始积累,它们就会非常真实地冒出来
系统什么时候可以自己执行
什么时候应该先停下来问一下人
哪些信息真的值得进入长期记忆
哪些内容其实只适合留在本次运行里
任务跑到一半失败以后
到底应该自动恢复
还是交还给人
还有一种很常见的错觉
就是系统看起来已经跑完了
但“跑完”和“可靠完成”其实不是一回事
我最近越来越在意的,就是这类问题
因为它们已经不只是 workflow 编排本身能解释的了
workflow 能把流程组织起来
tool use 能把能力接进来
memory 能让状态延续下去
但这些东西开始成立以后,系统还是会继续追问另一件事
它到底能不能被托付
所以我现在更想讨论的,不是 workflow 还能再加多少节点
而是当 workflow 开始走向真实场景以后
平台是不是迟早都要面对这样一层问题
高风险动作怎么设闸门
长期记忆怎么立边界
失败后的任务怎么恢复和回放
运行轨迹怎么被人理解和审计
系统又怎么避免随着能力增长而越来越乱
我最近越来越倾向于把这层问题理解成“驾驭工程”
不是为了让 Agent 更像人
而是为了让 Agent 更值得被托付
也想听听各位的感觉
在真实 workflow 里,你们最早遇到的“不可托付”问题,通常是什么
All reactions