昨天 GitHub 发了一篇挺有意思的文章,题目直接点出了一个越来越明显的问题:
Chat is great for intent, but agent work gets lost in the scroll.
我很认同。
过去两年,我们几乎默认了一个 UI 逻辑:
AI = Chat
用户输入一句话,AI 回复一大段。
可 Agent 一旦从“回答问题”变成“执行任务”,这个界面开始变得别扭。
比如一个 Coding Agent 正在做:
理解需求
→读 18 个文件
→拆 7 个任务
→修改 5 个文件
→跑测试
→修 3 个失败
→再跑测试
→等待人工确认
最后这一切都被塞进一条越来越长的聊天记录。
问题就来了。
我真正想看的不是它说了什么,而是它现在是什么状态
用户问:“现在做到哪了?”
聊天记录可能已经有 80 屏。
真正应该回答的是:
任务:登录模块重构
总步骤:7
完成:4
进行中:1
阻塞:1
待人工:1
已修改:
- AuthService.java
- JwtFilter.java
- LoginController.java
测试:
32 passed
2 failed
预算:
$1.82 / $3.00
这不是 Chat UI。
这是任务控制面。
GitHub 那篇文章里提到的一个现实问题很关键
Agent 生成代码的速度,已经开始超过人类 Review 的速度。
以前瓶颈是写代码,现在慢慢变成看 Agent 到底改了什么。
所以产品界面如果仍然只展示模型消息,人会越来越累。
因为 Review 需要的不是完整过程日志,而是:
变更
证据
状态
差异
决策点
一个 Agent Run,我希望至少有四个视图
Goal
最上面固定显示用户真正要完成什么。
例如:
修复登录偶发401,
不能改变现有Token格式,
必须通过全部Auth测试。


1726

被折叠的 条评论
为什么被折叠?



