Claude这次更新,重点不是更会聊天:AI Agent开始真正干活了

这两年看 AI 发布会,很容易产生一种疲劳感。

模型又变强了,跑分又涨了,上下文又长了。

普通用户真正关心的问题始终只有一个:

它到底能不能帮我把事情做完?

Anthropic 8 月 20 日更新的 Claude Platform,开始给出一个更明确的答案。

这次上线的重点包括 Computer Use、Browser Use、Skills API 和 Files API。Computer Use、Skills API、Files API 已经进入正式可用阶段。

如果只看名字,可能觉得又是一堆面向开发者的 API。

放到实际使用场景里看,变化很直观:

Claude 正在从“告诉你怎么做”,变成“直接进去帮你做”。

Claude已经可以像人一样操作软件

以前使用大模型处理工作,常见流程是:

你问 Claude 怎么操作一个后台。

Claude给你步骤。

你打开后台,找到对应按钮,复制内容,填写表格,再把结果发回给 Claude。

整个流程中,AI负责“大脑”,人负责“手”。

Computer Use 要改变的就是后半段。

Claude 可以读取屏幕截图,判断页面上的内容,然后点击、输入、滚动。

新增加的 Browser Use 又往前走了一步。

它不只是盯着网页截图猜“按钮大概在哪”,还能读取网页结构,识别具体的输入框、按钮和页面元素,再执行操作。

这类能力放在 Demo 里看起来可能只是“AI帮我点网页”。

放进公司每天重复几十次、几百次的工作里,意义完全不同。

例如:

整理后台数据、填写系统表单、跨多个页面录入资料、查询订单状态、下载文件、处理没有 API 的老系统。

很多公司的真实工作流,并没有漂亮的 API。

大量工作依旧靠员工登录网页,一个页面一个页面地点。

Claude现在瞄准的就是这部分。

Skills API更值得关注

我觉得这次更新里,Skills API 的价值甚至比“自动点击网页”更大。

一个通用 AI 很聪明,不代表它懂你公司的做事方式。

  • 财务部门有自己的模板。
  • 运营团队有固定流程。
  • 客服有回复规范。
  • 开发团队有内部脚本。
  • 不同公司处理同一件事情的方法也完全不同。

Skills API 允许开发者把一套指令、脚本、模板打包成一个 Skill,让 Claude 在需要的时候调用。

Claude不需要每次重新阅读几十页说明书。

需要做某项工作时,直接加载对应的 Skill。

这很接近企业真正需要的 AI 员工。

不是每次都告诉它:

“第一步干什么,第二步干什么,Excel格式是什么,最终文件怎么命名。”

这些规则可以提前写进去。

Files API补上了另外一块

AI Agent真要工作,肯定绕不开文件。

合同、PDF、Excel、报价单、产品资料、报告,全都需要读取和生成。

Files API 提供了一套更直接的文件存储方式。

文件上传一次,后续任务可以直接通过文件 ID 调用,不需要每次请求都重新上传。

Claude生成的文件也可以直接保存下来。

这次更新后,Files API 还增加了自动过期机制,提高了速率限制,每个组织提供最高 1TB 存储。

  • Computer Use负责操作软件。
  • Browser Use负责操作网页。
  • Skills负责告诉Claude“我们公司应该怎么做”。
  • Files负责管理工作过程中需要的资料。

把这几块拼起来,Agent才开始有一点完整工作流的样子。

“AI Agent”终于没那么像概念了

过去一年,“Agent”这个词已经快被科技公司用烂了。

很多所谓 Agent,本质还是聊天机器人外面包了一层自动化。

你问一句。

它调用一次工具。

返回一个结果。

结束。

真正有价值的 Agent,需要连续完成一串任务。

  • 打开网页。
  • 查资料。
  • 判断信息。
  • 填写内容。
  • 处理文件。
  • 发现页面变化后调整操作。
  • 最后交付结果。

Anthropic公布的一个客户案例很有意思。

一家处理医疗和保险流程的公司测试新版 Computer Use 后,最长的一项理赔工作流从 32分钟缩短到了13分钟,每项任务的成本下降约 30%

这类数据比模型跑分更值得看。

企业买 AI,不是为了看 Benchmark。

企业想知道一件事:

原来一个人需要30分钟完成的工作,AI能不能稳定做到10分钟。

对普通Claude用户有什么影响?

短期看,这套更新明显偏开发者和企业用户。

普通用户不一定马上会直接接触 Skills API、Files API。

Claude面向个人用户的方向也已经很清楚。

Claude Cowork、Claude Code、Computer Use 都在不断增加“执行任务”的能力。

Anthropic 今年3月已经把电脑操作能力带进 Claude Cowork 和 Claude Code;8月的这轮更新,更像是在把这些能力整理成开发者可以正式拿来构建产品的基础设施。

未来使用 AI,可能越来越少出现这种对话:

“帮我告诉我怎么做。”

更多会变成:

“把这个任务做完。”

这两个句子看起来只差几个字,背后的产品逻辑完全不同。

用Claude的人,付费方式也开始变复杂

Claude功能越来越多,付费场景也不再只有一个 Pro 会员。

目前美国地区 Claude Pro 是每月 20 美元;高频用户还有 Max 方案。

Claude订阅和 Claude API 又是两套独立的计费体系。Pro、Max 等订阅本身并不包含 Claude Console 的 API 用量。

API 目前主要采用预付 usage credits 的形式。

开发者需要先充值额度,余额耗尽后 API 会停止调用,也可以设置 Auto-reload 自动充值。

这也是很多国内开发者开始关注海外支付工具的原因。

用 Claude 聊天是一种场景。

跑 Claude Code、API、Agent 项目,又是另一种场景。

长期使用时,支付工具最好能单独管理预算和消费记录。

我们自己的 MXK8 虚拟卡也主要在做这类海外线上支付场景。需要订阅 Claude、AI 开发工具或其他海外 SaaS 时,可以按不同用途开卡,方便把 AI 工具的支出单独管理。

这类工具我更建议当成支付基础设施来看。

能正常完成订阅、方便控制预算,比单纯追求“多开几张卡”更重要。

Claude这次更新真正值得看的地方

我现在越来越少关注“Claude和GPT谁跑分更高”这种问题。

模型能力到今天这个阶段,单纯多几个百分点,很难直接改变大部分人的工作。

真正会改变工作方式的,是模型开始拥有手脚。

  • 能看网页。
  • 能操作软件。
  • 能调用公司的流程。
  • 能读写文件。
  • 能连续完成任务。

Claude这次更新没有发布一个名字更大的新模型。

它做了一件可能更重要的事情:

开始把AI从聊天框里往外搬。

下一阶段真正值得关注的竞争,可能已经不是“谁回答得最好”。

而是:

谁能真正把工作做完。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值