今天留两条产品更新。Anthropic 把操作电脑、读取文件、复用团队技能的能力放进 Claude Platform;Mistral 则把多步检索做成 Agentic Search。它们都在处理同一件事:让模型不只回答,还能自己去找材料、调用工具、完成一段工作。

工具、文件和技能被装进同一个平台

Anthropic 宣布 Claude Platform 的 Computer Use、Skills API 与 Files API 已全面可用,并增加浏览器操作工具。开发者可以把文件交给模型处理,让它按预设的技能完成任务,再通过工具与网页或软件交互。

这比在聊天框里多加几个按钮复杂得多。模型一旦能读文件、点网页,问题很快从“回答得像不像”变成“它碰了哪些数据、做了哪些动作、出了错谁能停住”。平台把这些能力打包,确实能少搭很多基础设施;但权限范围、人工确认点和操作记录,仍得由使用它的团队自己写清楚。

如果你准备把这类能力接进工作流,先别急着让它替你提交、发送或删除。先让它处理一段可复核的任务:从一组文档里找信息、整理表格,或者在测试环境跑一遍网页流程。能看见过程、能检查结果,才有资格谈下一步自动化。

检索不该只靠一次提问

Mistral 发布的 Agentic Search 把检索拆成 search、open、navigate、read 和 grep 等多步动作。模型先搜索,再打开页面、定位段落、读取内容,必要时继续追问或换线索。

对需要查长文档、多个来源的人来说,这个方向比“给我一段摘要”更接近真实工作。真正费时间的地方,经常不是找到一篇资料,而是确认它是不是最新版本、关键句藏在哪一节、两份说法是否相互矛盾。把这些步骤交给模型能省时间,但引用是否对得上、结论有没有超出原文,最后仍要有人核对。

今天可以带走什么

现在看智能体产品,先问两件事:它能接触什么,它做完后谁来验收。前一条决定风险,后一条决定结果能不能上桌。

模型会越来越会找、会点、会写。把任务拆清楚,把高风险动作留给人,把来源和结果逐项核过,才不会把一条看似顺滑的流程,变成事后没人说得清的黑箱。