会懂网AI资讯,9月4日
9月3日,Anthropic宣布全面升级Claude的“计算机使用”(Computer Use)能力。现在把一个任务交给Claude,它能在自己的后台窗口里点击、输入、打开应用、完成任务,而不接管你的鼠标和键盘——你做你的,它做它的,人机并行时代来了。

这次升级覆盖了Claude Cowork与Claude Code两个场景。在macOS 15及以上系统中,Claude默认通过后台窗口工作,不占用用户正在使用的鼠标键盘;如果你正在打字,它会主动等待,只有任务必须接管整个屏幕时,才会在每次会话首次发起前台操作前征求许可。功能面向Pro和Max订阅用户开放Beta,Linux版本还在测试。
从Anthropic公开的文档看,Claude的桌面操作仍建立在经典的“感知—决策—执行—反馈”循环上:每执行一步就截取当前窗口画面交给视觉模型理解,识别按钮、输入框、菜单和状态后生成动作,执行后再返回新截图判断成败。这也正是GUI智能体比普通工具调用更难的地方——屏幕只提供像素,同一个“提交”按钮可能出现在不同位置、尺寸和主题中。
执行策略上,Claude采用三级优先级:先尝试Gmail、Google Drive、Microsoft 365、Slack等原生连接器(最快最可靠),没有则用浏览器自动化,最后才动用屏幕控制。典型用例包括整合本地文件和连接服务编译竞争分析报告、打开手机模拟器发现UX问题、操作缺乏API的企业内部仪表盘。Anthropic也提醒,屏幕级交互没有沙盒隔离,要警惕恶意网页的提示注入攻击。
这是“AI Agent从演示走向日常”的关键一步。以前Claude控制屏幕,意味着你的光标、活动窗口和一下午都被“上交”;现在它在自己的窗口里安静干活,你在前台做别的事。当AI能在你办公的同时处理另一项任务,“AI同事”这个词才真正有了现实意义——它不再只是演示时惊艳、一用就打断你的玩具。




















暂无评论内容