Anthropic默认开启Claude Code自动模式:AI比人工安全

商业品牌
2026 08-16 06:59:52
分享

  【CNMO科技消息】8月10日消息,人工智能公司Anthropic宣布将从8月14日起,为其Claude Code编程工具的Pro、Max和Team账户默认启用自动模式。这一调整意味着用户在使用Claude Code进行编程时,将大幅减少人工审批环节,由AI自主判断哪些操作需要人类介入,哪些可以自动执行。

Claude
Claude

  自动模式并非全新功能,Anthropic早在今年3月便推出了测试版本,将其定位为平衡效率与控制的解决方案。根据该公司上周五发布的说明,当Claude Code处于自动模式时,系统不再在每一步操作前都弹出提示请求人工确认,而是自主判断当前动作是否属于"不可逆、具有破坏性或指向外部环境"的范畴。只有在触发这些条件时,系统才会暂停并请求用户审批。

  Anthropic公布的一项测试数据引发了业界关注。在一项涉及1053名付费用户的对照研究中,自动模式成功拦截了89%的有害操作,而人工审核仅拦截了13.6%。该公司分析认为,这一反差可能源于人工审核的惯性化问题——用户在Claude Code中批准权限提示的比例高达97%,意味着绝大多数情况下人工审核只是形式上的确认,并未真正起到把关作用。

  Claude Code负责人鲍里斯·切尔尼在社交平台X上表示,他和团队已经 exclusively 使用自动模式数月之久,无法想象回到需要逐条确认提示的状态。这一表态显示出Anthropic内部对自动模式的高度认可,也暗示了该公司在产品开发过程中已经深度依赖这一工作方式。

  在推出默认自动模式的同时,Anthropic也在强化配套的安全机制。公司表示已新增提示词注入筛查功能,并引入了可自定义的硬拒绝规则,以防止数据外泄等安全风险。这些措施旨在弥补自动模式下人工监督减少可能带来的安全隐患,确保AI在获得更多自主权的同时不会突破安全边界。

来源:手机中国
The End
免责声明:本文内容来源于第三方或整理自互联网,本站仅提供展示,不拥有所有权,不代表本站观点立场,也不构成任何其他建议,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容,不承担相关法律责任。如发现本站文章、图片等内容有涉及版权/违法违规或其他不适合的内容, 请及时联系我们进行处理。