Claude Blog 中文翻译

create: 2026-08-07
update: 2026-08-10
author: thinkycx
title: 【译】在生产环境中使用 Auto Mode
description: Nuro、Gusto 和 Garner Health 三家公司分享了在生产环境中使用 Claude Code Auto Mode 的实践经验。Auto Mode 通过分类器自动评估每个操作的安全性,在速度与安全之间找到平衡——内部评估表明它比人工逐一审批更能有效拦截危险操作,同时让 Claude 在两次中断之间的工作时长提升了 9 倍。
category: translation
tags: claude, blog, translation, auto-mode, production

在生产环境中使用 Auto Mode

原文发布于 2026 年 8 月 7 日,作者 Molly Vorwerck


Auto Mode 现已成为默认设置

Auto Mode 解决了 Agentic 编码中最常见的权衡难题:速度 vs. 安全。 Auto Mode 现在是 Claude Code 的默认设置。它不再要求你逐一审批 Agent 想要执行的每个命令,而是由一个分类器评估每个操作,并阻止那些看起来具有潜在危害的操作。

逐一审批命令虽然能保持人在环路中,但当会话延长到数小时或同时并行多个时,这种审批就成了瓶颈。完全跳过权限检查虽然更快,但也是 prompt 注入、范围漂移和偶发的生产资源被删除得以发生的原因。

Auto Mode 填补了这个缺口。在内部评估中,分类器比开发者手动点击审批按钮拦截了更多危险操作,并且这一表现经受了第三方红队测试的考验。由于会话暂停频率大幅降低,Claude 在两次中断之间的工作时长比之前的默认模式提升了 9 倍——覆盖所有 Claude Code 使用场景。

为了了解 Auto Mode 在生产环境中的实际表现,我们与 Nuro、Gusto 和 Garner Health 的团队进行了交流。


Nuro:驱动长时间自主运行的 Agent

Auto Mode 最大的价值在于让工作在工程师下班后继续运行。 Nuro 是一家开发通用 L4 自动驾驶技术的物理 AI 公司,于 2025 年末采用 Claude Code,到 3 月已成为公司最受欢迎的 Agentic 编码工具。

在 Auto Mode 推出之前,高级软件工程师 Kai Zhou 已经在原型一个内部替代方案:一个 hook 将每个待执行操作发送给小模型,90% 的常规操作自动放行,敏感操作则路由到 Slack 由人工审核。这个原型解决了一个真实的矛盾:工程师讨厌坐着点审批按钮,但从公司安全和法律角度看,完全跳过权限又太危险。Auto Mode 推出后,Kai 搁置了这个项目。

如今,Kai 所有的编码工作都使用 Auto Mode:

"我不想坐在那里一直点 approve。我 100% 的编码工作都用 Auto Mode。大多数时候,我开三四个并行会话,需要时才去查看。"

唯一的例外是涉及其他团队的工作——比如 Claude Code 代表他审查 Pull Request 时,Kai 会切回交互模式逐一审查。

Nuro 大量使用 skills,工程师在设置中直接禁止最危险的命令(如递归删除)。分类器在这些护栏内做出判断。

更大的解锁是让工作在工程师下班后持续运行。Kai 的团队用 Auto Mode 驱动长时间研究 Agent,对自动驾驶评估套件中的指标进行爬坡优化——这类任务有明确的、可衡量的信号,Agent 可以自主迭代。整夜运行中,Agent 可以研究评估套件标记的假阴性(false negatives)、起草提案、运行实验并持续迭代结果。这种方式可扩展到任何有明确评估方法的任务——Nuro 另一个团队用它来压缩特定二进制文件的内存占用——因为指标本身会告诉 Agent 它是在改善还是退步。

"前几天我晚上 10 点启动了一个 Agent,它一直运行到凌晨 5 点——早上给了我三个 PR。只有 Auto Mode 能支撑这种工作负载。"


Gusto:更快更安全地发布 PR

Auto Mode 在不牺牲安全的情况下提供了同等的速度,跨仓库工作不再因权限审批而中断。 Gusto 是一家领先的中小企业技术公司,其向 Auto Mode 的迁移始于一次主动的安全升级。

AI Dev Tools 团队的 Martin Emde 观察到权限疲劳拖慢了团队。Auto Mode 在不牺牲控制或安全的前提下提供了同等速度。自 12 月以来,Martin 已启动 2,425 个 Claude Code 会话,Auto Mode 是他的日常驱动。跨仓库工作不再因文件夹访问审批而中断,无人值守的任务(如从 GitHub、Slack、Jira 汇编每日笔记)自行运行。

在团队分析中,自 2026 年 5 月中旬以来,约 10% 的会话记录中出现了 Auto Mode 拒绝操作的记录——证明分类器在切实工作,同时不会拖累合法任务。

"Auto Mode 给了我们速度和控制之间更安全的平衡。我们能看到 Auto Mode 在正确的时机阻止操作,这给了我们快速前进的信心。"

Gusto AIT Cloud Engineering 团队的 Chad Kunsman 从另一个方向得出了相同结论。他的工作——端点调查、日志审计、连接器管理、跨 MCP 服务器的文档导入——以 20 分钟的短时爆发运行,而非通宵马拉松。他不追求更长的运行时间,而是想要 bypass permissions 的免打扰节奏,但不承担坏 prompt 或 prompt 注入溜过去的风险。

"考虑到对 prompt 注入的防护,以及它检查你的操作是否真的符合你原始请求的方式,它比 bypass permissions 更好,比 permission prompts 快得多。"

分类器偶尔介入时,Chad 说它判断准确:

"当它阻止我时,解释得很合理——正在偏离我原来的请求,所以它来确认。完全没有误判。"

对于最敏感的工作——Terraform、AWS、对线上 API 的直接 POST 调用——Chad 仍会切回手动审批模式。

"你必须权衡节省的时间和它可能犯错的严重程度。最终,你仍然要为发生的事情负责。"

Gusto 还将 MCP 流量通过一个带有工具防护和 prompt 检查的治理代理层路由,形成纵深防御。


Garner Health:加速整个 SDLC

Auto Mode 使基于 Agent 的标准化 SDLC 流程成为可能,员工不再需要连续数小时监视 Agent。 Garner Health 是一家医疗科技公司,2 月向全部 550 名员工推出 Claude Code,覆盖所有职能。该工具接入了所有核心系统,包括 Salesforce、Zendesk 和 Snowflake,员工被鼓励每周花约两小时自动化工作中最重复的部分。

在 Auto Mode 之前,这种规模带来了开销。平台工程经理 Evan Magnussen 形容权限管理是一个繁琐的循环——手动维护已批准命令列表,看着管道命令被拒绝。

现在,Evan 和大部分同事在每个会话中都使用 Auto Mode:

"我们为整个工程组织构建了一套标准化的软件开发生命周期,这只有在 Auto Mode 的支持下才可能实现。员工视其为肩上卸下的重担——他们不再需要连续数小时监视 Agent。"

该生命周期作为标准化 skills 的插件运行。Agent 接手任务、探索可访问的上下文、将上下文文件提交到仓库、运行 Evan 所谓的"对抗性研究"来对自己的假设进行压力测试,然后进入实现阶段——只有在找不到所需上下文时才暂停等人类介入。Evan 指出,这些研究密集型阶段在 Auto Mode 之前是不可能的。

分类器开箱即用几乎不需要调整。Evan 唯一的调整与 Nuro 的 Kai 类似:配置 Auto Mode 不自动批准与他人沟通的操作,比如发送 Slack 消息或邮件。"我个人不喜欢 Claude 在我与另一个人沟通时代表我行事,"他说。

他对其他企业推广 Auto Mode 的建议是:

"如果我们说——大家自己去构建工作流,没有任何遥测数据——那会非常危险。正因为我们有遥测,有相对标准的工作流,我们才有更多信心。"


开始使用

要点 说明
默认模式 Auto Mode 现在是 Claude Code Pro、Max 和 Team 计划的默认设置
核心机制 分类器评估每个操作,阻止潜在危险操作
性能提升 两次中断之间的工作时长提升 9x
安全验证 拦截能力优于人工审批,经第三方红队测试验证
自定义 通过 skills、settings 禁止危险命令,配合 hooks 使用

在 Claude Code 中开始使用 Auto Mode