Anthropic Engineering Blog 中文翻译¶
Anthropic 工程博客的中文意译版本,涵盖 AI Agent 构建、评测、安全、工具设计等工程实践(25 篇)。
更新时间:20260810
- 原文:https://www.anthropic.com/engineering
- 在线阅读:https://docs.thinkycx.me/anthropic-com-engineering-cn/
- 进度:25/25
翻译规范¶
- 意译不直译,短句不删减
- 段首加粗一句话总结
- 对比/列举信息表格化
- Prompt/代码保留英文
- 链接用远程完整 URL
- description 2-3 句话概括核心内容
文章列表¶
| # | 日期 | 原文 | 翻译 | 描述 |
|---|---|---|---|---|
| 1 | 2026-05-01 | 原文 | 【译】我们如何在各产品中隔离 Claude | Anthropic 工程团队详细介绍了如何在 claude.ai、Claude Code 和 Claude Cowork 三款产品中实现 Agent 隔离与控制。文章系统性地剖析了三类风险(用户滥用、... |
| 2 | 2026-04-23 | 原文 | 【译】近期 Claude Code 质量问题复盘 | Anthropic 追踪到近期 Claude Code 质量下降的报告源于三个独立的变更:推理努力等级默认值调整、缓存优化 bug 导致推理历史丢失、以及一条降低冗长度的系统提示词削弱了编码能力。三个... |
| 3 | 2026-04-08 | 原文 | 【译】规模化托管 Agent:将大脑与双手解耦 | Anthropic 介绍了 Managed Agents 的架构设计哲学——将 Agent 的"大脑"(harness + Claude)与"双手"(沙箱/工具)解耦,通过稳定的接口抽象(Sessio... |
| 4 | 2026-03-25 | 原文 | 【译】Claude Code Auto Mode:一种更安全的权限跳过方式 | Anthropic 工程团队详解 Claude Code auto mode 的设计与实现。auto mode 通过双层防御(输入层注入探测 + 输出层转录分类器)在安全与自主性之间取得平衡,替代了手... |
| 5 | 2026-03-24 | 原文 | 【译】面向长时间应用开发的 Harness 设计 | Anthropic 通过多 Agent 架构(规划者、生成者、评估者)推动 Claude 在前端设计和长时间自主编程方面的能力边界。核心创新是借鉴 GAN 思想分离生成与评估,解决了模型自我评价偏差和... |
| 6 | 2026-03-06 | 原文 | 【译】Claude Opus 4.6 在 BrowseComp 中的评测感知行为 | Anthropic 在 BrowseComp 基准测试中发现 Claude Opus 4.6 能够自主推断自己正在被测试、识别具体是哪个评测、并解密答案密钥。这是首次有模型在未被告知具体评测名称的情况... |
| 7 | 2026-02-05 | 原文 | 【译】用并行 Claude 团队构建 C 编译器 | Anthropic 研究员用 16 个并行 Claude Agent 组成团队,从零构建了一个 10 万行 Rust 代码的 C 编译器,能够编译 Linux 6.9 内核。文章分享了如何设计 Age... |
| 8 | 2026-02-05 | 原文 | 【译】量化 Agent 编码评测中的基础设施噪声 | Anthropic 发现基础设施配置(CPU/内存限制、沙箱实现方式)对 Agent 编码评测分数的影响可达 6 个百分点,往往超过排行榜上模型之间的差距。文章通过对 Terminal-Bench 2... |
| 9 | 2026-01-21 | 原文 | 【译】设计抗 AI 的技术面试评估 | Anthropic 性能工程团队负责人 Tristan Hume 分享了设计技术面试 take-home 的迭代过程——随着 Claude 模型能力持续增强,如何设计出仍能有效区分候选人能力的技术评估... |
| 10 | 2026-01-09 | 原文 | 【译】揭秘 AI Agent 评估 | Anthropic 工程团队总结了为 AI Agent 构建评估体系的完整方法论:从评估的核心结构(任务、评分器、试验)、不同类型 Agent(编码/对话/研究/计算机操作)的评估策略、到从零构建评估... |
| 11 | 2025-11-26 | 原文 | 【译】长时间运行 Agent 的高效框架设计 | 当 AI Agent 需要跨越多个上下文窗口处理复杂的长时间任务时,容易陷入"一次做太多"或"过早宣布完成"的失败模式。Anthropic 为 Claude Agent SDK 设计了一套两阶段方案—... |
| 12 | 2025-11-24 | 原文 | 【译】Claude 开发者平台的高级工具使用 | Anthropic 发布了三项高级工具使用特性:Tool Search Tool(按需发现工具,减少 85% token 占用)、Programmatic Tool Calling(通过代码编排工具调... |
| 13 | 2025-11-04 | 原文 | 【译】通过代码执行构建更高效的 MCP Agent | 随着 MCP 服务器数量增长,工具定义和中间结果会大量消耗上下文窗口 token,导致 Agent 效率下降。本文提出"代码执行"方案——让 Agent 编写代码调用 MCP 工具而非直接调用,从而实... |
| 14 | 2025-10-20 | 原文 | 【译】超越权限弹窗:让 Claude Code 更安全、更自主 | Claude Code 通过沙盒机制实现更安全、更自主的开发体验。文章介绍了两个核心功能:本地沙盒 Bash 工具(文件系统+网络双重隔离)和 Web 版 Claude Code(云端隔离沙盒+Git... |
| 15 | 2025-10-16 | 原文 | 【译】用 Agent Skills 武装 Agent 应对真实世界 | Anthropic 提出了 Agent Skills 的概念——一种通过文件夹组织指令、脚本和资源的方式来赋予 Agent 领域专业能力。文章详细介绍了 Skill 的目录结构、渐进式信息披露(pro... |
| 16 | 2025-09-29 | 原文 | 【译】AI Agent 的高效上下文工程 | 本文探讨了如何为 AI Agent 设计和管理有效的上下文。涵盖上下文工程与提示工程的区别、上下文窗口的有限性、系统提示/工具/示例的最佳实践、检索策略(预加载 vs 即时探索)、以及长时间任务中的压... |
| 17 | 2025-09-17 | 原文 | 【译】三个近期问题的事后复盘 | Anthropic 对 2025 年 8-9 月间三个基础设施 Bug 的事后复盘。这些 Bug 导致部分 Claude 请求出现质量下降,涉及上下文窗口路由错误、输出乱码和 XLA:TPU 编译器缺... |
| 18 | 2025-09-11 | 原文 | 【译】为 Agent 编写高效工具——与 Agent 协作 | Anthropic 分享了为 Agent 编写高质量工具的方法论:从原型构建、评估驱动的迭代优化,到与 Claude Code 协作改进工具。核心观点包括工具应整合高层功能而非简单包装 API、返回高... |
| 19 | 2025-06-26 | 原文 | 【译】Desktop Extensions:一键安装 MCP 服务器 | Anthropic 推出 Desktop Extensions(.mcpb 文件),将 MCP 服务器的安装过程从复杂的命令行配置简化为一键双击安装。文章详细介绍了扩展的技术架构、manifest 规... |
| 20 | 2025-06-13 | 原文 | 【译】我们如何构建多智能体研究系统 | Anthropic 分享了 Claude Research 功能的多智能体系统从原型到生产的完整历程,涵盖系统架构(编排者-工作者模式)、Prompt 工程经验(8 条核心原则)、评估方法、以及生产环... |
| 21 | 2025-04-18 | 原文 | 【译】Claude Code 最佳实践 | Claude Code 作为 Agentic 编码环境的最佳实践指南,涵盖环境配置(CLAUDE.md、权限、MCP、Hooks)、有效沟通策略、会话管理技巧(上下文管理、检查点、子代理)以及自动化与... |
| 22 | 2025-03-20 | 原文 | 【译】Think 工具:让 Claude 在复杂工具调用场景中停下来思考 | Anthropic 介绍了"think"工具——一种让 Claude 在复杂工具调用场景中"停下来思考"的技术。通过在工具调用链中为模型提供结构化的思考空间,该方法在策略遵循、一致性决策和多步骤推理方... |
| 23 | 2025-01-06 | 原文 | 【译】在 SWE-bench Verified 上刷新纪录:Claude 3.5 Sonnet | Anthropic 介绍了升级版 Claude 3.5 Sonnet 在 SWE-bench Verified 基准测试上达到 49% 的 SOTA 成绩,并详细分享了其极简 Agent 脚手架设计—... |
| 24 | 2024-12-19 | 原文 | 【译】构建高效的 AI Agent | Anthropic 总结了与数十个团队合作构建 LLM Agent 的经验,提出了构建 Agent 系统的核心设计模式:从增强型 LLM 到工作流(路由、并行、编排-工作者、评估-优化器),再到完全自... |
| 25 | 2024-09-19 | 原文 | 【译】上下文检索(Contextual Retrieval) | Anthropic 提出"上下文检索"(Contextual Retrieval)方法,通过在文本分块前为每个块添加上下文说明,配合 BM25 和重排序技术,将传统 RAG 的检索失败率降低了 67%... |