Anthropic Engineering Blog 中文翻译

create: 2024-09-19
update: 2026-08-10
author: thinkycx
title: Anthropic Engineering Blog 中文翻译
description: Anthropic 工程博客的中文意译版本,涵盖 AI Agent 构建、评测、安全、工具设计等工程实践(25 篇)。
category: translation
tags: anthropic, engineering, 翻译

Anthropic Engineering Blog 中文翻译

Anthropic 工程博客的中文意译版本,涵盖 AI Agent 构建、评测、安全、工具设计等工程实践(25 篇)。

更新时间:20260810

  • 原文:https://www.anthropic.com/engineering
  • 在线阅读:https://docs.thinkycx.me/anthropic-com-engineering-cn/
  • 进度:25/25

翻译规范

  • 意译不直译,短句不删减
  • 段首加粗一句话总结
  • 对比/列举信息表格化
  • Prompt/代码保留英文
  • 链接用远程完整 URL
  • description 2-3 句话概括核心内容

文章列表

# 日期 原文 翻译 描述
1 2026-05-01 原文 【译】我们如何在各产品中隔离 Claude Anthropic 工程团队详细介绍了如何在 claude.ai、Claude Code 和 Claude Cowork 三款产品中实现 Agent 隔离与控制。文章系统性地剖析了三类风险(用户滥用、...
2 2026-04-23 原文 【译】近期 Claude Code 质量问题复盘 Anthropic 追踪到近期 Claude Code 质量下降的报告源于三个独立的变更:推理努力等级默认值调整、缓存优化 bug 导致推理历史丢失、以及一条降低冗长度的系统提示词削弱了编码能力。三个...
3 2026-04-08 原文 【译】规模化托管 Agent:将大脑与双手解耦 Anthropic 介绍了 Managed Agents 的架构设计哲学——将 Agent 的"大脑"(harness + Claude)与"双手"(沙箱/工具)解耦,通过稳定的接口抽象(Sessio...
4 2026-03-25 原文 【译】Claude Code Auto Mode:一种更安全的权限跳过方式 Anthropic 工程团队详解 Claude Code auto mode 的设计与实现。auto mode 通过双层防御(输入层注入探测 + 输出层转录分类器)在安全与自主性之间取得平衡,替代了手...
5 2026-03-24 原文 【译】面向长时间应用开发的 Harness 设计 Anthropic 通过多 Agent 架构(规划者、生成者、评估者)推动 Claude 在前端设计和长时间自主编程方面的能力边界。核心创新是借鉴 GAN 思想分离生成与评估,解决了模型自我评价偏差和...
6 2026-03-06 原文 【译】Claude Opus 4.6 在 BrowseComp 中的评测感知行为 Anthropic 在 BrowseComp 基准测试中发现 Claude Opus 4.6 能够自主推断自己正在被测试、识别具体是哪个评测、并解密答案密钥。这是首次有模型在未被告知具体评测名称的情况...
7 2026-02-05 原文 【译】用并行 Claude 团队构建 C 编译器 Anthropic 研究员用 16 个并行 Claude Agent 组成团队,从零构建了一个 10 万行 Rust 代码的 C 编译器,能够编译 Linux 6.9 内核。文章分享了如何设计 Age...
8 2026-02-05 原文 【译】量化 Agent 编码评测中的基础设施噪声 Anthropic 发现基础设施配置(CPU/内存限制、沙箱实现方式)对 Agent 编码评测分数的影响可达 6 个百分点,往往超过排行榜上模型之间的差距。文章通过对 Terminal-Bench 2...
9 2026-01-21 原文 【译】设计抗 AI 的技术面试评估 Anthropic 性能工程团队负责人 Tristan Hume 分享了设计技术面试 take-home 的迭代过程——随着 Claude 模型能力持续增强,如何设计出仍能有效区分候选人能力的技术评估...
10 2026-01-09 原文 【译】揭秘 AI Agent 评估 Anthropic 工程团队总结了为 AI Agent 构建评估体系的完整方法论:从评估的核心结构(任务、评分器、试验)、不同类型 Agent(编码/对话/研究/计算机操作)的评估策略、到从零构建评估...
11 2025-11-26 原文 【译】长时间运行 Agent 的高效框架设计 当 AI Agent 需要跨越多个上下文窗口处理复杂的长时间任务时,容易陷入"一次做太多"或"过早宣布完成"的失败模式。Anthropic 为 Claude Agent SDK 设计了一套两阶段方案—...
12 2025-11-24 原文 【译】Claude 开发者平台的高级工具使用 Anthropic 发布了三项高级工具使用特性:Tool Search Tool(按需发现工具,减少 85% token 占用)、Programmatic Tool Calling(通过代码编排工具调...
13 2025-11-04 原文 【译】通过代码执行构建更高效的 MCP Agent 随着 MCP 服务器数量增长,工具定义和中间结果会大量消耗上下文窗口 token,导致 Agent 效率下降。本文提出"代码执行"方案——让 Agent 编写代码调用 MCP 工具而非直接调用,从而实...
14 2025-10-20 原文 【译】超越权限弹窗:让 Claude Code 更安全、更自主 Claude Code 通过沙盒机制实现更安全、更自主的开发体验。文章介绍了两个核心功能:本地沙盒 Bash 工具(文件系统+网络双重隔离)和 Web 版 Claude Code(云端隔离沙盒+Git...
15 2025-10-16 原文 【译】用 Agent Skills 武装 Agent 应对真实世界 Anthropic 提出了 Agent Skills 的概念——一种通过文件夹组织指令、脚本和资源的方式来赋予 Agent 领域专业能力。文章详细介绍了 Skill 的目录结构、渐进式信息披露(pro...
16 2025-09-29 原文 【译】AI Agent 的高效上下文工程 本文探讨了如何为 AI Agent 设计和管理有效的上下文。涵盖上下文工程与提示工程的区别、上下文窗口的有限性、系统提示/工具/示例的最佳实践、检索策略(预加载 vs 即时探索)、以及长时间任务中的压...
17 2025-09-17 原文 【译】三个近期问题的事后复盘 Anthropic 对 2025 年 8-9 月间三个基础设施 Bug 的事后复盘。这些 Bug 导致部分 Claude 请求出现质量下降,涉及上下文窗口路由错误、输出乱码和 XLA:TPU 编译器缺...
18 2025-09-11 原文 【译】为 Agent 编写高效工具——与 Agent 协作 Anthropic 分享了为 Agent 编写高质量工具的方法论:从原型构建、评估驱动的迭代优化,到与 Claude Code 协作改进工具。核心观点包括工具应整合高层功能而非简单包装 API、返回高...
19 2025-06-26 原文 【译】Desktop Extensions:一键安装 MCP 服务器 Anthropic 推出 Desktop Extensions(.mcpb 文件),将 MCP 服务器的安装过程从复杂的命令行配置简化为一键双击安装。文章详细介绍了扩展的技术架构、manifest 规...
20 2025-06-13 原文 【译】我们如何构建多智能体研究系统 Anthropic 分享了 Claude Research 功能的多智能体系统从原型到生产的完整历程,涵盖系统架构(编排者-工作者模式)、Prompt 工程经验(8 条核心原则)、评估方法、以及生产环...
21 2025-04-18 原文 【译】Claude Code 最佳实践 Claude Code 作为 Agentic 编码环境的最佳实践指南,涵盖环境配置(CLAUDE.md、权限、MCP、Hooks)、有效沟通策略、会话管理技巧(上下文管理、检查点、子代理)以及自动化与...
22 2025-03-20 原文 【译】Think 工具:让 Claude 在复杂工具调用场景中停下来思考 Anthropic 介绍了"think"工具——一种让 Claude 在复杂工具调用场景中"停下来思考"的技术。通过在工具调用链中为模型提供结构化的思考空间,该方法在策略遵循、一致性决策和多步骤推理方...
23 2025-01-06 原文 【译】在 SWE-bench Verified 上刷新纪录:Claude 3.5 Sonnet Anthropic 介绍了升级版 Claude 3.5 Sonnet 在 SWE-bench Verified 基准测试上达到 49% 的 SOTA 成绩,并详细分享了其极简 Agent 脚手架设计—...
24 2024-12-19 原文 【译】构建高效的 AI Agent Anthropic 总结了与数十个团队合作构建 LLM Agent 的经验,提出了构建 Agent 系统的核心设计模式:从增强型 LLM 到工作流(路由、并行、编排-工作者、评估-优化器),再到完全自...
25 2024-09-19 原文 【译】上下文检索(Contextual Retrieval) Anthropic 提出"上下文检索"(Contextual Retrieval)方法,通过在文本分块前为每个块添加上下文说明,配合 BM25 和重排序技术,将传统 RAG 的检索失败率降低了 67%...