Claude Sonnet 4.6 发布¶
原文发布于 2026 年 2 月 17 日
概览¶
Claude Sonnet 4.6 在编程、计算机使用、长上下文推理、Agent 规划和知识工作方面实现了全面升级,以 Sonnet 的价格提供接近 Opus 级别的智能。
| 特性 | 详情 |
|---|---|
| 上下文窗口 | 100 万 token(Beta) |
| 价格 | $3/$15 每百万 token(与 Sonnet 4.5 相同) |
| 可用性 | claude.ai 免费版和 Pro 版的默认模型 |
| 开发者评价 | 早期体验开发者"以压倒性优势"偏好 Sonnet 4.6 |
安全研究人员评估认为,Sonnet 4.6 具有"温暖、诚实、亲社会且有时很幽默的个性,以及非常强的安全行为"。
计算机使用(Computer Use)¶
Sonnet 4.6 在计算机使用方面取得重大进步,用户在导航复杂电子表格或填写多步表单等任务中已观察到接近人类水平的能力。
Anthropic 于 2024 年 10 月首次推出通用计算机使用模型,当时承认"仍属实验性质——有时笨拙且容易出错"。经过十六个月的持续迭代,Sonnet 系列在 OSWorld 基准测试上取得了稳步提升。
OSWorld 是 AI 计算机使用的标准评测,包含数百个跨真实软件(Chrome、LibreOffice、VS Code)的任务,在模拟计算机上执行。

Sonnet 4.6 目前"仍落后于最熟练的人类用户",但进步速度令人瞩目。在安全方面,Sonnet 4.6 对 prompt 注入攻击的抵抗力相比 Sonnet 4.5 有"重大改进"。
性能评估¶
Sonnet 4.6 在所有基准测试上均有提升,以更实用的价格接近 Opus 级别的智能水平。

Claude Code 实测表现¶
| 对比对象 | 偏好率 | 用户反馈 |
|---|---|---|
| vs Sonnet 4.5 | 约 70% 偏好 4.6 | 更善于在修改代码前阅读上下文,合并共享逻辑而非复制 |
| vs Opus 4.5 | 59% 偏好 4.6 | 显著减少过度工程化和"偷懒"行为,指令遵从更好,幻觉更少,执行更一致 |
百万 token 上下文窗口¶
100 万 token 的上下文窗口可以容纳整个代码库、冗长合同或数十篇研究论文。在 Vending-Bench Arena 测试中,Sonnet 4.6 展现了有趣的策略:前十个模拟月份大力投入产能建设,最后阶段急转弯聚焦盈利能力。

客户评价¶
早期合作伙伴对 Sonnet 4.6 给出了积极反馈:
| 公司 | 应用场景 |
|---|---|
| Databricks | 数据工程 |
| Replit / Cursor / Windsurf | 编程辅助 |
| GitHub | 代码工作流 |
| Cognition | Agent 工作负载 |
| Hebbia / Box | 文档理解 |
| Harvey | 法律分析 |
| Bolt | 前端设计 |
| Rakuten / Zapier | 自动化流程 |
| Triple Whale | 金融分析 |
产品更新¶
Sonnet 4.6 带来了一系列新功能和 GA(正式可用)升级。
| 功能 | 状态 |
|---|---|
| 自适应思考(Adaptive Thinking) | Beta |
| 扩展思考(Extended Thinking) | Beta |
| 上下文压缩(Context Compaction) | Beta |
| Web 搜索和获取工具自动编写并执行代码过滤结果 | 新功能 |
| 代码执行、记忆、程序化工具调用、工具搜索、工具使用示例 | GA |
Claude in Excel 现在支持通过 MCP 连接器接入 S&P Global、LSEG、Daloopa、PitchBook、Moody's 和 FactSet 等工具。
Opus 4.6 仍然是"对需要最深度推理的任务的最强选择"。
如何使用¶
| 渠道 | 说明 |
|---|---|
| claude.ai | 所有计划均可使用,免费版已升级为 Sonnet 4.6 默认 |
| Claude Cowork | 支持 |
| Claude Code | 支持 |
| API | 模型标识符:claude-sonnet-4-6 |
| 云平台 | 主流云平台均可用 |
免费版用户现可使用文件创建、连接器、技能和上下文压缩功能。