Anthropic 推出透明度中心¶

Anthropic 于 2025 年 2 月 27 日推出了透明度中心,系统展示其在确保 AI 系统安全、有益和可信方面所采取的各项措施。
随着 AI 能力的快速发展,Anthropic 认为"有意义的透明度对于建立信任和问责机制至关重要"。致力于前沿 AI 研发的组织必须就负责任的扩展流程、安全协议和风险缓解策略提供清晰的信息。
首份定期报告指标¶
作为起步,Anthropic 发布了首份定期报告,涵盖以下关键透明度指标:
| 指标类别 | 说明 |
|---|---|
| 封禁账户 | 违反政策被封禁的账户数据 |
| 账户申诉 | 用户提出的申诉请求 |
| 申诉改判 | 申诉后撤销封禁的情况 |
| NCMEC 报告 | 向美国失踪与被剥削儿童中心的举报 |
| 政府请求数据 | 各类政府信息请求的响应情况 |
透明度中心涵盖的领域¶
该中心提供以下方面的详细信息:
- 模型评估与安全测试的方法论
- 平台滥用检测与执法措施
- 内部治理与风险评估政策
- 评估和应对潜在社会影响的方法
- 推动 AI 安全的研究计划
- 贯穿整个开发过程的安全与隐私保障
超越基础报告¶
该中心旨在解决"多个透明度倡议和自愿承诺中多样化文档要求激增"的问题。 它构建了一个统一的框架,覆盖各类合规要求,使"用户、政策制定者和利益相关方能够清晰地了解我们的模型开发和部署过程"。
持续承诺¶
Anthropic 表示将"持续扩展报告范围,以反映 AI 能力不断进步和新挑战出现时的最佳实践。"
反馈联系方式:[email protected]