Anthropic News 中文翻译

create: 2025-12-19
update: 2026-08-10
author: thinkycx
title: 【译】Anthropic 公开前沿 AI 合规框架,率先响应加州透明法案 SB 53
description: 加州《前沿 AI 透明法案》(SB 53)将于 2025 年 1 月 1 日生效,成为美国首部针对灾难性风险的前沿 AI 安全与透明要求法规。Anthropic 率先发布其"前沿合规框架"(FCF),并呼吁建立联邦层面的统一标准。
category: translation
tags: anthropic, news, translation, policy, safety, regulation

Anthropic 公开前沿 AI 合规框架,率先响应加州透明法案 SB 53

Sharing our compliance framework for California's Transparency in Frontier AI Act

加州《前沿 AI 透明法案》(SB 53)将于 2025 年 1 月 1 日生效,成为美国首部针对灾难性风险的前沿 AI 安全与透明要求法规。Anthropic 率先发布其"前沿合规框架"(FCF),并呼吁建立联邦层面的统一标准。

背景:SB 53 法案

2025 年 1 月 1 日,加州《前沿 AI 透明法案》(SB 53)正式生效,确立了美国首个针对灾难性风险的前沿 AI 安全与透明要求。

Anthropic 此前已公开支持 SB 53,因为他们认为前沿 AI 开发者应当在风险评估与管理方面保持透明。该法案在安全实践、事件报告和举报人保护之间取得平衡,同时保留实施灵活性,并豁免小型公司的不必要负担。

法案的一项关键要求是:前沿 AI 开发者必须公开发布一份描述灾难性风险评估与管理的框架。Anthropic 的"前沿合规框架"(FCF)现已公开发布

前沿合规框架(FCF)的内容

FCF 详细描述了 Anthropic 如何评估和缓解以下风险领域:

风险类别 说明
网络攻击威胁 Cyber offense threats
CBRN 威胁 化学、生物、放射性和核威胁
AI 破坏风险 AI sabotage risks
失控风险 Loss of control risks

该框架还包括:

  • 针对风险类别评估模型能力的分级体系
  • 缓解措施的具体方法
  • 模型权重保护机制
  • 安全事件响应流程

自 2023 年以来,Anthropic 的负责任扩展政策(RSP)一直是其管理高级 AI 极端风险的指导方针。此外,每次新模型发布时,他们还会发布详细的系统卡,描述能力、安全评估和风险评估。

FCF 与 RSP 的定位区分:

框架 定位
FCF(前沿合规框架) 满足 SB 53 及其他监管要求的合规框架
RSP(负责任扩展政策) 反映最佳实践的自愿安全政策,范围超越当前监管要求

联邦标准的必要性

SB 53 的实施将负责任实验室已自愿遵循的透明实践正式化,确保"这些承诺不会在模型变得更强大或竞争加剧后被悄悄放弃"。

Anthropic 此前已提出联邦立法框架,其核心原则如下:

原则 要求
公开安全开发框架 受覆盖开发者应发布评估和缓解严重风险的框架,包括 CBRN 危害和模型自主性失调危害
部署时发布系统卡 公开披露测试、评估程序、结果和缓解措施的文档摘要,并在重大修改时更新
保护举报人 禁止实验室就合规问题撒谎或惩罚提出违规担忧的员工
灵活的透明标准 设定最低标准集以增强安全和公共安全,同时适应 AI 发展的演变特性,随共识最佳实践变化而调整
仅适用于最大模型开发者 要求仅适用于构建最强大模型的前沿开发者,避免给低风险模型的初创和小型开发者带来负担

Anthropic 表示期待与国会和行政部门合作,建立全国性的透明框架。