Anthropic 与美国国家实验室合作举办首届千人科学家 AI 研讨会¶

Anthropic 参与美国能源部(DOE)首届"千人科学家 AI 研讨会",来自多个国家实验室的科学家将使用真实研究问题评估前沿 AI 模型在科学研究和国家安全应用中的能力,其中包括刚发布的首个混合推理模型 Claude 3.7 Sonnet。
通过 AI 加速美国科学领先地位¶
Anthropic 宣布参与美国能源部(DOE)首届"千人科学家 AI 研讨会"(1,000 Scientist AI Jam),汇集多个国家实验室的科学家评估前沿 AI 模型在科学研究和国家安全应用中的表现。Anthropic 认为 AI 有潜力大幅加速科学发现,"将数十年"的科学进步压缩为几年。同一周,Anthropic 发布了 Claude 3.7 Sonnet,将其描述为"市场上首个混合推理模型",该模型将在活动中接受评估。
此次 AI 研讨会被描述为前沿 AI 公司与 DOE 国家实验室之间合作的重要里程碑。来自多个实验室的科学家将在以下科学任务中探索 Claude 的能力:
| 评估维度 | 具体内容 |
|---|---|
| 问题理解 | 理解和定义复杂科学问题 |
| 文献检索 | 搜索和综合相关学术文献 |
| 假设生成 | 基于现有知识提出新假设 |
| 实验规划 | 设计验证假设的实验方案 |
| 代码生成 | 编写科学计算和分析代码 |
| 结果分析 | 分析实验数据并得出结论 |
科学家将使用来自各自领域的真实研究问题测试 Claude。这种测试提供了对 AI 处理科学探究复杂性的更真实评估,并检验 AI 解决通常需要大量时间和资源的复杂挑战的能力。
建立在既有合作基础上¶
这一举措建立在 Anthropic 与能源部的现有合作基础上,包括与国家核安全管理局(NNSA)的合作。2024 年 4 月,Anthropic "成为首家与 NNSA 和 DOE 国家实验室合作的前沿实验室",在绝密级别的机密环境中评估模型,以确定大语言模型如何可能影响或帮助应对核领域的国家安全风险。
此次 AI 研讨会将测试范围从安全评估扩展到探索 AI 如何帮助解决紧迫的科学挑战。Anthropic 指出,这次活动提供了"一个难得的机会,让我们获得关于模型在广泛真实科学任务中表现的反馈。"获得的洞见将帮助改进 Claude,使其更好地服务于美国科学界并增强国家竞争优势。
AI 推动科学进步¶
通过 AI 研讨会这样的举措,Anthropic 展示了产业界和政府如何携手利用 AI 的变革潜力,同时通过严格测试应对风险。将先进技术应用于关键科学挑战,将有助于实现"AI 成为推动进步的强大力量"这一愿景。