研究
这里整理 Anthropic 官方研究文章、调查报告和政策分析。目前共 11 篇,本次新增内容覆盖编码 Agent、网络安全、全球 AI 领导力、开源评估工具和科学能力评测。
本次新增
- 社会科学中的编码 Agent - 1,260 名社会科学研究者关于 AI 和编码 Agent 使用情况的调查。
- Project Glasswing 初步更新 - 使用 Claude Mythos Preview 保护关键软件的早期进展。
- 2028:全球 AI 领导力的两种情景 - 关于 compute、AI 领导力和全球竞争的政策分析。
- 捐赠开源对齐工具 Petri - Petri 3.0 以及移交 Meridian Labs 的背景。
- Anthropic Institute 的重点方向 - 研究 AI 对经济、工作、安全和社会影响的计划。
- 用 BioMysteryBench 评估 Claude 的生物信息学能力 - 更接近真实科学任务的模型评估。
既有研究
- 教会 Claude 为什么 - 探索如何让 AI 模型理解行为背后的原因和价值。
- 自然语言自编码器 - 基于自然语言表示的无监督学习方法。
- 人们如何向 Claude 寻求个人指导 - 关于用户如何与 AI 进行深层个人对话的研究。
- 81,000 人告诉我们的 AI 经济学 - 大规模调查揭示的 AI 使用模式和经济影响。
- 自动化对齐研究员 - 探索用 AI 自动化 AI 对齐研究。