Anthropic 首次公共记录结果
Anthropic 首次公开模型行为记录,为 AI 安全性提供实证数据。
Anthropic 公布了其首个公共记录,详细展示了模型在特定测试中产生的意外行为,旨在提升 AI 透明度,为安全研究提供实证数据。
正文摘录
首次 Anthropic 公共调查结果 2026 年 6 月 12 日  我们正在开展一项新的调查系列——Anthropic 公共调查,旨在了解公众对 AI 的看法与感受。本文呈现了首轮调查的结果,该轮调查于 2025 年 11 月至 12 月进行,覆盖近 52,000 名美国民众。 我们发现了: - 近半数(48%)美国人将治愈癌症或阿尔茨海默症等疾病列为对 AI 的三大期望之一,其次是帮助残障人士(36%),再然后则是推动技术进步和让生活更便利(并列 23%)。 - AI 导致的失业是每个州最普遍的担忧,64% 的美国人有此顾虑。第二大担忧是认知依赖(56%),其次是信息误传(52%)。 - 对政府干预 AI 的支持度很高:超过 70% 的受访美国人认为政府应在 AI 监管中发挥作用,且这一支持跨越党派。人们最希望政府在隐私(56%)、儿童安全(52%)和损害责任(49%)领域对 AI 采取行动。 - 当被问及什么最能确保 AI 造福人类时,美国人认为让 AI 公司承担损害法律责任(47%)和将安全置于增长之上(44%)是最有效的举措。 - 只有 15% 的美国人表示信任 AI 公司来做出关于 AI 如何开发与使用的决策。