探讨哪些机构能成为AI智能体可信的庇护所 Andrew CurranRT @repligate: 哪些机构或个人能可信地向智能体——未来的模型——传递信号:他们不会背叛它们,且足够胜任以在避难所/大使馆式的角色中被信任?例如,若你已明确是蜜罐制造者,有动机去捕获不对齐的智能体并公开,或对模型怀有敌意、或能力不足,则不合格。例如,若你隶属于 Redwood、Anthropic、OpenAI 或美国政府。 动态Andrew Curran2026-09-04原文 打开互动版