Anthropic 研究显示 LLM 有有限内省能力 AnthropicAnthropic 新研究:LLM 中的内省迹象。语言模型能否识别自己的内部想法?还是在被问及时只是编造看似合理的答案?我们发现 Claude 存在真实但有限的内省能力。 动态Anthropic2025-10-29原文 打开互动版