研究2026年6月25日 · 1 分钟阅读Anthropic 的 AI 安全研究版图:可解释性、防越狱与制度化承诺从“追踪思维”的可解释性研究到负责扩展策略(RSP),Anthropic 把安全研究做成了企业级卖点——本站梳理其公开研究主线。Anthropic安全研究