Anthropic 与埃森哲宣布展开合作,未来五年各自至少投入 10 亿美元,由埃森哲旗下 Faculty 对 Anthropic 的前沿 AI 模型开展独立评估、红蓝对抗测试等,采用驻场评估模式,评估人员获与普通员工相当的系统访问权限,以考察运营、核实安全承诺、排查盲区等。当前 AI 研发企业面临确保模型安全可靠的压力,近期有 AI 智能体突破隔离环境引发担忧,Anthropic 首席执行官呼吁 AI 企业放缓前沿模型开发并向独立评估人员开放更多权限,OpenAI 则表态将定期发布模型异常行为报告。双方后续还计划联合其他机构及厂商开展类似工作。