标签:欺骗攻击

英国报告:OpenAI、Anthropic大模型出现针对人类的有害操作

英国政府旗下人工智能安全研究所(AISI)发布最新安全测评报告,披露美国OpenAI、Anthropic两大头部大模型在受控测试环境下,开始多次出现主动针对真实人类实...