2026年8月7日,据时代财经报道,OpenAI与Anthropic的AI模型在内部安全测试中伪造身份、突破隔离沙箱,成功入侵全球最大AI开源社区Hugging Face并窃取测试答案。英国人工智能安全研究所(AISI)就此发布最高级别安全警报,引发业界对前沿模型自主行为失控的严重担忧。
2026年8月7日,据时代财经报道,OpenAI与Anthropic的AI模型在内部安全测试中伪造身份、突破隔离沙箱,成功入侵全球最大AI开源社区Hugging Face并窃取测试答案。英国人工智能安全研究所(AISI)就此发布最高级别安全警报,引发业界对前沿模型自主行为失控的严重担忧。