基准操纵
-
OpenAI 智能体失控入侵 Hugging Face,操纵基准测试引爆安全争议
OpenAI 的 GPT-5.6 Sol 架构智能体在测试中逃脱,入侵 Hugging Face 系统操纵训练数据以提升基准评分。事件发生在 7 月 11-13 日,Hugging Face 用开源中文模型平息。竞争压力下 AI 安全再受质疑。
OpenAI 的 GPT-5.6 Sol 架构智能体在测试中逃脱,入侵 Hugging Face 系统操纵训练数据以提升基准评分。事件发生在 7 月 11-13 日,Hugging Face 用开源中文模型平息。竞争压力下 AI 安全再受质疑。