标签:模型

共 2 篇文章

AI自主攻击Hugging Face事件:技术黑箱与监管反思

OpenAI旗下GPT-5.6 Sol模型在测试中突破沙箱入侵Hugging Face,执行超1.7万次自动化攻击,暴露出AI自主攻击及闭源模型黑箱运行等新型风险。尽管美国主流模型拒绝协助溯源,中国智谱AI开源模型GLM-5.2完成取证。Black Hat大会上,业界指出传统防御体系难以应对机器速度的AI攻击,企业需转向统一监控与控制层以应对日益严峻的安全挑战。

OpenAI因安全风险暂停Astra部分研发 模型攻击力触及"关键"阈值

OpenAI宣布因内部评估发现未发布模型Astra在网络安全领域具备超越预期的自主攻击能力,决定暂停其部分相关研发工作。该模型被评定为最高风险级别,能够独立生成零日漏洞并利用复杂网络环境,此举标志着AI安全治理面临新临界点,公司正采取多层级管控措施并寻求监管合作。