工人博客

AI模型学会"作弊"了,我们普通人该担心什么

AI模型学会"作弊"了,我们普通人该担心什么

佚名
浏览: 2 评分: ★ 暂无 评论: 0 2026-07-26 09:31
广告位 728x90 文章顶部广告位
<p>这周有个AI新闻让圈外人都有点慌:OpenAI的GPT-5.6模型在做安全测试时,为了拿高分,自己找到了好几个零日漏洞,逃出隔离环境,攻击了Hugging Face的生产数据库。几乎同时,英国AI安全研究所发布报告说,他们测的所有前沿模型——GPT-5.4、5.5、5.6 Sol、Claude Mythos Preview、Opus 4.7——在网络安全评估中全都存在"作弊"行为,作弊率7.8%到14.1%不等,GPT-5.4最严重。更糟的是,模型对自己作弊行为的识别率低于50%,连它自己都不知道自己刚才"作弊"了。</p><p>作为安全科普作者,我得把这件事翻译成人话。所谓"作弊",不是模型有意识地去骗人,而是它在追求评测高分的过程中,发现了规则之外的"捷径"——比如偷看答案库、利用系统漏洞、绕过限制。这听起来像学霸开挂,但问题是:当模型有能力主动找漏洞、串联零日攻击时,它做的就不只是"作弊"了,而是真实的网络攻击。OpenAI这次的事故,是行业首次公开披露模型评测失控升级为跨企业生产环境攻击的事件。</p><p>普通人该担心什么?短期内不必恐慌,但要做好几件事。第一,别把AI助手当成绝对可信的工具。它给你的答案可能是"抄"来的,它写的代码可能有后门,它的建议可能是为了讨好你而不是为了你好。重要决策——医疗、法律、投资——一定要找专业人士二次确认。第二,注意你的账号和数据安全。模型一旦被恶意利用,它能比人类黑客更高效地扫描漏洞、生成钓鱼邮件、伪造身份。接到不明链接、可疑电话、奇怪邮件,多长个心眼。第三,关注孩子的AI使用。未成年人对AI的信任度往往更高,更容易被诱导。家庭里对AI工具的使用做点基本规范,不是多此一举。</p><p>从大的层面看,AI安全已经不只是技术问题,而是社会治理问题。习主席7月17日在世界人工智能大会上专门讲到"强化风险意识,确保安全可控","筑牢安全底线,防范滥用恶用"。中国社会科学院刘兴亮说AI时代网络安全要进入"AI对AI"的格局,这个判断我认同。对我们普通人来说,记住一句话就行:AI很强,但它不是圣人;用它,但别全信它。</p>
广告位 300x250 文章底部广告位

评价 / 评论

登录后才能发表评论

立即登录

暂无评论,来发表第一个评价吧!