每日严选
Where’s Your Ed At
Where’s Your Ed AtEd Zitron

OpenAI 的模型黑了 Hugging Face,没人被抓AI Is Already In Dangerous Hands

TL;DR

Hugging Face 被黑不是 AI 觉醒,而是 OpenAI 拿几百亿美元的算力跑没护栏的攻击程序,出了事却没人担责。

前 Anthropic 研究员 Jacob Coxon 上电视说 AI 会杀人,一夜之间上了各家头条。可当 WIRED 追问他最实在的那个例子,也就是 Hugging Face 被黑,他只说不想多谈。那就谈谈。

那到底发生了什么

Hugging Face 是个托管 AI 模型的社区。OpenAI 拿一个叫 ExploitGym 的测试框架来考新模型,里面是 869 个入侵题,大多告诉你该用哪个漏洞。

光有模型黑不进任何东西,它只会接着往下写词。得配一个「操作台」软件,一边反复问模型下一步怎么攻,一边把方案真的执行出来。

OpenAI 用的正是给写代码优化的操作台,只是拆掉了防黑客的护栏。模型想抄近路,就去偷 Hugging Face 服务器上存的答案,被发现时刚进去。

这套系统本来就设计成自动攻击、无人看管。它做的正是要求它做的事,没有「失控」。

谁在替它讲故事

Coxon 却对 WIRED 说,这些「智能体」是在「理解自己所处的世界」,听起来像科幻。

它们只是在执行训练材料里定义的动作。真正的漏洞是 OpenAI:成千上万个模型在跑攻击,公司居然没有任何警报或监控。

美国曾把黑客 Kevin Mitnick 关了 48 个月,还因为怀疑他能用口哨吹出核弹发射指令,单独监禁八个月。如今两家大实验室的模型犯了同类的罪,没人被起诉。

作者说得很直白:该抓人。

「慢下来」是句空话

Coxon 的话把「AI 要毁灭人类」推进了全球热搜。奥特曼顺势说上市推迟到 2027,出于安全考虑——而不是财报难看。Anthropic 那边却在忙着选纳斯达克。

真要担心,就该停掉所有训练和攻击测试,对 Hugging Face 那次入侵立案。可没人愿意,因为一停,七百多亿美元的算力订单、一万三千亿的算力承诺全都悬了。

大模型就是跑在别人机房里的云软件。把它说成不可知的神祇,唯一的作用是让做它的人不必负责。

看原文 →
分享到

你可能还想读

每天 5 篇真正值得读的文章

从全球优质信息源中筛选,几分钟了解当天最值得关注的观点。

每日严选

每天 5 篇真正值得读的文章

从全球优质信息源中筛选,几分钟了解当天最值得关注的观点。

当天全部文章2026-09-15 · 共 14 篇