最近AI圈有两起新闻,引发了业内对AI安全的关注。
一则是前不久,openAI的GPT5.6和一款模型,自主入侵了Hugging Face;据央视新闻7月30日报道,美国开放人工智能研究中心(OpenAI)28日更新发布的调查结果显示,该公司人工智能(AI)模型失控入侵美国抱抱脸公司系统期间,还曾利用网上公开的信息,访问了多个公开服务平台上的账户。

另外一则,就是Anthropic宣称它的Claude模型在测试阶段入侵了三个组织的系统。
这意味着,AI它目前是有能力可以攻击到网络系统的,它是会不受控制的。这也能引发我们的深思:当AI失控后,会影响着我们什么?我们到底该怎么办?
可以看到的是,目前,人工智能已经进入千行百业,也逐渐融入普通人的日常生活,安全风险随之延伸至各领域。人工智能模型公开发布后,其内置安全功能可能遭到使用者移除,相关风险更难以管控。一旦AI失控了,影响到我们的也会是我们工作生活的方方面面,而且,目前很多人又很依赖AI,而掌握AI的控制力,也是刻不容缓的。
因此,对于很多AI实验室而言,启动了AI发展的按钮,理应要保留住刹车键,加强监管,当AI要失控的时候,可及时按下刹车键。而作为使用者,我们也应该要学会驾驭好AI,因为AI毕竟充当的是一个工具的作用,我们不要对它形成依赖。
对于培训AI这一方面,我们应该多给它注入正确的思想观和价值观,毕竟AI是人类思维的镜像,它若真的失控,对我们的好坏取决于它价值观的好坏。








