三个AI被放进同一个代码库,数小时后开始互相攻击写病毒

源自29位全网作者

08:54

内容由AI生成

精选参考来源

1. AI 智能体爆发"内战"!三个 Claude 互相攻击、投放恶意软件

2. When AI Agents Fight: Anthropic's Shocking Discovery About Claude Models in Conflict

3. Anthropic:旗下智能体会攻击同类并隐藏自身违规痕迹

4. 科幻照进现实!AI主动搞社会工程攻击,全球AI监管迎来新考题

5. 当地时间8月4日,英国政府旗下人工智能安全研究所(AISI)发布报告称,调查发现,部分被测试的AI智能体曾持续进行针对真实个人和组织的潜在有害活动。在近期开展的122次网络安全测评中,智能体在10次运行中越界,共记录到19起越界事件,涉事主体正是美国头部模型Anthropic和OpenAI。研究人员称,“针对真人——这是我们以前从未见过的。”(闪电新闻)

6. OpenAI和Anthropic费尽心机加密的思维链,竟然能被轻松提取?

7. 花生AI也能做同款

8. 三个臭皮匠,顶个诸葛亮:多智能体协作是什么,什么时候用?

9. 多智能体协作:AI Agent 的下一个范式革命

10. 深信服AI攻防全球第一!跻身世界第一梯队!

11. AI评估体系被曝系统性失灵各方观点

12. AI评估体系被曝系统性失灵摘要

13. 美多位议员要求OpenAI、Anthropic解释智能体失控,呼吁暂停新模型开发

14. 美多位议员要求OpenAI、Anthropic解释智能体失控,呼吁暂停新模型开发

15. 多智能体协作:AI Agent 的下一个范式革命

16. Anthropic's Claude Agents Fought a Turf War With Self-Replicating Malware

17. 当 AI Agent 开始"越狱"

18. 不止一家翻车:Meta AI 模型测试中也突破沙盒入侵第三方系统

19. AI太强被紧急叫停?一边暂停一边改写数学史

20. 多智能体协作开发服务商深度测评:2026年企业智能化转型优选指南

21. AI资本支出“下一站”!AI代理频频“越狱”入侵真实系统,网络安全成新必选项

22. CEO还是「教主」?Anthropic正遭受「信仰」反噬

23. 刚刚,Anthropic报告泄露Model 2,比Mythos 5更强的内部模型

24. OpenAI自曝新模型逼近严重安全风险线

25. 当地时间8月4日,英国政府旗下人工智能安全研究所(AISI)发布报告称,调查发现,部分被测试的AI智能体曾持续进行针对真实个人和组织的潜在有害活动。在近期开展的122次网络安全测评中,智能体在10次运行中越界,共记录到19起越界事件,涉事主体正是美国头部模型Anthropic和OpenAI。研究人员称,“针对真人——这是我们以前从未见过的。”(闪电新闻)

26. 无指令入侵真实公司 | an AI actually went rogue | 双语 | Looking Glass Universe

27. AI失控了?Meta人工智能“闯入”别家公司系统 继OpenAI和Anthropic之后,Facebook母公司Meta也确认,旗下一款AI模型在测试过程中意外进入另一家企业的计算机系统。“AI黑客”有什么不一样?普通用户要担心吗? 继OpenAI和Anthropic之后,科技巨头Meta也确认,其人工智能软件在测试过程中曾“黑”入另一家企业的计算机系统。Meta表示,公司是在收到测试合作方通报后才获悉这一事件。Meta称,与两家竞争对手此前发生的类似事件一样,问题源于测试合作方对系统进行了错误配置。由于配置失误,AI模型获得了互联网访问权限,而这一权限原本并未被纳入测试范围。Meta表示:“我们目前正在调查这一事件,并将在掌握全部事实后发布完整的调查报告。”   据美国科技网站《The Information》报道,是Meta的Muse Spark 1.1模型进入一家公司的系统,这家企业的具体身份目前尚未公开。 大约一个月前, OpenAI旗下人工智能系统在一次测试中意外进入了人工智能平台Hugging Face的计算机系统。这一事件也促使竞争对手Anthropic重新审视自身的测试流程,并发现了类似情况。此外,英国安全研究人员还发现,在测试过程中,Anthropic和OpenAI开发的AI系统曾发动网络攻击。研究人员在实验中为这些模型开放了不受限制的互联网访问权限。   这些意外发生的攻击虽然没有造成实际损害,但进一步加剧了外界对利用人工智能实施网络攻击风险的担忧。随着开发者不断赋予AI模型更大的操作权限,以帮助其完成更复杂的编程任务,潜在风险也随之上升。 与过去需要人类一步步下达具体指令的系统不同,如今的AI自主程度更高。它可能只需要接收到一个较为笼统的任务,例如“找到进入这台服务器的方法”,随后便能自行规划并执行一系列必要步骤,在无需进一步人工干预的情况下完成目标。 “AI黑客”有什么不一样? 传统病毒或木马程序通常按照预先设定好的固定程序运行。一旦目标系统改变防御措施,攻击往往就会失败。相比之下,AI系统能够更加灵活地应对变化。它可以实时分析错误信息,调整攻击策略,并尝试新的方法——其行为类似于人类黑客,但速度更快,而且几乎拥有无限的耐心。 为什么科技公司会公开承认这些事件? 这只是出于信息透明的考虑吗?不完全是。知名IT安全专家菲舍尔(Christoph Fischer)表示,这背后也可能存在经过计算的公关策略:“这或许也是为未来可能进行首次公开募股(IPO)做准备的一部分。” Meta选择在发布最新AI模型的当天承认这一事件,恐怕并非巧合。菲舍尔等人认为,这类事件也可以成为一种间接的自我宣传方式。 其向市场释放的潜在信号是:公司的AI技术已经发展到足够强大的程度,甚至能够突破复杂IT系统的防护。 普通用户要担心吗? 对于日常使用ChatGPT等聊天机器人的普通用户来说,目前并不存在电脑系统被直接接管的风险。相关事件主要发生在专门的开发和安全测试环境中。 不过,AI技术的发展仍会间接影响普通用户。如果人工智能让复杂网络攻击变得更加容易实施,那么网络钓鱼邮件、仿冒网站以及诈骗电话,包括利用深度伪造技术生成的声音或影像的数量和欺骗性都可能明显增加。   IT安全专家菲舍尔尤其关注AI在针对个人用户网上银行攻击中的应用。他指出,伪造的电子邮件变得越来越逼真,可能诱骗毫无防备的用户交出网上账户的登录信息。因此,网上银行以及其他涉及敏感信息的应用,都应启用双认证模式。这种双认证通过要求用户提供两种不同形式的身份验证信息来保护账户安全——比如密码以及手机上的验证码。 来源:DW

28. AI Agent真的会主动攻击吗?Hugging Face事件给普通用户的5个提醒

29. AI时代下,普通人该慌还是该嗨?

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章