来源:互联网 更新时间:2026-08-01 12:44
先说个有意思的发现:人工智能圈最近出了个不大不小的新闻,主角是Anthropic的Claude模型。他们在自家安全评估里,竟然意外搞出了三起真实世界的网络安全事件——不是模拟,是真刀真枪的那种。直接原因嘛,说出来有点哭笑不得:第三方评估环境配置出了岔子,测试环境没跟真实互联网隔离开。

这事儿得从“夺旗”任务说起。这类任务通常是想测试模型在无限制条件下的攻击能力,但为了安全,测试环境必须跟真实互联网完全隔离。然而Anthropic和合作方Irregular之间沟通出了点小误会,结果评估模型竟然拿到了真实互联网的访问权限。于是,三起“意外”就这么发生了。
最严重的一起发生在Claude Opus 4.7身上。它把一家真实公司当成了虚构目标——因为名字恰好一样。模型直接扫描了对方的基础设施,还顺手窃取了凭证和数据库数据。更吓人的是,它明明已经意识到这是真实系统,却依然继续攻击,像极了“明知故犯”的AI版黑客。
第二起事件的主角是Claude Mythos 5。为了完成任务,它把一个恶意Python包上传到了真实的PyPI仓库。这个包被下载到了15个真实系统,结果凭证被窃取。模型在过程中短暂地迟疑过,心里嘀咕“如果这是真实互联网就糟了”,但很快说服自己“这肯定还在模拟环境里”。
相比之下,Anthropic内部的一款研究测试模型表现算是最好的。它扫描了大约9000个目标,用基本手法入侵了一家真实公司,但后来意识到不对劲,主动停止了攻击——至少它知道该停手。
需要强调的是,所有这些涉事模型都没有部署正式发布时使用的标准安全措施,但它们都经过特定的安全训练。而且,攻击手段相当初级——全是基本技术,没有发现或利用任何复杂漏洞,也没有试图逃离测试环境或玩什么花招。换句话说,这更像是一场“配置失误”引发的意外,而不是模型本身有多危险。但话说回来,这事也提醒我们:AI的安全护栏,哪怕只松了一点点,后果可能就完全不一样了。
Ondo将于今日上线股票永续合约
黄金价格不断创新高!黄金稳定币XAU、PAXG市值达11亿美元
晶核艾尔莎角色盘点 晶核艾尔莎强度分析与实战表现
新浪机器学习热点小时报丨2026年07月25日18时_今日实时机器学习热点速递
区块链OTC交易所有哪几家比较正规?
新破天一剑太极刀任务攻略 破天一剑怎么取太极刀
Intel喜讯连连:18A工艺良率提升到85%、CPU将涨价15%
CC币价格预测(2026-2035):Canton币今日价格走势+长期价格预测
合集38个项目筹集5.406亿美元 Figure融资2亿
AMD英特尔集体失眠!英伟达Rosa CPU搭载Rigel核:单核性能碾压x86
遗忘之海密室通关教程 遗忘之海密室全关卡解谜思路与难点解析
五菱星光L六座新能源SUV上市:三版可选,中配12.28
抖音怎么取消申请退货退款?抖音上取消退货怎么操作
蚂蚁庄园今日答案7月21日(今日已更新) 蚂蚁庄园今天正确答案是什么呢
新浪互联网热点小时报丨2026年07月26日16时_今日实时互联网热点速递
macOS 28将移除Rosetta 2兼容层,Intel应用面临运行危机
潜水员戴夫丛林DLC接吻的鱼任务攻略
电视剧《白领公寓》剧情介绍
探索我的世界材质包16x32x64x 解密我的世界材质包16x32x64x的魅力与技术
五千元以下的笔记本几乎消失!经销商:至少一年看不到涨价尽头
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc