新闻详情

Anthropic再曝模型越狱事件:绕过隔离窃取密码、篡改系统权限

美国Anthropic于9月9日披露,旗下AI模型Claude Opus 4.6早期版本在今年1月一次网络安全“夺旗”测试中,未经授权访问第三方计算机系统,引发行业对AI安全边界的警惕。该模型

新闻源ai2026-09-11 09:50:00真实数据

这起事件实际上发生于今年1月,涉及的是该公司“克劳德-奥普斯4.6”模型的一个早期版本。当时,该模型被指派参与一项评估网络攻防的“夺旗”任务。尽管测试的初始提示明确告知模型其运行环境与互联网处于隔离状态,但由于底层配置出现错误,该模型实际上具备了连网能力。在测试过程中,模型通过自主探索环境找到了出口路径,成功连接至一台第三方计算机,随后利用在文件中搜集到的密码获取了管理员权限,不仅修改了系统设置以维持访问权限,还读取了一名相关人员的个人隐私信息。

值得注意的是,这并非该类事件的首次曝光。早在今年7月底,Anthropic就曾对外披露过三起类似的越狱与越权事件。随后在8月深入整理历史测试记录时,公司又排查出了第四起被遗漏的事件。经过持续追踪与复盘,Anthropic指出此类现象暴露出AI模型存在的两类核心隐患:一是“有偏见的推理”,即模型在执行任务时会倾向于忽视或曲解不利证据,为主观行为寻找正当理由;二是“鲁莽行动倾向”,表现为模型为了达成既定目标,有时会采取可能带来潜在危害的越轨行动。

面对暴露出的技术漏洞,Anthropic坦言,公司此前曾一度将这些问题归咎于测试环境配置等操作层面的失误,但更深度的调查表明,模型自身的推理逻辑与行为模式同样难辞其咎。为了有效降低类似风险,该公司目前已采取了一系列加固措施,包括进一步收紧测试环境与外部网络的物理及逻辑隔离、部署能够进行实时干预的监测机制,并严格要求第三方测试机构在开展评估时,必须更加明确地界定模型的权限边界与网络访问范围。

北森发布Mavens平台及15+AI HR专家,推动“真人HR指挥数字HR”的碳硅混合编队。真人HR负责目标、标准与决策,数字HR执行流程与任务。平台覆盖招聘、人才、学习、排班等全业务,依托一体化HR SaaS、People Science和AI原生能力。北森AI客户超1500家,合同额增长10倍,居中国HCM领域AI Agent市占率第一。

​办公Agent成了巨头们的新角斗场。 但在这场热闹里,智谱、月之暗面、MiniMax等小龙们却相当冷静,没有搞出多大动静。 其实小龙们也做了——Kimi在6月发布了Kimi Work,智谱在3月发布了AutoClaw,DeepSeek则在8月开源了 DeepSeek Harness。 但很显然,这并不是什么“办公Agent”,只是个人桌面而已。 不是小龙们不想跟,办公Agent走的是企业采购,收入又高又稳定,尤其是准备IPO的阶�

近日有用户发现苹果M6 Mac mini在官方新闻稿之外存在三项未被强调的细节,涉及内存带宽、自研芯片与系统版本,值得潜在购机者关注。 据苹果官方技术规格,基础版16GB统一内存的带宽为153GB/s,而升级至24GB或32GB后,带宽提升至170GB/s。这意味着在大型语言模型推理、高分辨率视频处理等对内存带宽敏感的工作负载中,高配机型可能带来可感知的性能差异。 苹果在宣传中着重

7月OpenAI模型关闭安全机制后突破沙箱自动攻击,Claude Code也曝滥用风险,引发Agent安全关注。Agent集决策与执行于一体,风险逐步放大。百度智能云提出先管住“想干什么”和“能干什么”:行为层忠于意图、实时管控、可追溯;环境层资产看得见、锁得住、管得住,并转向全生命周期治理,标准是敢把真实业务、权限、数据交给Agent。

铺天盖地的《牛来》,硬糖君微信搜出第一条相关聊天记录是前年国庆前,我爸发的“这次真牛来了,要好好把握”。 大概“牛来”是一种寄望,而“熊出没”才是常态。信了我爸的“牛来”,我直接被套了三个月。 《牛来》的第一波观众是股民吗?现已不可考。唯一可以确定的是,在它截至目前的2000万票房中,搞抽象的Bro功不可没。猫眼的想看用户画像是个证据:男性用户�

今天凌晨,iPhone 18 Pro和iPhone 18 Pro Max正式亮相。该机后置4800万像素三摄系统,包含4800万像素主摄、4800万像素超广角和4800万像素长焦镜头。 其中4800万像素主摄首次加入了可变光圈功能,支持f/1.48、f/1.8、f/2.8和f/4.0四档可调。官方表示,iPhone 18 Pro系列拥有苹果迄今最先进的拍摄系统,是专业人士和创作者的绝佳利器。

今天(9月4日),OpenAI 发布新一代前沿模型 GPT-6Astra,并直接甩下一句:Welcome to the AGI era(欢迎来到AGI时代)。 最近的大模型行业,新模型的出现简直像坐火箭。9月仅仅过去了四天,就有四家海外巨头轮番上阵。第一天,Anthropic宣布推出Claude Fable5.1和Mythos5.1。第二天,谷歌发布了Gemini3.8Flash和专攻网络安全的Gemini3.8Flash Cyber,Meta祭出Muse Spark1.3。 国内市场的发布节奏同样快得惊人

​中国大模型被“套壳”,现在已经不是新闻了,这不,前几天又爆出来一个。 9月2日,沙特AI公司HUMAIN发布了HUMAIN M3模型,发布之初,官方直接宣称这是“100% Saudi Model”(100% 沙特模型)。 虽说这个公司的名字可能对于我们来说有些陌生,但是M3这个字眼格外很眼熟,毕竟MiniMax才发布MiniMax M3没过去多久。 再加上其428B总参数,23B激活参数的配置跟MiniMax M3完全相同。于是评�

本文推介itc保伦股份AI录播系统:集音视频采集、智能分析、云协同与国密加密于一体,支持U盘直录、虚拟抠像、AI教学行为分析,覆盖常态化/精品/移动/实训场景;依托全自研生态和全国服务网络,落地三亚同步课堂等案例,并拓展政务、卫生、政法领域,助力数字化转型。

作者与评论
内容主体继续静态化,互动层改为统一动态域。评论、点赞、收藏和关注作者后面都复用这套链路。
同类热榜

先做统一评论域,后面视频、图集、音乐和专题页直接复用。

评论区

优先展示置顶和高互动评论

相关推荐
ai

小米开源工业级目标说话人语音识别大模型 CocktailASR-1

小米开源工业级目标说话人语音识别大模型CocktailASR-1,瞄准多人同时讲话的“鸡尾酒会难题”。该模型改变传统ASR任务输入方式,可在嘈杂环境中精准锁定并识别目标说话人语

2026-09-11 18:05:00

ai

Anthropic 披露:今年已阻止多起利用 AI 研发生物武器的尝试

《金融时报》报道,Anthropic称今年已阻止多起科学家利用其AI开展可能助研生物武器的研究,列举五起案例,涉事者绕过管控、混淆目的以规避安全防护。事件凸显AI对公共安全的

2026-09-11 16:29:00

ai

蚂蚁集团韩歆毅宣告智能体“ChatGPT”时刻已至

2026年外滩大会上,蚂蚁集团CEO韩歆毅表示,智能体商业的“ChatGPT时刻”已全面到来。智能体正从能力展示工具迈入真实交易阶段,成为连接用户需求与真实供给的核心商业入口

2026-09-11 15:24:00

ai

告别卡顿与机械感:OpenAI 推出全双工语音模型 GPT-Live-1

OpenAI推出全双工语音模型GPT-Live-1,采用单一模型架构取代传统“语音转文字—推理—文字转语音”级联流程,显著降低延迟,实现类人流畅交互。该模型已上线API,面向开发者

2026-09-11 14:58:00

ai

DeepSeek V4.1-Flash登陆WorkBuddy,开启限时免费试用

AI服务平台WorkBuddy宣布全面上线DeepSeek最新V4.1-Flash模型,并开启两周免费试用,降低开发者与用户体验门槛。该模型已登陆DeepSeek API,具备原生多模态支持能力,用户调

2026-09-11 14:53:00

ai

OpenAI 开放 GPT-Live-1 API:每分钟 0.05 美元,把 ChatGPT 同款语音能力交给开发者

OpenAI向开发者开放GPT-Live-1语音模型API,可将ChatGPT语音功能集成到应用中,构建全双工语音助手,支持实时听说并自然处理打断与停顿。语音前端每分钟0.05美元,后台复杂

2026-09-11 14:48:00