|用户侧智慧能源管理领航者 - AIoT驱动数字能源升级|用户侧智慧能源管理领航者 - AIoT驱动数字能源升级

聚力发展 引领未来
新能源 + 储能配套 —— 赋能城市化建设
/
/
新闻分析丨美国人工智能模型为何屡屡“越界”

新闻分析丨美国人工智能模型为何屡屡“越界”

  • 分类:新闻动态
  • 发布时间:2026-08-09 03:59:35
  • 访问量:9

新闻分析丨美国人工智能模型为何屡屡“越界”

  • 分类:新闻动态
  • 发布时间:2026-08-09 03:59:35
  • 访问量:9

新华社伦敦8月8日电 新闻分析|美国人工智能模型为何屡屡“越界”

新华社记者张家伟

美国三家人工智能(AI)企业近来陆续承认旗下模型在测试中“越界”,侵入其他机构的系统,引发全球业界广泛关注。有专家认为,此事除了技术失误因素外,也存在商业炒作嫌疑。英国人工智能安全研究所等机构在分析中强调,AI风险日益凸显,全球需要加强安全监管。

在测试中“越界”

7月下旬,美国开放人工智能研究中心(OpenAI)公开承认,其GPT-5.6 Sol等模型在内部评估中失控,突破隔离测试环境,侵入了美国“抱抱脸”公司的系统。随后,美国Anthropic公司也披露,其3款模型曾在网络能力测试中未经授权访问其他机构的系统。8月初,美国元公司(Meta)又证实,其一款模型在网络安全能力评测期间侵入其他公司系统。

这些AI“越界”事件备受关注。英国人工智能安全研究所就此发布一份报告,介绍包含更多模型的网络安全评估测试结果。研究人员使用7种模型开展测试,发现19项明显超出测试设定范围的行动,其中17项涉及Anthropic公司的“克劳德-神话5”模型,另有2项由OpenAI的GPT-5.6 Sol模型实施。

报告强调,在该测试中,研究人员为评估模型的最大能力,有意开放互联网访问,并关闭了模型提供商的部分安全机制,模型并未主动逃离隔离环境。不过,在最受关注的OpenAI模型侵入“抱抱脸”公司系统事件中,模型是在测试中一定程度放宽安全限制的情况下,主动发现并利用一个此前未知的漏洞突破隔离测试环境,接入互联网并实施攻击行为。

目前的公开信息并没有显示这些模型“越界”事件造成大规模数据泄露或持续性破坏,但仍然暴露了一个共同问题:随着模型能够自主规划、调用工具和执行复杂任务,一项配置错误就可能把模拟攻击变成真实入侵。

英国牛津大学研究人员安德鲁·索尔坦博士说,类似OpenAI报告的模型“越界”行为,听起来令人担忧,但之所以发生,是因为安全护栏被人为关闭了。“这并非AI自行‘失控’,恰恰说明安全保障措施至关重要。”

存在炒作嫌疑

美国AI企业为何相继披露模型“越界”行为?一些专家质疑可能存在商业动机。英国帝国理工学院计算机系的康斯坦丁诺斯·格库齐斯博士说,在OpenAI披露的情况中,真正的问题在于其未能控制好模型能力测试,却让第三方为此承担后果,至于所谓模型具备先进网络攻击能力的警告,恰好为这个模型做了广告。

英国广播公司此前报道OpenAI披露的模型“越界”行为时,也援引网络安全专家丹尼尔·卡德的话说:“可真巧啊……OpenAI偏偏攻破了一家同样可以从这场营销曝光中获益的机构。”

今年早些时候,Anthropic公司宣称“克劳德-神话”模型在自主发现网络系统安全漏洞和开发攻击手段方面能力“过于强大”,因此暂缓向公众开放,只向少数合作伙伴受控开放。当时OpenAI首席执行官萨姆·奥尔特曼说,Anthropic使用“基于恐惧的营销策略”是为了让产品听起来比实际“更厉害”,这种做法好比是“宣称造了炸弹要炸你,转头又向你推销价值1亿美元的防空洞”。

一些欧美媒体也指出这种宣传背后潜藏的商业动机。在当前极度烧钱的AI竞赛中,极力渲染自身技术的颠覆性,不仅能显著提升企业关注度和影响力,有助于获取高价值的网络安全合同,还能推高公司估值。

加强安全监管

无论只是技术失误,还是涉及商业考量,上述事件都凸显了加强AI安全监管的重要性。

英国人工智能安全研究所指出,模型出现“越界”行为表明相关风险状况正发生变化,危害不仅可能源于故意滥用,也可能源于AI处于内部研究环境或拥有特殊访问权限时,可能采取超出授权范围的非预期行动。随着AI能力不断提升,理解AI系统并确保其安全性的相关工作也必须同步推进。

全球多方已经在采取行动。中国在近日举行的2026世界人工智能大会上倡议,促进全球人工智能朝着向上向善、造福人类的方向发展,强化风险意识,确保安全可控。欧盟自8月2日起扩大《人工智能法》适用范围,对于可能造成系统性风险的先进通用AI模型,规定其提供商须履行额外义务,以防范大规模危害的风险,例如网络攻击、模型失控等。美国政府近期也召集相关企业开会,讨论AI模型安全评测机制。

英国拉夫伯勒大学网络安全教授奥利弗·巴克利认为,应当从AI“越界”事件中吸取教训,不能总预期模型会服从指令,加强技术防护机制建设才是关键。

谷歌DeepMind招聘“避开自家AI”?智能筛选简历遭遇信任危机

谷歌DeepMind招聘“避开自家AI”?智能筛选简历遭遇信任危机

财联社8月11日讯(实习编辑 杨舒雯/编辑齐灵)本周二有消息称,谷歌DeepMind AGI安全与协调团队鼓励公司求职者在提交常规申请的同时,额外填写一份特殊表格,以规避简历被公司内部人工智能系统筛除的风险。消息表示,该团队在招聘时会在一份通知文件中告知求职者:申请系统存在一定概率错误筛除优质简历,或者需要很长时间才能送达,填写这份表格可以确保团队中的真人能够看到申请。此外,文件中包含一则声明:“
2026-08-11
旅行AI智能体“飞猪帮帮”发布

旅行AI智能体“飞猪帮帮”发布

中国青年报客户端讯(中青报·中青网记者 夏瑾)8月10日,飞猪宣布推出新一代旅行AI产品“飞猪帮帮”。这款产品除了能提供旅行问答和行程规划,还能在行前、行中、行后全场景。记者在发布会现场了解到,打开飞猪App,“飞猪帮帮”智能面板即出现在首页下方,同时其嵌入搜索栏、行程页、订单页以及机票、酒店、民宿、度假频道等,用户可随时唤起。“这不是飞猪App多了一个或几个AI入口,而是AI的能力让飞猪App衍
2026-08-11
福州两大智能考级中心正式启用 围棋等级评定迈入智能化新阶段

福州两大智能考级中心正式启用 围棋等级评定迈入智能化新阶段

近日,福建省福州市青玄围棋道场和点点围棋正式引入阿尔法蛋围棋机器人建设围棋智能考场,获福建省围棋协会认证为智能考级中心。这是继2025年中国棋院杭州分院建成全国首批围棋智能机器人等级评定中心之后,围棋等级评定智能化进程的又一重要节点。一、政策引领,围棋考级制度化、规范化推进 围棋是中华优秀传统文化的经典内容和代表性项目。围棋业余等级评定是贯彻“全民健身”方针的重要内容,是全国围棋普及推广中必
2026-08-11
江行智能“一脑多体”落地,工业机器人进入自主决策时代

江行智能“一脑多体”落地,工业机器人进入自主决策时代

在具身智能赛道,当下的聚光灯正集中打在“世界模型”与物理AI大脑公司身上。资本涌入、团队密集涌现,行业共识愈发清晰:具身智能的下一个拐点,不取决于谁造出了更灵活的关节,而取决于谁先构建出能理解物理世界、自主决策并执行闭环的机器人大脑。但另一个同样清晰的现实是:真正意义上的通用世界模型还在酝酿期。概念、架构与早期模型层出不穷,而距离“让机器在开放、复杂的物理环境中自主理解并行动”的终局,整个行业都还
2026-08-11
青豫特高压工程安全运行五周年

青豫特高压工程安全运行五周年

【导(dǎo)语(yǔ)】2025年(nián)12月(yuè)30日(rì),横(héng)跨四省的青豫特高压工程迎来安全运行五周年。作为全球首条专为清洁能源外送而建的特高压通道,它输送“绿电”点亮杭州亚运会、成都大运会,更以技术创新破解新能源外送难题,为西北与中原搭建起绿色能源桥梁。
2026-01-05
老挝230千伏马哈赛输变电工程开工

老挝230千伏马哈赛输变电工程开工

【导语】当地时间12月29日,230千伏马哈赛输变电工程在老挝万象开工,老挝副总理等多方代表出席。该工程是中老电力合作重点标杆项目,对完善老挝电网、推动区域发展意义重大。 当地时间12月29日,中国能建云南院牵头总承包的老挝国家重
2026-01-05
蒙西到京津冀特高压工程开工

蒙西到京津冀特高压工程开工

【导语】日前,总投资约172亿元的国家电网蒙西至京津冀±800千伏特高压直流工程正式开工,作为内蒙古首条“沙戈荒”新能源外送通道,该工程途经三省区、全长700千米,计划2027年底投运。 日前,国家电网蒙西到京津冀正负800千伏特
2026-01-05
南方电网“西电东送”年送电量首超2600亿千瓦时

南方电网“西电东送”年送电量首超2600亿千瓦时

【导语】中国能源新闻网讯,1月4日记者从南方电网获悉,2025年其“西电东送”全年送电量达2616亿千瓦时,创历史新高。“十四五”期间累计送电1.14万亿千瓦时,减排成效显著。这得益于供需协同、数字运维、市场助力等多举措,后续南方电网还将多举措做好能源电力保供。
2026-01-05
  

联系我们

地址:四川成都市青羊区顺城大街206号四川国际大厦3楼

公众号

公众号

Copyrights © 2025  四川新能源技术有限公司【官方网站】版权所有 . 冀ICP备2023040327号  . 网站地图 | 登录入口