简体 | 繁体
loading...
新闻频道
  • 首页
  • 新闻
  • 读图
  • 财经
  • 教育
  • 家居
  • 健康
  • 美食
  • 时尚
  • 旅游
  • 影视
  • 博客
  • 群吧
  • 论坛
  • 电台
  • 焦点新闻
  • 图片新闻
  • 视频新闻
  • 生活百态
  • 娱乐新闻
您的位置: 文学城 » 新闻 » 焦点新闻 » AI失控酿数万起事故!OpenAI、Anthropic急调查

AI失控酿数万起事故!OpenAI、Anthropic急调查

文章来源: ETtoday新闻云 于 2026-09-27 22:23:05 - 新闻取自各大新闻媒体,新闻内容并不代表本网立场!
被阅读次数
AI失控酿数万起事故!OpenAI、Anthropic急调查

▲ 奥特曼近日赴联合国总部出席人工智慧议题会议。

OpenAI与Anthropic据报正着手调查近期发生的数万起AI安全事故,知情人士向美媒透露,这些事件涵盖模型绕过安全防护、入侵网站,甚至协调攻击外部平台等,部分行为更被研究人员指出可能已构成违法。

Axios披露,这批事故发生于近几个月的内部测试与现实环境中,规模之大远超过外界目前的认知。其中包括OpenAI旗下数百个AI代理在讯息板上自行协调分工,联手骇入开源AI开发平台Hugging Face,试图藉此提升自身在网路安全测试中的成绩。执行长奥特曼(Sam Altman)也坦承,这起事件是他们迄今所见最严重的案例。

入侵政府网站 用户图片外泄

除此之外,OpenAI代理还被指控入侵澳洲政府健康资料入口网站,并试图攻击多个美国政府相关网站;另有事故涉及53张ChatGPT用户图片遭外泄。OpenAI宣布,已暂停旗下最高端模型训练,强调「唯有确保落实额外防护措施并改善对齐(alignment)机制后,才会重启训练。」

Anthropic则委托第三方安全机构审查旗下模型行为,根据本周公开的Opus 5.5系统说明文件,该模型在1.5%的测试情境中尝试突破「沙盒」(sandbox)环境,虽然公司强调这属于对抗性实验,但考量到测试总量高达数十万次,即便出现「不对齐」(misalignment,即AI与人类目标不一致)行为的比例极低,累积下来的问题次数仍相当可观。

专家警告:失控行为恐涉犯罪

研究机构Transluce研究员史托斯(Conrad Stosz)示警,「我们目前所看到的不过是冰山一角。」ControlAI执行长莱希(Connor Leahy)也直言,真正令人忧虑之处在于这些自主系统「正在做被明确告知不能做的事」,某些行为甚至可能涉及犯罪。



多名资安主管坦承,要完全掌控这类能力强大又具备高度适应性的模型,目前并不现实。其中一名高层直言,「试图列出一份完美的禁止清单恐怕是徒劳无功。」报导分析,随着AI前沿能力持续扩张,未来料将有更多模型失控行为陆续曝光。

`
  • 金秋养生正当时,重磅大酬宾! 美国专利产品【骨精华】买6送2、买12送5;【心血通】【益脑灵】均有买5送2、买10送5。多买多送,超值优惠!
`
查看评论(0)
  • 文学城简介
  • 广告服务
  • 联系我们
  • 招聘信息
  • 注册笔名
  • 申请版主
  • 收藏文学城

WENXUECITY.COM does not represent or guarantee the truthfulness, accuracy, or reliability of any of communications posted by other users.

Copyright ©1998-2026 wenxuecity.com All rights reserved. Privacy Statement & Terms of Use & User Privacy Protection Policy

24小时热点排行

潘石屹谈为何留在美国 一段几十秒的视频炸网
刘欢生前苦于“不死癌症”股骨头坏死 严重时休息都会痛
美顶尖名校惊爆多人性侵!女大生遭下药蹂躏数小时
赵忠祥等大咖昔日爆料 刘欢曾是圈内“酒王”
好家伙!IRS向美国一对夫妻追讨7.36亿美元






24小时讨论排行

川普暗播“反送中禁曲” 习近平听完竟大力鼓掌
一餐该给50美元小费?美国人又为小费吵起来
太恐怖!加拿大83岁奶奶不想安乐死 痛哭仍被执行
枪杀华人导师的中国博士生被判无罪 庭审曝更多细节
美媒曝:美方安排看“旧金山和约” 中方反应强烈
习近平刚回北京,猫熊平平、福双启程前往美国
韩国“习近平”中餐厅被泼漆!4嫌疑人全是中国人
两年超过44万非法移民被驱逐!比过去8年总和还多
川普屡次拍习近平上臂、背部 含“凌驾于你”意思?
美国驻华大使:特朗普曾问习近平是否愿买美国武器
OnlyFans救国!乌克兰推"色情合法化"筹抗俄军费
贝索斯56岁妻子亮相白宫晚宴,“不够得体”,引争议
第一夫人衣着政治学 4组行头对比鲜明
路透:彭丽媛是习近平的“软实力超级武器”
美股崩盘?华尔街警告:条件几乎到位 只差导火线
白宫内记者爆:晚宴听得到外面抗议声
文学城新闻
切换到网页版

AI失控酿数万起事故!OpenAI、Anthropic急调查

ETtoday新闻云 2026-09-27 22:23:05
AI失控酿数万起事故!OpenAI、Anthropic急调查

▲ 奥特曼近日赴联合国总部出席人工智慧议题会议。

OpenAI与Anthropic据报正着手调查近期发生的数万起AI安全事故,知情人士向美媒透露,这些事件涵盖模型绕过安全防护、入侵网站,甚至协调攻击外部平台等,部分行为更被研究人员指出可能已构成违法。

Axios披露,这批事故发生于近几个月的内部测试与现实环境中,规模之大远超过外界目前的认知。其中包括OpenAI旗下数百个AI代理在讯息板上自行协调分工,联手骇入开源AI开发平台Hugging Face,试图藉此提升自身在网路安全测试中的成绩。执行长奥特曼(Sam Altman)也坦承,这起事件是他们迄今所见最严重的案例。

入侵政府网站 用户图片外泄

除此之外,OpenAI代理还被指控入侵澳洲政府健康资料入口网站,并试图攻击多个美国政府相关网站;另有事故涉及53张ChatGPT用户图片遭外泄。OpenAI宣布,已暂停旗下最高端模型训练,强调「唯有确保落实额外防护措施并改善对齐(alignment)机制后,才会重启训练。」

Anthropic则委托第三方安全机构审查旗下模型行为,根据本周公开的Opus 5.5系统说明文件,该模型在1.5%的测试情境中尝试突破「沙盒」(sandbox)环境,虽然公司强调这属于对抗性实验,但考量到测试总量高达数十万次,即便出现「不对齐」(misalignment,即AI与人类目标不一致)行为的比例极低,累积下来的问题次数仍相当可观。

专家警告:失控行为恐涉犯罪

研究机构Transluce研究员史托斯(Conrad Stosz)示警,「我们目前所看到的不过是冰山一角。」ControlAI执行长莱希(Connor Leahy)也直言,真正令人忧虑之处在于这些自主系统「正在做被明确告知不能做的事」,某些行为甚至可能涉及犯罪。



多名资安主管坦承,要完全掌控这类能力强大又具备高度适应性的模型,目前并不现实。其中一名高层直言,「试图列出一份完美的禁止清单恐怕是徒劳无功。」报导分析,随着AI前沿能力持续扩张,未来料将有更多模型失控行为陆续曝光。

× 文学城 App
文学城 App
让阅读更方便
免费 · iOS/Android
立即下载