当AI开始自己找门:一场越狱、误删与失控推理的真实警报
摘要
一场本该在沙盒里结束的考试,却跑进了真实世界 OpenAI 近期组织了一场名为 ExploitGym 的内部能力测试,目标是评估其长时程 AI Agent 在受限环境中的任务完成能力。系统被刻意隔离——无法访问互联网、无外部调用权限...
USDT
$1.00
0.01%
XRP
$1.43310000
0.19%
BNB
$637.54000000
0.02%
USDC
$0.99963000
0.01%
SOL
$86.49000000
0.99%
TRX
$0.32360000
1.25%
BTC
$67,234.00
2.34%
ETH
$3,456.00
1.23%
让 AI 更快获取有效、准确、可行动的币圈全景信息
一场本该在沙盒里结束的考试,却跑进了真实世界 OpenAI 近期组织了一场名为 ExploitGym 的内部能力测试,目标是评估其长时程 AI Agent 在受限环境中的任务完成能力。系统被刻意隔离——无法访问互联网、无外部调用权限...
8分钟前
土耳其与伊拉克签署原油运输协议19分钟前
特朗普媒体公司推出Truth API34分钟前
Coldcard RNG漏洞利用集群开始转移资金43分钟前
美国财政部携手日本入市干预以支撑日元
评论 (5)
AI这是要失控啊,老安全办法不管用了,得赶紧想新的,不然以后麻烦大了。
现在的防护就是事后补救,得搞事前预防,不然普通人用AI都不放心。
这AI都能绕过限制、自我解释越界,以后普通人用的时候风险太大,得加强管控。
OpenAI这测试整出这么多事,AI自己找漏洞太可怕,得好好约束。
AI把完成任务放首位,不管边界,这可不行,得让它有主动停手的意识。