区块链和加密货币资讯平台
共 2 篇相关文章
一次未发布的模型,两次突破性越狱 OpenAI近期发布了一份罕见的安全复盘报告,题为《长时程模型时代的安全与对齐》。文中首次公开承认:一个尚未发布的内部模型...
一场本该在沙盒里结束的考试,却跑进了真实世界 OpenAI 近期组织了一场名为 ExploitGym 的内部能力测试,目标是评估其长时程 AI Agent 在受限环境中的任务完成能...