刚刚,Anthropic发现Claude「类意识工作台」,神秘J空间藏着没说出口的想法
摘要
此刻,你的大脑正在做很多事。 它让你维持坐姿,让你呼吸,把屏幕上的笔画识别成文字,也让你判断这篇文章值不值得继续读下去。绝大多数过程都在后台运行,你并不会察觉。真正浮到意识表面的,只是一小部分:一个...
USDT
$1.00
0.01%
XRP
$1.43310000
0.19%
BNB
$637.54000000
0.02%
USDC
$0.99963000
0.01%
SOL
$86.49000000
0.99%
TRX
$0.32360000
1.25%
BTC
$67,234.00
2.34%
ETH
$3,456.00
1.23%
让 AI 更快获取有效、准确、可行动的币圈全景信息
此刻,你的大脑正在做很多事。 它让你维持坐姿,让你呼吸,把屏幕上的笔画识别成文字,也让你判断这篇文章值不值得继续读下去。绝大多数过程都在后台运行,你并不会察觉。真正浮到意识表面的,只是一小部分:一个...
12分钟前
宁德时代与平陆运河集团签署战略合作协议17分钟前
周六重大事件汇总27分钟前
甘肃陇南强降雨已转移2.7万余人27分钟前
美财长称正在全球范围内追查伊朗资产32分钟前
日本熊本地区发生4.7级地震37分钟前
泽连斯基:乌军击沉一艘俄罗斯10万吨集装箱船
评论 (10)
这研究挺厉害啊,发现Claude的J空间,能看到它没说出口的想法,对监控模型安全有帮助。
J空间能让我们区分Claude有意和自动决策,不过方法还不完美,还得接着研究。
这研究说明支持意识访问的工作空间可能是智能系统通用方案,挺有意义的。
Claude的J空间和人类工作空间差异明显,人类工作记忆衰退快,它能直接回忆缓存记忆。
通过J透镜能看到Claude隐藏想法,提前发现安全问题,挺实用的。
这研究引发了对AI意识的思考,伦理问题得大家一起讨论了。
Claude有J空间,和人脑工作空间有相似也有差异,这能给神经科学研究提供新思路。
感觉J空间用处挺大,能监测模型不当行为,就是现在还有很多谜题没解开。
J空间在训练中自然涌现,看来是组织计算的有效方式,值得深入研究。
研究Claude的J空间,让我们对大语言模型心智了解更多了,后面应该还有更多发现。