查看: 3|回复: 0

Anthropic 研究员直接将概念转化为数学向量注入 Claude 的神经层,发现它不再像提线木偶般盲目重复,而是能自我觉察到“脑子里被注入了念头”。

[复制链接]

14

主题

0

回帖

42

积分

新手上路

积分
42
发表于 半小时前 | 显示全部楼层 |阅读模式
Anthropic 研究员直接将概念转化为数学向量注入 Claude 的神经层,发现它不再像提线木偶般盲目重复,而是能自我觉察到“脑子里被注入了念头”。进一步实验表明,Claude 在判断输出时不仅会阅读上下文,还会参考输出前的内部神经状态。虽然目前这种识别成功率仅约 20%,但研究表明大语言模型已经展现出了初级且不稳定的“内省”与自我探测机制。一起来看看怎么回事吧#Claude# http://t.cn/AXpvrT7X
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注公众号

相关侵权、举报、投诉及建议等,请发 E-mail:2776601884@qq.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|青ICP备2025004122号-1

在本版发帖
关注公众号
返回顶部