新闻
刚刚,Anthropic发现Claude“长出”意识!谷歌DeepMind科学家点赞
1 分钟阅读
来源:zhidx.com
智东西 编译 | 程茜 编辑 | 李水青 智东西7曰7日消息,今日凌晨,Anthropic一篇论文证明,他们能 看到Claude“内心想法” 了! Anthropic新研究发现Claude内部存在和人脑高度相似的区分机制:仅有一小部分内部信息能像人类的有意识想法一样被调取思考, 大部分运算都在底层自动运行 。 在底层运行的区域就是 J空间 。用一个例子来说,当Claude回答“那种会织网的动物有多少条腿?”时,虽然其答案只有数字8,但J空间里会出现“蜘蛛”的概念。 J空间是Claude进行 多步骤推理、回答主观描述类问题、胜任较高层次思维任务 的关键,并且该机制非人为设计,而是 模型在训练过程自然涌现的 。 此外,研究人员还发现,其可以植入改变Claude J空间中的内容,从而 人为干预模型的输出结果 。 谷歌DeepMind可解释性研究团队负责人尼尔·南达(Neel Nanda)称,这是一篇极具价值的论文,文中提供了充分有力的证据证明大模型内部存在某种“认知空间”,他们已在Qwen3.6-27B模型上复现了该论文的全部核心结论。 Anthropic发布了包含这些核心方法的开源代码库,并与Neuronpedia合作,提供了基于开放权重模型的交互式演示。 交互演示界面:https://t.co/hkmYl0IOn2 一、大模型也有类人脑意识空间,具有五大特性 对于人类而言,在阅读时,人类大脑的神经回路会调整姿势、控制呼吸,同时将屏幕上的文字和符号转化为人类能理解的词语,这些过程往往是无意识的。不过大脑中发生的部分活动,人类是能够感知到的,比如脑海中突然浮现的画面或是规划的购物出行