-
_NEWSDATE: 2026-07-09 | News by: MIT科技评论 | 有0人参与评论 | _FONTSIZE: _FONT_SMALL _FONT_MEDIUM _FONT_LARGE
图 | 通过交换 J 空间的内容来改变 Claude 的沉默推理方式的两个案例(来源:Anthropic)
J 空间也参与了多步推理。Anthropic 在博客文章里举了这样一个例子:织网的动物的腿有多少条?这时,模型需要首先推出那个动物是蜘蛛,接着回忆蜘蛛有几条腿。“蜘蛛”这个词从来没有出现在提示词或生成答案里,它只是模型内部所使用的一个垫脚石。J 空间在模型处理的中途捕捉到了“蜘蛛”这个中间概念词语,这时换掉这个词语就会改变结果,比如换成蚂蚁,答案就从八条腿变成了六条腿。
全局工作空间理论的另一个重要特征是灵活性,每当一个表征进入工作空间,就能够被多种下游任务使用。Anthropic 给了模型四个提示,让其分别询问关于法国的不同事实,这四个提示分别涉及到首都、语言、大洲和货币。
接着,在 J 空间里把法国换成了中国,在每种语境中使用一模一样的干预。这时,模型分别回答了北京、中文、亚洲和人民币这些答案。在四个不同的下游计算里,模型都读取了同一个编辑,并且都能各自正确使用它。假如模型为每种问题分别存储了一个单独的国家副本,编辑内容最多只会影响其中一个,四个答案全部一起改变说明它们都在读取同一个共享表征。
但是 J 空间并不参与模型的日常自动处理,没有它的话模型仍然能够流利地说话、分类情感、回答选择题、从段落中提取事实。在那些需要更高阶思维的任务里,假如没有 J 空间则会让大模型失去一些能力,比如多步推理能力下降到接近零、总结和写押韵诗的表现滑到了一个小得多的未受损模型之下。
在研究中的一项实验里,Anthropic 给模型看了一段西班牙语写的文章,随后交给它不同的任务,让其继续写下去、说出语言名称以及回答那些需要利用语言身份的问题。
然后,在 J 空间里把西班牙语换成了法语,随后检查模型在哪些任务里受到了影响。结果发现,当模型被要求说出语言名称时,模型说了法语;被问及著名作家的时候,它从《百年孤独》作者&拉美作家加西亚·马尔克斯换成了法国作家维克多·雨果。
但是让它继续写文章时,它写出来了流利的西班牙语,几乎完全不受影响。事实上,模型其实是知道西班牙语怎么用的,但是有些任务需要从 J 空间里把它拿出来才能用,比如只有命名语言或者用它做点新事情时才会经过 J 空间。对于继续写文章这类任务,这是一种模型在大量文本上练习过的技能,因此它会自动地运行。
这项研究也引出了那个始终绕不开的意识问题,前面提到的德阿内和纳卡什在评论文章中写道,J 空间与全局神经元工作空间理论之间存在着大量的对应关系,比如可报告性、有限容量和选择性、广泛的上下游连接、灵活使用同一表征完成多种下游计算、在刻意内部推理中扮演核心角色但自动过程发生在外部,种种这些都说明模型可能复现了人类有意识访问的特征。
但是,模型和人脑依然存在关键差异。人脑的工作空间由循环回路进行维持,信号在同样的回路中来回地循环。J 空间则是在一次通过网络的前向传递中演化的,这一过程实际上深度扮演了时间在人脑中扮演的角色。
J 空间的容量貌似也更高,Anthropic 估计它能够同时容纳大约二十五个活跃概念,这比人类工作记忆的估计容量要大很多。当然,J 空间并不是一组专门的神经元,而是分布在一组普通的神经元上,而同样的单元同时携带了无意识内容。
模型和人脑还有一个更根本的差异,人脑的工作空间由长程轴突和丘脑皮层回路的特定解剖结构加以支撑,J 空间则是在一个前馈网络中涌现出来的。但是德阿内和纳卡什认为,这些实现细节对于机器是否可以实现有意识处理这个问题来说,在很大程度上其实没啥影响。- 新闻来源于其它媒体,内容不代表本站立场!
-
原文链接
原文链接:
目前还没有人发表评论, 大家都在期待您的高见