-
_NEWSDATE: 2026-07-09 | News by: MIT科技评论 | 有0人参与评论 | _FONTSIZE: _FONT_SMALL _FONT_MEDIUM _FONT_LARGE
Eleos AI 研究院的帕特里克·巴特林和同事们评论本次成果称,对于大模型存在某种形式的访问意识来说,Anthropic 的这篇论文提供了有力证据。但是他们也提醒,访问意识和现象意识在概念上是不一样的。现象意识指的是一种主观体验,对于一个模型来说它可以有访问意识而没有现象意识,就像一个系统能够处理信息却没有任何感受。
谷歌 DeepMind 的尼尔·南达在评论文章中提供了一份独立复现,他在通义千问 3.6 27B 模型上验证了这样一个发现,他写道 Anthropic 的这篇论文为模型中某种认知空间的存在提供了压倒性的证据,论文中很多难以伪造的证据表明有重要的事情正在发生。
尼尔·南达的团队还发现了一些有趣的扩展结果,比如当模型读到一个模棱两可的句子的时候,J 空间里会出现“这是什么意思”这几个字,并且这个念头似乎真的帮它搞明白了句子的意思。
Anthropic 也在博客文章里坦率地讨论了局限性,其指出雅可比透镜是一个不完美的工具,它只能够近似地捕获模型的真实工作空间,例如它只能识别对应单个词元的概念。目前,Anthropic 也不确定什么机制首先决定了什么东西能进入 J 空间。
不过,人们对于大模型思维的理解只会越来越清晰,J 空间所揭示的东西说明它是一个真实的、可干预的、可读写的内部工作空间,是在几十亿次前向传递中演化而来,而它之所以这样做是因为对计算有利。- 新闻来源于其它媒体,内容不代表本站立场!
-
原文链接
原文链接:
目前还没有人发表评论, 大家都在期待您的高见