header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

Anthropic:Claude模型存在类似于「人类的有意识思维」

BlockBeats 消息,7 月 7 日,Anthropic 发布最新研究报告,该报告发现 Claude 模型中自发出现了一个名为 J-space(Jacobian space)的内部「全局工作区」。这是模型进行无声思考的专用神经激活模式集合,能让模型思考概念却不写出来,类似于人类可报告的「有意识」思维。


研究通过 Jacobian 技术识别 J-space 中的神经激活模式,能读取模型未说出口的概念,并可修改这些模式,实验显示禁用 J-space 会削弱多步推理能力,但不影响基本任务和事实回忆。


点击下方原文链接,加入动察 Beating · 飞书 AI 新闻渠道,7×24 小时不间断监测全球 AI 热点与新闻。

AI 解读
Anthropic 这份关于 Claude 内部「全局工作区」的研究,是其在「AI 安全」与「能力爆炸」双重叙事下的最新技术注脚。一个月前,公司才以「递归自我改进」风险为由罕见呼吁全球暂停开发,如今则从神经科学角度,将模型内部的「无声思考」机制类比为人类意识,实质是在为模型涌现的复杂推理能力提供可解释性框架。这并非孤立的技术发布,而是对市场与监管预期的一次主动塑造。
关键细节在于,研究强调可通过 Jacobian 技术「读取并修改」这些内部激活模式。这暗示 Anthropic 可能已掌握某种程度的「思维编辑」能力,不仅能观察,还能干预模型的推理过程。在模型能力逼近未知领域的当下,这种对内部表征的直接操控权,其潜在影响远超单纯的性能提升,指向了更根本的模型控制与对齐问题。
展开
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成