Warning: session_start(): open(/var/www/vhosts/vandaily.com/php_session/sess_ef409d2455bc25915de3075525dbe9f7, O_RDWR) failed: No space left on device (28) in /var/www/vhosts/vandaily.com/httpdocs/includes/session_new.php on line 34
"Claude長出意識"怎麼理解?專家解析AI意識爭議 | 溫哥華教育中心
   

"Claude長出意識"怎麼理解?專家解析AI意識爭議

卓克:“Claude長出意識”的新聞,怎麼理解?


最近,Anthropic的壹篇研究被各媒體傳播,題目大都類似於“Claude長出了意識”“Anthropic切開了Claude的大腦發現了意識空間”“AI有了內心獨白和主觀體驗”等等。

今天,我們請得到App《科技參考5》主理人卓克老師,來幫你解讀這個新聞。理解這篇新聞,非常有助於我們了解當前模型的細節,但更重要的是,它能幫我們區分:什麼是模型內部真實存在的中間表征,什麼是媒體和公眾腦補出來的“意識故事”。

Anthropic這項研究,真正突破的不是證明AI有了靈魂,而是提供了壹種觀察模型黑箱的新工具:它讓我們看到,模型在給出答案前,哪些概念可能參與了推理,又怎樣影響最終輸出。AI確實越來越像會思考,但越是這樣,我們越需要把熱鬧的想象,拉回冷靜的理解。

作者:卓克

來源:得到App《科技參考5》

01

Claude有意識了?

這篇Anthropic的文章題目,如果直接翻譯就叫做《語言模型中的全局工作空間》,但要明白這個空間是怎麼看到的,那就要細說了。

媒體解讀的各種文章之所以都被放在頭條,還都很抓眼球,是因為讓人以為語言模型有了意識,有了靈魂。

Anthropic在文章中給了很多鮮活的例子,比如,讓他抄寫壹句話,是關於繪畫的句子,然後壹邊抄,壹邊讓他心裡想著“橘子”。然後就會觀察到在他們定義的“J-空間”裡發現了“橘子、水果”這些概念,同時這個空間裡還有“思考、想象”這些關鍵詞。

還有個例子是,問Claude:“會織網的動物有幾條腿?”他的回答就是“8”,沒有出現其他信息。但在那個J-空間裡卻出現了“蜘蛛”這個詞。所以咱們旁觀者壹看,這不就是有腦子的證據嗎?心裡有很多中間步驟要說沒說啊。

而且工程師還通過特定的操作,把J-空間裡的“蜘蛛”替換成了“螞蟻”,然後再觀察輸出結果。Claude再回答“會織網的動物有幾條腿?6條”。也就是說,這個中間步驟的心智是真實存在的,並且能夠直接影響推理的結果。

然後還有這樣的例子,被說得很神,就是工程師讓Claude在接下來不要想某壹個特定的概念。結果Claude在思考過程中,J-空間裡那個概念是壹直存在的。雖然強度比你命令他專門去想這個概念的時候弱,但也遠遠高於你不提這個要求時,這個概念的強度。

而且Claude的J-空間裡還冒出了“完蛋了”“失敗”這樣的詞。媒體的解讀是,他沒控制住,他還非得想那個詞,結果他自己罵了自己壹句。因為這個場景平時人類也在做,比如越告訴他別在某個步驟犯錯,結果事到臨頭還是掉坑裡去了,然後自己罵自己壹句。接下來就是對Claude意識存在、靈魂存在的延伸討論了。

02

所有大模型都有意識?


而實際上,Anthropic這篇論文裡,雖然提到了意識,但往往不是單獨出現的,而是以“conscious access”這個詞出現的。

按照文章的內容,conscious(意識)其實很不適合翻譯為“人的意識”,更應該翻譯成“表征”,“數學表征”的那個“表征”——在數學上你可以理解為是向量的壹個投影。

access更應該翻譯成“可調用/可報告的”。

於是,整個詞“conscious access”應該翻譯成“可調用的向量投影”或者“可調用的數學表征”,而不能再往“感覺、體驗、道德、意識”之類的方向去理解了。

很多同學對“大語言模型表現得很像有意識的樣子”這件事其實很熟。

比如,我們曾經介紹了壹個OpenAI的實驗。

當時是用GPT-4去解讀GPT-2的各層神經元,比如,第17層的第3218號神經元,學會的是“壹句話表達完了”這個狀態。而第21層的第2932號神經元,學會的是“加拿大”這個概念。同時,加拿大人、國家、多倫多、金士頓這些概念對於那個神經元來說也是激活的。神經元對“加拿大”的理解,從GPT-2那個遠古時期以來就不是死板的。

而且我們也在3年前就知道,大語言模型在輸出結果時,有點像文字接龍的游戲。就是在上壹句話最後接哪個詞,吐出那個字之前,其實是有壹個“next token輸出概率榜”的,這個概率榜單壹大長串。

[加西網正招聘多名全職sales 待遇優]
無評論不新聞,發表壹下您的意見吧
上壹頁123下壹頁
注:
  • 新聞來源於其它媒體,內容不代表本站立場!
  • 在此頁閱讀全文
     延伸閱讀
    "我是Claude,不是Kimi" 中國AI模型大翻車 Grok 4.5和Claude 4.8,在我電腦裡"打"起來了
    切開Claude大腦,發現了類似人類意識的內部空間 中國工信部警示Claude Code存安全隱患
    Anthropic宣布:Claude自己長出了意識 消息稱阿裡全面禁用Claude 禁令7月10日正式生效
    業余語言學家聲稱用Claude Code破解3500年前死語言 Anthropic深夜發布Claude Fable 5 屠榜所有測試
    偷電子書被罰15億美元後 Claude又毀掉百萬實體書 Claude Code之父:26年未寫1行代碼 不再用電腦
     推薦:

    意見

    當前評論目前還沒有任何評論,歡迎您發表您的看法。
    發表評論
    您的評論 *: 
    安全校驗碼 *:  請在此處輸入圖片中的數字
    The Captcha image  (請在此處輸入圖片中的數字)



    Copyright © 溫哥華網, all rights are reserved.

    溫哥華網為北美中文網傳媒集團旗下網站