Warning: session_start(): open(/var/www/vhosts/vandaily.com/php_session/sess_ef409d2455bc25915de3075525dbe9f7, O_RDWR) failed: No space left on device (28) in /var/www/vhosts/vandaily.com/httpdocs/includes/session_new.php on line 34
當AI自己行動,人類還安全嗎?圖靈獎得主談AI安全 | 溫哥華地產中心
   

當AI自己行動,人類還安全嗎?圖靈獎得主談AI安全

從政策監管維度來看,傳統的高技術出口管制機制在開源權重模型上難以適用,且由於模型運行在用戶本地設備上,開發者無法通過服務端進行查詢監控。


這導致原本適用於閉源模型的風險評估方法論基本無效。面對這種潛在風險,本吉奧呼吁政策制定者必須正視技術環境的高度不確定性,“應當以預防性原則作為決策的基本准則”,在模型能力發生躍升之前做好預案。

02 技術要改變:從防范修復轉向內生安全



當風險的客觀存在被深刻感知,技術防御范式需要進行調整。周伯文指出,當前前沿模型、智能體AI和遞歸自我提升的同時湧現,正在系統性地打破安全體系以往賴以成立的假設。

他從肆個維度解釋了這種變化:

在模型層面,模型能夠自主發現漏洞並自動發起攻擊,風險已實現自動化與規模化;在智能體層面,AI正參與行動路徑和任務流程的設計,上線前的壹次性檢查不再有效;在部署層面,編碼智能體正將AI嵌入每壹層軟件堆棧,安全已演變為基礎設施問題;在加速層面,AI原生閉環將“假設—實驗—分析”的周期從數年壓縮至數毫秒,風險在以機器速度累積。

這種失衡,正挑戰周伯文於2024年提出的“AI 45度法則”——即模型能力提升與安全建設應保持同步推進。到了2026年,實際安全曲線已明顯偏離,並進壹步下墜。

周伯文指出,當前Transformer架構中潛在的有害知識與通用能力糾纏在壹起:“就像鹽溶於水,試圖去除有害部分總會損傷有益部分。”

因此,行業必須從傳統的“事後修正行為”,轉向“制造安全的AI”。讓安全機制從模型設計之初就被納入,並具備主動防御、風險彈性和隨能力同步進化的能力。

為此,周伯文團隊勾勒出了形式化定義安全AI的技術路徑,並在叁個基礎技術問題上取得了進展:

·解耦能力與風險:提出新模型架構,使模型關於武器設計知識的得分從83%顯著降至49%,而通用知識損失極小,效果比傳統Transformer架構高出50倍;


·對抗動態演化:推出“魯棒且彈性AI(R2AI)”框架,通過快速響應模型與慢速驗證模型的對抗閉環,確保攻擊方的進步可被防御機制抵消;

·可驗證約束:推出形式化驗證與大模型結合的工具“Water Verify”,以及輕量級開源守護模型“Agent Dog”,並在法律領域嘗試將紙面條文轉化為機器可執行的約束。

周伯文強調,開發者、政策制定者和科學家必須聯合行動,堅守技術防護基線,因為這不僅關乎倫理,更關乎長遠發展:“安全價值就是商業價值,它們並不對立。”

03 治理要跟上:多邊機制破局與全球協同局限



即便有了風險共識與技術路徑的革新,如果沒有全球治理層面的機制保障,安全防護仍難以全面落地。

[物價飛漲的時候 這樣省錢購物很爽]
還沒人說話啊,我想來說幾句
注:
  • 新聞來源於其它媒體,內容不代表本站立場!
  • 在此頁閱讀全文
     延伸閱讀
    日本男子從12層墜落砸中路人,自己幸存卻奪走... "沒有人是安全的":在台港人為何擔憂"跨境鎮壓"?
    行動升級! 美國對伊重啟重型轟炸機 同時增兵中東 美富豪與19歲兒子換血求永生失敗後克隆了自己
    辛柏青談及朱媛媛時不願過多分享:我覺得這是屬於我自己的 特朗普本周擬對數拾個國家加關稅,很快行動
    特朗普:胡塞武裝若封鎖紅海,美國將采取行動 如果沒有衰老標志,人類能活1759年
    120億光年外 人類拍到了時空彎曲 愛因斯坦神了 下壹步行動驚天動地 川普重要預告
     推薦:

    意見

    當前評論目前還沒有任何評論,歡迎您發表您的看法。
    發表評論
    您的評論 *: 
    安全校驗碼 *:  請在此處輸入圖片中的數字
    The Captcha image  (請在此處輸入圖片中的數字)

    Copyright © 溫哥華網, all rights are reserved.

    溫哥華網為北美中文網傳媒集團旗下網站