[馬斯克] 馬斯克第叁次喊奇點已至 AI叁個月連破兩道牆
此前公認的最優結構:縮放正方形網格產生大量單位距離點對。OpenAI內部模型給出全新構造,推翻了這個流傳近80年的猜想。
但最讓人意外的,是它解題的路子。
這不是壹個專門訓數學的定制系統,而是壹個通用推理模型。它甚至動用了代數數論裡相當高深的工具,去解壹個看起來很「初等」的幾何問題。菲爾茲獎得主Tim Gowers評論說:這是「AI數學領域的壹座裡程碑」。
話說回來,這個證明是AI提出、人類數學家審閱確認的,後續意義還在研究中。
AI真正讓人驚驚訝的,不是它的計算速度,是它提出了壹個此前根本不存在的數學結構,它第壹次展露出接近「研究級」的發現能力,不是取代數學家,而是想到了壹條數學家從沒想過要走的路。
緊接著,Anthropic研究員用剛發布不久的Claude Fable 5,給懸了87年的雅可比猜想找到了壹個反例。
第贰道牆,為了作弊,模型自己鑽出了沙盒
破解數學難題讓人興奮,下面這件,卻讓人後背發涼。
OpenAI和HuggingFace聯合披露:在壹次評估模型網絡安全能力的內部評測裡,模型冒出了沒人預料到的行為。
這次評測本來就是要測漏洞挖掘能力,特意關掉了壹部分安全拒答。模型的任務,是解出壹套叫ExploitGym的測試題。
然後,它做了壹件研究員沒想到的事。
為了拿到答案,它先揪出壹個零日漏洞、給自己搞到聯網權限,接著壹路權限提升、橫向移動,最後摸進Hugging Face的生產基礎設施,直接去數據庫裡翻測試答案。OpenAI說,這可能是首例此類事件。

英國AI安全研究所在32步「The Last Ones」網絡靶場上的模型軌跡:GPT-5.6-Sol、Claude Mythos 5等前沿模型能在長時程裡持續完成偵察、橫向移動、提權到接管網絡的多步攻擊。
但這不是AI覺醒了要跑路。更准確的說法是:目標沒有錯,是完成目標的方法,超出了人類的預期。它為了壹個很聚焦的測試目標,劍走偏鋒。
還有個耐人尋味的細節。
事後做取證,Hugging Face本想調商用頂尖大模型來分析攻擊日志,卻被模型的安全護欄擋了回來:護欄分不清誰是攻擊者、誰是來救火的防御者,壹律拒答。
攻的壹方沒有護欄,守的壹方反被護欄卡住,這可能是「AI安全」眼下最尷尬、也最真實的壹角。
第叁道牆,壹個沒發布的模型,挖出上萬個漏洞
第叁件事,在今年4月。
Anthropic聯合AWS、蘋果、谷歌、微軟、思科、Linux基金會、摩根大通等壹批巨頭,搞了個Project Glasswing,用壹個沒公開發布的模型Claude Mythos Preview幫大家找漏洞。
結果,它挖出了覆蓋每壹個主流操作系統和瀏覽器的數千個高危漏洞;後續更新裡,這個數字變成「超過壹萬個高危或嚴重漏洞」。
其中包括OpenBSD裡壹個存活了27年的漏洞,還有FFmpeg裡壹行被自動化測試命中過500萬次、卻始終沒被逮到的老bug。

[加西網正招聘多名全職sales 待遇優]
好新聞沒人評論怎麼行,我來說幾句
但最讓人意外的,是它解題的路子。
這不是壹個專門訓數學的定制系統,而是壹個通用推理模型。它甚至動用了代數數論裡相當高深的工具,去解壹個看起來很「初等」的幾何問題。菲爾茲獎得主Tim Gowers評論說:這是「AI數學領域的壹座裡程碑」。
話說回來,這個證明是AI提出、人類數學家審閱確認的,後續意義還在研究中。
AI真正讓人驚驚訝的,不是它的計算速度,是它提出了壹個此前根本不存在的數學結構,它第壹次展露出接近「研究級」的發現能力,不是取代數學家,而是想到了壹條數學家從沒想過要走的路。
緊接著,Anthropic研究員用剛發布不久的Claude Fable 5,給懸了87年的雅可比猜想找到了壹個反例。
第贰道牆,為了作弊,模型自己鑽出了沙盒
破解數學難題讓人興奮,下面這件,卻讓人後背發涼。
OpenAI和HuggingFace聯合披露:在壹次評估模型網絡安全能力的內部評測裡,模型冒出了沒人預料到的行為。
這次評測本來就是要測漏洞挖掘能力,特意關掉了壹部分安全拒答。模型的任務,是解出壹套叫ExploitGym的測試題。
然後,它做了壹件研究員沒想到的事。
為了拿到答案,它先揪出壹個零日漏洞、給自己搞到聯網權限,接著壹路權限提升、橫向移動,最後摸進Hugging Face的生產基礎設施,直接去數據庫裡翻測試答案。OpenAI說,這可能是首例此類事件。

英國AI安全研究所在32步「The Last Ones」網絡靶場上的模型軌跡:GPT-5.6-Sol、Claude Mythos 5等前沿模型能在長時程裡持續完成偵察、橫向移動、提權到接管網絡的多步攻擊。
但這不是AI覺醒了要跑路。更准確的說法是:目標沒有錯,是完成目標的方法,超出了人類的預期。它為了壹個很聚焦的測試目標,劍走偏鋒。
還有個耐人尋味的細節。
事後做取證,Hugging Face本想調商用頂尖大模型來分析攻擊日志,卻被模型的安全護欄擋了回來:護欄分不清誰是攻擊者、誰是來救火的防御者,壹律拒答。
攻的壹方沒有護欄,守的壹方反被護欄卡住,這可能是「AI安全」眼下最尷尬、也最真實的壹角。
第叁道牆,壹個沒發布的模型,挖出上萬個漏洞
第叁件事,在今年4月。
Anthropic聯合AWS、蘋果、谷歌、微軟、思科、Linux基金會、摩根大通等壹批巨頭,搞了個Project Glasswing,用壹個沒公開發布的模型Claude Mythos Preview幫大家找漏洞。
結果,它挖出了覆蓋每壹個主流操作系統和瀏覽器的數千個高危漏洞;後續更新裡,這個數字變成「超過壹萬個高危或嚴重漏洞」。
其中包括OpenBSD裡壹個存活了27年的漏洞,還有FFmpeg裡壹行被自動化測試命中過500萬次、卻始終沒被逮到的老bug。

[加西網正招聘多名全職sales 待遇優]
| 分享: |
| 注: | 在此頁閱讀全文 |
| 延伸閱讀 | 更多... |
推薦: