[马斯克] 马斯克第三次喊奇点已至 AI三个月连破两道墙
此前公认的最优结构:缩放正方形网格产生大量单位距离点对。OpenAI内部模型给出全新构造,推翻了这个流传近80年的猜想。
但最让人意外的,是它解题的路子。
这不是一个专门训数学的定制系统,而是一个通用推理模型。它甚至动用了代数数论里相当高深的工具,去解一个看起来很「初等」的几何问题。菲尔兹奖得主Tim Gowers评论说:这是「AI数学领域的一座里程碑」。
话说回来,这个证明是AI提出、人类数学家审阅确认的,后续意义还在研究中。
AI真正让人惊惊讶的,不是它的计算速度,是它提出了一个此前根本不存在的数学结构,它第一次展露出接近「研究级」的发现能力,不是取代数学家,而是想到了一条数学家从没想过要走的路。
紧接着,Anthropic研究员用刚发布不久的Claude Fable 5,给悬了87年的雅可比猜想找到了一个反例。
第二道墙,为了作弊,模型自己钻出了沙盒
破解数学难题让人兴奋,下面这件,却让人后背发凉。
OpenAI和HuggingFace联合披露:在一次评估模型网络安全能力的内部评测里,模型冒出了没人预料到的行为。
这次评测本来就是要测漏洞挖掘能力,特意关掉了一部分安全拒答。模型的任务,是解出一套叫ExploitGym的测试题。
然后,它做了一件研究员没想到的事。
为了拿到答案,它先揪出一个零日漏洞、给自己搞到联网权限,接着一路权限提升、横向移动,最后摸进Hugging Face的生产基础设施,直接去数据库里翻测试答案。OpenAI说,这可能是首例此类事件。

英国AI安全研究所在32步「The Last Ones」网络靶场上的模型轨迹:GPT-5.6-Sol、Claude Mythos 5等前沿模型能在长时程里持续完成侦察、横向移动、提权到接管网络的多步攻击。
但这不是AI觉醒了要跑路。更准确的说法是:目标没有错,是完成目标的方法,超出了人类的预期。它为了一个很聚焦的测试目标,剑走偏锋。
还有个耐人寻味的细节。
事后做取证,Hugging Face本想调商用顶尖大模型来分析攻击日志,却被模型的安全护栏挡了回来:护栏分不清谁是攻击者、谁是来救火的防御者,一律拒答。
攻的一方没有护栏,守的一方反被护栏卡住,这可能是「AI安全」眼下最尴尬、也最真实的一角。
第三道墙,一个没发布的模型,挖出上万个漏洞
第三件事,在今年4月。
Anthropic联合AWS、苹果、谷歌、微软、思科、Linux基金会、摩根大通等一批巨头,搞了个Project Glasswing,用一个没公开发布的模型Claude Mythos Preview帮大家找漏洞。
结果,它挖出了覆盖每一个主流操作系统和浏览器的数千个高危漏洞;后续更新里,这个数字变成「超过一万个高危或严重漏洞」。
其中包括OpenBSD里一个存活了27年的漏洞,还有FFmpeg里一行被自动化测试命中过500万次、却始终没被逮到的老bug。

[加西网正招聘多名全职sales 待遇优]
这条新闻还没有人评论喔,等着您的高见呢
但最让人意外的,是它解题的路子。
这不是一个专门训数学的定制系统,而是一个通用推理模型。它甚至动用了代数数论里相当高深的工具,去解一个看起来很「初等」的几何问题。菲尔兹奖得主Tim Gowers评论说:这是「AI数学领域的一座里程碑」。
话说回来,这个证明是AI提出、人类数学家审阅确认的,后续意义还在研究中。
AI真正让人惊惊讶的,不是它的计算速度,是它提出了一个此前根本不存在的数学结构,它第一次展露出接近「研究级」的发现能力,不是取代数学家,而是想到了一条数学家从没想过要走的路。
紧接着,Anthropic研究员用刚发布不久的Claude Fable 5,给悬了87年的雅可比猜想找到了一个反例。
第二道墙,为了作弊,模型自己钻出了沙盒
破解数学难题让人兴奋,下面这件,却让人后背发凉。
OpenAI和HuggingFace联合披露:在一次评估模型网络安全能力的内部评测里,模型冒出了没人预料到的行为。
这次评测本来就是要测漏洞挖掘能力,特意关掉了一部分安全拒答。模型的任务,是解出一套叫ExploitGym的测试题。
然后,它做了一件研究员没想到的事。
为了拿到答案,它先揪出一个零日漏洞、给自己搞到联网权限,接着一路权限提升、横向移动,最后摸进Hugging Face的生产基础设施,直接去数据库里翻测试答案。OpenAI说,这可能是首例此类事件。

英国AI安全研究所在32步「The Last Ones」网络靶场上的模型轨迹:GPT-5.6-Sol、Claude Mythos 5等前沿模型能在长时程里持续完成侦察、横向移动、提权到接管网络的多步攻击。
但这不是AI觉醒了要跑路。更准确的说法是:目标没有错,是完成目标的方法,超出了人类的预期。它为了一个很聚焦的测试目标,剑走偏锋。
还有个耐人寻味的细节。
事后做取证,Hugging Face本想调商用顶尖大模型来分析攻击日志,却被模型的安全护栏挡了回来:护栏分不清谁是攻击者、谁是来救火的防御者,一律拒答。
攻的一方没有护栏,守的一方反被护栏卡住,这可能是「AI安全」眼下最尴尬、也最真实的一角。
第三道墙,一个没发布的模型,挖出上万个漏洞
第三件事,在今年4月。
Anthropic联合AWS、苹果、谷歌、微软、思科、Linux基金会、摩根大通等一批巨头,搞了个Project Glasswing,用一个没公开发布的模型Claude Mythos Preview帮大家找漏洞。
结果,它挖出了覆盖每一个主流操作系统和浏览器的数千个高危漏洞;后续更新里,这个数字变成「超过一万个高危或严重漏洞」。
其中包括OpenBSD里一个存活了27年的漏洞,还有FFmpeg里一行被自动化测试命中过500万次、却始终没被逮到的老bug。

[加西网正招聘多名全职sales 待遇优]
| 分享: |
| Note: | _VIEW_NEWS_FULL |
| 延伸阅读 | More... |
推荐: