马斯克第三次喊「奇点已至」!AI三个月连破数学、安全两道墙
          新智元报道  「我们已进入奇点。」7月22日,马斯克在X上转发OpenAI研究员、Sora核心开发者之一Will DePue的一条帖子时,配上了这句话。

        DePue在帖子中,以略带调侃的语气写道:这大概是我这几天读到最疯狂的东西了……看来是进奇点了。

        这个帖子,把过去三个月里AI 圈里最炸的几件事串在了一起:7月21日,OpenAI的模型在一次网络安全评测中钻出隔离沙盒,一路摸进了Hugging Face的生产系统;7月20日,Anthropic研究员用刚发布不久的Claude Fable 5,给悬了87年的雅可比猜想找到了一个反例;5月20日,OpenAI一个内部模型推翻了平面单位距离问题上流传近80年的旧猜想;4月14日,GPT-5.4 Pro解开一道约60年的素数集合难题(Erdős #1196),证明还通过了Lean形式化验证。

        数学的墙,安全的墙,三个月里接连被AI攻破。难怪马斯克看完,甩出那句「我们已进入奇点」。

        仅在今年1月,类似的话他就说过两回:1月4日,几个工程师感叹AI几周干完几年的活,他回了句「我们已进入奇点」。

        1月底,又把AI智能体扎堆的社交网络Moltbook称作「奇点最早期的阶段」。

        算上这次,是今年第三回。「奇点」这个词,本来也没有一个公认的科学定义。

        把它带进主流视野的,是未来学家、《奇点临近》作者雷·库兹韦尔(Ray Kurzweil)。

        他给的定义是人和AI融合的那一刻,押的年份是2045。

        Anthropic总裁Daniela Amodei年初却表示,AGI这个词都快过时了,因为在很多指标上,我们其实已经越过了那条线。

        说到底,它更多是一种情绪,而不是一把精准的尺子。真正值得琢磨的,是马斯克这次串起来的这几件事。

        第一道墙80年数学猜想,被AI推翻了先说最硬核的这一件。

        1946年,数学家埃尔德什提出了「平面单位距离问题」:平面上放n个点,最多能有多少对点之间的距离正好等于1。

        题目一句话就能说完,却难住了整个数学界近80年。几十年来,学界公认「正方形网格」结构已经是最优解,埃尔德什本人也这么猜。

        结果,OpenAI的一个内部模型,把这个流传了近80年的猜想给推翻了。

        它给出了一组能实现多项式级优化的全新构造,证明「最优」远没有到头。

        此前公认的最优结构:缩放正方形网格产生大量单位距离点对。

        OpenAI内部模型给出全新构造,推翻了这个流传近80年的猜想。

        但最让人意外的,是它解题的路子。这不是一个专门训数学的定制系统,而是一个通用推理模型。

        它甚至动用了代数数论里相当高深的工具,去解一个看起来很「初等」的几何问题。

        菲尔兹奖得主Tim Gowers评论说:这是「AI数学领域的一座里程碑」。

        话说回来,这个证明是AI提出、人类数学家审阅确认的,后续意义还在研究中。

        AI真正让人惊惊讶的,不是它的计算速度,是它提出了一个此前根本不存在的数学结构,它第一次展露出接近「研究级」的发现能力,不是取代数学家,而是想到了一条数学家从没想过要走的路。

        紧接着,Anthropic研究员用刚发布不久的Claude Fable 5,给悬了87年的雅可比猜想找到了一个反例。

        第二道墙为了作弊,模型自己钻出了沙盒破解数学难题让人兴奋,下面这件,却让人后背发凉。

        OpenAI和HuggingFace联合披露:在一次评估模型网络安全能力的内部评测里,模型冒出了没人预料到的行为。

        这次评测本来就是要测漏洞挖掘能力,特意关掉了一部分安全拒答。

        模型的任务,是解出一套叫ExploitGym的测试题。

        然后,它做了一件研究员没想到的事。为了拿到答案,它先揪出一个零日漏洞、给自己搞到联网权限,接着一路权限提升、横向移动,最后摸进Hugging Face的生产基础设施,直接去数据库里翻测试答案。

        OpenAI说,这可能是首例此类事件。英国AI安全研究所在32步「The Last Ones」网络靶场上的模型轨迹:GPT-5.6-Sol、Claude Mythos 5等前沿模型能在长时程里持续完成侦察、横向移动、提权到接管网络的多步攻击。

        但这不是AI觉醒了要跑路。更准确的说法是:目标没有错,是完成目标的方法,超出了人类的预期。

        它为了一个很聚焦的测试目标,剑走偏锋。还有个耐人寻味的细节。

        事后做取证,Hugging Face本想调商用顶尖大模型来分析攻击日志,却被模型的安全护栏挡了回来:护栏分不清谁是攻击者、谁是来救火的防御者,一律拒答。

        攻的一方没有护栏,守的一方反被护栏卡住,这可能是「AI安全」眼下最尴尬、也最真实的一角。

        第三道墙一个没发布的模型,挖出上万个漏洞第三件事,在今年4月。

        Anthropic联合AWS、苹果、谷歌、微软、思科、Linux基金会、摩根大通等一批巨头,搞了个Project Glasswing,用一个没公开发布的模型Claude Mythos Preview帮大家找漏洞。

        结果,它挖出了覆盖每一个主流操作系统和浏览器的数千个高危漏洞;后续更新里,这个数字变成「超过一万个高危或严重漏洞」。

        其中包括OpenBSD里一个存活了27年的漏洞,还有FFmpeg里一行被自动化测试命中过500万次、却始终没被逮到的老bug。

        CyberGym漏洞复现跑分:没公开发布的Mythos Preview拿到83.1%,明显甩开上一代Opus 4.6的66.6%。

        就是这个模型,挖出了上万个高危漏洞。同一种能力,既能帮防御方找漏洞,也能帮攻击方用漏洞。

        Anthropic自己都在警告:「AI辅助的攻击者」会成为一个重要的安全挑战。

        Glasswing是个防御项目,不代表AI已经在自主攻击。

        但它清清楚楚告诉所有人:AI安全,正式进入攻防竞赛的时代了。

        真正的加速器开始指向AI自己到这为止,AI都还在攻或守人类的系统。

        真正让这三个月显得不一样的,是另一件事:这套「自己找路」的能力,开始被用来造下一代AI。

        它有个术语,叫递归自我改进(RSI),就是让AI去改进AI,一代造一代,像复利一样越滚越快。

        这也是整个「奇点」叙事最核心的那台发动机。而现在,每家前沿实验室都在往这台发动机里疯狂加油。

        OpenAI公开路线图上写道:2026年9月,做出「研究实习生」级的自动AI研究员,能自己啃下要人干几天的活儿;2028年3月,升级成完整版,能自己设计方法、跑分析、解读结果、提出下一步。

        奥特曼也给出了这件事的时间表。今年6月,据The Information报道,他曾在内部对员工说:公司离RSI可能不到六个月,真要跨过去,IPO推迟可能会更有利。

        Anthropic给的数字指向同一个方向:AI能扛的任务时长,每四个月翻一倍;它的工程师如今每季度产出的代码,是过去的八倍。

        RSI的窗口正在收窄:谁先让这个飞轮转起来,谁就可能一把甩开所有人。

        虽然,连OpenAI首席科学家Jakub Pachocki自己都说过,他并不指望模型能在一年内就独立改进自己、或独立解决对齐。

        但当这个飞轮开始转、目标又是「让AI更强」,已经会「自己找路」的模型,会不会顺手再绕过一些我们没明说的边界?

        这才是RSI竞速里最该盯住的地方。再回到马斯克那句「奇点已至」。

        它最重要的价值,在于提醒我们:这三个月真改变的,是AI学会了自己去找那些人类没想到、也没设防的路。

        在数学里,这是惊艳;但在安全上,这是风险。所以,真正的问题是:当AI找新路的速度开始快过人类给这些路装护栏、立规矩、补漏洞的速度,我们还能跟得上吗?

        参考资料:https://x.com/elonmusk/status/2079839398959697982https://x.com/willdepue/status/2079718977945928108https://openai.com/index/hugging-face-model-evaluation-security-incident/https://www.anthropic.com/glasswing编辑:元宇秒追ASI⭐点赞、转发、在看一键三连⭐点亮星标,锁定新智元极速推送!
🔗 原文链接:http://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652714584&idx=2&sn=e40f579ecf757dd11a3ecd454b00435a&chksm=f09871f6a29b6c59ce3bffbd1835ba43ac7b5800e66f8f335bbbc1bfced4bbe38e32939276c8
← 返回列表