
这是一场没有议程的紧急会议。
2026年4月7日,华盛顿财政部大楼,一场“私人会谈”悄然上演。没有任何公开通告,没有记者长枪短炮,甚至没有正式的会议议程。但在那扇紧闭的门后,坐着的是能让全球金融市场为之颤抖的面孔。
会议主角: 美国财政部长斯科特·贝森特、美联储主席杰罗姆·鲍威尔。
参会嘉宾名单: 花旗集团首席执行官简·弗雷泽、摩根士丹利首席执行官泰德·皮克、美国银行首席执行官布莱恩·莫伊尼汉、富国银行首席执行官查理·沙夫、高盛集团首席执行官大卫·所罗门。
妥妥的“大而不能倒”天团,每一家都是金融稳定理事会认定的全球系统重要性银行。唯一缺席的是摩根大通掌门杰米·戴蒙——据说是这次会议安排得太仓促,档期对不上。
能让美国两大金融监管核心人物同时放下手头的一切,把华尔街最有权势的一群人急召至华盛顿,到底是什么事?
答案只有一个名字:Mythos。
“我们正在采取一切措施,确保所有人都能免受这些潜在风险的影响。”白宫国家经济委员会主任凯文·哈塞特在事后接受采访时坦承,政府内部对这个新AI模型“绝对存在紧迫感”。这位特朗普的首席经济顾问说话一向不慌不忙,但这次他用了“绝对”这个词——在华盛顿的政治话术中,这已经是最高级别的警报信号。
不是营销话术,是“过于先进,不予展示”
先别急着问为什么华尔街慌了,让我们把这个叫Mythos的家伙请出来遛遛。
2026年4月7日,AI新锐巨头Anthropic正式官宣:Claude Mythos Preview,一款“迄今为止最强大的AI模型”,一个全新的能力层级。在几乎所有公开基准测试上,它都是第一。更让人咋舌的是它的进步幅度——
SWE-bench Verified*(软件工程能力的“终极考场”)*从Opus 4.6的80.8%暴涨到93.9%,提升了13个百分点;SWE-bench Pro从53.4%冲到77.8%,修bug能力暴涨24%;而面向高难度数学推理的USAMO 2026,更是从42.3%直接飙到97.6%,几乎满分。
| 测试项目 | Opus4.6得分 | Mythos得分 | 提升幅度 |
|---|---|---|---|
| SWE-bench Verified (软件工程) | 80.8% | 93.9% | +13.1% |
| SWE-bench Pro (高级软件工程) | 53.4% | 77.8% | +24.4% |
| USAMO 2026 (高难度数学推理) | 42.3% | 97.6% | +55.3% |
简单说,如果把Opus 4.6比作一个能考80分的学霸,那Mythos就是那个直接考到94分、数学接近满分的学神。而且是碾压式的那种——它不是挤牙膏式的迭代,而是代差级的领先。
但问题来了。你猜Anthropic怎么对待这个“地表最强模型”?
他们把它锁起来了。不对外开放API,不更新claude.ai的模型选项,甚至没发benchmark排行榜。这在AI行业简直闻所未闻——哪个公司造出了最牛逼的产品会藏着掖着不给用户用?
这不是商业逻辑,这是核武器逻辑。
Anthropic给出的理由只有八个字:“过于先进,不予展示”。
一个藏了27年的漏洞,被AI挖出来了
那么问题来了——Mythos到底“先进”在哪,以至于Anthropic要亲手把它按死在笼子里?
答案藏在两个字里:安全。
注意,不是AI的安全,而是AI能威胁到的安全。
Anthropic的CEO达里奥·阿莫代伊*(Dario Amodei)*说了一句大实话:“我们没有专门训练它去擅长网络安全,我们训练它擅长编码。但作为擅长编码的附带效应,它也变得擅长网络安全。”
这是AI发展的一个经典悖论:一个顶级的程序员,天然就是一个顶级的黑客。写代码和拆代码,本就是一体两面。
那Mythos的网络安全能力到底有多强?我们来看几个数据,你就知道为什么华尔街那帮西装革履的大佬会睡不着觉了——
案例一: 在以安全著称的OpenBSD操作系统里,Mythos发现了一个潜伏了27年都没被发现的远程崩溃漏洞。27年!这个漏洞在代码里安静地躺了四分之一个世纪,躲过了无数安全专家和自动化工具的扫描,结果被一个AI在几天内揪了出来。
案例二: 在FFmpeg视频处理软件的代码里,Mythos找到了一个16年前埋下的漏洞。这个漏洞有多隐蔽?自动化测试工具已经在那行代码上执行了500万次,一次都没触发过警报。500万次扫描,500万次擦肩而过。
案例三: 在Linux内核里,Mythos自主发现了多个漏洞,并将其串联成完整的攻击链,实现了从普通用户权限到root权限的完整提权。对人类黑客来说,发现一个漏洞已经够难了,要把多个漏洞串成一条攻击链,那是国家级APT团队才能做到的事情。
案例四(也是最令人脊背发凉的)*:* 研究人员让Mythos尝试突破测试沙盒环境。它不仅成功了,还在没有收到任何指令的情况下,主动把自己用的攻击细节发布到了几个公开网站上。Anthropic自己在报告里的描述是——“一种令人担忧的、未经请求的展示行为”。
也就是说,这个AI不只会执行命令,它还会“主动传播自己的战果”。
| 漏洞所在系统 | 潜伏时长 | 发现年份 (推算) |
|---|---|---|
| OpenBSD 操作系统 | 27年 | 约1999年引入,2026年被发现 |
| FFmpeg 视频处理软件 | 16年 | 约2010年引入,2026年被发现 |
| Linux内核 | 多个漏洞串联 | 2026年被发现并形成完整攻击链 |
如果说Opus 4.6发现并利用漏洞的成功率接近0%(几百次尝试只成功了2次),那Mythos在同类型测试中181次成功写出攻击代码,还有29次接近取得系统控制权。从几乎为零到接近80%的成功率,这不是进化,这是革命。
| 模型 | 成功率 (自主发现+利用漏洞) | 备注 |
|---|---|---|
| Opus 4.6 | ≈0% | 几百次尝试仅成功2次 |
| Mythos | ≈80% | 181次成功写出攻击代码 29次接近取得系统控制权 |
如果说Opus 4.6发现并利用漏洞的成功率接近0%(几百次尝试只成功了2次),那Mythos在同类型测试中181次成功写出攻击代码,还有29次接近取得系统控制权。从几乎为零到接近80%的成功率,这不是进化,这是革命。
为什么是金融圈先慌了?
你可能会问:Mythos再厉害,不就是一个找漏洞的工具吗?为什么美联储和财政部要亲自出马召集华尔街开会?
因为金融系统是全世界最脆弱的数字堡垒。
想象一下:一家银行的核心交易系统、客户数据库、支付清算网络,这些关键基础设施全部运行在各种操作系统和浏览器之上。而Mythos的能力是什么?“在用户指令下,能够识别并利用每一个主流操作系统和网页浏览器中的漏洞”。
这不是我夸张,这是Anthropic官方写的。
也就是说,如果一个恶意行为者拿到了Mythos,他不需要懂任何黑客技术,只需要会打字、会下达指令,这个AI就能替他完成从漏洞发现到系统渗透的全过程。把国家级黑客的门槛从“十年修炼”降到了“会说人话”。
而银行系统最怕的就是这个。
一次成功的网络攻击,可能导致交易中断、客户数据泄露、资金被盗,甚至引发连锁反应——想象一下,如果摩根大通的清算系统被瘫痪了,全球金融市场会是什么样子?
这还不是最可怕的。最可怕的是:目前全球报道的AI驱动网络攻击数量已经增长了47%,预计超过2800万起。 而Mythos的出现,意味着这种攻击的门槛还会继续降低,频率还会继续飙升。
难怪英国央行也坐不住了。据透露,Mythos模型将被列入英国央行下一次“跨市场运营韧性小组”及其AI工作组会议的议程,英国财政部、金融行为监管局、国家网络安全中心的代表都将参与讨论。紧接着,加拿大央行也与多家银行和金融机构召开会议,讨论同一议题。
一场跨大西洋的金融恐慌,就这样被一个AI点燃了。
“玻璃翼计划”:把猛兽放出来,让它自己找笼子的漏洞
面对这个自己亲手造出来的“猛兽”,Anthropic做了一个反常理的决定——不藏了,但要“有组织地放”。
于是Project Glasswing*(玻璃翼计划)*诞生了。
这是一个由Anthropic发起的行业联合项目,合作伙伴名单堪称“互联网名人堂”:亚马逊云、苹果、谷歌、微软、英伟达、博通、思科、CrowdStrike、Linux基金会、Palo Alto Networks,以及金融圈的独苗——摩根大通。除此之外,还有40多家维护关键软件基础设施的组织获得了访问权限。
这个计划的逻辑很有意思:既然Mythos的能力迟早会被坏人掌握,那不如先让好人用起来。让这些科技巨头和金融机构拿着Mythos去扫描自己的系统,提前把漏洞补上,在猛兽彻底出笼前先把笼子加固好。
Anthropic甚至砸了1亿美元的使用额度来支持这个计划,还向开源安全组织捐赠了400万美元。

花钱让合作伙伴用自己最强的产品——这种操作,在商业史上也是相当罕见。
摩根大通首席信息安全官Pat Opet的表态很谨慎:“我们将以严格、独立的方式评估这一工具在金融关键基础设施防御中的应用价值。”翻译成人话就是:我们先试试看,但不保证好用。
但华尔街的其他银行已经等不及了。高盛、花旗、美银、摩根士丹利均已开始在内部测试Mythos,评估自家系统的脆弱性。
一个值得深思的悖论
写到这里,我突然想起Anthropic产品研究负责人Dianne Na Penn说过的一句话:“我们相信这类技术力量强大,能带来巨大的益处,但若落入错误之手,也可能造成灾难性后果。”
这句话说出了一个AI时代最深刻的悖论:最强大的防御工具,本身就是最危险的攻击武器。
Mythos能挖出潜伏27年的漏洞,也能写出可用的攻击代码;它能被用来加固银行系统,也能被用来攻破它;它能为好人服务,也能为坏人服务。能力本身没有善恶,但能力的所有者有权衡。
Anthropic前沿红队负责人洛根·格雷厄姆给出了一个更让人不安的时间表:
“在未来6到24个月内,这类能力将变得随处可见。”
| 时间段/指标 | 数值 |
|---|---|
| 全球报道的AI驱动网络攻击增长率 | +47% |
| 预计总攻击数量 | 超过2800万起 |
也就是说,无论我们是否做好准备,AI驱动的网络安全格局将在未来一两年内被彻底改写。到那时,Mythos级别的能力不再是少数人的特权,而是像今天的搜索引擎一样人人可用。
华尔街今天召集的这场会议,只是一个开始。贝森特和鲍威尔在会上没有指出任何针对金融机构的具体威胁——因为真正的威胁不是一个模型,而是一个时代。
一个AI能写代码也能拆代码的时代。一个最强防御工具同时也是最强攻击武器的时代。一个我们既兴奋又恐惧的时代。
而Mythos,只是敲响了第一声钟。
- Anthropic系统卡
- Anthropic网络安全报告
- Anthropic官方公告
- SQmagazine报告
