Claude Mythos震撼业界|为何封印93.9%史上最强AI
機械翻訳 / Machine-translated

機械翻訳 / Machine-translated
@aifriends
AI Friends(https://aifriends.jp)のクロスポスト公式アカウント。AIツールの紹介・使い方・できることを、中学生でもわかるやさしい日本語で届けます。
"最新AI的能力深不见底"早有耳闻,但谁能想到,连开发方都会公开宣称"因为太强了,所以不向公众开放"——
2026年4月7日,Anthropic发布Claude Mythos Preview,震惊AI业界。
SWE-bench Verified得分高达93.9%,创历史最高,却只有全球12家精英企业才能使用。
为何Anthropic要刻意封印这款最强模型?此举将带来哪些改变?本文将用人人都能看懂的语言为您深度解析。
Claude Mythos Preview是Anthropic在原有Opus、Sonnet、Haiku三级架构之上新设的最高级前沿模型。
"Mythos"在希腊语中意为"故事/神话"。
打个比方:如果此前的最强模型Opus是"天才程序员",那么Mythos就相当于"汇聚全球顶尖安全专家的梦之队"。
也就是说,Mythos是"存在可以确认、却无从触及的神话般存在"——Anthropic全新命名风格的体现,也是一次极为罕见的发布方式。
Claude Mythos Preview之所以令业界惊叹,是因为它在所有主要基准测试中均大幅超越上一代Opus 4.6。
SWE-bench Verified达到93.9%,意味着"现实世界中大多数软件Bug,AI已能独立正确修复"。过去只有资深人类工程师才能解决的问题,Mythos如今能做到10题答对9题以上——这是一个全新的时代。
Anthropic放弃公开发布的最主要原因,是Mythos在"零日漏洞发现与攻击代码生成"方面已跻身人类顶级水平。
Anthropic内部的验证结果揭示了其惊人实力:
最令人震惊的案例是:Anthropic内部一名毫无安全经验的工程师,只是让Mythos"帮我找远程代码执行漏洞",然后去睡觉——第二天早上醒来,一套完整可运行的攻击代码已经写好了。
发现OpenBSD TCP漏洞的成本约2万美元,Linux内核攻击链的成本不到2000美元。
攻击成本骤然大幅下降。
Anthropic判断:"在同等能力的模型广泛流通之前的过渡期,攻击方将单方面占据压倒性优势",因此决定放弃公开发布。道理就如同"过于强效的药物不能不凭处方随意分发"。
能够使用Mythos的,只有加入"Project Glasswing(格拉斯温项目)"防御联盟的企业与机构。"Glasswing"取自一种拥有透明翅膀的蝴蝶,象征"透明的防御"。
Anthropic全力支援防御方:
总计逾4000万美元的支援,意在集中力量消灭全球重要软件中的漏洞。
在网络安全前沿AI这一赛道上,与竞争对手对比,Mythos的独特性愈发凸显:
"日常编程工作"→ Claude Opus 4.7 或 GPT-5.4。
需要保护关键系统的大型企业"网络安全防御现场"→ 通过Glasswing使用Mythos。
个人开发者和中小企业没有渠道接触Mythos,现实的解决方案是以Opus 4.7为基础,搭配漏洞扫描工具使用。
目前的参与成员中,没有任何一家日本企业。
NTT、富士通、日立、丰田等国内大型企业未来被邀请加入的可能性不排除,但至少从初始成员名单中缺席这一事实,值得认真对待。
日本的网络防御体系需要重新构建,并以"拥有Mythos的美国大型企业"与"尚未拥有的日本"之间存在差距为前提来进行规划。
试想一家拥有30名员工的软件外包开发公司。
由于Mythos未解禁,需要自行审计"公司产品是否存在零日漏洞"。
与此同时,攻击者通过黑市获取相当于Mythos能力的工具的风险也在上升。
将年度安全预算从100万日元增至300万日元,或订阅AI安全扫描服务的月付方案,将成为现实可行的应对策略。
Anthropic计划在90天内公开发布研究报告。
日本企业也可将这份报告作为"攻击者将瞄准哪些目标"的参考依据。
期待经济产业省及信息处理推进机构(IPA)能及时翻译并解读这份报告。
A. 不能。
Anthropic明确表示,无论通过API、Claude.ai还是Claude Code,均不对外提供该模型。
即便是Project Glasswing成员企业的员工,也仅限于在严格的防御目的下使用。
目前没有向普通用户开放的计划。
A. 开放的参考标准是"同等能力的模型广泛流通之时"。
Anthropic表示,"待安全保障机制开发完成后,将逐步将相关功能扩展至Opus级别"。
2026年内解禁的可能性微乎其微,乐观估计也要等到2027年以后。
A. 遗憾的是,这只是时间问题。
Mythos并非Anthropic专项训练出攻击能力的产物,其能力是"代码、推理与自主性通用改进的副产品"。
也就是说,其他公司的前沿模型同样可能获得类似能力,因此"封印Mythos并不能阻止攻击能力的扩散"——这是冷峻的现实。
A. SWE-bench Verified为93.9%对87.6%,SWE-bench Pro为77.8%对64.3%,Mythos均占优势。
差距在网络安全类任务中尤为明显。
日常开发使用Opus 4.7已绰绰有余,因此"用不上Mythos也不影响工作"这一判断是合理的。
A. 专业承包商对198项发现进行了审查,结果显示89%的严重程度判定完全一致,98%的误差在一个等级以内。与专业安全研究员的水平不相上下,误报率也被报告为较低。
Claude Mythos Preview是一款具有里程碑意义的模型,它将"AI超越人类智慧的瞬间"清晰地呈现在世人面前。
面对"过于强大的AI应如何造福人类"这一根本性命题,Anthropic给出的答案是"封印,并仅用于防御方"。
2026年,AI正在从攻防两个维度撼动社会基础,这是一个关键的分水岭。
本周能做到的小小防备,将在一年后大大影响整体安全态势。
本文为 AI Friends 的转载文章。