Mythos(Claude Mythos)是 Anthropic 推出的高阶能力版本大模型,隶属于 Project Glasswing(玻璃翼计划)。其底层基座与公开版 Claude Fable 5 完全一致,最大区别在于安全护栏策略完全反向——针对性放开了网络安全、高危代码审计、漏洞挖掘、生命科学推演等高风险能力。本报告系统梳理 Mythos 与通用大模型的核心安全差异、白名单准入机制的核心原因、Fable 与 Mythos 的关系,并通过对比表呈现两者在安全护栏、漏洞挖掘能力、开放方式等维度的差异。
Mythos(Claude Mythos)是 Anthropic 推出的高阶能力版本大模型,隶属于 Project Glasswing(玻璃翼计划)。其底层基座与公开版 Claude Fable 5 完全一致,二者最大区别不在于模型智商、通用能力,而在于安全护栏策略完全不同。
普通大模型均预设严格安全限制,对高危领域内容进行拦截;而 Mythos 针对性放开了网络安全、高危代码审计、漏洞挖掘、生命科学推演等高风险能力。
因此 Mythos 并未对外公开售卖、开放注册,仅采用严格白名单邀请制,仅限合规可信机构使用。
普通大模型(GPT、Claude Opus/Sonnet/Fable 等)
Mythos 大模型
常规模型风险:用户主动诱导 → 模型被动输出有害内容。
Mythos 独特风险:用户即使只提出正常代码审计需求,模型会自主发现高危害零日漏洞、自动推导可利用攻击方式、自动生成 POC/EXP。
Mythos 完成了 Anthropic 最高等级的红队测试,产出 244 页专业 System Card 安全评估报告。评估重点不再是普通造谣、诈骗、暴力风险,而是:
传统高级零日漏洞挖掘门槛极高,仅顶尖安全团队掌握。Mythos 将顶级网络攻防能力普惠化:
官方定位:Mythos 高危能力只允许防御方先用、先用尽。
优先开放给:
目的:在黑客大规模掌握该能力前,先修复全网高危漏洞。
所有白名单机构必须签署严格约束:
Mythos 不售卖、不付费开通、不自主申请。全部由 Anthropic 官方主动筛选、定向邀请。
| 对比维度 | 通用大模型 / Claude Fable | Claude Mythos |
|---|---|---|
| 安全护栏 | 全开,高危行为拦截 | 仅关闭攻防、生科护栏 |
| 漏洞挖掘能力 | 基础代码检查、不挖零日 | 可自主挖掘内核级零日漏洞 |
| 攻击链构建 | 禁止、屏蔽 | 完整生成、推演、复现 |
| 开放方式 | 公开付费、全员可用 | 严格白名单、邀请制 |
| 使用场景 | 日常办公、文案、开发、学习 | 企业防御、基础设施加固、合规科研 |
| 核心风险 | 用户滥用 | 模型内生高级攻防能力扩散风险 |