先锋 趋势 方法 投研 作者
(预告)Mythos 与 Project Glasswing、Anthropic 之年仍在快步向前、围绕 NYT、Altman 与去全球化的问答
返回节目精读

(预告)Mythos 与 Project Glasswing、Anthropic 之年仍在快步向前、围绕 NYT、Altman 与去全球化的问答

摘要

  • Anthropic 的 Mythos 让 AI 驱动的漏洞发现成为近期必然到来的安全事件,即使外界仍无法确知其当前的准确能力边界。 目前预览仅限约 50 家关键基础设施机构,包括 Amazon、Microsoft、Apple、Google 和 Linux Foundation。Ben Thompson 的长期判断是确定性的:遗留软件中存在海量 bug,模型擅长穷尽式审查,而最终“狼终究会来”。

  • 将 Mythos 保持私有,既符合 Anthropic 的安全论证,也符合其维护市场支配力和定价权的商业利益。 Thompson 将此与 Anthropic 团队早年在 OpenAI 的工作联系起来:当时不公开 GPT-2 既可能确实出于风险考量,也能防止竞争对手复制前沿能力。自助式 API 会让有决心的蒸馏“很难阻止”。

  • 蒸馏会缩小模型护城河,但不会将其抹平。 Thompson 表示,被复制的模型仍然“更加参差不齐”、覆盖面更窄,落后于原始模型,但面对昂贵的前沿产品,仍可能“好到绰绰有余”。他对开源模型大约落后 6 个月的解释是:向领先 API 发起“无数次”查询、再用输出训练模型,大致就需要这么长时间。

  • 算力稀缺已经在决定 Anthropic 的产品质量、访问权限和商业经济性。 Thompson 表示,公司“勉强维持在线”,而限流、量化、缓存、批处理以及提供蒸馏模型叠加起来,都会损害使用体验。Mythos 的价格约为 Opus 的 5X,而 Opus 本身已显著贵于 GPT-5.4,这进一步支持将访问权限限制在愿意支付“真金白银”的客户范围内。

  • Mythos 当前最直接的用途,是在恶意行为者获得同等能力之前发现并修补漏洞。 一位听众提到,据报道,研究人员借助 Mythos 在 1—2 个月内发现的漏洞,已经超过了他们整个职业生涯的总和;Thompson 承认,这种防御性部署显然有价值。他谨慎地将泄露的 Quad Code 源码中可能存在的匿名报告模式,与某个 Linux kernel 小组收到数量异常庞大的有效 bug 报告联系起来,但同时强调 Anthropic 是否参与其中仍不确定。

  • Mythos 加剧了前沿实验室与政府之间尚未解决的主权冲突。 Andrew Sharp 追问,私人主体为何应当拥有这种可能渗透企业和国家的技术,并称将其国有化很可能损害 Anthropic。Thompson 反驳说,法律最终取决于“手里有枪的人”。华盛顿可能担心 Anthropic 会攻击自己,也可能认为自己需要像 Mythos 这样的能力去攻击中国。

精读

1. Mythos 让代码领域的 AI 优势变成安全威胁

  • Sharp 的铺垫是:Anthropic 正面向约 50 家关键基础设施机构预览 Mythos,但目前没有公开发布计划,因为 Mythos 能够发现并利用软件漏洞。

  • Thompson 的解释很直接:软件本质上是“海量语言”,对大语言模型而言异常可预测;而计算机恰恰擅长完成检查软件所需的那种枯燥、逐行进行的“苦力活”。

  • Sharp 认为威胁迫在眉睫;Thompson 则对时间点保持保留。Mythos 可能已经达到所宣称的能力,但数百万乃至数十亿行人类编写的代码中必然存在 bug,而能力不断提升的模型迟早会把它们找出来。

2. 安全与定价权共同将模型推向闭源

  • Thompson 的框架带着犬儒色彩,但并非全盘否定:他提到 Anthropic 团队早年在 OpenAI 的工作,当时 GPT-2 因安全风险担忧而未开放,但“不开放其实更有利于生意”。阻止近乎等价的模型出现,也能保护长期市场地位和定价权。

  • DeepSeek 提供了一个具体类比:可以对领先 API 发起“无数次”查询,生成训练数据,这也解释了为何开源替代品可能仍会落后前沿约 6 个月。

  • Sharp 问,能否可靠阻止蒸馏。Thompson 的答案实际上是否定的:复制模型的能力缺口更多、全面性仍逊于原始模型,但要管住经由云服务器转发的高速 API 请求,难度远高于“管控铀”。

3. 算力稀缺,Mythos 成为溢价产品

  • Thompson 表示 Anthropic“勉强维持在线”。5 小时的使用时段实际上并非固定 5 小时:一天中的某些时段会缩短,另一些时段则会延长。量化、提供蒸馏模型、缓存和批处理层层叠加,都会损害质量——即使这种劣化并非有意为之。

  • 定价使选择性开放在商业上合理:Mythos 的价格约为 Opus 的 5X,而 Opus 本身已经显著贵于更小的 GPT-5.4。因此,将访问权限限制给愿意支付“真金白银”的客户,就有了商业上的正当性。

4. 防御性找漏洞,是部署 Mythos 最有力的理由

  • 一位匿名听众提出质疑:据报道,顶尖安全研究人员用 Mythos 在过去 1—2 个月发现的漏洞,比他们整个职业生涯累计发现的还多。Thompson 认可这条有限但明确的建议:在恶意行为者拿到同等工具前,尽可能多地发现并修补漏洞。

  • 他谨慎地将这一行动与泄露的 Quad Code 源码中似乎存在的“隐藏模式”联系起来,并提到某个 Linux kernel 小组收到海量报告,且“全都是真实漏洞”。这些活动究竟有多少确实来自 Anthropic,仍待确认。

  • Thompson 反对将其批评解读为轻蔑:他的担忧“源于深切的尊重和欣赏”,因为 Anthropic 确实是一家靠谱的公司,而且在重大事项上做得非常到位。

5. 前沿能力催生国家与实验室的权力博弈

  • Sharp 有一个值得保留的反问:如果 Mythos 能够入侵全球各地的公司和政府,“为什么一家私人公司应当拥有这么大的权力?”他认为政府若将其国有化,很可能反而伤害 Anthropic;但这种能力的集中本身也很危险。

  • Thompson 将其与近期 Anthropic 和美国政府争端中尚未解决的张力联系起来。他给出的现实主义答案是:法律终究是强制力的下游。如果国家认为有人正在制造“一把更好的枪”,并因此感到根本性威胁,便可能无视法律约束,直接夺取或限制这项能力。

  • 冲突是双向的:华盛顿可能担心自己要依赖 Anthropic 的善意,才能确保不会遭到其攻击;也可能寻求 Mythos 一类的能力,对中国展开进攻性行动。在 Thompson 看来,负责任地修补漏洞,仍是在“招致并加剧”一场根本性、尚未解决的张力。