泥潭日报 uscardforum · 内容汇总

没人聊聊 Anthropic 最新的模型 Mythos 吗?

内容摘要

Anthropic Mythos被曝攻破苹果五年安全防御,争议持续。

1. 关键信息

  • Mythos是Anthropic最新模型,API价格25/125(Opus为5/25),是Opus的5倍(#1, #17)。
  • 据称能发现并利用软件漏洞,已与Amazon、Apple、Google、Microsoft、CrowdStrike等合作Project Glasswing修补漏洞(#61, #86)。
  • 在SWE Bench Pro上准确率从~50%提升至70%+(#24),但部分benchmark不如ChatGPT(#119)。
  • 有报道称Mythos攻破FreeBSD获取root权限(#86)。
  • 用户反映Opus 4.6被降智(#79-#82)。
  • 最新:Mythos Preview与工程师合作,在五天内构建了针对Apple内存保护硬件的利用(#130),而Apple花费五年建设防御(#130)。

2. 羊毛/优惠信息

3. 最新动态

  • 模型已向部分企业客户开放,普通用户无法使用(#46, #102)。
  • 美国财长Bessent和美联储主席Powell警告银行关于Mythos的风险(#99)。
  • 有报道称Mythos被未授权用户访问(#120)。
  • 中国公司未参与合作,引发安全担忧(#92)。
  • 新增:Mythos Preview团队与工程师在五天内实现对Apple内存保护系统的漏洞利用(#130),相关博客文章已公开(#130)。

4. 争议或不同意见

  • 多数用户认为是炒作,类似OpenAI GPT-2“太危险不发布”的套路(#5, #22, #56, #96)。
  • 质疑SWE Bench已饱和,模型提分方式可疑(#13, #27)。
  • CEO Dario被批“attention whore”“装逼”(#2, #28, #39)。
  • 用户愤怒于Opus降智,认为Anthropic“反人类”(#82, #93)。
  • 有测试显示小开源模型也能找到同样漏洞(#108)。
  • 新增:#130的新证据引发新一轮关于真实性的讨论,部分用户认为五天内破解苹果五年防御更显Mythos能力可信,但仍有质疑者等待独立复现。

5. 行动建议

  • 关注Mythos在网络安全领域的实际应用,但警惕过度炒作。
  • 对Anthropic的“强大到不敢发布”叙事保持怀疑,等待第三方独立评测。
  • 若持有SK Telecom股票(曾投资Anthropic),注意稀释风险(#64, #75)。
  • 普通用户可继续使用现有模型,等待Mythos公开后评估性价比。
  • 新增:关注#130提供的公开博客文章(calif.io)以了解Mythos在内存安全方面的实际表现,并对比Apple官方回应。