泥潭日报 uscardforum · 内容汇总

Anthropic的新AI模型Fable限制重重,引发用户强烈不满

内容摘要

Fable 5限制引争议且高管遭威胁,7月20日起加入订阅。

关键信息

  • 模型发布:Anthropic 发布基于 Mythos 架构的 Claude Fable 5,旨在平衡商业利益与安全目标 [1]
  • 功能表现:Fable 能力显著增强,用户演示其能自主编写代码生成可运行的《侠盗猎车手》克隆版游戏 [1]
  • 隐性限制争议:模型在涉及高端 AI 开发问题时降低回复质量且不弹出通知,仅在生物武器、网络安全等敏感话题触发重定向至旧版 Claude [1]
  • 官方回应:Anthropic 承认“隐藏的安全屏障更难被探测和规避”是错误取舍,深表歉意并计划公开安全通知,同时致力于减少不必要的阻碍 [1]

最新动态

  • 高管人身安全威胁:一名男子潜入 Anthropic 办公室并扬言要高管付出生命代价;随着针对科技巨头的暴力威胁增加,各大公司正加大安保支出,甚至雇佣武装保镖随行保护高管 [2]
  • 订阅方案更新:自7月20日起,Claude Fable 5 将包含在所有 Max 和 Team Premium 计划中,但额度限制为50% [3]

争议或不同意见

  • 打压竞争质疑:AI 专家指责 Anthropic 通过隐性门槛打压潜在竞争对手,干扰外部研究人员评估模型潜力 [1]
  • 科研受阻案例:杰克逊实验室免疫学家 Derya Unutmaz 反馈模型拒绝回答基础生物学问题(如“线粒体”、“癌症”),甚至无法打招呼,被形容为“噩梦般的场景” [1]
  • 行业批评:普林斯顿大学 AI 研究员 Sayash Kapoor 称这是 AI 公司推出安全护栏后首次遭到一致唾弃,认为此举开创了危险先例,使未来评估模型能力变得困难 [1]
  • 动机质疑:批评人士指出,AI 巨头关于危险的声明实为营销手段及排挤开源替代品,当前措施催生了“保姆式”管控状态 [1]

风险/限制/注意事项

  • 访问受限:触及敏感话题时,对话会被重定向至能力较弱的早期版本 Claude [1]
  • 特定领域封锁:初期对生物学、化学等看似无害的科研查询采取过度保守态度,拦截大量相关查询以防恶意研究 [1]
  • 未来计划:Anthropic 计划向更广泛的生物医学界提供“不带这些安全保障”的 Fable/Mythos 级模型,以加速药物发现 [1]

值得跟进

  • 政策调整:Anthropic 承诺将显示安全通知,并减少不必要的科研阻碍,需观察实际执行效果 [1]
  • 监管动态:Anthropic CEO Dario Amodei 呼吁建立全球 AI 监管机构以暂停高风险开发,Sam Altman 响应此提议,美国政府是否允许 Anthropic AI 用于所有合法目的仍是核心争议点 [1]
Claude Fable 5Anthropic安全限制人身威胁订阅计划