泥潭日报 uscardforum · 内容汇总

突发!claude-code 最新版本代码泄漏

内容摘要

Claude Code源码旧闻讨论转向脏话与训练数据来源。

1. 关键信息

  • 核心内容:楼主(ID: IrishCoffee)发布所谓 Claude Code 源码泄漏消息并附带官方 GitHub 链接。
  • 真实性:多位用户指出该项目本就在官方 GitHub 上公开,并非隐私泄漏;版本 2.1.88 的讨论在一个月前就已出现。
  • 代码规模:据引用信息,该项目包含 1880+ 文件、51 万行代码,涵盖 40+ 种内置工具。
  • 脏话现象:用户 #14 @Divinealex 发现 Claude 会主动说脏话并附截图;#15 @hoodl 认为可能与蒸馏 DeepSeek 有关;#16 @IrishCoffee 推测中文语料基调导致;#17 @收束观测者 调侃可能将“我操”映射到 bravo;#18 @Keiour 提供英文脏话截图,认为训练集清洗程度低、包含口语化资料;#19-#21 讨论 LLM 骨子里是红迪人,因预训练数据大量 Reddit 语料;#22 @qwaszx 感觉 DeepSeek 扒了小红书,国外模型没有。

2. 羊毛/优惠信息

3. 最新动态

  • Claude Code 作为一个终端 Agentic coding tool,支持文件操作、搜索获取及代码执行等核心功能。
  • 评论区流传相关技术解析视频及博文。
  • 新增讨论转向 Claude 的脏话输出,涉及训练数据来源(Reddit、小红书等)及清洗程度。

4. 争议或不同意见

  • 时效性争议#2, #4, #7 等用户一致认为这是“上个月的旧闻”,讽刺楼主“突(上个月)发”。
  • 动机质疑#6 认为楼主作为钛金会员在“水贴”博关注;#8 怀疑这是 Anthropic 官方的免费广告营销手段。
  • 脏话成因分歧#15 主张蒸馏 DeepSeek 导致;#16 认为中文语料问题;#18 否认语言特异性,强调训练集清洗少;#22 指出 DeepSeek 可能用了小红书数据而国外模型没有。

5. 行动建议

  • 开发者:可直接访问官方 GitHub 查看源码,研究其 Agent Loop 及内置工具实现,无需寻找“泄漏版”。
  • 坛友:发布新闻前建议先进行关键词检索,避免搬运已过时的内容,维持论坛信息质量。
  • 对脏话讨论感兴趣的坛友:可进一步查找 Claude 官方说明或对比不同语言模型的训练数据构成。