泥潭日报 uscardforum · 内容汇总

千问3.8来了, 排名第二

内容摘要

千问3.8发布引排行争议,坛友热议大模型实测与开源应用。

最新动态

  • 大模型排行更新:千问 3.8 推出并名列第二,主楼调侃其迅速让 Kimi K3 成为史上“光环最短”的大模型 (#1);有坛友吐槽反正 Kimi 也买不到了 (#23)。此外,坛友指出 Minimax 亦即将发布新版,DeepSeek v4 正式版也即将到来 (#6, #7)。
  • 阿里推出 Token 套餐:阿里推出了包含 qwen3.8-max-preview、deepseek-v4-pro、glm-5.2 等大模型的 Token 计划,最低首月 39 元即可体验,已有坛友购买尝鲜 (#9, #20)。

争议或不同意见

  • 排名真实性质疑:部分坛友对千问 3.8 排名第二的数据来源表示怀疑,调侃其是否“讲人情世故” (#8, #18)。
  • 英文语法瑕疵:有坛友指出千问宣传文案中存在“one of the most powerful model… compatible to...”等英文语法错误 (#21)。
  • 测试必要性讨论:有用户质疑频繁测试国内大模型是否有实际工作需要,另有用户自嘲确实是“吃饱了太闲” (#10, #12)。

闲聊脉络

  • 苹果大模型合作模式:坛友讨论苹果国行 AI 的形式,猜测其大模型为深度微调且由苹果自行部署,类似于智谱 GLM 的大模型服务售卖模式 (#3);同时指出国行新 iPhone 确认将搭载 AI 性能 (#5)。
  • 国行 AI 进度吐槽:用户指出苹果在 AI 的部署与本土化落地动作过慢,新版 Siri 都已准备就绪,大陆地区却还在苦等上一版本 AI (#4)。
  • 大模型性价比与硬件门槛:坛友讨论大模型性价比,指出 DeepSeek 在美国使用最便宜,但不适合复杂工作 (#15, #16);另有坛友期待 30B 左右的小模型,认为 2.4T 级别的模型即使 Q8 量化,单台 GB300 机器也无法运行 (#22)。
  • Polymarket 预测:有坛友分享了 Polymarket 上关于“7 月底谁是最佳中国 AI 公司”的预测事件,交易额已接近 40 万美元 (#17)。

值得跟进

  • 大模型实测与 Arena 结果:坛友期待后续的实测评测与套餐性价比对比,并表示可以先等待 LMSYS Chatbot Arena 的评测结果 (#13, #15)。
  • 应用替换与开源小模型展望:坛友询问千问 3.8 能否替换 Claude Code 中的 Opus 或 Fable (#24);同时关注 3.8 是否会像 3.5 和 3.6 一样提供开源小模型,以便用于 agentic RAG 等本地或轻量级应用场景 (#25)。
千问3.8苹果AIDeepSeekClaude Code开源小模型