泥潭日报 uscardforum · 内容汇总

AI模型闲聊楼

内容摘要

讨论Gemini降智与API定价,分享Minimax本地运行体验

最新动态

  • Minimax H3 视频模型发布:无审查的开源视频模型 Minimax H3 已在 HuggingFace 发布,支持图生视频和文生视频,社区测试显示其能达到 seedance 同等水平(#12)。

经验与数据点

  • Gemini 降智与 API 定价争议
  • 降智表现:在接近 5 小时使用额度上限时,Gemini 存在降智到无推理能力模型的可能性,表现为失去 "show thinking" 功能(#5)。有时还会出现说话像流氓等发癫行为(#15)。
  • API 价格对比:针对 Google 官方以“1.5 Pro 成本更高”为由否认降级服务的说法,用户列出 API 价格指出 3.1 Pro 实际上比 1.5 Pro 更贵(#10):
    • 1.5 Pro:输入 $1.25 / 百万 tokens,输出 $5 / 百万 tokens。
    • 3.1 Pro(≤200K tokens):输入 $2.00 / 百万 tokens,输出(含 thinking)$12.00 / 百万 tokens。
    • 3.6 Flash:输入 $1.50 / 百万 tokens,输出 $7.50 / 百万 tokens。
  • 模型对比:Gemini 在处理大量问题时便宜大碗,而 Grok 的上下文能力在第一个问题后会光速拉胯(#22)。此外,其 CoT 模式被指非常像 Claude(如 Fable 或 Opus 4.8)(#20)。
  • Minimax H3 本地部署数据点
  • 配置与显存:该模型显存占用减少 66%(从 123.6 GB 降至 42.5 GB),结合动态 VRAM 卸载,可在 RTX 3060 等本地 GPU 上运行(#21)。
  • 实测反馈:有潭友使用“32G 内存 + 32G swap + 3090 显卡”成功在 ComfyUI 上运行并生成视频,但速度较慢(#23);由于生成的 step 步数较少,目前 denoise 效果还不够精细,后续有待拉高参数测试(#25)。

闲聊脉络

  • 吐槽谷歌与打赌:潭友吐槽对谷歌 Gemini 的失望,感觉像看着聪明朋友患上阿兹海默症(#13)。有潭友因信任而在上个月打赌下代 Pro 会在 31 日前发布(#14),现在只想给谷歌发 CLRA 索求信(#16)。
  • 国产模型态度:潭友对国产模型表示惊喜(#17),但也有人因不了解敏感点而不敢直接使用,更倾向于租机器运行 GLM 或 Kimi(#22)。
GeminiMinimax H3API定价本地部署