AI模型闲聊楼
讨论Gemini降智与API定价,分享Minimax本地运行体验
最新动态
- Minimax H3 视频模型发布:无审查的开源视频模型 Minimax H3 已在 HuggingFace 发布,支持图生视频和文生视频,社区测试显示其能达到 seedance 同等水平(#12)。
经验与数据点
- Gemini 降智与 API 定价争议:
- 降智表现:在接近 5 小时使用额度上限时,Gemini 存在降智到无推理能力模型的可能性,表现为失去 "show thinking" 功能(#5)。有时还会出现说话像流氓等发癫行为(#15)。
- API 价格对比:针对 Google 官方以“1.5 Pro 成本更高”为由否认降级服务的说法,用户列出 API 价格指出 3.1 Pro 实际上比 1.5 Pro 更贵(#10):
- 1.5 Pro:输入 $1.25 / 百万 tokens,输出 $5 / 百万 tokens。
- 3.1 Pro(≤200K tokens):输入 $2.00 / 百万 tokens,输出(含 thinking)$12.00 / 百万 tokens。
- 3.6 Flash:输入 $1.50 / 百万 tokens,输出 $7.50 / 百万 tokens。
- 模型对比:Gemini 在处理大量问题时便宜大碗,而 Grok 的上下文能力在第一个问题后会光速拉胯(#22)。此外,其 CoT 模式被指非常像 Claude(如 Fable 或 Opus 4.8)(#20)。
- Minimax H3 本地部署数据点:
- 配置与显存:该模型显存占用减少 66%(从 123.6 GB 降至 42.5 GB),结合动态 VRAM 卸载,可在 RTX 3060 等本地 GPU 上运行(#21)。
- 实测反馈:有潭友使用“32G 内存 + 32G swap + 3090 显卡”成功在 ComfyUI 上运行并生成视频,但速度较慢(#23);由于生成的 step 步数较少,目前 denoise 效果还不够精细,后续有待拉高参数测试(#25)。