泥潭日报 uscardforum · 内容汇总

谈谈我自掏腰包的ai体验

内容摘要

自掏腰包体验主流AI编程工具的优缺点与性价比对比。

1. 关键信息

  • Copilot:Pro教育版,2021–2024,免费易用,VS Code集成佳,但Agent/自动化能力弱。
  • Cursor:Pro教育版,2025.4–10,Vibe coding里程碑,需大量人工介入,上限接近极限。
  • Windsurf:Pro自费,不推荐。
  • Claude Code (Opus):Pro/Max自费,2025.5–至今,轻量易用、适合有经验者,可自定义agent,代码速度快、debug强,但幻觉严重、不可控。
  • Codex CLI:Pro,2025.11–12,响应快、幻觉低,但功能少、赶工。
  • Codex App:Pro,2026.2–至今,图形界面新手友好,decision tree设计佳,Mac独占、闭源。
  • Gemini CLI/antigravity:Ultra,2025.10/2026.1–至今,图像强但CLI/工程表现弱。
  • Amazon Q/Kiro:免费token额度慷慨。
  • Trae:类似Claude Code 7能力。
  • 推荐排序:Codex App with GPT 5.3 > Cursor Pro with Opus ≈ Claude Code Opus > 其他。
  • 流程建议:Git worktree、独立分支、接口契约、Pre-commit/CI gate、隔离构建输出。
  • 构建Agent:Orchestrator (LangGraph/Temporal/Prefect/Airflow)、Tool calling (OpenAI function calling/MCP)、Memory/State (Redis/Postgres/SQLite+FAISS/pgvector)、Planning (DAG/queue/worker pool)、Safety/Quality (unit/golden/lint/typecheck/eval harness)。
  • Cursor + extensions (openai, claude等) 与原生工具(openai, claude tools)的区别:未明确结论,需进一步对比(#89)。

2. 羊毛/优惠信息

无。

3. 最新动态

  • antigravity回应用例仍依赖claude;Ultra反代疑似失效(#3)。
  • Claude Code限额从月度改为每周,引发用户不满(#3)。
  • Opus 4.6能力显著提升,Cursor与CC差距缩小(#62)。
  • Codex 5.3/Opus 4.6在代码能力与自动化上持续增强(#13, #54, #69)。
  • 用户转向codex以降低成本,claude仍用于规划(#81, #84)。
  • 新增需求:希望有“喂饭教程”让AI帮助处理家人需求并自动提醒(#88)。

4. 争议或不同意见

  • Claude Code vs Codex:幻觉与控制力分歧(#33, #35, #69, #78)。
  • CLI与GUI价值:有人认为CLI更纯粹适合agent,也有人认为GUI wrapper更高效(#37, #43, #49)。
  • 工具迁移与锁定:跨IDE无缝迁移难,CLI/开放生态更易迁移(#6, #7, #42)。
  • 成本与token消耗:高频agent运行需API或Extra usage,token制非常亏(#59, #60)。
  • Cursor + extensions vs 原生工具:优劣尚无定论(#89)。

5. 行动建议

  • 优先试用Codex App与Cursor Pro,评估代码控制与预算匹配度。
  • 采用工作流规范:独立分支、契约先行、CI gate、隔离构建。
  • 谨慎开启Claude Code本地文件操作,设置工作目录与容器隔离。
  • 高频任务考虑API或OpenAI Plus,避免token超支。
  • 关注“喂饭教程”类需求,可考虑开发面向非技术用户的AI辅助提醒流程(#88)。