我把 OpenAI 官方定价和 DeepSWE v1.1 工程实测放在一起看了,结论其实很简单: 🌙 Luna 适合批量、机械、规则明确的任务。 改名、格式、脚本、批量生成,优先 Low / Medium。 ⛰️ Terra 最适合常规开发。 小功能用 Medium,跨文件开发和普通 Bug 用 High。 ☀️ Sol 留给复杂任务。 日常认真开发用 Medium,难 Bug 和复杂重构用 High,XHigh 是高难任务甜点位。 👑 Max 不是默认选项,只适合最难、失败成本很高的任务。 至于 GPT-5.5,在这组工程实测里,基本都能找到更便宜或更强的 GPT-5.6 组合,所以不建议再作为默认选择。 一句话总结: 批量用 Luna,常规用 Terra,复杂用 Sol,Max 最后再开。 数据参考:OpenAI 官方定价 + DeepSWE v1.1 工程任务实测。 #Codex #AI编程 #VibeCoding #独立开发者 #howto用好AI #大模型 #gpt