Codex中如何有效使用各个模型?

大家好呀,我是飞鱼

经常有人问,自己的买的 GPT 不经用。

这篇文章主要想讲怎么在 Codex 中同时使用多种模型,从而价值最大化的使用 Token

首先说明下额度不耐用的问题

有时候经常是我们有些哪些不合理的使用导致额度一下子就没了。

最常见的一种就是啥活都交给 GPT 5.6 Sol,然后开 Fast 和 Max 模式。

旗舰模型 GPT 5.6 Sol 百万 Token 的输入价格是同系列 GPT 5.6 Terra 的两倍,还是 GPT 5.6 Luna 的 20 倍。

如果还开了 Fast 模式就更费 Token:Fast 模式是正常模式额度消耗的 2.5 倍。

如果推理强度还一直开着 XHigh 或者 Max,整体额度消耗还会再拉高 4 到 10 倍。

总结就是:一直用 Sol 加 Fast 加 Max,跟用 Luna 加 Standard 加 Medium 比,额度消耗能差出 100 倍。

所以省 Token 我们要特别注意:不同任务配不同模型:

比如改个配置,做代码解释,找文件就没必要用 Sol,而是交给 Luna。

常规业务的逻辑开发,写单元测试则用更均衡的 Terra 就行。

复杂 Bug 排查,跨多模块重构,全局架构设计,再用上 Sol。

那如果一个会话里任务有复杂有简单,怎么在一个会话里用上不同的模型呢?

目前最简单的方法就是用 subagent,可以直接在 Codex 里分出几个 subagent 来干什么活。

比如告诉配置哪些工具、哪个模型以及模型的推理强度用哪一档, Codex 就会按照你的要求创建临时 subagent

如果你有些任务要反复做,可以让他创建某某 subagent,创建完成后,直接在对话里就能调用。

我们有时候觉得 GPT 太贵了,想搭配其他模型(比如国产模型,最便宜)。

可以借助一个第三方工具:OpenCodex。

至于安装 OpenCodex 可以直接把项目链接丢给Codex,让它帮你装。

总结一下

这篇文章主要讲了下下面几点。

Codex 额度为什么烧得快?

除了客观原因,很大一部分主观原因是把 Sol Fast 当默认配置,要学会按任务类型选模型,额度能省不少。

可以使用 subagent 把不同模型隔离到不同任务里,避免在一个会话里切来切去,浪费上下文缓存。

通过 OpenCodex 可以在 Codex 中同时使用 GPT 模型和第三方模型。

最后:文章会收录到我的个人网站:http://hardyfish.top/