Codex中如何有效使用各个模型?
Codex中如何有效使用各个模型?
月伴飞鱼大家好呀,我是飞鱼
经常有人问,自己的买的 GPT 不经用。
这篇文章主要想讲怎么在 Codex 中同时使用多种模型,从而价值最大化的使用 Token。
首先说明下额度不耐用的问题
有时候经常是我们有些哪些不合理的使用导致额度一下子就没了。
最常见的一种就是啥活都交给 GPT 5.6 Sol,然后开 Fast 和 Max 模式。
❝
旗舰模型 GPT 5.6 Sol 百万 Token 的输入价格是同系列 GPT 5.6 Terra 的两倍,还是 GPT 5.6 Luna 的 20 倍。
如果还开了 Fast 模式就更费 Token:Fast 模式是正常模式额度消耗的 2.5 倍。
如果推理强度还一直开着 XHigh 或者 Max,整体额度消耗还会再拉高 4 到 10 倍。
总结就是:一直用 Sol 加 Fast 加 Max,跟用 Luna 加 Standard 加 Medium 比,额度消耗能差出 100 倍。
所以省 Token 我们要特别注意:不同任务配不同模型:
❝
比如改个配置,做代码解释,找文件就没必要用 Sol,而是交给 Luna。
常规业务的逻辑开发,写单元测试则用更均衡的 Terra 就行。
复杂 Bug 排查,跨多模块重构,全局架构设计,再用上 Sol。
那如果一个会话里任务有复杂有简单,怎么在一个会话里用上不同的模型呢?
❝
目前最简单的方法就是用
subagent,可以直接在 Codex 里分出几个subagent来干什么活。比如告诉配置哪些工具、哪个模型以及模型的推理强度用哪一档, Codex 就会按照你的要求创建临时
subagent。
如果你有些任务要反复做,可以让他创建某某 subagent,创建完成后,直接在对话里就能调用。
我们有时候觉得 GPT 太贵了,想搭配其他模型(比如国产模型,最便宜)。
❝
可以借助一个第三方工具:OpenCodex。
至于安装 OpenCodex 可以直接把项目链接丢给Codex,让它帮你装。
总结一下
这篇文章主要讲了下下面几点。
Codex 额度为什么烧得快?
❝
除了客观原因,很大一部分主观原因是把 Sol Fast 当默认配置,要学会按任务类型选模型,额度能省不少。
可以使用 subagent 把不同模型隔离到不同任务里,避免在一个会话里切来切去,浪费上下文缓存。
通过 OpenCodex 可以在 Codex 中同时使用 GPT 模型和第三方模型。
❝
最后:文章会收录到我的个人网站:http://hardyfish.top/














