GPT-5.6基础价没涨,但Codex长任务成本可能达到5.5的2倍以上 Tibo好的不学,学会变相涨价了 GPT-5.6 Sol和GPT-5.5的基础价格相同:输入5美元/百万tokens,输出30美元/百万tokens。 真正影响成本的是长上下文计费规则。OpenAI官方写道: “Prompts with >272K input tokens are priced at 2x input and 1.5x output for the full request.” 重点是“for the full request”:当单次请求的输入超过272K后,并非只有超出的部分涨价,而是整个请求的输入按2倍计费,输出按1.5倍计费。 这条规则5.5也有,但Codex中的5.5有效上下文约为258.4K,通常碰不到272K门槛。GPT-5.6在Codex中的可用窗口明显更大,因此长任务更容易越过门槛。 GPT-5.6还新增了cache write费用,缓存写入按普通输入价格的1.25倍计费,这也是5.5时代没有单独收取的一项成本。 以20K输出的长任务为例: GPT-5.5跑到258.4K输入,约为1.89美元。 GPT-5.6跑到353.4K输入并触发长上下文价格后,约为4.43美元。 两者相差约2.34倍。这里还没有额外计入cache write,因此实际成本可能更高。 解决办法是主动限制Codex的上下文窗口。例如在~/.codex/config.toml顶层加入: model_context_window = 272000 model_auto_compact_token_limit = 240000 雷父已经在Codex CLI 0.144.0上实测:第一项配置会把实际显示的有效上下文限制为258400 tokens,低于272K计费线;第二项则让Codex更早进行历史压缩。 不过需要说明,这是一种降低触发概率的配置,不是绝对的计费保证。另外减少九十多K的上下文窗口可能会对模型能力带来一定的损失,蹬友们请根据自身情况决定要不要改窗口大小。
终于知道codex5.6额度不耐用的原因了
刘耀文的大沙雕
论文
降低AIGC
知网
作者:终于知道codex5.6额度不耐用的原因了
上一篇
← 上一篇:没有上一篇
下一篇
下一篇:没有下一篇 →