Cerebras 发了一篇长文,讲的不是再吹自己芯片有多快,而是 GPT-5.6 在 Codex 里怎么用:Sol、Terra、Luna 三档,别无脑只开最贵。 三档大意:Sol 最强也最贵,适合长程任务、复杂技术、多 Agent 统括;Terra 大约半价,智力接近旗舰,适合当执行副手;Luna 大约五分之一价,最快最便宜,日常大量活够用。 短上下文官方价量级大约是 Sol $5/$30、Terra $2.5/$15、Luna $1/$6(每百万 token,以实时价为准)。 核心打法就一句:从 Luna 开始,卡住再升级。文件查找、整理、轻改、常规调查,没必要一上来旗舰。出现改不落地、上下文丢失,再上 Terra 或 Sol。 推理量是第二层旋钮。Codex 可从 Light 拉到 Ultra。文中引用 Artificial Analysis 测试:Sol 推理每升一档,任务均成本大约加一半。小活拉满等于浪费。 第三层是缓存。缓存输入可比新输入便宜约九成,会话热着、TTL 大约半小时量级;同一代码库反复读,维持会话往往比次次新开更省。多 Agent 则要把角色划细:Sol 定方向,便宜模型执行,Advisor 防跑偏,并限制子代理数量。 也要听反例:有人试 Luna 搜集再 Sol 判断,觉得 Luna 太弱;有人最终只留 Sol 的 medium/high;还有人 Sol 乱生子代理一把烧掉周额度一截。策略要按自己的任务实测。 默认 Luna;卡住再升级;推理按失败成本加;同仓保持热会话;限制子代理数量。 #Cerebras #GPT56 #Sol #Terra #Luna #Codex #AI工具 #AIagent #AIChannel
codex 先别无脑开最贵模型,从便宜档起手
刘耀文的大沙雕
论文
降低AIGC
知网
作者:codex 先别无脑开最贵模型,从便宜档起手
上一篇
← 上一篇:没有上一篇
下一篇
下一篇:没有下一篇 →