GPT-6 Astra应该开什么思考强度?如果是GPT-5.6 Sol的话,肯定是推荐开High或者更高的,但GPT-6 Astra的Medium已经很强了,你或许也看到了有些测试Medium反而成绩更高,有些测试Extra High反而更省Token,这主要跟Codex 272K的上下文窗口有关。
如果我们忽略上下文窗口的影响和模型自由编写bash脚本的能力,那么显然简单且明确的任务用Medium,复杂且发散的任务用Extra High甚至Ultra。
但是因为272K上下文窗口的存在,每当上下文长度超过272K的时候,就会对模型的上下文进行压缩,压缩导致的结果是模型会记不清读过的文件,会忘记一些用户下达的指令,连续性的工作会被打断甚至产生偏移,因此,如果你是交互式地跟模型进行沟通,应该关注Codex的上下文长度进行主动的Compact,而如果你是下达了一个长期的任务,那么你就需要关注Medium和Extra High这些不同的思考强度,会不会可能因为Extra High对于一些需要反复迭代或者拆分成多步的任务来说强度过高,反而导致模型无法在一个272K的窗口内完成最小单位的任务,降低了执行的质量?
但是对于另一些偏向于编写脚本迭代执行的任务来说,Medium相较于Extra High更倾向于多次编辑脚本多次执行,反而增加了Token的消耗。
还你不知道哪个适合自己?那就是如果你一边跟Codex聊天一边让它做事,选Very High,适时地主动Compact可以增加执行的质量,不差Token的话就把Codex的上下文改到1M也行;如果长期执行,Medium更保险,如果你想用Very High或更高,最好搞个1M上下文的Planner(Kimi K3或者Fable 5.1)去指挥Codex。