今天凌晨,GPT-6 Astra 全量开放了,所有付费用户均可使用。Tibo 义父也是先完成了额度重置,然后才去睡觉。
随后 A 社 Lydia Hallie 公告说,Claude Max 用户的周额度也已经全部重置(我有个号是周日上午重置……shit)。
少见的重置也说明,OpenAI 给到 Anthropic 的压力确实很大啊:
在 PolyMarket 上,Anthropic 在 9 月内再次发布更强大模型的可能性达到了 94%。
大脚预测 Lydia 接下来将成为 Claude 的官方重置官,将直接与义父 Tibo 展开对攻。
接下来就是看义父更强,还是义母更凶了……
关于 GPT-6 Astra,要注意它非常能吃,同样的任务会是 Sol 两倍的消耗速度。
如果你是 Plus 用户,那你会发现它在你的 Chat 里是没法用的,只能在 Work 和 Codex 里使用。但要注意的是,如果你在 Codex 里直接问个问题,即便只是问句知识截止日期,可能 20% 的周额度就干没了。
所以 Plus 用户的 Chat 使用办法是:在 Work 里面用,并且把所有插件关掉,并且直接说明不要浏览、不要用工具、不要派子 Agent。这样你会发现额度非常耐用,聊半小时可能也就只会花掉 1%。
GPT-6 Astra 思考档位上,大部分任务用 medium 基本就够了。
参考:在 DeepSWE 上,medium 和 max 性能接受,差距不到 1%,但价格(消耗速率)差了 25%,xhigh 到 max 更是贵了 90%。
还有一个许多人没发现的:新的 compaction 默认是关的。
你可以直接口喷给 Codex 说“帮我在 config.toml 里打开 features.context_management.experimental_mode”,就行。
开启之后,它会跨上下文窗口然后给自己存笔记,在之前的窗口里的消息和工具调用它也都能搜回来,而不再是每次压缩就丢掉一大堆细节,不再失忆性压缩。
Astra 还有个新的习惯是它会异步提问。
也就是说它问你问题的时候,并不会停下来卡着。它能干的活会同时先干着,你晚点再回答也可以。
不过,它确实比之前的模型更爱问。如果你嫌烦,可以在提示词里加一句“直接行动,多干少问”,会清静许多。
再分享一个用法:可以让它去读 ~/.codex 里的历史会话,复盘一下过去哪些任务做对了、哪些做错了。Fable 刚出时我就也这样使用,很有奇效,可以试试。
也可以直接告诉它进行预算控制:“我的预算是 X,写个脚本监控 token 消耗,确保在预算用完前把活干完。”
同样,对 Fable 也可以提这个要求。
最后提醒:
如果之前默认开的是 fast 模式和极高推理,记得先调回来。不然你的额度会跑得非常快。