⚠️ 写给已经会用 GPT、Claude 聊天、最近想把几个 AI 工具串起来省事的人:你一会儿在浏览器查资料,一会儿回聊天框补背景,一会儿再回编辑器改代码,最烦的是自己一直在搬运上下文。372K 变 272K,很多人第一反应是“降智”。[C001] 我更倾向于反过来看:272K首先是计费线,不是智力线。[C002]

把 Codex 当成同一种工具,以为谁分高谁就适合自己,代价不是看错一次参数,而是你会在最该省事的地方继续手动复制粘贴,多赔一轮返工。AI 工具真正开始抢的,不只是代码活,而是你来回切换的那些碎时间。

官方一句话摘要就是“OpenAI reduces Codex Model Context Size from 372k to 272k”,白话就是:Codex 一次能带进去的背景,从 372K 调到了 272K。[C001] 但同一个模型页还写了两件更关键的事:总上下文上限是 1,050,000;输入一旦超过 272K,整次请求就按 2 倍输入、1.5 倍输出计费。[C003]

再看计费说明,2026 年 4 月 2 日之后,Codex 已经改成按输入、缓存输入、输出分别算钱。[C004] 所以我不把 272K 当成单纯的“脑力线”,而更像默认预算红线。[C003][C004] 边界也要说清:这是根据官方定价结构做的判断,不是 OpenAI 公开说明了缩窗原因。

所以真要改默认值,我会先把代理助手(agent,也就是会自己调工具往下做事的助手)的上下文上限卡在 272K 附近,再决定哪些项目说明值得一起塞进去。很多人以为自己缺的是更强模型,其实缺的是少切几个窗口。已经开始把项目说明、工具列表、网页资料一起塞进去的人,比偶尔单轮问答的人更该盯这条线。

先存这条。下次你想一股脑贴整份项目说明前,先问一句:我现在缺的到底是更大窗口,还是少一次来回搬运?