今天是 2026 年 3 月 31 日。如果你正在开发或维护一个基于 OpenAI 的 Agent 应用,现在打开 API 定价页,你会看到一条已经生效的规则变更:containers 开始按 session 计费。

这不是一次价格战,也不是新模型发布,但它可能比任何 benchmark 都更能刺痛你的现金流。

OpenAI 明确写道:自今日起,容器资源按 20 分钟 session 收费。四种规格单价清晰得近乎冷酷:

1GB:$0.03 / 20 分钟

4GB:$0.12 / 20 分钟

16GB:$0.48 / 20 分钟

64GB:$1.92 / 20 分钟

这个价格覆盖 Hosted Shell 与 Code Interpreter——换句话说,所有需要“在隔离环境里跑代码、传文件、维持状态”的任务,从此多了一笔强制记账。

过去,我们习惯把 Agent 的成本压在 token 上:上下文越长,prompt 越贵。我们优化 prompt engineering,压缩输入输出,却对后台那个“一直开着的虚拟机”视而不见。它像家里的冰箱,只要插着电,就一直在耗能,但我们从不单独为它付费。

现在,OpenAI 把这台冰箱拿上台面,贴上了价签。

这意味着,一个 16GB 的容器如果连续跑满一小时,成本就是 $1.44。这还不包括模型推理本身的费用。如果你的 Agent 需要频繁启动高内存容器来处理大文件、训练小模型或渲染图表,这笔账很快就会超过 API 调用费本身。

谁可以继续安睡?

只做问答、摘要、文本生成的轻量应用。你的成本结构没变,token 依然是你的主要变量。

低频任务自动化。偶尔跑一次数据清洗?那几美分的容器费可以忽略不计。

纯前端交互类工具。不需要后台执行环境,就不受此影响。

谁该立刻坐起来?

长周期任务流水线。比如每天凌晨自动拉取全网数据、清洗、建模、生成报告的 Agent。以前你可能只算“跑模型花了多少”,现在你得算“机器空转了多久”。

依赖 Code Interpreter 做复杂计算的独立开发者。如果你的用户上传 100MB 的 Excel 并要求“分析趋势”,现在你不仅要承担推理成本,还要为那几分钟的容器运行时间买单。

SaaS 化 Agent 产品的架构师。你的产品定价模型如果没包含“执行时长”维度,可能已经处于亏损边缘。

以前,我们谈 Agent 成本,总像在雾里看花。现在,OpenAI 把显微镜递了过来。

这不是为了涨价,而是为了透明。只有当成本可拆解,开发者才能做出真正的权衡:是让 Agent 在云端多跑 10 分钟,还是把任务切分后本地预处理?是升级到 64GB 图个快,还是用 4GB 慢慢熬?

引入强制中断与 checkpoint。不要让容器等待用户响应。一旦 idle 超过阈值,自动 snapshot 状态并释放资源,下次唤醒再恢复。

冷热资源分离。高频小任务用低配容器,偶尔的大计算才动态升配。别让 64GB 的“超跑”去送外卖。

重新评估自托管边界。对于确定性高、周期长的任务,把 Code Interpreter 的逻辑迁移到自己的 K8s 集群,可能比用 Hosted Shell 更划算。

产品层面,引入“执行时长费”。就像云服务商收计算单位一样,让你的用户为“运行时间”付费,而不仅仅是“提问次数”。

这并不是要制造焦虑,而是把选择权还给开发者。

当所有人都在争论模型谁更强时,OpenAI 悄悄把战场拉回到了工程本质:资源利用率。谁能把容器用得更省、更准、更克制,谁的产品才配谈长期主义。

今天是 3 月 31 日,容器计费正式生效。你的 Agent,准备好结账了吗?

Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐