OpenAI API 定价页更新:Web Search、Hosted Shell 与 File Search 怎么收费?
OpenAI API 定价页是开发者估算模型和配套工具成本的官方参考。此次页面变更的重点不只是模型单价,还包括 Web Search、Hosted Shell、Code Interpreter 和 File Search 等工具:它们分别用于联网检索、在托管环境中运行命令或代码,以及让模型检索已上传的文件。对搜索型应用、代码执行任务和智能体(Agent)应用来说,这些工具费用会直接影响整体预算。
这里的“工具费用”与模型本身的输入、输出 token 费用不是同一个计费项目。一次请求可能同时调用模型和一个或多个工具,因此不能只看模型每百万 token 的价格。本文所述价格和页面变化,来自 OpenAI 官方 API 定价页及本次价格监控记录。
本次定价变化涉及哪些工具
OpenAI API 中的工具,可以理解为模型之外的外部能力。模型负责理解任务、生成回复并决定是否调用工具;工具则完成搜索、代码执行或文件检索等具体工作。工具调用通常有独立的计费单位,使用次数、容器规格或存储时长都可能影响最终成本。
Web Search:每 1000 次调用 25 美元
Web Search 是让模型获取网络搜索结果的工具,适合需要实时信息、网页检索或基于公开资料回答问题的应用。定价页将相关能力分为两类 Web Search preview:
- 面向推理模型的 Web Search preview,包括 GPT-5 和 o-series;
- 面向非推理模型的 Web Search preview。
本次页面变更记录给出的价格为 25 美元/1000 次调用,折算后每次调用为 0.025 美元。记录同时注明,搜索内容 tokens 免费。
这里的“搜索内容 tokens 免费”不应理解为整次请求完全免费。它指搜索工具返回的搜索内容不收取这项 token 费用;模型处理请求时产生的输入和输出 token,仍应按照所使用模型的定价项目计算。一个请求如果触发了 Web Search,通常至少要分别关注搜索工具调用次数和模型 token 用量。
Hosted Shell 与 Code Interpreter:按容器会话计费
Hosted Shell 和 Code Interpreter 用于在 OpenAI 托管的容器环境中执行命令或代码。容器可以理解为一个相对隔离的运行环境,适合进行数据处理、文件转换、脚本执行或计算任务。
这两项能力的相关价格不是按代码行数计费,而是按照每个容器、每次 20 分钟会话计算。页面列出的不同内存规格价格如下:
| 容器规格 | 每个容器每次 20 分钟会话 |
|---|---|
| 1 GB | 0.03 美元 |
| 4 GB | 0.12 美元 |
| 16 GB | 0.48 美元 |
| 64 GB | 1.92 美元 |
例如,使用 4 GB 容器运行 100 个 20 分钟会话,按该项目计算的容器费用为 100 × 0.12 = 12 美元。这只是容器会话费用,不包括同一任务可能产生的模型调用费、Web Search 费用或其他工具费用。
估算时还要注意“会话”和“任务”不是完全相同的概念。一个任务可能复用同一容器,也可能因生命周期管理方式不同而产生多个容器会话;因此,实际预算应记录容器规格和会话数量,而不能只用业务任务数替代。
File Search:存储和工具调用分开计费
File Search 用于让模型检索已上传并建立索引的文件,例如企业文档、产品资料、知识库或项目文件。它包含两个容易混淆的成本维度:文件保存多久,以及模型调用 File Search 多少次。
- 存储:每天每 GB 0.10 美元,包含 1 GB 免费额度;
- 工具调用:每 1000 次调用 2.50 美元。
例如,保存 10 GB 文件 30 天,按 1 GB 免费额度估算,需要计费的存储量为 9 GB,存储费用约为 9 × 0.10 × 30 = 27 美元,另外还要加上实际的 File Search 工具调用费用。
如果保存 100 GB 文件 30 天,则按同一计算方式,存储费用约为 99 × 0.10 × 30 = 297 美元。如果这段时间发生 1 万次 File Search 调用,调用费用还需要增加 10 × 2.50 = 25 美元。
这意味着,低频检索应用的主要成本可能来自长期存储,而高频问答应用则需要同时关注存储规模和调用次数。上传文件后长期保留、重复建立多个知识库,都会使存储成本持续累积。
Agent Kit 的 ChatKit 上传存储
价格页面的变化记录还出现了 Agent Kit 下的 ChatKit 文件和图片上传存储项目。现有材料确认了这一存储项目的存在,但没有给出对应金额,因此不能把它并入 Web Search、容器或 File Search 的计算示例。
这项记录也说明,Agent Kit 相关功能的成本不能简单套用 File Search 的存储价格。是否收费、具体按什么单位收费,应以该项目在定价页中的单独说明为准。
如何估算一个智能体请求的实际成本
一个同时具备联网搜索、文件检索和代码执行能力的智能体请求,可能产生多项费用。较稳妥的做法,是先拆分每种能力的计费单位,再把模型费用单独加总。
- Web Search:每 1000 次调用 25 美元。每月 1 万次调用约为 250 美元;搜索内容 tokens 不收取该项费用,但模型本身的 token 费用仍需单独计算。
- Hosted Shell 或 Code Interpreter:按容器规格和每次 20 分钟会话计费。以 4 GB 容器为例,每月 100 个会话的容器费用为 12 美元。
- File Search:同时计算文件存储费和工具调用费。保存 100 GB 文件 30 天,按 1 GB 免费额度估算,存储费用约为 297 美元;如果发生 1 万次工具调用,还需增加 25 美元。
- 模型调用:根据实际使用的模型、输入 token、输出 token 以及可能涉及的其他能力单独计算。
因此,成本估算可以用下面的思路表示:
总成本
= 模型输入与输出费用
+ Web Search 调用费用
+ 容器会话费用
+ File Search 存储费用
+ File Search 工具调用费用
+ 其他已启用工具的费用
其中,Web Search 的主要变量是调用次数,容器的主要变量是内存规格和会话数量,File Search 则同时受到存储量、保留天数和检索次数影响。不同应用的成本结构可能完全不同:实时搜索产品更容易受到搜索调用量影响,企业知识库则可能首先受到长期存储量影响。
部署时应该记录哪些指标
如果要在应用中控制成本,建议至少将以下指标分开记录:
- Web Search 调用次数;
- 每种规格容器的会话次数;
- File Search 的文件存储量和保留天数;
- File Search 工具调用次数;
- 模型输入和输出 token 用量;
- Agent Kit 或其他工具产生的独立存储和调用量。
这些指标最好按日或按月汇总,并与业务请求 ID、用户或项目维度关联。这样才能判断费用增长来自请求量增加、文件库变大、容器规格提高,还是某个工具被频繁触发。
页面中消失的 Video generation 价格意味着什么
本次变化记录还显示,原先与 Video generation models 相关的按秒计价内容,在当前捕获到的定价页面文本中已经消失或被替换。涉及的旧条目包括 Landscape、sora-2、sora-2-pro,以及 1280×720、1024p、1792×1024、1080p 等分辨率或规格信息;记录中还出现了按秒计价的价格文本。
这能确认的是页面展示内容发生了变化,不能仅凭价格文本消失就推断视频生成服务已经停止,也不能据此确认新的视频价格。若应用依赖视频生成,应以定价页当前对应产品条目和官方服务说明为准。
阅读这张定价页时还要注意的规则
定价页同时包含一些与本次工具价格变化不同的计费说明,不能与 Web Search、容器或 File Search 的价格混为一谈:
- 对于 2026 年 3 月 5 日或之后发布的模型,区域处理(data residency)端点会在模型价格基础上增加 10%;FedRAMP 端点同样增加 10%。
- Priority processing 已于 2026 年 7 月 30 日更名为 Fast mode。名称变化不等于可以直接套用其他处理模式的价格。
- GPT-5.6 Sol 的促销价格至少提供到 2026 年 11 月 21 日。
- GPT-Live 1 语音会话按秒计费,不向上取整到整分钟;后端模型和工具使用费用仍需单独计算。
- OpenAI 正在逐步停止提供 fine-tuning 平台。新用户已经无法访问该平台,现有用户在未来几个月仍可以创建训练任务;已经微调的模型会继续支持推理,直到其基础模型被弃用。
- 通过 Amazon Bedrock 或 Microsoft Azure 使用 OpenAI 模型时,费用由相应云服务计费,应分别查看 Amazon Bedrock 或 Microsoft Azure 的价格说明。
总的来说,这次页面变化最值得关注的不是某一个孤立数字,而是 OpenAI API 的工具成本正在呈现更细的拆分方式:联网搜索按调用计费,代码执行按容器会话和规格计费,文件检索则把存储与调用分开计费。开发者在上线前应根据实际工作流逐项核算,而不是只用模型 token 单价估算整个应用的成本。