更新日志
2026年5月
为企业客户发布了 Secure MCP Tunnel。Secure MCP Tunnel 允许受支持的 OpenAI 产品(包括 ChatGPT 网页版、Codex、Responses API 和 AgentKit)通过客户托管的 tunnel-client 连接到私有或本地 MCP 服务器,而无需将这些服务器暴露在公共互联网上。
初始的 GA(正式发布)采取账户主导模式,而非自助服务。
为 Responses API 的 网络搜索工具 添加了 return_token_budget。使用它可选择开启更长的 GPT-5+ 推理网络搜索任务,适用于高强度研究和评估工作负载。
发布了 Realtime 2,这是一款全新的实时语音模型,支持语音到语音代理的推理配置;同时发布了用于流式语音翻译的 Realtime Translate,以及用于流式语音转文本的 Realtime Whisper。
更新了 实时与音频指南,添加了专门的 实时翻译指南,刷新了用于流式转录的 实时转录 内容,并将实时提示词引导移至 使用实时模型 页面。
发布了 OpenAI Developers Codex 插件。该插件可帮助您利用 OpenAI 平台访问权限和 OpenAI API 设置指导,在 Codex 中构建 AI 应用程序和代理。
更新后的 Agents SDK 现已支持 TypeScript,包含对沙盒代理的支持以及内置的开源测试工具。点击 此处 了解更多。
OpenAI 的 Node、Python、Go、Ruby 和 Java SDK 现已支持 Admin API。请参阅 Admin API 指南 获取设置说明和示例。
2026年4月
发布了用于复杂专业工作的全新前沿模型 GPT-5.5(适用于 Chat Completions 和 Responses API),并发布了用于需要更多算力的难题的 GPT-5.5 pro。
GPT-5.5 支持 100 万 token 上下文窗口、图像输入、结构化输出、函数调用、提示词缓存、批量处理 (Batch)、工具搜索、内置计算机操作、托管 Shell、应用补丁、技能 (Skills)、MCP 和网络搜索。关键更新包括:
发布了用于图像生成与编辑的顶尖模型 GPT Image 2。GPT Image 2 支持灵活的图像尺寸、高保真图像输入、基于 token 的图像定价,以及享有 50% 折扣的 Batch API 支持。
更新了 Agents SDK,新增功能包括:
- 在受控沙盒中运行代理;
- 检查和自定义开源测试工具;以及
- 控制记忆的创建时间和存储位置。
2026年3月
在 Chat Completions 和 Responses API 中发布了 GPT-5.4 mini 和 GPT-5.4 nano。GPT-5.4 mini 为高频负载提供了具备 GPT-5.4 等级能力且更快、更高效的模型;GPT-5.4 nano 则针对速度和成本至关重要的简单高频任务进行了优化。
GPT-5.4 mini 支持 工具搜索、内置 计算机操作 和 压缩 (Compaction)。GPT-5.4 nano 支持压缩,但不支持工具搜索或计算机操作。
将 gpt-5.3-chat-latest 别名更新为指向当前 ChatGPT 中使用的最新模型。
更新了我们的图像编码器,修复了 GPT-5.4 中 input_image 输入的一个小错误。部分图像理解用例现在可能会体验到更高的质量。无需执行任何操作。
扩展了 Sora API,新增可重用角色引用、最长 20 秒的生成长度、sora-2-pro 的 1080p 输出、视频扩展,以及 POST /v1/videos 的 Batch API 支持。sora-2-pro 的 1080p 生成费用为每秒 $0.70。点击 此处 了解更多。
新增 POST /v1/videos/edits 用于编辑现有视频。这将取代 POST /v1/videos/{video_id}/remix,该接口将在 6 个月后弃用。点击 此处 了解更多。
为 Chat Completions 和 Responses API 发布了我们用于专业工作的最新前沿模型 GPT-5.4,并为 Responses API 发布了针对更艰巨问题的 GPT-5.4 pro。
同时发布了:
发布 gpt-5.3-chat-latest 至 Chat Completions 和 Responses API。该模型指向当前 ChatGPT 中使用的 GPT-5.3 Instant 快照。点击 此处 阅读更多。
2026年2月
扩展了 input_file 支持,接受更多的文档、演示文稿、电子表格、代码和文本文件类型。点击 此处 了解更多。
发布 phase 至 Responses API。它将助手消息标记为中间评论 (commentary) 或最终答案 (final_answer)。点击 此处 阅读更多。
发布 gpt-5.3-codex 至 Responses API。点击 此处 阅读更多。
为 Responses API 推出 WebSocket 模式。点击 此处 了解更多。
Batch API 现已支持 GPT 图像模型:gpt-image-1.5、chatgpt-image-latest、gpt-image-1 和 gpt-image-1-mini。
将 gpt-5.2-chat-latest 别名更新为指向当前 ChatGPT 中使用的最新模型。
在 Responses API 中推出 服务端压缩。
在 Responses API 中推出对 技能 (Skills) 的支持。我们支持本地执行和基于托管容器执行这两种模式的 Skills。
推出全新的 托管 Shell (Hosted Shell) 工具,并支持容器网络。
为 GPT 图像模型的 /v1/images/edits 添加了对 application/json 请求的支持。JSON 请求使用 images(及可选的 mask)配合 image_url 或 file_id 引用,而非多部分上传。
我们已针对 API 客户优化了推理栈,GPT-5.2 和 GPT-5.2-Codex 运行速度提高了约 40%。模型本身及权重保持不变。
2026年1月
宣布 Open Responses:一个用于构建多提供商、可互操作 LLM 接口的开源规范,构建于原始 OpenAI Responses API 之上。
发布 gpt-5.2-codex 至 Responses API。GPT-5.2-Codex 是 GPT-5.2 的一个版本,针对 Codex 或类似环境中的代理式编码任务进行了优化。点击 此处 阅读更多。
为 Realtime API 添加了专用 SIP IP 范围。sip.api.openai.com 会进行 GeoIP 路由,将 SIP 流量引导至最近的区域。了解更多。
将 gpt-realtime-mini 和 gpt-audio-mini 别名更新为指向 2025-12-15 的快照。如果您需要之前的模型快照,请使用 gpt-realtime-mini-2025-10-06 和 gpt-audio-mini-2025-10-06。
将 sora-2 别名更新为指向 sora-2-2025-12-08。如果您需要之前的模型快照,请使用 sora-2-2025-10-06。
将 gpt-4o-mini-tts 和 gpt-4o-mini-transcribe 别名更新为指向 2025-12-15 的快照。如果您需要之前的模型快照,请使用 gpt-4o-mini-tts-2025-03-20 和 gpt-4o-mini-transcribe-2025-03-20。目前我们建议使用 gpt-4o-mini-transcribe 而非 gpt-4o-transcribe 以获得最佳效果。
修复了一个问题,即在使用 /v1/images/edits 进行图像编辑时,gpt-image-1.5 和 chatgpt-image-latest 会错误地使用高保真度,即使显式设置了 fidelity 为 low(默认值)。
2025年12月
将 gpt-image-1.5 和 chatgpt-image-latest 添加到 Responses API 图像生成工具中。
发布 gpt-image-1.5 和 chatgpt-image-latest,这是我们用于图像生成的最新、最先进的模型。点击 此处 阅读更多。
发布 GPT-5.2,这是 GPT-5 模型家族中的最新旗舰模型。GPT-5.2 在以下方面相比之前的 GPT-5.1 有所改进:
- 通用智能
- 指令遵循
- 准确性和 token 效率
- 多模态——特别是视觉
- 代码生成——特别是前端 UI 创建
- API 中的工具调用和上下文管理
- 电子表格理解与创建。
5.2 的新特性包括 xhigh 推理力度级别、简洁的推理总结,以及使用压缩的新上下文管理。
发布 客户端压缩。对于与 Responses API 的长期对话,您可以使用 /responses/compact 终结点来缩小您在每轮发送的上下文。
发布 gpt-5.1-codex-max 至 Responses API。GPT-5.1-Codex 是我们最智能的编码模型,针对长视距、代理式编码任务进行了优化。点击 此处 阅读更多。
2025年11月
为 Realtime API 添加了对 DTMF 按键的支持。现在,您可以在使用 Realtime 边带连接时接收 DTMF 事件。请参阅 此处文档 获取更多信息。
发布 GPT-5.1,这是 GPT-5 模型家族中的最新旗舰模型。GPT-5.1 在以下方面经过专门训练,表现更加出色:
- 可控性,以及在需要较少思考时提供更快的响应
- 代码生成和编程用例
- 代理式工作流
请注意,GPT-5.1 默认采用新的 none 推理设置,以便在不需要太多思考时获得更快的响应——这与 GPT-5 中之前的 medium 默认设置不同。
发布 增强的基于角色的访问控制 (RBAC)。RBAC 允许您决定谁在组织和项目中可以做什么——既可以通过 API,也可以在仪表板中。
发布 gpt-5.1-codex 和 gpt-5.1-codex-mini 至 Responses API。GPT-5.1-Codex 是 GPT-5.1 的一个版本,针对 Codex 或类似环境中的代理式编码任务进行了优化。点击 此处 阅读更多。
发布 扩展提示词缓存保留。该功能使缓存的前缀保持活跃时间更长,最长可达 24 小时。扩展提示词缓存的工作原理是将键/值张量卸载到 GPU 本地存储中(当内存已满时),从而显著增加可用于缓存的存储容量。
2025年10月
gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 是基于 gpt-oss 构建的安全推理模型。点击 此处 阅读更多。
发布 企业密钥管理 (EKM)。EKM 允许您使用自己管理的外部密钥管理系统 (KMS) 对 OpenAI 上的客户内容进行加密。
发布 英国数据驻留。
在 OpenAI DevDay 发布了多项新功能:
发布 gpt-5-pro,这是 GPT-5 的一个版本,它使用更多的计算资源进行深度思考,以提供始终如一的优质答案。
发布 gpt-realtime-mini 和 gpt-audio-mini,实现更具成本效益的语音到语音性能。
发布 gpt-image-1-mini,实现更具成本效益的图像生成与编辑。
推出 v1/videos,利用我们最新的 Sora 2 和 Sora 2 Pro 模型实现丰富、详细且动态的视频生成与重混。
推出 代理构建器 (Agent Builder),用于可视化创建自定义多代理工作流。
推出 ChatKit,这是一种用于部署代理的可嵌入聊天界面。
发布 追踪评估、数据集和提示词优化工具。
评估 (Evals):发布第三方模型支持。
推出 服务健康仪表板。
发布 IP 白名单。IP 白名单将 API 访问限制为您指定的 IP 地址或范围。
2025年9月
在 Responses API 中添加了对图像和文件作为 工具调用输出 的支持。
推出专用模型 gpt-5-codex,专门构建并优化用于 Codex CLI。
2025年8月
OpenAI Realtime API 现已全面可用。点击 此处在我们的 Realtime API 指南中 了解更多。
向 Responses API 添加了对 连接器 (Connectors) 的支持。连接器是 OpenAI 维护的 MCP 封装程序,适用于 Google 应用、Dropbox 等流行服务,可用于让模型读取存储在这些服务中的数据。
发布 Conversations API,允许您创建和管理与 Responses API 的长期对话。请参阅 迁移指南,查看并排对比并学习如何从 Assistants API 集成迁移至 Responses 和 Conversations。
在 API 中发布 GPT-5 系列模型,包括 gpt-5、gpt-5-mini 和 gpt-5-nano。
引入 minimal 推理力度 (reasoning effort) 值,以优化 GPT-5 模型(支持推理)的快速响应。
引入 custom 工具调用 类型,允许在工具调用时与模型进行自由格式的输入和输出。
2025年6月
推出对 优先级处理 (Priority processing) 的支持。与标准处理相比,优先级处理在保持按需付费灵活性的同时,提供了显著更低且更一致的延迟。
发布 o3-deep-research 和 o4-mini-deep-research,这是我们 o 系列推理模型的深度研究变体,针对深度分析和研究任务进行了优化。在 深度研究指南 中了解更多。
添加了对使用 Webhooks 进行异步事件处理的支持。降低并简化了网络搜索工具的定价。添加了对 网络搜索工具 的支持。
新的可重用提示词 现已在仪表板和 Responses API 中可用。通过 API,您现在可以通过 prompt 参数(带有 prompt id,可选 version)引用在仪表板中创建的模板,并提供可包含字符串、图像或文件输入的动态 variables。可重用提示词在 Chat Completions 中不可用。了解更多。
发布 o3-pro,这是 o3 推理模型的一个版本,它利用更多的计算资源来通过更好的推理和一致性来解答难题。o3 模型的所有 API 请求(包括批量和 flex 处理)的价格也已下调。
添加了通过 直接偏好优化 (DPO) 进行微调的支持,适用于 gpt-4.1-2025-04-14、gpt-4.1-mini-2025-04-14 和 gpt-4.1-nano-2025-04-14 模型。
新的模型快照可用于 gpt-4o-audio-preview 和 gpt-4o-realtime-preview。发布了 TypeScript 版 Agents SDK。
2025年5月
在 Responses API 中添加了对新内置工具的支持,包括 远程 MCP 服务器 和 代码解释器。了解更多关于工具的信息。
在使用非微调模型进行并行工具调用时,添加了对工具架构使用 strict 模式的支持。添加了新的 架构功能,包括对 email 和其他模式的字符串验证,以及为数字和数组指定范围。
在 API 中推出 codex-mini-latest,优化用于 Codex CLI。
推出对 强化微调 (Reinforcement fine-tuning) 的支持。了解可用的 微调方法。gpt-4.1-nano 现已可用于微调。
2025年4月
推出对 增强型 API 预算警报和自动充值限额 的支持。
添加了一个新的图像生成模型 gpt-image-1。该模型在图像生成方面设立了新标准,具备更高的质量和指令遵循能力。
更新了图像生成和编辑终结点,以支持特定于 gpt-image-1 模型的新参数。
添加了两个新的 o 系列推理模型 o3 和 o4-mini。它们在数学、科学和编码、视觉推理任务以及技术写作方面设立了新标准。
发布 Codex,我们的代码生成 CLI 工具。
向 API 添加了 gpt-4.1、gpt-4.1-mini 和 gpt-4.1-nano 模型。这些新模型具有改进的指令遵循、编码能力和更大的上下文窗口(最高 100 万 token)。gpt-4.1 和 gpt-4.1-mini 可用于监督微调。宣布弃用 gpt-4.5-preview。
2025年3月
向 Audio API 添加了 gpt-4o-mini-tts、gpt-4o-transcribe、gpt-4o-mini-transcribe 和 whisper-1 模型。
发布了多个新模型、新工具以及一个新的代理工作流 API:
- 发布 Responses API,这是一个用于创建和使用代理及工具的新 API。
- 发布了一套用于 Responses API 的内置工具:网络搜索、文件搜索 和 计算机操作。
- 发布 Agents SDK,这是一个用于设计、构建和部署代理的编排框架。
- 宣布新模型:
gpt-4o-search-preview、gpt-4o-mini-search-preview、computer-use-preview。 - 宣布计划将 Assistants API 的所有功能引入更易于使用的 Responses API,预计 Assistants 的停用日期为 2026 年(在实现完全功能对等后)。
为微调任务添加了 metadata 字段支持。
2025年2月
发布了 GPT-4.5 的研究预览版——这是我们目前最大、能力最强的聊天模型。GPT-4.5 高度的“情商 (EQ)”和对用户意图的理解,使其在创意任务和代理规划方面表现更出色。
推出 API 使用情况仪表板更新。此更新解决了对额外数据筛选器的需求,例如项目选择、日期选择器和细粒度的时间间隔。同时还提供了对查看不同产品和服务层级使用情况的更好支持。
引入欧洲数据驻留。点击 此处 阅读更多。
2025年1月
推出 o3-mini,这是一款针对科学、数学和编码任务进行优化的小型推理模型。
扩大了对 o1 模型 的访问权限。o1 系列模型经过强化学习训练,可执行复杂的推理任务。
2024年12月
推出 管理 API 密钥轮换,使客户能够通过编程方式轮换其管理 API 密钥。
更新 管理 API 邀请,使客户能够在邀请用户加入组织的同时,通过编程方式将其邀请加入项目。
为 o1、gpt-4o-realtime、gpt-4o-audio 等添加了 新模型。
为 Realtime API 添加了 WebRTC 连接方法。
为 o1 模型添加了 reasoning_effort 参数。
为 o1 模型添加了 developer 消息角色。请注意,o1-preview 和 o1-mini 不支持 system 或 developer 消息。
推出使用 直接偏好优化 (DPO) 的偏好微调。
推出 Go 和 Java 的 Beta 版 SDK。了解更多。
在 Python SDK 中添加了对 Realtime API 的支持。
推出 使用情况 API,使客户能够通过编程方式查询 OpenAI API 的活动和支出。
2024年11月
发布 gpt-4o-2024-11-20,这是我们 gpt-4o 系列中的最新模型。
发布 预测输出 (Predicted Outputs),它大大减少了模型响应的延迟,特别是当大部分响应已知时(例如在仅有少量更改的情况下重新生成文档和代码文件的内容)。
2024年10月
在 Realtime API 和 Chat Completions API 中添加了五种新的声音类型。
发布 新的 gpt-4o-audio-preview 聊天补全模型,它支持音频输入和输出,并使用与 Realtime API 相同的底层模型。
在 旧金山 OpenAI DevDay 发布了多项新功能:
Realtime API:使用 WebSockets 接口在应用程序中构建快速的语音到语音体验。
模型蒸馏 (Model distillation):用于通过大型前沿模型的输出对低成本模型进行微调的平台。
图像微调:使用图像和文本微调 GPT-4o 以提高视觉能力。
评估 (Evals):创建并运行自定义评估,以衡量模型在特定任务上的表现。
提示词缓存 (Prompt caching):针对最近看到的输入 token 提供折扣和更快的处理时间。
在 Playground 中生成:使用“生成”按钮在 Playground 中轻松生成提示词、函数定义和结构化输出架构。
2024年9月
发布 新的 omni-moderation-latest 审核模型,它支持图像和文本(针对某些类别),支持两种新的仅文本有害类别,并具有更准确的分数。
发布 o1-preview 和 o1-mini,这是新的大语言模型,经过强化学习训练,可执行复杂的推理任务。
2024年8月
Assistants API 现支持 包含文件搜索结果及自定义排名行为。
发布 gpt-4o-2024-08-06 微调 的正式版——所有 API 用户现在都可以微调最新的 GPT-4o 模型。
发布 chatgpt-4o-latest 动态模型——该模型将指向 ChatGPT 使用的最新 GPT-4o 模型。
推出 结构化输出 (Structured Outputs)——模型输出现可可靠地遵守开发人员提供的 JSON 架构。
发布 gpt-4o-2024-08-06,这是我们 gpt-4o 系列中的最新模型。
推出 管理和审计日志 API,使客户能够通过编程方式管理其组织并使用审计日志监控更改。审计日志记录必须在 设置 中启用。
2024年7月
推出 自助 SSO 配置,允许拥有自定义和无限账单的企业客户配置针对其所需 IDP 的身份验证。
推出 GPT-4o mini 微调,为特定用例实现更高的性能。
发布 GPT-4o mini,这是我们经济实惠且智能的小型模型,适用于快速、轻量级的任务。
发布 上传 (Uploads),支持分片上传大型文件。
2024年5月
添加了对 归档项目 的支持。只有组织所有者才能访问此功能。
添加了对按项目设置成本限额的支持(针对按需付费客户)。
在 API 中发布 GPT-4o。GPT-4o 是我们最快且最经济实惠的旗舰模型。
添加了对 Assistants API 图像输入 的支持。
添加了对 Batch API 微调模型 的支持。
向 Chat Completions 和 Completions API 添加了 stream_options: {"include_usage": true} 参数。设置此参数后,开发者可以在使用流式传输时获取使用量统计信息。
添加了 一个新终结点,用于删除 Assistants API 线程中的消息。
2024年4月
向 Chat Completions 和 Assistants API 添加了新的 函数调用选项 tool_choice: "required"。
添加了 Batch API 指南,以及对 嵌入模型 的 Batch API 支持。
引入了 一系列 Assistants API 更新,包括新的文件搜索工具(每个助手最多支持 10,000 个文件)、新的 token 控制和工具选择支持。
发布 Batch API。
在 API 中全面发布 GPT-4 Turbo with Vision。
在微调 API 中添加了对 seed (随机种子) 的支持。
在微调 API 中添加了对 检查点 (checkpoints) 的支持。
在 Assistants API 中添加了在 创建 Run 时添加消息 的支持。
在 Assistants API 中添加了 按 run_id 过滤消息 的支持。
2024年3月
在 Assistants API 中添加了对 温度 (temperature) 和 助手消息创建 的支持。
在 Assistants API 中添加了对 流式传输 (streaming) 的支持。
2024年2月
向 Audio API 添加了 timestamp_granularities 参数。
2024年1月
发布嵌入 V3 模型和更新的 GPT-4 Turbo 预览版。
向 Embeddings API 添加了 dimensions 参数。
2023年12月
在 Assistants API 中向 Run 创建添加了 additional_instructions 参数。
向 Chat Completions API 添加了 logprobs 和 top_logprobs 参数。
将工具调用上的 函数参数 参数修改为可选。
2023年11月
发布 OpenAI Deno SDK。
发布 GPT-4 Turbo 预览版、更新的 GPT-3.5 Turbo、GPT-4 Turbo with Vision、Assistants API、DALL·E 3 API 以及 文本转语音 API。
弃用 Chat Completions functions 参数,改用 tools。
2023年10月
向 Embeddings API 添加了 encoding_format 参数。
向 审核模型 添加了 max_tokens。
向微调 API 添加了 函数调用支持。