OpenAI 发布 GPT-5.5
GPT-5.5 正式在 API 上线,重大模型升级。直接影响 AI 编程开发效率和应用可用性。
GPT-5.5 正式在 API 上线,重大模型升级。直接影响 AI 编程开发效率和应用可用性。
发布了官方 OpenAI Terraform provider,用于将 OpenAI API Platform 资源作为基础设施即代码来管理。
预配置和管理项目、用户、组、角色、访问分配、服务账户、证书、邀请和项目级速率限制。使用标准 Terraform 工作流来审查和应用变更、导入现有资源以及检测和协调配置漂移。从 Terraform Registry 安装 provider。
发布了 GPT Transcribe,用于精确的文件转录和已提交的 Realtime 回合的最终转录,以及 GPT Live Transcribe,提供低延迟流式转录。
两个模型都支持自由形式的转录上下文、关键字提示和多种预期输入语言。在转录指南中对比支持的输出和工作流。
为 OpenAI API Platform 上的组织和项目添加了硬花费限制。设置月度上限,当跟踪支出达到限制时,受影响的 API 请求将返回 429 错误。在流量中断之前使用花费警报来获得通知。详见花费限制指南。
发布了 GPT-5.6 模型系列,包括前沿能力的 GPT-5.6 Sol、平衡智能和成本的 GPT-5.6 Terra,以及用于高效高容量工作负载的 GPT-5.6 Luna。gpt-5.6 别名将请求路由到 gpt-5.6-sol。
GPT-5.6 新增了可编程工具调用、显式 prompt caching 控制、持久化推理、最大推理工作量和 Pro 模式,以及 Responses API 的多智能体编排测试版。GPT-5.6 还支持以原始尺寸接收图像,可选择原始或自动图像细节。
发布了 GPT-Realtime-2.1,这是一个改进的实时推理模型,具有改进的字母数字识别、静音和噪声处理,以及中断行为。同时发布了 GPT-Realtime-2.1 mini,一个用于实时语音应用的更快、成本更低的蒸馏推理模型。
更新了 chat-latest 快照,它指向 ChatGPT 中当前使用的最新即时模型。我们建议生产 API 使用 GPT-5.5,但您可以随意使用此模型来测试针对聊天用例的最新改进。底层模型快照将定期更新。详见此处。
在 OpenAI API Platform 上发布了 Safety Usage Dashboard。Safety 仪表板显示基于发送到请求的 safety_identifier 值来阻止的 Responses 请求,以识别最终用户。访问 Safety 仪表板。
Web search 现在可以返回图片结果以及常规文本结果。当您的应用需要当前的或网络事实的视觉效果(如产品照片、地标、地点、事件或视觉参考)时,使用图片搜索。详见 web search 指南。
发布了 OpenAI API Platform 的重设计导航,访问此处。
向 Responses API 和 Chat Completions API 添加了内容节制分数。在生成请求中传递一个 moderation 对象,以在同一响应中接收针对模型输入和生成输出的内容节制结果。
详见内容节制指南。
宣布了可复用 prompt 对象、Evals 平台和 Agent Builder 的弃用。详见弃用页面了解关闭时间表和迁移指南。
从 2026 年 6 月 2 日开始,合格的容器会话将按分钟计费,最少 5 分钟,而不是按完整 20 分钟会话费率计费。底层按分钟费率保持不变。
此更新旨在使短会话的计费更加细粒度,并将降低客户的有效成本。
您可以在 API 定价文档中找到当前的内置工具定价。
OpenAI 模型现在在 Amazon Bedrock 上可用,通过 OpenAI 兼容的 Responses API 端点。支持的模型和特性因 AWS 区域而异。详见此处。
对于未启用 ZDR 的组织,prompt_cache_retention 现在默认为 24h 而不是 in_memory,默认启用扩展 prompt caching。详见此处。
发布了 chat-latest 快照,它指向 ChatGPT 中当前使用的最新即时模型。我们建议生产 API 使用 GPT-5.5,但您可以随意使用此模型来测试针对聊天用例的最新改进。底层模型快照将定期更新。详见此处。
发布了工作负载身份联合。受信任的工作负载可以交换外部颁发的身份令牌来获得短期有效的 OpenAI 访问令牌,无需存储长期有效的 API 密钥。
添加了新的 Admin API 功能,用于管理花费警报、模型允许列表、数据保留设置和托管工具权限,以及查询细粒度计费明细项目。
为企业客户发布了 Secure MCP Tunnel。Secure MCP Tunnel 让支持的 OpenAI 产品(包括 ChatGPT web、Codex、Responses API 和 AgentKit)通过客户托管的 tunnel-client 连接到私有或本地 MCP 服务器,而无需将这些服务器暴露到公网。
您现在可以管理多个 IP allowlist,并在项目级别或整个组织应用每个 allowlist。要配置它们,请转到设置 > 安全 > IP allowlist。
弃用了 DALL·E 模型快照和 Realtime API Beta。
DALL·E 模型快照 dall-e-2 和 dall-e-3 已在 2026 年 5 月 12 日弃用并从 API 中移除。我们建议改用 gpt-image-2、gpt-image-1 或 gpt-image-1-mini。
Realtime API Beta 已在 2026 年 5 月 12 日弃用并从 API 中移除。如果您仍在使用测试版接口,请迁移到已发布的 Realtime API。详见迁移指南和完整弃用页面。
为 Responses API web search 工具添加了 return_token_budget。使用它来选择进行更长的 GPT-5+ 推理 web search 运行,用于高工作量的研究和评估工作。
发布了 GPT-Realtime-2,一个新的实时语音模型,具有可配置的推理,用于语音转语音智能体,以及 GPT-Realtime-Translate 用于流式语音翻译,GPT-Realtime-Whisper 用于流式语音转文本。
更新了 Realtime 和音频指南、添加了专用的 Realtime 翻译指南、刷新了用于流式转录的 Realtime 转录,并将实时模型提示指南移到使用实时模型中。
发布了 OpenAI Developers plugin for Codex。这可以帮助您在 Codex 中使用 OpenAI Platform 访问和 OpenAI API 设置指南来构建 AI 应用和智能体。
更新的 Agents SDK 现在支持 TypeScript,包括对沙箱智能体的支持和内置的开源 harness。详见此处。
发布了 chat-latest 快照,它指向 ChatGPT 中当前使用的最新即时模型。我们建议生产 API 使用 GPT-5.5,但您可以随意使用此模型来测试针对聊天用例的最新改进。底层模型快照将定期更新。详见此处。
Admin APIs 现在在 Node、Python、Go、Ruby 和 Java 的 OpenAI SDK 中得到支持。详见 Admin APIs 指南了解设置说明和示例。
发布了 GPT-5.5,一个用于复杂专业工作的新前沿模型,到 Chat Completions 和 Responses API,并发布了 GPT-5.5 Pro 用于 Responses API 请求,解决受益于更多计算的更困难问题。
GPT-5.5 支持 1M token 上下文窗口、图像输入、结构化输出、函数调用、prompt caching、Batch、工具搜索、内置计算机使用、托管 shell、apply patch、Skills、MCP 和 web search。主要更新包括:
推理工作量现在默认为中等。
当 image_detail 未设置或设置为自动时,模型现在使用原始行为。
GPT-5.5 的缓存仅支持扩展 prompt caching。不支持内存中 prompt caching。详见此处。
发布了 GPT Image 2,一个用于图像生成和编辑的最先进的图像生成模型。GPT Image 2 支持灵活的图像尺寸、高保真图像输入、基于 token 的图像定价,以及 Batch API 支持,享受 50% 的折扣。
使用新功能更新了 Agents SDK,包括:
在受控沙箱中运行智能体;
检查和自定义开源 harness;以及
控制何时创建记忆和在哪里存储它们。
发布了 GPT-5.4 mini 和 GPT-5.4 nano 到 Chat Completions 和 Responses API。GPT-5.4 mini 将 GPT-5.4 级功能引入一个更快、更高效的模型,用于高容量工作负载,而 GPT-5.4 nano 针对简单的高容量任务进行了优化,其中速度和成本最重要。
GPT-5.4 mini 支持工具搜索、内置计算机使用和压缩。GPT-5.4 nano 支持压缩,但不支持工具搜索或计算机使用。
更新了 gpt-5.3-chat-latest slug 以指向 ChatGPT 中当前使用的最新模型。
更新了我们的图像编码器以修复 GPT-5.4 中 input_image 输入的一个小错误。一些图像理解用例现在可能会看到改进的质量。不需要采取任何行动。
扩展了 Sora API,具有可复用的角色参考、最长 20 秒的生成、sora-2-pro 的 1080p 输出、视频扩展和对 POST /v1/videos 的 Batch API 支持。sora-2-pro 上的 1080p 生成按 $0.70 每秒计费。详见此处。
添加了 POST /v1/videos/edits 用于编辑现有视频。这将替换 POST /v1/videos/{video_id}/remix,将在 6 个月后弃用。详见此处。
发布了 GPT-5.4,我们用于专业工作的最新前沿模型,到 Chat Completions 和 Responses API,并发布了 GPT-5.4 Pro 到 Responses API,用于解决受益于更多计算的更困难问题。
Responses API 中的工具搜索允许模型将大型工具表面延迟到运行时,以减少 token 使用、保护缓存性能和改进延迟。
通过 Responses API 计算机工具在 GPT-5.4 中支持内置计算机使用,用于基于屏幕截图的 UI 交互。
1M token 上下文窗口和对更长运行的智能体工作流的原生压缩支持。
发布了 gpt-5.3-chat-latest 到 Chat Completions 和 Responses API。此模型指向 ChatGPT 中当前使用的 GPT-5.3 Instant 快照。详见此处。
扩展了 input_file 支持以接受更多文档、演示文稿、电子表格、代码和文本文件类型。详见此处。
发布了 phase 到 Responses API。它将助手消息标记为中间评论(commentary)或最终答案(final_answer)。详见此处。
发布了 gpt-5.3-codex 到 Responses API。详见此处。
发布了 Responses API 的 WebSocket 模式。详见此处。
发布了 GPT-Realtime-1.5 到 Realtime API。
发布了 gpt-audio-1.5 到 Chat Completions API。详见此处。
Batch API 现在支持 GPT Image 模型:gpt-image-1.5、chatgpt-image-latest、gpt-image-1 和 gpt-image-1-mini。
更新了 gpt-5.2-chat-latest slug 以指向 ChatGPT 中当前使用的最新模型。
在 Responses API 中发布了服务端压缩。
在 Responses API 中发布了对 Skills 的支持。我们在本地执行和托管的基于容器的执行中都支持 Skills。
发布了一个新的托管 Shell 工具,以及对容器中网络的支持。
为 GPT image 模型添加了对 /v1/images/edits 上 application/json 请求的支持。JSON 请求使用图像(和可选的掩码)以及 image_url 或 file_id 引用,而不是多部分上传。
我们已优化了 API 客户的推理栈,GPT-5.2 和 GPT-5.2-Codex 现在运行速度快约 40%。模型和模型权重未改变。
宣布了开放 Responses:一个用于构建多提供商、可互操作 LLM 接口的开源规范,构建在原始 OpenAI Responses API 之上。
发布了 gpt-5.2-codex 到 Responses API。GPT-5.2-Codex 是优化用于 Codex 或类似环境中的智能体编码任务的 GPT-5.2 版本。详见此处。
为 Realtime API 添加了专用 SIP IP 范围。sip.api.openai.com 执行地理 IP 路由,并将 SIP 流量定向到最近的区域。详见此处。
更新了 gpt-realtime-mini 和 gpt-audio-mini slug 以指向 2025-12-15 快照。如果您需要之前的模型快照,请使用 gpt-realtime-mini-2025-10-06 和 gpt-audio-mini-2025-10-06。
更新了 sora-2 slug 以指向 sora-2-2025-12-08。如果您需要之前的模型快照,请使用 sora-2-2025-10-06。
更新了 gpt-4o-mini-tts 和 gpt-4o-mini-transcribe slug 以指向 2025-12-15 快照。如果您需要之前的模型快照,请使用 gpt-4o-mini-tts-2025-03-20 和 gpt-4o-mini-transcribe-2025-03-20。我们目前建议使用 gpt-4o-mini-transcribe 而不是 gpt-4o-transcribe 来获得最佳结果。
修复了一个问题,其中 gpt-image-1.5 和 chatgpt-image-latest 在通过 /v1/images/edits 进行图像编辑时错误地使用高保真,即使保真度明确设置为低(默认值)。
将 gpt-image-1.5 和 chatgpt-image-latest 添加到 Responses API 图像生成工具。
发布了 gpt-image-1.5 和 chatgpt-image-latest,我们用于图像生成的最新和最先进的模型。详见此处。
发布了四个新的日期音频快照。这些更新为实时、语音驱动的应用提供了可靠性、质量和语音保真度改进。详见此处。
此发布还包括对合格客户的自定义语音的支持。
发布了 GPT-5.2,GPT-5 模型系列中最新的旗舰模型。GPT-5.2 相比之前的 GPT-5.1 显示了以下改进:
指令遵循
准确性和 token 效率
多模态性——特别是视觉
代码生成——特别是前端 UI 创建
API 中的工具调用和上下文管理
电子表格理解和创建。
5.2 中的新增功能是一个新的 xhigh 推理工作量水平、简洁的推理摘要和使用压缩的新上下文管理。
发布了客户端压缩。对于与 Responses API 的长期运行对话,您可以使用 /responses/compact 端点来缩小每个回合发送的上下文。
发布了 gpt-5.1-codex-max 到 Responses API。GPT-5.1-Codex 是我们最智能的编码模型,针对长地平线、智能体编码任务进行了优化。详见此处。
在 Realtime API 中添加了对 DTMF 按键的支持。您现在可以在使用 Realtime sideband 连接时接收 DTMF 事件。详见文档以获取更多信息。
发布了 GPT-5.1,GPT-5 模型系列中最新的旗舰模型。GPT-5.1 被训练为特别精通:
可指导性和较少思考时的快速响应
代码生成和编码用例
注意 GPT-5.1 默认为新的 none 推理设置,以在需要较少思考时获得更快的响应——与 GPT-5 中之前的 medium 默认设置不同。
发布了增强的基于角色的访问控制(RBAC)。基于角色的访问控制(RBAC)让您可以决定谁可以在您的组织和项目中做什么——通过 API 和仪表板。
发布了 gpt-5.1-codex 和 gpt-5.1-codex-mini 到 Responses API。GPT-5.1-Codex 是一个针对 Codex 或类似环境中的智能体编码任务进行优化的 GPT-5.1 版本。详见此处。
发布了扩展 prompt cache 保留期。扩展 prompt cache 保留期将缓存的前缀保持活动最长 24 小时。扩展 Prompt Caching 通过在内存已满时将键值张量卸载到 GPU 本地存储来工作,显著增加了可用于缓存的存储容量。
gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 是建立在 gpt-oss 之上的安全推理模型。详见此处。
发布了企业密钥管理(EKM)。企业密钥管理(EKM)允许您使用由您自己的外部密钥管理系统(KMS)管理的密钥在 OpenAI 加密客户内容。
发布了英国数据驻留。
在 OpenAI DevDay 上发布了几项新功能:
发布了 GPT-5 Pro,一个 GPT-5 的版本,使用更多计算来更用心思考并提供一致更好的答案。
发布了 GPT-Realtime mini 和 gpt-audio-mini,实现更具成本效益的语音转语音性能。
发布了 gpt-image-1-mini,用于更具成本效益的图像生成和编辑。
发布了 v1/videos,用于使用我们最新的 Sora 2 和 Sora 2 Pro 模型进行丰富、详细和动态的视频生成和改编。
推出了 Agent Builder,用于直观创建自定义多智能体工作流。
推出了 ChatKit,一个可嵌入的聊天界面,用于部署智能体。
发布了 Trace Evals、Datasets 和 Prompt Optimization 工具。
Evals:发布了第三方模型支持。
推出了服务健康仪表板。
发布了 IP allowlist。IP allowlisting 限制 API 访问仅限于您指定的 IP 地址或范围。
在 Responses API 中添加了对图像和文件作为工具调用输出的支持。
推出了专用目的模型 gpt-5-codex,为与 Codex CLI 配套使用而构建和优化。
OpenAI Realtime API 现已正式发布。详见我们的 Realtime API 指南。
为 Responses API 添加了对连接器的支持。连接器是 OpenAI 维护的针对流行服务(如 Google 应用、Dropbox 等)的 MCP 包装器,可用于为模型提供对存储在这些服务中的数据的读取访问。
发布了 Conversations API,它允许您使用 Responses API 创建和管理长期运行的对话。详见迁移指南以了解并排比较和如何从 Assistants API 集成迁移到 Responses 和 Conversations。
在 API 中发布了 GPT-5 模型系列,包括 gpt-5、gpt-5-mini 和 gpt-5-nano。
为 GPT-5 模型(支持推理的)引入了最小推理工作量值,以优化快速响应。
引入了自定义工具调用类型,它允许在工具调用时进行自由形式的输入和输出。
推出了优先处理支持。优先处理相比标准处理提供显著更低和更一致的延迟,同时保持按需付费灵活性。
发布了 o3-deep-research 和 o4-mini-deep-research,这是我们的 o 系列推理模型的深度研究变体,针对深度分析和研究任务进行了优化。详见深度研究指南。
添加了对 webhook 异步事件处理的支持。降低和简化了 web search 工具的定价。添加了对 web search 工具的支持。
新的可复用 prompts 现在在仪表板和 Responses API 中可用。通过 API,您现在可以通过 prompt 参数(使用 prompt id、可选版本)引用在仪表板中创建的模板,并提供可包括字符串、图像或文件输入的动态变量。可复用 prompts 在 Chat Completions 中不可用。详见此处。
发布了 o3-pro,o3 推理模型的一个版本,使用更多计算来回答困难问题,具有更好的推理和一致性。o3 模型的所有 API 请求(包括 batch 和 flex processing)的价格也已降低。
添加了对使用 direct preference optimization 进行微调的支持,用于模型 gpt-4.1-2025-04-14、gpt-4.1-mini-2025-04-14 和 gpt-4.1-nano-2025-04-14。
新的 gpt-4o-audio-preview 和 gpt-4o-realtime-preview 模型快照现已可用。发布了 TypeScript 的 Agents SDK。
在 Responses API 中添加了对新内置工具的支持,包括远程 MCP 服务器和代码解释器。详见工具指南了解更多。
添加了对在非微调模型的并行工具调用中使用严格模式的支持。添加了新的模式特性,包括用于电子邮件和其他模式的字符串验证,以及为数字和数组指定范围。
在 API 中推出了 codex-mini-latest,针对与 Codex CLI 配套使用进行了优化。
推出了强化微调支持。详见可用微调方法。gpt-4.1-nano 现在可用于微调。
推出了增强的 API 预算警报和自动充值限制支持。
添加了一个新的图像生成模型 gpt-image-1。此模型为图像生成设置了新标准,具有改进的质量和指令遵循。
更新了 Image Generation 和 Edit 端点以支持特定于 gpt-image-1 模型的新参数。
添加了两个新的 o-series 推理模型,o3 和 o4-mini。它们为数学、科学和编码、视觉推理任务以及技术写作设置了新标准。
推出了 Codex,我们的代码生成 CLI 工具。
添加了 gpt-4.1、gpt-4.1-mini 和 gpt-4.1-nano 模型到 API。这些新模型具有改进的指令遵循、编码和更大的上下文窗口(最多 1M tokens)。gpt-4.1 和 gpt-4.1-mini 可用于监督微调。宣布弃用 gpt-4.5-preview。
添加了 gpt-4o-mini-tts、gpt-4o-transcribe、gpt-4o-mini-transcribe 和 whisper-1 模型到音频 API。
发布了 o1-pro,o1 推理模型的一个版本,使用更多计算来回答困难问题,具有更好的推理和一致性。
发布了几个新模型和工具以及用于智能体工作流的新 API:
发布了 Responses API,一个用于创建和使用智能体和工具的新 API。
发布了一套 Responses API 的内置工具:web search、file search 和 computer use。
发布了 Agents SDK,一个用于设计、构建和部署智能体的编排框架。
宣布了新模型:gpt-4o-search-preview、gpt-4o-mini-search-preview、computer-use-preview。
宣布计划将所有 Assistants API 特性引入更易使用的 Responses API,预期 Assistants 的日落日期为 2026 年(在实现完整特性奇偶性之后)。
为微调工作添加了元数据字段支持。
发布了 GPT-4.5 的研究预览——我们有史以来最大和最强大的聊天模型。GPT-4.5 高"情商"和对用户意图的理解使其在创意任务和智能体规划中表现更好。
推出了 API 使用仪表板更新。此更新应对了额外数据过滤器(如项目选择、日期选择器和细粒度时间间隔)的请求。还有更好的支持来查看跨不同产品和服务层的使用。
推出了 o3-mini,一个新的小型推理模型,针对科学、数学和编码任务进行了优化。
扩展了对 o1 模型的访问。o1 系列模型使用强化学习来进行复杂推理。
推出了 Admin API 密钥轮换,使客户能够以编程方式轮换其 admin api 密钥。
更新了 Admin API 邀请,使客户能够以编程方式邀请用户同时加入项目和组织。
添加了 o1、gpt-4o-realtime、gpt-4o-audio 等新模型。
为 Realtime API 添加了 WebRTC 连接方法。
为 o1 模型添加了 reasoning_effort 参数。
为 o1 模型添加了开发者消息角色。注意 o1-preview 和 o1-mini 不支持系统或开发者消息。
推出了使用 Direct Preference Optimization(DPO)的偏好微调。
推出了 Go 和 Java 的 Beta SDK。详见此处。
添加了在 Python SDK 中的 Realtime API 支持。
推出了使用 API,使客户能够以编程方式查询 OpenAI APIs 中的活动和支出。
发布了 gpt-4o-2024-11-20,我们 gpt-4o 系列中的最新模型。
发布了预测输出,它极大地减少了模型响应的延迟,其中响应的大部分是提前知道的。这在重新生成仅有微小更改的文档和代码文件的内容时最常见。
在 Realtime API 和 Chat Completions API 中添加了五种新的语音类型。
发布了新的 gpt-4o-audio-preview 模型用于聊天完成,支持音频输入和输出。使用与 Realtime API 相同的底层模型。
在旧金山的 OpenAI DevDay 发布了几项新功能:
Realtime API:使用 WebSockets 接口在您的应用中构建快速语音转语音体验。
模型蒸馏:用于微调成本高效模型的平台,使用来自大型前沿模型的输出。
图像微调:使用图像和文本微调 GPT-4o 以改进视觉功能。
Evals:创建和运行自定义评估以衡量模型在特定任务上的性能。
Pro