OpenAI 模型谱系
从生成式预训练到统一推理、多模态、工具与 Agent,OpenAI 以 GPT 主线串联图像、语音、视频与推理专用系列,持续重划通用模型的产品边界。
历代模型
GPT-Live(全双工语音)
全双工语音模型家族,可同时听与说;GPT-Live-1 与 mini 分别成为付费与免费用户的 ChatGPT 语音默认模型。
GPT-5.6 Luna 免费开放
免费与 Go 用户默认模型切换为 Luna,无限次文本聊天并新增 Think 按钮;Plus/Pro 的 Sol 同步升级,事实错误率较 GPT-5.5 Instant 降约 68%。
GPT-5.6
以 Sol、Terra、Luna 三档覆盖能力、成本与吞吐,并加入程序化工具调用、多 Agent、显式缓存和持久推理。
GPT-5.5
把托管 Shell、补丁应用、Skills、MCP 与网页搜索进一步纳入旗舰模型的生产工作流。
GPT-5.4
引入 100 万 token 上下文、原生压缩、工具搜索和内置计算机使用,强化长期 Agent 工作流。
GPT-5.3
重点推进 ChatGPT 即时体验与实时编码分支,随后被更新的旗舰家族取代。
GPT-5.2
面向复杂专业工作提高可靠性,并延伸出针对长期软件工程任务优化的 Codex 版本。
GPT-5.1
提升可控性、代码与 Agent 工作流,并加入无需额外思考的快速推理档位。
GPT-5
把快速回答与深度推理统一到同一家族,并面向工具使用、代码和专业工作流优化。
OpenAI o3-pro
更高计算预算的 o3 专业档,面向最难推理与专业工作负载。
OpenAI o3 / o4-mini
首批能在 ChatGPT 中代理式调用全套工具的推理模型;o4-mini 接续小推理档。
GPT-4.5
强化世界知识、自然对话与模式识别,是大规模无监督路线的过渡性旗舰更新。
OpenAI o3-mini
更小更快的推理档,并向免费用户开放;可调低/中/高思考强度。
OpenAI o1
o1 正式版扩大可用性,强化 STEM、代码与多步规划场景。
OpenAI o1-preview / o1-mini
用更长测试时计算换取更强复杂推理,「推理模型」成为独立产品路线。
GPT-4o
原生统一文本、视觉与语音输入输出,降低实时多模态交互的延迟与成本。
Sora
文本到视频生成研究与产品化路线公开,把「世界模拟」叙事带入生成模型竞争。
GPT-4 Turbo
更长上下文、更低价格与更新知识截断,面向生产 API 与 Assistants 工作流。
DALL·E 3
与 ChatGPT 深度集成,强调提示遵循与更安全的图像生成体验。
GPT-4
显著提升推理、代码与专业任务表现,并把图像理解纳入旗舰模型能力。
GPT-3.5 / ChatGPT
指令微调与对话对齐支撑 ChatGPT,把大模型从开发者工具变成大众产品入口。
Whisper
大规模弱监督语音识别模型开源,成为多语言转写与字幕的事实基础设施之一。
DALL·E 2
显著提升图像质量与语义对齐,文生图进入可用的消费与创作者工具阶段。
Codex
在代码语料上微调的 GPT 系模型,支撑 GitHub Copilot 等编程辅助产品。
DALL·E
文本到图像生成的早期里程碑,展示大规模多模态生成的产品潜力。
GPT-3
1750 亿参数带来强大的少样本与上下文学习,大模型开始以 API 形式成为通用能力底座。
GPT-2
把参数规模和零样本生成能力同时向前推,也首次让模型发布方式与滥用风险成为公共议题。
GPT-1
用「先预训练、再微调」证明通用语言表征可迁移到多种任务,为 GPT 路线奠定方法基础。