← 返回 2026-07-26 简报

OpenAI 宣布 GPT-5 Turbo:推理速度提升 3 倍,价格减半

OpenAI 发布了 GPT-5 Turbo,作为 GPT-5 系列的轻量高效版本,旨在为生产环境提供更具性价比的 AI 能力。

核心特性

  • 性能与效率:GPT-5 Turbo 采用了改进的模型蒸馏技术,在保持 GPT-5 90% 以上性能的同时,将模型体积压缩了 60%。推理速度提升了 3 倍,首 token 延迟降低至 200ms 以下。
  • 定价策略:API 定价相比 GPT-5 降低了 50%,输入 token 价格为 $2/百万 token,输出为 $8/百万 token。这一价格使得大规模 AI 应用的经济性大大改善。
  • 长上下文优化:高效支持 128K token 上下文窗口,在长文档处理场景下的吞吐量比 GPT-5 提升了 2.5 倍。

应用场景

OpenAI 表示 GPT-5 Turbo 特别针对实时应用场景进行了优化,首批用户包括多个大型 SaaS 平台。实时客服、代码补全、内容生成等对延迟敏感的应用将直接受益。此外,GPT-5 Turbo 还支持 streaming 输出,首 token 延迟仅 150ms。

行业意义

GPT-5 Turbo 的发布标志着 AI 行业的趋势转变——从追求"最大最强"到追求"最优性价比"。推理速度提升 3 倍、价格减半,这会让更多中小企业真正用得起前沿 AI。

原文链接: https://openai.com/blog/gpt-5-turbo

来源: OpenAI

原文链接:https://openai.com/blog/gpt-5-turbo
来源:OpenAI
以上内容由 AI 自动翻译,仅供参考。
← 返回简报