跳转到内容

GPT-4 Turbo — 成本降低与知识更新

发布日期: 2023-11-06
来源: OpenAI DevDay 公告
工程范式: 统一推理模型路线——在 GPT-4 基础上优化效率、成本、知识新鲜度。

GPT-4 Turbo 是 OpenAI 在 GPT-4 发布后 8 个月的重大迭代。核心目标是 降低使用成本、更新知识截止、扩展上下文能力。这标志着 OpenAI 从”能做”到”能便宜地做”的战略转向——让最好模型的价格变得可负担。

关键定价:输入 $0.01/1K tokens,输出 $0.03/1K tokens,比 GPT-4 便宜 2.75-3 倍

  • 知识截止日期: 从 GPT-4 的 2021 年 9 月更新到 2023 年 4 月(新增 19 个月知识)
  • 上下文窗口: 从 8K/32K 扩展到 128K tokens(4 倍于 GPT-4 最大窗口)
  • 功能增强:
    • JSON Mode(强制结构化输出)
    • Function Calling 改进(一次可调用多个函数)
    • 可复现输出(seed 参数)
    • 更好的指令遵循(instruction following)
  • 价格策略: 输入侧比 GPT-4 便宜 3 倍,输出侧比 GPT-4 便宜 2 倍
  • 速率限制: 翻倍(可申请更高限额)
能力维度GPT-4 TurboGPT-4变化
英文文本持平基线
代码生成微降基线
长上下文 (128K)可用限于 32K
知识时效2023-042021-09↑↑
价格(输入)$0.01/1K$0.03/1K↓ 3x
价格(输出)$0.03/1K$0.06/1K↓ 2x
维度GPT-4 TurboGPT-4Claude 2.1
上下文128K32K100K
知识截止2023-042021-092023-01
价格$0.01/$0.03$0.03/$0.06$0.008/$0.024
JSON Mode
  1. 基础模型的边际成本递减: 同架构下的推理优化可以在 8 个月内将成本降低 2-3 倍
  2. 知识更新是最容易被低估的用户需求: GPT-4 使用 2021 年知识的限制是用户最大的痛点之一
  3. 128K 上下文在 2023 年底是差异化能力 —— 长上下文是通往 agent 能力的桥梁
  4. 功能更新(JSON Mode、Function Calling)比能力提升对开发者更重要 —— GPT-4 Turbo 的核心价值主要在降低成本和增强开发体验