
OpenAI 推出 Flex 处理模式:API 费用减半,性能有所牺牲
OpenAI 为降低成本,推出 Flex 处理模式,用户可享受 API 费用减半,但需承担响应速度降低及稳定性下降的风险。此模式适用于非生产任务,如模型评估和数据扩充。
OpenAI Flex 处理模式介绍
近日,OpenAI 宣布推出 Flex 处理模式,旨在与谷歌等竞争对手在生成式 AI 领域竞争。该模式允许用户以牺牲响应速度和稳定性为代价,享受更低的 API 费用。
Flex 处理模式目前适用于 o3 和 o4-mini 推理模型,主要面向非生产任务,如模型评估和数据扩充。采用该模式,API 费用将直接减半。
例如,Flex 模式下,o3 的费用为每百万输入 tokens 收取 5 美元,每百万输出 tokens 收取 20 美元;而标准价格为每百万输入 tokens 收取 10 美元,每百万输出 tokens 收取 40 美元。对于 o4-mini,Flex 模式的费用同样大幅降低。

值得注意的是,处于第 1 至第 3 层的开发者必须完成新上线的身份验证流程,方可获取 o3 的访问权限。此外,o3 及其他模型的推理摘要功能和流式 API 服务同样需要完成身份验证后才能启用。
OpenAI 强调,身份验证机制的目的是防止用户违反公司制定的使用政策。