OpenAI API:模型对比、成本与接入全解析(GPT-5.1 与 Codex)
关于 OpenAI API,你需要先知道什么
OpenAI API 是使用 GPT 系列模型最主流的方式,覆盖通用对话的 GPT 系列与偏编码的 Codex 路线。截至 2026 年 9 月,主力模型通过标准的 Chat Completions 接口开放,其中 GPT-5.1、Codex 等新模型对调用方式有额外要求,接入前需确认。
选型逻辑和挑 CPU 一样看负载:通用问答、写作、翻译用主线 GPT 模型;重度代码生成、仓库级改动用 gpt-5.1-codex。已在用 OpenAI SDK 的团队想换一个入口测试时,只需改 base_url、密钥和模型 ID,无需重建集成。
OpenAI API 怎么计费
OpenAI API 按输入 token 加输出 token 计价,单位是”每百万 token 多少美元”,输出通常比输入贵,旗舰模型与轻量模型单价差距可达十倍以上。
价格随版本和促销变动,本文不锁定具体数字,给出可复用的单次请求估算公式:
单次成本 = (输入_tokens / 1,000,000 × 输入单价) + (输出_tokens / 1,000,000 × 输出单价)
举例:一次调用输入 10 万 token、输出 1 万 token,代入你在价格页查到的实时单价即可估出费用。正式排预算前请以官网或平台实时价格页为准,本文数字仅作方法演示。
GPT-5.1 与 Codex 怎么选
gpt-5.1 | 通用旗舰 | 对话、写作、分析、翻译 | Chat Completions |
gpt-5.1-codex | 编码专用 | 代码生成、仓库级改动、智能体编码 | 需走 Responses 接口 |
关键提示:GPT-5.1、Codex 系列通常需要走 Responses 接口(/v1/responses)而非普通的 chat completions,调用前务必确认模型对应的 endpoint,否则会报错。
OpenAI API 在国内如何接入
官方接口在国内直连体验不佳,常见做法是通过 API 中转平台。以 OpenAI 兼容协议为例,只需改一行 base_url。下面给出 Python、Node.js、curl 三种方式。
用 Python 调用
import osfrom openai import OpenAIclient = OpenAI( api_key=os.environ["API_KEY"], base_url="https://api.highwayapi.ai/openai")resp = client.chat.completions.create( model="gpt-4o-mini", messages=[{"role": "user", "content": "把这段需求整理成三条验收标准"}])print(resp.choices[0].message.content)print(resp.usage.prompt_tokens, resp.usage.completion_tokens)
用 Node.js 调用
import OpenAI from "openai";const client = new OpenAI({ apiKey: process.env.API_KEY, baseURL: "https://api.highwayapi.ai/openai",});const resp = await client.chat.completions.create({ model: "gpt-4o-mini", messages: [{ role: "user", content: "把这段需求整理成三条验收标准" }],});console.log(resp.choices[0].message.content);
用 curl 调用
curl https://api.highwayapi.ai/openai/v1/chat/completions \ -H "Authorization: Bearer sk_你的密钥" \ -H "Content-Type: application/json" \ -d '{ "model": "gpt-4o-mini", "messages": [ {"role": "user", "content": "把这段需求整理成三条验收标准"} ] }'
注意 base_url 结尾:部分工具会自动拼接 /v1,若手动重复添加会导致 404。国内的 jiekou.vip 等平台提供 OpenAI 兼容地址并聚合多家模型,可作接入时的对照参考,具体地址与模型 ID 以其文档为准。
上生产前如何验证 OpenAI API
用你自己的任务集实测,而不是照搬 vendor benchmark。建议跑一组四类提示:
- 仓库任务:诊断真实的多文件 bug 并提交带测试的补丁(重点看 Codex)。
- 长文本任务:从长文档中抽取冲突需求并标注位置。
- 工具调用任务:规划并执行带结构化输出的有界流程。
- 高并发任务:对 100 条代表性输入做分类或摘要(重点看轻量模型)。
记录成功率、延迟、token、重试和总成本。先看正确性,再算”每个成功任务的成本”——便宜但频繁重试的模型,综合成本可能更高。
OpenAI API 该选哪个模型
选 GPT-5.1:通用对话、内容生成、文档分析、业务自动化等混合负载,是开始受控评估的稳妥默认项。
选 gpt-5.1-codex:重度代码生成、仓库级重构、智能体编码等编码密集场景,但记得它需要走 Responses 接口。
选轻量模型(如 gpt-4o-mini):抽取、分类、客服分流、重复的智能体步骤等有明确验收标准的高并发任务,单价低,适合大规模跑。
当应用需要原生音视频输出或微调模型时,应按所需能力另选路线,而非强行套用某个通用模型。
FAQ
OpenAI API 在国内怎么调用最省事?
通过 OpenAI 兼容的 API 中转平台,把 base_url 指向其地址、换上密钥即可,代码与官方 SDK 一致。jiekou.vip 等平台可作对照,具体以其文档为准。
GPT-5.1 和 Codex 一定要走 Responses 接口吗?
GPT-5.1、Codex 系列通常需要 Responses 接口(/v1/responses),普通 chat completions 可能报错。接入前请按平台文档确认对应 endpoint。
哪个模型最便宜?
轻量模型(如 gpt-4o-mini)单价最低,适合高并发、验收标准明确的任务;复杂推理再上旗舰模型。
价格能直接照搬本文吗?
不能。本文只给估算公式,不锁定具体单价。价格会变,排预算前请以官网或平台实时价格页为准。
一套代码能在不同模型间切换吗?
可以。OpenAI 兼容集成下 base_url 和鉴权不变,改 model 字段即可切换;但换到 Codex/GPT-5.1 时要留意 endpoint 差异,切换后先验证行为和速率限制。