gpt-4o-audio-preview-2024-12-17 — 价格、上下文与性能

gpt-4o-audio-preview-2024-12-17 是 OpenAI 的模型,可在 AirAI 上调用。输入 $2.48,输出 $9.92,均为每百万 tokens。

概览

厂商OpenAI
API 格式openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search

价格

套餐倍率输入输出说明
基准价1×$2.48$9.92
Eco0.3×$0.74$2.98Standard — standard reasoning, moderate stability.
default0.6×$1.49$5.95Standard — standard reasoning, moderate stability.
Plus1×$2.48$9.92High — strong reasoning, stable.
Pro2×$4.96$19.84Enterprise — full reasoning, high stability.
Max4×$9.92$39.68Premium — max reasoning & stability.

仅列出该模型已开放的套餐。

性能实测

API 端点https://api.airai.cc/v1
OpenAI 兼容OpenAI-compatible

常见问题

gpt-4o-audio-preview-2024-12-17 的价格是多少?
输入 $2.48,输出 $9.92,均为每百万 tokens。
gpt-4o-audio-preview-2024-12-17 的上下文窗口有多大?
gpt-4o-audio-preview-2024-12-17 的上下文窗口为 未标注,即单次请求中输入与输出合计的 token 上限。
如何在代码中调用 gpt-4o-audio-preview-2024-12-17?
把 base_url 指向 https://api.airai.cc/v1,model 填 gpt-4o-audio-preview-2024-12-17 即可,接口与 OpenAI 完全兼容。
gpt-4o-audio-preview-2024-12-17 为什么会返回 429?
429 是限流响应。降低并发、加退避重试,或切换到配额更高的套餐即可。

模型对比

Model厂商输入输出上下文
gpt-4o-audio-preview-2024-12-17OpenAI$2.48$9.92未标注
gpt-chat-latestOpenAI$5.00$30.00未标注
gpt-5.3OpenAI价格未公开—未标注
gpt-image-2-cOpenAI每次请求 $0.12—未标注
gpt-5.6-terra-ultraOpenAI价格未公开—未标注
gpt-4o-audio-previewOpenAI$2.50$10.00未标注
gpt-5.2-proOpenAI$21.00$168.00400K
gpt-5.6-terra-openai-compactOpenAI价格未公开—未标注
o3OpenAI$2.00$8.00200K
gpt-5.5-openai-compactOpenAI价格未公开—未标注
gpt-5.6-sol-openai-compactOpenAI价格未公开—未标注
gpt-4-1106-previewOpenAI$10.00$30.00未标注
gpt-5.5-proOpenAI$30.00$180.001.1M

错误排查

429 是限流响应。降低并发、加退避重试,或切换到配额更高的套餐即可。

常见原因

  • 并发请求过多
  • 当前套餐配额已用完
  • 失败后立即重试没有退避

解决办法

  • 限制并发并用指数退避重试
  • 切换到配额更高的套餐
  • 对重复请求做缓存

如何接入

curl https://api.airai.cc/v1/chat/completions \
  -H "Authorization: Bearer <YOUR_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-4o-audio-preview-2024-12-17",
    "messages": [{"role": "user", "content": "Hello"}]
  }'
from openai import OpenAI

client = OpenAI(
    api_key="<YOUR_API_KEY>",
    base_url="https://api.airai.cc/v1"
)

response = client.chat.completions.create(
    model="gpt-4o-audio-preview-2024-12-17",
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

const response = await client.chat.completions.create({
  model: "gpt-4o-audio-preview-2024-12-17",
  messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);
const OpenAI = require("openai");

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

client.chat.completions.create({
  model: "gpt-4o-audio-preview-2024-12-17",
  messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));

将 <YOUR_API_KEY> 替换为令牌设置中的 API Key。

兼容端点

openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search

Gemini SDK · TypeScript

import { GoogleGenerativeAI } from "@google/generative-ai";

const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "gpt-4o-audio-preview-2024-12-17" });

const result = await model.generateContent(
  "Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());

身份验证

所有请求必须携带 Authorization: Bearer <TOKEN> 请求头;Anthropic 格式端点也接受 x-api-key 请求头。在「令牌」页面生成 API Key,可按模型、分组、IP、速率等维度精细化授权。

支持的参数

参数类型默认值范围说明
temperaturefloat10–2采样温度;越低越稳定
top_pfloat10–1核采样累计概率
max_tokensinteger——响应中最大 token 数
frequency_penaltyfloat0−2–2惩罚高频 token 的重复出现
presence_penaltyfloat0−2–2鼓励引入新话题
stopstring[]null≤ 4最多 4 个停止生成的字符串
seedintegernull—尽量保证可复现的采样种子
ninteger1—生成的候选条数
streambooleanfalse—通过 SSE 流式返回 token
response_formatobject——强制输出 JSON 对象或符合 Schema 的结果
toolsarray——模型可调用的工具 / 函数声明
tool_choicestring | objectauto—工具选择策略或具体工具名
logprobsbooleanfalse—返回每个 token 的对数概率
top_logprobsintegernull0–20每个 token 返回的 top 概率数量
logit_biasmap——按 token 的 logit 偏置映射
userstring——用于风险审计的终端用户标识

速率限制

分组RPMTPMRPD
Eco990398K20K
Test980393K20K

数据更新于: 2026-10-10 12:10

技术支持在线客服
返回顶部