OpenAI

gpt-5.6-luna

OpenAI按量计费

OpenAI 的 gpt-5.6-luna 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。

textimagestreamingfunction_callingtoolsstructured_outputjson_modevisionweb_searchcachingreasoningcode_interpretercontext:1050000
起始价格
输入 / 输出 · 1M
上下文
1.1M
最大输入窗口
最大输出
128K
单次响应最大 token 数
模态
→
知识截止
Feb 2026
发布于
Jul 2026

按供应商定价

OpenAI
省40%
Openai官方接口
输入$0.2$0.12/ 1M
输出$1.2$0.72/ 1M
缓存读取$0.02$0.012/ 1M
缓存写入 (5m)$0.25$0.15/ 1M
缓存写入 (1h)$0.4$0.24/ 1M
Azure
省40%
微软云API直连,稳定可靠
输入$0.2$0.12/ 1M
输出$1.2$0.72/ 1M
缓存读取$0.02$0.012/ 1M
缓存写入 (5m)$0.25$0.15/ 1M
缓存写入 (1h)$0.4$0.24/ 1M
GPT官+AZ 混合
省40%
适合生产环境,az 和官 key 混合渠道
输入$0.2$0.12/ 1M
输出$1.2$0.72/ 1M
缓存读取$0.02$0.012/ 1M
缓存写入 (5m)$0.25$0.15/ 1M
缓存写入 (1h)$0.4$0.24/ 1M
GPT特价
省50%
适合vibe coding自用,gpt pro 号池
输入$0.2$0.1/ 1M
输出$1.2$0.6/ 1M
缓存读取$0.02$0.01/ 1M
缓存写入 (5m)$0.25$0.125/ 1M
缓存写入 (1h)$0.4$0.2/ 1M

能力 / 支持的模态

流式输出函数调用工具结构化输出JSON 模式视觉网络搜索提示词缓存推理代码解释器
输入
输出

厂商与数据隐私

厂商
OpenAI文档
分词器
o200k_base
许可证
Proprietary (commercial)商业闭源
数据保留30 天默认不会用于上游训练

性能

接入 API

调用示例

请求POST/v1/chat/completions
请求示例
参数
参数类型默认值 / 范围说明信息
temperature
number
=10 ~ 2
采样温度;越低越稳定
top_p
number
=10 ~ 1
核采样累计概率
max_tokens
integer>= 1响应中最大 token 数
frequency_penalty
number
=0-2 ~ 2
惩罚高频 token 的重复出现
presence_penalty
number
=0-2 ~ 2
鼓励引入新话题
stop
array—最多 4 个停止生成的字符串
seed
integer—尽量保证可复现的采样种子
n
integer
=1>= 1
生成的候选条数
stream
boolean
=false
通过 SSE 流式返回 token
response_format
object—强制输出 JSON 对象或符合 Schema 的结果
tools
array—模型可调用的工具 / 函数声明
tool_choice
string
autononerequired
工具选择策略或具体工具名
logprobs
boolean
=false
返回每个 token 的对数概率
top_logprobs
integer0 ~ 20每个 token 返回的 top 概率数量
logit_bias
object—按 token 的 logit 偏置映射
user
string—用于风险审计的终端用户标识

替换 <YOUR_API_KEY> 替换为令牌设置中的 API Key。

身份验证

所有请求必须携带 Authorization: Bearer <TOKEN> 请求头。Anthropic 格式的端点也接受 x-api-key 请求头。

在「令牌」页面生成 API Key,可以按模型、分组、IP、速率等维度精细化授权。

支持的参数

Generation parameters
参数类型默认值 / 范围说明信息
temperature
number
=10 ~ 2
采样温度;越低越稳定
top_p
number
=10 ~ 1
核采样累计概率
max_tokens
integer>= 1响应中最大 token 数
frequency_penalty
number
=0-2 ~ 2
惩罚高频 token 的重复出现
presence_penalty
number
=0-2 ~ 2
鼓励引入新话题
stop
array—最多 4 个停止生成的字符串
seed
integer—尽量保证可复现的采样种子
n
integer
=1>= 1
生成的候选条数
stream
boolean
=false
通过 SSE 流式返回 token
response_format
object—强制输出 JSON 对象或符合 Schema 的结果
tools
array—模型可调用的工具 / 函数声明
tool_choice
string
autononerequired
工具选择策略或具体工具名
logprobs
boolean
=false
返回每个 token 的对数概率
top_logprobs
integer0 ~ 20每个 token 返回的 top 概率数量
logit_bias
object—按 token 的 logit 偏置映射
user
string—用于风险审计的终端用户标识

速率限制

供应商RPMTPMRPD
Azure720289K15K
GPT官+AZ 混合880351K18K
GPT特价440174K8.7K
OpenAI940376K19K

RPM = 每分钟请求数,TPM = 每分钟 token 数,RPD = 每日请求数。限制按令牌分组生效。

API 接入常见问题

创建账户前需要了解的关键信息。

探索更多模型