GPT-5.6 家族轻量款,响应迅捷、成本更低,适合高并发与快速问答。
模型 ID: gpt-5.6-luna · 类型: chat · 厂商: OpenAI
可用端点: /v1/chat/completions · /v1/responses · /v1/messages
| 输入 (每 1M tokens) | $0.65 USD |
| 输出 (每 1M tokens) | $3.9 USD |
| 缓存命中 (每 1M tokens) | $0.065 USD |
| 缓存创建 5m (每 1M tokens) | $0.8125 USD |
| ≤ 272000 tokens | $0.65 / 1M in | $3.9 / 1M out |
| > 272000 | $1.3 / 1M in | $5.85 / 1M out |
from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.router.ai/v1")
resp = client.chat.completions.create(
model="gpt-5.6-luna",
messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)GPT-5.6 Luna (`gpt-5.6-luna`) 按用量计费, $0.65/1M in · $3.9/1M out (美元)。最新价格见 https://932.ai/models/gpt-5.6-luna。
向 https://api.router.ai/v1/v1/chat/completions 发请求, 带请求头 `Authorization: Bearer <你的 API Key>`, body 里 `"model": "gpt-5.6-luna"`。接口与 OpenAI 兼容, 用任何 OpenAI SDK 只需把 base_url 改成 https://api.router.ai/v1, 其余代码不用动。
GPT-5.6 Luna 可通过以下端点调用: /v1/chat/completions; /v1/responses; /v1/messages.
GPT-5.6 Luna 最多接受 922,000 个输入 token, 最多返回 128,000 个输出 token。超出输入上限的请求会在到达模型前被拒绝。
GPT-5.6 Luna 支持: vision, function_calling, prompt_caching.
GPT-5.6 Luna 是 OpenAI 的 chat 模型, 通过 932.ai 网关调用, 与其他所有模型共用同一个 API Key。
通过 932.ai 的 OpenAI 兼容接口调用 (API Base: https://api.router.ai/v1). AI agent 可经 MCP (https://mcp.router.ai/mcp) 直接发现并调用本网关的全部模型, 无需人工集成.