01
长上下文与图文输入
官方文档列出 1,050,000 Token 上下文、最高 922,000 Token 输入和 128,000 Token 输出。模型接受文本与图片输入,输出为文本。这些是官方模型上限,不代表单次请求可以同时用满所有上限。
- 1,050,000 Token 上下文
- 文本 + 图片输入 → 文本输出

透明定价,无隐藏费用。按量付费,用多少付多少。
| 型号 | 规格 | PoYo价格 | 官方价格 | 为你节省 |
|---|---|---|---|---|
Input | $0.080/1M tokens 16 积分 /1M tokens | $0.100/1M tokens Official | 20% | |
Output | $0.400/1M tokens 80 积分 /1M tokens | $0.500/1M tokens Official | 20% | |
Cache Read | $0.008/1M tokens 1.6 积分 /1M tokens | $0.010/1M tokens Official | 20% | |
Cache Write | $0.100/1M tokens 20 积分 /1M tokens | $0.125/1M tokens Official | 20% |
* 实际费用以最终输出为准。
面向专注任务与高调用量应用的高效推理模型
GPT-6 Luna 是 OpenAI 面向专注任务和高调用量场景的 GPT-6 模型,于 2026 年 9 月 22 日发布,接受文本和图片输入并输出文本。下方规格来自官方文档;PoYo 的接入方式与定价单独列明。
面向专注任务与高调用量应用的高效推理模型
01
官方文档列出 1,050,000 Token 上下文、最高 922,000 Token 输入和 128,000 Token 输出。模型接受文本与图片输入,输出为文本。这些是官方模型上限,不代表单次请求可以同时用满所有上限。

02
官方支持 none、low、medium、high、xhigh、max 六档,默认 medium。OpenAI 建议通过 Responses 使用工具;Chat Completions 的函数调用要求 reasoning_effort=none。
PoYo 已验证 Chat Completions 和 Responses 的基础文本请求。图片输入、流式输出、推理参数、结构化输出及工具执行尚未在本次接入中验证;官方支持不等于渠道已支持。

03
对于输入不超过 272K Token 的标准请求,官方每百万 Token 定价为:输入 $0.10、输出 $0.50、缓存读取 $0.01、缓存写入 $0.125。PoYo 对应基础标价为 $0.08、$0.40、$0.008 和 $0.10。

可评估用于工单分流或按预设标签分类文档。
可尝试对提供的文本做定向摘要与字段提取,并用业务样本校验结果。
通过明确的提示词生成短草稿、改写内容和回复建议。
可评估代码解释与小范围修改,应用前运行项目测试。
| 规格项 | GPT-6 Luna |
|---|---|
| 发布日期 | 2026-09-22 |
| 上下文窗口 | 1,050,000 tokens |
| 最大输入 | 922,000 tokens |
| 最大输出 | 128,000 tokens |
| 知识截止日期 | 2026-05-18 |
| 输入 / 输出 | 文本 + 图片 / 文本 |
| 推理档位 | none · low · medium · high · xhigh · max |
| 微调 | 官方模型不支持 |
核验于 2026 年 9 月 23 日。以上为官方模型规格,渠道限制与功能开放情况可能不同。
/v1/chat/completions + /v1/responses。调用模型 ID 为 gpt-6-luna。在现有 Chat Completions 或 Responses 接入中使用 gpt-6-luna。
在上方价格表中查看输入、输出和缓存的各项单价。
查看本页模型规格,并验证应用实际需要的功能。
在当前页面试用文本提示词,切换 Chat Completions 与 Responses,再接入应用。