首页 > 博客 > GPT-6 Sol和Luna API价格 一百万token多少钱

GPT-6 Sol和Luna API价格 一百万token多少钱

更新时间:2026-09-28 05:47:01 发布时间:1小时前 阅读:3次

GPT-6 Sol 和 Luna 的 API 价格在 2026 年 9 月 22 日发布时就定下来了,而且官方明确说是“永久定价”,不是限时促销。但很多人去看价格表的时候被“短上下文”“长上下文”“缓存输入”这些档位绕晕了,不知道实际跑一个任务到底花多少钱。下面把两个模型的完整价格表和计费规则拆开说。

gpt6 api pricing

GPT-6 Sol 标准价格

Sol 的短上下文标准价是输入 $2 / 百万 token,输出 $10 / 百万 token。这个价格适用于单次请求输入不超过 272K token 的情况。如果你开了提示缓存,缓存命中的输入部分只收 $0.20 / 百万 token,相当于打了一折。缓存写入的费用是 $2.50 / 百万 token。

GPT-6 Sol 长上下文价格

如果单次请求的输入超过 272K token,整个请求的计费会跳档。输入变成 $4 / 百万 token,输出变成 $15 / 百万 token,缓存输入 $0.40,缓存写入 $5.00。注意是整个请求按长上下文价格算,不是只对超出部分加价。所以一个 300K 输入的请求,全部 token 都按 $4 计费。

GPT-6 Luna 标准价格

Luna 的短上下文标准价是输入 $0.10 / 百万 token,输出 $0.50 / 百万 token。这个价格是整个 GPT-6 系列里最低的,跟 Sol 差了整整二十倍。缓存命中的输入只要 $0.01 / 百万 token,缓存写入 $0.125。对于跑批量任务、Agent 内部调用这种高频场景,Luna 的成本几乎可以忽略。

GPT-6 Luna 长上下文价格

Luna 超过 272K 输入 token 之后同样跳档。输入变成 $0.20 / 百万 token,输出变成 $0.75 / 百万 token,缓存输入 $0.02,缓存写入 $0.25。虽然翻倍了,但绝对值依然很低。一个 400K 输入的请求加 5K 输出,按长上下文价格算下来也只要 $0.084 左右。

Batch 和 Fast 模式的价格

OpenAI 还有两种处理模式会影响价格。Batch(批处理)和 Flex 模式的价格是标准价的一半,适合对延迟不敏感的大批量任务。Fast 模式(以前叫 Priority)的价格是标准价的两倍,适合需要低延迟的实时应用。这两种模式的价格都会跟着长短上下文的档位走。

实际跑一个任务花多少钱

光看单价没感觉,算个具体的。假设你一个月跑 1000 万输入 token 加 200 万输出 token:用 Luna 是 $2.00,用 Sol 是 $40.00,用 Astra 是 $200.00。如果 80% 的输入能命中缓存,Luna 降到 $1.28,Sol 降到 $25.60。对一个客服系统来说,10 万条工单每条 300 token 输入、5 token 输出,Luna 的总成本大约是 $3.25。

标签:
微信        
微信号runmie