主题
模型与价格
本站共提供 11 个模型,全部支持 OpenAI、Responses、Anthropic、Gemini 四种调用协议。
价格总表
价格单位为 美元 / 100 万 tokens。
| 模型 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
deepseek-flash | $0.5 | $2 | $0.02 |
gpt-6-luna | $0.5 | $2 | $0.01 |
gpt-6-astra | $2.8 | $14 | $0.28 |
gpt-6.1-sol | $0.56 | $2.8 | $0.028 |
gpt-5.6-sol | $1.4 | $8.4 | $0.14 |
claude-sonnet-5-5 | $2 | $10 | $0.2 |
claude-opus-5-5 | $4 | $20 | $0.2 |
gemini-3.8-flash-high | $1.25 | $4.5 | $0.2 |
qwen3.8-omni-flash | $0.5 | $2 | $0.1 |
kimi-k3 | $8 | $40 | $0.8 |
muse-spark-1.3 | $0.5 | $2 | $0.02 |
缓存读取是什么意思
如果你重复发送相似内容,上游会命中缓存,这部分 token 按「缓存读取」价计费, 通常比正常输入便宜很多。缓存由上游自动管理,无需手动配置。
长上下文分档
以下两个模型按输入长度分档计费:当单次请求的输入超过 272K tokens 时, 输入、输出、缓存价格全部上调。
gpt-6.1-sol
| 档位 | 输入 | 输出 | 缓存读取 | 缓存写入 |
|---|---|---|---|---|
| ≤ 272K | $0.56 | $2.8 | $0.028 | $0.7 |
| > 272K | $1.12 | $4.2 | $0.056 | $1.4 |
gpt-6-astra
| 档位 | 输入 | 输出 | 缓存读取 | 缓存写入 |
|---|---|---|---|---|
| ≤ 272K | $2.8 | $14 | $0.28 | $3.5 |
| > 272K | $5.6 | $21 | $0.56 | $7 |
长上下文成本上升明显
272K tokens 大约是 20 万汉字。处理长文档、大仓库代码时注意控制单次输入长度, 必要时拆分成多次请求,成本会低很多。
计费方式
余额按实际用量扣减,规则如下:
- 输入 token:你发送的内容
- 输出 token:模型生成的内容(含思考过程)
- 缓存读取:命中上游缓存的部分,单价更低
最终扣费 = 各项 token 数 × 对应单价。
你可以在「使用日志」页面查看每次请求的详细消耗。
模型选择建议
| 场景 | 推荐模型 |
|---|---|
| 日常对话、快速任务 | deepseek-flash、gpt-6-luna |
| 代码编写与重构 | gpt-6.1-sol、claude-sonnet-5-5 |
| 复杂推理、长文档分析 | claude-opus-5-5、kimi-k3 |
| 大仓库、长上下文处理 | gpt-6.1-sol、gpt-6-astra |
| 图片理解(多模态) | qwen3.8-omni-flash、gemini-3.8-flash-high |
模型名不要加后缀
直接使用表格里的完整名称,例如 claude-opus-5-5。 不要自行添加 -thinking、-high 之类的后缀,部分客户端会因此找不到模型。