Skip to content

模型与价格 ​

本站共提供 11 个模型,全部支持 OpenAI、Responses、Anthropic、Gemini 四种调用协议。

价格总表 ​

价格单位为 美元 / 100 万 tokens。

模型输入输出缓存读取
deepseek-flash$0.5$2$0.02
gpt-6-luna$0.5$2$0.01
gpt-6-astra$2.8$14$0.28
gpt-6.1-sol$0.56$2.8$0.028
gpt-5.6-sol$1.4$8.4$0.14
claude-sonnet-5-5$2$10$0.2
claude-opus-5-5$4$20$0.2
gemini-3.8-flash-high$1.25$4.5$0.2
qwen3.8-omni-flash$0.5$2$0.1
kimi-k3$8$40$0.8
muse-spark-1.3$0.5$2$0.02

缓存读取是什么意思

如果你重复发送相似内容,上游会命中缓存,这部分 token 按「缓存读取」价计费, 通常比正常输入便宜很多。缓存由上游自动管理,无需手动配置。

长上下文分档 ​

以下两个模型按输入长度分档计费:当单次请求的输入超过 272K tokens 时, 输入、输出、缓存价格全部上调。

gpt-6.1-sol ​

档位输入输出缓存读取缓存写入
≤ 272K$0.56$2.8$0.028$0.7
> 272K$1.12$4.2$0.056$1.4

gpt-6-astra ​

档位输入输出缓存读取缓存写入
≤ 272K$2.8$14$0.28$3.5
> 272K$5.6$21$0.56$7

长上下文成本上升明显

272K tokens 大约是 20 万汉字。处理长文档、大仓库代码时注意控制单次输入长度, 必要时拆分成多次请求,成本会低很多。

计费方式 ​

余额按实际用量扣减,规则如下:

  • 输入 token:你发送的内容
  • 输出 token:模型生成的内容(含思考过程)
  • 缓存读取:命中上游缓存的部分,单价更低

最终扣费 = 各项 token 数 × 对应单价。

你可以在「使用日志」页面查看每次请求的详细消耗。

模型选择建议 ​

场景推荐模型
日常对话、快速任务deepseek-flash、gpt-6-luna
代码编写与重构gpt-6.1-sol、claude-sonnet-5-5
复杂推理、长文档分析claude-opus-5-5、kimi-k3
大仓库、长上下文处理gpt-6.1-sol、gpt-6-astra
图片理解(多模态)qwen3.8-omni-flash、gemini-3.8-flash-high

模型名不要加后缀

直接使用表格里的完整名称,例如 claude-opus-5-5。 不要自行添加 -thinking、-high 之类的后缀,部分客户端会因此找不到模型。

有问题欢迎加入 QQ 群咨询