跳转至

模型与价格

本页价格为 RouteFast 公开模型广场在 2026-09-07 的标准时段快照,币种为美元,单位为 每 100 万 Token(USD/MTok)。下表由对应分组的渠道单价换算,并计入快照中的公开分组倍率 0.5;不是“官方价格统一五折”的保证。

控制台实时价格、你的用户专属倍率与最终账单具有更高优先级。模型、费率和上游可用性可能调整,不要把本页数字用于不可变的程序逻辑或长期报价。

公开查询:RouteFast 模型广场

GPT 模型

模型 ID 输入 缓存写入 缓存读取 输出 建议用途
gpt-6-astra $5.00 $6.25 $0.50 $25.00 已列入公开目录,接入前核对密钥权限与客户端版本
gpt-5.6-sol $2.50 $3.125 $0.25 $15.00 复杂专业工作、困难编码任务
gpt-5.6-sol-pro $2.00 $2.50 $0.20 $10.00 RouteFast Pro 路由,按实际任务验证
gpt-5.6-terra $1.00 $1.25 $0.10 $6.00 能力、速度和成本的默认平衡点
gpt-5.6-terra-pro $2.00 $2.50 $0.20 $10.00 RouteFast Pro 路由,按实际任务验证
gpt-5.6-luna $0.10 $0.125 $0.01 $0.60 高频、成本敏感、轻量任务
gpt-5.6-luna-pro $2.00 $2.50 $0.20 $10.00 RouteFast Pro 路由,按实际任务验证
gpt-5.5 $2.50 $0.25 $15.00 既有复杂工作流兼容
gpt-5.4-mini $0.375 $0.0375 $2.25 轻量编码与子任务
gpt-5.3-codex-spark $0.875 $0.0875 $7.00 面向 Codex 的快速编码任务

*-pro 是 RouteFast 模型广场公开的路由名,不是 ChatGPT Pro 订阅。请求中的模型名、网关转发模型与计费模型可能因分组映射而不同;具体映射未在本页披露,请在接入前向支持确认。不要仅凭名称推断官方产品关系、SLA 或能力差异。

本指南的 GPT 入门示例使用 gpt-5.6-terra。先确认密钥权限,用少量自己的任务比较质量、延迟和费用,再确定常用模型;用途描述不是平台性能测试结果。

Claude 模型

模型 ID 输入 5 分钟缓存写入 缓存读取 输出 建议用途
claude-fable-5 $5.00 $6.25 $0.50 $25.00 已列入公开目录,接入前核对密钥权限与客户端版本
claude-fable-5-1 $5.00 $6.25 $0.125 $25.00 已列入公开目录,接入前核对密钥权限与客户端版本
claude-opus-5 $2.50 $3.125 $0.25 $12.50 最复杂的智能体、长任务和深度编码
claude-opus-4-8 $2.50 $3.125 $0.25 $12.50 旧版 Opus 工作流兼容
claude-sonnet-5 $1.00 $1.25 $0.10 $5.00 Claude Code 默认选择,速度与能力均衡
claude-sonnet-4-6 $1.50 $1.875 $0.15 $7.50 旧版 Sonnet 工作流兼容
claude-haiku-4-5 $0.50 $0.625 $0.05 $2.50 快速、轻量、低成本任务

本指南的 Claude 入门示例使用 claude-sonnet-5。升级模型前先确认客户端版本、密钥权限及工作流兼容性,不要仅按名称或价格推断所有任务效果。

模型列在目录中不等于所有高级功能都已通过验证。缓存 TTL、长上下文和客户端最低版本需分别确认;Claude Code 版本要求见 接入教程。表中 表示快照未提供该价格,不等于免费。本指南只覆盖 GPT 与 Claude;其他公开分组不自动纳入本页支持范围。

费用计算示例

一次 GPT 请求消耗:

  • 未缓存输入 20,000 Token;
  • 缓存读取 80,000 Token;
  • 输出 5,000 Token;
  • 模型为 gpt-5.6-terra

按快照价格计算:

本例没有缓存写入,总输入为 100,000 Token(普通输入 20,000 + 缓存读取 80,000)。以下是演算示例,不是实际用户账单。

输入费用 = 20,000 / 1,000,000 × $1.00 = $0.020
缓存费用 = 80,000 / 1,000,000 × $0.10 = $0.008
输出费用 = 5,000 / 1,000,000 × $6.00 = $0.030
总费用   = $0.058

实际账单还可能受用户专属倍率、分时倍率、模型映射、长上下文规则及上游返回用量影响。

如何取得实时模型与倍率

列出密钥实际可用模型:

curl -sS https://api.routefast.ai/v1/models \
  -H "Authorization: Bearer $ROUTEFAST_API_KEY"

查看密钥当前生效倍率:

curl -sS https://api.routefast.ai/v1/sub2api/billing \
  -H "Authorization: Bearer $ROUTEFAST_API_KEY"

参考资料