按量付费,灵活透明
无月租,无强制套餐,用多少算多少
OpenRely 采用纯按量付费机制(Pay-as-you-go)。账户充值余额永久有效,按实际请求消耗的 Tokens 实时结算,并全面兼容 Prompt Caching 缓存特惠,让每一分算力都物尽其用。
开发者免费试用
适合开发者快速验证 API 网关流式连通性,注册即送测试金,支持邀请好友双向奖励。
- 新用户注册:免费送 $5 美元测试额度
- 好友邀请福利:邀请新用户注册使用,邀请者与受邀者各得 $5 美元额度
- 支持调用 GPT 与 DeepSeek 基础系列
- 支持最高 60 TPS 并发速率限制
- 开发者社区支持与在线集成文档
按量付费 (Pay-As-You-Go)
按实际消耗的 Token 扣费,无月租底噪,用量越大自动享受更高阶梯折扣。
- 100% 兼容 OpenAI / Anthropic / Gemini SDK
- 全量聚合 DeepSeek、Claude、GPT、Gemini 等全部模型
- 毫秒级智能负载路由与故障自动秒切
- 500 TPS 并发上限与多 API Key 权限隔离
- 标准工单支持与技术专家交流群
企业专属定制
专属多节点网关集群托管,提供 SLA 99.99% 保证与 7×24 专职架构师支持。
- 定制专属独立网关节点与就近边缘加速
- SLA 99.99% 高可用稳定性生产保障
- 支持私有化模型集成与专属上游通道挂载
- 不设上限的专属高并发速率配额
- 7×24 专属解决方案架构师深度支持
0 月租门槛
无固定月租与最低消费门槛,随充随用,用多少扣多少,零闲置浪费。
毫秒级实时结算
每次请求结束即时审计 Tokens 消耗与扣费,账单明细精确到每笔请求。
余额永久有效
充值余额永久有效,不设失效期限,彻底告别月末清零与续费焦虑。
Prompt 缓存立省
全面支持主流模型 Prompt Caching 机制,长上下文重复提示最高省 90%。
前往控制台查看全量模型倍率
OpenRely 持续聚合全球 100+ 主流大模型(DeepSeek、Claude、GPT、Gemini 等)。因各厂商费率可能动态调整,平台所有开放模型的实时倍率、上下文窗口与运行状态,均集中在控制台「模型广场」公开透明展示。
前往查看完整模型价格表计费常见问题
关于按量扣除、余额有效期与充值规则的常见解答
Q按量付费是如何计算每次请求费用的?
费用严格按照每次请求实际消耗的 Prompt Tokens(输入)、Completion Tokens(输出)以及是否命中缓存(Prompt Cache)分别计算。计费公式为:消费金额 = (输入 Tokens × 输入单价 + 输出 Tokens × 输出单价) / 1,000,000。非流式与流式(Stream)请求扣费规则完全一致。
Q账户充值的余额会过期吗?
永久有效。充值的余额不会因为时间推移而失效或被清空,只要账户处于正常状态即可随时调用。
Q什么是 Prompt Caching(提示词缓存)特惠?
当您使用支持缓存的模型(如 Claude、DeepSeek 等)并在连续请求中包含较长的前缀上下文(如系统提示词或长文档)时,网关自动识别命中缓存,仅收取对应模型输入价格 10%~20% 的极低费率,大幅降低长对话调用成本。
Q如果账户余额耗尽,会发生什么?会产生欠费吗?
不会产生欠费。OpenRely 采用严格的预付费保护机制,当账户可用额度不足以完成单次请求时,网关会直接返回 402/403 明确的额度不足状态码,绝不会产生意外的超额扣费账单。