模型价格
输入
按量计费
输出
按量计费
缓存命中
支持缓存优惠
模型能力
模型体验深度思考Function Calling结构化输出Cache 缓存
输入类型
文本
输出类型
文本
模型限制
- 最大输入 Tokens
- 1M
- 最大输出 Tokens
- 128k
- 上下文窗口
- 1M
- 最大 TPM
- 1,000,000
- 最大 RPM
- 60
调用协议
/v1/chat/completions/v1/responses
按 token 计费
对话按实际用量扣费,先充值再调用。
输入
按量计费
输出
按量计费
缓存命中
支持缓存优惠
输入类型
输出类型
按 token 计费
对话按实际用量扣费,先充值再调用。