模型价格
输入
0.14
元/百万 tokens
输出
0.28
元/百万 tokens
缓存命中
支持缓存优惠
模型能力
模型体验深度思考Function Calling结构化输出Cache 缓存
输入类型
文本
输出类型
文本
模型限制
- 最大输入 Tokens
- 1M
- 最大输出 Tokens
- 128k
- 上下文窗口
- 1M
- 最大 TPM
- 2,000,000
- 最大 RPM
- 120
调用协议
/v1/chat/completions/v1/responses兼容 Anthropic 协议
按 token 计费
对话按实际用量扣费,先充值再调用。