模型 | 模型 ID | 条件 | 未命中缓存输入的抵扣系数 | 输出的抵扣系数 | 命中缓存输入的抵扣系数 |
Auto 模型 | auto | - | 82 | 237 | 7 |
GLM-5.3-Flash | glm-5.3-flash | - | 23.438 | 78.125 | 4.688 |
GLM-5.2 | glm-5.2 glm-5-2 | - | 154 | 482 | 29 |
Kimi K3 | kimi-k3 | - | 468.75 | 2343.75 | 46.875 |
Kimi-K2.6 | kimi-k2.6 kimi-k-2-6 | - | 115 | 474 | 20 |
DeepSeek-V4.1-Flash 原厂直供 | deepseek/deepseek-flash | 空闲时段 | 21.429 | 85.714 | 0.429 |
| | 高峰时段 | 42.857 | 171.429 | 0.857 |
DeepSeek-V4-Pro 0813 正式版 原厂直供 | deepseek-v4-pro-202606 deepseek/deepseek-v4-pro-0813 deepseek/deepseek-v4-pro | 空闲时段 | 94.286 | 282.857 | 3.143 |
| | 高峰时段 | 188.571 | 565.714 | 6.286 |
DeepSeek-V4-Flash 0731 正式版 原厂直供 | deepseek-v4-flash-202605 deepseek/deepseek-v4-flash-0731 deepseek/deepseek-v4-flash | 空闲时段 | 21.429 | 85.714 | 0.429 |
| | 高峰时段 | 42.857 | 171.429 | 0.857 |
MiniMax-M3 | minimax-m3 | 输入长度(tokens) ≤ 512k | 47 | 188 | 10 |
| | 输入长度(tokens) > 512k | 94 | 375 | 19 |
模型 | Model ID | 输入长度 (tokens) | 输入的抵扣系数 | 输出的抵扣系数 | 缓存命中的抵扣系数 |
Kimi K3 | kimi-k3 | / | 445.313 | 2226.563 | 44.531 |
单次请求的积分消耗= (命中缓存输入的 Token 数 × 命中缓存输入的抵扣系数 +未命中缓存输入的 Token 数 × 未命中缓存输入的抵扣系数 +输出的 Token 数 × 输出的积分系数)/1,000,000= (50000 × 20 + 10000 × 115 + 500 × 474) / 1000000= 2.387
文档反馈