Input tokens
Tokens enviados no prompt que não foram atendidos pelo cache.
Escolha o modelo em cada requisição. Input, cache e output são calculados separadamente e debitados do seu saldo interno em dólar.
Tokens enviados no prompt que não foram atendidos pelo cache.
Parte reutilizada do contexto, cobrada pela tarifa reduzida do modelo.
Tokens gerados pelo modelo na resposta da sua requisição.
Catálogo ao vivo
5 modelos publicados
| Modelo | Contexto | Zero Data Retention | TPS médioúltimos 7 dias | Inputpreço por 1 milhão de tokens | Cachepreço por 1 milhão de tokens | Outputpreço por 1 milhão de tokens |
|---|---|---|---|---|---|---|
deepseek-v4-flashdeepseek-v4-flash | 1.048.576 ctx | Sim | 56 tok/s | US$ 0,14 | US$ 0,006 | US$ 0,22 |
deepseek-v4-flash-0731deepseek-v4-flash-0731 | 1.048.576 ctx | Sim | 58 tok/s | US$ 0,14 | US$ 0,006 | US$ 0,22 |
Qwen 3.6 27bqwen3.6-27b | 262.144 ctx | Sim | 37 tok/s | US$ 0,15 | US$ 0,03 | US$ 1,50 |
glm-5.2glm-5.2 | 1.048.576 ctx | Sim | 55 tok/s | US$ 0,70 | US$ 0,15 | US$ 2,20 |
Kimi K3kimi-k3 | 1.048.576 ctx | Sim | 72 tok/s | US$ 2,50 | US$ 0,30 | US$ 9,00 |
TPS é a média ponderada observada nos últimos 7 dias e aparece após 10 respostas válidas. Zero Data Retention significa que prompts e respostas não são persistidos; telemetria técnica e dados de cobrança são mantidos.
Adicione saldo em USD pelo cartão e use até acabar. A carteira é controlada internamente e o consumo só é debitado depois de uma resposta bem-sucedida.