Preços da API

Pague apenas pelos tokens que usar.

Escolha o modelo em cada requisição. Input, cache e output são calculados separadamente e debitados do seu saldo interno em dólar.

Input tokens

Tokens enviados no prompt que não foram atendidos pelo cache.

Cached input

Parte reutilizada do contexto, cobrada pela tarifa reduzida do modelo.

Output tokens

Tokens gerados pelo modelo na resposta da sua requisição.

Catálogo ao vivo

Modelos disponíveis

5 modelos publicados

Modelos disponíveispreço por 1 milhão de tokens
ModeloContextoZero Data RetentionTPS médioúltimos 7 diasInputpreço por 1 milhão de tokensCachepreço por 1 milhão de tokensOutputpreço por 1 milhão de tokens
deepseek-v4-flashdeepseek-v4-flash1.048.576 ctxSim56 tok/sUS$ 0,14US$ 0,006US$ 0,22
deepseek-v4-flash-0731deepseek-v4-flash-07311.048.576 ctxSim58 tok/sUS$ 0,14US$ 0,006US$ 0,22
Qwen 3.6 27bqwen3.6-27b262.144 ctxSim37 tok/sUS$ 0,15US$ 0,03US$ 1,50
glm-5.2glm-5.21.048.576 ctxSim55 tok/sUS$ 0,70US$ 0,15US$ 2,20
Kimi K3kimi-k31.048.576 ctxSim72 tok/sUS$ 2,50US$ 0,30US$ 9,00

TPS é a média ponderada observada nos últimos 7 dias e aparece após 10 respostas válidas. Zero Data Retention significa que prompts e respostas não são persistidos; telemetria técnica e dados de cobrança são mantidos.

Um saldo sempre em dólar.

Adicione saldo em USD pelo cartão e use até acabar. A carteira é controlada internamente e o consumo só é debitado depois de uma resposta bem-sucedida.

Adicionar saldo