Guia
Modelos com reasoning
Ajuste o esforço de raciocínio somente quando a capability estiver disponível.
Consulte esforços aceitos
GET /models retorna reasoning.effort_levels e reasoning.default_effort para modelos compatíveis. A ausência de reasoning significa que o parâmetro não deve ser enviado.
Defina reasoning_effort
cURL
curl https://code.verboo.ai/router/v1/chat/completions \
-H "Authorization: Bearer $VERBOO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "<MODEL_ID>",
"reasoning_effort": "medium",
"messages": [{"role": "user", "content": "Explain why low latency matters for developer tools."}]
}'| Esforço | Quando usar |
|---|---|
| low | Tarefas simples e sensíveis a latência. |
| medium | Equilíbrio para programação e análise. |
| high | Problemas complexos quando qualidade é prioridade. |
Trade-offs
Meça no seu workload
Mais esforço pode aumentar latência e consumo sem melhorar toda tarefa. Compare qualidade, tempo e custo com entradas reais.