Como calculamos

Custo = volume de conversas × (tokens de entrada × preço de input + tokens de saída × preço de output), pelos preços de cada modelo e convertido pelo câmbio. A tabela compara os modelos lado a lado.

O que reduz a conta

Prompt caching, batching e usar um modelo menor para as tarefas simples cortam o custo em ordens de grandeza. Os preços são de referência (2026) e mudam com frequência.