Texto e documentos
Números e cálculo
Dados e formatos
Segurança
Desenvolvimento e DevOps
Inteligência Artificial
Finanças
Saúde & Bem-estar
Produtividade
Jogos & Entretenimento
Multimédia e design
Empresa
Guia de utilização
Parâmetros de utilização

Calcula o custo mensal de usar LLMs a partir dos pedidos por mês e da média de tokens de entrada e saída por pedido. Útil para orçamentar o uso de APIs de IA.

Filtros e pesquisa

Filtra a tabela por fornecedor e por tipo de modelo (raciocínio, flagship, equilibrado, económico), ou pesquisa um modelo pelo nome. Ativa Incluir obsoletos para veres também modelos já retirados.

Ordenar e comparar

Clica nos cabeçalhos das colunas para ordenar por preço de entrada, de saída, contexto ou custo total mensal, e comparar modelos de relance.

Preços e dados

Os preços são indicativos e são atualizados regularmente; a data da última atualização aparece por baixo da tabela. Os tokens de entrada incluem todo o histórico da conversa enviado em cada pedido, por isso o custo real cresce com conversas longas.

Custos LLMSimula o gasto mensal
Custos LLMSimulador de gasto mensal por modelo de IA

A entrada processa-se em paralelo —fase de prefill—, por isso o seu custo é sobretudo de computação. A saída gera-se um token de cada vez —fase de decode—, limitada por quanta memória é preciso mover para cada um: por isso escala pior, e por isso o preço de tabela põe sempre a saída mais cara. Daqui saem os três controlos abaixo: um acerto de cache reutiliza um prefill já feito (por isso custa ~10%), e os tokens de raciocínio são decode puro — são faturados como saída porque, tecnicamente, é exatamente o que são.