💎 Custo-Benefício

Melhor Custo-Benefício em IARanking Score AA ÷ Preço 2026

Qual modelo de IA entrega mais inteligência por dólar gasto? Ranking calculado por AA Intelligence Index ÷ preço/1M tokens — modelos com alta qualidade e baixo custo de API ficam no topo. 30 modelos ranqueados.

Fórmula: (AA Intelligence Index × 10) ÷ preço_input/1M tokens. Fonte: Artificial Analysis, atualizado a cada 6h.

Top 5 — Melhor Custo-Benefício

Ranking Completo

30 modelos com AA Intelligence Index e preço disponíveis.

#ModeloEmpresaScore AA$/1M in$/1M outtok/sScore C/B
1Agnes 3.0 FlashSapiens AI35.5$$0.05$$0.15317
7,100
2Gemma 4 E4B (Reasoning)GoogleGoogle8.9$$0.02$$0.1049
4,450
3Qwen3.5 4B (Reasoning)AlibabaAlibaba13.1$$0.03$$0.1526
4,367
4Gemma 4 E4B (Non-reasoning)GoogleGoogle7.5$$0.02$$0.1044
3,750
5GPT-6 Luna (max)OpenAIOpenAI37.3$$0.10$$0.50134
3,730
6Qwen3.5 4B (Non-reasoning)AlibabaAlibaba10.8$$0.03$$0.1524
3,600
7Ling 3.0 FlashInclusionAI24.9$$0.07$$0.22351
3,557
8Agnes 2.5 Pro BetaSapiens AI35.2$$0.10$$0.30168
3,520
9Ling-3.0-flash-VLInclusionAI24.6$$0.07$$0.22146
3,514
10Llama 3.1 8B InstructMetaMeta6.9$$0.02$$0.05138
3,450
11GPT-6 Luna (xhigh)OpenAIOpenAI33.9$$0.10$$0.50128
3,390
12Ling-3.0-flash-FinInclusionAI22.6$$0.07$$0.22159
3,229
13GPT-6 Luna (high)OpenAIOpenAI32.1$$0.10$$0.50135
3,210
14Granite 4.2 3BIBM9.1$$0.03$$0.12220
3,033
15GPT-6 Luna (medium)OpenAIOpenAI29.5$$0.10$$0.50143
2,950
16HyperNova 60B 2605Multiverse Computing11.7$$0.04$$0.14355
2,925
17Hy3-preview (Non-reasoning)Tencent17.0$$0.06$$0.2178
2,833
18GLM-5.3-FlashZ AI41.8$$0.15$$0.5043
2,787
19Qwen3.8-Flash-NextAlibabaAlibaba39.8$$0.15$$0.4753
2,653
20GPT-5 NanoOpenAIOpenAI13.0$$0.05$$0.40149
2,600
21GPT-5 nano (medium)OpenAIOpenAI12.5$$0.05$$0.40143
2,500
22Sarvam 105B (high)Sarvam8.8$$0.04$$0.17—
2,200
23Sarvam 30BSarvam6.6$$0.03$$0.11—
2,200
24Z.ai: GLM 4.7 FlashZ.aiZ.ai14.9$$0.07$$0.4071
2,129
25GPT-6 Luna (low)OpenAIOpenAI20.9$$0.10$$0.50124
2,090
26MiMo-V2-Flash (Reasoning)Xiaomi20.8$$0.10$$0.30—
2,080
27DeepSeek V4 Flash (Reasoning, High Effort)DeepSeekDeepSeek26.0$$0.13$$0.28—
2,000
28GPT-5.6 Luna (max)OpenAIOpenAI37.3$$0.20$$1.20126
1,865
29DeepSeek V4 Flash 0420 (Non-reasoning)DeepSeekDeepSeek24.2$$0.13$$0.28—
1,862
30Granite 4.2 8BIBM11.1$$0.06$$0.2582
1,850

Score C/B = (AA Intelligence Index × 10) ÷ preço_input/1M. Maior = melhor custo-benefício.Ver metodologia →

Como Interpretar o Ranking de Custo-Benefício

O ranking de custo-benefício não é um substituto para o ranking de qualidade absoluta. Um modelo no topo desta lista não é necessariamente “melhor” — é o que entrega mais qualidade relativa ao seu custo. Para projetos onde a qualidade máxima é crítica (diagnóstico médico, análise jurídica, código de produção), use oranking por inteligência absoluta.

Quando Custo-Benefício É o Critério Principal

Custo-benefício deve ser o critério dominante quando: (1) volume de tokens é alto (chatbots de WhatsApp com centenas de mensagens/dia); (2) a tarefa tem critérios de qualidade definidos e mensuráveis (respostas corretas em FAQs, extração de dados estruturados); (3) você tem múltiplos modelos passando no critério de qualidade mínimo. Nesses casos, o modelo mais barato que passa é a escolha correta — pagar a mais não adiciona valor.

O Custo Real: Além do Preço por Token

O preço por token é só parte do custo total. Inclua também: (1) custo de latência — modelos mais baratos tendem a ser mais lentos, impactando a experiência em tempo real; (2) custo de prompt engineering — modelos com menos capacidade requerem prompts mais elaborados; (3) custo de erros — um modelo barato que erra 10% mais pode custar mais em revisão humana; (4) custo de integração — APIs com menor documentação aumentam o custo de desenvolvimento.

Perguntas Frequentes

Como é calculado o custo-benefício?

(AA Intelligence Index × 10) ÷ preço_input/1M tokens. O Intelligence Index mede raciocínio + código + contexto de 0 a 100 (Artificial Analysis, atualizado a cada 6h); multiplicar por 10 escala a métrica; dividir pelo preço normaliza por custo. Maior score = mais inteligência por dólar.

Qual o modelo mais barato com boa qualidade?

Agnes 3.0 Flash lidera em 2026 com Score AA 35.5 por $0.05/1M tokens. Modelos com alto AA Intelligence Index e baixo preço ficam no topo desta lista.

Vale pagar mais por um modelo mais caro?

Depende da tarefa. Para volume alto e tarefas simples, modelos baratos entregam 80% da qualidade por 10% do custo. Para análise complexa, o ganho de qualidade pode justificar o preço maior.