API de IA Mais BarataPreços em Reais 2026

Quanto custa usar a API do ChatGPT, Claude, Gemini e outros LLMs para empresas e desenvolvedores brasileiros? Compare o preço por milhão de tokens convertido para BRL — sem surpresas na fatura.

US$ 1 = R$ 5.70 • IOF zerado para PF desde jan/2024 • Última atualização: 18 de agosto de 2026 694 APIs listadas

694

APIs listadas

193

Com plano grátis

$0.019

Mais barata (input/1M)

$150.00

Mais cara (input/1M)

Como ler a tabela: preços são por milhão de tokens (input = o que você envia; output = a resposta do modelo). Em português, 1.000 tokens ≈ 750 palavras ≈ 1 página A4. O valor em BRL usa câmbio R$ 5.70/USD — substitua pelo câmbio do seu banco para estimativas precisas. Preços verificados nas páginas oficiais de precificação de cada empresa.

Preços por Milhão de Tokens — APIs com Custo

#ModeloInput USD/1MInput R$/1M
1Mistral: Mistral Nemo$0.019R$ 0.108
2Gemma 4 E4B (Non-reasoning)$0.020R$ 0.114
3Gemma 4 E4B (Reasoning)$0.020R$ 0.114
4Llama 3.1 8B Instruct$0.020R$ 0.114
5OpenAI: GPT-5 Nano (batch)$0.025R$ 0.143
6Qwen3.5 4B (Non-reasoning)$0.030R$ 0.171
7Qwen3.5 4B (Reasoning)$0.030R$ 0.171
8Granite 3.3 8B (Non-reasoning)$0.030R$ 0.171
9Sarvam 30B$0.030R$ 0.171
10Qwen: Qwen2.5 7B Instruct$0.040R$ 0.228
11Amazon: Nova Micro 1.0$0.040R$ 0.228
12Llama 3 8B Instruct$0.040R$ 0.228
13HyperNova 60B 2605$0.040R$ 0.228
14NVIDIA Nemotron Nano 9B V2 (Reasoning)$0.040R$ 0.228
15Sao10K: Llama 3 8B Lunaris$0.040R$ 0.228
16Sarvam 105B (high)$0.040R$ 0.228
17Arcee AI: Trinity Mini$0.045R$ 0.257
18Qwen: Qwen-Turbo$0.050R$ 0.285
19Google: Gemini 2.5 Flash Lite (batch)$0.050R$ 0.285
20Granite 4.1 8B$0.050R$ 0.285
21Llama 2 Chat 7B$0.050R$ 0.285
22NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)$0.050R$ 0.285
23NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)$0.050R$ 0.285
24NVIDIA Nemotron Nano 9B V2 (Non-reasoning)$0.050R$ 0.285
25NVIDIA: Nemotron 3 Nano 30B A3B$0.050R$ 0.285
26NVIDIA: Nemotron Nano 9B V2$0.050R$ 0.285
27Nemotron 3.5 Lightning$0.050R$ 0.285
28GPT-5 Nano$0.050R$ 0.285
29GPT-5 nano (minimal)$0.050R$ 0.285
30OpenAI: GPT-4.1 Nano (batch)$0.050R$ 0.285
31Amazon: Nova Lite 1.0$0.060R$ 0.342
32Gemma 3n 4B$0.060R$ 0.342
33Gemma 3n E4B Instruct$0.060R$ 0.342
34Granite 4.0 H Small$0.060R$ 0.342
35MythoMax 13B$0.060R$ 0.342
36gpt-oss-20b$0.060R$ 0.342
37Hy3-preview (Non-reasoning)$0.060R$ 0.342
38Hy3-preview (Reasoning)$0.060R$ 0.342
39Ling-3.0-flash$0.070R$ 0.399
40Baidu: ERNIE 4.5 21B A3B Thinking$0.070R$ 0.399
41Nemotron 3 Nano Omni 30B A3B Reasoning$0.070R$ 0.399
42GLM-4.7-Flash (Reasoning)$0.070R$ 0.399
43ByteDance Seed: Seed 1.6 Flash$0.075R$ 0.427
44Gemini 2.0 Flash Lite$0.075R$ 0.427
45gpt-oss-safeguard-20b$0.075R$ 0.427
46OpenAI: GPT-4o-mini (batch)$0.075R$ 0.427
47Qwen: Qwen3 30B A3B Thinking 2507$0.080R$ 0.456
48DeepSeek: DeepSeek V4 Flash 0423$0.083R$ 0.471
49Tongyi DeepResearch 30B A3B$0.090R$ 0.513
50Qwen3.5 Omni Flash$0.100R$ 0.570
51Olmo 3 7B Instruct$0.100R$ 0.570
52ByteDance: UI-TARS 7B $0.100R$ 0.570
53Gemini 2.5 Flash Lite$0.100R$ 0.570
54Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)$0.100R$ 0.570
55Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)$0.100R$ 0.570
56Gemma 4 12B (Reasoning)$0.100R$ 0.570
57Ling 2.6 Flash$0.100R$ 0.570
58Ministral 3 3B$0.100R$ 0.570
59Mistral Small 3$0.100R$ 0.570
60Mistral Small 3.1$0.100R$ 0.570
61Mistral Small 3.2$0.100R$ 0.570
62Mistral: Voxtral Small 24B 2507$0.100R$ 0.570
63GPT-4.1 Nano$0.100R$ 0.570
64OpenAI: GPT-5.4 Nano (batch)$0.100R$ 0.570
65OpenAI: GPT-5.6 Luna (batch)$0.100R$ 0.570
66OpenAI: GPT-5.6 Luna Pro$0.100R$ 0.570
67OpenAI: GPT-5.6 Luna Pro (batch)$0.100R$ 0.570
68Reka Edge$0.100R$ 0.570
69Step 3.5 Flash$0.100R$ 0.570
70Apertus 8B Instruct$0.100R$ 0.570
71MiMo-V2-Flash (Reasoning)$0.100R$ 0.570
72Z.ai: GLM 4 32B $0.100R$ 0.570
73Google: Gemini 3.1 Flash Lite (batch)$0.125R$ 0.713
74OpenAI: GPT-5 Mini (batch)$0.125R$ 0.713
75DeepSeek V4 Flash (Reasoning, Max Effort)$0.130R$ 0.741
76Gemma 4 26B A4B $0.130R$ 0.741
77Microsoft: Phi 4$0.130R$ 0.741
78Nous: Hermes 4 70B$0.130R$ 0.741
79Hermes 4 - Llama-3.1 70B (Non-reasoning)$0.130R$ 0.741
80Hermes 4 - Llama-3.1 70B (Reasoning)$0.130R$ 0.741
81Nex AGI: DeepSeek V3.1 Nex N1$0.135R$ 0.770
82Qwen3.5 9B (Reasoning)$0.140R$ 0.798
83Baidu: ERNIE 4.5 VL 28B A3B$0.140R$ 0.798
84DeepSeek V4 Flash (Reasoning, High Effort)$0.140R$ 0.798
85DeepSeek-V4-Flash$0.140R$ 0.798
86Ling-flash-2.0$0.140R$ 0.798
87Ring-flash-2.0$0.140R$ 0.798
88NousResearch: Hermes 2 Pro - Llama-3 8B$0.140R$ 0.798
89Tencent: Hunyuan A13B Instruct$0.140R$ 0.798
90MiMo-V2.5$0.140R$ 0.798
91Qwen: Qwen3 235B A22B Thinking 2507$0.149R$ 0.852
92EssentialAI: Rnj 1 Instruct$0.150R$ 0.855
93Google: Gemini 2.5 Flash (batch)$0.150R$ 0.855
94Google: Gemini 3.5 Flash Lite (batch)$0.150R$ 0.855
95Ministral 3 8B$0.150R$ 0.855
96Mistral Small (Feb '24)$0.150R$ 0.855
97Mistral: Mistral Small 4$0.150R$ 0.855
98GPT-4o-mini (2024-07-18)$0.150R$ 0.855
99GPT-4o-mini Search Preview$0.150R$ 0.855
100gpt-oss-120b$0.150R$ 0.855
101OpenAI: GPT-4o-mini$0.150R$ 0.855
102Solar Mini$0.150R$ 0.855
103Solar Pro 3$0.150R$ 0.855
104TheDrummer: Rocinante 12B$0.170R$ 0.969
105GLM-4.5-Air$0.170R$ 0.969
106Qwen: Qwen3 VL 8B Instruct$0.180R$ 1.03
107Qwen3 8B (Non-reasoning)$0.180R$ 1.03
108Qwen3 8B (Reasoning)$0.180R$ 1.03
109Qwen3 VL 8B (Reasoning)$0.180R$ 1.03
110Arcee AI: Spotlight$0.180R$ 1.03
111Llama 4 Scout$0.180R$ 1.03
112Llama Guard 4 12B$0.180R$ 1.03
113Google: Gemini 3.7 Flash (batch)$0.188R$ 1.07
114Jamba 1.5 Mini$0.200R$ 1.14
115Jamba 1.6 Mini$0.200R$ 1.14
116Qwen: Qwen3 30B A3B Instruct 2507$0.200R$ 1.14
117Qwen: Qwen3 VL 30B A3B Instruct$0.200R$ 1.14
118Qwen3 30B A3B (Reasoning)$0.200R$ 1.14
119Qwen3 30B A3B 2507 (Reasoning)$0.200R$ 1.14
120Qwen3 30B A3B 2507 Instruct$0.200R$ 1.14
121Qwen3 VL 30B A3B (Reasoning)$0.200R$ 1.14
122MiniMax: MiniMax-01$0.200R$ 1.14
123Ministral 3 14B$0.200R$ 1.14
124Mistral Small (Sep '24)$0.200R$ 1.14
125Mistral: Saba$0.200R$ 1.14
126NVIDIA Nemotron 3 Super 120B A12B (Reasoning)$0.200R$ 1.14
127NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)$0.200R$ 1.14
128NVIDIA Nemotron Nano 12B v2 VL (Reasoning)$0.200R$ 1.14
129GPT-5.4 Nano$0.200R$ 1.14
130GPT-5.6 Luna (high)$0.200R$ 1.14
131GPT-5.6 Luna (low)$0.200R$ 1.14
132GPT-5.6 Luna (max)$0.200R$ 1.14
133GPT-5.6 Luna (medium)$0.200R$ 1.14
134GPT-5.6 Luna (Non-reasoning)$0.200R$ 1.14
135GPT-5.6 Luna (xhigh)$0.200R$ 1.14
136OpenAI: GPT-4.1 Mini (batch)$0.200R$ 1.14
137Reka Flash 3$0.200R$ 1.14
138Step 3.7 Flash$0.200R$ 1.14
139Celeris-1$0.200R$ 1.14
140Grok 4 Fast$0.200R$ 1.14
141Seed-OSS-36B-Instruct$0.210R$ 1.20
142Arcee AI: Trinity Large Thinking$0.230R$ 1.31
143Qwen: Qwen2.5 VL 72B Instruct$0.250R$ 1.43
144Qwen: Qwen3.5-35B-A3B$0.250R$ 1.43
145Qwen3 Omni 30B A3B (Reasoning)$0.250R$ 1.43
146Qwen3 Omni 30B A3B Instruct$0.250R$ 1.43
147Anthropic: Claude 3 Haiku$0.250R$ 1.43
148ByteDance Seed: Seed-2.0-Lite$0.250R$ 1.43
149Gemini 3.1 Flash Lite$0.250R$ 1.43
150Gemini 3.1 Flash Lite Preview$0.250R$ 1.43
151Google: Gemini 3 Flash Preview (batch)$0.250R$ 1.43
152Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)$0.250R$ 1.43
153Inception: Mercury 2$0.250R$ 1.43
154Mistral 7B Instruct$0.250R$ 1.43
155GPT-5 Mini$0.250R$ 1.43
156GPT-5 mini (minimal)$0.250R$ 1.43
157GPT-5.1-Codex-Mini$0.250R$ 1.43
158OpenAI: GPT-3.5 Turbo (batch)$0.250R$ 1.43
159DeepSeek V3 0324$0.270R$ 1.54
160DeepSeek V3.1 Terminus$0.270R$ 1.54
161DeepSeek V3.2 Exp$0.270R$ 1.54
162Llama 4 Maverick$0.270R$ 1.54
163Baidu: ERNIE 4.5 300B A47B $0.280R$ 1.60
164DeepSeek V3.2$0.280R$ 1.60
165DeepSeek V3.2 Exp (Non-reasoning)$0.280R$ 1.60
166DeepSeek V3.2 Exp (Reasoning)$0.280R$ 1.60
167Qwen: Qwen3.5-27B$0.300R$ 1.71
168Amazon: Nova 2 Lite$0.300R$ 1.71
169Nova 2.0 Lite (high)$0.300R$ 1.71
170Nova 2.0 Omni (low)$0.300R$ 1.71
171Nova 2.0 Omni (medium)$0.300R$ 1.71
172Nova 2.0 Omni (Non-reasoning)$0.300R$ 1.71
173Gemini 2.5 Flash$0.300R$ 1.71
174Gemini 2.5 Flash Preview (Reasoning)$0.300R$ 1.71
175Gemini 3.5 Flash-Lite$0.300R$ 1.71
176Nano Banana (Gemini 2.5 Flash Image)$0.300R$ 1.71
177Ling-2.6-1T$0.300R$ 1.71
178Ring-2.6-1T$0.300R$ 1.71
179Kwaipilot: KAT-Coder-Pro V2$0.300R$ 1.71
180MiniMax-M2$0.300R$ 1.71
181MiniMax-M3$0.300R$ 1.71
182MiniMax: MiniMax M2-her$0.300R$ 1.71
183MiniMax: MiniMax M2.1$0.300R$ 1.71
184MiniMax: MiniMax M2.5$0.300R$ 1.71
185MiniMax: MiniMax M2.7$0.300R$ 1.71
186Inkling-Small$0.300R$ 1.71
187Mistral: Codestral 2508$0.300R$ 1.71
188Nous: Hermes 3 70B Instruct$0.300R$ 1.71
189TheDrummer: Cydonia 24B V4.1$0.300R$ 1.71
190Inkling Small$0.300R$ 1.71
191Solar Pro 4$0.300R$ 1.71
192Grok 3 Mini$0.300R$ 1.71
193Grok 3 Mini Beta$0.300R$ 1.71
194GLM-4.6V (Reasoning)$0.300R$ 1.71
195Muse Glimmer (high)$0.320R$ 1.82
196Llama 3.2 11B Vision Instruct$0.340R$ 1.94
197Qwen: Qwen3 Coder Next$0.350R$ 1.99
198Qwen3 14B (Non-reasoning)$0.350R$ 1.99
199Qwen3 14B (Reasoning)$0.350R$ 1.99
200DeepSeek V3$0.360R$ 2.05
201Google: Gemini 3.6 Flash (batch)$0.375R$ 2.14
202OpenAI: GPT-5.4 Mini (batch)$0.375R$ 2.14
203Qwen: Qwen3.6 35B A3B$0.380R$ 2.17
204Qwen: Qwen3.5-122B-A10B$0.400R$ 2.28
205Qwen3.5 Omni Plus$0.400R$ 2.28
206Qwen3.7 Plus$0.400R$ 2.28
207MiniMax: MiniMax M1$0.400R$ 2.28
208Mistral: Mistral Medium 3$0.400R$ 2.28
209Mistral: Mistral Medium 3.1$0.400R$ 2.28
210Llama Nemotron Super 49B v1.5 (Non-reasoning)$0.400R$ 2.28
211Llama Nemotron Super 49B v1.5 (Reasoning)$0.400R$ 2.28
212GPT-4.1 Mini$0.400R$ 2.28
213TheDrummer: UnslopNemo 12B$0.400R$ 2.28
214Baidu: ERNIE 4.5 VL 424B A47B $0.420R$ 2.39
215DeepSeek V4 Pro (Non-reasoning)$0.430R$ 2.45
216DeepSeek V4 Pro (Reasoning, High Effort)$0.430R$ 2.45
217DeepSeek V4 Pro (Reasoning, Max Effort)$0.430R$ 2.45
218Xiaomi: MiMo-V2.5-Pro$0.430R$ 2.45
219DeepSeek V4 Flash$0.440R$ 2.51
220Qwen: Qwen3 Coder 30B A3B Instruct$0.450R$ 2.56
221Mistral: Mixtral 8x7B Instruct$0.450R$ 2.56
222ReMM SLERP 13B$0.450R$ 2.56
223Agnes 2.5 Pro Alpha$0.450R$ 2.56
224Qwen2.5 72B Instruct$0.470R$ 2.68
225Llama Guard 3 8B$0.480R$ 2.74
226Qwen: Qwen3 Next 80B A3B Instruct$0.500R$ 2.85
227Qwen: Qwen3.6 Plus$0.500R$ 2.85
228Qwen3 Next 80B A3B (Reasoning)$0.500R$ 2.85
229Anthropic: Claude Haiku 4.5 (batch)$0.500R$ 2.85
230Arcee AI: Coder Large$0.500R$ 2.85
231Command-R (Mar '24)$0.500R$ 2.85
232Gemini 3 Flash Preview (Non-reasoning)$0.500R$ 2.85
233Gemini 3 Flash Preview (Reasoning)$0.500R$ 2.85
234Google: Nano Banana 2 (Gemini 3.1 Flash Image)$0.500R$ 2.85
235Nano Banana 2 (Gemini 3.1 Flash Image Preview)$0.500R$ 2.85
236Magistral Small 1.2$0.500R$ 2.85
237Mistral Large 3$0.500R$ 2.85
238Nex-N2-Pro$0.500R$ 2.85
239GPT-3.5 Turbo$0.500R$ 2.85
240MiniMax M1 80k$0.550R$ 3.14
241OpenAI: o3 Mini (batch)$0.550R$ 3.14
242OpenAI: o3 Mini High (batch)$0.550R$ 3.14
243OpenAI: o4 Mini (batch)$0.550R$ 3.14
244OpenAI: o4 Mini High (batch)$0.550R$ 3.14
245TheDrummer: Skyfall 36B V2$0.550R$ 3.14
246DeepSeek V3.1$0.560R$ 3.19
247Llama 3.1 70B Instruct$0.560R$ 3.19
248Kimi K2$0.570R$ 3.25
249MoonshotAI: Kimi K2 0711$0.570R$ 3.25
250GLM-4.6 (Reasoning)$0.570R$ 3.25
251Qwen: Qwen3.5 397B A17B$0.600R$ 3.42
252Qwen: Qwen3.6 27B$0.600R$ 3.42
253Kimi K2 Thinking$0.600R$ 3.42
254MoonshotAI: Kimi K2 0905$0.600R$ 3.42
255MoonshotAI: Kimi K2.5$0.600R$ 3.42
256Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)$0.600R$ 3.42
257Nemotron 3 Ultra 550B A55B (Reasoning)$0.600R$ 3.42
258GPT Audio Mini$0.600R$ 3.42
259Writer: Palmyra X5$0.600R$ 3.42
260GLM-4.5V (Reasoning)$0.600R$ 3.42
261GLM-4.7 (Reasoning)$0.600R$ 3.42
262WizardLM-2 8x22B$0.620R$ 3.53
263Google: Gemini 2.5 Pro (batch)$0.625R$ 3.56
264OpenAI: GPT-5 (batch)$0.625R$ 3.56
265OpenAI: GPT-5 Codex (batch)$0.625R$ 3.56
266OpenAI: GPT-5.1 (batch)$0.625R$ 3.56
267Gemma 2 27B$0.650R$ 3.71
268Llama 3 70B Instruct$0.650R$ 3.71
269Sao10K: Llama 3.3 Euryale 70B$0.650R$ 3.71
270QwQ 32B$0.660R$ 3.76
271Llama 3.3 70B Instruct$0.660R$ 3.76
272Qwen: Qwen3 235B A22B Instruct 2507$0.700R$ 3.99
273Qwen: Qwen3 VL 235B A22B Instruct$0.700R$ 3.99
274Qwen: Qwen3 VL 32B Instruct$0.700R$ 3.99
275Qwen3 235B A22B (Reasoning)$0.700R$ 3.99
276Qwen3 32B (Non-reasoning)$0.700R$ 3.99
277Qwen3 32B (Reasoning)$0.700R$ 3.99
278Qwen3 VL 235B A22B (Reasoning)$0.700R$ 3.99
279Qwen3 VL 32B (Reasoning)$0.700R$ 3.99
280DeepSeek: R1$0.700R$ 3.99
281R1 Distill Llama 70B$0.700R$ 3.99
282Hermes 3 - Llama-3.1 70B$0.700R$ 3.99
283Arcee AI: Virtuoso Large$0.750R$ 4.28
284Gemini 3.7 Flash (high)$0.750R$ 4.28
285Gemini 3.7 Flash (low)$0.750R$ 4.28
286Gemini 3.7 Flash (medium)$0.750R$ 4.28
287Google: Gemini 3.5 Flash (batch)$0.750R$ 4.28
288LongCat 2.0$0.750R$ 4.28
289Mancer: Weaver (alpha)$0.750R$ 4.28
290GPT-5.4 Mini$0.750R$ 4.28
291Qwen: Qwen3 Max Thinking$0.780R$ 4.45
292AionLabs: Aion-2.0$0.800R$ 4.56
293AionLabs: Aion-RP 1.0 (8B)$0.800R$ 4.56
294AlfredPros: CodeLLaMa 7B Instruct Solidity$0.800R$ 4.56
295Amazon: Nova Pro 1.0$0.800R$ 4.56
296Morph: Morph V3 Fast$0.800R$ 4.56
297Apertus 70B Instruct$0.820R$ 4.67
298Relace: Relace Apply 3$0.850R$ 4.84
299Sao10K: Llama 3.1 Euryale 70B v2.2$0.850R$ 4.84
300OpenAI: GPT-5.2 (batch)$0.875R$ 4.99
301Arcee AI: Maestro Reasoning$0.900R$ 5.13
302Morph: Morph V3 Large$0.900R$ 5.13
303Kimi K2.7 Code$0.950R$ 5.42
304MoonshotAI: Kimi K2.6$0.950R$ 5.42
305Anthropic: Claude Sonnet 5 (batch)$1.00R$ 5.70
306Claude 4.5 Haiku (Reasoning)$1.00R$ 5.70
307Claude Haiku 4.5$1.00R$ 5.70
308Google: Gemini 3.1 Pro Preview (batch)$1.00R$ 5.70
309Nous: Hermes 3 405B Instruct$1.00R$ 5.70
310Nous: Hermes 4 405B$1.00R$ 5.70
311Hermes 4 - Llama-3.1 405B (Non-reasoning)$1.00R$ 5.70
312Hermes 4 - Llama-3.1 405B (Reasoning)$1.00R$ 5.70
313OpenAI: GPT-4.1 (batch)$1.00R$ 5.70
314OpenAI: GPT-5.6 Terra (batch)$1.00R$ 5.70
315OpenAI: GPT-5.6 Terra Pro$1.00R$ 5.70
316OpenAI: GPT-5.6 Terra Pro (batch)$1.00R$ 5.70
317OpenAI: o3 (batch)$1.00R$ 5.70
318Relace: Relace Search$1.00R$ 5.70
319Inkling$1.00R$ 5.70
320Inkling$1.00R$ 5.70
321Grok Build 0.1 0616$1.00R$ 5.70
322SpaceXAI: Grok Build 0.1$1.00R$ 5.70
323xAI: Grok Build 0.1$1.00R$ 5.70
324GLM-5 (Non-reasoning)$1.00R$ 5.70
325o3 Mini$1.10R$ 6.27
326o3 Mini High$1.10R$ 6.27
327o4 Mini$1.10R$ 6.27
328o4 Mini High$1.10R$ 6.27
329Qwen: Qwen3 Max$1.20R$ 6.84
330Qwen3 Max (Preview)$1.20R$ 6.84
331Qwen3 Max Thinking (Preview)$1.20R$ 6.84
332Llama 3.1 Nemotron 70B Instruct$1.20R$ 6.84
333Nova 2.0 Pro Preview (medium)$1.25R$ 7.13
334Cogito v2.1 (Reasoning)$1.25R$ 7.13
335Deep Cogito: Cogito v2.1 671B$1.25R$ 7.13
336Gemini 2.5 Pro$1.25R$ 7.13
337Gemini 2.5 Pro Preview (May' 25)$1.25R$ 7.13
338Gemini 2.5 Pro Preview 05-06$1.25R$ 7.13
339Muse Spark 1.1$1.25R$ 7.13
340Muse Spark 1.1 (xhigh)$1.25R$ 7.13
341Muse Spark 1.2 (xhigh)$1.25R$ 7.13
342GPT-5$1.25R$ 7.13
343GPT-5 (minimal)$1.25R$ 7.13
344GPT-5 Codex$1.25R$ 7.13
345GPT-5.1$1.25R$ 7.13
346GPT-5.1 Chat$1.25R$ 7.13
347GPT-5.1-Codex$1.25R$ 7.13
348GPT-5.1-Codex-Max$1.25R$ 7.13
349OpenAI: GPT-4o (batch)$1.25R$ 7.13
350OpenAI: GPT-5.4 (batch)$1.25R$ 7.13
351Grok 4.20 Multi-Agent$1.25R$ 7.13
352SpaceXAI: Grok 4.20$1.25R$ 7.13
353SpaceXAI: Grok 4.20 Multi-Agent$1.25R$ 7.13
354SpaceXAI: Grok 4.3$1.25R$ 7.13
355Qwen3.6 Max Preview$1.30R$ 7.41
356DeepSeek V4 Pro$1.32R$ 7.52
357DeepSeek: DeepSeek V4 Pro 0423$1.32R$ 7.52
358DeepSeek R1 (Jan '25)$1.35R$ 7.70
359GLM-5.1 (Non-reasoning)$1.38R$ 7.87
360GLM-5.2 (max)$1.40R$ 7.98
361Sao10k: Llama 3 Euryale 70B v2.1$1.48R$ 8.44
362Qwen3 Coder 480B A35B Instruct$1.50R$ 8.55
363Anthropic: Claude Sonnet 4.5 (batch)$1.50R$ 8.55
364Anthropic: Claude Sonnet 4.6 (batch)$1.50R$ 8.55
365Gemini 3.5 Flash$1.50R$ 8.55
366Gemini 3.5 Flash (minimal)$1.50R$ 8.55
367Gemini 3.6 Flash$1.50R$ 8.55
368Gemini 3.6 Flash (high)$1.50R$ 8.55
369Google: Gemini 3.5 Flash$1.50R$ 8.55
370Mistral Medium$1.50R$ 8.55
371Mistral: Mistral Medium 3.5$1.50R$ 8.55
372GPT-5.2$1.75R$ 9.97
373GPT-5.2-Codex$1.75R$ 9.97
374GPT-5.3 Chat$1.75R$ 9.97
375GPT-5.3-Codex$1.75R$ 9.97
376AI21: Jamba Large 1.7$2.00R$ 11.40
377Jamba 1.5 Large$2.00R$ 11.40
378Jamba 1.6 Large$2.00R$ 11.40
379Qwen: Qwen3.8 2.4T A95B$2.00R$ 11.40
380Qwen: Qwen3.8 Max$2.00R$ 11.40
381Claude Sonnet 5$2.00R$ 11.40
382Gemini 3 Pro Preview (high)$2.00R$ 11.40
383Gemini 3 Pro Preview (low)$2.00R$ 11.40
384Gemini 3.1 Pro Preview$2.00R$ 11.40
385Gemini 3.1 Pro Preview Custom Tools$2.00R$ 11.40
386Google: Nano Banana Pro (Gemini 3 Pro Image)$2.00R$ 11.40
387Nano Banana Pro (Gemini 3 Pro Image Preview)$2.00R$ 11.40
388Mistral Large 2 (Jul '24)$2.00R$ 11.40
389Magistral Medium 1.2$2.00R$ 11.40
390Mistral Large$2.00R$ 11.40
391Mistral: Mixtral 8x22B Instruct$2.00R$ 11.40
392GPT-4.1$2.00R$ 11.40
393GPT-5.6 Terra (high)$2.00R$ 11.40
394GPT-5.6 Terra (low)$2.00R$ 11.40
395GPT-5.6 Terra (max)$2.00R$ 11.40
396GPT-5.6 Terra (medium)$2.00R$ 11.40
397GPT-5.6 Terra (Non-reasoning)$2.00R$ 11.40
398GPT-5.6 Terra (xhigh)$2.00R$ 11.40
399o3$2.00R$ 11.40
400o4 Mini Deep Research$2.00R$ 11.40
401Perplexity: Sonar Deep Research$2.00R$ 11.40
402Grok 4.5$2.00R$ 11.40
403Grok 4.20 0309 (Reasoning)$2.00R$ 11.40
404SpaceXAI: Grok 4.5$2.00R$ 11.40
405SpaceXAI: Grok 4.6$2.00R$ 11.40
406Qwen3.7 Max$2.50R$ 14.25
407Nova Premier$2.50R$ 14.25
408Anthropic: Claude Opus 4.5 (batch)$2.50R$ 14.25
409Anthropic: Claude Opus 4.6 (batch)$2.50R$ 14.25
410Anthropic: Claude Opus 4.7 (batch)$2.50R$ 14.25
411Anthropic: Claude Opus 4.8 (batch)$2.50R$ 14.25
412Claude Opus 5 (batch)$2.50R$ 14.25
413Cohere: Command A$2.50R$ 14.25
414Cohere: Command R+ (08-2024)$2.50R$ 14.25
415Inflection: Inflection 3 Pi$2.50R$ 14.25
416Inflection: Inflection 3 Productivity$2.50R$ 14.25
417Llama 3.1 Instruct 405B$2.50R$ 14.25
418GPT Audio$2.50R$ 14.25
419GPT-4o (2024-08-06)$2.50R$ 14.25
420GPT-4o (2024-11-20)$2.50R$ 14.25
421GPT-4o Audio$2.50R$ 14.25
422GPT-4o Search Preview$2.50R$ 14.25
423GPT-5 Image Mini$2.50R$ 14.25
424GPT-5.4$2.50R$ 14.25
425OpenAI: GPT-4o$2.50R$ 14.25
426OpenAI: GPT-5.5 (batch)$2.50R$ 14.25
427OpenAI: GPT-5.6 Sol (batch)$2.50R$ 14.25
428OpenAI: GPT-5.6 Sol Pro (batch)$2.50R$ 14.25
429Claude 3 Sonnet$3.00R$ 17.10
430Claude 3.5 Sonnet (June '24)$3.00R$ 17.10
431Claude 3.5 Sonnet (Oct '24)$3.00R$ 17.10
432Claude 3.7 Sonnet$3.00R$ 17.10
433Claude 4 Sonnet (Reasoning)$3.00R$ 17.10
434Claude 4.5 Sonnet (Non-reasoning)$3.00R$ 17.10
435Claude 4.5 Sonnet (Reasoning)$3.00R$ 17.10
436Claude Sonnet 4$3.00R$ 17.10
437Claude Sonnet 4.5$3.00R$ 17.10
438Claude Sonnet 4.6$3.00R$ 17.10
439Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)$3.00R$ 17.10
440Claude Sonnet 4.6 (Non-reasoning, Low Effort)$3.00R$ 17.10
441Command-R+ (Apr '24)$3.00R$ 17.10
442Kimi K3$3.00R$ 17.10
443Magnum v4 72B$3.00R$ 17.10
444OpenAI: GPT-3.5 Turbo 16k$3.00R$ 17.10
445Perplexity: Sonar Pro Search$3.00R$ 17.10
446Sao10K: Llama 3.1 70B Hanami x1$3.00R$ 17.10
447Grok 3 Beta$3.00R$ 17.10
448Grok 4$3.00R$ 17.10
449Goliath 120B$3.75R$ 21.38
450AionLabs: Aion-1.0$4.00R$ 22.80
451Mistral Large 2 (Nov '24)$4.00R$ 22.80
452Grok 3$4.00R$ 22.80
453Anthropic: Claude Fable 5 (batch)$5.00R$ 28.50
454Claude Opus 4.5$5.00R$ 28.50
455Claude Opus 4.5 (Reasoning)$5.00R$ 28.50
456Claude Opus 4.6$5.00R$ 28.50
457Claude Opus 4.6 (Adaptive Reasoning, Max Effort)$5.00R$ 28.50
458Claude Opus 4.7$5.00R$ 28.50
459Claude Opus 4.8 (Adaptive Reasoning, Max Effort)$5.00R$ 28.50
460Claude Opus 5$5.00R$ 28.50
461GPT Chat Latest$5.00R$ 28.50
462GPT-5.5$5.00R$ 28.50
463GPT-5.5 Instant (June 2026)$5.00R$ 28.50
464GPT-5.5 Instant (May 2026)$5.00R$ 28.50
465GPT-5.6 Sol (high)$5.00R$ 28.50
466GPT-5.6 Sol (low)$5.00R$ 28.50
467GPT-5.6 Sol (max)$5.00R$ 28.50
468GPT-5.6 Sol (medium)$5.00R$ 28.50
469GPT-5.6 Sol (Non-reasoning)$5.00R$ 28.50
470GPT-5.6 Sol (xhigh)$5.00R$ 28.50
471OpenAI: GPT-4 Turbo (batch)$5.00R$ 28.50
472OpenAI: GPT-4o (2024-05-13)$5.00R$ 28.50
473OpenAI: GPT-5.6 Sol Pro$5.00R$ 28.50
474Anthropic: Claude Opus 4.1 (batch)$7.50R$ 42.75
475OpenAI: GPT-5 Pro (batch)$7.50R$ 42.75
476OpenAI: o1 (batch)$7.50R$ 42.75
477GPT-5.4 Image 2$8.00R$ 45.60
478Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)$10.00R$ 57.00
479Claude Opus 5 (Fast)$10.00R$ 57.00
480GPT-4 Turbo$10.00R$ 57.00
481GPT-5 Image$10.00R$ 57.00
482o3 Deep Research$10.00R$ 57.00
483OpenAI: GPT-4 Turbo (older v1106)$10.00R$ 57.00
484OpenAI: o3 Pro (batch)$10.00R$ 57.00
485OpenAI: GPT-5.2 Pro (batch)$10.50R$ 59.85
486Claude 3 Opus$15.00R$ 85.50
487Claude 4 Opus (Reasoning)$15.00R$ 85.50
488Claude 4.1 Opus (Non-reasoning)$15.00R$ 85.50
489Claude 4.1 Opus (Reasoning)$15.00R$ 85.50
490Claude Opus 4$15.00R$ 85.50
491Claude Opus 4.1$15.00R$ 85.50
492o1$15.00R$ 85.50
493OpenAI: GPT-5.4 Pro (batch)$15.00R$ 85.50
494OpenAI: GPT-5.5 Pro (batch)$15.00R$ 85.50
495o1-preview$16.50R$ 94.05
496o3 Pro$20.00R$ 114.00
497Claude Opus 4.7 (Fast)$30.00R$ 171.00
498GPT-5.4 Pro$30.00R$ 171.00
499OpenAI: GPT-4$30.00R$ 171.00
500OpenAI: o1-pro (batch)$75.00R$ 427.50
501o1-pro$150.00R$ 855.00

APIs com Plano Gratuito

Estes modelos oferecem acesso via API sem custo (com limites de rate). Ideais para protótipos e projetos de baixo volume.

Apriel-v1.5-15B-Thinker

ServiceNow

Grátis

Apriel-v1.6-15B-Thinker

ServiceNow

Grátis

Arctic Instruct

Snowflake

Grátis

Claude 2.0

Anthropic

Grátis

Claude 2.1

Anthropic

Grátis

Claude 3.5 Haiku

Anthropic

Grátis

Claude 3.7 Sonnet (thinking)

Anthropic

Grátis

Claude Instant

Anthropic

Grátis

Command A+

Cohere

Grátis

DBRX Instruct

Databricks

Grátis

DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)

Nous Research

Grátis

DeepHermes 3 - Mistral 24B Preview (Non-reasoning)

Nous Research

Grátis

DeepSeek Coder V2 Lite Instruct

DeepSeek

Grátis

DeepSeek LLM 67B Chat (V1)

DeepSeek

Grátis

DeepSeek R1 0528 Qwen3 8B

DeepSeek

Grátis

DeepSeek R1 Distill Llama 8B

DeepSeek

Grátis

DeepSeek R1 Distill Qwen 1.5B

DeepSeek

Grátis

DeepSeek R1 Distill Qwen 14B

DeepSeek

Grátis

DeepSeek V3.2 Speciale

DeepSeek

Grátis

DeepSeek-Coder-V2

DeepSeek

Grátis

DeepSeek-V2-Chat

DeepSeek

Grátis

DeepSeek-V2.5

DeepSeek

Grátis

DeepSeek-V2.5 (Dec '24)

DeepSeek

Grátis

DeepSeek: R1 Distill Qwen 32B

DeepSeek

Grátis

Devstral 2

Mistral

Grátis

Devstral Small (Jul '25)

Mistral

Grátis

Devstral Small (May '25)

Mistral

Grátis

Devstral Small 2

Mistral

Grátis

DiffusionGemma 26B A4B

Google

Grátis

Doubao Seed Code

ByteDance Seed

Grátis

ERNIE 5.0 Thinking Preview

Baidu

Grátis

Exaone 4.0 1.2B (Non-reasoning)

LG AI Research

Grátis

EXAONE 4.0 32B (Non-reasoning)

LG AI Research

Grátis

EXAONE 4.0 32B (Reasoning)

LG AI Research

Grátis

EXAONE 4.5 33B

LG AI

Grátis

Falcon-H1R-7B

TII UAE

Grátis

G9v3-39A5B

AI9Stars

Grátis

G9v3-3B

AI9Stars

Grátis

Gemini 1.0 Pro

Google

Grátis

Gemini 1.0 Ultra

Google

Grátis

Gemini 1.5 Flash (May '24)

Google

Grátis

Gemini 1.5 Flash (Sep '24)

Google

Grátis

Gemini 1.5 Flash-8B

Google

Grátis

Gemini 1.5 Pro (May '24)

Google

Grátis

Gemini 1.5 Pro (Sep '24)

Google

Grátis

Gemini 2.0 Flash

Google

Grátis

Gemini 2.0 Flash (experimental)

Google

Grátis

Gemini 2.0 Flash Thinking Experimental (Dec '24)

Google

Grátis

Gemini 2.0 Flash Thinking Experimental (Jan '25)

Google

Grátis

Gemini 2.0 Flash-Lite (Feb '25)

Google

Grátis

Gemini 2.0 Flash-Lite (Preview)

Google

Grátis

Gemini 2.0 Pro Experimental (Feb '25)

Google

Grátis

Gemini 2.5 Flash Preview (Non-reasoning)

Google

Grátis

Gemini 2.5 Flash Preview (Sep '25) (Reasoning)

Google

Grátis

Gemini 2.5 Pro Preview (Mar' 25)

Google

Grátis

Gemini 3 Deep Think

Google

Grátis

Gemma 3 12B

Google

Grátis

Gemma 3 1B Instruct

Google

Grátis

Gemma 3 270M

Google

Grátis

Gemma 3 27B

Google

Grátis

Gemma 3 4B

Google

Grátis

Gemma 3n E2B Instruct

Google

Grátis

Gemma 3n E4B Instruct Preview (May '25)

Google

Grátis

Gemma 4 31B

Google

Grátis

Gemma 4 E2B (Non-reasoning)

Google

Grátis

Gemma 4 E2B (Reasoning)

Google

Grátis

GLM 5V Turbo (Reasoning)

Z.ai

Grátis

GLM-4.5 (Reasoning)

Z.ai

Grátis

GLM-5-Turbo

Z.ai

Grátis

GPT-3.5 Turbo (0613)

OpenAI

Grátis

GPT-4.5 (Preview)

OpenAI

Grátis

GPT-4o (ChatGPT)

OpenAI

Grátis

GPT-4o (March 2025, chatgpt-4o-latest)

OpenAI

Grátis

GPT-4o mini Realtime (Dec '24)

OpenAI

Grátis

GPT-4o Realtime (Dec '24)

OpenAI

Grátis

GPT-5 (ChatGPT)

OpenAI

Grátis

Granite 4.0 1B

IBM

Grátis

Granite 4.0 350M

IBM

Grátis

Granite 4.0 H 1B

IBM

Grátis

Granite 4.0 H 350M

IBM

Grátis

Granite 4.0 Micro

IBM

Grátis

Granite 4.1 30B

IBM

Grátis

Granite 4.1 3B

IBM

Grátis

Grok 2 (Dec '24)

xAI

Grátis

Grok 4.1 Fast

xAI

Grátis

Grok Beta

xAI

Grátis

Grok Code Fast 1

xAI

Grátis

Grok-1

xAI

Grátis

HyperCLOVA X SEED Think (32B)

Naver

Grátis

INTELLECT-3

Prime Intellect

Grátis

Jamba 1.7 Mini

AI21 Labs

Grátis

Jamba Reasoning 3B

AI21 Labs

Grátis

JT-35B-Flash

China Mobile

Grátis

JT-4.1 Flash 236B A21B

China Mobile

Grátis

JT-MINI

China Mobile

Grátis

K2 Think V2

MBZUAI Institute of Foundation Models

Grátis

K2-V2 (medium)

MBZUAI Institute of Foundation Models

Grátis

KAT-Coder-Pro V1

KwaiKAT

Grátis

Kimi Linear 48B A3B Instruct

Kimi

Grátis

LFM 40B

Liquid AI

Grátis

LFM2 1.2B

Liquid AI

Grátis

LFM2 2.6B

Liquid AI

Grátis

LFM2 8B A1B

Liquid AI

Grátis

LFM2-24B-A2B

LiquidAI

Grátis

LFM2.5-1.2B-Instruct

Liquid AI

Grátis

LFM2.5-1.2B-Thinking

Liquid AI

Grátis

LFM2.5-8B-A1B

Liquid AI

Grátis

LFM2.5-VL-1.6B

Liquid AI

Grátis

Ling 3.0 Tiny

InclusionAI

Grátis

Ling-1T

InclusionAI

Grátis

Ling-mini-2.0

InclusionAI

Grátis

Llama 2 Chat 13B

Meta

Grátis

Llama 2 Chat 70B

Meta

Grátis

Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning)

Nvidia

Grátis

Llama 3.1 Tulu3 405B

Allen Institute for AI

Grátis

Llama 3.2 1B Instruct

Meta

Grátis

Llama 3.2 3B Instruct

Meta

Grátis

Llama 3.2 Instruct 90B (Vision)

Meta

Grátis

Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)

Nvidia

Grátis

Llama 3.3 Nemotron Super 49B v1 (Reasoning)

Nvidia

Grátis

Llama 65B

Meta

Grátis

LongCat Flash Lite

LongCat

Grátis

Magistral Medium 1

Mistral

Grátis

Magistral Small 1

Mistral

Grátis

Mi:dm K 2.5 Pro

Korea Telecom

Grátis

Mi:dm K 2.5 Pro Preview

Korea Telecom

Grátis

MiMo-V2-Flash (Feb 2026)

Xiaomi

Grátis

MiMo-V2-Omni-0327

Xiaomi

Grátis

MiniCPM-V 4.6 1.3B

OpenBMB

Grátis

MiniCPM5-1B (Non-reasoning)

OpenBMB

Grátis

MiniMax M1 40k

MiniMax

Grátis

Mistral: Devstral Medium

Mistral AI

Grátis

Mistral: Pixtral Large 2411

Mistral AI

Grátis

Mixtral 8x22B Instruct

Mistral

Grátis

Molmo 7B-D

Allen Institute for AI

Grátis

Molmo2-8B

Allen Institute for AI

Grátis

Motif 3 (Beta)

Motif Technologies

Grátis

Motif-2-12.7B-Reasoning

Motif Technologies

Grátis

Muse Spark

Meta

Grátis

Nanbeige4.1-3B

Nanbeige

Grátis

Nemotron Cascade 2 30B A3B

Nvidia

Grátis

North Mini Code

Cohere

Grátis

NVIDIA Nemotron 3 Nano 4B

Nvidia

Grátis

o1-mini

OpenAI

Grátis

OLMo 2 32B

Allen Institute for AI

Grátis

OLMo 2 7B

Allen Institute for AI

Grátis

Olmo 3 32B Think

AllenAI

Grátis

Olmo 3 7B Think

Allen Institute for AI

Grátis

Olmo 3.1 32B Instruct

AllenAI

Grátis

Olmo 3.1 32B Think

Allen Institute for AI

Grátis

OpenChat 3.5 (1210)

OpenChat

Grátis

PALM-2

Google

Grátis

Phi-3 Mini Instruct 3.8B

Microsoft

Grátis

Phi-4 Mini Instruct

Microsoft

Grátis

Phi-4 Multimodal Instruct

Microsoft

Grátis

Qwen Chat 14B

Alibaba

Grátis

Qwen Chat 72B

Alibaba

Grátis

Qwen1.5 Chat 110B

Alibaba

Grátis

Qwen2 Instruct 72B

Alibaba

Grátis

Qwen2.5 Coder 32B Instruct

Alibaba

Grátis

Qwen2.5 Coder Instruct 7B

Alibaba

Grátis

Qwen2.5 Instruct 32B

Alibaba

Grátis

Qwen2.5 Max

Alibaba

Grátis

Qwen3 0.6B (Non-reasoning)

Alibaba

Grátis

Qwen3 0.6B (Reasoning)

Alibaba

Grátis

Qwen3 1.7B (Non-reasoning)

Alibaba

Grátis

Qwen3 1.7B (Reasoning)

Alibaba

Grátis

Qwen3 4B (Non-reasoning)

Alibaba

Grátis

Qwen3 4B (Reasoning)

Alibaba

Grátis

Qwen3 4B 2507 (Reasoning)

Alibaba

Grátis

Qwen3 4B 2507 Instruct

Alibaba

Grátis

Qwen3 VL 4B (Reasoning)

Alibaba

Grátis

Qwen3 VL 4B Instruct

Alibaba

Grátis

Qwen3.5 0.8B (Non-reasoning)

Alibaba

Grátis

Qwen3.5 0.8B (Reasoning)

Alibaba

Grátis

Qwen3.5 2B (Reasoning)

Alibaba

Grátis

QwQ 32B-Preview

Alibaba

Grátis

R1 1776

Perplexity

Grátis

Ring-1T

InclusionAI

Grátis

Sarvam M (Reasoning)

Sarvam

Grátis

Solar Open 100B (Reasoning)

Upstage

Grátis

Solar Pro 2 (Non-reasoning)

Upstage

Grátis

Solar Pro 2 (Preview) (Non-reasoning)

Upstage

Grátis

Solar Pro 2 (Preview) (Reasoning)

Upstage

Grátis

Sonar

Perplexity

Grátis

Sonar Reasoning

Perplexity

Grátis

Sonar Reasoning Pro

Perplexity

Grátis

Step3 VL 10B

StepFun

Grátis

Tiny Aya Global

Cohere

Grátis

Tri-21B-Think

Trillion Labs

Grátis

Tri-21B-think Preview

Trillion Labs

Grátis

Xiaomi: MiMo-V2-Omni

Xiaomi

Grátis

Xiaomi: MiMo-V2-Pro

Xiaomi

Grátis

Guia de Custo de APIs de IA para o Brasil

Como Funciona a Precificação por Token

A grande maioria das APIs de LLMs cobra por tokens processados, divididos em duas categorias: tokens de input(o texto que você envia ao modelo — seu prompt, contexto e histórico) e tokens de output (a resposta gerada pelo modelo). Em geral, o custo de output é 2–4× maior que o de input, pois requer mais computação para gerar.

Para o português brasileiro, 1.000 tokens equivalem a aproximadamente 750 palavras — ligeiramente menos eficiente que o inglês por causa de palavras mais longas e acentuação. Na prática, uma página A4 de texto corrido tem entre 600 e 900 tokens.

Exemplo Real de Custo Mensal

Imagine uma empresa que usa a API do GPT-4o para processar 100 e-mails por dia, com um prompt médio de 800 tokens e resposta de 300 tokens. Isso representa 110.000 tokens/dia × 30 dias = 3,3 milhões de tokens/mês. Com o preço de $2,50/M tokens de input e $10/M de output:

  • Input: 2,4M tokens × $2,50/M = $6,00/mêsR$ 34.20/mês
  • Output: 0,9M tokens × $10/M = $9,00/mêsR$ 51.30/mês
  • Total: $15,00/mêsR$ 85.50/mês

O mesmo volume com Claude Haiku (a ~$0,25/M input) custaria apenas R$ 9.83/mês — uma economia significativa para casos onde a qualidade máxima não é crítica.

Estratégias para Reduzir Custos de API no Brasil

1. Escolha o modelo certo para cada tarefa: classificação simples de texto pode usar Gemini Flash ou Claude Haiku; reserve GPT-4o ou Claude Opus para tarefas que realmente exigem raciocínio avançado.

2. Comprima os prompts: evite repetir contexto desnecessário. Sistemas de RAG bem implementados enviam apenas os trechos relevantes, não o documento inteiro.

3. Cache de respostas: se o mesmo prompt é enviado repetidamente (ex: categorização de produtos), armazene as respostas e reutilize. Providers como Anthropic oferecem prompt caching com desconto.

4. Use modelos open source via APIs de terceiros: Groq, Together AI e Fireworks oferecem modelos como Llama e Qwen por $0,01–$0,20/M tokens — 10–100× mais barato que os proprietários frontier.

IOF e Câmbio para Empresas Brasileiras

O pagamento das APIs de IA (OpenAI, Anthropic, Google) é feito em dólares americanos por cartão de crédito ou débito internacional. Para pessoas físicas, o IOF sobre compras internacionais foi zerado pelo governo Lula em janeiro de 2024 — você paga apenas o câmbio do cartão. Para pessoas jurídicas (CNPJ), as remessas internacionais ainda incidem IOF de 0,38%. Além do IOF, considere o spread do cartão (tipicamente 3–5% sobre o câmbio PTAX). Plataformas de pagamento como Wise podem oferecer câmbio mais próximo ao comercial.

Perguntas Frequentes sobre Custo de API

Quanto custa usar a API do ChatGPT (GPT-4o) em reais?

A API do GPT-4o custa $2,50 por milhão de tokens de input e $10,00 por milhão de tokens de output (preços de 2026). Com o câmbio em torno de R$ 5.70, isso equivale a aproximadamente R$ 14.25/M tokens de input. Para uma empresa brasileira que envia 1 milhão de tokens por dia, o custo mensal seria de aproximadamente R$ 428.

Qual é a API de IA mais barata disponível para empresas brasileiras?

Modelos open source como Qwen, Llama e Gemma podem ser rodados via APIs de terceiros (Groq, Together AI, Fireworks) por frações de centavo por milhão de tokens — chegando a $0,01–$0,10/M tokens. Entre as APIs proprietárias, Gemini Flash e Claude Haiku são as mais acessíveis, com preços a partir de $0,08–$0,25/M tokens de input.

Preciso pagar IOF ao usar APIs de IA no Brasil?

O IOF sobre compras internacionais no cartão de crédito foi zerado desde janeiro de 2024 para pessoas físicas. Empresas (CNPJ) ainda pagam IOF sobre remessas internacionais — consulte sua contabilidade. Os preços nesta tabela mostram o valor base em USD sem IOF adicional; inclua seu câmbio bancário real na estimativa final.

O que são tokens e como calcular o custo real do meu projeto?

Tokens são unidades de texto que os LLMs processam — em inglês, 1 token ≈ 4 caracteres; em português, pode ser um pouco menos por causa de acentuação. Uma página A4 tem ~600–800 tokens. Para estimar o custo: (tokens de input + tokens de output) × preço/1M tokens. Exemplo: prompt de 500 tokens + resposta de 300 tokens = 800 tokens × preço do modelo.

Vale mais a pena usar API ou assinar o plano premium do ChatGPT/Claude?

Para uso pessoal moderado, a assinatura (US$ 20/mês ≈ R$ 114/mês) costuma ser mais econômica. Para uso intensivo ou integração em produtos, a API é mais flexível e escalável. O ponto de virada geralmente acontece quando o consumo de tokens via API supera o custo da assinatura mensal.

Como os preços de API de IA variam ao longo do tempo?

Os preços caíram drasticamente: GPT-4 custava $30/M tokens em 2023; hoje modelos equivalentes custam $2–5/M. A tendência é de queda contínua conforme a competição aumenta. Atualizamos esta tabela semanalmente — verifique sempre os preços oficiais antes de comprometer seu budget.

Explorar no Benchmark