API de IA Mais BarataPreços em Reais 2026

Quanto custa usar a API do ChatGPT, Claude, Gemini e outros LLMs para empresas e desenvolvedores brasileiros? Compare o preço por milhão de tokens convertido para BRL — sem surpresas na fatura.

US$ 1 = R$ 5.70 • IOF zerado para PF desde jan/2024 • Última atualização: 02 de outubro de 2026 • 799 APIs listadas

799

APIs listadas

192

Com plano grátis

$0.019

Mais barata (input/1M)

$150.00

Mais cara (input/1M)

Como ler a tabela: preços são por milhão de tokens (input = o que você envia; output = a resposta do modelo). Em português, 1.000 tokens ≈ 750 palavras ≈ 1 página A4. O valor em BRL usa câmbio R$ 5.70/USD — substitua pelo câmbio do seu banco para estimativas precisas. Preços verificados nas páginas oficiais de precificação de cada empresa.

Preços por Milhão de Tokens — APIs com Custo

#ModeloInput USD/1MInput R$/1M
1Mistral: Mistral Nemo$0.019R$ 0.108
2Gemma 4 E4B (Non-reasoning)$0.020R$ 0.114
3Gemma 4 E4B (Reasoning)$0.020R$ 0.114
4Llama 3.1 8B Instruct$0.020R$ 0.114
5OpenAI: gpt-oss-20b (batch)$0.024R$ 0.137
6OpenAI: gpt-oss-120b (batch)$0.030R$ 0.169
7Qwen3.5 4B (Non-reasoning)$0.030R$ 0.171
8Qwen3.5 4B (Reasoning)$0.030R$ 0.171
9Granite 3.3 8B (Non-reasoning)$0.030R$ 0.171
10Granite 4.2 3B$0.030R$ 0.171
11Sarvam 30B$0.030R$ 0.171
12Qwen: Qwen2.5 7B Instruct$0.040R$ 0.228
13Amazon: Nova Micro 1.0$0.040R$ 0.228
14Llama 3 8B Instruct$0.040R$ 0.228
15HyperNova 60B 2605$0.040R$ 0.228
16NVIDIA Nemotron Nano 9B V2 (Reasoning)$0.040R$ 0.228
17Sao10K: Llama 3 8B Lunaris$0.040R$ 0.228
18Sarvam 105B (high)$0.040R$ 0.228
19DeepSeek: DeepSeek V4 Flash 0423$0.042R$ 0.239
20Arcee AI: Trinity Mini$0.045R$ 0.257
21Qwen2.5 Turbo$0.050R$ 0.285
22Granite 4.1 8B$0.050R$ 0.285
23Llama 2 Chat 7B$0.050R$ 0.285
24Mistral Small 3$0.050R$ 0.285
25NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)$0.050R$ 0.285
26NVIDIA: Nemotron 3 Nano 30B A3B$0.050R$ 0.285
27NVIDIA: Nemotron Nano 9B V2$0.050R$ 0.285
28GPT-5 Nano$0.050R$ 0.285
29GPT-5 nano (medium)$0.050R$ 0.285
30GPT-5 nano (minimal)$0.050R$ 0.285
31OpenAI: GPT-6 Luna (batch)$0.050R$ 0.285
32OpenAI: GPT-6 Luna Pro (batch)$0.050R$ 0.285
33Amazon: Nova Lite 1.0$0.060R$ 0.342
34Gemma 3n 4B$0.060R$ 0.342
35Gemma 3n E4B Instruct$0.060R$ 0.342
36Granite 4.0 H Small$0.060R$ 0.342
37Granite 4.2 8B$0.060R$ 0.342
38MythoMax 13B$0.060R$ 0.342
39Nemotron 3.5 Lightning$0.060R$ 0.342
40Hy3-preview (Non-reasoning)$0.060R$ 0.342
41Baidu: ERNIE 4.5 21B A3B Thinking$0.070R$ 0.399
42Ling 3.0 Flash$0.070R$ 0.399
43Ling-3.0-flash-Fin$0.070R$ 0.399
44Ling-3.0-flash-VL$0.070R$ 0.399
45Mistral Small 3.2$0.070R$ 0.399
46gpt-oss-20b$0.070R$ 0.399
47gpt-oss-20b (low)$0.070R$ 0.399
48GLM-4.7-Flash (Non-reasoning)$0.070R$ 0.399
49Z.ai: GLM 4.7 Flash$0.070R$ 0.399
50ByteDance Seed: Seed 1.6 Flash$0.075R$ 0.427
51Gemini 2.0 Flash Lite$0.075R$ 0.427
52Mistral: Ministral 3 8B 2512 (batch)$0.075R$ 0.427
53Mistral: Mistral Small 4 (batch)$0.075R$ 0.427
54gpt-oss-safeguard-20b$0.075R$ 0.427
55Qwen: Qwen3 30B A3B Thinking 2507$0.080R$ 0.456
56Tongyi DeepResearch 30B A3B$0.090R$ 0.513
57Qwen3.5 Omni Flash$0.100R$ 0.570
58Olmo 3 7B Instruct$0.100R$ 0.570
59ByteDance: UI-TARS 7B $0.100R$ 0.570
60Gemini 2.5 Flash Lite$0.100R$ 0.570
61Gemini 2.5 Flash-Lite (Reasoning)$0.100R$ 0.570
62Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)$0.100R$ 0.570
63Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)$0.100R$ 0.570
64Gemma 4 12B (Non-reasoning)$0.100R$ 0.570
65Gemma 4 12B (Reasoning)$0.100R$ 0.570
66Gemma 4 26B A4B $0.100R$ 0.570
67Ling 2.6 Flash$0.100R$ 0.570
68Ministral 3 3B$0.100R$ 0.570
69Mistral: Voxtral Small 24B 2507$0.100R$ 0.570
70GPT-4.1 Nano$0.100R$ 0.570
71GPT-6 Luna (high)$0.100R$ 0.570
72GPT-6 Luna (low)$0.100R$ 0.570
73GPT-6 Luna (max)$0.100R$ 0.570
74GPT-6 Luna (medium)$0.100R$ 0.570
75GPT-6 Luna (Non-reasoning)$0.100R$ 0.570
76GPT-6 Luna (xhigh)$0.100R$ 0.570
77OpenAI: GPT-5.6 Luna (batch)$0.100R$ 0.570
78OpenAI: GPT-5.6 Luna Pro (batch)$0.100R$ 0.570
79OpenAI: GPT-6 Luna Pro$0.100R$ 0.570
80Reka Edge$0.100R$ 0.570
81Step 3.5 Flash$0.100R$ 0.570
82Apertus 8B Instruct$0.100R$ 0.570
83Solar Mini 4$0.100R$ 0.570
84MiMo-V2-Flash (Reasoning)$0.100R$ 0.570
85Z.ai: GLM 4 32B $0.100R$ 0.570
86DeepSeek V4 Flash (Reasoning, High Effort)$0.110R$ 0.627
87DeepSeek: DeepSeek V4 Flash 0731 (batch)$0.110R$ 0.627
88DeepSeek: DeepSeek V4 Flash Vision Exp (batch)$0.110R$ 0.627
89Mistral Small 3.1$0.110R$ 0.627
90Mistral: Ministral 8B$0.110R$ 0.627
91DeepSeek: DeepSeek V4.1 Flash (batch)$0.112R$ 0.638
92DeepSeek V4 Flash 0420 (Non-reasoning)$0.130R$ 0.741
93Gemma 4 26B A4B (Non-reasoning)$0.130R$ 0.741
94Microsoft: Phi 4$0.130R$ 0.741
95Nous: Hermes 4 70B$0.130R$ 0.741
96Hermes 4 - Llama-3.1 70B (Non-reasoning)$0.130R$ 0.741
97Hermes 4 - Llama-3.1 70B (Reasoning)$0.130R$ 0.741
98Nex AGI: DeepSeek V3.1 Nex N1$0.135R$ 0.770
99Qwen3.5 9B (Reasoning)$0.140R$ 0.798
100Baidu: ERNIE 4.5 VL 28B A3B$0.140R$ 0.798
101Gemma 4 31B (Non-reasoning)$0.140R$ 0.798
102Ling-flash-2.0$0.140R$ 0.798
103Ring-flash-2.0$0.140R$ 0.798
104NousResearch: Hermes 2 Pro - Llama-3 8B$0.140R$ 0.798
105Hy3-preview (Reasoning)$0.140R$ 0.798
106Tencent: Hunyuan A13B Instruct$0.140R$ 0.798
107MiMo-V2.5$0.140R$ 0.798
108MiMo-V2.6-Flash$0.140R$ 0.798
109Qwen: Qwen3 235B A22B Thinking 2507$0.149R$ 0.852
110Qwen: Qwen3 Next 80B A3B Instruct$0.150R$ 0.855
111Qwen3 Next 80B A3B (Reasoning)$0.150R$ 0.855
112Qwen3.8-Flash-Next$0.150R$ 0.855
113EssentialAI: Rnj 1 Instruct$0.150R$ 0.855
114Ministral 3 8B$0.150R$ 0.855
115Mistral 7B Instruct$0.150R$ 0.855
116Mistral Small (Feb '24)$0.150R$ 0.855
117Mistral Small 4 (Non-reasoning)$0.150R$ 0.855
118Mistral: Codestral 2508 (batch)$0.150R$ 0.855
119GPT-4o-mini (2024-07-18)$0.150R$ 0.855
120GPT-4o-mini Search Preview$0.150R$ 0.855
121gpt-oss-120b$0.150R$ 0.855
122gpt-oss-120b (low)$0.150R$ 0.855
123OpenAI: GPT-4o-mini$0.150R$ 0.855
124Solar Mini$0.150R$ 0.855
125Solar Pro 3$0.150R$ 0.855
126GLM-5.3-Flash$0.150R$ 0.855
127Qwen: Qwen3 VL 32B Instruct$0.160R$ 0.912
128Qwen3 32B (Non-reasoning)$0.160R$ 0.912
129Qwen3 32B (Reasoning)$0.160R$ 0.912
130Qwen3 VL 32B (Reasoning)$0.160R$ 0.912
131Granite 4.2 30B$0.160R$ 0.912
132Qwen3.5 9B (Non-reasoning)$0.170R$ 0.969
133TheDrummer: Rocinante 12B$0.170R$ 0.969
134Z.ai: GLM 4.5 Air$0.170R$ 0.969
135Qwen: Qwen3 VL 8B Instruct$0.180R$ 1.03
136Qwen3 8B (Non-reasoning)$0.180R$ 1.03
137Qwen3 8B (Reasoning)$0.180R$ 1.03
138Qwen3 VL 8B (Reasoning)$0.180R$ 1.03
139Arcee AI: Spotlight$0.180R$ 1.03
140Llama Guard 4 12B$0.180R$ 1.03
141Llama 4 Scout$0.190R$ 1.08
142Jamba 1.5 Mini$0.200R$ 1.14
143Jamba 1.6 Mini$0.200R$ 1.14
144Qwen: Qwen3 30B A3B Instruct 2507$0.200R$ 1.14
145Qwen: Qwen3 VL 30B A3B Instruct$0.200R$ 1.14
146Qwen3 30B A3B (Reasoning)$0.200R$ 1.14
147Qwen3 30B A3B 2507 (Reasoning)$0.200R$ 1.14
148Qwen3 30B A3B 2507 Instruct$0.200R$ 1.14
149Qwen3 VL 30B A3B (Reasoning)$0.200R$ 1.14
150MiniMax: MiniMax-01$0.200R$ 1.14
151Ministral 3 14B$0.200R$ 1.14
152Mistral Small (Sep '24)$0.200R$ 1.14
153Mistral: Mistral Medium 3.1 (batch)$0.200R$ 1.14
154Mistral: Saba$0.200R$ 1.14
155Nemotron 3 Nano Omni 30B A3B Reasoning$0.200R$ 1.14
156NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)$0.200R$ 1.14
157NVIDIA Nemotron Nano 12B v2 VL (Reasoning)$0.200R$ 1.14
158GPT-5.4 Nano$0.200R$ 1.14
159GPT-5.4 nano (medium)$0.200R$ 1.14
160GPT-5.4 nano (Non-Reasoning)$0.200R$ 1.14
161GPT-5.6 Luna (high)$0.200R$ 1.14
162GPT-5.6 Luna (low)$0.200R$ 1.14
163GPT-5.6 Luna (max)$0.200R$ 1.14
164GPT-5.6 Luna (medium)$0.200R$ 1.14
165GPT-5.6 Luna (Non-reasoning)$0.200R$ 1.14
166GPT-5.6 Luna (xhigh)$0.200R$ 1.14
167OpenAI: GPT-5.6 Luna Pro$0.200R$ 1.14
168Reka Flash 3$0.200R$ 1.14
169Grok 4 Fast (Reasoning)$0.200R$ 1.14
170Step 3.7 Flash$0.200R$ 1.14
171Celeris-1$0.200R$ 1.14
172Grok 4 Fast$0.200R$ 1.14
173DeepSeek: DeepSeek V4 Pro 0423$0.209R$ 1.19
174Seed-OSS-36B-Instruct$0.210R$ 1.20
175DeepSeek: DeepSeek V4 Flash Vision Exp$0.216R$ 1.23
176Qwen3 235B A22B 2507 (Reasoning)$0.230R$ 1.31
177DeepSeek V3 0324$0.240R$ 1.37
178Qwen: Qwen2.5 VL 72B Instruct$0.250R$ 1.43
179Qwen: Qwen3.5-35B-A3B$0.250R$ 1.43
180Qwen3 Omni 30B A3B (Reasoning)$0.250R$ 1.43
181Qwen3 Omni 30B A3B Instruct$0.250R$ 1.43
182Qwen3.5 35B A3B (Non-reasoning)$0.250R$ 1.43
183Anthropic: Claude 3 Haiku$0.250R$ 1.43
184Arcee AI: Trinity Large Thinking$0.250R$ 1.43
185ByteDance Seed: Seed-2.0-Lite$0.250R$ 1.43
186Gemini 3.1 Flash Lite Preview$0.250R$ 1.43
187Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)$0.250R$ 1.43
188Inception: Mercury 2$0.250R$ 1.43
189Mercury 2.5$0.250R$ 1.43
190Mistral: Mistral Large 3 2512 (batch)$0.250R$ 1.43
191GPT-5 Mini$0.250R$ 1.43
192GPT-5 mini (medium)$0.250R$ 1.43
193GPT-5 mini (minimal)$0.250R$ 1.43
194GPT-5.1-Codex-Mini$0.250R$ 1.43
195Llama 4 Maverick$0.260R$ 1.48
196DeepSeek V3.1 Terminus$0.270R$ 1.54
197Baidu: ERNIE 4.5 300B A47B $0.280R$ 1.60
198DeepSeek V3.2$0.280R$ 1.60
199DeepSeek V3.2 (Reasoning)$0.280R$ 1.60
200DeepSeek V3.2 Exp (Non-reasoning)$0.280R$ 1.60
201DeepSeek V3.2 Exp (Reasoning)$0.280R$ 1.60
202Qwen: Qwen3.5-27B$0.300R$ 1.71
203Qwen3.5 27B (Non-reasoning)$0.300R$ 1.71
204Amazon: Nova 2 Lite$0.300R$ 1.71
205Nova 2.0 Lite (high)$0.300R$ 1.71
206Nova 2.0 Lite (low)$0.300R$ 1.71
207Nova 2.0 Lite (medium)$0.300R$ 1.71
208Nova 2.0 Omni (low)$0.300R$ 1.71
209Nova 2.0 Omni (medium)$0.300R$ 1.71
210Nova 2.0 Omni (Non-reasoning)$0.300R$ 1.71
211Apodex 1.1$0.300R$ 1.71
212DeepSeek V4.1 Flash (Non-Reasoning)$0.300R$ 1.71
213DeepSeek: DeepSeek V4.1 Flash$0.300R$ 1.71
214Gemini 2.5 Flash$0.300R$ 1.71
215Gemini 2.5 Flash Preview (Reasoning)$0.300R$ 1.71
216Gemini 3.5 Flash-Lite$0.300R$ 1.71
217Nano Banana (Gemini 2.5 Flash Image)$0.300R$ 1.71
218Ling-2.6-1T$0.300R$ 1.71
219Ring-2.6-1T$0.300R$ 1.71
220Kwaipilot: KAT-Coder-Pro V2$0.300R$ 1.71
221LongCat 2.0$0.300R$ 1.71
222MiniMax-M2$0.300R$ 1.71
223MiniMax-M3$0.300R$ 1.71
224MiniMax: MiniMax M2-her$0.300R$ 1.71
225MiniMax: MiniMax M2.1$0.300R$ 1.71
226MiniMax: MiniMax M2.5$0.300R$ 1.71
227MiniMax: MiniMax M2.7$0.300R$ 1.71
228Mistral: Codestral 2508$0.300R$ 1.71
229Nous: Hermes 3 70B Instruct$0.300R$ 1.71
230NVIDIA Nemotron 3 Super 120B A12B (Reasoning)$0.300R$ 1.71
231Grok 3 mini Reasoning (high)$0.300R$ 1.71
232TheDrummer: Cydonia 24B V4.1$0.300R$ 1.71
233Inkling Small$0.300R$ 1.71
234Solar Pro 4$0.300R$ 1.71
235Grok 3 Mini Beta$0.300R$ 1.71
236GLM-4.6V (Reasoning)$0.300R$ 1.71
237DeepSeek V3$0.320R$ 1.82
238Muse Glimmer (high)$0.320R$ 1.82
239Llama 3.2 11B Vision Instruct$0.340R$ 1.94
240Qwen: Qwen3 Coder Next$0.350R$ 1.99
241Qwen3 14B (Non-reasoning)$0.350R$ 1.99
242Qwen3 14B (Reasoning)$0.350R$ 1.99
243Google: Gemini 3.6 Flash (batch)$0.375R$ 2.14
244Google: Gemini 3.8 Flash (batch)$0.375R$ 2.14
245Qwen: Qwen3.6 35B A3B$0.380R$ 2.17
246Qwen3.6 35B A3B (Non-reasoning)$0.380R$ 2.17
247Google: Gemma 4 31B (batch)$0.390R$ 2.22
248Qwen: Qwen3 VL 235B A22B Instruct$0.400R$ 2.28
249Qwen: Qwen3.5-122B-A10B$0.400R$ 2.28
250Qwen3 VL 235B A22B (Reasoning)$0.400R$ 2.28
251Qwen3.5 122B A10B (Non-reasoning)$0.400R$ 2.28
252Qwen3.5 Omni Plus$0.400R$ 2.28
253Qwen3.7 Plus$0.400R$ 2.28
254MiniMax: MiniMax M1$0.400R$ 2.28
255Mistral: Mistral Medium 3$0.400R$ 2.28
256Mistral: Mistral Medium 3.1$0.400R$ 2.28
257Llama Nemotron Super 49B v1.5 (Non-reasoning)$0.400R$ 2.28
258Llama Nemotron Super 49B v1.5 (Reasoning)$0.400R$ 2.28
259GPT-4.1 Mini$0.400R$ 2.28
260TheDrummer: UnslopNemo 12B$0.400R$ 2.28
261Baidu: ERNIE 4.5 VL 424B A47B $0.420R$ 2.39
262DeepSeek V4 Pro (Non-reasoning)$0.430R$ 2.45
263DeepSeek V4 Pro (Reasoning, High Effort)$0.430R$ 2.45
264MiMo-V2.5-Pro (Non-reasoning)$0.430R$ 2.45
265MiMo-V2.6-Pro$0.430R$ 2.45
266Xiaomi: MiMo-V2.5-Pro$0.430R$ 2.45
267DeepSeek V4 Flash Vision (Reasoning, Max Effort)$0.440R$ 2.51
268DeepSeek-V4-Flash$0.440R$ 2.51
269Qwen: Qwen3 Coder 30B A3B Instruct$0.450R$ 2.56
270Mistral: Mixtral 8x7B Instruct$0.450R$ 2.56
271ReMM SLERP 13B$0.450R$ 2.56
272Qwen2.5 72B Instruct$0.470R$ 2.68
273Llama Guard 3 8B$0.480R$ 2.74
274Qwen: Qwen3.6 Plus$0.500R$ 2.85
275Qwen3.8 27B (low)$0.500R$ 2.85
276Qwen3.8 27B (medium)$0.500R$ 2.85
277Qwen3.8 27B (Non-reasoning)$0.500R$ 2.85
278Anthropic: Claude Haiku 4.5 (batch)$0.500R$ 2.85
279Arcee AI: Coder Large$0.500R$ 2.85
280Command-R (Mar '24)$0.500R$ 2.85
281Gemini 3 Flash Preview (Non-reasoning)$0.500R$ 2.85
282Gemini 3 Flash Preview (Reasoning)$0.500R$ 2.85
283Google: Nano Banana 2 (Gemini 3.1 Flash Image)$0.500R$ 2.85
284Nano Banana 2 (Gemini 3.1 Flash Image Preview)$0.500R$ 2.85
285Magistral Small 1.2$0.500R$ 2.85
286Mistral Large 3$0.500R$ 2.85
287Nex-N2-Pro$0.500R$ 2.85
288GPT-3.5 Turbo$0.500R$ 2.85
289MiniMax M1 80k$0.550R$ 3.14
290OpenAI: o3 Mini High (batch)$0.550R$ 3.14
291OpenAI: o4 Mini High (batch)$0.550R$ 3.14
292TheDrummer: Skyfall 36B V2$0.550R$ 3.14
293DeepSeek V3.1$0.560R$ 3.19
294Llama 3.1 70B Instruct$0.560R$ 3.19
295Kimi K2$0.570R$ 3.25
296MoonshotAI: Kimi K2 0711$0.570R$ 3.25
297GLM-4.6 (Reasoning)$0.570R$ 3.25
298DeepSeek V3.1 (Reasoning)$0.580R$ 3.31
299Qwen: Qwen3.5 397B A17B$0.600R$ 3.42
300Qwen3.5 397B A17B (Non-reasoning)$0.600R$ 3.42
301Qwen3.6 27B (Non-reasoning)$0.600R$ 3.42
302Kimi K2 Thinking$0.600R$ 3.42
303Kimi K2.5 (Non-reasoning)$0.600R$ 3.42
304MoonshotAI: Kimi K2 0905$0.600R$ 3.42
305MoonshotAI: Kimi K2.5$0.600R$ 3.42
306Quasar 438B$0.600R$ 3.42
307Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)$0.600R$ 3.42
308Nemotron 3 Ultra 550B A55B (Reasoning)$0.600R$ 3.42
309GPT Audio Mini$0.600R$ 3.42
310Writer: Palmyra X5$0.600R$ 3.42
311GLM-4.7 (Non-reasoning)$0.600R$ 3.42
312GLM-4.5V (Reasoning)$0.600R$ 3.42
313WizardLM-2 8x22B$0.620R$ 3.53
314Google: Gemini 2.5 Pro (batch)$0.625R$ 3.56
315Gemma 2 27B$0.650R$ 3.71
316Llama 3 70B Instruct$0.650R$ 3.71
317Sao10K: Llama 3.3 Euryale 70B$0.650R$ 3.71
318QwQ 32B$0.660R$ 3.76
319DeepSeek: DeepSeek V4 Pro 0813 (batch)$0.660R$ 3.76
320Qwen: Qwen3 235B A22B Instruct 2507$0.700R$ 3.99
321Qwen3 235B A22B (Reasoning)$0.700R$ 3.99
322R1 Distill Llama 70B$0.700R$ 3.99
323Hermes 3 - Llama-3.1 70B$0.700R$ 3.99
324Llama 3.3 70B Instruct$0.710R$ 4.05
325Arcee AI: Virtuoso Large$0.750R$ 4.28
326Gemini 3.6 Flash (high)$0.750R$ 4.28
327Gemini 3.7 Flash (high)$0.750R$ 4.28
328Gemini 3.7 Flash (low)$0.750R$ 4.28
329Gemini 3.7 Flash (medium)$0.750R$ 4.28
330Gemini 3.8 Flash (high)$0.750R$ 4.28
331Gemini 3.8 Flash (low)$0.750R$ 4.28
332Gemini 3.8 Flash (medium)$0.750R$ 4.28
333Google: Gemini 3.5 Flash (batch)$0.750R$ 4.28
334Mancer: Weaver (alpha)$0.750R$ 4.28
335Mistral: Mistral Medium 3.5 (batch)$0.750R$ 4.28
336GPT-5.4 Mini$0.750R$ 4.28
337GPT-5.4 mini (medium)$0.750R$ 4.28
338GPT-5.4 mini (Non-Reasoning)$0.750R$ 4.28
339Qwen: Qwen3 Max Thinking$0.780R$ 4.45
340AionLabs: Aion-2.0$0.800R$ 4.56
341AionLabs: Aion-RP 1.0 (8B)$0.800R$ 4.56
342AlfredPros: CodeLLaMa 7B Instruct Solidity$0.800R$ 4.56
343Amazon: Nova Pro 1.0$0.800R$ 4.56
344Morph: Morph V3 Fast$0.800R$ 4.56
345Apertus 70B Instruct$0.820R$ 4.67
346Relace: Relace Apply 3$0.850R$ 4.84
347Sao10K: Llama 3.1 Euryale 70B v2.2$0.850R$ 4.84
348Arcee AI: Maestro Reasoning$0.900R$ 5.13
349Morph: Morph V3 Large$0.900R$ 5.13
350Kimi K2.6 (Non-reasoning)$0.950R$ 5.42
351Kimi K2.7 Code$0.950R$ 5.42
352Anthropic: Claude Sonnet 5.5 (batch)$1.00R$ 5.70
353Claude 4.5 Haiku (Reasoning)$1.00R$ 5.70
354Claude Haiku 4.5$1.00R$ 5.70
355Google: Gemini 3.1 Pro Preview (batch)$1.00R$ 5.70
356Nous: Hermes 3 405B Instruct$1.00R$ 5.70
357Nous: Hermes 4 405B$1.00R$ 5.70
358Hermes 4 - Llama-3.1 405B (Non-reasoning)$1.00R$ 5.70
359Hermes 4 - Llama-3.1 405B (Reasoning)$1.00R$ 5.70
360OpenAI: GPT-5.6 Sol Pro (batch)$1.00R$ 5.70
361OpenAI: GPT-5.6 Terra Pro (batch)$1.00R$ 5.70
362OpenAI: GPT-6 Sol (batch)$1.00R$ 5.70
363OpenAI: GPT-6 Sol Pro (batch)$1.00R$ 5.70
364OpenAI: GPT-6.1 Sol (batch)$1.00R$ 5.70
365OpenAI: GPT-6.1 Sol Pro (batch)$1.00R$ 5.70
366Relace: Relace Search$1.00R$ 5.70
367Step 5 Preview$1.00R$ 5.70
368Inkling$1.00R$ 5.70
369Grok Build 0.1 0616$1.00R$ 5.70
370SpaceXAI: Grok 4.3 (batch)$1.00R$ 5.70
371SpaceXAI: Grok Build 0.1$1.00R$ 5.70
372GLM-5 (Non-reasoning)$1.00R$ 5.70
373o3 Mini$1.10R$ 6.27
374o3 Mini High$1.10R$ 6.27
375o4 Mini$1.10R$ 6.27
376o4 Mini High$1.10R$ 6.27
377Qwen: Qwen3 Max$1.20R$ 6.84
378Qwen3 Max (Preview)$1.20R$ 6.84
379Qwen3 Max Thinking (Preview)$1.20R$ 6.84
380Llama 3.1 Nemotron 70B Instruct$1.20R$ 6.84
381Z.ai: GLM 5V Turbo$1.20R$ 6.84
382Nova 2.0 Pro Preview (low)$1.25R$ 7.13
383Nova 2.0 Pro Preview (medium)$1.25R$ 7.13
384Cogito v2.1 (Reasoning)$1.25R$ 7.13
385Deep Cogito: Cogito v2.1 671B$1.25R$ 7.13
386Gemini 2.5 Pro$1.25R$ 7.13
387Gemini 2.5 Pro Preview (May' 25)$1.25R$ 7.13
388Gemini 2.5 Pro Preview 05-06$1.25R$ 7.13
389Muse Spark 1.1$1.25R$ 7.13
390Muse Spark 1.1 (xhigh)$1.25R$ 7.13
391Muse Spark 1.2 (xhigh)$1.25R$ 7.13
392Muse Spark 1.3 (max)$1.25R$ 7.13
393Muse Spark 1.3 (xhigh)$1.25R$ 7.13
394GPT-5$1.25R$ 7.13
395GPT-5 (low)$1.25R$ 7.13
396GPT-5 (medium)$1.25R$ 7.13
397GPT-5 (minimal)$1.25R$ 7.13
398GPT-5 Codex$1.25R$ 7.13
399GPT-5.1$1.25R$ 7.13
400GPT-5.1 (Non-reasoning)$1.25R$ 7.13
401GPT-5.1-Codex$1.25R$ 7.13
402Grok 4.20 0309 v2 (Non-reasoning)$1.25R$ 7.13
403Grok 4.3 (low)$1.25R$ 7.13
404Grok 4.3 (medium)$1.25R$ 7.13
405Grok 4.3 (Non-reasoning)$1.25R$ 7.13
406SpaceXAI: Grok 4.20$1.25R$ 7.13
407SpaceXAI: Grok 4.20 Multi-Agent$1.25R$ 7.13
408SpaceXAI: Grok 4.3$1.25R$ 7.13
409Z.ai: GLM 5.1$1.28R$ 7.30
410Qwen3.6 Max Preview$1.30R$ 7.41
411DeepSeek V4 Pro$1.32R$ 7.52
412DeepSeek V4 Pro 0813 (Non-reasoning)$1.32R$ 7.52
413DeepSeek: R1$1.35R$ 7.70
414GLM-5.1 (Non-reasoning)$1.38R$ 7.87
415GLM-5.2 (Non-reasoning)$1.40R$ 7.98
416GLM-5.3 (low)$1.40R$ 7.98
417GLM-5.3$1.40R$ 7.98
418Sao10k: Llama 3 Euryale 70B v2.1$1.48R$ 8.44
419Qwen3 Coder 480B A35B Instruct$1.50R$ 8.55
420Anthropic: Claude Sonnet 4.5 (batch)$1.50R$ 8.55
421Gemini 3.5 Flash (medium)$1.50R$ 8.55
422Gemini 3.5 Flash (minimal)$1.50R$ 8.55
423Gemini 3.6 Flash$1.50R$ 8.55
424Google: Gemini 3.5 Flash$1.50R$ 8.55
425Mistral Medium$1.50R$ 8.55
426Mistral Medium 3.5$1.50R$ 8.55
427DeepSeek V3.1 Terminus (Reasoning)$1.64R$ 9.35
428GPT-5.2$1.75R$ 9.97
429GPT-5.2 (medium)$1.75R$ 9.97
430GPT-5.2 (Non-reasoning)$1.75R$ 9.97
431GPT-5.2-Codex$1.75R$ 9.97
432GPT-5.3 Chat$1.75R$ 9.97
433GPT-5.3-Codex$1.75R$ 9.97
434AI21: Jamba Large 1.7$2.00R$ 11.40
435Jamba 1.5 Large$2.00R$ 11.40
436Jamba 1.6 Large$2.00R$ 11.40
437Qwen: Qwen3.8 2.4T A95B$2.00R$ 11.40
438Qwen: Qwen3.8 Max$2.00R$ 11.40
439Anthropic: Claude Opus 5.5 (batch)$2.00R$ 11.40
440Claude Sonnet 5$2.00R$ 11.40
441Claude Sonnet 5 (Adaptive Reasoning, High Effort)$2.00R$ 11.40
442Claude Sonnet 5 (Adaptive Reasoning, Low Effort)$2.00R$ 11.40
443Claude Sonnet 5 (Adaptive Reasoning, Medium Effort)$2.00R$ 11.40
444Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)$2.00R$ 11.40
445Claude Sonnet 5 (Non-reasoning, High Effort)$2.00R$ 11.40
446Claude Sonnet 5.5 (Adaptive Reasoning, High Effort, Default Fallback)$2.00R$ 11.40
447Claude Sonnet 5.5 (Adaptive Reasoning, Low Effort, Default Fallback)$2.00R$ 11.40
448Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)$2.00R$ 11.40
449Claude Sonnet 5.5 (Adaptive Reasoning, Medium Effort, Default Fallback)$2.00R$ 11.40
450Claude Sonnet 5.5 (Adaptive Reasoning, Xhigh Effort, Default Fallback)$2.00R$ 11.40
451DeepSeek R1 (Jan '25)$2.00R$ 11.40
452Gemini 3 Pro Preview (high)$2.00R$ 11.40
453Gemini 3 Pro Preview (low)$2.00R$ 11.40
454Gemini 3.1 Pro Preview$2.00R$ 11.40
455Gemini 3.1 Pro Preview Custom Tools$2.00R$ 11.40
456Gemini 4 Argon (High)$2.00R$ 11.40
457Google: Nano Banana Pro (Gemini 3 Pro Image)$2.00R$ 11.40
458Nano Banana Pro (Gemini 3 Pro Image Preview)$2.00R$ 11.40
459Mistral Large 2 (Jul '24)$2.00R$ 11.40
460Magistral Medium 1.2$2.00R$ 11.40
461GPT-4.1$2.00R$ 11.40
462GPT-5.6 Terra (high)$2.00R$ 11.40
463GPT-5.6 Terra (low)$2.00R$ 11.40
464GPT-5.6 Terra (max)$2.00R$ 11.40
465GPT-5.6 Terra (medium)$2.00R$ 11.40
466GPT-5.6 Terra (Non-reasoning)$2.00R$ 11.40
467GPT-5.6 Terra (xhigh)$2.00R$ 11.40
468GPT-6 Sol (high)$2.00R$ 11.40
469GPT-6 Sol (low)$2.00R$ 11.40
470GPT-6 Sol (max)$2.00R$ 11.40
471GPT-6 Sol (medium)$2.00R$ 11.40
472GPT-6 Sol (Non-reasoning)$2.00R$ 11.40
473GPT-6 Sol (xhigh)$2.00R$ 11.40
474GPT-6.1 Sol (high)$2.00R$ 11.40
475GPT-6.1 Sol (low)$2.00R$ 11.40
476GPT-6.1 Sol (max)$2.00R$ 11.40
477GPT-6.1 Sol (medium)$2.00R$ 11.40
478GPT-6.1 Sol (xhigh)$2.00R$ 11.40
479o3$2.00R$ 11.40
480o4 Mini Deep Research$2.00R$ 11.40
481OpenAI: GPT-6 Sol Pro$2.00R$ 11.40
482OpenAI: GPT-6.1 Sol Pro$2.00R$ 11.40
483Perplexity: Sonar Deep Research$2.00R$ 11.40
484Grok 4.20 0309 (Non-reasoning)$2.00R$ 11.40
485Grok 4.6 (low)$2.00R$ 11.40
486Grok 4.6 (medium)$2.00R$ 11.40
487Grok 4.6 (xhigh)$2.00R$ 11.40
488Grok 4.7 (high)$2.00R$ 11.40
489Grok 4.7 (Low)$2.00R$ 11.40
490Grok 4.7 (xhigh)$2.00R$ 11.40
491Grok 4.20 0309 (Reasoning)$2.00R$ 11.40
492SpaceXAI: Grok 4.5$2.00R$ 11.40
493SpaceXAI: Grok 4.6$2.00R$ 11.40
494Qwen3.7 Max$2.50R$ 14.25
495Nova Premier$2.50R$ 14.25
496Anthropic: Claude Opus 5 (batch)$2.50R$ 14.25
497Cohere: Command A$2.50R$ 14.25
498Cohere: Command R+ (08-2024)$2.50R$ 14.25
499Inflection: Inflection 3 Pi$2.50R$ 14.25
500Inflection: Inflection 3 Productivity$2.50R$ 14.25
501Llama 3.1 Instruct 405B$2.50R$ 14.25
502GPT Audio$2.50R$ 14.25
503GPT-4o (2024-08-06)$2.50R$ 14.25
504GPT-4o (2024-11-20)$2.50R$ 14.25
505GPT-4o Audio$2.50R$ 14.25
506GPT-4o Search Preview$2.50R$ 14.25
507GPT-5 Image Mini$2.50R$ 14.25
508GPT-5.4$2.50R$ 14.25
509GPT-5.4 (low)$2.50R$ 14.25
510GPT-5.4 (Non-reasoning)$2.50R$ 14.25
511OpenAI: GPT-4o$2.50R$ 14.25
512Claude 3 Sonnet$3.00R$ 17.10
513Claude 3.5 Sonnet (June '24)$3.00R$ 17.10
514Claude 3.5 Sonnet (Oct '24)$3.00R$ 17.10
515Claude 3.7 Sonnet$3.00R$ 17.10
516Claude 4 Sonnet (Reasoning)$3.00R$ 17.10
517Claude 4.5 Sonnet (Non-reasoning)$3.00R$ 17.10
518Claude 4.5 Sonnet (Reasoning)$3.00R$ 17.10
519Claude Sonnet 4$3.00R$ 17.10
520Claude Sonnet 4.5$3.00R$ 17.10
521Claude Sonnet 4.6$3.00R$ 17.10
522Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)$3.00R$ 17.10
523Claude Sonnet 4.6 (Non-reasoning, Low Effort)$3.00R$ 17.10
524Command-R+ (Apr '24)$3.00R$ 17.10
525Kimi K3 (low)$3.00R$ 17.10
526Magnum v4 72B$3.00R$ 17.10
527Kimi K3$3.00R$ 17.10
528OpenAI: GPT-3.5 Turbo 16k$3.00R$ 17.10
529Perplexity: Sonar Pro Search$3.00R$ 17.10
530Sao10K: Llama 3.1 70B Hanami x1$3.00R$ 17.10
531Grok 3 Beta$3.00R$ 17.10
532Grok 4$3.00R$ 17.10
533Goliath 120B$3.75R$ 21.38
534AionLabs: Aion-1.0$4.00R$ 22.80
535Claude Opus 5.5 (Adaptive Reasoning, High Effort, Default Fallback)$4.00R$ 22.80
536Claude Opus 5.5 (Adaptive Reasoning, Low Effort, Default Fallback)$4.00R$ 22.80
537Claude Opus 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)$4.00R$ 22.80
538Claude Opus 5.5 (Adaptive Reasoning, Medium Effort, Default Fallback)$4.00R$ 22.80
539Claude Opus 5.5 (Adaptive Reasoning, Xhigh Effort, Default Fallback)$4.00R$ 22.80
540Mistral Large 2 (Nov '24)$4.00R$ 22.80
541Mistral Large$4.00R$ 22.80
542GPT-5.6 Sol (high)$4.00R$ 22.80
543GPT-5.6 Sol (low)$4.00R$ 22.80
544GPT-5.6 Sol (max)$4.00R$ 22.80
545GPT-5.6 Sol (medium)$4.00R$ 22.80
546GPT-5.6 Sol (Non-reasoning)$4.00R$ 22.80
547GPT-5.6 Sol (xhigh)$4.00R$ 22.80
548Grok 3 Reasoning Beta$4.00R$ 22.80
549Anthropic: Claude Fable 5.1 (batch)$5.00R$ 28.50
550Claude Opus 4.5$5.00R$ 28.50
551Claude Opus 4.5 (Reasoning)$5.00R$ 28.50
552Claude Opus 4.6$5.00R$ 28.50
553Claude Opus 4.6 (Adaptive Reasoning, Max Effort)$5.00R$ 28.50
554Claude Opus 4.7$5.00R$ 28.50
555Claude Opus 4.7 (Non-reasoning, High Effort)$5.00R$ 28.50
556Claude Opus 4.8 (Adaptive Reasoning, Max Effort)$5.00R$ 28.50
557Claude Opus 5$5.00R$ 28.50
558Claude Opus 5 (Adaptive Reasoning, High Effort)$5.00R$ 28.50
559Claude Opus 5 (Adaptive Reasoning, Low Effort)$5.00R$ 28.50
560Claude Opus 5 (Adaptive Reasoning, Medium Effort)$5.00R$ 28.50
561Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)$5.00R$ 28.50
562GPT Chat Latest$5.00R$ 28.50
563GPT-5.5$5.00R$ 28.50
564GPT-5.5 (high)$5.00R$ 28.50
565GPT-5.5 (low)$5.00R$ 28.50
566GPT-5.5 (medium)$5.00R$ 28.50
567GPT-5.5 (Non-reasoning)$5.00R$ 28.50
568GPT-5.5 Instant (June 2026)$5.00R$ 28.50
569GPT-5.5 Instant (May 2026)$5.00R$ 28.50
570OpenAI: GPT-4o (2024-05-13)$5.00R$ 28.50
571OpenAI: GPT-6 Astra (batch)$5.00R$ 28.50
572OpenAI: GPT-6 Astra Pro (batch)$5.00R$ 28.50
573Anthropic: Claude Opus 4.1 (batch)$7.50R$ 42.75
574OpenAI: GPT-5 Pro (batch)$7.50R$ 42.75
575GPT-5.4 Image 2$8.00R$ 45.60
576Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)$10.00R$ 57.00
577Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)$10.00R$ 57.00
578Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)$10.00R$ 57.00
579Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)$10.00R$ 57.00
580Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback)$10.00R$ 57.00
581Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)$10.00R$ 57.00
582GPT-4 Turbo$10.00R$ 57.00
583GPT-5 Image$10.00R$ 57.00
584GPT-6 Astra (high)$10.00R$ 57.00
585GPT-6 Astra (low)$10.00R$ 57.00
586GPT-6 Astra (max)$10.00R$ 57.00
587GPT-6 Astra (medium)$10.00R$ 57.00
588GPT-6 Astra (xhigh)$10.00R$ 57.00
589o3 Deep Research$10.00R$ 57.00
590OpenAI: GPT-6 Astra Pro$10.00R$ 57.00
591OpenAI: o3 Pro (batch)$10.00R$ 57.00
592OpenAI: GPT-5.2 Pro (batch)$10.50R$ 59.85
593Claude 3 Opus$15.00R$ 85.50
594Claude 4 Opus (Reasoning)$15.00R$ 85.50
595Claude 4.1 Opus (Non-reasoning)$15.00R$ 85.50
596Claude 4.1 Opus (Reasoning)$15.00R$ 85.50
597Claude Opus 4$15.00R$ 85.50
598Claude Opus 4.1$15.00R$ 85.50
599o1$15.00R$ 85.50
600OpenAI: GPT-5.4 Pro (batch)$15.00R$ 85.50
601OpenAI: GPT-5.5 Pro (batch)$15.00R$ 85.50
602o1-preview$16.50R$ 94.05
603o3 Pro$20.00R$ 114.00
604GPT-5.4 Pro$30.00R$ 171.00
605OpenAI: GPT-4$30.00R$ 171.00
606OpenAI: o1-pro (batch)$75.00R$ 427.50
607o1-pro$150.00R$ 855.00

APIs com Plano Gratuito

Estes modelos oferecem acesso via API sem custo (com limites de rate). Ideais para protótipos e projetos de baixo volume.

Apriel-v1.5-15B-Thinker

ServiceNow

Grátis

Apriel-v1.6-15B-Thinker

ServiceNow

Grátis

Arctic Instruct

Snowflake

Grátis

Claude 2.0

Anthropic

Grátis

Claude 2.1

Anthropic

Grátis

Claude 3.5 Haiku

Anthropic

Grátis

Claude 3.7 Sonnet (thinking)

Anthropic

Grátis

Claude Instant

Anthropic

Grátis

Command A+

Cohere

Grátis

DBRX Instruct

Databricks

Grátis

DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)

Nous Research

Grátis

DeepHermes 3 - Mistral 24B Preview (Non-reasoning)

Nous Research

Grátis

DeepSeek Coder V2 Lite Instruct

DeepSeek

Grátis

DeepSeek LLM 67B Chat (V1)

DeepSeek

Grátis

DeepSeek R1 0528 Qwen3 8B

DeepSeek

Grátis

DeepSeek R1 Distill Llama 8B

DeepSeek

Grátis

DeepSeek R1 Distill Qwen 1.5B

DeepSeek

Grátis

DeepSeek R1 Distill Qwen 14B

DeepSeek

Grátis

DeepSeek V3.2 Speciale

DeepSeek

Grátis

DeepSeek-Coder-V2

DeepSeek

Grátis

DeepSeek-V2-Chat

DeepSeek

Grátis

DeepSeek-V2.5

DeepSeek

Grátis

DeepSeek-V2.5 (Dec '24)

DeepSeek

Grátis

DeepSeek: R1 Distill Qwen 32B

DeepSeek

Grátis

Devstral 2

Mistral

Grátis

Devstral Small (Jul '25)

Mistral

Grátis

Devstral Small (May '25)

Mistral

Grátis

Devstral Small 2

Mistral

Grátis

DiffusionGemma 26B A4B

Google

Grátis

Doubao Seed Code

ByteDance

Grátis

ERNIE 5.0 Thinking Preview

Baidu

Grátis

EXAONE 4.0 32B (Non-reasoning)

LG AI Research

Grátis

EXAONE 4.0 32B (Reasoning)

LG AI Research

Grátis

Falcon-H1R-7B

TII UAE

Grátis

G9v3-39A5B

AI9Stars

Grátis

G9v3-3B

AI9Stars

Grátis

Gemini 1.0 Pro

Google

Grátis

Gemini 1.0 Ultra

Google

Grátis

Gemini 1.5 Flash (May '24)

Google

Grátis

Gemini 1.5 Flash (Sep '24)

Google

Grátis

Gemini 1.5 Flash-8B

Google

Grátis

Gemini 1.5 Pro (May '24)

Google

Grátis

Gemini 1.5 Pro (Sep '24)

Google

Grátis

Gemini 2.0 Flash

Google

Grátis

Gemini 2.0 Flash (experimental)

Google

Grátis

Gemini 2.0 Flash Thinking Experimental (Dec '24)

Google

Grátis

Gemini 2.0 Flash Thinking Experimental (Jan '25)

Google

Grátis

Gemini 2.0 Flash-Lite (Feb '25)

Google

Grátis

Gemini 2.0 Flash-Lite (Preview)

Google

Grátis

Gemini 2.0 Pro Experimental (Feb '25)

Google

Grátis

Gemini 2.5 Flash Preview (Non-reasoning)

Google

Grátis

Gemini 2.5 Flash Preview (Sep '25) (Reasoning)

Google

Grátis

Gemini 2.5 Pro Preview (Mar' 25)

Google

Grátis

Gemini 3 Deep Think

Google

Grátis

Gemma 3 12B

Google

Grátis

Gemma 3 1B Instruct

Google

Grátis

Gemma 3 270M

Google

Grátis

Gemma 3 27B

Google

Grátis

Gemma 3 4B

Google

Grátis

Gemma 3n E2B Instruct

Google

Grátis

Gemma 3n E4B Instruct Preview (May '25)

Google

Grátis

Gemma 4 31B

Google

Grátis

Gemma 4 E2B (Non-reasoning)

Google

Grátis

Gemma 4 E2B (Reasoning)

Google

Grátis

GLM-4.5 (Reasoning)

Z.ai

Grátis

GLM-5-Turbo

Z.ai

Grátis

GPT-3.5 Turbo (0613)

OpenAI

Grátis

GPT-4.5 (Preview)

OpenAI

Grátis

GPT-4o (ChatGPT)

OpenAI

Grátis

GPT-4o (March 2025, chatgpt-4o-latest)

OpenAI

Grátis

GPT-4o mini Realtime (Dec '24)

OpenAI

Grátis

GPT-4o Realtime (Dec '24)

OpenAI

Grátis

GPT-5 (ChatGPT)

OpenAI

Grátis

Granite 4.0 1B

IBM

Grátis

Granite 4.0 350M

IBM

Grátis

Granite 4.0 H 1B

IBM

Grátis

Granite 4.0 H 350M

IBM

Grátis

Granite 4.0 Micro

IBM

Grátis

Granite 4.1 30B

IBM

Grátis

Granite 4.1 3B

IBM

Grátis

Grok 2 (Dec '24)

xAI

Grátis

Grok 4.1 Fast

xAI

Grátis

Grok Beta

xAI

Grátis

Grok Code Fast 1

xAI

Grátis

Grok-1

xAI

Grátis

HyperCLOVA X SEED Think (32B)

Naver

Grátis

INTELLECT-3

Prime Intellect

Grátis

Jamba 1.7 Mini

AI21 Labs

Grátis

Jamba Reasoning 3B

AI21 Labs

Grátis

JT-35B-Flash

China Mobile

Grátis

JT-4.1 Flash 236B A21B

China Mobile

Grátis

JT-MINI

China Mobile

Grátis

K2 Horizon 375B A23B

MBZUAI Institute of Foundation Models

Grátis

K2 Think V2

MBZUAI Institute of Foundation Models

Grátis

K2-V2 (medium)

MBZUAI Institute of Foundation Models

Grátis

KAT-Coder-Pro V1

KwaiKAT

Grátis

Kimi Linear 48B A3B Instruct

Kimi

Grátis

LFM 40B

Liquid AI

Grátis

LFM2 1.2B

Liquid AI

Grátis

LFM2 2.6B

Liquid AI

Grátis

LFM2 8B A1B

Liquid AI

Grátis

LFM2-24B-A2B

LiquidAI

Grátis

LFM2.5-1.2B-Instruct

Liquid AI

Grátis

LFM2.5-1.2B-Thinking

Liquid AI

Grátis

LFM2.5-2.6B

Grátis

LFM2.5-8B-A1B

Liquid AI

Grátis

LFM2.5-VL-1.6B

Liquid AI

Grátis

Ling 3.0 Tiny

InclusionAI

Grátis

Ling-1T

InclusionAI

Grátis

Ling-mini-2.0

InclusionAI

Grátis

Llama 2 Chat 13B

Meta

Grátis

Llama 2 Chat 70B

Meta

Grátis

Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning)

Nvidia

Grátis

Llama 3.1 Tulu3 405B

Allen Institute for AI

Grátis

Llama 3.2 1B Instruct

Meta

Grátis

Llama 3.2 3B Instruct

Meta

Grátis

Llama 3.2 Instruct 90B (Vision)

Meta

Grátis

Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)

Nvidia

Grátis

Llama 3.3 Nemotron Super 49B v1 (Reasoning)

Nvidia

Grátis

Llama 65B

Meta

Grátis

LongCat Flash Lite

LongCat

Grátis

Magistral Medium 1

Mistral

Grátis

Magistral Small 1

Mistral

Grátis

Mi:dm K 2.5 Pro

Korea Telecom

Grátis

Mi:dm K 2.5 Pro Preview

Korea Telecom

Grátis

MiMo-V2-Flash (Feb 2026)

Xiaomi

Grátis

MiMo-V2-Omni-0327

Xiaomi

Grátis

MiniCPM-V 4.6 1.3B

OpenBMB

Grátis

MiniCPM5-1B (Non-reasoning)

OpenBMB

Grátis

MiniMax M1 40k

MiniMax

Grátis

Mistral: Devstral Medium

Mistral AI

Grátis

Mistral: Pixtral Large 2411

Mistral AI

Grátis

Mixtral 8x22B Instruct

Mistral

Grátis

Molmo 7B-D

Allen Institute for AI

Grátis

Molmo2-8B

Allen Institute for AI

Grátis

Motif 3 (Beta)

Motif Technologies

Grátis

Motif-2-12.7B-Reasoning

Motif Technologies

Grátis

Muse Spark

Meta

Grátis

Nanbeige4.1-3B

Nanbeige

Grátis

Nemotron Cascade 2 30B A3B

Nvidia

Grátis

North Mini Code

Cohere

Grátis

NVIDIA Nemotron 3 Nano 4B

Nvidia

Grátis

o1-mini

OpenAI

Grátis

OLMo 2 32B

Allen Institute for AI

Grátis

OLMo 2 7B

Allen Institute for AI

Grátis

Olmo 3 32B Think

AllenAI

Grátis

Olmo 3 7B Think

Allen Institute for AI

Grátis

Olmo 3.1 32B Instruct

AllenAI

Grátis

Olmo 3.1 32B Think

Allen Institute for AI

Grátis

OpenChat 3.5 (1210)

OpenChat

Grátis

PALM-2

Google

Grátis

Phi-3 Mini Instruct 3.8B

Microsoft

Grátis

Phi-4 Mini Instruct

Microsoft

Grátis

Phi-4 Multimodal Instruct

Microsoft

Grátis

Qwen Chat 14B

Alibaba

Grátis

Qwen Chat 72B

Alibaba

Grátis

Qwen1.5 Chat 110B

Alibaba

Grátis

Qwen2 Instruct 72B

Alibaba

Grátis

Qwen2.5 Coder 32B Instruct

Alibaba

Grátis

Qwen2.5 Coder Instruct 7B

Alibaba

Grátis

Qwen2.5 Instruct 32B

Alibaba

Grátis

Qwen2.5 Max

Alibaba

Grátis

Qwen3 0.6B (Non-reasoning)

Alibaba

Grátis

Qwen3 0.6B (Reasoning)

Alibaba

Grátis

Qwen3 1.7B (Non-reasoning)

Alibaba

Grátis

Qwen3 1.7B (Reasoning)

Alibaba

Grátis

Qwen3 4B (Non-reasoning)

Alibaba

Grátis

Qwen3 4B (Reasoning)

Alibaba

Grátis

Qwen3 4B 2507 (Reasoning)

Alibaba

Grátis

Qwen3 4B 2507 Instruct

Alibaba

Grátis

Qwen3 VL 4B (Reasoning)

Alibaba

Grátis

Qwen3 VL 4B Instruct

Alibaba

Grátis

Qwen3.5 0.8B (Non-reasoning)

Alibaba

Grátis

Qwen3.5 0.8B (Reasoning)

Alibaba

Grátis

Qwen3.5 2B (Reasoning)

Alibaba

Grátis

QwQ 32B-Preview

Alibaba

Grátis

R1 1776

Perplexity

Grátis

Ring-1T

InclusionAI

Grátis

Sarvam M (Reasoning)

Sarvam

Grátis

Solar Open 100B (Reasoning)

Upstage

Grátis

Solar Pro 2 (Non-reasoning)

Upstage

Grátis

Solar Pro 2 (Preview) (Non-reasoning)

Upstage

Grátis

Solar Pro 2 (Preview) (Reasoning)

Upstage

Grátis

Sonar

Perplexity

Grátis

Sonar Reasoning

Perplexity

Grátis

Sonar Reasoning Pro

Perplexity

Grátis

Step3 VL 10B

StepFun

Grátis

Tiny Aya Global

Cohere

Grátis

Tri-21B-Think

Trillion Labs

Grátis

Tri-21B-think Preview

Trillion Labs

Grátis

Xiaomi: MiMo-V2-Omni

Xiaomi

Grátis

Xiaomi: MiMo-V2-Pro

Xiaomi

Grátis

Guia de Custo de APIs de IA para o Brasil

Como Funciona a Precificação por Token

A grande maioria das APIs de LLMs cobra por tokens processados, divididos em duas categorias: tokens de input(o texto que você envia ao modelo — seu prompt, contexto e histórico) e tokens de output (a resposta gerada pelo modelo). Em geral, o custo de output é 2–4× maior que o de input, pois requer mais computação para gerar.

Para o português brasileiro, 1.000 tokens equivalem a aproximadamente 750 palavras — ligeiramente menos eficiente que o inglês por causa de palavras mais longas e acentuação. Na prática, uma página A4 de texto corrido tem entre 600 e 900 tokens.

Exemplo Real de Custo Mensal

Imagine uma empresa que usa a API de um modelo intermediário da OpenAI para processar 100 e-mails por dia, com um prompt médio de 800 tokens e resposta de 300 tokens. Isso representa 110.000 tokens/dia × 30 dias = 3,3 milhões de tokens/mês. Com o preço de $2,50/M tokens de input e $10/M de output:

  • Input: 2,4M tokens × $2,50/M = $6,00/mês ≈ R$ 34.20/mês
  • Output: 0,9M tokens × $10/M = $9,00/mês ≈ R$ 51.30/mês
  • Total: $15,00/mês ≈ R$ 85.50/mês

O mesmo volume com um modelo compacto da Anthropic (a ~$0,25/M input) custaria apenas R$ 9.83/mês — uma economia significativa para casos onde a qualidade máxima não é crítica.

Estratégias para Reduzir Custos de API no Brasil

1. Escolha o modelo certo para cada tarefa: classificação simples de texto pode usar Gemini Flash ou um modelo compacto da Anthropic; reserve modelos frontier da OpenAI ou Anthropic para tarefas que realmente exigem raciocínio avançado.

2. Comprima os prompts: evite repetir contexto desnecessário. Sistemas de RAG bem implementados enviam apenas os trechos relevantes, não o documento inteiro.

3. Cache de respostas: se o mesmo prompt é enviado repetidamente (ex: categorização de produtos), armazene as respostas e reutilize. Providers como Anthropic oferecem prompt caching com desconto.

4. Use modelos open source via APIs de terceiros: Groq, Together AI e Fireworks oferecem modelos como Llama e Qwen por $0,01–$0,20/M tokens — 10–100× mais barato que os proprietários frontier.

IOF e Câmbio para Empresas Brasileiras

O pagamento das APIs de IA (OpenAI, Anthropic, Google) é feito em dólares americanos por cartão de crédito ou débito internacional. Para pessoas físicas, o IOF sobre compras internacionais foi zerado pelo governo Lula em janeiro de 2024 — você paga apenas o câmbio do cartão. Para pessoas jurídicas (CNPJ), as remessas internacionais ainda incidem IOF de 0,38%. Além do IOF, considere o spread do cartão (tipicamente 3–5% sobre o câmbio PTAX). Plataformas de pagamento como Wise podem oferecer câmbio mais próximo ao comercial.

Perguntas Frequentes sobre Custo de API

Quanto custa usar a API do ChatGPT em reais?

Em 2026, o modelo pago mais barato da OpenAI via API custa $0.024 por milhão de tokens de input e $0.112 por milhão de output. Com o câmbio em torno de R$ 5.70, veja a tabela de preços ao vivo acima para os valores convertidos e o ranking completo — os preços mudam com frequência.

Qual é a API de IA mais barata disponível para empresas brasileiras?

Modelos open source como Qwen, Llama e Gemma podem ser rodados via APIs de terceiros (Groq, Together AI, Fireworks) por frações de centavo por milhão de tokens — chegando a $0,01–$0,10/M tokens. Entre as APIs proprietárias, Gemini Flash e modelos compactos da Anthropic são as mais acessíveis, com preços a partir de $0,08–$0,25/M tokens de input.

Preciso pagar IOF ao usar APIs de IA no Brasil?

O IOF sobre compras internacionais no cartão de crédito foi zerado desde janeiro de 2024 para pessoas físicas. Empresas (CNPJ) ainda pagam IOF sobre remessas internacionais — consulte sua contabilidade. Os preços nesta tabela mostram o valor base em USD sem IOF adicional; inclua seu câmbio bancário real na estimativa final.

O que são tokens e como calcular o custo real do meu projeto?

Tokens são unidades de texto que os LLMs processam — em inglês, 1 token ≈ 4 caracteres; em português, pode ser um pouco menos por causa de acentuação. Uma página A4 tem ~600–800 tokens. Para estimar o custo: (tokens de input + tokens de output) × preço/1M tokens. Exemplo: prompt de 500 tokens + resposta de 300 tokens = 800 tokens × preço do modelo.

Vale mais a pena usar API ou assinar o plano premium do ChatGPT/Claude?

Para uso pessoal moderado, a assinatura (US$ 20/mês ≈ R$ 114/mês) costuma ser mais econômica. Para uso intensivo ou integração em produtos, a API é mais flexível e escalável. O ponto de virada geralmente acontece quando o consumo de tokens via API supera o custo da assinatura mensal.

Como os preços de API de IA variam ao longo do tempo?

Os preços caíram drasticamente: modelos frontier custavam $30/M tokens em 2023; hoje modelos equivalentes custam $2–5/M. A tendência é de queda contínua conforme a competição aumenta. Atualizamos esta tabela semanalmente — verifique sempre os preços oficiais antes de comprometer seu budget.

Explorar no Benchmark