Modelos de IA 2026Fichas Técnicas Completas

Especificações técnicas, preços, context window e capacidades de 835 modelos de IA de 105 empresas. Fichas atualizadas semanalmente com dados dos fabricantes.

Para ranking por performance, acesse o Benchmark de IA.

835

Modelos

105

Empresas

124

Open Source

187

Multimodal

1 modelo
ModeloOS
LFM2.5-2.6B
0
—

AI21 Labs

7 modelos
ModeloOS
AI21: Jamba Large 1.7
256K tokens·$2.00/1M
✅
Jamba 1.5 Large
$2.00/1M
—
Jamba 1.5 Mini
$0.20/1M
—
Jamba 1.6 Large
$2.00/1M
—
Jamba 1.6 Mini
$0.20/1M
—
Jamba 1.7 Mini
0
—
Jamba Reasoning 3B
0
—

AI9Stars

2 modelos
ModeloOS
G9v3-39A5B
0
—
G9v3-3B
0
—

Adobe

1 modelo
ModeloOS
Adobe Image5
—

AionLabs

3 modelos
ModeloOS
AionLabs: Aion-1.0
131K tokens·$4.00/1M
—
AionLabs: Aion-2.0
131K tokens·$0.80/1M
—
AionLabs: Aion-RP 1.0 (8B)
33K tokens·$0.80/1M
—

AlfredPros

1 modelo
ModeloOS
AlfredPros: CodeLLaMa 7B Instruct Solidity
4K tokens·$0.80/1M
✅

Alibaba

90 modelos
ModeloOS
Qwen Chat 14B
0
—
Qwen Chat 72B
0
—
Qwen: Qwen2.5 7B Instruct
33K tokens·$0.04/1M
✅
Qwen: Qwen2.5 VL 72B Instruct
32K tokens·$0.25/1M
✅
Qwen: Qwen3 235B A22B Instruct 2507
262K tokens·$0.70/1M
✅
Qwen: Qwen3 235B A22B Thinking 2507
131K tokens·$0.15/1M
✅
Qwen: Qwen3 30B A3B Instruct 2507
262K tokens·$0.20/1M
✅
Qwen: Qwen3 30B A3B Thinking 2507
131K tokens·$0.08/1M
✅
Qwen: Qwen3 Coder 30B A3B Instruct
160K tokens·$0.45/1M
✅
Qwen: Qwen3 Coder Next
262K tokens·$0.35/1M
✅
Qwen: Qwen3 Max
262K tokens·$1.20/1M
✅
Qwen: Qwen3 Max Thinking
262K tokens·$0.78/1M
✅
Qwen: Qwen3 Next 80B A3B Instruct
262K tokens·$0.15/1M
✅
Qwen: Qwen3 VL 235B A22B Instruct
262K tokens·$0.40/1M
✅
Qwen: Qwen3 VL 30B A3B Instruct
131K tokens·$0.20/1M
✅
Qwen: Qwen3 VL 32B Instruct
131K tokens·$0.16/1M
✅
Qwen: Qwen3 VL 8B Instruct
131K tokens·$0.18/1M
✅
Qwen: Qwen3.5 397B A17B
262K tokens·$0.60/1M
✅
Qwen: Qwen3.5-122B-A10B
262K tokens·$0.40/1M
✅
Qwen: Qwen3.5-27B
262K tokens·$0.30/1M
✅
Qwen: Qwen3.5-35B-A3B
262K tokens·$0.25/1M
✅
Qwen: Qwen3.6 35B A3B
262K tokens·$0.38/1M
✅
Qwen: Qwen3.6 Plus
1.0M tokens·$0.50/1M
✅
Qwen: Qwen3.8 2.4T A95B
1.0M tokens·$2.00/1M
✅
Qwen: Qwen3.8 Max
1.0M tokens·$2.00/1M
✅
Qwen1.5 Chat 110B
0
—
Qwen2 Instruct 72B
0
—
Qwen2.5 72B Instruct
33K tokens·$0.47/1M
✅
Qwen2.5 Coder 32B Instruct
33K tokens00
✅
Qwen2.5 Coder Instruct 7B
0
—
Qwen2.5 Instruct 32B
0
—
Qwen2.5 Max
0
—
Qwen2.5 Turbo
$0.05/1M
—
Qwen3 0.6B (Non-reasoning)
0
—
Qwen3 0.6B (Reasoning)
0
—
Qwen3 1.7B (Non-reasoning)
0
—
Qwen3 1.7B (Reasoning)
0
—
Qwen3 14B (Non-reasoning)
$0.35/1M
—
Qwen3 14B (Reasoning)
$0.35/1M
—
Qwen3 235B A22B (Reasoning)
$0.70/1M
—
Qwen3 235B A22B 2507 (Reasoning)
$0.23/1M
—
Qwen3 30B A3B (Reasoning)
$0.20/1M
—
Qwen3 30B A3B 2507 (Reasoning)
$0.20/1M
—
Qwen3 30B A3B 2507 Instruct
$0.20/1M
—
Qwen3 32B (Non-reasoning)
$0.16/1M
—
Qwen3 32B (Reasoning)
$0.16/1M
—
Qwen3 4B (Non-reasoning)
0
—
Qwen3 4B (Reasoning)
0
—
Qwen3 4B 2507 (Reasoning)
0
—
Qwen3 4B 2507 Instruct
0
—
Qwen3 8B (Non-reasoning)
$0.18/1M
—
Qwen3 8B (Reasoning)
$0.18/1M
—
Qwen3 Coder 480B A35B Instruct
$1.50/1M
—
Qwen3 Max (Preview)
$1.20/1M
—
Qwen3 Max Thinking (Preview)
$1.20/1M
—
Qwen3 Next 80B A3B (Reasoning)
$0.15/1M
—
Qwen3 Omni 30B A3B (Reasoning)
$0.25/1M
—
Qwen3 Omni 30B A3B Instruct
$0.25/1M
—
Qwen3 VL 235B A22B (Reasoning)
$0.40/1M
—
Qwen3 VL 30B A3B (Reasoning)
$0.20/1M
—
Qwen3 VL 32B (Reasoning)
$0.16/1M
—
Qwen3 VL 4B (Reasoning)
0
—
Qwen3 VL 4B Instruct
0
—
Qwen3 VL 8B (Reasoning)
$0.18/1M
—
Qwen3.5 0.8B (Non-reasoning)
0
—
Qwen3.5 0.8B (Reasoning)
0
—
Qwen3.5 122B A10B (Non-reasoning)
$0.40/1M
—
Qwen3.5 27B (Non-reasoning)
$0.30/1M
—
Qwen3.5 2B (Non-reasoning)
—
Qwen3.5 2B (Reasoning)
0
—
Qwen3.5 35B A3B (Non-reasoning)
$0.25/1M
—
Qwen3.5 397B A17B (Non-reasoning)
$0.60/1M
—
Qwen3.5 4B (Non-reasoning)
$0.03/1M
—
Qwen3.5 4B (Reasoning)
$0.03/1M
—
Qwen3.5 9B (Non-reasoning)
$0.17/1M
—
Qwen3.5 9B (Reasoning)
$0.14/1M
—
Qwen3.5 Omni Flash
$0.10/1M
—
Qwen3.5 Omni Plus
$0.40/1M
—
Qwen3.6 27B (Non-reasoning)
$0.60/1M
—
Qwen3.6 35B A3B (Non-reasoning)
$0.38/1M
—
Qwen3.6 Max Preview
$1.30/1M
—
Qwen3.7 Max
$2.50/1M
—
Qwen3.7 Plus
$0.40/1M
—
Qwen3.8 27B (low)
$0.50/1M
—
Qwen3.8 27B (medium)
$0.50/1M
—
Qwen3.8 27B (Non-reasoning)
$0.50/1M
—
Qwen3.8-Flash-Next
$0.15/1M
—
QwQ 32B
$0.66/1M
—
QwQ 32B-Preview
0
—
Wan 2.1
✅

Allen Institute for AI

8 modelos
ModeloOS
Llama 3.1 Tulu3 405B
0
—
Molmo 7B-D
0
—
Molmo2-8B
0
—
OLMo 2 32B
0
—
OLMo 2 7B
0
—
Olmo 3 7B Instruct
$0.10/1M
—
Olmo 3 7B Think
0
—
Olmo 3.1 32B Think
0
—

AllenAI

2 modelos
ModeloOS
Olmo 3 32B Think
66K tokens00
✅
Olmo 3.1 32B Instruct
66K tokens00
✅

Amazon

13 modelos
ModeloOS
Amazon: Nova 2 Lite
1.0M tokens·$0.30/1M
—
Amazon: Nova Lite 1.0
300K tokens·$0.06/1M
—
Amazon: Nova Micro 1.0
128K tokens·$0.04/1M
—
Amazon: Nova Pro 1.0
300K tokens·$0.80/1M
—
Nova 2.0 Lite (high)
$0.30/1M
—
Nova 2.0 Lite (low)
$0.30/1M
—
Nova 2.0 Lite (medium)
$0.30/1M
—
Nova 2.0 Omni (low)
$0.30/1M
—
Nova 2.0 Omni (medium)
$0.30/1M
—
Nova 2.0 Omni (Non-reasoning)
$0.30/1M
—
Nova 2.0 Pro Preview (low)
$1.25/1M
—
Nova 2.0 Pro Preview (medium)
$1.25/1M
—
Nova Premier
$2.50/1M
—

Anthropic

62 modelos
ModeloOS
Anthropic: Claude 3 Haiku
200K tokens·$0.25/1M
—
Anthropic: Claude Fable 5.1 (batch)
1.0M tokens·$5.00/1M
—
Anthropic: Claude Haiku 4.5 (batch)
200K tokens·$0.50/1M
—
Anthropic: Claude Opus 4.1 (batch)
200K tokens·$7.50/1M
—
Anthropic: Claude Opus 5 (batch)
1.0M tokens·$2.50/1M
—
Anthropic: Claude Opus 5.5 (batch)
1.0M tokens·$2.00/1M
—
Anthropic: Claude Sonnet 4.5 (batch)
1.0M tokens·$1.50/1M
—
Claude 2.0
0
—
Claude 2.1
0
—
Claude 3 Opus
$15.00/1M
—
Claude 3 Sonnet
$3.00/1M
—
Claude 3.5 Haiku
200K tokens00
—
Claude 3.5 Sonnet (June '24)
$3.00/1M
—
Claude 3.5 Sonnet (Oct '24)
$3.00/1M
—
Claude 3.7 Sonnet
200K tokens·$3.00/1M
—
Claude 3.7 Sonnet (thinking)
200K tokens00
—
Claude 4 Opus (Reasoning)
$15.00/1M
—
Claude 4 Sonnet (Reasoning)
$3.00/1M
—
Claude 4.1 Opus (Non-reasoning)
$15.00/1M
—
Claude 4.1 Opus (Reasoning)
$15.00/1M
—
Claude 4.5 Haiku (Reasoning)
$1.00/1M
—
Claude 4.5 Sonnet (Non-reasoning)
$3.00/1M
—
Claude 4.5 Sonnet (Reasoning)
$3.00/1M
—
Claude Code
—
Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)
1.0M tokens·$10.00/1M
—
Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)
$10.00/1M
—
Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback)
$10.00/1M
—
Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback)
1.0M tokens·$10.00/1M
—
Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback)
$10.00/1M
—
Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)
$10.00/1M
—
Claude Haiku 4.5
200K tokens·$1.00/1M
—
Claude Instant
0
—
Claude Opus 4
200K tokens·$15.00/1M
—
Claude Opus 4.1
200K tokens·$15.00/1M
—
Claude Opus 4.5
200K tokens·$5.00/1M
—
Claude Opus 4.5 (Reasoning)
$5.00/1M
—
Claude Opus 4.6
1.0M tokens·$5.00/1M
—
Claude Opus 4.6 (Adaptive Reasoning, Max Effort)
$5.00/1M
—
Claude Opus 4.7
1.0M tokens·$5.00/1M
—
Claude Opus 4.7 (Non-reasoning, High Effort)
$5.00/1M
—
Claude Opus 4.8 (Adaptive Reasoning, Max Effort)
1.0M tokens·$5.00/1M
—
Claude Opus 5
1.0M tokens·$5.00/1M
—
Claude Opus 5 (Adaptive Reasoning, High Effort)
1.0M tokens·$5.00/1M
—
Claude Opus 5 (Adaptive Reasoning, Low Effort)
$5.00/1M
—
Claude Opus 5 (Adaptive Reasoning, Medium Effort)
$5.00/1M
—
Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
$5.00/1M
—
Claude Opus 5.5 (Adaptive Reasoning, High Effort, Default Fallback)
$4.00/1M
—
Claude Opus 5.5 (Adaptive Reasoning, Low Effort, Default Fallback)
$4.00/1M
—
Claude Opus 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)
1.0M tokens·$4.00/1M
—
Claude Opus 5.5 (Adaptive Reasoning, Medium Effort, Default Fallback)
$4.00/1M
—
Claude Opus 5.5 (Adaptive Reasoning, Xhigh Effort, Default Fallback)
$4.00/1M
—
Claude Sonnet 4
200K tokens·$3.00/1M
—
Claude Sonnet 4.5
1.0M tokens·$3.00/1M
—
Claude Sonnet 4.6
1.0M tokens·$3.00/1M
—
Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)
$3.00/1M
—
Claude Sonnet 4.6 (Non-reasoning, Low Effort)
$3.00/1M
—
Claude Sonnet 5
1.0M tokens·$2.00/1M
—
Claude Sonnet 5 (Adaptive Reasoning, High Effort)
1.0M tokens·$2.00/1M
—
Claude Sonnet 5 (Adaptive Reasoning, Low Effort)
$2.00/1M
—
Claude Sonnet 5 (Adaptive Reasoning, Medium Effort)
1.0M tokens·$2.00/1M
—
Claude Sonnet 5 (Adaptive Reasoning, Xhigh Effort)
$2.00/1M
—
Claude Sonnet 5 (Non-reasoning, High Effort)
1.0M tokens·$2.00/1M
—

Apodex

1 modelo
ModeloOS
Apodex 1.1
$0.30/1M
—

Arcee AI

6 modelos
ModeloOS
Arcee AI: Coder Large
33K tokens·$0.50/1M
—
Arcee AI: Maestro Reasoning
131K tokens·$0.90/1M
—
Arcee AI: Spotlight
131K tokens·$0.18/1M
—
Arcee AI: Trinity Large Thinking
262K tokens·$0.25/1M
✅
Arcee AI: Trinity Mini
131K tokens·$0.04/1M
✅
Arcee AI: Virtuoso Large
131K tokens·$0.75/1M
—

Baidu

5 modelos
ModeloOS
Baidu: ERNIE 4.5 21B A3B Thinking
131K tokens·$0.07/1M
✅
Baidu: ERNIE 4.5 300B A47B
123K tokens·$0.28/1M
✅
Baidu: ERNIE 4.5 VL 28B A3B
30K tokens·$0.14/1M
✅
Baidu: ERNIE 4.5 VL 424B A47B
123K tokens·$0.42/1M
✅
ERNIE 5.0 Thinking Preview
0
—

Black Forest Labs

1 modelo
ModeloOS
FLUX1.1 [pro]
—

ByteDance

2 modelos
ModeloOS
ByteDance: UI-TARS 7B
128K tokens·$0.10/1M
✅
Doubao Seed Code
0
—

ByteDance Seed

3 modelos
ModeloOS
ByteDance Seed: Seed 1.6 Flash
262K tokens·$0.07/1M
—
ByteDance Seed: Seed-2.0-Lite
262K tokens·$0.25/1M
—
Seed-OSS-36B-Instruct
$0.21/1M
—

China Mobile

3 modelos
ModeloOS
JT-35B-Flash
0
—
JT-4.1 Flash 236B A21B
0
—
JT-MINI
0
—

Cognition

1 modelo
ModeloOS
Devin
—

Cohere

7 modelos
ModeloOS
Cohere: Command A
256K tokens·$2.50/1M
—
Cohere: Command R+ (08-2024)
128K tokens·$2.50/1M
—
Command A+
192K tokens00
—
Command-R (Mar '24)
$0.50/1M
—
Command-R+ (Apr '24)
$3.00/1M
—
North Mini Code
0
—
Tiny Aya Global
0
—

Databricks

1 modelo
ModeloOS
DBRX Instruct
0
—

Deep Cogito

2 modelos
ModeloOS
Cogito v2.1 (Reasoning)
$1.25/1M
—
Deep Cogito: Cogito v2.1 671B
128K tokens·$1.25/1M
—

DeepSeek

41 modelos
ModeloOS
DeepSeek Coder V2 Lite Instruct
0
—
DeepSeek LLM 67B Chat (V1)
0
—
DeepSeek R1 (Jan '25)
$2.00/1M
—
DeepSeek R1 0528 Qwen3 8B
0
—
DeepSeek R1 Distill Llama 8B
0
—
DeepSeek R1 Distill Qwen 1.5B
0
—
DeepSeek R1 Distill Qwen 14B
0
—
DeepSeek V3
164K tokens·$0.32/1M
✅
DeepSeek V3 0324
$0.84/1M
—
DeepSeek V3.1
164K tokens·$0.57/1M
✅
DeepSeek V3.1 (Reasoning)
$0.59/1M
—
DeepSeek V3.1 Terminus
164K tokens·$0.27/1M
✅
DeepSeek V3.1 Terminus (Reasoning)
$1.64/1M
—
DeepSeek V3.2
164K tokens·$0.28/1M
✅
DeepSeek V3.2 (Reasoning)
$0.28/1M
—
DeepSeek V3.2 Exp (Non-reasoning)
$0.28/1M
—
DeepSeek V3.2 Exp (Reasoning)
$0.28/1M
—
DeepSeek V3.2 Speciale
164K tokens00
✅
DeepSeek V4 Flash (Reasoning, High Effort)
$0.13/1M
—
DeepSeek V4 Flash 0420 (Non-reasoning)
$0.13/1M
—
DeepSeek V4 Flash Vision (Reasoning, Max Effort)
$0.44/1M
—
DeepSeek V4 Pro
1.0M tokens·$1.32/1M
✅
DeepSeek V4 Pro (Non-reasoning)
$0.43/1M
—
DeepSeek V4 Pro (Reasoning, High Effort)
$0.43/1M
—
DeepSeek V4.1 Flash (Non-Reasoning)
$0.30/1M
—
DeepSeek-Coder-V2
0
—
DeepSeek-V2-Chat
0
—
DeepSeek-V2.5
0
—
DeepSeek-V2.5 (Dec '24)
0
—
DeepSeek-V4-Flash
1.0M tokens·$0.44/1M
—
DeepSeek: DeepSeek V4 Flash 0423
1.0M tokens·$0.09/1M
✅
DeepSeek: DeepSeek V4 Flash 0731 (batch)
1.0M tokens·$0.11/1M
✅
DeepSeek: DeepSeek V4 Flash Vision Exp
1.0M tokens·$0.22/1M
✅
DeepSeek: DeepSeek V4 Flash Vision Exp (batch)
1.0M tokens·$0.11/1M
✅
DeepSeek: DeepSeek V4 Pro 0423
1.0M tokens·$0.94/1M
✅
DeepSeek: DeepSeek V4 Pro 0813 (batch)
1.0M tokens·$0.66/1M
✅
DeepSeek: DeepSeek V4.1 Flash
1.0M tokens·$0.30/1M
✅
DeepSeek: DeepSeek V4.1 Flash (batch)
1.0M tokens·$0.11/1M
✅
DeepSeek: R1
64K tokens·$1.35/1M
✅
DeepSeek: R1 Distill Qwen 32B
128K tokens00
✅
R1 Distill Llama 70B
8K tokens·$0.70/1M
✅

ElevenLabs

2 modelos
ModeloOS
Eleven v3
—
ElevenAgents
—

EssentialAI

1 modelo
ModeloOS
EssentialAI: Rnj 1 Instruct
33K tokens·$0.15/1M
✅

Goliath 120B

1 modelo
ModeloOS
Goliath 120B
6K tokens·$3.75/1M
✅

Google

84 modelos
ModeloOS
DiffusionGemma 26B A4B
0
—
Gemini 1.0 Pro
0
—
Gemini 1.0 Ultra
0
—
Gemini 1.5 Flash (May '24)
0
—
Gemini 1.5 Flash (Sep '24)
0
—
Gemini 1.5 Flash-8B
0
—
Gemini 1.5 Pro (May '24)
0
—
Gemini 1.5 Pro (Sep '24)
0
—
Gemini 2.0 Flash
1.0M tokens00
—
Gemini 2.0 Flash (experimental)
0
—
Gemini 2.0 Flash Lite
1.0M tokens·$0.07/1M
—
Gemini 2.0 Flash Thinking Experimental (Dec '24)
0
—
Gemini 2.0 Flash Thinking Experimental (Jan '25)
0
—
Gemini 2.0 Flash-Lite (Feb '25)
0
—
Gemini 2.0 Flash-Lite (Preview)
0
—
Gemini 2.0 Pro Experimental (Feb '25)
0
—
Gemini 2.5 Flash
1.0M tokens·$0.30/1M
—
Gemini 2.5 Flash Lite
1.0M tokens·$0.10/1M
—
Gemini 2.5 Flash Preview (Non-reasoning)
0
—
Gemini 2.5 Flash Preview (Reasoning)
$0.30/1M
—
Gemini 2.5 Flash Preview (Sep '25) (Reasoning)
0
—
Gemini 2.5 Flash-Lite (Reasoning)
$0.10/1M
—
Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)
$0.10/1M
—
Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)
$0.10/1M
—
Gemini 2.5 Pro
1.0M tokens·$1.25/1M
—
Gemini 2.5 Pro Preview (Mar' 25)
0
—
Gemini 2.5 Pro Preview (May' 25)
$1.25/1M
—
Gemini 2.5 Pro Preview 05-06
1.0M tokens·$1.25/1M
—
Gemini 3 Deep Think
0
—
Gemini 3 Flash Preview (Non-reasoning)
$0.50/1M
—
Gemini 3 Flash Preview (Reasoning)
$0.50/1M
—
Gemini 3 Pro Preview (high)
$2.00/1M
—
Gemini 3 Pro Preview (low)
$2.00/1M
—
Gemini 3.1 Flash Lite Preview
1.0M tokens·$0.25/1M
—
Gemini 3.1 Pro Preview
1.0M tokens·$2.00/1M
—
Gemini 3.1 Pro Preview Custom Tools
1.0M tokens·$2.00/1M
—
Gemini 3.5 Flash (medium)
$1.50/1M
—
Gemini 3.5 Flash (minimal)
$1.50/1M
—
Gemini 3.5 Flash-Lite
1.0M tokens·$0.30/1M
—
Gemini 3.6 Flash
$1.50/1M
—
Gemini 3.6 Flash (high)
1.0M tokens·$0.75/1M
—
Gemini 3.7 Flash (high)
1.0M tokens·$0.75/1M
—
Gemini 3.7 Flash (low)
$0.75/1M
—
Gemini 3.7 Flash (medium)
$0.75/1M
—
Gemini 3.8 Flash (high)
1.0M tokens·$0.75/1M
—
Gemini 3.8 Flash (low)
$0.75/1M
—
Gemini 3.8 Flash (medium)
$0.75/1M
—
Gemma 2 27B
8K tokens·$0.65/1M
—
Gemma 3 12B
131K tokens00
—
Gemma 3 1B Instruct
0
—
Gemma 3 270M
0
—
Gemma 3 27B
131K tokens00
—
Gemma 3 4B
131K tokens00
—
Gemma 3n 4B
33K tokens·$0.06/1M
—
Gemma 3n E2B Instruct
0
—
Gemma 3n E4B Instruct
$0.06/1M
—
Gemma 3n E4B Instruct Preview (May '25)
0
—
Gemma 4 12B (Non-reasoning)
$0.10/1M
—
Gemma 4 12B (Reasoning)
$0.10/1M
—
Gemma 4 26B A4B
262K tokens·$0.10/1M
—
Gemma 4 26B A4B (Non-reasoning)
$0.13/1M
—
Gemma 4 31B
262K tokens00
—
Gemma 4 31B (Non-reasoning)
$0.14/1M
—
Gemma 4 E2B (Non-reasoning)
0
—
Gemma 4 E2B (Reasoning)
0
—
Gemma 4 E4B (Non-reasoning)
$0.02/1M
—
Gemma 4 E4B (Reasoning)
$0.02/1M
—
Google: Gemini 2.5 Pro (batch)
1.0M tokens·$0.63/1M
—
Google: Gemini 3.1 Pro Preview (batch)
1.0M tokens·$1.00/1M
—
Google: Gemini 3.5 Flash
1.0M tokens·$1.50/1M
—
Google: Gemini 3.5 Flash (batch)
1.0M tokens·$0.75/1M
—
Google: Gemini 3.6 Flash (batch)
1.0M tokens·$0.38/1M
—
Google: Gemini 3.8 Flash (batch)
1.0M tokens·$0.38/1M
—
Google: Gemma 4 31B (batch)
262K tokens·$0.39/1M
—
Google: Nano Banana 2 (Gemini 3.1 Flash Image)
131K tokens·$0.50/1M
—
Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)
66K tokens·$0.25/1M
—
Google: Nano Banana Pro (Gemini 3 Pro Image)
131K tokens·$2.00/1M
—
Imagen 4
—
Lyria 3 Clip Preview
1.0M tokens
—
Lyria 3 Pro Preview
1.0M tokens
—
Nano Banana (Gemini 2.5 Flash Image)
33K tokens·$0.30/1M
—
Nano Banana 2 (Gemini 3.1 Flash Image Preview)
66K tokens·$0.50/1M
—
Nano Banana Pro (Gemini 3 Pro Image Preview)
66K tokens·$2.00/1M
—
PALM-2
0
—

IBM

13 modelos
ModeloOS
Granite 3.3 8B (Non-reasoning)
$0.03/1M
—
Granite 4.0 1B
0
—
Granite 4.0 350M
0
—
Granite 4.0 H 1B
0
—
Granite 4.0 H 350M
0
—
Granite 4.0 H Small
$0.06/1M
—
Granite 4.0 Micro
131K tokens00
✅
Granite 4.1 30B
0
—
Granite 4.1 3B
0
—
Granite 4.1 8B
$0.05/1M
—
Granite 4.2 30B
$0.16/1M
—
Granite 4.2 3B
$0.03/1M
—
Granite 4.2 8B
$0.06/1M
—

Ideogram

1 modelo
ModeloOS
Ideogram 4.0
✅

Inception

2 modelos
ModeloOS
Inception: Mercury 2
128K tokens·$0.25/1M
—
Mercury 2.5
$0.25/1M
—

Inclusion AI

2 modelos
ModeloOS
Ling 2.6 Flash
$0.10/1M
—
Ling-2.6-1T
$0.30/1M
—

InclusionAI

10 modelos
ModeloOS
Ling 3.0 Flash
$0.07/1M
—
Ling 3.0 Tiny
0
—
Ling-1T
0
—
Ling-3.0-flash-Fin
$0.07/1M
—
Ling-3.0-flash-VL
$0.07/1M
—
Ling-flash-2.0
$0.14/1M
—
Ling-mini-2.0
0
—
Ring-1T
0
—
Ring-2.6-1T
$0.30/1M
—
Ring-flash-2.0
$0.14/1M
—

Inflection

2 modelos
ModeloOS
Inflection: Inflection 3 Pi
8K tokens·$2.50/1M
—
Inflection: Inflection 3 Productivity
8K tokens·$2.50/1M
—

Institute of Foundation Models

4 modelos
ModeloOS
K2 Horizon 0.9B
—
K2 Horizon 3.7B
—
K2 Horizon 7B
—
K2 Horizon MoVA 36B A4B
—

Kimi

6 modelos
ModeloOS
Kimi K2 Thinking
262K tokens·$0.60/1M
—
Kimi K2.5 (Non-reasoning)
$0.60/1M
—
Kimi K2.6 (Non-reasoning)
$0.95/1M
—
Kimi K2.7 Code
$0.95/1M
—
Kimi K3 (low)
1.0M tokens·$3.00/1M
—
Kimi Linear 48B A3B Instruct
0
—

Kling AI

1 modelo
ModeloOS
Kling 2.1
—

Korea Telecom

2 modelos
ModeloOS
Mi:dm K 2.5 Pro
0
—
Mi:dm K 2.5 Pro Preview
0
—

Kuaishou

1 modelo
ModeloOS
Kling AI 2.0
—

KwaiKAT

1 modelo
ModeloOS
KAT-Coder-Pro V1
0
—

Kwaipilot

1 modelo
ModeloOS
Kwaipilot: KAT-Coder-Pro V2
256K tokens·$0.30/1M
—

LG AI Research

6 modelos
ModeloOS
Exaone 4.0 1.2B (Reasoning)
—
EXAONE 4.0 32B (Non-reasoning)
0
—
EXAONE 4.0 32B (Reasoning)
0
—
EXAONE 4.5 33B (Non-reasoning)
—
K-EXAONE (Non-reasoning)
—
K-EXAONE 2.0 0803
—

Liquid AI

8 modelos
ModeloOS
LFM 40B
0
—
LFM2 1.2B
0
—
LFM2 2.6B
0
—
LFM2 8B A1B
0
—
LFM2.5-1.2B-Instruct
0
—
LFM2.5-1.2B-Thinking
0
—
LFM2.5-8B-A1B
0
—
LFM2.5-VL-1.6B
0
—

LiquidAI

1 modelo
ModeloOS
LFM2-24B-A2B
33K tokens00
✅

LongCat

2 modelos
ModeloOS
LongCat 2.0
$0.30/1M
—
LongCat Flash Lite
0
—

Luma AI

2 modelos
ModeloOS
Luma Dream Machine 1.6
—
Luma Ray3.2
—

MBZUAI Institute of Foundation Models

4 modelos
ModeloOS
K2 Horizon 375B A23B
—
K2 Think V2
0
—
K2-V2 (low)
—
K2-V2 (medium)
0
—

Magnum v4 72B

1 modelo
ModeloOS
Magnum v4 72B
16K tokens·$3.00/1M
✅

Mancer

1 modelo
ModeloOS
Mancer: Weaver (alpha)
8K tokens·$0.75/1M
—

Meta

25 modelos
ModeloOS
Llama 2 Chat 13B
0
—
Llama 2 Chat 70B
0
—
Llama 2 Chat 7B
$0.05/1M
—
Llama 3 70B Instruct
8K tokens·$0.65/1M
✅
Llama 3 8B Instruct
8K tokens·$0.04/1M
✅
Llama 3.1 70B Instruct
131K tokens·$0.56/1M
✅
Llama 3.1 8B Instruct
16K tokens·$0.02/1M
✅
Llama 3.1 Instruct 405B
$2.50/1M
—
Llama 3.2 11B Vision Instruct
131K tokens·$0.34/1M
✅
Llama 3.2 1B Instruct
60K tokens00
✅
Llama 3.2 3B Instruct
80K tokens00
✅
Llama 3.2 Instruct 90B (Vision)
0
—
Llama 3.3 70B Instruct
131K tokens·$0.71/1M
✅
Llama 4 Maverick
1.0M tokens·$0.26/1M
✅
Llama 4 Scout
1.3M tokens·$0.19/1M
✅
Llama 65B
0
—
Llama Guard 3 8B
131K tokens·$0.48/1M
✅
Llama Guard 4 12B
164K tokens·$0.18/1M
✅
Muse Glimmer (high)
$0.32/1M
—
Muse Spark
0
—
Muse Spark 1.1
$1.25/1M
—
Muse Spark 1.1 (xhigh)
$1.25/1M
—
Muse Spark 1.2 (xhigh)
$1.25/1M
—
Muse Spark 1.3 (max)
$1.25/1M
—
Muse Spark 1.3 (xhigh)
$1.25/1M
—

Microsoft

5 modelos
ModeloOS
Microsoft: Phi 4
16K tokens·$0.13/1M
✅
Phi-3 Mini Instruct 3.8B
0
—
Phi-4 Mini Instruct
0
—
Phi-4 Multimodal Instruct
0
—
WizardLM-2 8x22B
66K tokens·$0.62/1M
✅

Midjourney

1 modelo
ModeloOS
Midjourney V8.1
—

MiniMax

14 modelos
ModeloOS
Hailuo 2.3
—
Hailuo MiniMax Video-01
—
MiniMax M1 40k
0
—
MiniMax M1 80k
$0.55/1M
—
MiniMax-M2
205K tokens·$0.30/1M
—
MiniMax-M3
1.0M tokens·$0.30/1M
—
MiniMax: MiniMax M1
1.0M tokens·$0.40/1M
—
MiniMax: MiniMax M2-her
66K tokens·$0.30/1M
—
MiniMax: MiniMax M2.1
197K tokens·$0.30/1M
✅
MiniMax: MiniMax M2.5
197K tokens·$0.30/1M
✅
MiniMax: MiniMax M2.7
197K tokens·$0.30/1M
✅
MiniMax: MiniMax-01
1.0M tokens·$0.20/1M
✅
Music 2.6
—
Speech 2.8
—

Mistral

23 modelos
ModeloOS
Devstral 2
0
—
Devstral Small (Jul '25)
131K tokens00
—
Devstral Small (May '25)
0
—
Devstral Small 2
0
—
Magistral Medium 1
0
—
Magistral Small 1
0
—
Magistral Small 1.2
$0.50/1M
—
Ministral 3 14B
$0.20/1M
—
Ministral 3 3B
$0.10/1M
—
Ministral 3 8B
$0.15/1M
—
Mistral 7B Instruct
$0.15/1M
—
Mistral Large 2 (Jul '24)
131K tokens·$2.00/1M
—
Mistral Large 2 (Nov '24)
$4.00/1M
—
Mistral Large 3
$0.50/1M
—
Mistral Medium
$1.50/1M
—
Mistral Medium 3.5
262K tokens·$1.50/1M
—
Mistral Small (Feb '24)
$0.15/1M
—
Mistral Small (Sep '24)
$0.20/1M
—
Mistral Small 3
$0.05/1M
—
Mistral Small 3.1
$0.11/1M
—
Mistral Small 3.2
$0.07/1M
—
Mistral Small 4 (Non-reasoning)
$0.15/1M
—
Mixtral 8x22B Instruct
0
—

Mistral AI

18 modelos
ModeloOS
Magistral Medium 1.2
$2.00/1M
—
Mistral Large
128K tokens·$4.00/1M
✅
Mistral: Codestral 2508
256K tokens·$0.30/1M
—
Mistral: Codestral 2508 (batch)
256K tokens·$0.15/1M
✅
Mistral: Devstral Medium
131K tokens00
✅
Mistral: Ministral 3 8B 2512 (batch)
262K tokens·$0.07/1M
✅
Mistral: Ministral 8B
128K tokens·$0.11/1M
✅
Mistral: Mistral Large 3 2512 (batch)
262K tokens·$0.25/1M
✅
Mistral: Mistral Medium 3
131K tokens·$0.40/1M
✅
Mistral: Mistral Medium 3.1
131K tokens·$0.40/1M
✅
Mistral: Mistral Medium 3.1 (batch)
131K tokens·$0.20/1M
✅
Mistral: Mistral Medium 3.5 (batch)
262K tokens·$0.75/1M
✅
Mistral: Mistral Nemo
131K tokens·$0.02/1M
✅
Mistral: Mistral Small 4 (batch)
262K tokens·$0.07/1M
✅
Mistral: Mixtral 8x7B Instruct
33K tokens·$0.45/1M
✅
Mistral: Pixtral Large 2411
131K tokens00
—
Mistral: Saba
33K tokens·$0.20/1M
✅
Mistral: Voxtral Small 24B 2507
32K tokens·$0.10/1M
✅

Moonshot AI

2 modelos
ModeloOS
Kimi K2
131K tokens·$0.57/1M
—
Kimi K3
1.0M tokens·$3.00/1M
—

MoonshotAI

3 modelos
ModeloOS
MoonshotAI: Kimi K2 0711
131K tokens·$0.57/1M
✅
MoonshotAI: Kimi K2 0905
262K tokens·$0.60/1M
✅
MoonshotAI: Kimi K2.5
262K tokens·$0.60/1M
✅

Morph

2 modelos
ModeloOS
Morph: Morph V3 Fast
82K tokens·$0.80/1M
—
Morph: Morph V3 Large
262K tokens·$0.90/1M
—

Motif Technologies

3 modelos
ModeloOS
Motif 3
—
Motif 3 (Beta)
0
—
Motif-2-12.7B-Reasoning
0
—

Multiverse Computing

2 modelos
ModeloOS
HyperNova 60B 2605
$0.04/1M
—
Quasar 438B
$0.60/1M
—

MythoMax 13B

1 modelo
ModeloOS
MythoMax 13B
4K tokens·$0.06/1M
✅

NVIDIA

1 modelo
ModeloOS
Nemotron 3.5 Lightning
262K tokens·$0.07/1M
—

Nanbeige

1 modelo
ModeloOS
Nanbeige4.1-3B
0
—

Naver

1 modelo
ModeloOS
HyperCLOVA X SEED Think (32B)
0
—

Nex AGI

2 modelos
ModeloOS
Nex AGI: DeepSeek V3.1 Nex N1
131K tokens·$0.14/1M
✅
Nex-N2-Pro
262K tokens·$0.50/1M
—

Nous

4 modelos
ModeloOS
Nous: Hermes 3 405B Instruct
131K tokens·$1.00/1M
✅
Nous: Hermes 3 70B Instruct
131K tokens·$0.30/1M
✅
Nous: Hermes 4 405B
131K tokens·$1.00/1M
✅
Nous: Hermes 4 70B
131K tokens·$0.13/1M
✅

Nous Research

7 modelos
ModeloOS
DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)
0
—
DeepHermes 3 - Mistral 24B Preview (Non-reasoning)
0
—
Hermes 3 - Llama-3.1 70B
$0.70/1M
—
Hermes 4 - Llama-3.1 405B (Non-reasoning)
$1.00/1M
—
Hermes 4 - Llama-3.1 405B (Reasoning)
$1.00/1M
—
Hermes 4 - Llama-3.1 70B (Non-reasoning)
$0.13/1M
—
Hermes 4 - Llama-3.1 70B (Reasoning)
$0.13/1M
—

NousResearch

1 modelo
ModeloOS
NousResearch: Hermes 2 Pro - Llama-3 8B
8K tokens·$0.14/1M
✅

Nvidia

18 modelos
ModeloOS
Llama 3.1 Nemotron 70B Instruct
131K tokens·$1.20/1M
✅
Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning)
0
—
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)
$0.60/1M
—
Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)
0
—
Llama 3.3 Nemotron Super 49B v1 (Reasoning)
0
—
Llama Nemotron Super 49B v1.5 (Non-reasoning)
$0.40/1M
—
Llama Nemotron Super 49B v1.5 (Reasoning)
$0.40/1M
—
Nemotron 3 Nano Omni 30B A3B Reasoning
$0.20/1M
—
Nemotron 3 Ultra 550B A55B (Reasoning)
1.0M tokens·$0.60/1M
—
Nemotron Cascade 2 30B A3B
0
—
NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)
$0.05/1M
—
NVIDIA Nemotron 3 Nano 4B
0
—
NVIDIA Nemotron 3 Super 120B A12B (Reasoning)
1.0M tokens·$0.30/1M
—
NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)
$0.20/1M
—
NVIDIA Nemotron Nano 12B v2 VL (Reasoning)
$0.20/1M
—
NVIDIA Nemotron Nano 9B V2 (Reasoning)
$0.04/1M
—
NVIDIA: Nemotron 3 Nano 30B A3B
262K tokens·$0.05/1M
—
NVIDIA: Nemotron Nano 9B V2
131K tokens·$0.05/1M
—

OpenAI

150 modelos
ModeloOS
Codex
—
Deep Research
—
GPT Audio
128K tokens·$2.50/1M
—
GPT Audio Mini
128K tokens·$0.60/1M
—
GPT Chat Latest
400K tokens·$5.00/1M
—
GPT Image 2
—
GPT-3.5 Turbo
$0.50/1M
—
GPT-3.5 Turbo (0613)
0
—
GPT-4 Turbo
128K tokens·$10.00/1M
—
GPT-4.1
1.0M tokens·$2.00/1M
—
GPT-4.1 Mini
1.0M tokens·$0.40/1M
—
GPT-4.1 Nano
1.0M tokens·$0.10/1M
—
GPT-4.5 (Preview)
0
—
GPT-4o (2024-08-06)
128K tokens·$2.50/1M
—
GPT-4o (2024-11-20)
128K tokens·$2.50/1M
—
GPT-4o (ChatGPT)
0
—
GPT-4o (March 2025, chatgpt-4o-latest)
0
—
GPT-4o Audio
128K tokens·$2.50/1M
—
GPT-4o mini Realtime (Dec '24)
0
—
GPT-4o Realtime (Dec '24)
0
—
GPT-4o Search Preview
128K tokens·$2.50/1M
—
GPT-4o Transcribe
—
GPT-4o-mini (2024-07-18)
128K tokens·$0.15/1M
—
GPT-4o-mini Search Preview
128K tokens·$0.15/1M
—
GPT-5
400K tokens·$1.25/1M
—
GPT-5 (ChatGPT)
0
—
GPT-5 (low)
400K tokens·$1.25/1M
—
GPT-5 (medium)
400K tokens·$1.25/1M
—
GPT-5 (minimal)
$1.25/1M
—
GPT-5 Codex
400K tokens·$1.25/1M
—
GPT-5 Image
400K tokens·$10.00/1M
—
GPT-5 Image Mini
400K tokens·$2.50/1M
—
GPT-5 Mini
400K tokens·$0.25/1M
—
GPT-5 mini (medium)
$0.25/1M
—
GPT-5 mini (minimal)
$0.25/1M
—
GPT-5 Nano
400K tokens·$0.05/1M
—
GPT-5 nano (medium)
$0.05/1M
—
GPT-5 nano (minimal)
$0.05/1M
—
GPT-5.1
400K tokens·$1.25/1M
—
GPT-5.1 (Non-reasoning)
$1.25/1M
—
GPT-5.1-Codex
400K tokens·$1.25/1M
—
GPT-5.1-Codex-Mini
400K tokens·$0.25/1M
—
GPT-5.2
400K tokens·$1.75/1M
—
GPT-5.2 (medium)
$1.75/1M
—
GPT-5.2 (Non-reasoning)
$1.75/1M
—
GPT-5.2-Codex
400K tokens·$1.75/1M
—
GPT-5.3 Chat
128K tokens·$1.75/1M
—
GPT-5.3-Codex
400K tokens·$1.75/1M
—
GPT-5.4
1.1M tokens·$2.50/1M
—
GPT-5.4 (low)
$2.50/1M
—
GPT-5.4 (Non-reasoning)
$2.50/1M
—
GPT-5.4 Image 2
272K tokens·$8.00/1M
—
GPT-5.4 Mini
400K tokens·$0.75/1M
—
GPT-5.4 mini (medium)
$0.75/1M
—
GPT-5.4 mini (Non-Reasoning)
$0.75/1M
—
GPT-5.4 Nano
400K tokens·$0.20/1M
—
GPT-5.4 nano (medium)
$0.20/1M
—
GPT-5.4 nano (Non-Reasoning)
$0.20/1M
—
GPT-5.4 Pro
1.1M tokens·$30.00/1M
—
GPT-5.5
1.1M tokens·$5.00/1M
—
GPT-5.5 (high)
$5.00/1M
—
GPT-5.5 (low)
$5.00/1M
—
GPT-5.5 (medium)
$5.00/1M
—
GPT-5.5 (Non-reasoning)
$5.00/1M
—
GPT-5.5 Instant (June 2026)
$5.00/1M
—
GPT-5.5 Instant (May 2026)
$5.00/1M
—
GPT-5.6 Luna (high)
$0.20/1M
—
GPT-5.6 Luna (low)
$0.20/1M
—
GPT-5.6 Luna (max)
1.1M tokens·$0.20/1M
—
GPT-5.6 Luna (medium)
$0.20/1M
—
GPT-5.6 Luna (Non-reasoning)
$0.20/1M
—
GPT-5.6 Luna (xhigh)
$0.20/1M
—
GPT-5.6 Sol (high)
$4.00/1M
—
GPT-5.6 Sol (low)
$4.00/1M
—
GPT-5.6 Sol (max)
1.1M tokens·$4.00/1M
—
GPT-5.6 Sol (medium)
$4.00/1M
—
GPT-5.6 Sol (Non-reasoning)
$4.00/1M
—
GPT-5.6 Sol (xhigh)
$4.00/1M
—
GPT-5.6 Terra (high)
$2.00/1M
—
GPT-5.6 Terra (low)
$2.00/1M
—
GPT-5.6 Terra (max)
1.1M tokens·$2.00/1M
—
GPT-5.6 Terra (medium)
$2.00/1M
—
GPT-5.6 Terra (Non-reasoning)
$2.00/1M
—
GPT-5.6 Terra (xhigh)
$2.00/1M
—
GPT-6 Astra (high)
$10.00/1M
—
GPT-6 Astra (low)
$10.00/1M
—
GPT-6 Astra (max)
1.1M tokens·$10.00/1M
—
GPT-6 Astra (medium)
$10.00/1M
—
GPT-6 Astra (xhigh)
$10.00/1M
—
GPT-6 Luna (high)
$0.10/1M
—
GPT-6 Luna (low)
$0.10/1M
—
GPT-6 Luna (max)
1.1M tokens·$0.10/1M
—
GPT-6 Luna (medium)
$0.10/1M
—
GPT-6 Luna (Non-reasoning)
$0.10/1M
—
GPT-6 Luna (xhigh)
$0.10/1M
—
GPT-6 Sol (high)
$2.00/1M
—
GPT-6 Sol (low)
$2.00/1M
—
GPT-6 Sol (max)
1.1M tokens·$2.00/1M
—
GPT-6 Sol (medium)
$2.00/1M
—
GPT-6 Sol (Non-reasoning)
$2.00/1M
—
GPT-6 Sol (xhigh)
$2.00/1M
—
gpt-oss-120b
131K tokens·$0.15/1M
—
gpt-oss-120b (low)
131K tokens·$0.15/1M
—
gpt-oss-20b
131K tokens·$0.07/1M
—
gpt-oss-20b (low)
$0.07/1M
—
gpt-oss-safeguard-20b
131K tokens·$0.07/1M
—
GPT-Realtime-Whisper
—
o1
200K tokens·$15.00/1M
—
o1-mini
0
—
o1-preview
$16.50/1M
—
o1-pro
200K tokens·$150.00/1M
—
o3
200K tokens·$2.00/1M
—
o3 Deep Research
200K tokens·$10.00/1M
—
o3 Mini
200K tokens·$1.10/1M
—
o3 Mini High
200K tokens·$1.10/1M
—
o3 Pro
200K tokens·$20.00/1M
—
o4 Mini
200K tokens·$1.10/1M
—
o4 Mini Deep Research
200K tokens·$2.00/1M
—
o4 Mini High
200K tokens·$1.10/1M
—
OpenAI: GPT-3.5 Turbo 16k
16K tokens·$3.00/1M
—
OpenAI: GPT-4
8K tokens·$30.00/1M
—
OpenAI: GPT-4o
128K tokens·$2.50/1M
—
OpenAI: GPT-4o (2024-05-13)
128K tokens·$5.00/1M
—
OpenAI: GPT-4o-mini
128K tokens·$0.15/1M
—
OpenAI: GPT-5 Pro (batch)
400K tokens·$7.50/1M
—
OpenAI: GPT-5.2 Pro (batch)
400K tokens·$10.50/1M
—
OpenAI: GPT-5.4 Pro (batch)
1.1M tokens·$15.00/1M
—
OpenAI: GPT-5.5 Pro (batch)
1.1M tokens·$15.00/1M
—
OpenAI: GPT-5.6 Luna (batch)
1.1M tokens·$0.10/1M
—
OpenAI: GPT-5.6 Luna Pro
1.1M tokens·$0.20/1M
—
OpenAI: GPT-5.6 Luna Pro (batch)
1.1M tokens·$0.10/1M
—
OpenAI: GPT-5.6 Sol Pro (batch)
1.1M tokens·$1.00/1M
—
OpenAI: GPT-5.6 Terra Pro (batch)
1.1M tokens·$1.00/1M
—
OpenAI: GPT-6 Astra (batch)
1.1M tokens·$5.00/1M
—
OpenAI: GPT-6 Astra Pro
1.1M tokens·$10.00/1M
—
OpenAI: GPT-6 Astra Pro (batch)
1.1M tokens·$5.00/1M
—
OpenAI: GPT-6 Luna (batch)
1.1M tokens·$0.05/1M
—
OpenAI: GPT-6 Luna Pro
1.1M tokens·$0.10/1M
—
OpenAI: GPT-6 Luna Pro (batch)
1.1M tokens·$0.05/1M
—
OpenAI: GPT-6 Sol (batch)
1.1M tokens·$1.00/1M
—
OpenAI: GPT-6 Sol Pro
1.1M tokens·$2.00/1M
—
OpenAI: GPT-6 Sol Pro (batch)
1.1M tokens·$1.00/1M
—
OpenAI: gpt-oss-120b (batch)
131K tokens·$0.03/1M
—
OpenAI: gpt-oss-20b (batch)
131K tokens·$0.02/1M
—
OpenAI: o1-pro (batch)
200K tokens·$75.00/1M
—
OpenAI: o3 Mini High (batch)
200K tokens·$0.55/1M
—
OpenAI: o3 Pro (batch)
200K tokens·$10.00/1M
—
OpenAI: o4 Mini High (batch)
200K tokens·$0.55/1M
—
Sora
—
Sora 2
—

OpenBMB

4 modelos
ModeloOS
MiniCPM-V 4.6 1.3B
0
—
MiniCPM5-1B (Non-reasoning)
0
—
MiniCPM5-1B (Reasoning)
—
MiniCPM5-2B
—

OpenChat

1 modelo
ModeloOS
OpenChat 3.5 (1210)
0
—

Perplexity

6 modelos
ModeloOS
Perplexity: Sonar Deep Research
128K tokens·$2.00/1M
—
Perplexity: Sonar Pro Search
200K tokens·$3.00/1M
—
R1 1776
0
—
Sonar
127K tokens00
—
Sonar Reasoning
127K tokens00
—
Sonar Reasoning Pro
128K tokens00
—

Pika

1 modelo
ModeloOS
Pika 2.5
—

Pika Labs

1 modelo
ModeloOS
Pika 2.1
—

Prime Intellect

1 modelo
ModeloOS
INTELLECT-3
131K tokens00
✅

ReMM SLERP 13B

1 modelo
ModeloOS
ReMM SLERP 13B
6K tokens·$0.45/1M
✅

Recraft

1 modelo
ModeloOS
Recraft V4.1
—

Reka Edge

1 modelo
ModeloOS
Reka Edge
16K tokens·$0.10/1M
✅

Reka Flash 3

1 modelo
ModeloOS
Reka Flash 3
66K tokens·$0.20/1M
✅

Relace

2 modelos
ModeloOS
Relace: Relace Apply 3
256K tokens·$0.85/1M
—
Relace: Relace Search
256K tokens·$1.00/1M
—

Runway

2 modelos
ModeloOS
Runway Gen-3 Alpha
—
Runway Gen-4.5
—

SK Telecom

1 modelo
ModeloOS
A.X-K2
—

Sao10K

5 modelos
ModeloOS
Sao10K: Llama 3 8B Lunaris
8K tokens·$0.04/1M
✅
Sao10k: Llama 3 Euryale 70B v2.1
8K tokens·$1.48/1M
✅
Sao10K: Llama 3.1 70B Hanami x1
16K tokens·$3.00/1M
✅
Sao10K: Llama 3.1 Euryale 70B v2.2
131K tokens·$0.85/1M
✅
Sao10K: Llama 3.3 Euryale 70B
131K tokens·$0.65/1M
✅

Sapiens AI

3 modelos
ModeloOS
Agnes 2.5 Pro Alpha
$0.45/1M
—
Agnes 2.5 Pro Beta
$0.10/1M
—
Agnes 3.0 Flash
$0.05/1M
—

Sarvam

3 modelos
ModeloOS
Sarvam 105B (high)
$0.04/1M
—
Sarvam 30B
$0.03/1M
—
Sarvam M (Reasoning)
0
—

ServiceNow

2 modelos
ModeloOS
Apriel-v1.5-15B-Thinker
0
—
Apriel-v1.6-15B-Thinker
0
—

Snowflake

1 modelo
ModeloOS
Arctic Instruct
0
—

SpaceXAI

14 modelos
ModeloOS
Grok 3 mini Reasoning (high)
$0.30/1M
—
Grok 3 Reasoning Beta
$4.00/1M
—
Grok 4 Fast (Reasoning)
$0.20/1M
—
Grok 4.1 Fast (Reasoning)
—
Grok 4.20 0309 (Non-reasoning)
$2.00/1M
—
Grok 4.20 0309 v2 (Non-reasoning)
$1.25/1M
—
Grok 4.3 (low)
$1.25/1M
—
Grok 4.3 (medium)
$1.25/1M
—
Grok 4.3 (Non-reasoning)
$1.25/1M
—
Grok 4.6 (low)
$2.00/1M
—
Grok 4.6 (medium)
$2.00/1M
—
Grok 4.6 (xhigh)
$2.00/1M
—
Grok 4.7 (high)
$2.00/1M
—
Grok 4.7 (xhigh)
500K tokens·$2.00/1M
—

Stability AI

2 modelos
ModeloOS
Stable Diffusion 3.5 Large
✅
Stable Video Diffusion 3D
✅

StepFun

4 modelos
ModeloOS
Step 3.5 Flash
$0.10/1M
—
Step 3.7 Flash
$0.20/1M
—
Step 5 Preview
$1.00/1M
—
Step3 VL 10B
0
—

Suno

1 modelo
ModeloOS
Suno v4.5
—

Swiss AI Initiative

2 modelos
ModeloOS
Apertus 70B Instruct
$0.82/1M
—
Apertus 8B Instruct
$0.10/1M
—

TII UAE

1 modelo
ModeloOS
Falcon-H1R-7B
0
—

Tencent

3 modelos
ModeloOS
Hy3-preview (Non-reasoning)
262K tokens·$0.06/1M
—
Hy3-preview (Reasoning)
262K tokens·$0.06/1M
—
Tencent: Hunyuan A13B Instruct
131K tokens·$0.14/1M
✅

TheDrummer

4 modelos
ModeloOS
TheDrummer: Cydonia 24B V4.1
131K tokens·$0.30/1M
✅
TheDrummer: Rocinante 12B
33K tokens·$0.17/1M
✅
TheDrummer: Skyfall 36B V2
33K tokens·$0.55/1M
✅
TheDrummer: UnslopNemo 12B
33K tokens·$0.40/1M
✅

Thinking Machines

2 modelos
ModeloOS
Inkling
$1.00/1M
—
Inkling Small
$0.30/1M
—

Tongyi DeepResearch 30B A3B

1 modelo
ModeloOS
Tongyi DeepResearch 30B A3B
131K tokens·$0.09/1M
✅

Trillion Labs

2 modelos
ModeloOS
Tri-21B-Think
0
—
Tri-21B-think Preview
0
—

Unknown

1 modelo
ModeloOS
Celeris-1
$0.20/1M
—

Upstage

9 modelos
ModeloOS
Solar Mini
$0.15/1M
—
Solar Open 100B (Reasoning)
0
—
Solar Open2 250B
—
Solar Pro 2 (Non-reasoning)
0
—
Solar Pro 2 (Preview) (Non-reasoning)
0
—
Solar Pro 2 (Preview) (Reasoning)
0
—
Solar Pro 2 (Reasoning)
—
Solar Pro 3
128K tokens·$0.15/1M
—
Solar Pro 4
524K tokens·$0.30/1M
—

Writer

1 modelo
ModeloOS
Writer: Palmyra X5
1.0M tokens·$0.60/1M
—

Xiaomi

9 modelos
ModeloOS
MiMo-V2-Flash (Feb 2026)
0
—
MiMo-V2-Flash (Reasoning)
262K tokens·$0.10/1M
—
MiMo-V2-Omni-0327
0
—
MiMo-V2.5
$0.14/1M
—
MiMo-V2.5-Pro (Non-reasoning)
$0.43/1M
—
MiMo-V2.6-Pro
$0.43/1M
—
Xiaomi: MiMo-V2-Omni
262K tokens00
—
Xiaomi: MiMo-V2-Pro
1.0M tokens00
—
Xiaomi: MiMo-V2.5-Pro
1.0M tokens·$0.43/1M
—

Z AI

5 modelos
ModeloOS
GLM-4.7 (Non-reasoning)
$0.60/1M
—
GLM-4.7-Flash (Non-reasoning)
$0.07/1M
—
GLM-5.2 (Non-reasoning)
$1.40/1M
—
GLM-5.3 (low)
$1.40/1M
—
GLM-5.3-Flash
$0.15/1M
—

Z.ai

13 modelos
ModeloOS
GLM-4.5 (Reasoning)
131K tokens00
—
GLM-4.5V (Reasoning)
$0.60/1M
—
GLM-4.6 (Reasoning)
$0.57/1M
—
GLM-4.6V (Reasoning)
$0.30/1M
—
GLM-5 (Non-reasoning)
205K tokens·$1.00/1M
—
GLM-5-Turbo
203K tokens00
—
GLM-5.1 (Non-reasoning)
$1.38/1M
—
GLM-5.3
$1.40/1M
—
Z.ai: GLM 4 32B
128K tokens·$0.10/1M
—
Z.ai: GLM 4.5 Air
131K tokens·$0.17/1M
✅
Z.ai: GLM 4.7 Flash
203K tokens·$0.07/1M
✅
Z.ai: GLM 5.1
203K tokens·$1.28/1M
✅
Z.ai: GLM 5V Turbo
203K tokens·$1.20/1M
—

xAI

18 modelos
ModeloOS
Grok 2 (Dec '24)
0
—
Grok 3 Beta
131K tokens·$3.00/1M
—
Grok 3 Mini Beta
131K tokens·$0.30/1M
—
Grok 4
256K tokens·$3.00/1M
—
Grok 4 Fast
2.0M tokens·$0.20/1M
—
Grok 4.1 Fast
2.0M tokens00
—
Grok 4.20 0309 (Reasoning)
$2.00/1M
—
Grok Beta
0
—
Grok Build 0.1 0616
$1.00/1M
—
Grok Code Fast 1
256K tokens00
—
Grok-1
0
—
SpaceXAI: Grok 4.20
2.0M tokens·$1.25/1M
—
SpaceXAI: Grok 4.20 Multi-Agent
2.0M tokens·$1.25/1M
—
SpaceXAI: Grok 4.3
1.0M tokens·$1.25/1M
—
SpaceXAI: Grok 4.3 (batch)
1.0M tokens·$1.00/1M
—
SpaceXAI: Grok 4.5
500K tokens·$2.00/1M
—
SpaceXAI: Grok 4.6
500K tokens·$2.00/1M
—
SpaceXAI: Grok Build 0.1
256K tokens·$1.00/1M
—

Guia de Modelos de IA em 2026

O ecossistema de modelos de inteligência artificial em 2026 é dominado por quatro grandes famílias: GPT da OpenAI, Claude da Anthropic, Gemini do Google e Llama da Meta. Cada família tem modelos em diferentes tamanhos e especializações, com preços e capacidades variadas para diferentes casos de uso.

Família GPT (OpenAI)

A OpenAI oferece a linha GPT-4o como modelo principal, com variantes de diferentes custos e velocidades. GPT-4o-mini é a opção mais acessível com excelente custo-benefício. A API da OpenAI é a mais amplamente suportada por ferramentas e integrações de terceiros, tornando-a a escolha default para muitas aplicações.

Família Claude (Anthropic)

Anthropic posiciona Claude com foco em segurança e seguir instruções complexas. Claude Opus é o modelo mais capaz da linha, com context window de 200K tokens — ideal para análise de documentos longos. Claude Haiku é a opção mais rápida e barata. A Anthropic tem forte presença em casos de uso empresariais e compliance-sensíveis.

Família Gemini (Google)

Gemini é notável pelo context window de 1 milhão de tokens — o maior entre modelos comerciais — e pela integração nativa com o ecossistema Google (Search, Workspace, Cloud). Gemini Flash é a opção mais acessível com velocidade excepcional.

Open Source: Llama, Qwen e DeepSeek

O segmento open source avançou significativamente. Meta AI lançou Llama 4 com performance competitiva em certas tarefas. Alibaba mantém a família Qwen com foco em multilingual, incluindo melhor suporte a português. DeepSeek surpreendeu com performance frontier a custo substancialmente menor que modelos proprietários equivalentes.

Perguntas Frequentes

Qual a diferença entre GPT-4o e Claude Opus?

GPT-4o da OpenAI e Claude Opus da Anthropic são ambos modelos frontier com capacidades similares. GPT-4o tem melhor velocidade e integração com o ecossistema OpenAI. Claude Opus se destaca em tarefas com contexto longo e raciocínio complexo.

O que é context window em modelos de IA?

Context window é a quantidade máxima de texto que o modelo pode processar em uma única requisição, medida em tokens (aproximadamente 4 caracteres por token em inglês, 2-3 em português). Modelos com context window maior podem analisar documentos completos e bases de código extensas.

Qual modelo de IA é open source?

Modelos open source incluem Llama (Meta), Qwen (Alibaba), Mistral, DeepSeek e Gemma (Google). São disponibilizados sob licenças que permitem uso, modificação e deploy próprio, sem dependência de API paga.

Como funcionam os preços por token?

LLMs cobram por tokens processados — separado por tokens de input (o que você envia) e output (o que o modelo gera). Preços em US$ por 1 milhão de tokens. Tokens de output geralmente custam 3-5x mais que tokens de input.

Explorar