Atualização de Preços da API OpenRouter: 24 Modelos Gratuitos, Aumentos de Preço para DeepSeek V3 e Outros
Em 2026-09-18, o OpenRouter rastreia 445 modelos com 24 disponíveis gratuitamente, incluindo novas ofertas gratuitas da Qwen e Thinking Machines.
Modelos Gratuitos
Há 24 modelos gratuitos disponíveis no OpenRouter a partir de 2026-09-18, incluindo o Lyria 3 Pro Preview e o Lyria 3 Clip Preview do Google, ambos com 1.048.576 tokens de contexto.
A Thinking Machines oferece dois modelos gratuitos: Inkling Small e Inkling, cada um com 1.048.576 tokens de contexto. A NVIDIA fornece dois modelos gratuitos: Nemotron 3.5 Lightning e Nemotron 3 Ultra, cada um com 1.000.000 tokens de contexto.
Modelos gratuitos adicionais vêm da Dots Studio, inclusionAI (três variantes do Ling 3.0 Flash), Nex AGI (duas variantes do Nex-N2.5), Qwen (Qwen3.8 27B), Poolside (duas variantes Laguna), Google (duas variantes do Gemma 4), NVIDIA (Nemotron 3 Super), Cohere (North Mini Code) e NVIDIA (Nemotron 3 Nano Omni).
Novos e Removidos Modelos
Dois novos modelos foram adicionados: Qwen: Qwen3.8 27B (gratuito) do provedor qwen, e Pareto do provedor unbiased, com preço de $2,50 por milhão de tokens de entrada e $7,50 por milhão de tokens de saída, ambos com 262.144 tokens de contexto.
Um modelo foi removido: Union Alpha do provedor stealth. Nenhum modelo tornou-se gratuito ou deixou de ser gratuito em comparação com o dia anterior.
Alterações de Preço
Oito modelos tiveram alterações de preço. DeepSeek: DeepSeek V3 (provedor deepseek) aumentou o preço de entrada de $0,2574 para $0,32 por milhão de tokens e reduziu o preço de saída de $1,0287 para $0,89 por milhão de tokens.
NVIDIA: Nemotron 3 Nano 30B A3B (provedor nvidia) aumentou a entrada de $0,05 para $0,06 e a saída de $0,20 para $0,24 por milhão de tokens. Z.ai: GLM 5.3 Flash (provedor z-ai) aumentou a entrada de $0,07 para $0,09 e a saída de $0,2333 para $0,30 por milhão de tokens.
Z.ai: GLM Flash Latest (provedor ~z-ai) aumentou a entrada de $0,07 para $0,075 e a saída de $0,2333 para $0,25 por milhão de tokens. NVIDIA: Nemotron 3 Ultra (provedor nvidia) aumentou a entrada de $0,60 para $0,625 e a saída de $2,40 para $3,125 por milhão de tokens.
Meta: Muse Glimmer 30B (provedor meta) reduziu a entrada de $0,35 para $0,30 e a saída de $1,50 para $1,10 por milhão de tokens. Z.ai: GLM Latest (provedor ~z-ai) aumentou a entrada de $0,833 para $0,8775 e a saída de $2,618 para $2,97 por milhão de tokens.
MoonshotAI: Kimi Latest (provedor ~moonshotai) aumentou a entrada de $2,00 para $2,10 e reduziu a saída de $11,20 para $10,95 por milhão de tokens.
Opções Pagantes Mais Baratas
O modelo pago mais barato por preço de entrada é o IBM: Granite 4.0 Micro (provedor ibm-granite) a $0,017 por milhão de tokens de entrada e $0,112 por milhão de tokens de saída, com 131.000 tokens de contexto e pesos abertos.
Em segundo lugar está o Mistral: Mistral Nemo (provedor mistralai) a $0,019 por milhão de tokens de entrada e $0,03 por milhão de tokens de saída, com 131.072 tokens de contexto e pesos abertos.
Em terceiro lugar está o inclusionAI: Ling 3.0 Flash (provedor inclusionai) a $0,021 por milhão de tokens de entrada e $0,063 por milhão de tokens de saída, com 262.144 tokens de contexto e pesos abertos.
Maiores Janelas de Contexto
As maiores janelas de contexto disponíveis são de 2.000.000 de tokens, detidas por cinco modelos: Auto Router (Beta), Pareto Code Router e duas variantes da SpaceXAI: Grok 4.20 Multi-Agent e Grok 4.20 (todos do provedor x-ai), e Auto Router (provedor openrouter). Todos são fornecidos pelo openrouter ou x-ai.
Pontos principais
- 24 modelos são gratuitos para uso no OpenRouter a partir de 2026-09-18, incluindo o recém-gratuito Qwen3.8 27B.
- DeepSeek V3 teve o maior aumento de preço de entrada entre os modelos alterados, subindo para $0,32 por milhão de tokens.
- IBM Granite 4.0 Micro permanece o modelo pago mais barato a $0,017 por milhão de tokens de entrada.
- Nenhum modelo alterou seu status gratuito em comparação com ontem; todos os modelos gratuitos já eram gratuitos em 2026-09-17.
- A janela de contexto máxima disponível é de 2.000.000 de tokens, oferecida por vários modelos de roteamento e proprietários.