Atualização de Preços da API OpenRouter: 20 de setembro de 2026
Em 20 de setembro de 2026, o OpenRouter monitorou 447 modelos com 25 modelos gratuitos e 187 modelos de peso aberto, enquanto vários modelos pagos tiveram reduções nos preços de entrada e saída.
Disponibilidade de Modelos Gratuitos
A partir de 20 de setembro de 2026, o OpenRouter lista 25 modelos disponíveis sem custo, incluindo o Lyria 3 Pro Preview e o Lyria 3 Clip Preview do Google, cada um com 1.048.576 tokens de contexto. O DeepSeek V4 Flash 0731 (gratuito) do DeepSeek e o Inkling Small e o Inkling (gratuitos) da Thinking Machines também oferecem 1.048.576 tokens de contexto sem custo.
O Nemotron 3.5 Lightning (gratuito) e o Nemotron 3 Ultra (gratuito) da NVIDIA fornecem 1.000.000 tokens de contexto sem cobrança. Modelos gratuitos adicionais da inclusionAI, Nex AGI, Qwen, Poolside, Google, NVIDIA e Cohere oferecem janelas de contexto variando de 256.000 a 262.144 tokens.
Novos e Removidos Modelos
Um novo modelo foi adicionado em 20 de setembro de 2026: o GLM 5.3 FlashX da Z.ai, com preço de US$ 0,37 por milhão de tokens de entrada e US$ 1,25 por milhão de tokens de saída, com janela de contexto de 1.048.576 tokens e pesos fechados. Nenhum modelo foi removido da plataforma em comparação com 19 de setembro de 2026.
Nenhum modelo tornou-se gratuito ou deixou de ser gratuito nesta data, indicando estabilidade nas ofertas da camada gratuita.
Ajustes de Preço
Múltiplos modelos tiveram reduções de preço em 20 de setembro de 2026. O DeepSeek Flash Latest reduziu o preço de entrada de US$ 0,135 para US$ 0,13 por milhão de tokens e o de saída de US$ 0,54 para US$ 0,52. O Kimi K3 da MoonshotAI reduziu a entrada de US$ 1,95 para US$ 1,7 e a saída de US$ 10,92 para US$ 8,5 por milhão de tokens.
O DeepSeek V4 Flash Latest reduziu a entrada de US$ 0,0519 para US$ 0,04 e a saída de US$ 0,1558 para US$ 0,08 por milhão de tokens. O Nemotron 3 Ultra da NVIDIA diminuiu a entrada de US$ 0,625 para US$ 0,6 e a saída de US$ 3,125 para US$ 2,4. O Nemotron 3.5 Lightning reduziu a entrada de US$ 0,08 para US$ 0,07 por milhão de tokens, com saída inalterada em US$ 0,2.
Outras reduções incluem o DeepSeek V4 Flash 0423 (entrada: US$ 0,0484 → US$ 0,0378; saída: US$ 0,0969 → US$ 0,0756), Z.ai: GLM 5.2 (entrada: US$ 0,5544 → US$ 0,6496; saída: US$ 1,7424 → US$ 2,0416 — nota: aumento), Z.ai: GLM Latest (entrada: US$ 0,8918 → US$ 0,8442; saída: US$ 2,8028 → US$ 2,6532), MoonshotAI: Kimi Latest (mesmas alterações do Kimi K3), DeepSeek V4 Pro 0423 (entrada: US$ 1,6 → US$ 0,4223; saída: US$ 3,2 → US$ 0,8446), e DeepSeek V4 Flash 0731 (entrada: US$ 0,06 → US$ 0,04; saída: US$ 0,12 → US$ 0,08).
Opções Pagos Mais Baratas
Os modelos pagos mais acessíveis por custo de entrada são o Granite 4.0 Micro da IBM a US$ 0,017 por milhão de tokens de entrada e US$ 0,112 para saída, com 131.000 tokens de contexto e pesos abertos. O Mistral Nemo segue a US$ 0,019 de entrada e US$ 0,03 de saída, também com pesos abertos e 131.072 tokens.
Outras opções pagas de baixo custo incluem o Ling 3.0 Flash da inclusionAI (US$ 0,021 de entrada, US$ 0,063 de saída, 262.144 tokens, pesos abertos), o GPT-5 Nano (batch) da OpenAI a US$ 0,025 de entrada e US$ 0,2 de saída (400.000 tokens, pesos fechados), e o Llama 3.2 1B Instruct da Meta (US$ 0,027 de entrada, US$ 0,201 de saída, 60.000 tokens, pesos abertos).
Maiores Janelas de Contexto
Os modelos com as maiores janelas de contexto disponíveis no OpenRouter a partir de 20 de setembro de 2026 são o Auto Router (Beta), o Pareto Code Router, o Grok 4.20 Multi-Agent da SpaceXAI, o Grok 4.20 da SpaceXAI e o Auto Router — todos oferecendo 2.000.000 tokens de contexto. Esses são fornecidos pelos provedores openrouter e x-ai.
Pontos principais
- O OpenRouter hospedou 447 modelos em 20 de setembro de 2026, com 25 disponíveis gratuitamente e 187 apresentando pesos abertos.
- Reduções de preço foram generalizadas entre os modelos pagos, especialmente da DeepSeek, MoonshotAI e NVIDIA, sem novos modelos gratuitos adicionados ou removidos.
- O modelo pago mais barato por custo de entrada é o Granite 4.0 Micro da IBM a US$ 0,017 por milhão de tokens.
- O GLM 5.3 FlashX da Z.ai é o único modelo novo introduzido, com preço de US$ 0,37 de entrada e US$ 1,25 de saída por milhão de tokens.
- Cinco modelos compartilham o comprimento máximo de contexto de 2.000.000 tokens, todos acessíveis via OpenRouter ou provedores x-ai.