Atualização de Preços da API OpenRouter: 16 de setembro de 2026
Em 2026-09-16, o OpenRouter monitora 443 modelos com 23 modelos gratuitos, incluindo duas novas prévias do Google Lyria 3 e variantes do Thinking Machines Inkling, enquanto o preço de entrada do Qwen Qwen3.5-35B-A3B caiu para $0.1625 por milhão de tokens.
Modelos Gratuitos
Em 2026-09-16, há 23 modelos gratuitos no OpenRouter, incluindo Google: Lyria 3 Pro Preview e Google: Lyria 3 Clip Preview, cada um com 1.048.576 tokens de contexto. A Thinking Machines oferece dois modelos gratuitos: Inkling Small (gratuito) e Inkling (gratuito), ambos com 1.048.576 tokens de contexto. A NVIDIA fornece dois modelos gratuitos: Nemotron 3.5 Lightning (gratuito) e Nemotron 3 Ultra (gratuito), cada um com 1.000.000 tokens de contexto.
Modelos gratuitos adicionais incluem Dots Studio: Dots3-Note Preview (gratuito) com 512.000 tokens de contexto, e várias variantes Flash do inclusionAI Ling 3.0 (Sante, Fin, VL), cada uma com 262.144 tokens de contexto. A Nex AGI oferece Nex-N2.5-Mini e Nex-N2.5-Pro (gratuitos), ambos com 262.144 tokens de contexto. A Poolside fornece Laguna S 2.1 e Laguna XS 2.1 (gratuitos), cada um com 262.144 tokens de contexto. O Google oferece Gemma 4 26B A4B e Gemma 4 31B (gratuitos), cada um com 262.144 tokens de contexto. O Nemotron 3 Super (gratuito) da NVIDIA tem 262.144 tokens de contexto. O North Mini Code (gratuito) da Cohere tem 256.000 tokens de contexto. O Nemotron 3 Nano Omni (gratuito) da NVIDIA tem 256.000 tokens de contexto. O Free Models Router do openrouter tem 200.000 tokens de contexto.
Adições e Remoções de Modelos
Um novo modelo foi adicionado: Z.ai: GLM 5.2 (gratuito), com preços de entrada e saída em $0,0 por milhão de tokens, 32.768 tokens de contexto e pesos abertos. Três modelos foram removidos: Google: Gemma 4 31B (lote), OpenAI: gpt-oss-20b (lote) e Thinking Machines: Inkling Small (lote). Nenhum modelo tornou-se gratuito ou deixou de ser gratuito nesta data.
Alterações de Preço
Cinco modelos tiveram alterações de preço. O preço de entrada do Qwen: Qwen3.5-35B-A3B diminuiu de $0,3125 para $0,1625 por milhão de tokens, enquanto o preço de saída aumentou de $1,25 para $1,30 por milhão de tokens. O preço de entrada do Z.ai: GLM 5.3 Flash caiu de $0,15 para $0,075 por milhão de tokens, e o preço de saída caiu de $0,50 para $0,25 por milhão de tokens. O preço de entrada do Z.ai: GLM 5.2 aumentou de $0,6832 para $1,40 por milhão de tokens, e o preço de saída aumentou de $2,1472 para $4,40 por milhão de tokens. O preço de entrada do Z.ai: GLM Latest diminuiu de $0,90 para $0,85 por milhão de tokens, e o preço de saída caiu de $3,00 para $2,8985 por milhão de tokens. O preço de entrada do DeepSeek: DeepSeek V4 Flash 0731 diminuiu de $0,06 para $0,055 por milhão de tokens, e o preço de saída caiu de $0,12 para $0,11 por milhão de tokens.
Opções Pagas Mais Baratas
O modelo pago mais barato pelo preço de entrada é o IBM: Granite 4.0 Micro a $0,017 por milhão de tokens para entrada e $0,112 para saída, com 131.000 tokens de contexto e pesos abertos. Em segundo lugar está o Mistral: Mistral Nemo a $0,019 de entrada e $0,03 de saída por milhão de tokens, 131.072 tokens de contexto, pesos abertos. Em terceiro lugar está o inclusionAI: Ling 3.0 Flash a $0,021 de entrada e $0,063 de saída por milhão de tokens, 262.144 tokens de contexto, pesos abertos. Em quarto lugar está o OpenAI: GPT-5 Nano (lote) a $0,025 de entrada e $0,20 de saída por milhão de tokens, 400.000 tokens de contexto, sem pesos abertos. Em quinto lugar está o Meta: Llama 3.2 1B Instruct a $0,027 de entrada e $0,201 de saída por milhão de tokens, 60.000 tokens de contexto, pesos abertos.
Maiores Janelas de Contexto
As maiores janelas de contexto são detidas por cinco modelos, cada um com 2.000.000 de tokens: Pareto Code Router (openrouter), Auto Router (Beta) (openrouter), SpaceXAI: Grok 4.20 Multi-Agent (x-ai), SpaceXAI: Grok 4.20 (x-ai) e Auto Router (openrouter).
Pontos principais
- A contagem de modelos gratuitos permanece em 23, com novas adições da Z.ai e nenhuma mudança no status gratuito dos modelos existentes.
- O Qwen Qwen3.5-35B-A3B teve a maior queda de preço de entrada entre os modelos alterados, reduzindo à metade para $0,1625 por milhão de tokens.
- O IBM Granite 4.0 Micro é o modelo pago mais barato a $0,017 por milhão de tokens de entrada.
- Cinco modelos compartilham a janela de contexto máxima de 2.000.000 de tokens, todos dos provedores OpenRouter ou xAI.
- O Z.ai: GLM 5.2 teve o maior aumento de preço, com a saída subindo para $4,40 por milhão de tokens.