overfeed.news

Atualização de Preços da API OpenRouter: 22 Modelos Gratuitos, Cortes de Preço para DeepSeek e MoonshotAI, Novos Modelos Pagos

884 palavras

Em 2026-09-12, o OpenRouter rastreia 443 modelos com 22 disponíveis gratuitamente, incluindo novos níveis gratuitos do Google e Thinking Machines, enquanto modelos pagos tiveram quedas no preço de entrada para DeepSeek V3 0324 e MoonshotAI Kimi K3.

Modelos Gratuitos

Há 22 modelos gratuitos disponíveis no OpenRouter em 2026-09-12, incluindo Lyria 3 Pro Preview e Lyria 3 Clip Preview do Google, cada um com 1.048.576 tokens de contexto. A Thinking Machines oferece duas variantes gratuitas do Inkling com o mesmo comprimento de contexto. A NVIDIA fornece acesso gratuito ao Nemotron 3.5 Lightning e Nemotron 3 Ultra, ambos com 1.000.000 tokens de contexto. Modelos gratuitos adicionais vêm da Dots Studio, inclusionAI, Nex AGI, Poolside, Google (variantes Gemma 4), Cohere e NVIDIA (Nemotron 3 Super e Nemotron 3 Nano Omni). O Free Models Router do OpenRouter também está disponível com 200.000 tokens de contexto.

Novos e Removidos Modelos

Sete novos modelos foram adicionados ao OpenRouter em 2026-09-12. O Ling 3.0 Flash VL da inclusionAI está disponível a $0,06 por milhão de tokens de entrada e $0,18 por milhão de tokens de saída com 131.072 tokens de contexto e pesos abertos. A Sakana introduziu dois modelos pagos: Fugu Max a $2,00 entrada e $6,00 saída por milhão de tokens, e Fugu Ultra v2 a $5,00 entrada e $30,00 saída por milhão de tokens, ambos com 1.000.000 tokens de contexto e pesos fechados. A OpenAI lançou quatro novas variantes sob o provedor ~openai: GPT Astra Latest ($10,00 entrada, $50,00 saída), GPT Luna Latest ($0,20 entrada, $1,20 saída), GPT Sol Latest ($2,00 entrada, $10,00 saída) e GPT Terra Latest ($2,00 entrada, $12,00 saída), todos com 1.050.000 tokens de contexto e pesos fechados. Um modelo foi removido: OpenAI GPT Latest do provedor ~openai.

Mudanças de Preço

Vários modelos tiveram ajustes de preço em comparação a 2026-09-11. O Kimi K3 da MoonshotAI viu a entrada cair de $3,00 para $1,6159 e a saída de $15,00 para $8,1054 por milhão de tokens. O DeepSeek V3 0324 reduziu a entrada de $0,29 para $0,25 e a saída de $1,14 para $1,00 por milhão de tokens. O Solar Pro 4 da Upstage aumentou a entrada de $0,03 para $0,09 e a saída de $0,12 para $0,36 por milhão de tokens. O DeepSeek V4 Pro 0813 baixou a entrada de $0,66 para $0,5795 e a saída de $1,98 para $1,7384 por milhão de tokens. O Qwen3 30B A3B Instruct 2507 subiu a entrada de $0,0481 para $0,09 e a saída de $0,193 para $0,30 por milhão de tokens. O DeepSeek V4 Flash 0423 cortou a entrada de $0,0886 para $0,0676 e a saída de $0,1772 para $0,1352 por milhão de tokens. O GLM 5.2 da Z.ai reduziu a entrada de $0,966 para $0,60 e a saída de $3,036 para $2,00 por milhão de tokens. Por outro lado, o GLM Latest da Z.ai (sob ~z-ai) aumentou a entrada de $0,70 para $0,8727 e a saída de $2,20 para $3,36 por milhão de tokens. O MoonshotAI Kimi Latest (sob ~moonshotai) igualou as novas taxas do Kimi K3 a $1,6159 entrada e $8,1054 saída por milhão de tokens. O DeepSeek V4 Pro 0423 fez um corte menor, reduzindo a entrada de $0,87 para $0,8397 e a saída de $1,74 para $1,6794 por milhão de tokens.

Opções Pagas Mais Baratas

O menor custo de entrada entre modelos pagos é o Granite 4.0 Micro da IBM a $0,017 por milhão de tokens, com saída a $0,112 por milhão de tokens e 131.000 tokens de contexto. O Mistral Nemo segue a $0,019 entrada e $0,03 saída por milhão de tokens com 131.072 tokens de contexto. O Ling 3.0 Flash da inclusionAI custa $0,021 entrada e $0,063 saída por milhão de tokens com 262.144 tokens de contexto. O GPT-5 Nano (batch) da OpenAI oferece $0,025 entrada e $0,20 saída por milhão de tokens com 400.000 tokens de contexto. O Llama 3.2 1B Instruct da Meta cobra $0,027 entrada e $0,201 saída por milhão de tokens com 60.000 tokens de contexto. Qwen3.7 Flash, gpt-oss-20b da OpenAI e Nova Micro 1.0 da Amazon começam a $0,03 entrada por milhão de tokens, com taxas de saída e comprimentos de contexto variados.

Maiores Janelas de Contexto

Os modelos com as maiores janelas de contexto no OpenRouter são o Auto Router (Beta), Pareto Code Router e duas variantes do Grok 4.20 da SpaceXAI (padrão e Multi-Agent), todos fornecidos por openrouter ou x-ai, cada um oferecendo 2.000.000 tokens de contexto. O Auto Router padrão também fornece 2.000.000 tokens de contexto. Esses roteadores são projetados para casos de uso de entrada estendida, embora não sejam modelos de pesos abertos.

  • 22 modelos são gratuitos para uso no OpenRouter em 2026-09-12, com comprimentos de contexto de até 1.048.576 tokens.
  • Preços de entrada diminuíram para DeepSeek V3 0324, MoonshotAI Kimi K3 e várias variantes do DeepSeek V4, enquanto Upstage e alguns modelos Qwen tiveram aumentos.
  • O modelo pago mais barato por custo de entrada é o Granite 4.0 Micro da IBM a $0,017 por milhão de tokens.
  • Sete novos modelos foram adicionados, incluindo quatro variantes GPT da OpenAI e o Ling 3.0 Flash VL da inclusionAI.
  • A maior janela de contexto disponível é de 2.000.000 tokens, oferecida por múltiplos roteadores do OpenRouter e x-ai.
Atualização de Preços da API OpenRouter: 22 Modelos Gratuitos,…