overfeed.news

Atualização de Preços da API de LLM: 22 de setembro de 2026

990 palavras

Em 22 de setembro de 2026, o OpenRouter rastreou 443 modelos com 24 disponíveis gratuitamente, incluindo novas ofertas gratuitas do Google e da Thinking Machines, enquanto os modelos pagos tiveram ajustes de preço em tokens de entrada e saída.

Modelos Gratuitos

A partir de 22 de setembro de 2026, 24 modelos estão disponíveis gratuitamente no OpenRouter, um aumento em relação ao dia anterior. Eles incluem o Lyria 3 Pro Preview e o Lyria 3 Clip Preview do Google, ambos com 1.048.576 tokens de contexto. A Thinking Machines oferece duas variantes gratuitas: Inkling Small e Inkling, cada uma com 1.048.576 tokens de contexto. A NVIDIA fornece dois modelos gratuitos: Nemotron 3.5 Lightning e Nemotron 3 Ultra, cada um com 1.000.000 tokens de contexto. Modelos gratuitos adicionais vêm da Dots Studio, inclusionAI, Nex AGI, Qwen, Poolside, Google (variantes Gemma 4), Cohere e NVIDIA (Nemotron 3 Super e Nemotron 3 Nano Omni), com tokens de contexto variando de 256.000 a 1.048.576.

Novos e Removidos Modelos

Quatro novos modelos foram adicionados ao OpenRouter em 22 de setembro de 2026. O Grok 4.7 da SpaceXAI está precificado em US$ 1,60 por milhão de tokens de entrada e US$ 4,80 por milhão de tokens de saída, com 500.000 tokens de contexto. A Xiaomi introduziu três modelos: MiMo-V2.6-Flash a US$ 0,14 de entrada e US$ 0,28 de saída por milhão de tokens, MiMo-V2.6-Pro a US$ 0,435 de entrada e US$ 0,87 de saída, e MiMo-V2.6-Pro-UltraSpeed a US$ 4,35 de entrada e US$ 8,70 de saída, todos com 1.048.576 tokens de contexto. Sete modelos foram removidos da plataforma, incluindo o Claude Opus 4 da Anthropic, o MiniMax M3 (batch), o Kimi K3 (batch) da MoonshotAI, o gpt-oss-120b (batch) da OpenAI, e três modelos batch da Qwen, além do Inkling (batch) da Thinking Machines.

Alterações de Preço

Vários modelos tiveram ajustes de preço em 22 de setembro de 2026. O DeepSeek Pro Latest reduziu o preço de entrada de US$ 0,5795 para US$ 0,5586 e o de saída de US$ 1,7384 para US$ 1,6759 por milhão de tokens. O DeepSeek Flash Latest baixou a entrada de US$ 0,13 para US$ 0,12 e a saída de US$ 0,52 para US$ 0,48. O Kimi K3 da MoonshotAI aumentou a entrada de US$ 1,70 para US$ 3,00 e a saída de US$ 8,50 para US$ 15,00 por milhão de tokens. O DeepSeek V4 Flash Latest elevou o preço de saída de US$ 0,16 para US$ 0,40, mantendo a entrada em US$ 0,04. O Nemotron 3 Nano 30B A3B da NVIDIA reduziu a entrada de US$ 0,06 para US$ 0,05 e a saída de US$ 0,24 para US$ 0,20. O GLM 5.3 Flash da Z.ai aumentou a entrada de US$ 0,09 para US$ 0,15 e a saída de US$ 0,30 para US$ 0,50. O DeepSeek V4 Pro 0813 cortou a entrada de US$ 0,66 para US$ 0,5586 e a saída de US$ 1,98 para US$ 1,6759. O Qwen3.8 27B da Qwen aumentou a entrada de US$ 0,20 para US$ 0,42 e a saída de US$ 2,55 para US$ 3,00. O DeepSeek V4 Flash 0423 fez reduções menores: entrada de US$ 0,0899 para US$ 0,0886 e saída de US$ 0,1797 para US$ 0,1772. O GLM Latest da Z.ai aumentou a entrada de US$ 0,7735 para US$ 0,7839 e a saída de US$ 2,431 para US$ 2,6532. O Grok Latest da xAI baixou a entrada de US$ 2,00 para US$ 1,60 e a saída de US$ 6,00 para US$ 4,80. O Kimi Latest da MoonshotAI diminuiu a entrada de US$ 1,70 para US$ 1,50 e a saída de US$ 8,50 para US$ 7,50 por milhão de tokens.

Opções Paginas Mais Baratas

Os modelos pagos mais acessíveis por custo de entrada são o Granite 4.0 Micro da IBM a US$ 0,017 por milhão de tokens de entrada e US$ 0,112 de saída, com 131.000 tokens de contexto. O Mistral Nemo vem em seguida a US$ 0,019 de entrada e US$ 0,03 de saída por milhão de tokens, com 131.072 tokens de contexto. O Ling 3.0 Flash da inclusionAI está precificado em US$ 0,021 de entrada e US$ 0,063 de saída por milhão de tokens, oferecendo 262.144 tokens de contexto. O GPT-5 Nano (batch) da OpenAI custa US$ 0,025 de entrada e US$ 0,20 de saída por milhão de tokens com 400.000 tokens de contexto. O Llama 3.2 1B Instruct da Meta está a US$ 0,027 de entrada e US$ 0,201 de saída por milhão de tokens, com 60.000 tokens de contexto. O Qwen3.7 Flash da Qwen, o gpt-oss-20b da OpenAI e o Schematron V2 Turbo da Inference.net cobram todos US$ 0,03 por milhão de tokens de entrada, com preços de saída de US$ 0,13, US$ 0,13 e US$ 0,15 respectivamente, e tokens de contexto variando de 128.000 a 1.000.000.

Maiores Janelas de Contexto

Os modelos com as maiores janelas de contexto no OpenRouter a partir de 22 de setembro de 2026 são o Auto Router (Beta), o Pareto Code Router, o Grok 4.20 Multi-Agent da SpaceXAI, o Grok 4.20 da SpaceXAI e o Auto Router, todos oferecendo 2.000.000 tokens de contexto. Eles são fornecidos pelo OpenRouter e pela xAI. Nenhum outro modelo no conjunto rastreado ultrapassa esse comprimento de contexto.

  • A disponibilidade de modelos gratuitos aumentou para 24, com novas entradas do Google e da Thinking Machines oferecendo até 1.048.576 tokens de contexto.
  • As alterações de preço foram mistas: DeepSeek e xAI reduziram custos, enquanto MoonshotAI e Z.ai aumentaram preços para certos modelos.
  • O modelo pago mais barato continua sendo o Granite 4.0 Micro da IBM a US$ 0,017 por milhão de tokens de entrada.
  • O MiMo-V2.6-Flash da Xiaomi é o novo modelo pago de menor custo a US$ 0,14 por milhão de tokens de entrada com 1.048.576 tokens de contexto.
  • As maiores janelas de contexto disponíveis são de 2.000.000 de tokens, detidas pelos roteadores do OpenRouter e pelas variantes Grok 4.20 da xAI.
Atualização de Preços da API de LLM: 22 de setembro de 2026 —…