Referência
Guias
Como os números do overfeed.news são feitos: o que significa um preço de aluguel de GPU, como se calcula o ponto de equilíbrio API ou GPU, como ler preços de API de LLM, e como coletamos e publicamos.
Como funciona o preço de aluguel de GPU, e como o medimos
O que significa de fato um preço por GPU-hora no RunPod e no Vast.ai, por que a oferta mais barata não é o preço de mercado, e por que ordenamos as placas por VRAM em vez de por preço.
API ou sua própria GPU: o ponto de equilíbrio, explicado
Como calculamos os tokens por hora acima dos quais alugar uma placa sai mais barato do que pagar por token num modelo de pesos abertos, o que entra no número e o que ele deixa de fora de propósito.
Preços de API de LLM, explicados: por milhão de tokens, janelas de contexto e níveis gratuitos
Como ler um preço por milhão de tokens, por que entrada e saída são cobradas de forma diferente, o que uma janela de contexto lhe custa, e o que um modelo gratuito no OpenRouter promete e não promete.
Como o overfeed.news coleta e publica os seus dados
As fontes que consultamos, com que frequência, o que guardamos de cada item e por que só um excerto, como os preços são fotografados, e como os relatórios diários são gerados e verificados.