overfeed.news

incoai/GLM-5.3-Flash-DFlash2

1mês

Idade

74

Curtidas

Coletado

Quanto custa rodar isto

1.2B params · 32,768 Contexto

PrecisãoPrecisa deMais barato que cabe
16 bits3.2GBGTX 1660 S$0.02/h
8 bits1.6GBGTX 1660 S$0.02/h
4 bits0.8GBGTX 1660 S$0.02/h

Pesos mais cache de atenção, com 15% de folga para ativações e o alocador. Tudo aqui é aritmética — não medimos velocidade, então não classificamos chip por ela. Ver todos os preços de GPU

New text-generation model. Tags: qwen3, dflash, dflash2, speculative-decoding, block-diffusion, draft-model, sglang, text-generation

Leia o artigo completo em huggingface.co

O overfeed.news indexa e aponta. Publicamos um trecho curto — o artigo completo fica em Hugging Face New Models.

Entre para seguir esta fonte
incoai/GLM-5.3-Flash-DFlash2 — overfeed.news