overfeed.news

z-lab/Qwen3.8-27B-DFlash2

1mês

Idade

99

Curtidas

1K

Downloads

Publicado
Coletado

Quanto custa rodar isto

1.9B params · 32,768 Contexto

PrecisãoPrecisa deMais barato que cabe
16 bits4.8GBGTX 1660 S$0.02/h
8 bits2.4GBGTX 1660 S$0.02/h
4 bits1.2GBGTX 1660 S$0.02/h

Pesos mais cache de atenção, com 15% de folga para ativações e o alocador. Tudo aqui é aritmética — não medimos velocidade, então não classificamos chip por ela. Ver todos os preços de GPU

New text-generation model. Tags: qwen3, dflash2, speculative-decoding, block-diffusion, draft-model, sglang, vllm, text-generation

Leia o artigo completo em huggingface.co

O overfeed.news indexa e aponta. Publicamos um trecho curto — o artigo completo fica em Hugging Face New Models.

Entre para seguir esta fonte
z-lab/Qwen3.8-27B-DFlash2 — overfeed.news