overfeed.news

Qwen/Qwen2.5-7B-Instruct

25d

Idade

2.1K

Curtidas

10M

Downloads

Coletado

Quanto custa rodar isto

7.6B params · 32,768 Contexto

PrecisãoPrecisa deMais barato que cabe
16 bits18GBTesla P40$0.08/h
8 bits9.2GBTesla P100$0.03/h
4 bits4.6GBGTX 1660 S$0.02/h

Pesos mais cache de atenção, com 15% de folga para ativações e o alocador. Tudo aqui é aritmética — não medimos velocidade, então não classificamos chip por ela. Ver todos os preços de GPU

New text-generation model. Tags: qwen2, text-generation, chat, conversational, en, arxiv:2309.00071, arxiv:2407.10671, base_model:Qwen/Qwen2.5-7B

Leia o artigo completo em huggingface.co

O overfeed.news indexa e aponta. Publicamos um trecho curto — o artigo completo fica em Hugging Face New Models.

Entre para seguir esta fonte
Qwen/Qwen2.5-7B-Instruct — overfeed.news