Saltar al contenido

LFM2.5 2.6B

Liquid AILiquid AI · 2,7B · Denso

LFM2.5 2.6B es un modelo de 2,7B de Liquid AI con un contexto de 128K tokens. En Q4_K_M con 8K de contexto necesita unos 2 GB; con 4 GB tienes margen para conversaciones largas.

Hugging Face GGUF

Opciones de cuantización

Cuant.MemoriaEn tu hardware
Q2_K—…
Q3_K_M—…
Q4_K_M—…
Q5_K_M—…
Q6_K—…
Q8_0—…
F16—…

Memoria según el contexto

En Q4_K_M. La caché del contexto crece con cada token que el modelo recuerda.

ContextoCaché de contextoTotal
4K0,1 GB1,9 GB
8K0,1 GB2 GB
32K0,5 GB2,4 GB
128K2 GB3,9 GB

Comparte una velocidad medida

Ejecuta uno de estos y pega abajo la salida completa (o sólo los tokens por segundo):

llama-bench -m model.gguf
ollama run model --verbose

Se publica de forma anónima y se conserva. No guardamos cuenta ni dirección, sólo un hash que cambia cada día para limitar a diez envíos diarios.

Siguiente paso

Alternativas más pequeñas

Modelos que necesitan menos memoria que LFM2.5 2.6B y puntúan casi igual o mejor.

Ningún modelo puntuado es a la vez más pequeño y casi tan inteligente como LFM2.5 2.6B.

¿Puedo ejecutar LFM2.5 2.6B en local?

¿Puedo ejecutar LFM2.5 2.6B en local?

Sí, si tu GPU o tu Mac tiene unos 2 GB libres para él en Q4_K_M. Abre esta página en ese ordenador para ver la nota de tu hardware exacto y arráncalo con llama.cpp, Ollama o LM Studio.

¿Cuánta memoria necesita LFM2.5 2.6B?

Unos 2 GB en Q4_K_M con 8K de contexto y 3,1 GB en Q8_0. Las cuantizaciones más bajas caben en tarjetas más pequeñas con algo de pérdida de calidad; los contextos largos suman al total.