Qwen
Qwen 3.5 9B
Por qué gana
This model is a direct match for coding. It belongs to a current frontier family for local AI. It fits natively with comfortable headroom. Known channels: huggingface, ollama, lm-studio.
Capacity: Roomy · Bandwidth: Medium · Stack: Standard
Interactive: Good · Light API: Great · Bottleneck: Balanced
Puntuación
130.7
Estado de encaje
Runs well
Encaje: Runs well con 32K de contexto seguro.
Soporte de runtime: unknown vía n/a en unknown.
Runtime
llama.cpp
Artefacto
n/a
Cuant.
Q4_K_M
Decodificación
71.5 tok/s
Ctx seguro
32K
Ctx oficial
131K
Soporte
n/a
TTFT
2708 ms
Pesos: 5.5 GB
Caché KV: 2.2 GB
Backend: unknown
Límites actuales
Este setup está bastante equilibrado para este modelo.
No hay grandes señales de alerta
Esta recomendación tiene margen de memoria suficiente y una velocidad estimada razonable para la carga de trabajo seleccionada.
Siguientes mejoras útiles
La puntuación 130.7 combina coincidencia de carga de trabajo, frescura del catálogo, seguridad de encaje, cobertura de contexto, elección de artefacto, utilización de memoria, rendimiento y latencia.