Qwen3.8-27B GGUF: layout per-tensore, quantization più leggibile
La scheda modello di bartowski/Qwen3.8-27B-GGUF introduce mappe di layout per-tensore per la compressione GGUF. L'intervento rende esplicito, tensore per tensore, lo schema di quantization usato, aiutando chi gestisce deployment self-hosted a stimare...