Unsloth: disponibili i modelli Gemma 4 QAT MTP per l'inference locale
Unsloth ha annunciato la disponibilità di nuovi modelli assistente basati sull'architettura Gemma 4 di Google, ottimizzati tramite Quantization-Aware Training (QAT). Questi LLM, distribuiti nel formato GGUF, sono offerti in diverse quantizzazioni, inclusa la `q8_0`, e in varie dimensioni. Questa release è strategica per i deployment on-premise, consentendo un'inference efficiente su hardware con risorse limitate e supportando scenari che richiedono sovranità dei dati e controllo sul TCO.