Döner kebab e modelli quantizzati: la sfida dei salti di versione tra GLM 5.2 e Qwen 3.6
Un test inusuale con uno spiedo rotante attiva i “pesi tedeschi” di GLM 5.2 e riaccende il dibattito su quanto contino gli aggiornamenti incrementali dei modelli. Qwen 3.6 35B gira in locale con llama.cpp e quantization Q8, mostrando i compromessi di chi punta al self-hosting.