Topic / Trend Rising

Quantization sotto esame

La quantization post-training si sta rivelando una trasformazione non neutra: può creare divari tra validazione e deployment e backdoor nascoste, mentre nuovi metodi basati su gradiente riducono la perdita di qualità. Questo la rende sia una leva di ottimizzazione sia una superficie d'attacco emergente.

Detected: 2026-09-05 · Updated: 2026-09-05

Articoli Correlati

2026-09-02 ArXiv cs.LG

REAL-Q porta la discesa del gradiente nella quantization dei LLM

Un nuovo metodo di post-training quantization, REAL-Q, usa la discesa del gradiente a blocchi per ridurre fino a circa il 49% la divergenza KL end-to-end rispetto ai metodi di secondo ordine su LLaMA-3.1 e Qwen3 a W4A16. Un risultato che tocca i depl...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-31 ArXiv cs.LG

Quantization non neutra: il gap tra validazione e deployment dei LLM

Un nuovo studio formalizza il validation-deployment gap: un LLM può superare i controlli a precisione piena e attivare comportamenti dannosi solo dopo quantization INT8 o a 4 bit. Nei test, la traduzione tattica passa da zero corruzione a FP16 ripara...

#Hardware #LLM On-Premise #Fine-Tuning
← Torna ai Topic