Budget: un LLM denso da 9,4B su una scheda sposta il vincolo dalla GPU alla comunità
Un ricercatore indipendente ha preparato un modello denso da 9,4 miliardi di parametri per il training su una singola scheda, con distillazione da Llama 3 e semplificazioni architetturali. Non ci sono benchmark, ma il segnale per l'AI on-premise è ch...