Topic / Trend Rising

Modelli piccoli ed efficienza dei dati

I modelli aperti compatti e gli approcci di addestramento con pochi dati stanno ottenendo risultati competitivi su task specifici, dai modelli sotto i 4B ai budget in stile BabyLM. L'efficienza sta diventando una leva progettuale primaria per costi, distribuzione e uso on-device.

Detected: 2026-09-11 · Updated: 2026-09-11

Articoli Correlati

2026-09-11 ArXiv cs.CL

BabyLM 2026: il metodo che impara da 10 milioni di parole e cambia i vincoli

Qiushi Engine ha condotto un programma di ricerca autonomo su BabyLM 2026 Strict-Small, con 10 milioni di parole e 100 milioni di presentazioni cumulative. Tre fasi hanno unito avanzamento, scoperta di principi e miglioramento guidato. L'Overall sale...

#Hardware #LLM On-Premise #Fine-Tuning
2026-09-07 LocalLLaMA

MiniCPM5-2B: OpenBMB guida i modelli open weights sotto i 4B

OpenBMB ha pubblicato MiniCPM5-2B, un modello open weights da 2 miliardi di parametri che ottiene 15 sull'Artificial Analysis Intelligence Index v4.2, il punteggio più alto tra i modelli aperti fino a 4B. Il risultato interessa chi valuta deployment ...

#LLM On-Premise #Fine-Tuning #DevOps
2026-09-06 LocalLLaMA

Spark-X2.5 in GGUF: llama.cpp apre la strada ai modelli compatti da 1M token

Una pull request su llama.cpp introduce il supporto per Spark-X2.5, due LLM compatti da 4B e 1.7B parametri, con contesto nativo fino a 1M token e architettura ibrida a finestra scorrevole. La mossa abbassa la soglia per l'inference locale e self-hos...

#Hardware #LLM On-Premise #Fine-Tuning
2026-09-04 LocalLLaMA

Un LLM da 90 milioni di parametri gira su PSP: il local al limite del 2004

Un esperimento porta un modello conversazionale da 90M su una console Sony del 2004. L'inference viaggia a circa 0,5-0,6 token al secondo, con risposte in 1-3 minuti. Più una provocazione tecnica che uno strumento utile, ma dice molto sui vincoli rea...

#Hardware #LLM On-Premise #DevOps
← Torna ai Topic