Topic / Trend Rising

I Modelli Cinesi Open-Weight Rimodellano l'AI di Frontiera

Un'ondata di modelli cinesi—DeepSeek V4 Flash, Ling-3.0, GLM-5.3—viene rilasciata con enormi conteggi di esperti e pesi aperti, democratizzando le capacità. La compatibilità con motori di inference locali accelera l'adozione on-premise.

Detected: 2026-08-06 · Updated: 2026-08-06

Articoli Correlati

2026-08-05 LocalLLaMA

DeepSeek V4 Flash con MXFP4: il benchmark locale segna il nuovo vertice

I benchmark locali di un utente mostrano DeepSeek V4 Flash 0731 in formato MXFP4 al top per efficienza e qualità, raggiungendo 1.000 token/s in prefill e 90 token/s in generazione. Un risultato che accende i riflettori sulla quantization a bassa prec...

#Hardware #LLM On-Premise #DevOps
2026-08-04 LocalLLaMA

Ling-3.0-flash: il MoE da 127B scende a 128GB con l'FP8 ufficiale

InclusionAI ha rilasciato i pesi di Ling-3.0-flash su Hugging Face. Il modello conta 127,5 miliardi di parametri con un'architettura a 512 esperti, di cui solo 8 attivi per token. La vera notizia è la versione FP8 ufficiale: 128GB, sufficienti per un...

#Hardware #LLM On-Premise #DevOps
2026-08-04 LocalLLaMA

Ling-3.0-flash: 124 miliardi di parametri, 5 attivi, e un futuro on-premise

InclusionAI ha rilasciato Ling-3.0-flash, un modello MoE open-weight da 124 miliardi di parametri con appena 5 miliardi attivi per token. Annunciato prima dell’ondata Kimi K3 e DeepSeek-V4-Flash, il suo dimensionamento potrebbe ritagliargli una nicch...

#Hardware #LLM On-Premise #DevOps
2026-08-03 LocalLLaMA

GLM-5.3 avvistato su GitHub: cosa significa per chi fa self-hosting

Un commit nello SDK Java di Z.AI accenna a un nuovo modello GLM-5.3. Un segnale che anticipa l'aggiornamento di una famiglia di LLM già diffusa in scenari on-premise cinesi, e che rilancia la discussione su sovranità dei dati e competizione con i ven...

#Hardware #LLM On-Premise #DevOps
2026-07-31 LocalLLaMA

La girandola LLM cinese non si ferma: adesso tocca a MiniMax

Un nuovo modello di MiniMax è atteso nei prossimi giorni. Dietro la frenesia dei lanci cinesi si legge un disegno preciso: spingere gli LLM verso deployment on-premise, dove sovranità dei dati e hardware domestico dettano le regole del gioco.

#Hardware #LLM On-Premise #Fine-Tuning
← Torna ai Topic