Topic / Trend Rising

Gara dei modelli open-weight: efficienza e laboratori cinesi

La corsa open-weight accelera su due fronti: modelli compatti addestrabili su singola GPU e laboratori cinesi come MiniCPM, DeepSeek, Qwen e Moonshot che riducono il divario per scala e ricavi. Questo mette in discussione le ipotesi di soli modelli occidentali e ridefinisce le scelte di deployment on-premise.

Detected: 2026-09-14 · Updated: 2026-09-14

Articoli Correlati

2026-09-14 TechWire Asia

Kimi K3: i ricavi di Moonshot mettono alla prova l'open-weight

Moonshot AI dichiara oltre 1 miliardo di dollari di ricavi ricorrenti annualizzati ad agosto e punta a 2 miliardi entro fine 2026. I guadagni arrivano da abbonamenti a Kimi e servizi basati sul modello open-weight K3. La licenza impone accordi commer...

#Hardware #LLM On-Premise #DevOps
2026-09-13 LocalLLaMA

Aurora1.0-150M: un LLM da 150 milioni di parametri addestrato su RTX Pro 6000

Un modello da 150 milioni di parametri con prestazioni simili a GPT-2 Small è stato addestrato su una singola RTX Pro 6000 usando 7 miliardi di token. I benchmark pubblicati mostrano PIQA 62,24%, Hellaswag 32,20%, Arc-Easy 44,91%, Arc-Challenge 25,00...

#Hardware #LLM On-Premise #Fine-Tuning
2026-09-13 LocalLLaMA

Un LLM denso da 9,4B pronto per il training su una sola scheda

Un ricercatore indipendente ha reso pubblico un modello da circa 9,4 miliardi di parametri, pensato per l'addestramento su una singola scheda. Il progetto include architetture ispirate a Moonshot e una distillazione da Llama 3, con il training già av...

#Hardware #LLM On-Premise #Fine-Tuning
2026-09-12 LocalLLaMA

Solo modelli occidentali sugli H100: il vuoto dei 120B con visione

Chi gestisce H100 con vincoli che escludono modelli cinesi parte svantaggiato: nel segmento aperto 120B+ con visione il divario rispetto a GLM, Qwen e DeepSeek è misurabile. Tra i candidati occidentali citati, Inkling Small e Command A+ coprono parte...

#Hardware #LLM On-Premise #Fine-Tuning
2026-09-11 ArXiv cs.CL

BabyLM 2026: il metodo che impara da 10 milioni di parole e cambia i vincoli

Qiushi Engine ha condotto un programma di ricerca autonomo su BabyLM 2026 Strict-Small, con 10 milioni di parole e 100 milioni di presentazioni cumulative. Tre fasi hanno unito avanzamento, scoperta di principi e miglioramento guidato. L'Overall sale...

#Hardware #LLM On-Premise #Fine-Tuning
2026-09-10 LocalLLaMA

DeepSeek-V4.1-Flash su Hugging Face: un nome, nessun dettaglio

La pagina esiste, il modello si chiama DeepSeek-V4.1-Flash. Dalla fonte non emergono specifiche tecniche: nessuna VRAM, nessun contesto, nessuna metrica. Il nome 'Flash' suggerisce una variante orientata all'inference, ma per chi valuta on-premise re...

#Hardware #LLM On-Premise #Fine-Tuning
2026-09-07 LocalLLaMA

MiniCPM5-2B: OpenBMB guida i modelli open weights sotto i 4B

OpenBMB ha pubblicato MiniCPM5-2B, un modello open weights da 2 miliardi di parametri che ottiene 15 sull'Artificial Analysis Intelligence Index v4.2, il punteggio più alto tra i modelli aperti fino a 4B. Il risultato interessa chi valuta deployment ...

#LLM On-Premise #Fine-Tuning #DevOps
← Torna ai Topic