Topic / Trend Rising

Muse Glimmer di Meta ed ecosistemi AI locali dei vendor

Muse Glimmer 30B di Meta, con licenza Apache 2.0, viene rapidamente integrato da AMD, Intel e dagli stack comunitari per l'inference locale tramite Lemonade, ExecuTorch, GGUF e LLM-Scaler. AMD sta inoltre rafforzando il supporto ROCm per NPU e ottimizzazioni FP8, segnalando uno spostamento verso l'inference on-premise supportata dai vendor.

Detected: 2026-08-17 · Updated: 2026-08-17

Articoli Correlati

2026-08-15 Phoronix

Lemonade 11.6: il segnale è nel runtime, non nel modello

AMD aggiorna Lemonade SDK con Muse-Glimmer 30B e modulo sperimentale ROCm per generazione immagini. Più che una novità di benchmark, è un segnale per chi valuta LLM locali: il valore si sposta su ottimizzazione di CPU, GPU e NPU, prevedibilità dei co...

2026-08-11 Phoronix

FastFlowLM 1.0: AMD unifica l’AI su NPU sotto l’ombrello ROCm

FastFlowLM 1.0, il software open-source per eseguire modelli linguistici e multimodali sulle NPU dei processori Ryzen AI, entra ufficialmente nell’ecosistema ROCm. La mossa segnala l’intenzione di AMD di offrire uno stack unificato per l’inference lo...

#Hardware #LLM On-Premise #DevOps
2026-08-10 LocalLLaMA

Muse Glimmer di Meta: l'agente locale open-weight da 30B che sfida il cloud

Meta rilascia Muse Glimmer, un modello da 30 miliardi di parametri con licenza Apache 2.0, ottimizzato per flussi di lavoro agentici sempre attivi su hardware consumer. La quantization a 4 bit e la decodifica speculativa lo rendono eseguibile su GPU ...

#Hardware #LLM On-Premise #Fine-Tuning
← Torna ai Topic