Topic / Trend Rising

Maturazione degli strumenti per l'IA locale

AMD, Intel e progetti open source stanno consolidando gli stack di inference locale: Lemonade 11.6 integra Muse-Glimmer, FastFlowLM entra in ROCm, llama.cpp adotta il versioning semantico e Unsloth Desktop porta il training locale. Ottimizzazioni FP8, supporto AVX-512, aggiornamenti del kernel Linux e dock Comma.ai rafforzano ulteriormente i runtime IA self-hosted.

Detected: 2026-08-18 · Updated: 2026-08-18

Articoli Correlati

2026-08-17 LocalLLaMA

llama.cpp v0.1.0 segna il passaggio al versioning semantico

Il progetto abbandona i numeri di build sequenziali e adotta il versioning semantico. Un cambiamento che pesa soprattutto nei contesti self-hosted e on-premise, dove la prevedibilità delle API e la stabilità delle pipeline di inference contano più de...

#Hardware #LLM On-Premise #DevOps
2026-08-17 Phoronix

AMD lavora a un backend ROCm per il calcolo GPU virtualizzato in QEMU

Gli ingegneri AMD stanno sviluppando un backend per migliorare il supporto del calcolo GPU virtualizzato con ROCm sotto QEMU. La mossa punta a rendere più stabile l'uso di GPU AMD in macchine virtuali, un tema cruciale per infrastrutture on-premise e...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-17 Phoronix

KTransformers 0.7 espande AVX-512 e premia i server AMD EPYC

Il framework per LLM eterogenei KTransformers pubblica la versione 0.7 con supporto AVX-512 esteso, un intervento mirato sui server AMD EPYC. Per chi opera in self-hosted, il messaggio è strutturale: la CPU non è più un ripiego, ma una componente att...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-17 Phoronix

Linux 7.3 riscatta ARM64: workaround NVIDIA Olympus e fine del caos patch AI

Il ciclo Linux 7.2 per ARM64 si era chiuso senza funzionalità reali, vittima del caos nelle patch AI/LLM. Con Linux 7.3 arrivano nuove feature ARM64, tra cui BBML3 e workaround per NVIDIA Olympus. Un segnale di maturità per l'ecosistema ARM64, che in...

#Hardware #LLM On-Premise #DevOps
2026-08-16 Phoronix

Linux 7.2 stabile: I/O più rapido e driver AMD/Intel aggiornati

Il kernel 7.2 arriva dopo un ciclo segnato dall'aumento di patch e segnalazioni legate all'ecosistema AI/LLM. I progressi su I/O e driver AMD/Intel contano per chi esegue LLM self-hosted, perché il sistema operativo può diventare l'anello debole tra ...

#Hardware #LLM On-Premise #DevOps
2026-08-16 LocalLLaMA

Il debito dell'AI locale verso Georgi Gerganov e llama.cpp

Un breve post di ringraziamento riporta l'attenzione su Georgi Gerganov, creatore di llama.cpp. Il progetto open source ha trasformato l'approccio all'esecuzione di Large Language Models su hardware comune, abbattendo barriere per deployment self-hos...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-15 Phoronix

Lemonade 11.6: il segnale è nel runtime, non nel modello

AMD aggiorna Lemonade SDK con Muse-Glimmer 30B e modulo sperimentale ROCm per generazione immagini. Più che una novità di benchmark, è un segnale per chi valuta LLM locali: il valore si sposta su ottimizzazione di CPU, GPU e NPU, prevedibilità dei co...

2026-08-13 Phoronix

Comma.ai lancia il dock Chestnut con GPU AMD e firmware open source

George Hotz presenta con Comma.ai e Tinygrad due dock: il Tiny Chestnut e il Chestnut, quest'ultimo con AMD Radeon RX 9060 da 8GB. Entrambi collegano PCIe Gen4 x4 a USB4 e girano su firmware open source. Una mossa che sposta l'apertura dal software a...

#Hardware #LLM On-Premise #DevOps
2026-08-11 LocalLLaMA

Unsloth Desktop porta il training in locale: 2× più veloce, 70% VRAM in meno

Unsloth Desktop è la prima applicazione open source per eseguire e addestrare LLM in locale. Supporta Windows, macOS e Linux, con accelerazione su NVIDIA, AMD, Intel e Mac. Promette training 2× più veloce e riduce la VRAM del 70%. Integra ricerca pri...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-11 Phoronix

FastFlowLM 1.0: AMD unifica l’AI su NPU sotto l’ombrello ROCm

FastFlowLM 1.0, il software open-source per eseguire modelli linguistici e multimodali sulle NPU dei processori Ryzen AI, entra ufficialmente nell’ecosistema ROCm. La mossa segnala l’intenzione di AMD di offrire uno stack unificato per l’inference lo...

#Hardware #LLM On-Premise #DevOps
← Torna ai Topic