Topic / Trend Rising

Stack hardware e runtime per l'IA locale

La strumentazione per l'inference locale si sta consolidando tra AMD ROCm, Intel Arc, supporto GPU nel kernel Linux e piattaforme container on-premise. Nuove versioni e mosse di prezzo, da Lemonade e FastFlowLM a RTX PRO 6000, mostrano opportunità ma anche pressioni di costo per l'infrastruttura self-hosted.

Detected: 2026-08-15 · Updated: 2026-08-15

Articoli Correlati

2026-08-15 Phoronix

Lemonade 11.6: il segnale è nel runtime, non nel modello

AMD aggiorna Lemonade SDK con Muse-Glimmer 30B e modulo sperimentale ROCm per generazione immagini. Più che una novità di benchmark, è un segnale per chi valuta LLM locali: il valore si sposta su ottimizzazione di CPU, GPU e NPU, prevedibilità dei co...

2026-08-13 LocalLLaMA

Nvidia raddoppia la RTX PRO 6000 Blackwell: on-premise più caro

La scheda professionale da 96 GB passa da un preordine sotto gli 8.000 dollari a un MSRP di 16.000. Un segnale sui costi dell'inference self-hosted e sulla pressione che spinge le aziende private a spendere il doppio per GPU. Per chi valuta server lo...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-13 Phoronix

Comma.ai lancia il dock Chestnut con GPU AMD e firmware open source

George Hotz presenta con Comma.ai e Tinygrad due dock: il Tiny Chestnut e il Chestnut, quest'ultimo con AMD Radeon RX 9060 da 8GB. Entrambi collegano PCIe Gen4 x4 a USB4 e girano su firmware open source. Una mossa che sposta l'apertura dal software a...

#Hardware #LLM On-Premise #DevOps
2026-08-12 Phoronix

LACT 0.10: overclock NVIDIA e sensori Blackwell per chi spinge le GPU Linux

Arriva LACT 0.10, l’utility Linux per il controllo GPU. Nuove funzioni per l’overclock NVIDIA e il sensore hotspot delle Blackwell segnalano un ecosistema che matura: sempre più critico per chi gestisce carichi AI on-premise e deve bilanciare prestaz...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-11 Phoronix

FastFlowLM 1.0: AMD unifica l’AI su NPU sotto l’ombrello ROCm

FastFlowLM 1.0, il software open-source per eseguire modelli linguistici e multimodali sulle NPU dei processori Ryzen AI, entra ufficialmente nell’ecosistema ROCm. La mossa segnala l’intenzione di AMD di offrire uno stack unificato per l’inference lo...

#Hardware #LLM On-Premise #DevOps
← Torna ai Topic