📁 Hardware

Questa sezione Hardware segue il lato pratico dell'infrastruttura AI locale: GPU, NPU, mini PC, acceleratori edge, banda memoria e compromessi energetici che incidono direttamente sulle prestazioni in inferenza. Privilegiamo aggiornamenti con benchmark e note operative utili a decisioni reali, dal laboratorio domestico ai cluster pilota in azienda. Qui puoi confrontare costo totale, vincoli termici e scenari modello-hardware, poi approfondire con la guida pillar hardware e la copertura LLM collegata.

SanDisk ha evidenziato come, al momento, i data center dedicati all'intelligenza artificiale non abbiano ancora un caso d'uso economico convincente per sostituire completamente gli hard disk (HDD) con le unità a stato solido (SSD). La dichiarazione sottolinea le sfide legate al Total Cost of Ownership (TCO) e le diverse esigenze di performance e capacità di archiviazione per i carichi di lavoro AI, suggerendo che gli HDD mantengono un ruolo cruciale in specifici contesti.

2026-05-18 Fonte

La futura piattaforma Nvidia Rubin è destinata a rivoluzionare la domanda di memoria LPDDR, superando entro il 2027 quella di giganti come Apple e Samsung. Questa previsione, basata su analisi di mercato, evidenzia l'impatto crescente dell'intelligenza artificiale sull'hardware e sulla catena di approvvigionamento, con implicazioni significative per le strategie di deployment on-premise e la valutazione del TCO per i carichi di lavoro LLM.

2026-05-18 Fonte

Le recenti patch per i driver grafici Intel Xe su Linux rivelano l'esistenza di molteplici ID PCI associati agli imminenti acceleratori "Crescent Island" (CRI). Questa scoperta suggerisce un'offerta diversificata di modelli, con implicazioni per le strategie di deployment on-premise e la scelta hardware per carichi di lavoro AI, influenzando TCO e flessibilità.

2026-05-18 Fonte

La startup sudcoreana LetinAR sta sviluppando lenti ottiche di dimensioni ridotte, paragonabili a un'unghia, destinate a diventare un componente chiave per la prossima era degli occhiali intelligenti basati sull'intelligenza artificiale. Questa innovazione mira a superare le sfide di miniaturizzazione e integrazione, fondamentali per il deployment di capacità AI avanzate in dispositivi indossabili.

2026-05-18 Fonte

Un appassionato ha ingegnerizzato una PlayStation 2 per integrarla in un dispositivo portatile. Il progetto, che include una scheda madre personalizzata, combina funzionalità moderne con il silicio originale della console, dimostrando la complessità e la dedizione richieste dalla personalizzazione hardware.

2026-05-18 Fonte

Il processore Nvidia GB300 sta catalizzando una crescita significativa nel mercato dei server AI, alimentando la domanda di infrastrutture dedicate. Questa espansione è ulteriormente supportata dall'imminente avvio della fase "Vera Rubin", previsto per il terzo trimestre, che promette di portare nuove capacità e disponibilità nel panorama dell'intelligenza artificiale.

2026-05-18 Fonte

Lotes ha raggiunto ricavi record, trainati dalla crescente domanda di connettori per server e applicazioni AI. L'azienda sta mantenendo una strategia di prezzi competitivi per espandere la propria quota di mercato in un segmento infrastrutturale critico per i deployment di Large Language Models (LLM) e carichi di lavoro di intelligenza artificiale.

2026-05-18 Fonte

L'interesse per l'esecuzione di Large Language Models (LLM) in locale sta spingendo lo sviluppo di hardware compatto. Un recente riferimento a una "size chart" per i mini PC Strix Halo, con un aggiornamento previsto per maggio 2026, evidenzia come le dimensioni e il form factor siano cruciali per i deployment on-premise e all'edge, influenzando TCO, gestione dei dati e flessibilità operativa.

2026-05-18 Fonte

Nan Ya PCB, un attore chiave nella produzione di circuiti stampati, sta incrementando la sua capacità produttiva. Questa mossa risponde alla crescente domanda di substrati avanzati, essenziali per i chip AI di nuova generazione. L'espansione sottolinea la pressione sulla supply chain dell'hardware AI e le sue implicazioni per le strategie di deployment on-premise e cloud, influenzando la disponibilità e il TCO delle infrastrutture dedicate all'intelligenza artificiale.

2026-05-17 Fonte

Tata Electronics ha annunciato un investimento di 11 miliardi di dollari per la costruzione di un impianto di produzione di semiconduttori a Dholera, in India, con la collaborazione di ASML. Questo progetto mira a rafforzare l'autonomia indiana nel settore dei chip, cruciale per l'ecosistema tecnicico globale e per la disponibilità di hardware per i deployment on-premise di carichi di lavoro AI e LLM.

2026-05-17 Fonte

Canonical ha iniziato a rilasciare ISO "Concept" di Ubuntu specificamente ottimizzate per la CPU CIX P1, una piattaforma dedicata all'intelligenza artificiale. Queste distribuzioni mirano a fornire un supporto hardware all'avanguardia che non è ancora integrato nel kernel Linux principale, un approccio fondamentale per le aziende che cercano di massimizzare le performance e il controllo nei loro deployment AI on-premise.

2026-05-17 Fonte

Mikron, produttore russo di semiconduttori, ha lanciato una linea di souvenir insoliti: wafer di silicio incorniciati, contenenti fino a 120.000 processori di test. Disponibili in dodici design diversi e venduti a circa 170 dollari l'uno, questi oggetti d'arte da parete sono accompagnati da fiale di aria di camera bianca a 2 dollari. Un'iniziativa che celebra la microelettronica in una forma inaspettata, trasformando il cuore della tecnicia in un pezzo da collezione.

2026-05-17 Fonte

Il progetto open source `low_latency_layer` introduce un layer Vulkan implicito che estende la compatibilità di tecnicie come AMD Anti-Lag 2 e NVIDIA Reflex 2. Questa soluzione, agnostica all'hardware e progettata per Linux, consente a schede grafiche AMD e Intel di sfruttare queste funzionalità di riduzione della latenza, superando le tradizionali limitazioni legate al produttore. Rappresenta un passo verso una maggiore flessibilità nell'utilizzo dell'hardware grafico in ambienti self-hosted.

2026-05-17 Fonte

La Cina ha svelato LineShine, un supercomputer da 1.54 exaflops basato esclusivamente su CPU, equipaggiato con 2.4 milioni di core Armv9 progettati da Huawei. Questa architettura CPU-only rappresenta una risposta strategica alle restrizioni sulle GPU imposte dagli Stati Uniti, evidenziando un percorso alternativo per raggiungere elevate capacità di calcolo e rafforzare la sovranità tecnicica in settori critici come l'HPC e l'AI.

2026-05-17 Fonte

Un nuovo fork di llama.cpp risolve un problema di lunga data con il tensor parallelism, permettendo l'uso di KV cache quantizzati su configurazioni dual GPU. Questo porta a un incremento di oltre il 40% nelle prestazioni per l'inference di LLM, come dimostrato con un modello Qwen da 27B su hardware consumer. La soluzione è cruciale per chi cerca efficienza on-premise e un TCO ottimizzato.

2026-05-17 Fonte

Adlink sta puntando sull'Intelligenza Artificiale fisica, integrando l'AI direttamente in sistemi tangibili per settori critici come la robotica, la sanità e i semiconduttori. Questo approccio richiede soluzioni edge e on-premise per garantire bassa latenza, sovranità dei dati e affidabilità, ponendo nuove sfide e opportunità per l'infrastruttura hardware e il deployment.

2026-05-16 Fonte

Nuovi benchmark su hardware AMD Strix Halo esplorano le prestazioni di llama.cpp con LLM Qwen3.6, confrontando le versioni standard e MTP. I risultati evidenziano un notevole miglioramento nella generazione di token per entrambi i modelli, con il 27B-MTP che mostra un'accelerazione complessiva significativa, specialmente in scenari di chat a lungo contesto. Il modello 35B-MTP, invece, presenta un framework più sfumato, con un incremento della generazione ma un tempo totale leggermente superiore in alcuni test.

2026-05-16 Fonte

Un recente test ha dimostrato la capacità di una GPU RTX 5090, collegata tramite eGPU dock a un MacBook con chip M-series, di gestire carichi di lavoro grafici estremamente intensivi. L'esperimento, che ha visto il sistema eseguire Cyberpunk 2077 a oltre 100 FPS con impostazioni massime e frame generation, evidenzia il potenziale delle soluzioni eGPU per estendere le capacità di calcolo di piattaforme non convenzionali. Questo approccio offre spunti interessanti per scenari di deployment on-premise che richiedono flessibilità e potenza computazionale.

2026-05-16 Fonte

AMD ha rilasciato ROCm 7.13, l'ultima anteprima del suo SDK Core, che introduce il supporto per le GPU Instinct MI350P e per un numero maggiore di APU Ryzen AI. Questo aggiornamento è cruciale per gli sviluppatori e le aziende che utilizzano l'hardware AMD per carichi di lavoro di intelligenza artificiale, rafforzando l'ecosistema software in vista della futura versione ROCm 8.0 e facilitando i deployment on-premise.

2026-05-16 Fonte

Un'analisi dettagliata esplora l'efficienza energetica di una configurazione on-premise con quattro GPU NVIDIA RTX 3090 per l'inference di Large Language Models. I test rivelano un punto di massima efficienza a 220W per GPU, bilanciando throughput e consumo energetico, un dato cruciale per chi gestisce infrastrutture locali e mira a ottimizzare il TCO.

2026-05-15 Fonte