📁 Hardware

Questa sezione Hardware segue il lato pratico dell'infrastruttura AI locale: GPU, NPU, mini PC, acceleratori edge, banda memoria e compromessi energetici che incidono direttamente sulle prestazioni in inferenza. Privilegiamo aggiornamenti con benchmark e note operative utili a decisioni reali, dal laboratorio domestico ai cluster pilota in azienda. Qui puoi confrontare costo totale, vincoli termici e scenari modello-hardware, poi approfondire con la guida pillar hardware e la copertura LLM collegata.

Un utente di Reddit sta sperimentando una workstation locale dotata di 6 GPU (circa 200GB di VRAM) per l'esecuzione concorrente di modelli di ragionamento open-source. L'obiettivo è l'analisi di dati interni e l'automazione del flusso di lavoro. Si cercano consigli su colli di bottiglia, gestione di GPU miste e strategie di scheduling dei modelli.

2026-02-14 Fonte

Il modello OpenAI GPT-5.3-Codex-Spark è ora operativo su chip Cerebras WSE-3, raggiungendo velocità di inference superiori a 1000 token al secondo. Questa performance apre nuove prospettive per applicazioni che richiedono risposte rapide e a bassa latenza.

2026-02-14 Fonte

NVIDIA ha rilasciato un aggiornamento open-source per il driver Nouveau, focalizzato sul supporto della GPU GA100 tramite il processore di sistema GPU (GSP). Questa mossa mira a migliorare la compatibilità e le prestazioni delle GPU NVIDIA con driver open-source.

2026-02-13 Fonte

Un utente ha finalizzato le specifiche del proprio server domestico, dotato di 4 GPU MI50, 2 CPU 8260L e 2TB di RAM DDR4. La configurazione include una VBIOS personalizzata per Linux, aprendo interrogativi sulle possibili ottimizzazioni e carichi di lavoro ideali per tale setup.

2026-02-13 Fonte

Il modello GPT-5.3-Codex-Spark di OpenAI è stato ottimizzato per funzionare sui processori Cerebras WSE-3, raggiungendo una velocità di inference di oltre 1000 token al secondo. Questa performance apre nuove prospettive per applicazioni che richiedono risposte rapide e a bassa latenza.

2026-02-13 Fonte

La Radeon RX 9060 XT 8GB, basata su architettura Navi 44, si riposiziona sul mercato con un prezzo di listino di 299 dollari. Questa mossa mira a fornire una soluzione accessibile per i giocatori con budget limitato, in un contesto di crescente domanda e costi elevati per le GPU dedicate all'intelligenza artificiale.

2026-02-13 Fonte

OpenAI ha implementato GPT-5.3-Codex-Spark su architettura Cerebras, segnando la prima volta che l'azienda si allontana dall'infrastruttura Nvidia per un deployment di produzione. Questa mossa strategica potrebbe avere implicazioni significative per il futuro dell'inference di modelli linguistici di grandi dimensioni.

2026-02-13 Fonte

Quanta Computer espande la produzione di server AI in Thailandia, aumentando gli investimenti per rispondere alla crescente domanda. L'iniziativa mira a rafforzare la capacità produttiva nel settore dell'intelligenza artificiale, con un focus sui server dedicati.

2026-02-13 Fonte

SK Hynix ha avviato l'ordinazione di attrezzature per una nuova linea di packaging HBM (High Bandwidth Memory) a Cheongju, in risposta alla crescente domanda di memorie ad alte prestazioni guidata dall'intelligenza artificiale. L'espansione mira ad aumentare la capacità produttiva di HBM.

2026-02-13 Fonte

Al SEMICON Korea, Samsung ha evidenziato i progressi nel settore delle memorie HBM con tecnicia hybrid bonding. SK Hynix, invece, ha posto l'accento sull'integrazione dell'intelligenza artificiale a livello di piattaforma, segnalando un cambio di paradigma nell'approccio all'innovazione tecnicica nel settore dei semiconduttori.

2026-02-13 Fonte

OpenAI ha rilasciato il modello GPT-5.3-Codex-Spark, il suo primo modello di produzione AI a funzionare su hardware non-Nvidia, utilizzando chip Cerebras. Il modello offre codice a oltre 1.000 token al secondo, circa 15 volte più veloce del suo predecessore. L'accesso è disponibile per gli abbonati ChatGPT Pro e partner selezionati.

2026-02-12 Fonte

OpenAI ha presentato GPT-5.3-Codex-Spark, il suo primo modello progettato per funzionare sugli acceleratori AI di Cerebras Systems. Questi acceleratori, noti per la loro ampia superficie e la memoria on-chip ad alta velocità, competono direttamente con le soluzioni di Nvidia e AMD nel mercato dell'intelligenza artificiale.

2026-02-12 Fonte

L'aggiornamento di Nvidia DGX Spark introduce il rilevamento hot-plug sulla NIC ConnectX, ottimizzando l'efficienza energetica delle workstation AI e riducendo i consumi in idle del 32% o più. Un passo avanti per workstation AI più efficienti.

2026-02-12 Fonte

Indiscrezioni suggeriscono che GLM-5, un modello linguistico di grandi dimensioni (LLM), sia stato addestrato esclusivamente utilizzando hardware Huawei e il framework Mindspore. Se confermato, questo rappresenterebbe un significativo passo avanti per la tecnicia cinese nel campo dell'intelligenza artificiale, con implicazioni per la sovranità tecnicica e le alternative on-premise.

2026-02-12 Fonte

Jensen Huang, CEO di Nvidia, ha riconosciuto il ruolo di leadership di Foxconn nel settore dei server AI durante un evento aziendale. La collaborazione tra le due aziende si concentra sullo sviluppo di soluzioni hardware avanzate per carichi di lavoro di intelligenza artificiale.

2026-02-12 Fonte

Samsung annuncia l'inizio della produzione di massa di memorie HBM4, una novità mondiale che potrebbe ridefinire le prestazioni nell'ambito dell'intelligenza artificiale e dell'high-performance computing. Questa mossa consolida la posizione di Samsung nel mercato delle memorie ad alta velocità.

2026-02-12 Fonte

Il kernel Linux 7.0 introduce importanti aggiornamenti ai driver grafici DRM (Direct Rendering Manager), con novità per hardware AMD e il supporto SR-IOV per Intel Xe. Inclusi anche miglioramenti per i driver "accel" dedicati ad acceleratori AI come le NPU.

2026-02-12 Fonte