Un utente di Reddit sta sperimentando una workstation locale dotata di 6 GPU (circa 200GB di VRAM) per l'esecuzione concorrente di modelli di ragionamento open-source. L'obiettivo è l'analisi di dati interni e l'automazione del flusso di lavoro. Si cercano consigli su colli di bottiglia, gestione di GPU miste e strategie di scheduling dei modelli.
Un appassionato ha acquistato due schede grafiche Nvidia GTX Titan X (Maxwell) con sistema di raffreddamento a liquido personalizzato per soli 86 dollari. Si tratta di GPU di punta di precedente generazione, ancora valide per determinati carichi di lavoro.
In occasione del President's Day, MSI propone la GeForce RTX 5060 Ti 8GB Ventus 2X OC Plus al prezzo di listino di 379 dollari. L'offerta include anche la possibilità di acquistare una GPU Blackwell al prezzo consigliato e un alimentatore da 650W in omaggio.
Un esperimento ha messo alla prova audiofili esperti: impossibile distinguere segnali audio trasmessi attraverso cavi di rame, banane o persino fango umido. Il creatore del test si è detto sorpreso dal risultato.
Il modello OpenAI GPT-5.3-Codex-Spark è ora operativo su chip Cerebras WSE-3, raggiungendo velocità di inference superiori a 1000 token al secondo. Questa performance apre nuove prospettive per applicazioni che richiedono risposte rapide e a bassa latenza.
NVIDIA ha rilasciato un aggiornamento open-source per il driver Nouveau, focalizzato sul supporto della GPU GA100 tramite il processore di sistema GPU (GSP). Questa mossa mira a migliorare la compatibilità e le prestazioni delle GPU NVIDIA con driver open-source.
Un utente ha finalizzato le specifiche del proprio server domestico, dotato di 4 GPU MI50, 2 CPU 8260L e 2TB di RAM DDR4. La configurazione include una VBIOS personalizzata per Linux, aprendo interrogativi sulle possibili ottimizzazioni e carichi di lavoro ideali per tale setup.
Il modello GPT-5.3-Codex-Spark di OpenAI è stato ottimizzato per funzionare sui processori Cerebras WSE-3, raggiungendo una velocità di inference di oltre 1000 token al secondo. Questa performance apre nuove prospettive per applicazioni che richiedono risposte rapide e a bassa latenza.
La Radeon RX 9060 XT 8GB, basata su architettura Navi 44, si riposiziona sul mercato con un prezzo di listino di 299 dollari. Questa mossa mira a fornire una soluzione accessibile per i giocatori con budget limitato, in un contesto di crescente domanda e costi elevati per le GPU dedicate all'intelligenza artificiale.
OpenAI ha implementato GPT-5.3-Codex-Spark su architettura Cerebras, segnando la prima volta che l'azienda si allontana dall'infrastruttura Nvidia per un deployment di produzione. Questa mossa strategica potrebbe avere implicazioni significative per il futuro dell'inference di modelli linguistici di grandi dimensioni.
Quanta Computer espande la produzione di server AI in Thailandia, aumentando gli investimenti per rispondere alla crescente domanda. L'iniziativa mira a rafforzare la capacità produttiva nel settore dell'intelligenza artificiale, con un focus sui server dedicati.
SK Hynix ha avviato l'ordinazione di attrezzature per una nuova linea di packaging HBM (High Bandwidth Memory) a Cheongju, in risposta alla crescente domanda di memorie ad alte prestazioni guidata dall'intelligenza artificiale. L'espansione mira ad aumentare la capacità produttiva di HBM.
Al SEMICON Korea, Samsung ha evidenziato i progressi nel settore delle memorie HBM con tecnicia hybrid bonding. SK Hynix, invece, ha posto l'accento sull'integrazione dell'intelligenza artificiale a livello di piattaforma, segnalando un cambio di paradigma nell'approccio all'innovazione tecnicica nel settore dei semiconduttori.
OpenAI ha rilasciato il modello GPT-5.3-Codex-Spark, il suo primo modello di produzione AI a funzionare su hardware non-Nvidia, utilizzando chip Cerebras. Il modello offre codice a oltre 1.000 token al secondo, circa 15 volte più veloce del suo predecessore. L'accesso è disponibile per gli abbonati ChatGPT Pro e partner selezionati.
OpenAI ha presentato GPT-5.3-Codex-Spark, il suo primo modello progettato per funzionare sugli acceleratori AI di Cerebras Systems. Questi acceleratori, noti per la loro ampia superficie e la memoria on-chip ad alta velocità, competono direttamente con le soluzioni di Nvidia e AMD nel mercato dell'intelligenza artificiale.
L'aggiornamento di Nvidia DGX Spark introduce il rilevamento hot-plug sulla NIC ConnectX, ottimizzando l'efficienza energetica delle workstation AI e riducendo i consumi in idle del 32% o più. Un passo avanti per workstation AI più efficienti.
Indiscrezioni suggeriscono che GLM-5, un modello linguistico di grandi dimensioni (LLM), sia stato addestrato esclusivamente utilizzando hardware Huawei e il framework Mindspore. Se confermato, questo rappresenterebbe un significativo passo avanti per la tecnicia cinese nel campo dell'intelligenza artificiale, con implicazioni per la sovranità tecnicica e le alternative on-premise.
Jensen Huang, CEO di Nvidia, ha riconosciuto il ruolo di leadership di Foxconn nel settore dei server AI durante un evento aziendale. La collaborazione tra le due aziende si concentra sullo sviluppo di soluzioni hardware avanzate per carichi di lavoro di intelligenza artificiale.
Samsung annuncia l'inizio della produzione di massa di memorie HBM4, una novità mondiale che potrebbe ridefinire le prestazioni nell'ambito dell'intelligenza artificiale e dell'high-performance computing. Questa mossa consolida la posizione di Samsung nel mercato delle memorie ad alta velocità.
Il kernel Linux 7.0 introduce importanti aggiornamenti ai driver grafici DRM (Direct Rendering Manager), con novità per hardware AMD e il supporto SR-IOV per Intel Xe. Inclusi anche miglioramenti per i driver "accel" dedicati ad acceleratori AI come le NPU.