📁 Hardware

Questa sezione Hardware segue il lato pratico dell'infrastruttura AI locale: GPU, NPU, mini PC, acceleratori edge, banda memoria e compromessi energetici che incidono direttamente sulle prestazioni in inferenza. Privilegiamo aggiornamenti con benchmark e note operative utili a decisioni reali, dal laboratorio domestico ai cluster pilota in azienda. Qui puoi confrontare costo totale, vincoli termici e scenari modello-hardware, poi approfondire con la guida pillar hardware e la copertura LLM collegata.

Le due rivali storiche mettono da parte le divergenze per contrastare l’ascesa di Arm nei data center. L’annuncio congiunto segna una nuova fase nella guerra delle architetture, con possibili ripercussioni su TCO, sovranità dei dati e deployment on-premise per carichi AI.

2026-06-22 Fonte

Secondo DIGITIMES, Intel e Nvidia starebbero lavorando a un processore PC congiunto che potrebbe vedere la luce al CES 2028. Al di là delle indiscrezioni ancora sottili, l’idea di un chip frutto della collaborazione tra le due rivali di Santa Clara segnala un possibile riassetto della competizione nell’hardware per l’intelligenza artificiale, con ricadute concrete per chi cerca soluzioni di inference locale e deployment on-premise.

2026-06-22 Fonte

Al Computex 2026 MiTAC ha mostrato sistemi GPU, storage e server con raffreddamento a diamante, fino a rack da 52 unità. Uno sguardo al futuro dell'hardware per l'inference LLM on-premise, dove densità e gestione termica ridefiniscono i trade-off tra TCO, sovranità e controllo dell'infrastruttura.

2026-06-22 Fonte

Il team di driver open-source di Valve sta portando un recovery più robusto per le GPU AMD Graphics Core Next (GCN) in caso di freeze. Un passo avanti per la stabilità delle vecchie schede su Linux, con ricadute concrete per chi esegue carichi on-premise senza interruzioni.

2026-06-22 Fonte

Con un nuovo vertice, il costruttore taiwanese di macchine utensili punta ad aerospazio, IA e chip. La mossa si inserisce nella corsa alla sovranità tecnicica e alla catena di fornitura per l’hardware on-premise: componentistica di precisione, raffreddamento e attrezzature per semiconduttori diventano snodi critici per chi valuta il TCO dell’inference locale.

2026-06-21 Fonte

Un server con due GPU Radeon AI PRO R9700 e 64 GB di VRAM totale mette alla prova Qwen 3.6 27B in quantization Q8 con Multi-Token Prediction. Decode fino a 67 token/s su contesti pieni, prefill oltre 1.500 t/s e prompt caching efficiente: uno spaccato concreto per chi valuta deployment locale di LLM senza dipendere dal cloud.

2026-06-21 Fonte

Un appassionato ha convertito una macchina per il ghiaccio da banco in un sistema di raffreddamento per una RTX 3060, regolato da un termostato da frigo per birra. Il risultato? Temperature ridotte fino al 62% nei giochi, con Cyberpunk 2077 che viaggia a 22°C. Una trovata estrema che riaccende il dibattito sul thermal management per l’hardware ad alte prestazioni.

2026-06-21 Fonte

Un test su GPU AMD MI50 del 2018 con MiniMax M3 quantizzato a 4 bit raggiunge 19 token/s su 8 schede e 18 token/s su 16, grazie al decoding speculativo. Ma la latenza elevata (oltre 70 secondi per il primo token su prompt lunghi) e la generazione interminabile del ragionamento rendono l’esperienza inadatta allo sviluppo agentivo. I dati offrono uno sguardo concreto sulle possibilità e i limiti dell’hardware datacenter di vecchia generazione per il deployment locale di LLM.

2026-06-21 Fonte

GMKtec ha svelato una versione ridisegnata del suo EVO-X3, una workstation AI in formato mini PC basata sul potente processore AMD Ryzen AI Max+ 395 'Strix Halo'. Il dispositivo esibisce la firma di Lisa Su, CEO di AMD, segnale di una stretta collaborazione e di un’offerta pensata per chi cerca elevate prestazioni di inference locale in un corpo compatto.

2026-06-21 Fonte

Nei preparativi per il merge window di Linux 7.2, spunta un primo, discreto accenno al supporto per la prossima generazione di GPU NVIDIA, di cui ancora nulla si sa. Un indizio che conta per chi gestisce infrastrutture on-premise e guarda già ai refresh del parco hardware.

2026-06-21 Fonte

Secondo i test di CNET Labs, gli AirPods Pro 3 registrano un errore medio dell’1,67% rispetto a una fascia toracica Polar H10 di grado medicale, diventando il secondo dispositivo consumer più accurato mai misurato dalla testata. Solo l’Apple Watch Series 11 fa meglio (0,98%). Un risultato che riduce la distanza tra auricolari e wearable da polso.

2026-06-20 Fonte

Pechino ha imposto una coalizione fra aziende di chip e costruttori di satelliti per realizzare data center AI in orbita, scollegati dalla rete elettrica terrestre. Il progetto, annunciato alla vigilia di un atteso reveal AI di Elon Musk, rappresenta una mossa di sovranità tecnicica che ridisegna il concetto di edge computing e sfida le infrastrutture spaziali di SpaceX.

2026-06-20 Fonte

Un'edizione speciale del Monopoli, regalata ai dipendenti ASML nel 2007, viene barattata su piattaforme social con un modello LEGO del più avanzato sistema di litografia al mondo. L'episodio, apparentemente folcloristico, accende i riflettori sulla tecnicia High-NA EUV, essenziale per produrre i processori che rendono concreti i deployment on-premise di LLM e i carichi di inference AI.

2026-06-20 Fonte

Un appassionato di hardware esegue GLM 5.2 UD IQ2_M su una configurazione dual GPU con RTX 5090 e RTX 3090 in bifurcation x8. Nonostante la quantization molto bassa, il modello produce immagini SVG di qualità elevata, ma con un token rate ridotto. Il caso mette in luce le potenzialità e i compromessi dell'inference on-premise su hardware consumer di fascia alta, mentre l'utente pianifica un sistema Threadripper con 12 RTX 3090 per spingersi oltre.

2026-06-20 Fonte