📁 Hardware

Questa sezione Hardware segue il lato pratico dell'infrastruttura AI locale: GPU, NPU, mini PC, acceleratori edge, banda memoria e compromessi energetici che incidono direttamente sulle prestazioni in inferenza. Privilegiamo aggiornamenti con benchmark e note operative utili a decisioni reali, dal laboratorio domestico ai cluster pilota in azienda. Qui puoi confrontare costo totale, vincoli termici e scenari modello-hardware, poi approfondire con la guida pillar hardware e la copertura LLM collegata.

La recente confusione attorno alle specifiche della GPU RTX Spark evidenzia l'importanza di distinguere tra la larghezza di banda della memoria e la velocità di interconnessione NVLink. Molte testate hanno erroneamente attribuito alla GPU una larghezza di banda di 600 GB/s, un valore che in realtà si riferisce alla capacità di NVLink. Questo errore sottolinea la necessità di accuratezza nei dati tecnici per le decisioni infrastrutturali, specialmente per i deployment on-premise.

2026-06-01 Fonte

La NVIDIA DGX Station A100 si posiziona come una soluzione on-premise compatta ma potente per carichi di lavoro AI enterprise. Dotata di quattro GPU A100 da 80GB ciascuna, offre 320GB di VRAM complessiva e fino a 2.5 PetaFLOPS di performance. Questo sistema self-contained, con un costo di circa 150.000 sterline, include la suite software NVIDIA AI Enterprise, rendendolo una scelta strategica per aziende che necessitano di sovranità dei dati e controllo sull'infrastruttura AI.

2026-06-01 Fonte

NVIDIA ha annunciato al Computex 2026 l'entrata in piena produzione della piattaforma Vera Rubin e l'arrivo di Windows sui sistemi DGX Station entro il Q4. Questi sviluppi sono cruciali per le aziende che valutano infrastrutture AI on-premise, offrendo nuove opzioni hardware e software per il controllo dei dati e l'ottimizzazione dei carichi di lavoro.

2026-06-01 Fonte

Nvidia sta esplorando nuove opportunità nel panorama dei sistemi basati su architettura Arm con il progetto "RTX Spark". Questa iniziativa emerge in un momento chiave, dopo la scadenza dell'accordo esclusivo di Qualcomm per Windows on Arm. Nvidia si posiziona per capitalizzare su un mercato dove le precedenti soluzioni hanno incontrato sfide, puntando a integrare le sue rinomate capacità grafiche e di AI in un ecosistema in evoluzione.

2026-06-01 Fonte

Il Computex 2026 si conferma un appuntamento chiave per le innovazioni hardware che plasmeranno il futuro dei deployment AI. Per i professionisti IT che valutano soluzioni on-premise, l'accesso a report dettagliati è fondamentale per comprendere i trade-off tra performance, TCO e sovranità dei dati, guidando scelte strategiche per l'infrastruttura di Large Language Models.

2026-06-01 Fonte

Intel si prepara a lanciare entro fine anno il chip AI 'Crescent Island', una GPU progettata per le attività di inference. L'azienda mira a competere con Nvidia e AMD offrendo soluzioni con memoria e sistemi di raffreddamento più economici, puntando a ridurre il Total Cost of Ownership per i deployment AI, in particolare per i carichi di lavoro on-premise.

2026-06-01 Fonte

Mentre il Computex 2026 si prepara a Taipei, l'attenzione si sposta sulle innovazioni hardware che definiranno il futuro dei deployment AI on-premise. L'evento rappresenta un punto di riferimento cruciale per CTO e architetti infrastrutturali, offrendo uno sguardo sulle tecnicie che influenzeranno la sovranità dei dati, il TCO e le capacità di inference locale per i Large Language Models.

2026-06-01 Fonte

L'industria cinese dei chip per l'IA sta abbandonando l'obiettivo di replicare le GPU general-purpose di Nvidia. A causa dei continui controlli sulle esportazioni statunitensi, che limitano l'accesso ai processori grafici più potenti, le principali aziende tecniciche cinesi si stanno orientando verso lo sviluppo di circuiti integrati specifici per applicazioni (ASIC). Questa strategia mira a creare chip personalizzati, ottimizzati per eseguire compiti specifici con elevata efficienza, piuttosto che gestire carichi di lavoro generici.

2026-06-01 Fonte

Nvidia ha annunciato il chip RTX Spark, progettato per garantire la compatibilità nativa con le principali tecnicie anti-cheat e DRM, inclusi titoli come Fortnite e Valorant, nell'ecosistema Windows on Arm. Questa mossa, presentata dal CEO Jensen Huang, segna un passo significativo per l'integrazione hardware-software in un ambiente sempre più rilevante per lo sviluppo di soluzioni locali e edge.

2026-06-01 Fonte

NVIDIA ha presentato RTX Spark, un System-on-Chip (SoC) basato su architettura Arm, specificamente progettato per i PC Windows di fascia alta. Il chip integra 20 core CPU e una potente GPU basata sull'architettura Blackwell. Questa mossa segna l'ingresso di NVIDIA nel mercato dei PC Windows premium con una soluzione hardware che punta a offrire prestazioni elevate e efficienza energetica.

2026-06-01 Fonte

Nvidia ha annunciato la disponibilità della sua prossima piattaforma, Vera Rubin, e ha presentato RTX Spark, una macchina Windows basata su architettura Arm, durante il keynote di Computex 2026 a Taipei. L'intervento del CEO Jensen Huang ha delineato le prossime mosse dell'azienda nel settore dell'AI e dei PC, con implicazioni dirette per l'hardware dedicato all'inference e al training on-premise e per le strategie di deployment.

2026-06-01 Fonte

Le azioni di LG Electronics hanno registrato un'impennata quest'anno, con un picco del 30% per due sessioni consecutive. Il catalizzatore è l'annuncio di un incontro tra il presidente di LG Group e il CEO di Nvidia, Jensen Huang, previsto per il 5 giugno. L'obiettivo è esplorare una maggiore collaborazione nel campo dell'AI fisica, un settore che sta attirando l'attenzione per le sue implicazioni sui deployment on-premise e sull'hardware dedicato.

2026-06-01 Fonte

Il Computex 2026 di Taipei si conferma un appuntamento cruciale per l'innovazione hardware. Sebbene i dettagli specifici degli annunci del primo giorno siano ancora in fase di emersione, l'evento è un barometro fondamentale per le tendenze che influenzeranno i deployment di Large Language Models (LLM) on-premise, la sovranità dei dati e l'ottimizzazione del Total Cost of Ownership (TCO) per le infrastrutture AI.

2026-06-01 Fonte

An Open Source developer has released NBD-VRAM, a tool that enables the creation of swap space on the VRAM of consumer NVIDIA GeForce GPUs under Linux. This solution aims to extend available memory capacity for intensive workloads, such as Large Language Models, offering new possibilities for on-premise deployments with existing hardware and contributing to data sovereignty.

2026-06-01 Fonte

Durante il keynote di Computex, Jensen Huang di NVIDIA ha annunciato ufficialmente RTX Spark, un nuovo "superchip" progettato per equipaggiare PC desktop compatti e laptop. Questa mossa mira a portare capacità di calcolo avanzate direttamente sui dispositivi locali, aprendo nuove prospettive per l'esecuzione di carichi di lavoro AI e LLM in ambienti on-premise e edge.

2026-06-01 Fonte

L'aggiornamento DLSS 4.5 Ray Reconstruction, previsto per agosto, promette di elevare la qualità visiva del ray tracing. Questa evoluzione si basa su un set di dati di training più ampio e su un'architettura transformer di seconda generazione, fattori chiave per migliorare la fedeltà delle immagini. Per i professionisti IT, queste innovazioni sottolineano la crescente complessità dell'inference AI e la necessità di hardware dedicato, con implicazioni dirette sui deployment on-premise.

2026-06-01 Fonte

LianDe Holdings ha annunciato l'avvio della produzione di massa per i suoi raccordi flottanti a raffreddamento liquido, destinati alla supply chain dei produttori di chip statunitensi. Questa iniziativa evidenzia la crescente importanza delle soluzioni termiche avanzate per gestire la densità di potenza e le prestazioni richieste dai processori di nuova generazione, in particolare per i carichi di lavoro intensivi come i Large Language Models (LLM) in ambienti on-premise.

2026-06-01 Fonte

NVIDIA ha annunciato a Computex che il suo nuovo processore "Vera", sviluppato internamente, è già in uso presso importanti realtà del settore tech. Tra i primi ad adottarlo figurano Anthropic, OpenAI, SpaceX e Oracle. Questa mossa segna un'espansione strategica per NVIDIA, tradizionalmente leader nelle GPU, verso soluzioni di calcolo più integrate, con implicazioni significative per le infrastrutture AI e i deployment on-premise.

2026-06-01 Fonte

Zhen Ding, attore chiave nella produzione di circuiti stampati (PCB), evidenzia come l'intelligenza artificiale stia trasformando il ruolo di questi componenti. L'azienda rileva una crescente domanda, suggerendo un impatto significativo sulla supply chain e sull'infrastruttura hardware necessaria per supportare i carichi di lavoro AI, in particolare per i deployment on-premise.

2026-06-01 Fonte

Invisix, una startup nata da ASML, ha raccolto 20 milioni di euro per sviluppare nuove tecnicie di ispezione dei chip. L'obiettivo è superare i limiti degli strumenti ottici tradizionali, incapaci di analizzare le strutture interne dei semiconduttori moderni, sempre più complessi e miniaturizzati. Questa innovazione è cruciale per la produzione di hardware avanzato, fondamentale per i deployment on-premise di carichi di lavoro AI, garantendo qualità e affidabilità del silicio.

2026-06-01 Fonte