📁 Hardware

Questa sezione Hardware segue il lato pratico dell'infrastruttura AI locale: GPU, NPU, mini PC, acceleratori edge, banda memoria e compromessi energetici che incidono direttamente sulle prestazioni in inferenza. Privilegiamo aggiornamenti con benchmark e note operative utili a decisioni reali, dal laboratorio domestico ai cluster pilota in azienda. Qui puoi confrontare costo totale, vincoli termici e scenari modello-hardware, poi approfondire con la guida pillar hardware e la copertura LLM collegata.

Il nuovo chip inferenziale progettato da Broadcom e costruito da TSMC segna l’ingresso di OpenAI nella corsa al silicio personalizzato. Una svolta che ridisegna gli equilibri nella supply chain e pone le basi per un futuro in cui anche i carichi on-premise potrebbero beneficiare di architetture ottimizzate, con TCO più basso e maggiore controllo sui dati.

2026-06-25 Fonte

La controllante di flash memory Phison segnala che la carenza di chip NAND non accenna a finire, con ordini prenotati fino al secondo trimestre 2027. Uno scenario che impone alle aziende che gestiscono infrastrutture on-premise di rivedere tempistiche e costi per storage e server AI.

2026-06-25 Fonte

OpenAI e Broadcom annunciano Jalapeño, un chip custom progettato per l'inference dei Large Language Model nei data center. Primo tassello di un progetto a lungo termine, punta a ridefinire efficienza e costi dell'inference su larga scala. AI-RADAR analizza le implicazioni per chi valuta stack on-premise.

2026-06-24 Fonte

Al suo Investor Day 2026 Qualcomm ha presentato la CPU Dragonfly C1000, una soluzione di memoria ad alta larghezza di banda proprietaria come alternativa all’HBM e nuovi acceleratori AI. L’incursione nei rack dei data center segnala un cambio di passo che potrebbe ridefinire gli equilibri per chi cerca stack on-premise ad alte prestazioni e maggiore sovranità sui carichi di inference.

2026-06-24 Fonte

Broadcom e OpenAI hanno presentato Jalapeño, il primo processore customizzato di OpenAI. È un ASIC gigantesco, grande quanto l’intero reticolo litografico, ottimizzato esclusivamente per l’inference, e realizzato in soli nove mesi. L'architettura su misura segna un’accelerazione nella corsa al silicio proprietario per carichi LLM, con implicazioni sui costi e sulla sovranità dei dati per chi gestisce deployment in sede.

2026-06-24 Fonte

Una startup californiana sostenuta da capitali USA e guidata da Pat Gelsinger punta a costruire una sorgente di luce EUV concorrente. Il mercato dell'hardware per AI torna a scaldarsi, e questo investimento segnala un possibile allentamento della morsa di ASML sulla produzione di semiconduttori avanzati, con potenziali effetti a catena per chi fa deployment on-premise di LLM.

2026-06-24 Fonte

La collaborazione tra OpenAI e Broadcom dà vita a un processore custom ottimizzato per l’inference di modelli di linguaggio di grandi dimensioni. L’annuncio di Jalapeño segna un’accelerazione verso hardware specializzato, con possibili ricadute su efficienza e sovranità dei dati per i deployment aziendali.

2026-06-24 Fonte

La domanda globale di infrastrutture per l'intelligenza artificiale accelera l'economia di Taiwan, con investimenti e esportazioni tech che proiettano la crescita del PIL oltre il 10%. È un segnale di quanto la filiera dei semiconduttori sia centrale per il futuro dell'AI on-premise e su scala industriale.

2026-06-24 Fonte

L’accordo tra Meta ed EssilorLuxottica dà vita a una nuova linea accessibile di occhiali con intelligenza artificiale. Il catalogo smart eyewear sale così a quattro dispositivi, segnando un’ulteriore spinta verso l’AI indossabile e riaccendendo il dibattito su elaborazione locale, privacy e architetture edge.

2026-06-24 Fonte

Test su doppia RTX Pro 6000 mostrano che modelli con attenzione ibrida a finestra scorrevole come Mimo 2.5 e Step 3.7 Flash tengono alte velocità anche a 178k token, mentre architetture che puntano su kernel CUDA custom faticano. Il software per Blackwell consumer è ancora indietro, premiando chi sceglie attenzione “vecchia scuola” per l’agentic locale.

2026-06-24 Fonte