AI-Radar - Osservatorio su LLM locali, hardware AI e trend

AI-Radar per LLM on-prem & AI in casa

Il radar quotidiano su modelli, framework e hardware per far girare l'AI in locale. LLM, LangChain, Chroma, mini-PC e tutto ciò che serve per un cervello distribuito "in-house".

⚙️ Stack: LLM locali · LangChain · Transformers · ChromaDB · MiniPC · AI boxes
🛰️ Ask Observatory (Q&A + RAG) già collegato all'archivio articoli.
👥 160+ membri · Iscriviti gratis →

⚡ In Tendenza

View All →

🛠️ Guide & Osservatorio On-Premise

🚀 Esegui i modelli in locale → Tutte le guide →

Riferimenti evergreen e pratici per far girare l'AI in locale — hardware, costi, privacy e stack completo.

🖥️ Osservatorio LLM On-Premise Hardware, stack, governance e architetture di riferimento per l'AI in locale.

Ultime analisi & news dal radar

Articoli generati dall'AI sulla base dei feed, con spazio per layer editoriale umano sopra il contenuto grezzo.

Gemma 4.31B FP8 e Sonnet 4.6: LLM on-premise e ottimizzazione delle risorse
📁 Altro AI generated ℹ️ LocalLLaMA

Gemma 4.31B FP8 e Sonnet 4.6: LLM on-premise e ottimizzazione delle risorse

Un recente test evidenzia come il modello Gemma 4.31B, ottimizzato con Quantization FP8, sia in grado di eguagliare le prestazioni di Sonnet 4.6 Medium in diverse attività complesse. Questo risultato, ottenuto in un ambiente locale, sottolinea il potenziale degli LLM efficienti per deployment on-premise, offrendo nuove opportunità per la sovranità dei dati e il controllo infrastrutturale, anche su hardware con risorse limitate.

2026-06-08 📰 Fonte
Naver e Nvidia: la Corea del Sud accelera verso l'AI sovrana con 'fabbriche' da gigawatt
📁 Altro AI generated ✅ DigiTimes

Naver e Nvidia: la Corea del Sud accelera verso l'AI sovrana con 'fabbriche' da gigawatt

Naver, in collaborazione con Nvidia, si appresta a costruire infrastrutture AI su scala gigawatt, segnando un'accelerazione significativa nella strategia della Corea del Sud per l'intelligenza artificiale sovrana. L'iniziativa sottolinea l'importanza crescente del controllo nazionale sui dati e sulle capacità di calcolo, spingendo verso deployment on-premise massivi per gestire carichi di lavoro LLM complessi e garantire la sovranità tecnicica.

2026-06-08 📰 Fonte
Nvidia rivede il design di raffreddamento per la piattaforma Vera Rubin
📁 Hardware AI generated ✅ DigiTimes

Nvidia rivede il design di raffreddamento per la piattaforma Vera Rubin

Nvidia starebbe abbandonando l'architettura di raffreddamento a due pezzi per la sua prossima piattaforma Vera Rubin, secondo quanto riportato da DIGITIMES. Questa mossa potrebbe indicare un'evoluzione nel design hardware, con implicazioni significative per la densità dei server e l'efficienza termica nei data center. La gestione del calore è un fattore cruciale per le GPU ad alte prestazioni, specialmente in contesti on-premise dove l'ottimizzazione dello spazio e dei consumi energetici è prioritaria per i CTO e gli architetti di infrastruttura.

2026-06-08 📰 Fonte
Hitachi e Intel: una partnership strategica per l'AI fisica e l'industria
📁 Altro AI generated ✅ DigiTimes

Hitachi e Intel: una partnership strategica per l'AI fisica e l'industria

Hitachi e Intel hanno formalizzato una collaborazione strategica per avanzare nello sviluppo dell'AI fisica e delle infrastrutture industriali. L'iniziativa mira a integrare capacità di intelligenza artificiale direttamente negli ambienti operativi, con implicazioni significative per settori come la produzione, la logistica e la gestione degli asset. Questa partnership sottolinea l'importanza di soluzioni AI robuste e localizzate per le esigenze del mondo industriale.

2026-06-08 📰 Fonte
Nvidia e SK Telecom: un'alleanza per un'AI cloud su scala gigawatt in Corea
📁 Altro AI generated ✅ DigiTimes

Nvidia e SK Telecom: un'alleanza per un'AI cloud su scala gigawatt in Corea

Nvidia e SK Telecom hanno annunciato una collaborazione strategica per la creazione di un'infrastruttura AI cloud di dimensioni considerevoli in Corea. L'iniziativa, che mira a supportare carichi di lavoro intensivi per l'intelligenza artificiale, sottolinea l'importanza di partnership tecniciche per lo sviluppo di capacità di calcolo avanzate, con implicazioni per la sovranità dei dati e l'efficienza energetica su larga scala.

2026-06-08 📰 Fonte
Nvidia e Doosan Rafforzano la Collaborazione per Robotica e Infrastrutture AI
📁 Altro AI generated ✅ DigiTimes

Nvidia e Doosan Rafforzano la Collaborazione per Robotica e Infrastrutture AI

Nvidia e Doosan ampliano la loro partnership, puntando a sviluppare soluzioni per la robotica e le infrastrutture AI in ambito industriale. Questa collaborazione evidenzia la crescente domanda di capacità di calcolo on-premise per carichi di lavoro AI complessi, come quelli richiesti dalle fabbriche intelligenti. Per le aziende, la scelta di architetture locali offre controllo sui dati e ottimizzazione del TCO, aspetti cruciali per l'adozione di sistemi robotici avanzati.

2026-06-08 📰 Fonte
Nvidia e SK Hynix: alleanza pluriennale per la memoria in AI, PC e robotica
📁 Hardware AI generated ✅ DigiTimes

Nvidia e SK Hynix: alleanza pluriennale per la memoria in AI, PC e robotica

Nvidia e SK Hynix hanno annunciato una partnership pluriennale strategica incentrata sulla fornitura di soluzioni di memoria avanzate. L'accordo coprirà settori chiave come i server AI, i personal computer e la robotica, evidenziando l'importanza crescente della memoria ad alte prestazioni per l'evoluzione dell'intelligenza artificiale e delle infrastrutture che la supportano, con implicazioni dirette per i deployment on-premise.

2026-06-08 📰 Fonte
Murata introduce MLCC più compatti per l'elettronica dei veicoli di nuova generazione
📁 Hardware AI generated ✅ DigiTimes

Murata introduce MLCC più compatti per l'elettronica dei veicoli di nuova generazione

Murata ha annunciato il lancio di nuovi condensatori ceramici multistrato (MLCC) caratterizzati da dimensioni ridotte. Questi componenti sono specificamente progettati per l'integrazione nei sistemi elettronici avanzati dei veicoli elettrici e a guida autonoma. La miniaturizzazione è un fattore critico per ottimizzare lo spazio e migliorare le prestazioni in applicazioni automotive complesse, dove l'affidabilità e l'efficienza energetica sono essenziali anche per i carichi di lavoro di AI all'edge.

2026-06-08 📰 Fonte
Anthropic Mythos: Più Vulnerabilità Rilevate, Costi di Scansione in Aumento
📁 Altro AI generated ✅ DigiTimes

Anthropic Mythos: Più Vulnerabilità Rilevate, Costi di Scansione in Aumento

Anthropic ha introdotto Mythos, un nuovo strumento che promette di identificare un numero significativamente maggiore di vulnerabilità nei sistemi. Tuttavia, questa maggiore efficacia comporta un notevole incremento dei costi associati alle operazioni di scansione, ponendo le aziende di fronte a un trade-off tra sicurezza avanzata e gestione della spesa. La notizia solleva interrogativi cruciali per i responsabili IT e i CTO.

2026-06-08 📰 Fonte
OpenAI: Codex, ChatGPT e Atlas convergono in una superapp desktop
📁 Altro AI generated ✅ DigiTimes

OpenAI: Codex, ChatGPT e Atlas convergono in una superapp desktop

OpenAI si prepara a lanciare una "superapp" desktop che integrerà i modelli Codex, ChatGPT e Atlas. L'iniziativa, attesa nelle prossime settimane, segna un passo verso l'unificazione delle capacità AI su piattaforme locali. Per le aziende, l'evoluzione dei modelli e delle loro modalità di deployment, inclusi scenari on-premise, rimane un fattore critico per la sovranità dei dati e il Total Cost of Ownership (TCO).

2026-06-08 📰 Fonte
Francia: oltre 110 miliardi in investimenti AI e data center, ma la realizzazione è in salita
📁 Altro AI generated ✅ DigiTimes

Francia: oltre 110 miliardi in investimenti AI e data center, ma la realizzazione è in salita

La Francia ha attratto impegni per oltre 110 miliardi di euro in investimenti per l'intelligenza artificiale e i data center. Tuttavia, la concretizzazione di questi progetti su larga scala si scontra con ostacoli significativi, in particolare per quanto riguarda la disponibilità di energia e la complessità dei processi autorizzativi. Questo scenario evidenzia le sfide infrastrutturali che attendono i deployment AI, con implicazioni dirette per il Total Cost of Ownership e la sovranità dei dati.

2026-06-08 📰 Fonte
KT Cloud: costruzione modulare e digital twin per data center AI più rapidi
📁 Altro AI generated ✅ DigiTimes

KT Cloud: costruzione modulare e digital twin per data center AI più rapidi

KT Cloud sta accelerando la realizzazione di data center dedicati all'intelligenza artificiale attraverso l'adozione di metodologie innovative. L'azienda sfrutta la costruzione modulare e i digital twin per ottimizzare i tempi di deployment e l'efficienza operativa. Questo approccio risponde alla crescente domanda di infrastrutture AI robuste e scalabili, offrendo vantaggi significativi per le organizzazioni che valutano strategie di deployment on-premise o ibride, con un occhio attento al TCO e alla sovranità dei dati.

2026-06-08 📰 Fonte
xAI punta sulla Cina: assunzioni di 'AI tutor' per l'espansione locale
📁 Market AI generated ✅ DigiTimes

xAI punta sulla Cina: assunzioni di 'AI tutor' per l'espansione locale

xAI, l'azienda di intelligenza artificiale fondata da Elon Musk, sta intensificando la sua presenza in Cina attraverso l'assunzione di specialisti locali, definiti 'AI tutor'. Questa mossa strategica sottolinea l'importanza del mercato cinese per lo sviluppo e il perfezionamento dei Large Language Models, evidenziando le sfide legate alla localizzazione dei dati e alla sovranità digitale in un contesto geopolitico complesso.

2026-06-08 📰 Fonte
T3EX potenzia il trasporto aereo in Asia per le filiere di chip ed elettronica
📁 Market AI generated ✅ DigiTimes

T3EX potenzia il trasporto aereo in Asia per le filiere di chip ed elettronica

T3EX ha annunciato un'espansione dei suoi servizi di trasporto aereo nel Nord-Est asiatico, con l'obiettivo di rafforzare le catene di approvvigionamento per l'elettronica e i semiconduttori. Questa mossa strategica sottolinea la crescente importanza della logistica per i componenti ad alta tecnicia, cruciali per lo sviluppo e il deployment di infrastrutture AI, inclusi i Large Language Models (LLM) on-premise.

2026-06-08 📰 Fonte
Onsemi promuove architettura di alimentazione a 800 VDC per l'infrastruttura AI
📁 Altro AI generated ✅ DigiTimes

Onsemi promuove architettura di alimentazione a 800 VDC per l'infrastruttura AI

Onsemi sta promuovendo una nuova architettura di alimentazione a 800 VDC, pensata per le future infrastrutture dedicate all'intelligenza artificiale. Questa soluzione mira a migliorare l'efficienza energetica e la densità di potenza, aspetti cruciali per i deployment on-premise di Large Language Models e altri carichi di lavoro AI, dove il controllo sui costi operativi e la gestione dell'hardware sono prioritari.

2026-06-08 📰 Fonte
L'India mira a diventare un hub per il packaging dei chip, attrattiva per Taiwan
📁 Market AI generated ✅ DigiTimes

L'India mira a diventare un hub per il packaging dei chip, attrattiva per Taiwan

L'India sta intensificando gli sforzi per affermarsi come centro strategico per il packaging dei chip, cercando attivamente investimenti dalle aziende elettroniche taiwanesi. Questa mossa riflette una tendenza globale verso la diversificazione della supply chain dei semiconduttori, con potenziali impatti sulla disponibilità e sul Total Cost of Ownership (TCO) dell'hardware per i deployment di Large Language Models (LLM) on-premise. La strategia indiana mira a rafforzare la propria sovranità tecnicica e a creare un ecosistema manifatturiero robusto.

2026-06-08 📰 Fonte
LG Innotek espande le operazioni in Vietnam per il packaging AI
📁 Market AI generated ✅ DigiTimes

LG Innotek espande le operazioni in Vietnam per il packaging AI

LG Innotek ha annunciato l'espansione delle sue operazioni in Vietnam, focalizzandosi sul packaging avanzato per componenti AI. Questa mossa risponde alla crescente domanda globale di soluzioni hardware dedicate all'intelligenza artificiale, evidenziando l'importanza della supply chain per i deployment on-premise e cloud, e l'impatto sulla disponibilità di silicio per l'Inference e il training di LLM.

2026-06-08 📰 Fonte
L'adattamento infrastrutturale: il ruolo dei cavi in fibra ottica nell'AI on-premise
📁 Altro AI generated ℹ️ Tom's Hardware

L'adattamento infrastrutturale: il ruolo dei cavi in fibra ottica nell'AI on-premise

In un contesto di crescente complessità per i deployment di Large Language Models (LLM), l'adattamento e la resilienza infrastrutturale diventano cruciali. Questo articolo esplora come i cavi in fibra ottica rappresentino un elemento fondamentale per garantire connettività ad alta larghezza di banda e bassa latenza, essenziali per le architetture AI on-premise, influenzando direttamente il TCO e la sovranità dei dati.

2026-06-07 📰 Fonte
Notion ripristina l'accesso ad Anthropic dopo un'interruzione del servizio
📁 Altro AI generated ✅ TechCrunch AI

Notion ripristina l'accesso ad Anthropic dopo un'interruzione del servizio

Notion ha ristabilito l'accesso ai servizi di Anthropic a seguito di un'interruzione che ha generato notevole attenzione. L'episodio evidenzia la dipendenza delle piattaforme da fornitori esterni di Large Language Models e solleva interrogativi sulla resilienza delle architetture basate su cloud per carichi di lavoro AI critici, spingendo le aziende a valutare alternative on-premise per maggiore controllo e sovranità dei dati.

2026-06-07 📰 Fonte
Affidabilità hardware: il guasto di un sistema X99 e le implicazioni per l'AI on-premise
📁 Hardware AI generated ℹ️ LocalLLaMA

Affidabilità hardware: il guasto di un sistema X99 e le implicazioni per l'AI on-premise

Un utente ha segnalato il guasto di un sistema basato su chipset X99. Questo evento, sebbene aneddotico, solleva questioni cruciali sull'affidabilità dell'hardware in contesti di deployment on-premise per carichi di lavoro AI. La gestione del ciclo di vita dei componenti e la resilienza infrastrutturale sono fattori determinanti per CTO e architetti che valutano soluzioni self-hosted, dove il TCO include anche i costi di manutenzione e i tempi di inattività.

2026-06-07 📰 Fonte
Controllo di Avatar 3D via Linguaggio Naturale: La Rivoluzione di `programasweights`
📁 Frameworks AI generated ℹ️ LocalLLaMA

Controllo di Avatar 3D via Linguaggio Naturale: La Rivoluzione di `programasweights`

Un nuovo approccio permette di controllare avatar 3D con il linguaggio naturale, superando i limiti dei comandi predefiniti. Basato sul framework `programasweights`, il sistema compila descrizioni testuali in programmi di azione che vengono eseguiti localmente nel browser, anche offline. Questa tecnicia Open Source apre nuove frontiere per l'interazione utente e promette di trasformare il comportamento dei personaggi nei videogiochi, offrendo maggiore dinamicità e reattività.

2026-06-07 📰 Fonte
GMKtec EVO-X3: OCuLink, Wi-Fi 7 e Doppio PCIe 4.0 per il Ryzen AI MAX+ 495 da 192GB
📁 Hardware AI generated ℹ️ LocalLLaMA

GMKtec EVO-X3: OCuLink, Wi-Fi 7 e Doppio PCIe 4.0 per il Ryzen AI MAX+ 495 da 192GB

GMKtec ha annunciato il mini PC EVO-X3, che integra connettività OCuLink, Wi-Fi 7 e doppio slot PCIe 4.0. L'azienda prevede di rilasciare una versione più potente entro l'anno, equipaggiata con un processore Ryzen AI MAX+ 495 e ben 192GB di RAM. Questo hardware, il primo basato su "Strix 495" ad emergere, promette capacità I/O avanzate, posizionandosi come una soluzione interessante per carichi di lavoro AI on-premise. I dettagli sui prezzi non sono ancora stati divulgati.

2026-06-07 📰 Fonte
OpenAI e la "Super App": il futuro delle interazioni AI oltre la chat
📁 Altro AI generated ✅ TechCrunch AI

OpenAI e la "Super App": il futuro delle interazioni AI oltre la chat

OpenAI sta sviluppando una "super app" che potrebbe ridefinire l'interazione con l'intelligenza artificiale. La dichiarazione di un dipendente senior, "Chat is dead", suggerisce un superamento delle interfacce conversazionali attuali. Questa evoluzione pone nuove sfide e opportunità per le aziende che valutano deployment on-premise, in termini di requisiti hardware, gestione dei dati e sovranità.

2026-06-07 📰 Fonte
Firefox integra il supporto per la decodifica video Vulkan
📁 Hardware AI generated ✅ Phoronix

Firefox integra il supporto per la decodifica video Vulkan

Mozilla Firefox ha introdotto il supporto iniziale per Vulkan Video, abilitando la decodifica video accelerata tramite GPU. Questa integrazione mira a migliorare le prestazioni e l'efficienza energetica nella riproduzione multimediale, sfruttando le capacità hardware moderne per un'esperienza utente più fluida e un minor carico sulla CPU.

2026-06-07 📰 Fonte
NXP a Computex 2026: L'AI per l'Edge e la Robotica nel Mondo Reale
📁 Altro AI generated ✅ ServeTheHome

NXP a Computex 2026: L'AI per l'Edge e la Robotica nel Mondo Reale

NXP, tramite il suo CEO Rafael Sotomayor, ha delineato a Computex 2026 la propria visione per l'implementazione dell'intelligenza artificiale su dispositivi edge e nella robotica. L'azienda si posiziona come attore chiave per portare l'AI in applicazioni concrete, affrontando le sfide del deployment in ambienti reali, dove sovranità dei dati, controllo locale e ottimizzazione del TCO sono prioritari per le infrastrutture AI.

2026-06-07 📰 Fonte
Oltre i Large Language Models: l'AI quotidiana che sfugge ai riflettori
📁 Altro AI generated ℹ️ LocalLLaMA

Oltre i Large Language Models: l'AI quotidiana che sfugge ai riflettori

Mentre i Large Language Models dominano il dibattito sull'intelligenza artificiale, una discussione online ha acceso i riflettori su strumenti AI meno noti ma utilizzati quotidianamente. L'analisi esplora l'ecosistema di soluzioni AI "nascoste" che supportano operazioni critiche, spesso con implicazioni significative per le strategie di deployment on-premise e la sovranità dei dati, offrendo spunti per CTO e architetti infrastrutturali che valutano alternative al cloud.

2026-06-07 📰 Fonte
Wayland Protocols 1.49: Supporto Multi-GPU Rafforzato per Carichi AI
📁 Altro AI generated ✅ Phoronix

Wayland Protocols 1.49: Supporto Multi-GPU Rafforzato per Carichi AI

La versione 1.49 dei Wayland Protocols, rilasciata da Simon Ser, introduce un supporto multi-GPU migliorato. Questo aggiornamento è significativo per le architetture che gestiscono carichi di lavoro intensivi, come l'inference e il training di Large Language Models (LLM) in ambienti on-premise. La capacità di orchestrare più unità di elaborazione grafica in modo più efficiente può influenzare direttamente le performance e il TCO delle infrastrutture AI, offrendo maggiore flessibilità e controllo sui deployment locali.

2026-06-07 📰 Fonte
La Cina punta a veicoli elettrici più leggeri: la sfida di peso e dimensioni
📁 Market AI generated ℹ️ The Next Web

La Cina punta a veicoli elettrici più leggeri: la sfida di peso e dimensioni

Le autorità cinesi stanno spingendo per una riduzione del peso e delle dimensioni dei veicoli elettrici. Con un peso medio di 1.704 kg nel 2024, circa un terzo in più rispetto al 2012, e larghezze che superano i 2 metri per molti SUV e MPV, i veicoli attuali faticano a inserirsi negli spazi di parcheggio esistenti, creando nuove sfide infrastrutturali.

2026-06-07 📰 Fonte
llama.cpp integra il supporto Multi-Tensor Parallelism per Gemma4
📁 Frameworks AI generated ℹ️ LocalLLaMA

llama.cpp integra il supporto Multi-Tensor Parallelism per Gemma4

Il progetto `llama.cpp` ha introdotto il supporto per il Multi-Tensor Parallelism (MTP) per i modelli Gemma4. Questo sviluppo è cruciale per le organizzazioni che mirano a eseguire LLM su infrastrutture on-premise, consentendo una gestione più efficiente di modelli complessi su configurazioni multi-GPU e migliorando le performance di Inference in ambienti self-hosted e air-gapped.

2026-06-07 📰 Fonte
ASML vola a 674 miliardi di dollari: è la società europea di maggior valore, spinta dall'EUV
📁 Market AI generated ℹ️ Tom's Hardware

ASML vola a 674 miliardi di dollari: è la società europea di maggior valore, spinta dall'EUV

ASML ha raggiunto una capitalizzazione di mercato di 674 miliardi di dollari, diventando la società di maggior valore in Europa. Questo traguardo è alimentato dalle aspettative degli analisti su un aumento della produzione di sistemi EUV, tecnicia cruciale per i chip avanzati. Il successo di ASML sottolinea l'importanza strategica della litografia per l'industria dei semiconduttori, fondamentale per l'innovazione in settori come l'AI e i deployment on-premise.

2026-06-07 📰 Fonte
Qwen 3.6 27B: Analisi della Quantization KV Cache per LLM On-Premise
📁 LLM AI generated ℹ️ LocalLLaMA

Qwen 3.6 27B: Analisi della Quantization KV Cache per LLM On-Premise

Nuovi benchmark esplorano la quantization del KV cache per il modello Qwen 3.6 27B, testando diverse configurazioni (q8, q6, q5, q4) e tecniche avanzate come KVarN, TurboQuant e TCQ. I risultati, ottenuti tramite BeeLlama.cpp, offrono spunti cruciali per ottimizzare l'inference di Large Language Models in ambienti self-hosted, riducendo i requisiti di VRAM e migliorando il throughput per deployment on-premise efficienti e sovrani.

2026-06-07 📰 Fonte
Russia: un satellite della flotta "Rassvet" fuori orbita, 15 restano operativi
📁 Altro AI generated ℹ️ Tom's Hardware

Russia: un satellite della flotta "Rassvet" fuori orbita, 15 restano operativi

La Russia ha perso il primo satellite della sua nuova costellazione "Rassvet", definita "Starlink-Style", dopo poche settimane dal lancio. L'oggetto 4 è uscito dall'orbita, ma la maggior parte della flotta, composta da altri 15 satelliti, continua a operare. L'incidente evidenzia le sfide intrinseche nella gestione di infrastrutture spaziali complesse, cruciali per la connettività e la sovranità dei dati.

2026-06-07 📰 Fonte
Half-Life su Nokia N95: il mobile del 2007 eguaglia le performance dei PC del 1998
📁 Hardware AI generated ℹ️ Tom's Hardware

Half-Life su Nokia N95: il mobile del 2007 eguaglia le performance dei PC del 1998

Un recente esperimento ha dimostrato come un Nokia N95, smartphone del 2007, sia riuscito a far girare Half-Life a 30 FPS, eguagliando le performance dei PC del 1998. Questa impresa evidenzia la rapida evoluzione del silicio e le sue implicazioni per il deployment di Large Language Models (LLM) su dispositivi edge e infrastrutture on-premise, sottolineando l'importanza dell'efficienza hardware e della sovranità dei dati.

2026-06-07 📰 Fonte
Sistema AI di rilevamento armi sotto accusa dopo fallimento in sparatoria scolastica
📁 Altro AI generated ✅ Ars Technica AI

Sistema AI di rilevamento armi sotto accusa dopo fallimento in sparatoria scolastica

Un sopravvissuto a una sparatoria in una scuola del Tennessee ha citato in giudizio Omnilert, produttore di un sistema AI per il rilevamento di armi, dopo che il dispositivo non ha identificato la pistola usata nell'attacco. La causa evidenzia presunte limitazioni operative significative del sistema, legate a fattori ambientali come posizionamento delle telecamere, angolazione e illuminazione. Il caso solleva interrogativi cruciali sull'affidabilità dei sistemi AI per la sicurezza in contesti reali.

2026-06-07 📰 Fonte
Mesa 26.2 integra VK_GOOGLE_display_timing per un rendering più fluido
📁 Hardware AI generated ✅ Phoronix

Mesa 26.2 integra VK_GOOGLE_display_timing per un rendering più fluido

Mesa 26.2 introduce l'estensione VK_GOOGLE_display_timing, migliorando la gestione dei tempi di visualizzazione per i driver Vulkan. Questa novità, che include il supporto per la modalità di display diretto tramite KHR_display, mira a ottimizzare il frame-pacing e ridurre il micro-stuttering nei giochi. I driver Intel ANV, Radeon RADV, PowerVR, Turnip e V3DV beneficiano immediatamente di questa integrazione, offrendo un'esperienza visiva più fluida e reattiva su diverse piattaforme hardware.

2026-06-07 📰 Fonte
Overclock estremo su Core i7-6700K: sbloccare una RTX 3080 e il nodo CPU-GPU per l'AI
📁 Hardware AI generated ℹ️ Tom's Hardware

Overclock estremo su Core i7-6700K: sbloccare una RTX 3080 e il nodo CPU-GPU per l'AI

Un esperimento ha spinto un Intel Core i7-6700K a 5.2 GHz con 1.7 volt per mitigare un bottleneck sulla GPU NVIDIA RTX 3080. L'overclock ha permesso di aumentare l'utilizzo della GPU dal 60% al 74%. Questo caso studio evidenzia come l'equilibrio tra CPU e GPU sia cruciale per massimizzare le performance, un aspetto fondamentale per l'efficienza dei carichi di lavoro di Large Language Models (LLM) in ambienti self-hosted.

2026-06-07 📰 Fonte
USA: Direttiva presidenziale sull'AI militare e la sovranità sui sistemi
📁 Altro AI generated ℹ️ The Next Web

USA: Direttiva presidenziale sull'AI militare e la sovranità sui sistemi

Un memorandum presidenziale firmato dall'ex Presidente Trump impone alle agenzie militari e di intelligence statunitensi di accelerare l'adozione di AI avanzata. La direttiva NSPM-11 stabilisce un Framework per l'integrazione rapida di modelli da più vendor, ma soprattutto vieta alle aziende di disabilitare, degradare o modificare i sistemi AI una volta deployati. Questo sottolinea l'importanza del controllo operativo e della sovranità tecnicica in contesti di sicurezza nazionale.

2026-06-07 📰 Fonte
Broadcom V3D: Fine del Supporto per le Versioni 3.3 e 4.1
📁 Hardware AI generated ✅ Phoronix

Broadcom V3D: Fine del Supporto per le Versioni 3.3 e 4.1

Broadcom ha annunciato la deprecazione e la successiva rimozione del supporto per le IP grafiche V3D 3.3 e V3D 4.1 dal driver kernel V3D. La decisione, che segue la cessazione del supporto da parte del driver Mesa due anni fa, è motivata dalla mancanza di hardware di test per gli sviluppatori e dalla scarsa adozione di queste specifiche soluzioni grafiche in determinati SoC. Questo scenario evidenzia le sfide legate al ciclo di vita del supporto hardware per i deployment on-premise.

2026-06-07 📰 Fonte
Clustering di Jetson Nano Orin Super: L'AI Distribuita Oltre il Datacenter
📁 Altro AI generated ℹ️ LocalLLaMA

Clustering di Jetson Nano Orin Super: L'AI Distribuita Oltre il Datacenter

Un nuovo progetto esplora la creazione di cluster di calcolo distribuiti utilizzando hardware accessibile come i Jetson Nano Orin Super. L'iniziativa mira a democratizzare l'addestramento e l'inference di modelli AI, dimostrando come sistemi distribuiti possano operare al di fuori dei grandi datacenter, offrendo controllo e sovranità sui dati per carichi di lavoro on-premise.

2026-06-07 📰 Fonte
Intel lancia chip Core 200H senza iGPU per desktop SFF
📁 Hardware AI generated ℹ️ Tom's Hardware

Intel lancia chip Core 200H senza iGPU per desktop SFF

Intel ha ampliato la sua offerta di processori Core 200H con due nuovi modelli, Core 7 230H e Core 5 205H, basati sull'architettura Raptor Lake. Questi chip si distinguono per l'assenza di una GPU integrata, una scelta mirata a sistemi desktop compatti (Small Form Factor). La decisione risponde all'esigenza di configurazioni che prevedono l'uso di schede grafiche discrete, ottimizzando costi e consumi per specifici scenari di deployment.

2026-06-07 📰 Fonte
OpenAI rafforza ChatGPT con "Lockdown Mode" contro gli attacchi di prompt injection
📁 Altro AI generated ℹ️ The Next Web

OpenAI rafforza ChatGPT con "Lockdown Mode" contro gli attacchi di prompt injection

OpenAI ha iniziato il rilascio di "Lockdown Mode" per ChatGPT, una nuova impostazione di sicurezza progettata per contrastare il furto di dati tramite attacchi di prompt injection. Questa funzionalità disabilita diverse capacità, tra cui la navigazione web in tempo reale, la modalità agente, la ricerca approfondita, il recupero di immagini, il networking Canvas e i download di file. È disponibile per tutti gli utenti registrati, indipendentemente dal piano di abbonamento.

2026-06-07 📰 Fonte
Sriram Krishnan lascia il ruolo di consigliere AI alla Casa Bianca
📁 Market AI generated ℹ️ The Next Web

Sriram Krishnan lascia il ruolo di consigliere AI alla Casa Bianca

Sriram Krishnan, consigliere senior per l'intelligenza artificiale della Casa Bianca, si dimetterà a fine giugno. L'ex partner di Andreessen Horowitz era stato nominato dal Presidente Donald Trump per definire la strategia AI dell'amministrazione durante il suo secondo mandato. La sua partenza solleva interrogativi sulla continuità delle politiche AI a livello governativo, un ambito cruciale per le decisioni di deployment tecnicico in settori chiave.

2026-06-07 📰 Fonte
Raffreddamento AI: Niching registra un'impennata nelle consegne di heat spreader
📁 Hardware AI generated ✅ DigiTimes

Raffreddamento AI: Niching registra un'impennata nelle consegne di heat spreader

L'incremento della domanda di soluzioni di raffreddamento per l'intelligenza artificiale sta spingendo le consegne di heat spreader da parte di aziende come Niching. Questo fenomeno evidenzia la crescente importanza della gestione termica nell'infrastruttura AI, specialmente per i deployment on-premise di Large Language Models, dove l'efficienza e la dissipazione del calore sono cruciali per performance e TCO.

2026-06-07 📰 Fonte
Taiwan: primo hub estero per la certificazione della supply chain dei droni USA
📁 Market AI generated ✅ DigiTimes

Taiwan: primo hub estero per la certificazione della supply chain dei droni USA

Taiwan è stata designata come il primo hub estero per la certificazione della supply chain dei droni statunitensi. Questa mossa strategica sottolinea l'importanza crescente della sicurezza e dell'integrità delle catene di fornitura per le tecnicie critiche, in un contesto geopolitico in evoluzione. La certificazione mira a garantire l'affidabilità e la resilienza dei componenti, un aspetto cruciale anche per i deployment on-premise di soluzioni AI avanzate.

2026-06-07 📰 Fonte
AI agentica: Aspeed prevede un'impennata della domanda e tensioni sulla supply chain entro il 2027
📁 Market AI generated ✅ DigiTimes

AI agentica: Aspeed prevede un'impennata della domanda e tensioni sulla supply chain entro il 2027

Aspeed, fornitore di componenti essenziali per l'infrastruttura server, anticipa un'escalation della domanda legata all'AI agentica entro il 2027. Questa crescita è destinata a mettere sotto pressione le capacità della supply chain globale, con potenziali ripercussioni sui tempi di consegna e sui costi per le infrastrutture AI. Le aziende che valutano deployment on-premise dovranno pianificare con attenzione per mitigare i rischi.

2026-06-07 📰 Fonte
JCET inaugura un impianto per il packaging 3D, mirando a moduli AI e CPO
📁 Hardware AI generated ✅ DigiTimes

JCET inaugura un impianto per il packaging 3D, mirando a moduli AI e CPO

JCET ha annunciato l'apertura di un nuovo stabilimento in Corea del Sud, specializzato nel packaging 3D avanzato. L'impianto è progettato per soddisfare la crescente domanda di moduli di potenza per l'intelligenza artificiale e di soluzioni Co-Packaged Optics (CPO), componenti cruciali per l'infrastruttura AI di prossima generazione. Questa mossa sottolinea l'importanza delle tecnicie di packaging per migliorare le prestazioni e l'efficienza dei sistemi AI.

2026-06-07 📰 Fonte
ASRock Rack si aggiudica un ordine per server GPU in un data center AI in Thailandia
📁 Market AI generated ✅ DigiTimes

ASRock Rack si aggiudica un ordine per server GPU in un data center AI in Thailandia

ASRock Rack, divisione di Pegatron, ha ottenuto un significativo ordine per la fornitura di 587 server GPU destinati a un nuovo data center AI in Thailandia. Questa commessa, riportata da DIGITIMES, sottolinea la crescente domanda globale di infrastrutture dedicate all'intelligenza artificiale e l'importanza strategica dei deployment on-premise per la sovranità dei dati e il controllo delle risorse computazionali.

2026-06-07 📰 Fonte
dvlt.cu: Un Motore di Inference CUDA/C++ Minimale per Modelli 3D NVIDIA
📁 Frameworks AI generated ℹ️ LocalLLaMA

dvlt.cu: Un Motore di Inference CUDA/C++ Minimale per Modelli 3D NVIDIA

dvlt.cu è un motore di inference sviluppato ex novo in CUDA/C++ per i modelli transformer 3D DVLT di NVIDIA. Si distingue per la sua architettura estremamente leggera: un singolo binario da 5MB con dipendenze minime, privo di runtime complessi come Python, PyTorch o Hugging Face. Questo approccio lo rende ideale per deployment on-premise che richiedono controllo granulare, efficienza e bassa latenza, offrendo un esempio concreto di ottimizzazione hardware-software per carichi di lavoro AI specifici.

2026-06-07 📰 Fonte
Audi Nuvolari: Potenza Ibrida e le Lezioni per l'AI On-Premise
📁 Altro AI generated ℹ️ The Next Web

Audi Nuvolari: Potenza Ibrida e le Lezioni per l'AI On-Premise

Audi presenta la Nuvolari, un'hypercar ibrida da 1.001 PS che ridefinisce i limiti prestazionali. Questo veicolo, con il suo V8 biturbo e motori elettrici, incarna una complessità ingegneristica che richiama le sfide affrontate nel deployment di Large Language Models (LLM) on-premise. L'articolo esplora come la ricerca di prestazioni estreme e l'ottimizzazione delle risorse in contesti fisici possano offrire spunti preziosi per architetti e CTO che gestiscono infrastrutture AI.

2026-06-06 📰 Fonte
Grave vulnerabilità in uno strumento AI: rischio di takeover amministrativo con un click
📁 Altro AI generated ℹ️ LocalLLaMA

Grave vulnerabilità in uno strumento AI: rischio di takeover amministrativo con un click

Una grave vulnerabilità di sicurezza è stata scoperta in uno strumento AI associato al noto creator PewDiePie. Il difetto permette un "account takeover" amministrativo con un solo click, esponendo potenzialmente i dati e il controllo del sistema. Questo episodio sottolinea l'importanza di robuste pratiche di sicurezza per qualsiasi deployment di strumenti AI, sia on-premise che in cloud, evidenziando i rischi legati alla gestione degli accessi e alla protezione dei dati sensibili.

2026-06-06 📰 Fonte
OpenAI introduce la "Lockdown Mode" per rafforzare la sicurezza dei dati in ChatGPT
📁 Altro AI generated ✅ TechCrunch AI

OpenAI introduce la "Lockdown Mode" per rafforzare la sicurezza dei dati in ChatGPT

OpenAI ha annunciato la "Lockdown Mode" per ChatGPT, una nuova funzionalità volta a mitigare i rischi degli attacchi di prompt injection. L'obiettivo è ridurre la probabilità che dati sensibili vengano esposti, sebbene la protezione completa da tali vulnerabilità rimanga una sfida complessa per i Large Language Models. Questa mossa evidenzia la crescente attenzione alla sicurezza dei dati nel panorama degli LLM.

2026-06-06 📰 Fonte
GLM e la ricerca di modelli efficienti: la sfida del deployment locale
📁 Altro AI generated ℹ️ LocalLLaMA

GLM e la ricerca di modelli efficienti: la sfida del deployment locale

La community tech esprime preoccupazione per l'evoluzione dei modelli GLM. Dopo l'assenza di aggiornamenti per la serie "Air" e le prestazioni altalenanti del 4.7 Turbo, il recente GLM 5.1, pur eccellendo nella programmazione, si rivela troppo grande per il deployment locale e lento anche via API. Si evidenzia la necessità di modelli più efficienti, capaci di competere con alternative come Qwen 3.6 35B, ottimizzati per l'esecuzione on-premise e con un minor consumo di Token.

2026-06-06 📰 Fonte
Gemma 4 12B QAT: 120 tok/s su GPU da 12GB VRAM con llama.cpp
📁 LLM AI generated ℹ️ LocalLLaMA

Gemma 4 12B QAT: 120 tok/s su GPU da 12GB VRAM con llama.cpp

Un recente benchmark dimostra come il modello Gemma 4 12B QAT di Google, ottimizzato con Quantization-Aware Training, possa raggiungere prestazioni notevoli su hardware consumer. Utilizzando una GPU NVIDIA RTX 4070 Super da 12GB VRAM e una versione patchata di llama.cpp, è stato possibile ottenere una velocità di circa 120 token al secondo. Questo risultato evidenzia il potenziale dei Large Language Models quantizzati per deployment on-premise, anche con risorse hardware limitate, mantenendo un'elevata efficienza nell'inference.

2026-06-06 📰 Fonte
KVarN: Nuovi benchmark per la KV Cache riducono il fabbisogno di VRAM negli LLM
📁 LLM AI generated ℹ️ LocalLLaMA

KVarN: Nuovi benchmark per la KV Cache riducono il fabbisogno di VRAM negli LLM

Una nuova serie di benchmark sulla quantization della KV cache, condotta con la tecnica KVarN, rivela un significativo potenziale di risparmio di VRAM per i Large Language Models. I risultati indicano che KVarN a 6-bit può eguagliare la precisione di q8_0, mentre la versione a 4-bit raggiunge quella di q5_0, offrendo un vantaggio cruciale per i deployment on-premise con risorse hardware limitate, nonostante un attuale rallentamento nella fase di prompt processing.

2026-06-06 📰 Fonte
Sriram Krishnan lascia la Casa Bianca per un nuovo ruolo nella politica AI
📁 Market AI generated ✅ TechCrunch AI

Sriram Krishnan lascia la Casa Bianca per un nuovo ruolo nella politica AI

Sriram Krishnan, già consigliere AI della Casa Bianca, si appresta a lasciare il suo incarico. Secondo le prime indiscrezioni, fonderà una nuova istituzione con l'obiettivo di continuare a influenzare le future politiche sull'intelligenza artificiale dell'amministrazione Trump. Questo sviluppo sottolinea la crescente importanza delle figure chiave nella definizione delle strategie nazionali per l'AI e le loro potenziali ricadute sulle decisioni di deployment.

2026-06-06 📰 Fonte
StepFun 3.7 Flash MTP: L'accelerazione LLM on-premise su AMD Strix Halo
📁 Altro AI generated ℹ️ LocalLLaMA

StepFun 3.7 Flash MTP: L'accelerazione LLM on-premise su AMD Strix Halo

Un recente benchmark evidenzia come la tecnicia MTP (Multi-Token Prediction) migliori significativamente la velocità di decode e l'efficienza energetica per i Large Language Models (LLM) su hardware locale. Testato su un'APU AMD Strix Halo con 128 GB di memoria unificata, il modello StepFun 3.7 Flash, un MoE da circa 200 miliardi di parametri, ha mostrato un incremento del 27,5% nella generazione di token e una riduzione del 14% nel consumo energetico, senza penalizzare il prefill.

2026-06-06 📰 Fonte
Cohere presenta in anteprima un nuovo LLM per la programmazione, ottimizzato per deployment locali
📁 LLM AI generated ℹ️ LocalLLaMA

Cohere presenta in anteprima un nuovo LLM per la programmazione, ottimizzato per deployment locali

Cohere ha offerto alla community di `localllama` un accesso anticipato al suo primo Large Language Model (LLM) dedicato alla programmazione. Il modello, da 30 miliardi di parametri con 3 miliardi attivi, è progettato per funzionare efficacemente su configurazioni locali, sottolineando l'attenzione verso l'inference on-premise. Questa iniziativa mira a raccogliere feedback diretti per affinare il modello prima del rilascio ufficiale, evidenziando l'importanza della collaborazione con gli sviluppatori per ottimizzare le performance e l'usabilità in ambienti controllati.

2026-06-06 📰 Fonte
Schede di espansione AMD B650: più storage e connettività per PC on-premise
📁 Hardware AI generated ℹ️ Tom's Hardware

Schede di espansione AMD B650: più storage e connettività per PC on-premise

Le nuove schede di espansione AMD B650 arrivano sul mercato a partire da 199 dollari, offrendo quattro slot M.2 PCIe 4.0 e undici porte USB. Questa soluzione permette di potenziare i PC esistenti con capacità di storage ad alta velocità e maggiore connettività, rivelandosi strategica per chi gestisce carichi di lavoro AI/LLM on-premise e cerca flessibilità e controllo sull'infrastruttura locale.

2026-06-06 📰 Fonte
L'amministrazione Trump valuta una partecipazione in OpenAI per il beneficio pubblico dell'AI
📁 Market AI generated ✅ TechCrunch AI

L'amministrazione Trump valuta una partecipazione in OpenAI per il beneficio pubblico dell'AI

L'amministrazione Trump sta esplorando la possibilità di acquisire una partecipazione azionaria in OpenAI. Il Presidente Donald Trump ha dichiarato che l'obiettivo di questi accordi è garantire che il popolo americano possa trarre vantaggio dal successo e dallo sviluppo dell'intelligenza artificiale. Questa mossa sottolinea la crescente importanza strategica dell'AI a livello nazionale e le discussioni in corso su come i governi possano influenzare e beneficiare del suo progresso.

2026-06-06 📰 Fonte
Upgrade PC da $300: un'analisi per le esigenze LLM on-premise
📁 Hardware AI generated ℹ️ Tom's Hardware

Upgrade PC da $300: un'analisi per le esigenze LLM on-premise

Un bundle hardware consumer offre SSD PCIe 4.0 da 2TB, alimentatore da 750W e AIO da 240mm a $300. Sebbene conveniente per l'upgrade di un PC domestico, queste specifiche sono lontane dai requisiti per carichi di lavoro LLM in ambienti on-premise. L'articolo esplora le differenze fondamentali nelle infrastrutture necessarie per l'intelligenza artificiale.

2026-06-06 📰 Fonte
← Precedente Page 61 / 123 Successiva →
Vedi Archivio Completo 🗄️

AI-Radar is an independent observatory covering AI models, local LLMs, on-premise deployments, hardware, and emerging trends. We provide daily analysis and editorial coverage for developers, engineers, and organizations exploring local AI solutions.

AI-RADAR badge LaunchTry LAUNCHING SOON ON LaunchTry Fazier badge