AI-Radar - Osservatorio su LLM locali, hardware AI e trend

AI-Radar per LLM on-prem & AI in casa

Il radar quotidiano su modelli, framework e hardware per far girare l'AI in locale. LLM, LangChain, Chroma, mini-PC e tutto ciò che serve per un cervello distribuito "in-house".

⚙️ Stack: LLM locali · LangChain · Transformers · ChromaDB · MiniPC · AI boxes
🛰️ Ask Observatory (Q&A + RAG) già collegato all'archivio articoli.
👥 160+ membri · Iscriviti gratis →

⚡ In Tendenza

View All →

🛠️ Guide & Osservatorio On-Premise

🚀 Esegui i modelli in locale → Tutte le guide →

Riferimenti evergreen e pratici per far girare l'AI in locale — hardware, costi, privacy e stack completo.

🖥️ Osservatorio LLM On-Premise Hardware, stack, governance e architetture di riferimento per l'AI in locale.

Ultime analisi & news dal radar

Articoli generati dall'AI sulla base dei feed, con spazio per layer editoriale umano sopra il contenuto grezzo.

Meta estende globalmente le impostazioni di contenuto "13+" per adolescenti
📁 Market AI generated ℹ️ The Next Web

Meta estende globalmente le impostazioni di contenuto "13+" per adolescenti

Meta ha annunciato l'estensione globale delle sue impostazioni di contenuto "13+" per gli account adolescenti su Instagram, Facebook e Messenger. Questa misura, paragonata a una classificazione cinematografica, si applica ora di default in tutto il mondo, ampliando un sistema introdotto lo scorso ottobre in alcuni paesi anglofoni. La mossa riflette l'impegno dell'azienda nella sicurezza online dei minori.

2026-06-02 📰 Fonte
L'AI agentica trasforma la sanità: più efficienza e controllo on-premise
📁 Altro AI generated ✅ MIT Technology Review

L'AI agentica trasforma la sanità: più efficienza e controllo on-premise

Il settore sanitario globale è sotto pressione per carenze di personale e inefficienze. L'AI agentica si propone come soluzione chiave, automatizzando processi complessi e migliorando l'assistenza. Esempi concreti, come l'implementazione presso HSS, dimostrano significative riduzioni nei tempi di gestione delle pratiche e l'introduzione di servizi di triage avanzati. L'enfasi sulla sicurezza dei dati e il controllo interno la rende un'opzione rilevante per deployment on-premise, promettendo di liberare i clinici per compiti ad alto valore.

2026-06-02 📰 Fonte
SK hynix: raddoppio capacità memorie AI, carenza prevista fino al 2030
📁 Hardware AI generated ℹ️ Tom's Hardware

SK hynix: raddoppio capacità memorie AI, carenza prevista fino al 2030

SK hynix, uno dei principali produttori di memorie, ha annunciato l'intenzione di raddoppiare la propria capacità produttiva di wafer di memoria entro i prossimi cinque anni. L'azienda prevede che la carenza di memorie, spinta dalla crescente domanda di intelligenza artificiale, persisterà almeno fino al 2030. Questa espansione mira a mitigare le pressioni sul mercato, cruciali per i deployment on-premise di LLM.

2026-06-02 📰 Fonte
Gigabyte: nuove linee Infinity per il 40° anniversario, tra schede madri e GPU
📁 Hardware AI generated ℹ️ Tom's Hardware

Gigabyte: nuove linee Infinity per il 40° anniversario, tra schede madri e GPU

In occasione del suo 40° anniversario, Gigabyte ha presentato la nuova gamma di prodotti a marchio Infinity. L'offerta include la scheda madre X870 Infinity Next con elementi stampati in 3D, le schede Aero Wood e MicroATX Stealth, e nuove GPU che estendono lo stile Infinity a diverse fasce di mercato. Sebbene non specificamente orientati all'AI, questi componenti rappresentano l'infrastruttura di base per chi valuta soluzioni on-premise per carichi di lavoro computazionali intensivi, inclusi i Large Language Models.

2026-06-02 📰 Fonte
Microsoft Build: AI al centro, ma l'adozione di Copilot solleva interrogativi
📁 Market AI generated ℹ️ The Next Web

Microsoft Build: AI al centro, ma l'adozione di Copilot solleva interrogativi

Microsoft ha inaugurato la sua conferenza annuale Build a San Francisco, ponendo l'intelligenza artificiale e i nuovi strumenti di sviluppo al centro dell'attenzione. L'evento, con il CEO Satya Nadella come relatore principale, si svolge tuttavia in un contesto in cui l'adozione a pagamento di soluzioni come Copilot non ha ancora raggiunto le aspettative, spingendo le aziende a valutare attentamente i costi e i benefici dei deployment AI.

2026-06-02 📰 Fonte
Computex 2026: Nvidia e le Implicazioni per l'AI On-Premise
📁 Hardware AI generated ℹ️ Tom's Hardware

Computex 2026: Nvidia e le Implicazioni per l'AI On-Premise

Il Computex di Taipei si conferma un appuntamento cruciale per il settore tecnicico, con la presenza di attori chiave come Nvidia. L'evento offre uno spaccato sulle tendenze future dell'intelligenza artificiale, in particolare per quanto riguarda l'hardware e le strategie di deployment on-premise. Per le aziende che valutano soluzioni self-hosted, le innovazioni presentate a fiere come questa sono fondamentali per comprendere i trade-off tra controllo, sovranità dei dati e Total Cost of Ownership (TCO).

2026-06-02 📰 Fonte
Nvidia RTX Spark: Huang punta a reinventare lo strumento umano più importante con l'AI PC
📁 Hardware AI generated ℹ️ Tom's Hardware

Nvidia RTX Spark: Huang punta a reinventare lo strumento umano più importante con l'AI PC

Jensen Huang, CEO di Nvidia, ha annunciato RTX Spark, una piattaforma AI per PC che mira a ridefinire l'interazione umana con la tecnicia. L'iniziativa, che gode del supporto di numerosi produttori di computer, sottolinea la visione di Nvidia per un futuro in cui l'intelligenza artificiale agentica sarà integrata direttamente nei dispositivi personali, spostando l'elaborazione AI verso l'edge e offrendo nuove opportunità per il controllo dei dati.

2026-06-02 📰 Fonte
Veicoli Sottomarini Autonomi per la Sicurezza dei Cavi Strategici
📁 Altro AI generated ℹ️ Tom's Hardware

Veicoli Sottomarini Autonomi per la Sicurezza dei Cavi Strategici

Un nuovo patto di difesa che include gli Stati Uniti mira a proteggere i cavi sottomarini strategici da potenziali sabotaggi. La tecnicia in sviluppo prevede l'impiego di veicoli sottomarini autonomi, come quelli di Teledyne, per salvaguardare infrastrutture cruciali che gestiscono transazioni quotidiane per un valore di 1.8 trilioni di dollari.

2026-06-02 📰 Fonte
WeRide e Uber: i robotaxi arrivano a Madrid, tra sfide e opportunità on-premise
📁 Altro AI generated ℹ️ The Next Web

WeRide e Uber: i robotaxi arrivano a Madrid, tra sfide e opportunità on-premise

WeRide e Uber hanno annunciato il lancio del primo programma pilota commerciale di robotaxi in Spagna, nella regione di Madrid. Le corse saranno prenotabili tramite l'app Uber, con operazioni previste entro la fine dell'anno. L'iniziativa segna un'ulteriore espansione della mappa europea dei servizi di mobilità autonoma, sollevando questioni infrastrutturali e di gestione dei dati che sono cruciali per i deployment on-premise.

2026-06-02 📰 Fonte
Costi e Controllo: Un Setup Dual RTX 3090 per l'Inference LLM On-Premise
📁 Altro AI generated ℹ️ LocalLLaMA

Costi e Controllo: Un Setup Dual RTX 3090 per l'Inference LLM On-Premise

Un appassionato di ingegneria del software ha assemblato un sistema con due NVIDIA RTX 3090 per l'inference di Large Language Models (LLM) in locale. L'obiettivo è esplorare carichi di lavoro agentici e pipeline RAG, spinto dalla crescente preoccupazione per i costi dei servizi cloud e dal desiderio di maggiore controllo sui propri dati e modelli.

2026-06-02 📰 Fonte
Investimenti record in Europa: oltre 3,1 miliardi per l'infrastruttura digitale e l'AI
📁 Altro AI generated ℹ️ Tech.eu

Investimenti record in Europa: oltre 3,1 miliardi per l'infrastruttura digitale e l'AI

L'ultima settimana di maggio ha visto un afflusso di oltre 3,1 miliardi di euro nel settore tecnicico europeo, con un'enfasi particolare sull'infrastruttura digitale. Il Regno Unito ha guidato gli investimenti, spinto da un mega-round per un'azienda di data center. Il panorama include anche significativi finanziamenti per l'energia, il fintech e i semiconduttori, evidenziando la crescente domanda di soluzioni AI e di infrastrutture robuste.

2026-06-02 📰 Fonte
Oplane raccoglie 4,5 milioni di euro per rafforzare la sicurezza nello sviluppo AI
📁 Altro AI generated ℹ️ Tech.eu

Oplane raccoglie 4,5 milioni di euro per rafforzare la sicurezza nello sviluppo AI

La startup svedese Oplane ha ottenuto un finanziamento seed di 4,5 milioni di euro per affrontare le sfide di sicurezza nello sviluppo software assistito dall'intelligenza artificiale. Con l'adozione crescente di strumenti di coding AI, la velocità di sviluppo supera spesso le capacità di revisione della sicurezza tradizionale. La piattaforma agentica di Oplane integra la sicurezza direttamente nel processo di sviluppo, identificando requisiti e fornendo raccomandazioni contestuali per mitigare i rischi prima che si trasformino in vulnerabilità, mirando all'espansione europea e all'integrazione con strumenti AI.

2026-06-02 📰 Fonte
Regolamentazione AI: incertezza politica e impatto sulle strategie di deployment
📁 Market AI generated ✅ Wired AI

Regolamentazione AI: incertezza politica e impatto sulle strategie di deployment

L'amministrazione Trump ha bloccato un ordine esecutivo sulla regolamentazione dell'AI, generando incertezza tra funzionari e dirigenti del settore. Questa situazione solleva interrogativi sulle future direttive e sulle implicazioni per le aziende che valutano deployment di Large Language Models (LLM) on-premise, evidenziando la necessità di strategie robuste in un panorama normativo ancora indefinito.

2026-06-02 📰 Fonte
Shotcut 26.6 Beta: Nuove Funzionalità e Supporto Plugin Esteso
📁 Frameworks AI generated ✅ Phoronix

Shotcut 26.6 Beta: Nuove Funzionalità e Supporto Plugin Esteso

La versione beta 26.6 di Shotcut, l'editor video open source e multipiattaforma, è ora disponibile. Questo aggiornamento introduce numerose correzioni e, soprattutto, estende il supporto ai plugin OpenFX e VST2, migliorando le capacità di editing e l'integrazione con strumenti professionali per l'audio e il video.

2026-06-02 📰 Fonte
Jensen Huang tra bonus per ingegneri e buyback miliardari di Nvidia
📁 Market AI generated ℹ️ The Next Web

Jensen Huang tra bonus per ingegneri e buyback miliardari di Nvidia

Jensen Huang, CEO di Nvidia, ha difeso la retribuzione elevata per gli ingegneri dei chip, citando bonus significativi come quelli di Samsung. Queste dichiarazioni, rilasciate a Computex, arrivano pochi giorni dopo che Nvidia ha annunciato un riacquisto di azioni da 80 miliardi di dollari e l'impegno a destinare il 50% del free cash flow agli azionisti, sollevando interrogativi sull'equilibrio tra investimento nel capitale umano e rendimento per gli investitori.

2026-06-02 📰 Fonte
Zazume raccoglie 2,5 milioni di euro per la crescita nel proptech immobiliare
📁 Market AI generated ℹ️ Tech.eu

Zazume raccoglie 2,5 milioni di euro per la crescita nel proptech immobiliare

Zazume, azienda spagnola di proptech, ha ottenuto un finanziamento di 2,5 milioni di euro. L'investimento, guidato da Nordstar e GTV Capital, con il supporto di Sabadell Venture Capital, mira a sostenere l'espansione dell'azienda e l'acquisizione di portafogli di gestione immobiliare residenziale in Spagna. La piattaforma di Zazume digitalizza il ciclo di vita degli affitti combinando tecnicia proprietaria, intelligenza artificiale e servizi finanziari per migliorare l'efficienza operativa.

2026-06-02 📰 Fonte
SEALSQ acquisisce WeCan per un co-pilot AI di compliance post-quantum per banche private
📁 Market AI generated ℹ️ The Next Web

SEALSQ acquisisce WeCan per un co-pilot AI di compliance post-quantum per banche private

SEALSQ, azienda svizzera specializzata in crittografia post-quantistica, ha acquisito una quota di maggioranza in WeCan Group. L'operazione, che include un investimento aggiuntivo di 5 milioni di franchi svizzeri, mira ad accelerare lo sviluppo di strumenti di compliance basati sull'intelligenza artificiale per istituti finanziari come Pictet, Lombard Odier e Barclays, con un focus sulla sicurezza post-quantistica.

2026-06-02 📰 Fonte
Acquisizioni di chip Nvidia da parte del PLA: nuove evidenze post-controlli USA
📁 Altro AI generated ℹ️ Tom's Hardware

Acquisizioni di chip Nvidia da parte del PLA: nuove evidenze post-controlli USA

Nuove ricerche, basate su documenti pubblici, rivelano che istituzioni legate all'Esercito Popolare di Liberazione (PLA) cinese hanno continuato ad acquisire chip AI di Nvidia, inclusa la tecnicia Blackwell, anche dopo l'introduzione dei controlli all'export da parte di Washington. Questo scenario evidenzia le sfide nella gestione delle catene di approvvigionamento tecniciche e le implicazioni per la sovranità dei dati e il deployment on-premise di infrastrutture AI critiche.

2026-06-02 📰 Fonte
Codex e l'AI: la produttività aziendale nell'era dell'automazione intelligente
📁 Altro AI generated 🏆 OpenAI Blog

Codex e l'AI: la produttività aziendale nell'era dell'automazione intelligente

Il rapporto "The Next Era of Knowledge Work" evidenzia come Codex stia ridefinendo la produttività aziendale attraverso l'AI. Strumenti come Codex, capaci di ricerca avanzata, analisi dati, automazione dei workflow e creazione di contenuti, pongono nuove sfide e opportunità. L'adozione di queste tecnicie richiede un'attenta analisi dei requisiti infrastrutturali, dei costi e della sovranità dei dati, aspetti cruciali per i deployment on-premise e ibridi.

2026-06-02 📰 Fonte
Vinted Ventures investe 26 milioni in Tilt: una mossa strategica nel live-commerce
📁 Market AI generated ℹ️ The Next Web

Vinted Ventures investe 26 milioni in Tilt: una mossa strategica nel live-commerce

Vinted Ventures ha guidato un round di finanziamento da 26 milioni di dollari per Tilt, un'applicazione londinese di aste in diretta. Questa operazione segna il primo investimento di Vinted Ventures nel settore del live-commerce ed è interpretata come una strategia difensiva per contrastare l'espansione di Whatnot, che minaccia la posizione di Vinted nel mercato europeo del resale.

2026-06-02 📰 Fonte
CBA: l'AI aziendale genera 'work slop' e costi crescenti per le grandi imprese
📁 Market AI generated ℹ️ The Next Web

CBA: l'AI aziendale genera 'work slop' e costi crescenti per le grandi imprese

Il CEO della Commonwealth Bank of Australia, Matt Comyn, ha sollevato preoccupazioni sull'adozione dell'AI in ambito aziendale. Comyn ha coniato il termine 'work slop' per descrivere l'output di bassa qualità generato dagli strumenti di intelligenza artificiale, che si sta diffondendo nei flussi di lavoro corporate. Ha inoltre evidenziato come i costi dell'AI, basati sui token, stiano aumentando proporzionalmente alla complessità dei compiti, ponendo sfide significative per le grandi imprese.

2026-06-02 📰 Fonte
Intel: 18A e x86 al centro della strategia AI delineata da Lip-Bu Tan a Computex 2026
📁 Hardware AI generated ✅ DigiTimes

Intel: 18A e x86 al centro della strategia AI delineata da Lip-Bu Tan a Computex 2026

Durante il Computex 2026 a Taipei, il CEO di Intel, Lip-Bu Tan, ha presentato la strategia dell'azienda per l'intelligenza artificiale. L'approccio si fonda su tre pilastri: la tecnicia di processo 18A, l'architettura x86 e il rafforzamento dei legami con Taiwan. Questa visione mira a consolidare la posizione di Intel nel settore AI, offrendo soluzioni hardware robuste per carichi di lavoro complessi e supportando le esigenze di deployment on-premise con un focus su performance, efficienza e stabilità della supply chain.

2026-06-02 📰 Fonte
Mach Industries: la startup tech-difesa quadruplica la valutazione a 1,8 miliardi di dollari
📁 Market AI generated ℹ️ The Next Web

Mach Industries: la startup tech-difesa quadruplica la valutazione a 1,8 miliardi di dollari

Mach Industries, startup di Huntington Beach specializzata in tecnicia per la difesa, ha chiuso un round di finanziamento Series C da 300 milioni di dollari, portando la sua valutazione a 1,8 miliardi di dollari. L'azienda, fondata tre anni fa da Ethan Thornton, ventiduenne ex studente del MIT, ha quasi quadruplicato il suo valore rispetto a quanto registrato a giugno 2025, in un contesto di crescente interesse del Pentagono per la supremazia dei droni.

2026-06-02 📰 Fonte
Qisda accelera sull'AI: implicazioni per i deployment on-premise
📁 Market AI generated ✅ DigiTimes

Qisda accelera sull'AI: implicazioni per i deployment on-premise

Qisda sta rafforzando il suo impegno nell'intelligenza artificiale, proiettandosi verso una ripresa nel 2026. Questa mossa riflette una tendenza più ampia nel settore, dove le aziende esplorano l'AI per l'ottimizzazione operativa. Per le imprese, l'adozione dell'AI, specialmente con Large Language Models, solleva questioni cruciali legate al deployment, alla sovranità dei dati e al Total Cost of Ownership, spingendo molte a considerare soluzioni on-premise per maggiore controllo e sicurezza.

2026-06-02 📰 Fonte
AI PC e MacBook: un nuovo scenario per il mercato notebook e l'AI locale
📁 Market AI generated ✅ DigiTimes

AI PC e MacBook: un nuovo scenario per il mercato notebook e l'AI locale

Il mercato dei notebook affronta una fase di debolezza, influenzato dall'emergere degli AI PC e dalla presenza dei MacBook di fascia bassa. Questa dinamica evidenzia una crescente attenzione verso le capacità di elaborazione AI in locale, con implicazioni significative per l'Inference on-premise, la sovranità dei dati e il TCO, spingendo le aziende a riconsiderare le proprie strategie di deployment.

2026-06-02 📰 Fonte
Samsung: roadmap HBM5 e gestione termica per la memoria AI del futuro
📁 Hardware AI generated ✅ DigiTimes

Samsung: roadmap HBM5 e gestione termica per la memoria AI del futuro

Samsung sta delineando una strategia ambiziosa per la memoria dedicata all'AI, introducendo una roadmap per HBM5 e tecnicie avanzate di gestione termica. Questo sviluppo è cruciale per supportare i carichi di lavoro sempre più intensivi dei Large Language Models e per affrontare le sfide di performance e raffreddamento nei deployment on-premise e cloud, influenzando direttamente l'architettura dei futuri sistemi AI.

2026-06-02 📰 Fonte
Intel e Perplexity: la sinergia per i Large Language Models al Computex
📁 Altro AI generated ✅ DigiTimes

Intel e Perplexity: la sinergia per i Large Language Models al Computex

La keynote di Intel al Computex, con la partecipazione del CEO di Perplexity, ha evidenziato l'importanza delle collaborazioni tra produttori di silicio e sviluppatori di Large Language Models. L'evento sottolinea la crescente attenzione verso l'ottimizzazione dell'hardware per carichi di lavoro AI, un fattore cruciale per chi valuta deployment on-premise, la sovranità dei dati e il Total Cost of Ownership.

2026-06-02 📰 Fonte
Alphabet raccoglie 80 miliardi per l'infrastruttura AI, spinta dalla domanda
📁 Market AI generated ℹ️ The Next Web

Alphabet raccoglie 80 miliardi per l'infrastruttura AI, spinta dalla domanda

Alphabet, la casa madre di Google, ha annunciato un piano per raccogliere 80 miliardi di dollari in capitale azionario. Questa mossa, insolitamente ampia per l'azienda, mira a finanziare investimenti significativi in infrastrutture di calcolo AI di livello mondiale. La decisione è motivata da una domanda senza precedenti da parte dei clienti, evidenziando l'accelerazione degli investimenti nel settore dell'intelligenza artificiale.

2026-06-02 📰 Fonte
STMicroelectronics: ricavi dai data center raddoppiati a 1 miliardo di dollari
📁 Market AI generated ℹ️ The Next Web

STMicroelectronics: ricavi dai data center raddoppiati a 1 miliardo di dollari

STMicroelectronics ha rivisto al rialzo le sue previsioni di ricavi dal settore dei data center, portandole a circa 1 miliardo di dollari entro il 2026. L'azienda franco-italiana attribuisce questa crescita alla domanda sostenuta per l'infrastruttura AI e a un'accelerazione nella capacità produttiva. Questo scenario evidenzia la crescente importanza del silicio per l'AI, con implicazioni dirette per le strategie di deployment on-premise e la pianificazione dell'infrastruttura.

2026-06-02 📰 Fonte
Anthropic accelera verso l'IPO, ridefinendo la corsa nel mercato LLM
📁 Market AI generated ✅ DigiTimes

Anthropic accelera verso l'IPO, ridefinendo la corsa nel mercato LLM

Anthropic ha avviato il processo per una potenziale Offerta Pubblica Iniziale (IPO) con una presentazione riservata, posizionandosi in anticipo rispetto a concorrenti chiave come OpenAI. Questa mossa strategica evidenzia l'intensa competizione e la crescente maturità del settore dei Large Language Models, con implicazioni significative per gli investimenti in infrastrutture e le strategie di deployment, sia cloud che on-premise.

2026-06-02 📰 Fonte
Ennoconn: previsioni di crescita per il business AI oltre i 10 miliardi di NT$ entro il 2026
📁 Market AI generated ✅ DigiTimes

Ennoconn: previsioni di crescita per il business AI oltre i 10 miliardi di NT$ entro il 2026

Ennoconn, fornitore di soluzioni per l'Internet delle Cose e l'intelligenza artificiale, ha annunciato di prevedere che il suo business legato all'AI supererà i 10 miliardi di dollari taiwanesi entro il 2026. Questa proiezione evidenzia la rapida espansione del mercato delle infrastrutture AI e la crescente domanda di soluzioni hardware e software per l'implementazione di Large Language Models (LLM) in contesti enterprise, con un'attenzione particolare ai deployment on-premise.

2026-06-02 📰 Fonte
L'Agentic Computing ridefinirà data center e dispositivi edge, secondo Nvidia
📁 Altro AI generated ✅ DigiTimes

L'Agentic Computing ridefinirà data center e dispositivi edge, secondo Nvidia

Il CEO di Nvidia, Jensen Huang, prevede che l'agentic computing trasformerà radicalmente data center, PC, robot e veicoli. Questa visione sottolinea un futuro in cui sistemi autonomi basati su intelligenza artificiale gestiranno compiti complessi, influenzando profondamente le strategie di deployment on-premise e l'infrastruttura IT per la sovranità dei dati e l'efficienza operativa.

2026-06-02 📰 Fonte
La domanda di token AI accelera il mercato hardware: implicazioni per il deployment on-premise
📁 Market AI generated ✅ DigiTimes

La domanda di token AI accelera il mercato hardware: implicazioni per il deployment on-premise

Il presidente di TAITRA ha evidenziato come la forte e continua domanda di token AI stia guidando un aumento significativo delle spedizioni di hardware. Questa dinamica di mercato ha profonde implicazioni per le aziende che valutano strategie di deployment di Large Language Models (LLM) e carichi di lavoro AI, sottolineando l'importanza di considerare soluzioni on-premise per ottimizzare il Total Cost of Ownership (TCO) e garantire la sovranità dei dati.

2026-06-02 📰 Fonte
Valeo ridefinisce la strategia: focus su data center AI, robotica e difesa
📁 Altro AI generated ✅ DigiTimes

Valeo ridefinisce la strategia: focus su data center AI, robotica e difesa

Valeo, in un contesto di rallentamento della transizione verso l'elettrificazione e la guida autonoma, sta orientando la sua strategia verso nuovi settori ad alta crescita. L'azienda intende costruire un secondo motore di sviluppo focalizzato su data center per l'intelligenza artificiale, robotica e difesa. Questa mossa evidenzia la crescente importanza dell'AI in ambiti critici, dove il controllo dell'infrastruttura e la sovranità dei dati diventano prioritari.

2026-06-02 📰 Fonte
Intel Arc Pro B70: i benchmark di llama.cpp per l'inference locale
📁 Hardware AI generated ℹ️ LocalLLaMA

Intel Arc Pro B70: i benchmark di llama.cpp per l'inference locale

Nuovi benchmark mostrano le capacità della GPU Intel Arc Pro B70 nell'inference di Large Language Models (LLM) in ambienti locali. Con `llama.cpp` e il modello Qwen, la scheda ha raggiunto 6.3 Token al secondo, offrendo un'alternativa interessante per le aziende che valutano deployment on-premise e cercano soluzioni hardware efficienti per la sovranità dei dati e il controllo dei costi.

2026-06-02 📰 Fonte
NVIDIA lancia Cosmos 3: modelli omnimodali per l'AI fisica su Hugging Face
📁 LLM AI generated ℹ️ LocalLLaMA

NVIDIA lancia Cosmos 3: modelli omnimodali per l'AI fisica su Hugging Face

NVIDIA ha rilasciato Cosmos 3, una suite di modelli omnimodali disponibili su Hugging Face. Questi modelli, nelle versioni Nano (16B) e Super (64B), sono progettati per generare video, immagini, audio e comandi di azione da input multimodali. Rappresentano un elemento fondamentale per lo sviluppo di applicazioni di Intelligenza Artificiale fisica, dalla comprensione del mondo alla simulazione e all'apprendimento di policy per sistemi embodied.

2026-06-02 📰 Fonte
Moss TTS 1.5 8B: Nuovi Orizzonti nella Clonazione Vocale per l'Inglese
📁 Altro AI generated ℹ️ LocalLLaMA

Moss TTS 1.5 8B: Nuovi Orizzonti nella Clonazione Vocale per l'Inglese

Il modello Moss TTS 1.5 8B emerge come una soluzione promettente per la clonazione vocale in lingua inglese. Secondo le prime valutazioni, si posiziona in vantaggio rispetto ad altri modelli noti, con ampi margini di miglioramento attraverso l'ottimizzazione dei parametri. Questo sviluppo solleva questioni rilevanti per i deployment on-premise, in termini di controllo, personalizzazione e requisiti hardware per l'inference.

2026-06-02 📰 Fonte
Foxconn potenzia la sua infrastruttura AI con data center e robotica
📁 Altro AI generated ✅ DigiTimes

Foxconn potenzia la sua infrastruttura AI con data center e robotica

Foxconn sta espandendo il proprio ruolo nel settore dell'intelligenza artificiale, investendo in "token factories", soluzioni robotiche e una rete globale di data center. Questa mossa strategica sottolinea la crescente domanda di infrastrutture fisiche e logistiche per supportare i carichi di lavoro degli LLM e dell'AI generativa, offrendo nuove prospettive per le aziende che valutano deployment on-premise o ibridi e cercano alternative ai tradizionali hyperscaler cloud.

2026-06-02 📰 Fonte
Power Integrations: PSU GaN da 1700V per data center AI, un passo per l'efficienza
📁 Hardware AI generated ✅ DigiTimes

Power Integrations: PSU GaN da 1700V per data center AI, un passo per l'efficienza

Power Integrations ha annunciato una nuova unità di alimentazione ausiliaria (PSU) basata su nitruro di gallio (GaN) da 1700V. Progettata specificamente per i data center che ospitano carichi di lavoro di intelligenza artificiale, questa soluzione mira a migliorare l'efficienza energetica. L'adozione di tecnicie GaN è cruciale per ottimizzare il TCO e la gestione termica in ambienti on-premise, dove la densità di potenza e la sostenibilità sono fattori chiave per i decision-makers.

2026-06-02 📰 Fonte
Unimicron: la nuova leadership affronta la strozzatura dei substrati per l'AI
📁 Hardware AI generated ✅ DigiTimes

Unimicron: la nuova leadership affronta la strozzatura dei substrati per l'AI

Unimicron, azienda leader nella produzione di circuiti stampati, ha annunciato un cambio di leadership che porterà a un rifocalizzazione delle risorse. L'obiettivo primario è affrontare la crescente strozzatura nella fornitura di substrati avanzati, componenti cruciali per l'assemblaggio di chip AI ad alte prestazioni. Questa mossa strategica evidenzia le sfide attuali nella supply chain dell'hardware AI e le sue implicazioni per le aziende che pianificano deployment on-premise di Large Language Models e altre applicazioni di intelligenza artificiale.

2026-06-02 📰 Fonte
Intel Xeon 6+ punta all'AI agentica e sfida l'egemonia delle GPU
📁 Hardware AI generated ✅ DigiTimes

Intel Xeon 6+ punta all'AI agentica e sfida l'egemonia delle GPU

Intel ha presentato la sua nuova linea di processori Xeon 6+, progettata per ottimizzare l'inference di AI agentica. Questa mossa rappresenta una sfida diretta alle architetture infrastrutturali tradizionalmente incentrate sulle GPU, proponendo un'alternativa per le aziende che cercano maggiore controllo, sovranità dei dati e un TCO potenzialmente inferiore per specifici carichi di lavoro AI on-premise.

2026-06-02 📰 Fonte
L'ecosistema dei semiconduttori di Taiwan: un asset strategico irripetibile per l'AI
📁 Market AI generated ✅ DigiTimes

L'ecosistema dei semiconduttori di Taiwan: un asset strategico irripetibile per l'AI

Il CEO di ASE ha sottolineato come l'ecosistema taiwanese dei semiconduttori, frutto di quarant'anni di sviluppo, sia estremamente difficile da replicare. Questa realtà ha profonde implicazioni per la supply chain globale e per le strategie di deployment di infrastrutture AI, in particolare per le soluzioni on-premise che dipendono da silicio avanzato e da una filiera consolidata.

2026-06-02 📰 Fonte
Jensen Huang di NVIDIA elogia Marvell a Computex: un futuro da "trillion-dollar company"
📁 Market AI generated ✅ DigiTimes

Jensen Huang di NVIDIA elogia Marvell a Computex: un futuro da "trillion-dollar company"

Jensen Huang, CEO di NVIDIA, ha espresso grande fiducia in Marvell durante Computex, definendola una potenziale "trillion-dollar company". L'elogio sottolinea il ruolo cruciale di Marvell nello sviluppo di infrastrutture per data center e soluzioni di silicio personalizzate, elementi fondamentali per i deployment di Large Language Models on-premise e per la sovranità dei dati.

2026-06-02 📰 Fonte
Innovazione AI Locale: Un Modello On-Premise per la Lotta alle Zanzare
📁 Altro AI generated ℹ️ LocalLLaMA

Innovazione AI Locale: Un Modello On-Premise per la Lotta alle Zanzare

Un progetto amatoriale ha dimostrato il potenziale dell'intelligenza artificiale locale con un sistema capace di rilevare e neutralizzare le zanzare tramite laser. Questa iniziativa evidenzia i vantaggi dei deployment on-premise per applicazioni specifiche, offrendo spunti su sovranità dei dati, latenza ridotta e controllo operativo, aspetti cruciali per le decisioni infrastrutturali aziendali che valutano alternative self-hosted.

2026-06-02 📰 Fonte
Intel al Computex 2026: la strategia hardware per l'Era dell'Intelligenza
📁 Hardware AI generated ✅ ServeTheHome

Intel al Computex 2026: la strategia hardware per l'Era dell'Intelligenza

Intel si prepara a delineare la sua visione per l'Era dell'Intelligenza al Computex 2026. Il CEO Lip-Bu Tan illustrerà la strategia dell'azienda nello sviluppo di hardware AI per molteplici mercati, evidenziando l'impegno di Intel nel fornire soluzioni per carichi di lavoro di intelligenza artificiale, cruciali per le decisioni di deployment on-premise e ibride.

2026-06-02 📰 Fonte
Data Image a COMPUTEX: display robusti per veicoli AI autonomi
📁 Hardware AI generated ✅ DigiTimes

Data Image a COMPUTEX: display robusti per veicoli AI autonomi

Data Image, parte del gruppo Qisda, ha presentato a COMPUTEX i suoi display ad alta luminosità e robustezza, progettati specificamente per l'integrazione in veicoli autonomi basati su intelligenza artificiale. Questa offerta sottolinea la crescente domanda di hardware specializzato e resiliente per applicazioni AI in ambienti operativi esigenti, evidenziando le sfide del deployment AI all'edge e l'importanza della sovranità dei dati e del controllo in scenari critici.

2026-06-02 📰 Fonte
LLM per il Coding On-Premise: Bilanciare VRAM, Modelli da 70-80B e Contesto Esteso
📁 LLM AI generated ℹ️ LocalLLaMA

LLM per il Coding On-Premise: Bilanciare VRAM, Modelli da 70-80B e Contesto Esteso

Un utente esperto di sviluppo front-end cerca LLM per il coding nella fascia 70-80B, da eseguire su un setup on-premise con 3x 24GB VRAM. La sfida è bilanciare la dimensione del modello, la quantization Q6 e un contesto minimo di 256k token, essenziale per la qualità del codice. La velocità di inference è cruciale per il suo workflow di "micro-management", evidenziando i compromessi tra performance e risorse hardware locali.

2026-06-02 📰 Fonte
AEyeDE: L'attenzione dei LLM per un rilevamento robusto dei testi generati da AI
📁 LLM AI generated 🏆 ArXiv cs.CL

AEyeDE: L'attenzione dei LLM per un rilevamento robusto dei testi generati da AI

Con la crescente fluidità dei Large Language Models, distinguere testi umani da quelli generati da AI è sempre più complesso. AEyeDE propone un approccio innovativo basato sull'analisi delle matrici di attenzione dei Transformer, addestrando una rete neurale convoluzionale leggera. Questo metodo supera le tecniche tradizionali, offrendo un segnale interpretabile e robusto, fondamentale per le aziende che necessitano di verificare l'autenticità dei contenuti e garantire la sovranità dei dati.

2026-06-02 📰 Fonte
DOPA: Un framework per la robustezza degli LLM in contesti Out-of-Distribution
📁 LLM AI generated 🏆 ArXiv cs.CL

DOPA: Un framework per la robustezza degli LLM in contesti Out-of-Distribution

I Large Language Models (LLM) mostrano buone performance in compiti Out-of-Distribution (OOD), ma la loro efficacia diminuisce con l'aumentare dello scostamento distributivo. Per affrontare il problema dell'inaccessibilità del dominio target, che compromette la qualità delle "demonstrations" selezionate, è stato proposto DOPA. Questo framework utilizza un proxy OOD per approssimare il dominio target e una metrica di diversità basata sulla distanza di Mahalanobis, migliorando significativamente la robustezza degli LLM in scenari OOD.

2026-06-02 📰 Fonte
DAStatFormer: Efficienza e Precisione per il Monitoraggio Acustico Distribuito
📁 Altro AI generated 🏆 ArXiv cs.LG

DAStatFormer: Efficienza e Precisione per il Monitoraggio Acustico Distribuito

DAStatFormer introduce un approccio innovativo per l'analisi dei dati Distributed Acoustic Sensing (DAS). Questo Transformer ibrido elabora attributi statistici compatti anziché segnali grezzi, riducendo drasticamente la dimensione dei dati. Il modello raggiunge un'accuratezza elevata e un costo di Inference significativamente inferiore rispetto alle alternative, rendendolo ideale per applicazioni di monitoraggio scalabili e in tempo reale, con implicazioni positive per il Total Cost of Ownership (TCO) in contesti on-premise.

2026-06-02 📰 Fonte
BitsMoE: Ottimizzare i Large Language Models MoE con Quantization Spettrale
📁 LLM AI generated 🏆 ArXiv cs.LG

BitsMoE: Ottimizzare i Large Language Models MoE con Quantization Spettrale

BitsMoE introduce un nuovo framework per la quantization dei Large Language Models (LLM) basati su architettura Mixture-of-Experts (MoE). Affrontando il problema dell'elevato consumo di memoria, BitsMoE utilizza un'allocazione di bit guidata dall'energia spettrale. Questo approccio consente di ridurre significativamente la degradazione dell'accuratezza in regimi di ultra-low-bit, migliorando al contempo la velocità di inference e di quantization, rendendo i deployment on-premise più efficienti e sostenibili.

2026-06-02 📰 Fonte
Consilium Protocol: Deliberazione AI Multi-Modello per Affidabilità e TCO Contenuto
📁 LLM AI generated 🏆 ArXiv cs.AI

Consilium Protocol: Deliberazione AI Multi-Modello per Affidabilità e TCO Contenuto

Un nuovo protocollo, Consilium, introduce un'architettura derivata dalla tolleranza ai guasti bizantini per la deliberazione AI multi-modello. Assegnando "persone cognitive" ai Large Language Models, il protocollo dimostra che modelli edge a basso costo possono produrre risultati analitici comparabili a quelli di modelli frontier, con un TCO significativamente inferiore. Evidenzia inoltre i bias degli LLM allineati con RLHF e offre un framework per la validazione basata su evidenze esterne.

2026-06-02 📰 Fonte
Garantire la Robustezza Post-Calcolo nei Motori Decisionali
📁 Altro AI generated 🏆 ArXiv cs.AI

Garantire la Robustezza Post-Calcolo nei Motori Decisionali

I motori decisionali basati su Programmazione Lineare a Numeri Interi Misti (MILP) sono cruciali per sistemi industriali ad alta criticità. Tuttavia, le condizioni reali di deployment spesso non corrispondono alle assunzioni iniziali, rendendo le soluzioni nominalmente ottimali vulnerabili a piccole perturbazioni. Un nuovo approccio propone un livello di robustezza post-calcolo per valutare l'affidabilità delle soluzioni e fornire prove concrete sulla loro tenuta in ambienti operativi dinamici, specialmente per i sistemi decisionali abilitati all'apprendimento automatico.

2026-06-02 📰 Fonte
Foxconn e Nvidia: AI agentica e robotica infermieristica per gli ospedali di Taiwan
📁 Altro AI generated ✅ DigiTimes

Foxconn e Nvidia: AI agentica e robotica infermieristica per gli ospedali di Taiwan

Foxconn e Nvidia stanno collaborando per implementare su larga scala soluzioni di AI agentica e robotica infermieristica negli ospedali di Taiwan. Questa partnership mira a trasformare l'assistenza sanitaria attraverso l'automazione intelligente, evidenziando l'importanza di infrastrutture robuste e localizzate per gestire carichi di lavoro AI complessi e dati sensibili, con implicazioni significative per la sovranità dei dati e la latenza operativa.

2026-06-02 📰 Fonte
L'AI Agente e la Pressione Computazionale: Scenari per l'On-Premise
📁 Altro AI generated ✅ DigiTimes

L'AI Agente e la Pressione Computazionale: Scenari per l'On-Premise

L'emergere dell'AI agente sta generando una significativa pressione sulla catena di approvvigionamento globale per le risorse computazionali. Questo fenomeno solleva interrogativi cruciali per le organizzazioni che valutano strategie di deployment, spingendo a considerare l'impatto su disponibilità hardware, costi e sovranità dei dati. La crescente domanda di capacità di calcolo, in particolare per l'inference e il training di Large Language Models (LLM), rende le decisioni sull'infrastruttura on-premise sempre più strategiche.

2026-06-02 📰 Fonte
OpenAI punta alla robotica: assunzioni per sviluppo hardware e AI
📁 Market AI generated ✅ DigiTimes

OpenAI punta alla robotica: assunzioni per sviluppo hardware e AI

OpenAI sta intensificando i suoi sforzi nel campo della robotica, annunciando una campagna di assunzioni mirata a ingegneri specializzati nello sviluppo di hardware e intelligenza artificiale. L'iniziativa, rivelata da Sam Altman, segna un'espansione significativa delle ambizioni dell'azienda oltre i Large Language Models, verso applicazioni fisiche dell'AI. Questo passo evidenzia l'interesse crescente per l'integrazione tra AI avanzata e sistemi robotici autonomi.

2026-06-02 📰 Fonte
Alphabet accelera gli investimenti AI: 80 miliardi per l'infrastruttura
📁 Altro AI generated ✅ DigiTimes

Alphabet accelera gli investimenti AI: 80 miliardi per l'infrastruttura

Alphabet ha annunciato un significativo aumento del ciclo di spesa in conto capitale (CapEx) per l'intelligenza artificiale, con un investimento di 80 miliardi di dollari destinato all'espansione delle proprie infrastrutture. Questa mossa sottolinea la crescente importanza delle risorse hardware e data center per lo sviluppo e il deployment di Large Language Models e altre applicazioni AI, influenzando il panorama competitivo e le decisioni di deployment per le aziende.

2026-06-02 📰 Fonte
Intel a Computex 2026: Attesa per le Strategie AI On-Premise
📁 Hardware AI generated ℹ️ Tom's Hardware

Intel a Computex 2026: Attesa per le Strategie AI On-Premise

Intel si prepara a salire sul palco di Computex 2026 a Taipei, con il CEO Lip-Bu Tan che terrà il keynote. L'evento è un'occasione cruciale per l'azienda per delineare la propria visione e le innovazioni nel panorama dell'intelligenza artificiale, in particolare per i deployment on-premise. Gli occhi sono puntati sulle future direzioni hardware e software che potrebbero influenzare le decisioni strategiche di CTO e architetti infrastrutturali.

2026-06-02 📰 Fonte
HPE anticipa gli obiettivi a lungo termine per la crescente domanda di infrastrutture AI
📁 Market AI generated ✅ DigiTimes

HPE anticipa gli obiettivi a lungo termine per la crescente domanda di infrastrutture AI

Hewlett Packard Enterprise (HPE) ha annunciato l'accelerazione dei propri obiettivi finanziari a lungo termine, spinta da una significativa crescita nella domanda di infrastrutture dedicate all'intelligenza artificiale. Questo trend riflette l'espansione del mercato AI e la necessità delle aziende di dotarsi di capacità computazionali robuste per carichi di lavoro complessi, con implicazioni dirette per le strategie di deployment on-premise.

2026-06-02 📰 Fonte
← Precedente Page 69 / 123 Successiva →
Vedi Archivio Completo 🗄️

AI-Radar is an independent observatory covering AI models, local LLMs, on-premise deployments, hardware, and emerging trends. We provide daily analysis and editorial coverage for developers, engineers, and organizations exploring local AI solutions.

AI-RADAR badge LaunchTry LAUNCHING SOON ON LaunchTry Fazier badge