AI-Radar - Osservatorio su LLM locali, hardware AI e trend

AI-Radar per LLM on-prem & AI in casa

Il radar quotidiano su modelli, framework e hardware per far girare l'AI in locale. LLM, LangChain, Chroma, mini-PC e tutto ciò che serve per un cervello distribuito "in-house".

⚙️ Stack: LLM locali · LangChain · Transformers · ChromaDB · MiniPC · AI boxes
🛰️ Ask Observatory (Q&A + RAG) già collegato all'archivio articoli.
👥 160+ membri · Iscriviti gratis →

⚡ In Tendenza

View All →

🛠️ Guide & Osservatorio On-Premise

🚀 Esegui i modelli in locale → Tutte le guide →

Riferimenti evergreen e pratici per far girare l'AI in locale — hardware, costi, privacy e stack completo.

🖥️ Osservatorio LLM On-Premise Hardware, stack, governance e architetture di riferimento per l'AI in locale.

Ultime analisi & news dal radar

Articoli generati dall'AI sulla base dei feed, con spazio per layer editoriale umano sopra il contenuto grezzo.

GoPro e la Crisi della Memoria AI: Un Campanello d'Allarme per il Mercato
📁 Market AI generated ℹ️ Tom's Hardware

GoPro e la Crisi della Memoria AI: Un Campanello d'Allarme per il Mercato

GoPro ha sollevato dubbi significativi sulla propria continuità operativa, citando una carenza di memoria AI come fattore critico. Questo evento evidenzia le crescenti sfide nella catena di approvvigionamento di componenti essenziali per l'intelligenza artificiale, con ripercussioni che vanno oltre i settori tradizionali e influenzano le strategie di deployment on-premise e cloud.

2026-06-03 📰 Fonte
Mappare le minacce cyber abilitate dall'AI: un anno di sfide per l'on-premise
📁 Altro AI generated 🏆 Anthropic News

Mappare le minacce cyber abilitate dall'AI: un anno di sfide per l'on-premise

L'analisi di un anno di minacce cyber potenziate dall'intelligenza artificiale rivela sfide crescenti per la sicurezza delle infrastrutture. Per le aziende che valutano deployment on-premise di LLM, comprendere queste dinamiche è cruciale per proteggere la sovranità dei dati e garantire la compliance, bilanciando controllo e TCO in un panorama di attacchi sempre più sofisticati.

2026-06-03 📰 Fonte
Il CEO di MIPS promuove RISC-V per l'AI su hardware fisico al Computex
📁 Hardware AI generated ✅ DigiTimes

Il CEO di MIPS promuove RISC-V per l'AI su hardware fisico al Computex

Al Computex, il CEO di MIPS ha evidenziato il potenziale di RISC-V per l'intelligenza artificiale su hardware fisico. Questa architettura aperta offre flessibilità e controllo, elementi cruciali per le aziende che cercano soluzioni AI on-premise o edge, con un'attenzione particolare alla sovranità dei dati e all'ottimizzazione del TCO. La discussione sottolinea l'evoluzione del panorama dei processori per carichi di lavoro AI.

2026-06-03 📰 Fonte
Molfar raccoglie 1,5 milioni di euro per radar anti-drone tattici on-premise
📁 Altro AI generated ℹ️ Tech.eu

Molfar raccoglie 1,5 milioni di euro per radar anti-drone tattici on-premise

Molfar Defence Technologies, azienda polacco-ucraina, ha chiuso la prima tranche di un round di finanziamento da 1,5 milioni di euro. L'investimento di Front Ventures supporterà lo sviluppo e il deployment di sistemi radar tattici per la rilevazione di piccoli UAV. Questi sistemi, progettati per operare in ambienti complessi e vicini alle unità operative, enfatizzano la sovranità dei dati e il controllo sul campo, aspetti cruciali per le infrastrutture di difesa.

2026-06-03 📰 Fonte
Immobiliare a San Francisco: le azioni Anthropic superano il contante
📁 Market AI generated ✅ Wired AI

Immobiliare a San Francisco: le azioni Anthropic superano il contante

Nel dinamico mercato immobiliare della Bay Area, alcune proprietà vengono offerte in cambio di quote azionarie di Anthropic, la startup di intelligenza artificiale. Questo fenomeno sottolinea la percezione di un valore eccezionale per le aziende leader nel settore AI, riflettendo l'intensa corsa agli investimenti e l'importanza strategica dell'intelligenza artificiale generativa.

2026-06-03 📰 Fonte
KRAID: Nuovo Compilatore per GPU Arm Mali Integrato in Mesa 26.2
📁 Hardware AI generated ✅ Phoronix

KRAID: Nuovo Compilatore per GPU Arm Mali Integrato in Mesa 26.2

Il nuovo compilatore KRAID, progettato per le moderne GPU Arm Mali, è stato integrato in Mesa 26.2. Questa mossa strategica mira a migliorare le prestazioni e l'efficienza dei driver open-source Panfrost e PanVK, con implicazioni significative per i deployment AI su hardware Arm, in particolare in contesti edge e on-premise dove il controllo e il TCO sono prioritari.

2026-06-03 📰 Fonte
Microsoft Porta Coreutils su Windows, Basato su Rust
📁 Altro AI generated ✅ Phoronix

Microsoft Porta Coreutils su Windows, Basato su Rust

Durante la conferenza Build 2026, Microsoft ha svelato Coreutils per Windows, un set di utility di sistema derivato da Rust Coreutils. L'iniziativa mira a standardizzare e semplificare l'esperienza degli sviluppatori su piattaforme eterogenee come Windows, WSL, macOS e Linux, offrendo strumenti familiari e coerenti per la gestione dell'infrastruttura.

2026-06-03 📰 Fonte
Walmart e l'AI: la realtà dei costi di inference per le grandi imprese
📁 Market AI generated ℹ️ AI News

Walmart e l'AI: la realtà dei costi di inference per le grandi imprese

Walmart ha iniziato a limitare l'uso di un assistente AI interno a causa di costi di inference superiori alle attese, passando da un accesso illimitato a un sistema basato su token. Questa mossa riflette una tendenza più ampia nel settore, dove i Large Language Models (LLM) adottano modelli di pricing pay-per-use. La gestione dei costi e l'ottimizzazione dell'utilizzo dei modelli diventano cruciali per le grandi imprese che cercano di bilanciare produttività e spese operative dell'AI.

2026-06-03 📰 Fonte
Apoha: 36 milioni di dollari per insegnare alle macchine il comportamento della materia
📁 Altro AI generated ℹ️ The Next Web

Apoha: 36 milioni di dollari per insegnare alle macchine il comportamento della materia

Apoha ha annunciato un finanziamento da 36 milioni di dollari per sviluppare soluzioni che permettano alle macchine di simulare il comportamento della materia in condizioni reali. L'azienda mira a colmare una lacuna scientifica critica, offrendo un approccio scalabile ed economicamente vantaggioso per prevedere come le molecole interagiscono nell'ambiente, un fattore chiave per il successo nello sviluppo di farmaci e prodotti alimentari.

2026-06-03 📰 Fonte
Qisda: il 2026 sarà l'anno della svolta per l'intelligenza artificiale
📁 Market AI generated ✅ DigiTimes

Qisda: il 2026 sarà l'anno della svolta per l'intelligenza artificiale

Il presidente di Qisda prevede un'accelerazione significativa nell'adozione dell'IA entro il 2026. Questa prospettiva sottolinea l'urgenza per le aziende di definire strategie infrastrutturali robuste, valutando attentamente i trade-off tra soluzioni cloud e deployment on-premise, con particolare attenzione a TCO, sovranità dei dati e requisiti hardware per i Large Language Models.

2026-06-03 📰 Fonte
INXM Raccoglie 5,7 Milioni di Euro per l'Automazione AI On-Premise nelle Imprese Europee
📁 Altro AI generated ℹ️ Tech.eu

INXM Raccoglie 5,7 Milioni di Euro per l'Automazione AI On-Premise nelle Imprese Europee

La startup berlinese INXM ha ottenuto un finanziamento pre-seed di 5,7 milioni di euro per la sua tecnicia di automazione dei processi basata su AI. La piattaforma, che emerge dalla modalità stealth, mira a risolvere le sfide di deployment dell'AI in ambienti enterprise e industriali, garantendo consistenza, auditabilità e conformità. Il suo approccio "Compiled AI" trasforma gli insight dei Large Language Models in processi deterministici, ideali per la sovranità dei dati e l'integrazione con infrastrutture esistenti, specialmente in Europa.

2026-06-03 📰 Fonte
Sovranità tecnicica: il Parlamento UK chiede lo stop a Palantir nel NHS
📁 Altro AI generated ✅ The Register AI

Sovranità tecnicica: il Parlamento UK chiede lo stop a Palantir nel NHS

Il comitato per la scienza e la tecnicia del Parlamento britannico ha esortato il governo a rescindere il contratto con Palantir per la Federated Data Platform del NHS. La richiesta nasce dalla preoccupazione per il "vendor lock-in" e la dipendenza da fornitori esterni in settori critici. Il comitato suggerisce di sviluppare soluzioni interne o affidarsi a imprese britanniche per garantire la sovranità tecnicica e la sicurezza dei dati, sottolineando l'importanza di un'infrastruttura digitale robusta per i futuri progetti nazionali.

2026-06-03 📰 Fonte
I fan del Mondiale usano l'AI per aggirare il caro-biglietti e i bagarini
📁 LLM AI generated ✅ Wired AI

I fan del Mondiale usano l'AI per aggirare il caro-biglietti e i bagarini

I tifosi di calcio si stanno organizzando su Reddit, sfruttando Large Language Models come Claude per sviluppare software di ticketing fai-da-te. L'obiettivo è contrastare i prezzi esorbitanti dei biglietti per la Coppa del Mondo e l'attività dei bagarini, dimostrando come l'AI possa essere impiegata per soluzioni creative e decentralizzate, con implicazioni interessanti per il controllo dei dati e il deployment di applicazioni personalizzate.

2026-06-03 📰 Fonte
Oxford Quantum Circuits raccoglie 260 milioni di sterline: una svolta per il quantum computing britannico
📁 Market AI generated ℹ️ Tech.eu

Oxford Quantum Circuits raccoglie 260 milioni di sterline: una svolta per il quantum computing britannico

Oxford Quantum Circuits (OQC), spin-off dell'Università di Oxford, ha chiuso un round di finanziamento Series C da 260 milioni di sterline, il più grande mai registrato in Europa per il quantum computing privato. L'investimento segna un "momento di maturità" per il settore britannico, evidenziando il passaggio dalla promessa a consegne concrete. OQC sviluppa hardware e software per computer quantistici superconduttori, offrendo la propria tecnicia come servizio cloud a settori critici come finanza e difesa.

2026-06-03 📰 Fonte
SolarDew raccoglie 800.000 euro per la purificazione dell'acqua a energia solare
📁 Altro AI generated ℹ️ Tech.eu

SolarDew raccoglie 800.000 euro per la purificazione dell'acqua a energia solare

La startup olandese SolarDew ha ottenuto 800.000 euro per espandere la sua tecnicia di purificazione dell'acqua a energia solare. La soluzione, che sfrutta evaporazione e condensazione, opera autonomamente grazie all'energia termica solare e alla gravità, senza necessità di elettricità o prodotti chimici. Mira a fornire acqua potabile a un milione di persone entro il 2035, specialmente in aree remote e con scarsità idrica, offrendo un'alternativa sostenibile ai sistemi centralizzati e complessi.

2026-06-03 📰 Fonte
Quobly raccoglie 115 milioni per i computer quantistici su silicio
📁 Hardware AI generated ℹ️ The Next Web

Quobly raccoglie 115 milioni per i computer quantistici su silicio

La startup francese Quobly, con sede a Grenoble, ha recentemente raccolto 115 milioni di euro per sviluppare computer quantistici basati su chip di silicio. L'azienda si distingue per un approccio che mira a sfruttare l'infrastruttura produttiva esistente nel settore dei semiconduttori, a differenza di altre realtà che richiedono materiali e processi di fabbricazione completamente nuovi. Questa strategia potrebbe accelerare l'adozione della tecnicia quantistica, rendendola potenzialmente più accessibile e scalabile.

2026-06-03 📰 Fonte
MiniMax e Z.ai: la corsa a Shanghai riflette la crescita del compute AI
📁 Market AI generated ✅ DigiTimes

MiniMax e Z.ai: la corsa a Shanghai riflette la crescita del compute AI

MiniMax e Z.ai, due attori emergenti nel panorama dell'intelligenza artificiale, stanno esplorando la quotazione a Shanghai. Questa mossa evidenzia una tendenza più ampia: l'incremento significativo degli investimenti nel compute dedicato all'AI. La crescente domanda di risorse computazionali, sia per il training che per l'Inference di Large Language Models, spinge le aziende a cercare capitali per sostenere l'espansione infrastrutturale, un fattore chiave per chi valuta strategie di Deployment on-premise o ibride.

2026-06-03 📰 Fonte
La visione di Pegatron: un futuro con AI pensante e capace di agire
📁 LLM AI generated ✅ DigiTimes

La visione di Pegatron: un futuro con AI pensante e capace di agire

Il presidente di Pegatron, T.H. Tung, ha delineato una visione audace per il futuro dell'intelligenza artificiale, immaginando sistemi capaci di pensiero e azione autonomi. Questa prospettiva solleva interrogativi cruciali sulle infrastrutture necessarie per supportare tali capacità avanzate, spingendo la riflessione sui requisiti hardware e le strategie di deployment per l'AI di prossima generazione, con un occhio di riguardo alla sovranità dei dati e al TCO.

2026-06-03 📰 Fonte
Liteon: RTX Spark per trasformare i PC AI in assistenti personali
📁 Altro AI generated ✅ DigiTimes

Liteon: RTX Spark per trasformare i PC AI in assistenti personali

Liteon, tramite il suo presidente Anson Chiu, ha delineato una visione in cui la tecnicia "RTX Spark" potrebbe rivoluzionare i PC AI, trasformandoli in veri e propri assistenti personali. Questa prospettiva suggerisce un futuro in cui le capacità di intelligenza artificiale sono integrate e gestite localmente, offrendo nuove possibilità per l'interazione utente e la gestione dei dati direttamente sul dispositivo, in linea con i principi di sovranità e controllo.

2026-06-03 📰 Fonte
Micron punta su HBM4: implicazioni per l'ecosistema Nvidia e i deployment AI
📁 Hardware AI generated ✅ DigiTimes

Micron punta su HBM4: implicazioni per l'ecosistema Nvidia e i deployment AI

La strategia di Micron di focalizzarsi sulle memorie HBM4 preannuncia un ruolo di fornitore sempre più rilevante per Nvidia. Questa evoluzione è cruciale per l'industria dell'intelligenza artificiale, poiché le memorie HBM sono fondamentali per le performance delle GPU di prossima generazione. L'innovazione in questo settore influenzerà direttamente la capacità di gestire carichi di lavoro AI complessi, specialmente nei contesti di deployment on-premise, dove la sovranità dei dati e il TCO sono prioritari.

2026-06-03 📰 Fonte
La visione di NXP: l'AI fisica deve agire come una spina dorsale, non solo un cervello
📁 Altro AI generated ✅ DigiTimes

La visione di NXP: l'AI fisica deve agire come una spina dorsale, non solo un cervello

Al COMPUTEX Taipei, il CEO di NXP ha delineato una visione per l'AI fisica che trascende la mera elaborazione cognitiva. L'intelligenza artificiale, secondo questa prospettiva, dovrebbe emulare la reattività e la distribuzione della spina dorsale, integrandosi profondamente con il mondo fisico per decisioni rapide e localizzate. Questo approccio ha implicazioni significative per i deployment on-premise e l'edge computing, enfatizzando sovranità dei dati e TCO.

2026-06-03 📰 Fonte
Flok Health raccoglie 12,5 milioni di dollari per espandere la sua piattaforma AI per la fisioterapia
📁 Market AI generated ℹ️ Tech.eu

Flok Health raccoglie 12,5 milioni di dollari per espandere la sua piattaforma AI per la fisioterapia

Flok Health, piattaforma di cura digitale basata su intelligenza artificiale, ha chiuso un round di finanziamento Series A da 12,5 milioni di dollari. I fondi saranno impiegati per espandere i servizi di fisioterapia autonoma in UK, sviluppare nuove terapie e accedere a mercati internazionali. La soluzione, certificata come dispositivo medico di Classe IIa, mira a colmare il divario tra domanda e offerta nel settore sanitario, offrendo accesso immediato a trattamenti per patologie muscoloscheletriche.

2026-06-03 📰 Fonte
Gigaton: 26 milioni per l'AI che rivoluziona il controllo nell'industria pesante
📁 Market AI generated ℹ️ The Next Web

Gigaton: 26 milioni per l'AI che rivoluziona il controllo nell'industria pesante

Gigaton ha ottenuto un finanziamento di 26 milioni di dollari per sviluppare soluzioni AI destinate a sostituire il software di controllo obsoleto nell'industria pesante. L'obiettivo è modernizzare la gestione di impianti critici come i forni per cemento, che operano a temperature estreme e con sistemi spesso datati, migliorando efficienza e controllo operativo.

2026-06-03 📰 Fonte
Megaport punta al cloud AI distribuito e al mercato dell'inference con un maxi-finanziamento
📁 Altro AI generated ℹ️ The Next Web

Megaport punta al cloud AI distribuito e al mercato dell'inference con un maxi-finanziamento

Megaport, azienda australiana specializzata in networking, ha annunciato un'importante espansione strategica nel settore del cloud AI distribuito, con un focus specifico sul mercato dell'inference. L'iniziativa è sostenuta da nuovi contratti per infrastrutture AI del valore di circa 458,9 milioni di dollari australiani e da un'offerta di capitale per raccogliere 827,3 milioni di dollari australiani. Questo posizionamento mira a trasformare l'azienda in un fornitore di servizi AI, segnando un'evoluzione significativa nel suo modello di business.

2026-06-03 📰 Fonte
LLM quantizzati: perché la validità delle chiamate a strumenti è il vero benchmark
📁 LLM AI generated ℹ️ LocalLLaMA

LLM quantizzati: perché la validità delle chiamate a strumenti è il vero benchmark

L'attuale valutazione dei Large Language Models quantizzati si concentra su perplessità e qualità della prosa, ma trascura la validità dell'output strutturato, come le chiamate a strumenti JSON. Questa lacuna può portare a deployment inaffidabili, poiché errori invisibili nel testo diventano critici nelle schemi. È urgente sviluppare benchmark che misurino l'accuratezza delle chiamate a strumenti per garantire l'affidabilità dei sistemi AI agentici, specialmente in contesti on-premise.

2026-06-03 📰 Fonte
Kodesage: 6,6 milioni per l'AI on-premise e la modernizzazione del software legacy
📁 Altro AI generated ℹ️ The Next Web

Kodesage: 6,6 milioni per l'AI on-premise e la modernizzazione del software legacy

Kodesage, startup con sedi a Londra e Budapest, ha raccolto 6,6 milioni di dollari per la sua soluzione di modernizzazione AI. L'azienda si concentra sulla trasformazione di sistemi legacy come COBOL e Oracle Forms, tipici di banche e assicurazioni, garantendo che l'intera pipeline AI operi esclusivamente on-premise. Questo approccio risponde all'esigenza di sovranità dei dati, controllo e sicurezza per settori con infrastrutture critiche e software datato, mitigando i rischi associati alla migrazione al cloud.

2026-06-03 📰 Fonte
GitLab: tagli al personale e uscita da 22 Paesi per l'era 'agentic'
📁 Market AI generated ℹ️ The Next Web

GitLab: tagli al personale e uscita da 22 Paesi per l'era 'agentic'

GitLab ha annunciato una significativa ristrutturazione che prevede il taglio del 14% della forza lavoro e l'uscita da 22 mercati. La decisione, motivata dall'esigenza di riallineare la struttura operativa per affrontare la cosiddetta 'era agentic', arriva nonostante una crescita del 23% dei ricavi nel primo trimestre dell'anno fiscale 2027, superando le aspettative di Wall Street.

2026-06-03 📰 Fonte
Il regolatore UK impone a Google un opt-out per l'addestramento AI sui dati dei publisher
📁 Altro AI generated ℹ️ The Next Web

Il regolatore UK impone a Google un opt-out per l'addestramento AI sui dati dei publisher

L'autorità britannica per la concorrenza (CMA) ha imposto nuove regole a Google, riconoscendone lo status di mercato strategico. Tra le disposizioni spicca un "AI-training opt-out" che consente ai publisher di negare l'uso dei propri contenuti per l'addestramento di modelli AI. Questa mossa sottolinea l'importanza della sovranità dei dati e del controllo sui contenuti nell'era dell'intelligenza artificiale.

2026-06-03 📰 Fonte
OpenAI valuta alternative a CUDA per l'infrastruttura AI
📁 Altro AI generated ✅ DigiTimes

OpenAI valuta alternative a CUDA per l'infrastruttura AI

OpenAI sta esplorando attivamente soluzioni software e hardware per ridurre la dipendenza dall'ecosistema CUDA di Nvidia. Questa mossa mira a diversificare l'infrastruttura AI, potenzialmente abbassando i costi e aumentando il controllo sulle operazioni, un aspetto cruciale per chi valuta deployment on-premise e la sovranità dei dati.

2026-06-03 📰 Fonte
xMEMS punta al 2027 per i chip di raffreddamento: un futuro più fresco per AI e SSD
📁 Hardware AI generated ✅ DigiTimes

xMEMS punta al 2027 per i chip di raffreddamento: un futuro più fresco per AI e SSD

Durante Computex 2026, xMEMS ha presentato la sua tecnicia µCooling, promettendo una soluzione ai limiti termici di dispositivi come occhiali AI e SSD. Mike Housholder, VP dell'azienda, ha indicato il 2027 come anno di debutto. Questa innovazione potrebbe sbloccare nuove possibilità per l'hardware AI compatto e ad alte prestazioni, affrontando una sfida cruciale per l'adozione di soluzioni on-premise e edge, dove la gestione del calore è spesso un fattore limitante per l'integrazione di componenti potenti.

2026-06-03 📰 Fonte
Nvidia accelera la produzione di "Vera Rubin"; Quanta espande negli USA
📁 Market AI generated ✅ DigiTimes

Nvidia accelera la produzione di "Vera Rubin"; Quanta espande negli USA

Nvidia intensifica la produzione del progetto "Vera Rubin", un'iniziativa che potrebbe influenzare la disponibilità di hardware critico per l'AI. Parallelamente, Quanta Computer ha annunciato l'apertura di tre nuovi stabilimenti negli Stati Uniti entro la fine del 2026, segnalando un'espansione significativa della capacità produttiva. Questi sviluppi evidenziano le dinamiche della supply chain nel settore tecnicico, con potenziali impatti sui deployment on-premise e sull'approvvigionamento di componenti essenziali.

2026-06-03 📰 Fonte
GlobalFoundries acquisisce ARC di Synopsys: una spinta all'AI fisica
📁 Hardware AI generated ✅ DigiTimes

GlobalFoundries acquisisce ARC di Synopsys: una spinta all'AI fisica

GlobalFoundries ha completato l'acquisizione del business IP dei processori ARC di Synopsys. Questa mossa strategica mira a rafforzare la capacità dell'azienda di sviluppare piattaforme AI fisiche, con implicazioni significative per l'elaborazione dell'intelligenza artificiale a livello hardware. L'operazione sottolinea l'importanza crescente di soluzioni AI ottimizzate per l'edge e per deployment on-premise, dove il controllo diretto sull'hardware e la sovranità dei dati sono prioritari.

2026-06-03 📰 Fonte
Upstream lancia l'inbox AI-native: collaborazione tra umani e agenti con $3M di funding
📁 Market AI generated ℹ️ Tech.eu

Upstream lancia l'inbox AI-native: collaborazione tra umani e agenti con $3M di funding

La startup parigina Upstream ha annunciato il rilascio generale della sua piattaforma di posta elettronica AI-native, raccogliendo 3 milioni di dollari in un round pre-seed. La soluzione reinventa l'inbox per la collaborazione tra utenti e agenti AI, che possono leggere, scrivere e agire per conto dell'utente. Upstream enfatizza il controllo utente e la privacy, assicurando che i modelli AI non vengano addestrati sui dati dei clienti.

2026-06-03 📰 Fonte
ChatGPT: un miliardo di utenti mensili in tre anni, un record per le app
📁 Market AI generated ℹ️ The Next Web

ChatGPT: un miliardo di utenti mensili in tre anni, un record per le app

ChatGPT, l'applicazione di OpenAI, ha superato il miliardo di utenti attivi mensili globali a maggio, circa tre anni dopo il suo lancio. Secondo le stime di Sensor Tower, questo traguardo la rende l'applicazione più rapida nella storia a raggiungere tale volume di utenza. Il dato sottolinea la rapida adozione dei Large Language Models e le implicazioni per l'infrastruttura IT aziendale.

2026-06-03 📰 Fonte
Lightmatter e Nvidia: connettività ottica per l'AI nell'ecosistema NVLink Fusion
📁 Hardware AI generated ✅ DigiTimes

Lightmatter e Nvidia: connettività ottica per l'AI nell'ecosistema NVLink Fusion

Lightmatter ha annunciato la sua adesione all'ecosistema Nvidia NVLink Fusion, un passo significativo per l'espansione della connettività ottica nell'ambito dell'intelligenza artificiale. Questa collaborazione mira a migliorare le capacità di interconnessione per i carichi di lavoro AI, offrendo soluzioni che possono impattare l'efficienza e la scalabilità dei deployment on-premise, un aspetto cruciale per le aziende che cercano controllo e sovranità sui propri dati e infrastrutture.

2026-06-03 📰 Fonte
Factorial raccoglie 150 milioni di dollari per l'espansione AI in Europa
📁 Market AI generated ℹ️ Tech.eu

Factorial raccoglie 150 milioni di dollari per l'espansione AI in Europa

Factorial, azienda di software per la gestione della forza lavoro con sede a Barcellona, ha chiuso un round di finanziamento Series D da 150 milioni di dollari, raggiungendo una valutazione di 2,5 miliardi. Guidato da General Catalyst, l'investimento, che include un impegno aggiuntivo di 540 milioni, supporterà l'espansione europea e lo sviluppo di una piattaforma "AI-first" con agenti intelligenti per HR, finanza e IT, segnando una transizione strategica per l'azienda.

2026-06-03 📰 Fonte
Quobly ottiene 115 milioni di euro per i computer quantistici su silicio e il deployment industriale
📁 Hardware AI generated ℹ️ Tech.eu

Quobly ottiene 115 milioni di euro per i computer quantistici su silicio e il deployment industriale

Quobly, azienda francese specializzata in computer quantistici basati su silicio, ha chiuso un round di finanziamento Series A da 115 milioni di euro. L'investimento mira ad accelerare l'industrializzazione della sua tecnicia FD-SOI e il lancio dei primi sistemi commerciali. Il primo prodotto, Alloy Pioneer, sarà disponibile via cloud nel 2026 e successivamente integrato in ambienti HPC e data center esistenti, sottolineando un approccio al deployment scalabile e compatibile con le infrastrutture attuali.

2026-06-03 📰 Fonte
Mellum e Granite: Nuovi Embedding Models su llama.cpp per Deployment Locali
📁 Frameworks AI generated ℹ️ LocalLLaMA

Mellum e Granite: Nuovi Embedding Models su llama.cpp per Deployment Locali

Il framework `llama.cpp` ha annunciato il supporto per i modelli di embedding Mellum e Granite. Questa integrazione estende le capacità di `llama.cpp` per l'inference locale di modelli di linguaggio, offrendo nuove opportunità per architetture RAG e applicazioni di ricerca semantica on-premise. La mossa rafforza l'approccio self-hosted per le aziende che cercano maggiore controllo e sovranità sui propri dati AI.

2026-06-03 📰 Fonte
Holo3.1: VLM per Agenti Locali, dalla Scrivania al Mobile
📁 LLM AI generated ℹ️ LocalLLaMA

Holo3.1: VLM per Agenti Locali, dalla Scrivania al Mobile

Hcompany ha rilasciato Holo3.1, una famiglia di Vision-Language Models (VLM) progettati per agenti di automazione. Questi modelli, basati su Qwen 3.5 e disponibili in diverse dimensioni, supportano il deployment locale grazie a checkpoint quantizzati ottimizzati. Holo3.1 estende l'automazione a web, desktop e mobile, integrando il function-calling nativo per una maggiore flessibilità e efficienza dei costi nei deployment on-premise.

2026-06-03 📰 Fonte
llama.cpp: Nuovi Benchmark su Doppia RTX 3090 Ridisegnano le Performance On-Premise
📁 Frameworks AI generated ℹ️ LocalLLaMA

llama.cpp: Nuovi Benchmark su Doppia RTX 3090 Ridisegnano le Performance On-Premise

Un recente test di llama.cpp con la build b9455b e funzionalità di tensor-split su una configurazione duale di NVIDIA RTX 3090 ha mostrato un significativo incremento delle performance. Il framework raggiunge ora oltre 70 token/secondo per la generazione, e fino a 1400 token/secondo in prefill, eguagliando o superando soluzioni alternative per modelli come Qwen3.6-27B-UD-Q8_K_XL, con un'attenzione particolare alla qualità dell'output e alla gestione di contesti estesi.

2026-06-03 📰 Fonte
Nvidia e Infineon: il co-design nella supply chain per l'efficienza energetica AI
📁 Market AI generated ✅ DigiTimes

Nvidia e Infineon: il co-design nella supply chain per l'efficienza energetica AI

Nvidia e Infineon stanno intensificando la collaborazione per ottimizzare la supply chain, affrontando i crescenti limiti di potenza nell'AI. L'obiettivo è migliorare l'efficienza energetica dei sistemi, un fattore cruciale per i deployment on-premise e la riduzione del TCO in un'era di domanda computazionale sempre maggiore.

2026-06-03 📰 Fonte
La domanda di sistemi di raffreddamento per l'AI in forte crescita fino al 2029
📁 Altro AI generated ✅ DigiTimes

La domanda di sistemi di raffreddamento per l'AI in forte crescita fino al 2029

Il mercato dei sistemi di raffreddamento per l'intelligenza artificiale sta vivendo un'espansione significativa, con previsioni di crescita sostenuta fino al 2029. Questa tendenza riflette l'aumento della potenza di calcolo richiesta dai Large Language Models e dai carichi di lavoro AI, ponendo nuove sfide infrastrutturali per i deployment on-premise e ibridi in termini di gestione termica ed efficienza energetica.

2026-06-03 📰 Fonte
Microsoft lancia Aion: LLM on-device per efficienza e ragionamento locale
📁 LLM AI generated ℹ️ LocalLLaMA

Microsoft lancia Aion: LLM on-device per efficienza e ragionamento locale

Microsoft ha presentato Aion 1.0 Instruct e Aion 1.0 Plan, due nuovi LLM progettati per carichi di lavoro on-device. Aion 1.0 Instruct è un Small Language Model con pesi aperti per intelligenza testuale quotidiana, mentre Aion 1.0 Plan, con 14 miliardi di parametri e 32K di contesto, abilita workflow agentici e tool-calling direttamente sui dispositivi Windows compatibili, enfatizzando il controllo locale e la sovranità dei dati.

2026-06-03 📰 Fonte
L'Esponente di Curvatura nei Loss Landscape delle Reti Neurali: Implicazioni per l'AI
📁 LLM AI generated 🏆 ArXiv cs.LG

L'Esponente di Curvatura nei Loss Landscape delle Reti Neurali: Implicazioni per l'AI

Una ricerca approfondisce l'esponente di curvatura nei loss landscape delle reti neurali, un parametro che descrive la relazione tra gli autovalori dell'Hessiana e i valori singolari del gradiente. La sua variazione tra strati convoluzionali e di attenzione nei Transformer suggerisce nuove vie per ottimizzare i processi di training. Comprendere queste dinamiche è cruciale per migliorare l'efficienza e ridurre il TCO nei deployment AI on-premise, influenzando la scelta delle architetture e l'utilizzo dell'hardware.

2026-06-03 📰 Fonte
LSTM batte Transformer encoder-only nella previsione idrologica per bacini non monitorati
📁 Frameworks AI generated 🏆 ArXiv cs.AI

LSTM batte Transformer encoder-only nella previsione idrologica per bacini non monitorati

Uno studio ha confrontato le architetture Transformer (encoder-only) e LSTM per l'inference del flusso idrico in bacini non monitorati, utilizzando simulazioni del NOAA National Water Model. I risultati indicano che l'LSTM ha mostrato prestazioni complessivamente superiori rispetto al Transformer per la ricostruzione a monte. L'integrazione di informazioni a valle ha migliorato significativamente le capacità predittive di entrambi i modelli, evidenziando l'importanza del contesto idrologico per l'efficienza dei Framework AI.

2026-06-03 📰 Fonte
LLM e sostenibilità: più "verdi" degli umani, ma con riserve
📁 LLM AI generated 🏆 ArXiv cs.CL

LLM e sostenibilità: più "verdi" degli umani, ma con riserve

Uno studio ha analizzato le "attitudini ambientali" di 31 Large Language Models, proprietari e open-weight, confrontandole con quelle umane. I risultati indicano che molti LLM mostrano un allineamento più progressista verso la sostenibilità, suggerendo comportamenti con potenziale di riduzione di CO2. Tuttavia, la ricerca evidenzia anche una sensibilità contestuale e una tendenza alla "sycophancy" (compiacenza) che sollevano interrogativi sulla loro affidabilità normativa nei deployment reali, sottolineando l'importanza di governance e trasparenza.

2026-06-03 📰 Fonte
IdiomX: Un Nuovo Benchmark Multilingue per la Comprensione degli Idiomi nei LLM
📁 LLM AI generated 🏆 ArXiv cs.CL

IdiomX: Un Nuovo Benchmark Multilingue per la Comprensione degli Idiomi nei LLM

IdiomX è un benchmark multilingue su larga scala progettato per migliorare la comprensione, il recupero e l'interpretazione delle espressioni idiomatiche da parte dei Large Language Models. Il dataset include oltre 190.000 esempi contestualizzati e più di 12.000 idiomi, con rappresentazioni semantiche allineate in inglese, arabo e francese. Questo strumento affronta le sfide legate alla natura non composizionale degli idiomi, offrendo un framework modulare per valutare e potenziare le capacità dei modelli linguistici moderni in contesti multilingue.

2026-06-03 📰 Fonte
BCI: Architetture Leggere per la Robustezza contro Attacchi Avversari
📁 Altro AI generated 🏆 ArXiv cs.LG

BCI: Architetture Leggere per la Robustezza contro Attacchi Avversari

La ricerca sulle interfacce cervello-computer (BCI) basate su EEG ha trascurato la sicurezza, rendendole vulnerabili agli attacchi avversari. Un nuovo studio propone un'architettura CNN leggera che migliora significativamente la robustezza di questi sistemi. Testata contro modelli esistenti, la soluzione ha dimostrato maggiore resistenza alle perturbazioni, evidenziando il potenziale delle architetture leggere per deployment affidabili e sicuri, specialmente in contesti on-premise dove la sovranità dei dati è cruciale.

2026-06-03 📰 Fonte
LLM: i grafici visivi come impalcatura interna per un ragionamento più efficace
📁 LLM AI generated 🏆 ArXiv cs.AI

LLM: i grafici visivi come impalcatura interna per un ragionamento più efficace

Una nuova ricerca esplora il potenziale dei grafici non solo come fonti di conoscenza esterne, ma come strumenti interni per organizzare il ragionamento degli LLM. Gli esperimenti su compiti di risposta a domande multi-hop rivelano un "modality gap": la guida visiva tramite grafici supera nettamente l'approccio testuale, migliorando l'efficienza e la qualità del ragionamento. Questo suggerisce un nuovo paradigma per lo sviluppo di LLM più robusti e autonomi.

2026-06-03 📰 Fonte
L'ambizione europea per una 'gigafactory' AI da 20 miliardi di euro rallenta
📁 Market AI generated ✅ DigiTimes

L'ambizione europea per una 'gigafactory' AI da 20 miliardi di euro rallenta

L'Unione Europea mira a creare una "gigafactory" per l'intelligenza artificiale con un investimento di 20 miliardi di euro, ma il progetto sta affrontando ritardi significativi. Questa situazione solleva preoccupazioni sulla capacità del continente di competere con i progressi rapidi dei rivali globali nel settore dell'AI, in particolare per quanto riguarda l'infrastruttura di calcolo e lo sviluppo di Large Language Models. La sfida è mantenere il passo in un mercato in rapida evoluzione.

2026-06-03 📰 Fonte
SK Group e Foxconn: colloqui per rafforzare la filiera AI tra Taiwan e Corea
📁 Market AI generated ✅ DigiTimes

SK Group e Foxconn: colloqui per rafforzare la filiera AI tra Taiwan e Corea

SK Group e Foxconn hanno avviato colloqui esclusivi che potrebbero portare a un rafforzamento dei legami nella filiera dell'intelligenza artificiale tra Taiwan e Corea del Sud. Questa potenziale collaborazione è cruciale per la stabilità e l'efficienza della produzione di componenti hardware essenziali per i deployment di Large Language Models (LLM) on-premise, influenzando direttamente il TCO e la sovranità dei dati per le aziende.

2026-06-03 📰 Fonte
La corsa all'AI ridefinisce il settore dei semiconduttori: sfide e opportunità
📁 Market AI generated ✅ DigiTimes

La corsa all'AI ridefinisce il settore dei semiconduttori: sfide e opportunità

L'accelerazione della corsa all'intelligenza artificiale sta profondamente trasformando l'industria dei semiconduttori, come evidenziato in eventi chiave come il Computex. Questa evoluzione impone nuove sfide e opportunità per le aziende che valutano deployment on-premise di Large Language Models, richiedendo investimenti strategici in hardware specializzato e un'attenta analisi del TCO per garantire sovranità dei dati e controllo infrastrutturale.

2026-06-03 📰 Fonte
Giganti Tech e Taiwan: Stabilità Cruciale per la Supply Chain AI
📁 Market AI generated ✅ DigiTimes

Giganti Tech e Taiwan: Stabilità Cruciale per la Supply Chain AI

Le maggiori aziende tecniciche stanno intensificando gli investimenti a Taiwan, mentre il governo locale promette stabilità per la supply chain. Questo scenario è fondamentale per il settore dell'intelligenza artificiale, in particolare per le infrastrutture on-premise che dipendono dall'accesso a silicio avanzato e componenti hardware critici per lo sviluppo e il deployment di Large Language Models. La continuità nella produzione di semiconduttori è un fattore chiave per la pianificazione e il Total Cost of Ownership (TCO) delle soluzioni self-hosted.

2026-06-03 📰 Fonte
Microsoft e la roadmap AI: agenti intelligenti e sfide di deployment per il 2026
📁 Altro AI generated ✅ DigiTimes

Microsoft e la roadmap AI: agenti intelligenti e sfide di deployment per il 2026

Microsoft ha delineato la sua visione per il futuro dell'AI a Build 2026, focalizzandosi sullo sviluppo, l'esecuzione e la governance di "agenti" intelligenti su Azure. Questa strategia evidenzia la crescente complessità dei carichi di lavoro AI, spingendo le aziende a valutare attentamente le implicazioni infrastrutturali, dalla sovranità dei dati al Total Cost of Ownership (TCO), sia in cloud che in ambienti self-hosted.

2026-06-03 📰 Fonte
Naura introduce il primo strumento da 600mm per il packaging di chip AI
📁 Hardware AI generated ✅ DigiTimes

Naura introduce il primo strumento da 600mm per il packaging di chip AI

Naura, azienda attiva nel settore dei semiconduttori, ha annunciato il suo primo strumento per il processo di "descum" nel packaging di chip AI. Il nuovo macchinario, progettato per il Panel Level Packaging (PLP) su pannelli da 600mm, segna un'espansione delle capacità produttive per i componenti fondamentali dell'intelligenza artificiale. Questa innovazione potrebbe influenzare la supply chain e la disponibilità di hardware per l'AI.

2026-06-03 📰 Fonte
COMPUTEX: L'India punta alla supply chain elettronica di Taiwan per l'hardware AI
📁 Market AI generated ✅ DigiTimes

COMPUTEX: L'India punta alla supply chain elettronica di Taiwan per l'hardware AI

Durante COMPUTEX, diversi stati indiani hanno promosso attivamente le proprie regioni come destinazioni per i produttori di elettronica taiwanesi. L'iniziativa mira a incentivare il trasferimento di capacità produttive, un movimento strategico che potrebbe ridisegnare le supply chain globali. Per le aziende che valutano deployment on-premise di infrastrutture AI, la diversificazione delle fonti di hardware e la resilienza della catena di approvvigionamento diventano fattori critici nella pianificazione del TCO e della sovranità tecnicica.

2026-06-03 📰 Fonte
Delta Electronics presenta un data center modulare per AI che riduce i tempi di deployment
📁 Altro AI generated ✅ DigiTimes

Delta Electronics presenta un data center modulare per AI che riduce i tempi di deployment

Delta Electronics ha introdotto un data center modulare prefabbricato specificamente progettato per carichi di lavoro AI. Questa soluzione mira a semplificare e accelerare il deployment di infrastrutture dedicate, promettendo una riduzione dei tempi di installazione fino al 60%. L'iniziativa risponde alla crescente domanda di infrastrutture agili e scalabili per l'intelligenza artificiale, con un focus sui benefici per le aziende che cercano soluzioni self-hosted per la gestione dei Large Language Models e l'inference AI.

2026-06-03 📰 Fonte
Largan e l'ottica co-packaged: il futuro dei data center AI on-premise
📁 Hardware AI generated ✅ DigiTimes

Largan e l'ottica co-packaged: il futuro dei data center AI on-premise

Largan, azienda leader nel settore ottico, ha debuttato a Computex presentando le sue soluzioni CPO (Co-Packaged Optics). L'iniziativa mira a rispondere alla crescente domanda di interconnessioni ad alta velocità e bassa latenza nei data center dedicati all'intelligenza artificiale, con un focus particolare sulle infrastrutture on-premise. Questa mossa sottolinea l'importanza dell'ottica avanzata per l'efficienza e la scalabilità dei carichi di lavoro di Large Language Models (LLM).

2026-06-03 📰 Fonte
Anomalia nelle risposte di Qwen3.6-27B su server locale con llama-server
📁 Altro AI generated ℹ️ LocalLLaMA

Anomalia nelle risposte di Qwen3.6-27B su server locale con llama-server

Un utente segnala un comportamento inatteso con il modello Qwen3.6-27B, impiegato per il coding AI tramite OpenCode su un server locale. Le risposte del Large Language Model si interrompono improvvisamente durante il processo di ragionamento, senza messaggi di errore. La ripresa dell'output richiede un comando manuale "continue", suggerendo un'interruzione non legata a crash del server. Questo solleva interrogativi sulla stabilità dei deployment on-premise di LLM e sulla gestione delle sessioni.

2026-06-03 📰 Fonte
COMPUTEX 2026: AI Spaziale per la Casa e Soluzioni Edge per l'Impresa
📁 Altro AI generated ✅ DigiTimes

COMPUTEX 2026: AI Spaziale per la Casa e Soluzioni Edge per l'Impresa

COMPUTEX 2026 ha messo in luce l'evoluzione dell'intelligenza artificiale, focalizzandosi sull'AI spaziale per ambienti domestici e sulle soluzioni edge “chiavi in mano” per le aziende. Questi sviluppi sottolineano la crescente necessità di elaborazione locale e di deployment on-premise, cruciali per la sovranità dei dati, la riduzione della latenza e l'ottimizzazione del TCO in scenari di inference AI distribuiti.

2026-06-03 📰 Fonte
← Precedente Page 67 / 123 Successiva →
Vedi Archivio Completo 🗄️

AI-Radar is an independent observatory covering AI models, local LLMs, on-premise deployments, hardware, and emerging trends. We provide daily analysis and editorial coverage for developers, engineers, and organizations exploring local AI solutions.

AI-RADAR badge LaunchTry LAUNCHING SOON ON LaunchTry Fazier badge