AI-Radar - Osservatorio su LLM locali, hardware AI e trend

AI-Radar per LLM on-prem & AI in casa

Il radar quotidiano su modelli, framework e hardware per far girare l'AI in locale. LLM, LangChain, Chroma, mini-PC e tutto ciò che serve per un cervello distribuito "in-house".

⚙️ Stack: LLM locali · LangChain · Transformers · ChromaDB · MiniPC · AI boxes
🛰️ Ask Observatory (Q&A + RAG) già collegato all'archivio articoli.
👥 160+ membri · Iscriviti gratis →

⚡ In Tendenza

View All →

🛠️ Guide & Osservatorio On-Premise

🚀 Esegui i modelli in locale → Tutte le guide →

Riferimenti evergreen e pratici per far girare l'AI in locale — hardware, costi, privacy e stack completo.

🖥️ Osservatorio LLM On-Premise Hardware, stack, governance e architetture di riferimento per l'AI in locale.

Ultime analisi & news dal radar

Articoli generati dall'AI sulla base dei feed, con spazio per layer editoriale umano sopra il contenuto grezzo.

Unsloth: disponibili i modelli Gemma 4 QAT MTP per l'inference locale
📁 LLM AI generated ℹ️ LocalLLaMA

Unsloth: disponibili i modelli Gemma 4 QAT MTP per l'inference locale

Unsloth ha annunciato la disponibilità di nuovi modelli assistente basati sull'architettura Gemma 4 di Google, ottimizzati tramite Quantization-Aware Training (QAT). Questi LLM, distribuiti nel formato GGUF, sono offerti in diverse quantizzazioni, inclusa la `q8_0`, e in varie dimensioni. Questa release è strategica per i deployment on-premise, consentendo un'inference efficiente su hardware con risorse limitate e supportando scenari che richiedono sovranità dei dati e controllo sul TCO.

2026-06-09 📰 Fonte
Commissione UE impone a Meta di aprire WhatsApp agli assistenti AI rivali
📁 Market AI generated ℹ️ The Next Web

Commissione UE impone a Meta di aprire WhatsApp agli assistenti AI rivali

La Commissione Europea ha emesso un ordine provvisorio che impone a Meta di garantire l'accesso agli assistenti AI di terze parti su WhatsApp entro cinque giorni lavorativi. La decisione mira a salvaguardare la concorrenza nel mercato degli assistenti AI, prevenendo danni "gravi e irreparabili". Meta ha annunciato l'intenzione di ricorrere in appello contro il provvedimento.

2026-06-09 📰 Fonte
Paesi Bassi: screening investimenti esteri in AI dal 2027 per la sicurezza nazionale
📁 Altro AI generated ℹ️ The Next Web

Paesi Bassi: screening investimenti esteri in AI dal 2027 per la sicurezza nazionale

Il governo olandese estenderà il proprio regime di screening degli investimenti per includere l'intelligenza artificiale e altre cinque tecnicie strategiche a partire dal 1° gennaio 2027. La misura, che interesserà centinaia di aziende, mira a rafforzare la sicurezza nazionale contro operazioni cibernetiche, spionaggio e sabotaggio. La decisione, annunciata dalla Ministra dell'Economia Heleen Herbert, sottolinea la crescente attenzione alla sovranità tecnicica e al controllo delle infrastrutture critiche.

2026-06-09 📰 Fonte
Non più FAANG: l'era MANGOS ridefinisce il panorama tech
📁 Market AI generated ✅ TechCrunch AI

Non più FAANG: l'era MANGOS ridefinisce il panorama tech

Il settore tecnicico è in fermento, con SpaceX, Anthropic e OpenAI pronte a fare il loro ingresso in borsa. Questo scenario potrebbe segnare la fine dell'era FAANG, introducendo un nuovo acronimo, MANGOS, per identificare i giganti che plasmeranno il futuro dell'innovazione. La transizione riflette un'evoluzione delle dinamiche di mercato e delle tecnicie emergenti, in particolare nel campo dell'intelligenza artificiale e dell'esplorazione spaziale.

2026-06-09 📰 Fonte
Taiwan valuta il divieto penale sull'export di chip AI verso la Cina
📁 Altro AI generated ℹ️ Tom's Hardware

Taiwan valuta il divieto penale sull'export di chip AI verso la Cina

Taiwan sta valutando l'introduzione di misure più severe per limitare l'esportazione di chip AI verso la Cina, estendendo i divieti oltre le attuali liste nere. La proposta renderebbe un reato penale il contrabbando di server contenenti questi componenti, con implicazioni significative per la catena di approvvigionamento globale e per le strategie di deployment on-premise di Large Language Models, influenzando il TCO e la sovranità dei dati.

2026-06-09 📰 Fonte
Klarna lancia conti di risparmio ad alto rendimento negli USA: APY al 3,28%
📁 Market AI generated ℹ️ The Next Web

Klarna lancia conti di risparmio ad alto rendimento negli USA: APY al 3,28%

Klarna, la società nota per i servizi "buy now, pay later", ha introdotto conti di risparmio ad alto rendimento negli Stati Uniti. Con un APY iniziale del 3,28%, questi conti sono assicurati dalla FDIC tramite WebBank. L'iniziativa mira a integrare i servizi di risparmio per i clienti esistenti, segnando un passo significativo nell'ambizione di Klarna di espandere la propria offerta bancaria e differenziarsi nel panorama finanziario digitale.

2026-06-09 📰 Fonte
AI1: Il Data Center Orbitale di Musk con Payload da 120 kW e Chip Intercambiabili
📁 Hardware AI generated ℹ️ Tom's Hardware

AI1: Il Data Center Orbitale di Musk con Payload da 120 kW e Chip Intercambiabili

Elon Musk ha svelato i dettagli del suo primo data center orbitale, l'AI1 Satellite. Questa piattaforma, più ampia di un Boeing 747, è progettata per ospitare un payload di calcolo da 120 kW, con picchi fino a 150 kW, e integra un sistema di chip intercambiabili. L'iniziativa segna un passo verso l'elaborazione dati avanzata nello spazio, offrendo nuove prospettive per carichi di lavoro AI e LLM.

2026-06-09 📰 Fonte
Anthropic: Mythos è un rischio pubblico, ma l'accesso si estende a 200 organizzazioni
📁 LLM AI generated ℹ️ The Next Web

Anthropic: Mythos è un rischio pubblico, ma l'accesso si estende a 200 organizzazioni

Anthropic ha dichiarato che il suo modello Mythos è troppo efficace nel trovare vulnerabilità software per essere rilasciato pubblicamente, temendo che possa essere usato per attacchi a infrastrutture critiche o furti di dati. Nonostante ciò, l'azienda ha deliberatamente esteso l'accesso a 150 nuove organizzazioni, portando il totale a circa 200 in 15 paesi. Questa strategia mira a bilanciare il potenziale rischio con la necessità di ricerca e sviluppo controllato.

2026-06-09 📰 Fonte
V100 a slot singolo e mezza altezza con NVLink: nuove opzioni per l'on-premise
📁 Hardware AI generated ℹ️ LocalLLaMA

V100 a slot singolo e mezza altezza con NVLink: nuove opzioni per l'on-premise

In Cina sono emerse schede NVIDIA V100 personalizzate, caratterizzate da un design a slot singolo e mezza altezza con NVLink. Queste GPU, disponibili in versioni da 16GB e 32GB VRAM, offrono piena performance con opzioni di alimentazione flessibili (75W o 300W). Con un prezzo stimato inferiore a 220 dollari, rappresentano una soluzione interessante per deployment on-premise compatti e a basso costo, specialmente per carichi di lavoro di inference LLM.

2026-06-09 📰 Fonte
SpaceX svela Gigasat: una fabbrica da 1 GW/anno per l'AI satellitare entro il 2027
📁 Altro AI generated ℹ️ Tom's Hardware

SpaceX svela Gigasat: una fabbrica da 1 GW/anno per l'AI satellitare entro il 2027

SpaceX ha annunciato la costruzione della fabbrica Gigasat, un'imponente struttura di 11 milioni di piedi quadrati dedicata alla produzione di data center spaziali. L'obiettivo è generare 1 GW di potenza di calcolo AI all'anno dai suoi satelliti entro la fine del 2027, segnando un'ambiziosa espansione nell'infrastruttura di calcolo per l'intelligenza artificiale con un focus sulla distribuzione nello spazio. Questa mossa solleva questioni cruciali su sovranità dei dati e TCO per i deployment AI.

2026-06-09 📰 Fonte
AMD investe fino a 2 miliardi di sterline per la ricerca AI nel Regno Unito
📁 Market AI generated ✅ DigiTimes

AMD investe fino a 2 miliardi di sterline per la ricerca AI nel Regno Unito

AMD ha annunciato un investimento significativo, fino a 2 miliardi di sterline, destinato ad accelerare la ricerca sull'intelligenza artificiale nel Regno Unito. Questa mossa sottolinea l'importanza strategica di sviluppare capacità AI avanzate a livello locale, con potenziali ricadute sull'infrastruttura hardware e sui modelli di deployment on-premise per le aziende che operano nel paese. L'iniziativa mira a rafforzare la posizione del Regno Unito nel panorama globale dell'AI.

2026-06-09 📰 Fonte
OpenAI verso la quotazione: deposito confidenziale alla SEC
📁 Market AI generated ✅ DigiTimes

OpenAI verso la quotazione: deposito confidenziale alla SEC

OpenAI ha avviato il processo per la sua offerta pubblica iniziale (IPO) con un deposito riservato presso la Securities and Exchange Commission (SEC) statunitense. Questa mossa segna un passo significativo per l'azienda leader nell'intelligenza artificiale generativa, con potenziali ripercussioni sul panorama competitivo e sulle strategie di adozione dell'AI da parte delle imprese, che dovranno valutare attentamente le opzioni di deployment on-premise e cloud.

2026-06-09 📰 Fonte
Nvidia e SK Hynix: un'alleanza che ridefinisce la corsa alle memorie per l'AI
📁 Market AI generated ✅ DigiTimes

Nvidia e SK Hynix: un'alleanza che ridefinisce la corsa alle memorie per l'AI

L'accordo tra Nvidia e SK Hynix intensifica la competizione nel mercato delle memorie ad alte prestazioni, essenziali per i carichi di lavoro AI e LLM. Questa mossa mette sotto pressione giganti come Samsung e Micron, evidenziando la crescente domanda di soluzioni di memoria avanzate per l'inference e il training on-premise. L'alleanza potrebbe influenzare la disponibilità e il TCO per le infrastrutture AI self-hosted.

2026-06-09 📰 Fonte
Tencent e la strategia duale per i chip AI: Canghai V2 e partnership locali
📁 Hardware AI generated ✅ DigiTimes

Tencent e la strategia duale per i chip AI: Canghai V2 e partnership locali

Tencent sta adottando un approccio "dual-track" per lo sviluppo dei suoi chip AI, combinando il processore proprietario Canghai V2 con partnership strategiche a livello nazionale. Questa strategia mira a rafforzare il controllo sulla catena di fornitura e a ottimizzare le prestazioni per i carichi di lavoro di intelligenza artificiale, riflettendo una crescente enfasi sulla sovranità tecnicica e sull'efficienza operativa per i deployment su larga scala.

2026-06-09 📰 Fonte
Anthropic si Assicura un Finanziamento da 35 Miliardi di Dollari per la Capacità TPU
📁 Market AI generated ✅ DigiTimes

Anthropic si Assicura un Finanziamento da 35 Miliardi di Dollari per la Capacità TPU

Anthropic ha ottenuto un pacchetto di prestiti privati da 35 miliardi di dollari, supportato da Broadcom, per assicurarsi capacità di Tensor Processing Units (TPU). Questo finanziamento evidenzia la crescente necessità di accesso a risorse di calcolo specializzate per lo sviluppo e il deployment di Large Language Models (LLM), sottolineando la corsa all'infrastruttura AI e le implicazioni per le strategie di deployment.

2026-06-09 📰 Fonte
L'infrastruttura AI: Delta e Liteon per alimentazione e stabilità dei carichi
📁 Altro AI generated ✅ DigiTimes

L'infrastruttura AI: Delta e Liteon per alimentazione e stabilità dei carichi

Delta e Liteon si concentrano sulle esigenze critiche di alimentazione e stabilità dei carichi di lavoro AI. Con la crescente adozione di Large Language Models (LLM) e carichi computazionali intensivi, garantire un'infrastruttura energetica robusta e affidabile diventa fondamentale, specialmente per i deployment on-premise. Le soluzioni mirano a supportare l'efficienza e la resilienza dei sistemi AI.

2026-06-09 📰 Fonte
Nvidia e Hyundai rafforzano la partnership AI in robotica e mobilità
📁 Market AI generated ✅ DigiTimes

Nvidia e Hyundai rafforzano la partnership AI in robotica e mobilità

Nvidia e Hyundai hanno annunciato un'espansione della loro collaborazione strategica nel campo dell'intelligenza artificiale. L'accordo mira a potenziare lo sviluppo di soluzioni avanzate per la robotica e la mobilità, settori chiave che richiedono capacità di elaborazione AI sempre più sofisticate. Questa partnership sottolinea l'importanza dell'integrazione hardware-software per affrontare le sfide computazionali legate all'AI in contesti critici, con implicazioni significative per le strategie di deployment on-premise e edge.

2026-06-09 📰 Fonte
RISC-V: Prestazioni CPU Fino a 8x Superiori in Cinque Anni
📁 Hardware AI generated ✅ Phoronix

RISC-V: Prestazioni CPU Fino a 8x Superiori in Cinque Anni

Un'analisi recente evidenzia un notevole balzo in avanti nelle prestazioni delle CPU RISC-V, con miglioramenti fino a otto volte superiori nell'arco di cinque anni. Il confronto tra il nuovo SoC SpacemiT K3, un RISC-V RVA23 di prima generazione sul mercato, e la scheda SiFive HiFive Unmatched di cinque anni fa, rivela la rapida evoluzione dell'hardware RISC-V. Questo progresso apre nuove prospettive per i deployment on-premise e le soluzioni edge, offrendo alternative sempre più competitive.

2026-06-09 📰 Fonte
Onsemi lancia Elite Pairing Studio: ottimizzare la progettazione energetica per l'AI on-premise
📁 Altro AI generated ✅ DigiTimes

Onsemi lancia Elite Pairing Studio: ottimizzare la progettazione energetica per l'AI on-premise

Onsemi ha presentato Elite Pairing Studio, una nuova piattaforma software progettata per semplificare la complessa fase di progettazione dei sistemi di alimentazione. Questo strumento mira a migliorare l'efficienza e l'affidabilità delle soluzioni energetiche, un aspetto cruciale per le infrastrutture di calcolo ad alte prestazioni, in particolare per i carichi di lavoro AI e Large Language Models (LLM) che richiedono un'attenta gestione della potenza e del TCO nei deployment on-premise.

2026-06-09 📰 Fonte
Crisi di capacità TSMC: Google e Nvidia guardano a Intel per la produzione di chip
📁 Market AI generated ✅ DigiTimes

Crisi di capacità TSMC: Google e Nvidia guardano a Intel per la produzione di chip

Le limitazioni nella capacità produttiva di TSMC stanno spingendo giganti tecnicici come Google e Nvidia a esplorare alternative per la fabbricazione dei loro chip avanzati. Questo scenario posiziona Intel come un potenziale partner strategico, evidenziando le complesse dinamiche della supply chain dei semiconduttori e le sue implicazioni dirette per i futuri deployment di hardware AI, cruciali per le strategie on-premise e la sovranità dei dati.

2026-06-09 📰 Fonte
Nvidia a Computex: il consolidamento di un'egemonia nell'AI hardware
📁 Hardware AI generated ✅ DigiTimes

Nvidia a Computex: il consolidamento di un'egemonia nell'AI hardware

Computex ha ribadito la posizione dominante di Nvidia nel panorama dell'hardware per l'intelligenza artificiale. L'evento ha evidenziato come le soluzioni del gigante del silicio siano diventate un pilastro per lo sviluppo e il deployment di Large Language Models, influenzando profondamente le strategie di infrastruttura, specialmente per chi valuta opzioni self-hosted e la sovranità dei dati.

2026-06-09 📰 Fonte
Green SM di VinFast punta all'India: le sfide AI per il ride-hailing on-premise
📁 Altro AI generated ✅ DigiTimes

Green SM di VinFast punta all'India: le sfide AI per il ride-hailing on-premise

Green SM, sostenuta da VinFast, mira al mercato indiano del ride-hailing, espandendo la sua presenza oltre il Sud-Est asiatico. Questa mossa strategica solleva questioni cruciali per l'implementazione di soluzioni AI e Large Language Models (LLM) in un contesto di crescita rapida. L'analisi si concentra sulle implicazioni per la sovranità dei dati, i requisiti di performance e il Total Cost of Ownership (TCO) per le aziende che valutano deployment on-premise in settori ad alta intensità di dati.

2026-06-09 📰 Fonte
Alluminio Riciclato: SuperAlloy Ridisegna la Filiera dei Semiconduttori
📁 Hardware AI generated ✅ DigiTimes

Alluminio Riciclato: SuperAlloy Ridisegna la Filiera dei Semiconduttori

SuperAlloy sta focalizzando la propria strategia sulla filiera dei semiconduttori, promuovendo l'uso di alluminio riciclato. Questa iniziativa mira a integrare la sostenibilità in un settore chiave per l'innovazione tecnicica, rispondendo alla crescente domanda di resilienza nelle supply chain e di gestione responsabile delle risorse. L'adozione di materiali riciclati può influenzare positivamente il TCO e la stabilità dell'hardware per le infrastrutture AI on-premise.

2026-06-09 📰 Fonte
Chief Telecom prevede un secondo semestre più forte grazie alla domanda di data center AI
📁 Market AI generated ✅ DigiTimes

Chief Telecom prevede un secondo semestre più forte grazie alla domanda di data center AI

Chief Telecom anticipa una crescita significativa nella seconda metà dell'anno, trainata dall'incremento della domanda per i data center dedicati all'intelligenza artificiale. Questo trend riflette la crescente necessità di infrastrutture robuste per supportare i carichi di lavoro intensivi degli LLM e le applicazioni AI, spingendo le aziende a valutare attentamente le opzioni di deployment on-premise e cloud.

2026-06-09 📰 Fonte
Taiwan e l'AI: colmare il digital divide e spingere l'adozione nelle PMI
📁 Market AI generated ✅ DigiTimes

Taiwan e l'AI: colmare il digital divide e spingere l'adozione nelle PMI

Taiwan sta sfruttando il suo consolidato ecosistema tecnicico per affrontare il digital divide e accelerare l'adozione dell'intelligenza artificiale tra le Piccole e Medie Imprese (PMI). L'iniziativa mira a superare il 12% di adozione, evidenziando l'importanza di infrastrutture locali e soluzioni AI accessibili per favorire la competitività e la sovranità dei dati, temi centrali per chi valuta deployment on-premise.

2026-06-09 📰 Fonte
NoPo Nanotechnologies: l'India e la sfida dei materiali avanzati per i chip
📁 Market AI generated ✅ DigiTimes

NoPo Nanotechnologies: l'India e la sfida dei materiali avanzati per i chip

NoPo Nanotechnologies, azienda indiana guidata dal Co-Founder e CEO Gadhadar Reddy, si concentra sullo sviluppo di materiali avanzati per colmare una lacuna critica nella filiera di approvvigionamento dei chip. Questa iniziativa è fondamentale per rafforzare la resilienza della supply chain globale e supportare la produzione di hardware essenziale per i Large Language Models (LLM), con implicazioni dirette per la sovranità dei dati e i deployment on-premise.

2026-06-09 📰 Fonte
MedicalRec: Un sistema di raccomandazione per l'AI medica che riduce sprechi e consumi
📁 Altro AI generated 🏆 ArXiv cs.LG

MedicalRec: Un sistema di raccomandazione per l'AI medica che riduce sprechi e consumi

Un nuovo sistema, MedicalRec, mira a ottimizzare la selezione dei modelli per la classificazione di immagini mediche, riducendo il consumo energetico e gli sprechi computazionali. Basato su un dataset pubblico di oltre 5.000 record, il sistema offre un approccio più efficiente per l'adozione dell'AI in sanità, affrontando le sfide legate al TCO e all'impatto ambientale dei deployment on-premise.

2026-06-09 📰 Fonte
Pitchdrive chiude un fondo da 60 milioni per le startup AI europee
📁 Market AI generated ℹ️ Tech.eu

Pitchdrive chiude un fondo da 60 milioni per le startup AI europee

Pitchdrive, investitore europeo di venture capital pre-seed, ha annunciato la chiusura del suo quarto fondo, raggiungendo 60 milioni di euro e superando l'obiettivo iniziale. Il fondo, interamente sostenuto da investitori privati, si concentrerà su aziende AI-native e su quelle i cui modelli di business sono profondamente trasformati dall'intelligenza artificiale, in particolare nei settori software, robotica, mobilità e hardware. L'aumento della dimensione del fondo riflette la crescente necessità di infrastrutture di calcolo significative per le startup AI in rapida scalabilità.

2026-06-09 📰 Fonte
RL offline per il controllo del plasma nella fusione nucleare: un nuovo benchmark
📁 Frameworks AI generated 🏆 ArXiv cs.LG

RL offline per il controllo del plasma nella fusione nucleare: un nuovo benchmark

Un nuovo benchmark, RL4F, è stato introdotto per standardizzare lo sviluppo di controller di plasma basati su Offline Reinforcement Learning (RL) per la fusione nucleare. Affrontando i costi e i rischi delle sperimentazioni online, RL4F sfrutta dati storici del Tokamak DIII-D. Le valutazioni hanno mostrato che i metodi di RL offline basati su modelli offrono le migliori performance medie, sebbene nessun approccio prevalga su tutti i compiti. Il progetto è open source per stimolare la ricerca.

2026-06-09 📰 Fonte
OmniMem: Ottimizzare la Memoria per LLM Audio-Visivi a Lungo Raggio
📁 LLM AI generated 🏆 ArXiv cs.AI

OmniMem: Ottimizzare la Memoria per LLM Audio-Visivi a Lungo Raggio

OmniMem è un nuovo framework di streaming progettato per migliorare l'efficienza della memoria negli LLM audio-visivi. Affronta le limitazioni causate dalla crescita lineare dei token video e delle KV caches, introducendo una gestione della memoria consapevole della modalità e una selezione degli stati KV basata sulle perturbazioni. Questo approccio consente una compressione efficace senza compromettere la comprensione a lungo raggio, offrendo miglioramenti significativi in termini di accuratezza e rilevanza per i deployment on-premise.

2026-06-09 📰 Fonte
Zaro raccoglie 5,1 milioni di dollari per unificare l'AI aziendale
📁 Market AI generated ℹ️ Tech.eu

Zaro raccoglie 5,1 milioni di dollari per unificare l'AI aziendale

La startup londinese Zaro ha annunciato un finanziamento pre-seed da 5,1 milioni di dollari per sviluppare una piattaforma che mira a risolvere la frammentazione degli strumenti, dei workflow e dei dati AI nelle aziende. La soluzione di Zaro propone uno spazio di lavoro adattivo unificato, basato su un "shared context layer" e un approccio multi-modello. Quest'ultimo permette di ottimizzare i costi operativi, indirizzando i carichi di lavoro a modelli AI più efficienti in base alla complessità, un aspetto cruciale per le decisioni di deployment.

2026-06-09 📰 Fonte
PathoSage: Un Framework Agente per la Patologia Computazionale con Valutazione Strutturata dell'Evidenza
📁 Frameworks AI generated 🏆 ArXiv cs.AI

PathoSage: Un Framework Agente per la Patologia Computazionale con Valutazione Strutturata dell'Evidenza

PathoSage introduce un framework a tre stadi per la patologia computazionale, mirato a migliorare il ragionamento multimodale a livello di patch. Affronta le allucinazioni degli MLLM e i conflitti di evidenza nei sistemi agentici, separando recupero della conoscenza, raccolta e giudizio dell'evidenza. Il suo componente chiave, Structured Evidence Deliberation, valuta in modo indipendente le informazioni e analizza i conflitti, riducendo i bias. Il sistema include anche un meccanismo per modellare l'affidabilità degli strumenti.

2026-06-09 📰 Fonte
fonio.ai raccoglie 17 milioni di dollari per la sua piattaforma AI omnichannel
📁 Market AI generated ℹ️ Tech.eu

fonio.ai raccoglie 17 milioni di dollari per la sua piattaforma AI omnichannel

La startup europea fonio.ai ha chiuso un round di finanziamento seed da 17 milioni di dollari, raggiungendo una valutazione di 140 milioni. L'azienda sviluppa agenti AI per automatizzare le interazioni con i clienti, con un focus iniziale sulla comunicazione vocale. I nuovi capitali supporteranno l'espansione verso una piattaforma omnichannel e l'internazionalizzazione, offrendo soluzioni per la gestione autonoma delle richieste e la sovranità dei dati.

2026-06-09 📰 Fonte
ELAN: Droni e PC AI ridefiniscono il panorama dei ricavi aziendali
📁 Market AI generated ✅ DigiTimes

ELAN: Droni e PC AI ridefiniscono il panorama dei ricavi aziendali

ELAN Technology, un attore nel settore tecnicico, prevede un cambiamento significativo nella propria struttura di ricavi. L'azienda identifica la crescente domanda di droni e l'espansione del mercato dei PC dotati di funzionalità AI come i principali motori di questa trasformazione. Questo spostamento strategico riflette l'evoluzione del panorama tecnicico, dove l'intelligenza artificiale e le applicazioni autonome stanno diventando sempre più centrali, influenzando le strategie di business e le opportunità di mercato per i fornitori di componenti e soluzioni.

2026-06-09 📰 Fonte
COMPUTEX 2026: La corsa all'AI si sposta dalle GPU agli ecosistemi completi
📁 Market AI generated ✅ DigiTimes

COMPUTEX 2026: La corsa all'AI si sposta dalle GPU agli ecosistemi completi

Il COMPUTEX 2026 evidenzia un'evoluzione cruciale nel panorama dell'intelligenza artificiale: l'attenzione si sposta dalla mera potenza delle GPU all'integrazione di ecosistemi hardware e software. Questo cambiamento impone nuove considerazioni strategiche per le aziende che valutano deployment on-premise, enfatizzando il TCO e la sovranità dei dati.

2026-06-09 📰 Fonte
Violato Tchap, il messenger sovrano francese: disaccordo sull'entità della breccia
📁 Altro AI generated ℹ️ The Next Web

Violato Tchap, il messenger sovrano francese: disaccordo sull'entità della breccia

Il servizio di messaggistica crittografata Tchap, sviluppato dalla Francia per i propri funzionari pubblici al fine di garantire la sovranità dei dati e l'indipendenza da piattaforme come WhatsApp e Telegram, ha subito una violazione. L'ANSSI ha rilevato la compromissione il 7 giugno, ma l'entità dei dati esfiltrati rimane oggetto di contesa tra le autorità francesi e l'attaccante. L'incidente solleva interrogativi sulla sicurezza delle soluzioni self-hosted.

2026-06-09 📰 Fonte
L'ecosistema Nvidia al COMPUTEX 2026: Implicazioni per il deployment on-premise
📁 Market AI generated ✅ DigiTimes

L'ecosistema Nvidia al COMPUTEX 2026: Implicazioni per il deployment on-premise

Al COMPUTEX 2026, l'ecosistema di Nvidia ha dominato il dibattito, evidenziando la sua influenza crescente nel settore dell'intelligenza artificiale. Questo scenario solleva questioni cruciali per le aziende che valutano strategie di deployment on-premise per i Large Language Models, toccando aspetti come la sovranità dei dati, il Total Cost of Ownership e la scelta dell'infrastruttura hardware.

2026-06-09 📰 Fonte
Nvidia traccia la rotta per l'AI PC, Intel pondera le prossime mosse
📁 Altro AI generated ✅ DigiTimes

Nvidia traccia la rotta per l'AI PC, Intel pondera le prossime mosse

Nvidia ha delineato la sua visione per l'AI PC, spingendo per l'elaborazione AI on-device e la decentralizzazione dei carichi di lavoro. Contemporaneamente, Intel adotta un approccio più riflessivo, senza annunci di prodotto imminenti. Questa dinamica evidenzia le diverse strategie dei giganti del silicio e le implicazioni per il deployment di Large Language Models (LLM) on-premise, la sovranità dei dati e il Total Cost of Ownership (TCO) per le aziende che valutano soluzioni AI locali.

2026-06-09 📰 Fonte
Distanza Semantica come Strato di Routing: Un Modello Decentralizzato per la Scoperta On-Device
📁 Altro AI generated ℹ️ LocalLLaMA

Distanza Semantica come Strato di Routing: Un Modello Decentralizzato per la Scoperta On-Device

Un nuovo prototipo esplora un'alternativa decentralizzata ai tradizionali sistemi di scoperta basati su indici centrali. L'approccio propone di calcolare la rilevanza direttamente sui dispositivi, sfruttando modelli di embedding locali come EmbeddingGemma-300M e comunicazioni peer-to-peer. Questo elimina la necessità di server centralizzati, account e classifiche globali, spostando il controllo e la sovranità dei dati verso l'utente e l'edge. Un'innovazione con implicazioni significative per i deployment on-premise e la gestione autonoma degli LLM.

2026-06-09 📰 Fonte
Alibaba intensifica la strategia AI: il CEO alla guida della nuova unità
📁 Market AI generated ✅ DigiTimes

Alibaba intensifica la strategia AI: il CEO alla guida della nuova unità

Alibaba riorganizza la sua strategia nel campo dell'intelligenza artificiale, ponendo il CEO a capo di una nuova unità dedicata. Questa mossa sottolinea la crescente importanza commerciale dei Large Language Models e la necessità per le aziende di valutare attentamente le opzioni di deployment, tra cui soluzioni on-premise, per garantire controllo e sovranità dei dati.

2026-06-09 📰 Fonte
Qwen3.6-35B-A3B: Impatto della Quantization e del Contesto Lungo sul Tool Calling
📁 LLM AI generated ℹ️ LocalLLaMA

Qwen3.6-35B-A3B: Impatto della Quantization e del Contesto Lungo sul Tool Calling

Uno studio approfondito ha esaminato l'impatto delle diverse tecniche di quantization GGUF e della gestione della KV cache sulle performance di tool calling del modello Qwen3.6-35B-A3B. La ricerca, condotta su GPU NVIDIA V100, ha confrontato quantizzazioni di ByteShape e Unsloth, rivelando che la quantization q8_0 per la KV cache offre prestazioni simili a f16, mentre il contesto lungo degrada significativamente l'efficacia del modello. I risultati offrono spunti cruciali per l'ottimizzazione dei deployment LLM on-premise.

2026-06-09 📰 Fonte
Alibaba Cloud espande l'infrastruttura in Malesia con focus su AI agentica e sovranità dei dati
📁 Altro AI generated ℹ️ TechWire Asia

Alibaba Cloud espande l'infrastruttura in Malesia con focus su AI agentica e sovranità dei dati

Alibaba Cloud ha inaugurato una nuova regione cloud a Johor, Malesia, rafforzando la sua presenza nel Sud-Est asiatico. L'espansione include il lancio di servizi AI agentici e infrastrutture dedicate per la sovranità dei dati, cruciali per le aziende locali e i settori regolamentati. L'azienda sottolinea anche l'importanza della costo-efficacia nella selezione dei modelli LLM per deployment su larga scala.

2026-06-09 📰 Fonte
Bussola Politica per LLM Locali: Valutare il Bias nei Modelli Fine-tuned
📁 LLM AI generated ℹ️ LocalLLaMA

Bussola Politica per LLM Locali: Valutare il Bias nei Modelli Fine-tuned

I benchmark di "bussola politica" offrono uno strumento per analizzare il bias nei Large Language Models. Sebbene finora si siano concentrati sui modelli cloud, emerge la necessità di estendere queste metodologie ai deployment on-premise, specialmente per i modelli sottoposti a fine-tuning o modifiche. Comprendere le deviazioni di bias è cruciale per le organizzazioni che gestiscono LLM localmente, garantendo controllo e sovranità sui dati.

2026-06-09 📰 Fonte
Deliverance AI emerge dal riserbo con un OS per l'IA sovrana on-premise
📁 Altro AI generated ℹ️ Tech.eu

Deliverance AI emerge dal riserbo con un OS per l'IA sovrana on-premise

Deliverance AI ha annunciato la sua uscita dalla modalità stealth, rivelando un Agentic Operating System progettato per l'IA aziendale. Con £6 milioni di ARR e sei clienti enterprise in pochi mesi, l'azienda mira a offrire a governi e settori regolamentati un controllo granulare su modelli e dati, supportando deployment on-premise, privati e air-gapped per garantire sovranità dei dati e conformità.

2026-06-09 📰 Fonte
Modelli ternari per LLM: promessa non mantenuta o potenziale inespresso?
📁 LLM AI generated ℹ️ LocalLLaMA

Modelli ternari per LLM: promessa non mantenuta o potenziale inespresso?

I Large Language Models (LLM) ternari, come BitNet, avevano suscitato grande interesse per la loro capacità di ridurre drasticamente i requisiti di memoria e computazione. Nonostante le promesse iniziali, il modello ternario più grande disponibile si ferma a 2 miliardi di parametri. Questo solleva interrogativi sul perché i principali laboratori di AI non stiano adottando questa tecnicia, specialmente per scenari di deployment on-premise dove l'efficienza è cruciale.

2026-06-09 📰 Fonte
Gemma 4 26B: QAT e quantizzazioni tradizionali a confronto
📁 LLM AI generated ℹ️ LocalLLaMA

Gemma 4 26B: QAT e quantizzazioni tradizionali a confronto

Un recente benchmark ha messo a confronto diverse versioni quantizzate del modello Gemma 4 26B di Google, inclusa una variante con Quantization Aware Training (QAT) a 8 bit, su un MacBook M5 Pro. I risultati suggeriscono che la versione QAT 8-bit potrebbe non superare le quantizzazioni tradizionali a 6 bit in termini di accuratezza, specialmente su task di HumanEval. Questo solleva interrogativi sull'efficacia del QAT come sostituto universale per le quantizzazioni esistenti, influenzando le decisioni di deployment on-premise.

2026-06-09 📰 Fonte
Duely raccoglie 1,1 milioni di euro per innovare i servizi legali M&A con l'AI
📁 Market AI generated ℹ️ Tech.eu

Duely raccoglie 1,1 milioni di euro per innovare i servizi legali M&A con l'AI

La startup belga Duely ha ottenuto un finanziamento di 1,1 milioni di euro per espandere i suoi servizi legali "AI-native" nel settore delle fusioni e acquisizioni (M&A). L'azienda, che ha sviluppato una tecnicia proprietaria per automatizzare le attività documentali intensive, intende accelerare la crescita in Europa e rafforzare la sua posizione nel mercato emergente dei servizi professionali basati sull'intelligenza artificiale, offrendo consulenza diretta anziché licenze software.

2026-06-09 📰 Fonte
Omi Med STT v1: ASR medico on-device per la sovranità dei dati sanitari
📁 Altro AI generated ℹ️ LocalLLaMA

Omi Med STT v1: ASR medico on-device per la sovranità dei dati sanitari

Omi Health ha rilasciato Omi Med STT v1, un modello ASR da 0.6B basato su NVIDIA Parakeet, ottimizzato per il parlato clinico. Progettato per l'esecuzione locale su Mac, Windows e Linux, il modello offre elevate prestazioni e mantiene i dati sensibili dei pazienti sul dispositivo, affrontando le sfide di privacy e sovranità. Il suo fine-tuning mirato lo rende competitivo con soluzioni cloud, con un focus sulla velocità di elaborazione locale.

2026-06-09 📰 Fonte
Merchantee ottiene 1,8 milioni di euro per espandere l'AI nell'e-commerce europeo
📁 Market AI generated ℹ️ Tech.eu

Merchantee ottiene 1,8 milioni di euro per espandere l'AI nell'e-commerce europeo

Merchantee, specializzata in strumenti di intelligenza di mercato basati sull'AI per venditori e-commerce, ha ottenuto un finanziamento di 1,8 milioni di euro. L'investimento, guidato da Reflex Capital, supporterà lo sviluppo del prodotto e l'espansione in Europa, partendo da Polonia e Germania. La piattaforma automatizza la gestione di prezzi e promozioni su più marketplace, aiutando i merchant a navigare la crescente complessità del commercio digitale e a ottimizzare le operazioni senza aumentare le risorse umane.

2026-06-09 📰 Fonte
silx-ai/Quasar-Preview: Un LLM con finestra di contesto da 5 milioni di token
📁 LLM AI generated ℹ️ LocalLLaMA

silx-ai/Quasar-Preview: Un LLM con finestra di contesto da 5 milioni di token

Il modello Quasar-Preview di silx-ai si distingue per una finestra di contesto eccezionalmente ampia, pari a 5 milioni di token. Questa capacità permette di elaborare volumi di dati senza precedenti, aprendo nuove frontiere per applicazioni aziendali che richiedono l'analisi di documenti estesi o intere basi di codice. Tale caratteristica solleva importanti considerazioni per il deployment on-premise, in termini di requisiti hardware e gestione delle risorse.

2026-06-09 📰 Fonte
ICEYE raccoglie oltre 1 miliardo di euro: spinta all'intelligence spaziale sovrana
📁 Altro AI generated ℹ️ Tech.eu

ICEYE raccoglie oltre 1 miliardo di euro: spinta all'intelligence spaziale sovrana

ICEYE, azienda finlandese di tecnicia spaziale, ha completato un round di finanziamento di Serie F da oltre 1 miliardo di euro, raggiungendo una valutazione superiore ai 10 miliardi di euro. L'investimento, guidato da General Atlantic e con la partecipazione strategica di Nokia, mira a espandere la costellazione di satelliti SAR e a soddisfare la crescente domanda globale di sistemi di intelligence spaziale sovrana, rafforzando il controllo dei dati e l'autonomia strategica per governi e organizzazioni.

2026-06-09 📰 Fonte
ggml-webgpu: Prefill più rapidi per LLM quantizzati su Apple Silicon
📁 Frameworks AI generated ℹ️ LocalLLaMA

ggml-webgpu: Prefill più rapidi per LLM quantizzati su Apple Silicon

Un recente aggiornamento per `ggml-webgpu` introduce significativi miglioramenti nelle velocità di prefill per i Large Language Models (LLM) quantizzati, in particolare i formati "k-quants". I test su Apple M2 Pro mostrano accelerazioni fino a 3.78x, rendendo l'inference locale più efficiente. Questi progressi sono cruciali per i deployment on-premise e edge, dove l'ottimizzazione delle risorse hardware e la sovranità dei dati sono prioritarie, riducendo il TCO e la dipendenza dal cloud.

2026-06-09 📰 Fonte
Aavuus: Finanziamento Pre-Seed per il tracciamento di precisione dei detriti spaziali
📁 Altro AI generated ℹ️ Tech.eu

Aavuus: Finanziamento Pre-Seed per il tracciamento di precisione dei detriti spaziali

La startup finlandese Aavuus ha ottenuto un finanziamento Pre-Seed da Maki.vc per sviluppare una rete globale di stazioni laser terrestri. L'obiettivo è superare i limiti attuali nel tracciamento degli oggetti in orbita terrestre bassa, fornendo dati più rapidi e precisi per la sicurezza spaziale e la prevenzione delle collisioni. L'iniziativa risponde alla crescente sfida dei detriti spaziali, un problema critico per gli operatori satellitari e per la sostenibilità dell'economia spaziale.

2026-06-09 📰 Fonte
Apple: un LLM da 20 miliardi di parametri esegue l'inference dalla flash dell'iPhone
📁 LLM AI generated ℹ️ The Next Web

Apple: un LLM da 20 miliardi di parametri esegue l'inference dalla flash dell'iPhone

La conferenza sviluppatori di Apple ha messo in evidenza una Siri rinnovata. Tuttavia, la vera innovazione risiede in un modello AI da 20 miliardi di parametri che, pur essendo troppo grande per la RAM di un iPhone, riesce a eseguire l'inference direttamente dalla memoria flash del dispositivo. Questa soluzione tecnica, dettagliata in un post dedicato, apre nuove prospettive per l'esecuzione di Large Language Models on-device, con implicazioni significative per la sovranità dei dati e l'efficienza computazionale.

2026-06-09 📰 Fonte
L'IA Agente: la prossima frontiera per la finanza aziendale, tra coordinamento e controllo
📁 Altro AI generated ℹ️ The Next Web

L'IA Agente: la prossima frontiera per la finanza aziendale, tra coordinamento e controllo

L'intelligenza artificiale generativa ha già trasformato la gestione delle informazioni aziendali. La nuova sfida per le imprese, in particolare nel settore finanziario, è l'IA agente: sistemi capaci di coordinare processi complessi tra diversi sistemi di business. Questo richiede di bilanciare l'automazione con la necessità di mantenere controlli rigorosi, tracciabilità e responsabilità umana, aspetti cruciali per l'adozione in contesti critici.

2026-06-09 📰 Fonte
Zaro emerge dalla stealth con 5,1 milioni di dollari per l'AI on-premise
📁 Altro AI generated ℹ️ The Next Web

Zaro emerge dalla stealth con 5,1 milioni di dollari per l'AI on-premise

La startup londinese Zaro ha raccolto 5,1 milioni di dollari in un round pre-seed guidato da Cherry Ventures. L'obiettivo è sviluppare un ambiente di lavoro AI che le aziende possano possedere e controllare direttamente, in contrasto con le soluzioni basate su fornitori esterni. Questo approccio mira a rafforzare la sovranità dei dati e il controllo infrastrutturale, attirando investitori di spicco del settore AI.

2026-06-09 📰 Fonte
La Sorprendente Competenza di Gemma 4 31B nei Deployment LLM Locali
📁 LLM AI generated ℹ️ LocalLLaMA

La Sorprendente Competenza di Gemma 4 31B nei Deployment LLM Locali

Un utente accademico ha riscontrato prestazioni inattese da Gemma 4 31B nell'analisi di codice complesso, superando Qwen 3.6 e Opus 4.7. La capacità del modello di comprendere le interdipendenze del codice suggerisce nuove metriche per la valutazione dei Large Language Models in contesti on-premise, dove il controllo e la precisione sono cruciali per la sovranità dei dati e l'ottimizzazione del TCO.

2026-06-09 📰 Fonte
LFM2.5-8B-A1B: L'LLM da 8B gira su CPU con Rust, efficienza on-premise
📁 LLM AI generated ℹ️ LocalLLaMA

LFM2.5-8B-A1B: L'LLM da 8B gira su CPU con Rust, efficienza on-premise

Un nuovo progetto open source dimostra la fattibilità di eseguire LLM da 8 miliardi di parametri interamente su CPU. L'implementazione Rust-native di LFM2.5-8B-A1B, testata su un Ryzen 7950x, raggiunge circa 37 token/s in fase di decodifica, con un consumo di memoria di circa 7GB. Questo approccio sottolinea il potenziale per deployment on-premise, offrendo controllo sui dati e riducendo la dipendenza da infrastrutture GPU costose, pur richiedendo ottimizzazioni per la fase di prefill.

2026-06-09 📰 Fonte
Apple introduce CoreAI: inference on-device potenziata per i suoi chip
📁 Frameworks AI generated ℹ️ LocalLLaMA

Apple introduce CoreAI: inference on-device potenziata per i suoi chip

Apple ha presentato CoreAI, un nuovo framework per l'inference di Large Language Models direttamente sui dispositivi con Apple Silicon. Progettato per superare le limitazioni di CoreML, CoreAI mira a ottimizzare le operazioni on-device, supportando modelli fino a 20 miliardi di parametri e rafforzando la capacità di elaborazione locale su iPhone e iPad. Questa mossa sottolinea l'impegno di Apple verso l'AI distribuita e il controllo dei dati.

2026-06-09 📰 Fonte
← Precedente Page 58 / 123 Successiva →
Vedi Archivio Completo 🗄️

AI-Radar is an independent observatory covering AI models, local LLMs, on-premise deployments, hardware, and emerging trends. We provide daily analysis and editorial coverage for developers, engineers, and organizations exploring local AI solutions.

AI-RADAR badge LaunchTry LAUNCHING SOON ON LaunchTry Fazier badge