AI-Radar - Osservatorio su LLM locali, hardware AI e trend

AI-Radar per LLM on-prem & AI in casa

Il radar quotidiano su modelli, framework e hardware per far girare l'AI in locale. LLM, LangChain, Chroma, mini-PC e tutto ciò che serve per un cervello distribuito "in-house".

⚙️ Stack: LLM locali · LangChain · Transformers · ChromaDB · MiniPC · AI boxes
🛰️ Ask Observatory (Q&A + RAG) già collegato all'archivio articoli.
👥 160+ membri · Iscriviti gratis →

⚡ In Tendenza

View All →

🛠️ Guide & Osservatorio On-Premise

🚀 Esegui i modelli in locale → Tutte le guide →

Riferimenti evergreen e pratici per far girare l'AI in locale — hardware, costi, privacy e stack completo.

🖥️ Osservatorio LLM On-Premise Hardware, stack, governance e architetture di riferimento per l'AI in locale.

Ultime analisi & news dal radar

Articoli generati dall'AI sulla base dei feed, con spazio per layer editoriale umano sopra il contenuto grezzo.

Un guru di Windows adatta un motore Stirling ottocentesco per raffreddare un Threadripper AMD
📁 Hardware AI generated ℹ️ Tom's Hardware

Un guru di Windows adatta un motore Stirling ottocentesco per raffreddare un Threadripper AMD

Un appassionato ha montato un motore Stirling da 40 dollari su un sistema AMD Threadripper 3970X, usando il calore di scarto della CPU per azionare il volano e ottenere raffreddamento ausiliario senza consumare elettricità. Un ritorno a una tecnicia del 1816 che solleva interrogativi sulla gestione termica nei PC ad alte prestazioni.

2026-07-04 📰 Fonte
TabFM di Google: classificazione e regressione tabulare senza addestramento
📁 LLM AI generated ℹ️ LocalLLaMA

TabFM di Google: classificazione e regressione tabulare senza addestramento

Google Research ha rilasciato TabFM, un foundation model zero-shot per dati tabulari. Il modello gestisce classificazione e regressione su colonne miste numeriche e categoriche, senza fine-tuning o ricerca di iperparametri: gli esempi di training vengono passati come contesto, e le previsioni sono prodotte in un singolo passaggio. Per chi opera con dati strutturati in ambiti regolamentati, l'approccio promette di semplificare il deployment on-premise, mantenendo i dati locali e riducendo la dipendenza da pipeline di addestramento cloud.

2026-07-04 📰 Fonte
Linux 7.3 accoglie nuovi PCI ID per le GPU Intel Nova Lake S
📁 Hardware AI generated ✅ Phoronix

Linux 7.3 accoglie nuovi PCI ID per le GPU Intel Nova Lake S

Il ramo drm-xe-next del kernel Linux 7.3 inizia a includere gli identificatori PCI per le future GPU Intel Nova Lake S. L’enablement prosegue mentre cresce l’interesse verso soluzioni grafiche Intel per carichi di lavoro on-premise, anche se la strada per una maturità software competitiva è ancora lunga.

2026-07-04 📰 Fonte
Linux 7.2-rc2 porta a 256 il limite di core CPU per RISC-V 64-bit
📁 Hardware AI generated ✅ Phoronix

Linux 7.2-rc2 porta a 256 il limite di core CPU per RISC-V 64-bit

Una modifica nel kernel Linux, pronta per la prossima release candidate, innalza il tetto predefinito di core supportati per l’architettura RISC-V a 64 bit. Il nuovo valore di 256 core indica l’arrivo imminente di processori many-core pensati per server e carichi di lavoro paralleli.

2026-07-04 📰 Fonte
Infineon vince la quarta causa tedesca contro Innoscience: guerra GaN a Shanghai
📁 Altro AI generated ✅ DigiTimes

Infineon vince la quarta causa tedesca contro Innoscience: guerra GaN a Shanghai

Infineon ha ottenuto la quarta vittoria in tribunale in Germania contro Innoscience in una disputa sui brevetti GaN, con il conflitto che si estende ora anche a Shanghai. La contesa riguarda semiconduttori di potenza sempre più rilevanti per l'efficienza dei datacenter e il costo operativo di infrastrutture AI on-premise.

2026-07-04 📰 Fonte
GNOME Mutter impara a sopravvivere ai reset della GPU
📁 Frameworks AI generated ✅ Phoronix

GNOME Mutter impara a sopravvivere ai reset della GPU

Un progetto del Google Summer of Code introduce il recupero automatico dopo un reset della GPU in Mutter, salvando la sessione da arresti improvvisi. Un passo avanti per la stabilità del desktop Linux, cruciale anche per chi lavora con carichi computazionali pesanti sulle stesse macchine.

2026-07-04 📰 Fonte
Chip di potenza più cari: l’effetto a catena sulle infrastrutture AI on-premise
📁 Market AI generated ✅ DigiTimes

Chip di potenza più cari: l’effetto a catena sulle infrastrutture AI on-premise

L’annuncio di CR Micro si inserisce in un ciclo di rincari dei semiconduttori di potenza che tocca anche la componentistica per server e nodi GPU. Per chi gestisce deployment AI locali, l’aumento dei costi hardware incide su TCO e cicli di rinnovo, riaprendo un fronte spesso trascurato nelle valutazioni on-premise.

2026-07-04 📰 Fonte
TSMC paga meno delle concorrenti fabless: è un rischio per l’hardware AI
📁 Market AI generated ✅ DigiTimes

TSMC paga meno delle concorrenti fabless: è un rischio per l’hardware AI

Rivelazioni normative indicano che la retribuzione mediana in TSMC è inferiore a quella di realtà IC design più piccole. In un settore dove la competizione per i talenti è feroce, questo gap potrebbe aggravare la carenza di ingegneri e rallentare la produzione di chip avanzati, con effetti a catena su disponibilità e costi per chi costruisce infrastrutture AI on-premise.

2026-07-04 📰 Fonte
Longcat 2: quantization INT8 e FP8 per il deployment on-premise
📁 LLM AI generated ℹ️ LocalLLaMA

Longcat 2: quantization INT8 e FP8 per il deployment on-premise

Meituan ha rilasciato i pesi di Longcat 2 nelle varianti INT8 e FP8. Per chi gestisce LLM in locale, la disponibilità di modelli già quantizzati riduce la barriera hardware e i costi di inference, mantenendo un buon equilibrio fra prestazioni e consumo di VRAM.

2026-07-03 📰 Fonte
Alibaba vieta Claude Code: Anthropic avrebbe tracciato gli sviluppatori cinesi
📁 Altro AI generated ℹ️ The Next Web

Alibaba vieta Claude Code: Anthropic avrebbe tracciato gli sviluppatori cinesi

Dal 10 luglio Alibaba blocca l'uso di Claude Code tra i propri dipendenti. I ricercatori hanno scoperto codice nascosto che identificava gli utenti cinesi. La mossa si inserisce in uno scontro più ampio con Anthropic, accusata di aver trafugato capacità AI tramite distillazione. Un caso che riporta al centro il nodo della sovranità del codice e dei rischi degli strumenti AI in cloud.

2026-07-03 📰 Fonte
CEO Palantir spende 200 milioni in case segrete: ecco perché conta
📁 Altro AI generated ℹ️ The Next Web

CEO Palantir spende 200 milioni in case segrete: ecco perché conta

Alex Karp, CEO di Palantir, ha costruito un portafoglio immobiliare da oltre 200 milioni di dollari, con una costante: l’isolamento estremo. Dalla sede di un ex monastero in Colorado fino a ville blindate a Miami, la notizia solleva un paradosso: il capo della più potente azienda di sorveglianza al mondo si nasconde mentre la sua tecnicia scandaglia i dati altrui. Un riflesso delle stesse ansie che spingono governi e aziende verso il deployment on-premise.

2026-07-03 📰 Fonte
Dream, l’antidoto di Pegasus per i governi, sbarca in America Latina
📁 Altro AI generated ℹ️ The Next Web

Dream, l’antidoto di Pegasus per i governi, sbarca in America Latina

La startup israeliana di cybersecurity AI Dream, fondata da chi creò Pegasus, si espande in America Latina puntando sui governi allineati con Washington. Con attacchi in crescita del 25% annuo e difese deboli, la regione investe in soluzioni che coniugano protezione e sovranità digitale — un segnale per chi valuta deployment on-premise.

2026-07-03 📰 Fonte
Amalia: il Portogallo lancia un LLM nazionale da 9 miliardi di parametri
📁 Altro AI generated ℹ️ LocalLLaMA

Amalia: il Portogallo lancia un LLM nazionale da 9 miliardi di parametri

Il governo portoghese ha rilasciato Amalia, un Large Language Model da 9 miliardi di parametri con licenza Apache 2.0. Il modello, disponibile nelle varianti SFT e DPO, mira a rafforzare la sovranità digitale del Paese. L'assenza di benchmark sul coding non ne frena l'adozione per deployment on-premise, specialmente per carichi in lingua portoghese.

2026-07-03 📰 Fonte
Vulkan 1.4.356 accoglie i formati Microscaling MX per l'inference machine learning
📁 Frameworks AI generated ✅ Phoronix

Vulkan 1.4.356 accoglie i formati Microscaling MX per l'inference machine learning

L’ultimo aggiornamento di Vulkan introduce l’estensione VK_EXT_shader_ocp_microscaling_types, che abilita i tipi di dato Microscaling MX promossi dall’Open Compute Project. Una mossa che guarda direttamente ai carichi di lavoro machine learning, offrendo una nuova leva a chi sviluppa e distribuisce modelli in locale.

2026-07-03 📰 Fonte
L'Europa stringe sulle loot box: un segnale per chi fa AI in locale
📁 Altro AI generated ℹ️ The Next Web

L'Europa stringe sulle loot box: un segnale per chi fa AI in locale

Le autorità europee preparano un giro di vite sulle loot box nei videogiochi, con possibili perdite miliardarie per il settore. Ma la stretta normativa si inserisce in un framework più ampio su dati e intelligenza artificiale. Per le aziende che adottano LLM on-premise, la vera posta in gioco è la sovranità dei dati e il controllo dell'infrastruttura, elementi chiave per navigare la compliance senza rinunciare all'innovazione.

2026-07-03 📰 Fonte
Mistral rilascia Leanstral 1.5: verifica formale con 6 miliardi di parametri attivi
📁 LLM AI generated ℹ️ LocalLLaMA

Mistral rilascia Leanstral 1.5: verifica formale con 6 miliardi di parametri attivi

Mistral ha rilasciato Leanstral 1.5, un LLM con licenza Apache 2.0 focalizzato sulla verifica formale. Attiva solo 6 miliardi di parametri su 119 totali, raggiunge risultati all’avanguardia su miniF2F, PutnamBench e FATE, e ha scovato 5 bug in 57 repository reali. Il footprint ridotto apre scenari di deployment on-premise per chi non può esporre codice a servizi cloud.

2026-07-03 📰 Fonte
SAP congela assunzioni e trasferte per finanziare la svolta sull’AI
📁 Market AI generated ℹ️ The Next Web

SAP congela assunzioni e trasferte per finanziare la svolta sull’AI

Il colosso tedesco del software direzionale taglia costi operativi per dirottare risorse nei progetti di intelligenza artificiale. Una mossa che segnala la pressione competitiva sul fronte enterprise e riaccende il dibattito sui modelli di deployment, specie in Europa dove sovranità del dato e architetture on-premise restano centrali.

2026-07-03 📰 Fonte
Paesi Bassi, difesa software-first per droni: partnership multimilionaria con Intelic
📁 Altro AI generated ℹ️ Tech.eu

Paesi Bassi, difesa software-first per droni: partnership multimilionaria con Intelic

Il Ministero della Difesa olandese ha siglato un accordo da decine di milioni di euro con Intelic per sviluppare un’architettura software che renda i droni interoperabili fin dalla progettazione. Un cambio di paradigma: non più prima le piattaforme e poi l’integrazione, ma software come fondamento per connettere sistemi aerei e terrestri di produttori diversi, con feedback diretto dal fronte ucraino dove NEXUS è già operativo.

2026-07-03 📰 Fonte
Le email che hanno rotto il patto tra Anthropic e il Pentagono
📁 Altro AI generated ℹ️ The Next Web

Le email che hanno rotto il patto tra Anthropic e il Pentagono

Documenti giudiziari svelano che lo scontro legale non riguarda solo l’accesso a Claude. È in gioco il controllo sull’uso militare dell’AI di frontiera: una partita che ridefinisce i confini della sovranità tecnicica e del deployment on-premise.

2026-07-03 📰 Fonte
Zoom vuole l'intero ciclo di vendita: con Common Room l'AI legge i segnali d'acquisto
📁 Market AI generated ℹ️ The Next Web

Zoom vuole l'intero ciclo di vendita: con Common Room l'AI legge i segnali d'acquisto

Con l'acquisizione di Common Room, Zoom integra l'AI nel processo di vendita prima della videochiamata. La startup analizza i segnali d'acquisto, portando Zoom nel software enterprise. L'operazione, senza dettagli finanziari, segna un passo verso un ecosistema in cui la piattaforma controlla dati e conversazioni, sollevando interrogativi sulla sovranità dei dati per chi valuta on-premise.

2026-07-03 📰 Fonte
Spagna, blocco LALIGA abbatte 500mila siti innocenti
📁 Altro AI generated ℹ️ The Next Web

Spagna, blocco LALIGA abbatte 500mila siti innocenti

Ordini del tribunale per fermare lo streaming pirata delle partite hanno portato all’oscuramento di centinaia di migliaia di pagine web legittime, dalle organizzazioni umanitarie ai tool aziendali. Un rapporto quantifica per la prima volta il danno collaterale di un sistema di blocco automatico che solleva domande sulla sovranità digitale e sui limiti dell’automazione.

2026-07-03 📰 Fonte
Palantir su HuggingFace è vuota, ma i clienti governativi abbracciano l’open source
📁 Altro AI generated ℹ️ LocalLLaMA

Palantir su HuggingFace è vuota, ma i clienti governativi abbracciano l’open source

L’organizzazione gratuita di Palantir su Hugging Face esiste ma non contiene modelli né dataset pubblici. Il CEO Alex Karp ha dichiarato che alcuni clienti del governo USA sono passati a soluzioni AI open source. Un segnale del peso crescente della sovranità dei dati e del controllo diretto sui modelli, specie per chi opera in ambienti on-premise.

2026-07-03 📰 Fonte
L’Argentina propone società gestite da AI, ma il fattore umano resta indispensabile
📁 Altro AI generated ℹ️ The Next Web

L’Argentina propone società gestite da AI, ma il fattore umano resta indispensabile

Il governo argentino ha inviato al Congresso un disegno di legge per creare società non-umane, entità gestite da agenti AI o robot capaci di firmare contratti e detenere beni in autonomia. La proposta, però, ammette implicitamente che la supervisione umana rimane irrinunciabile, sollevando questioni su controllo, responsabilità e l’infrastruttura tecnicica che rende possibili simili forme giuridiche.

2026-07-03 📰 Fonte
Intel accelera il supporto a Nova Lake con Xe3P per Linux 7.3
📁 Hardware AI generated ✅ Phoronix

Intel accelera il supporto a Nova Lake con Xe3P per Linux 7.3

Le prime patch per il kernel Linux 7.3 concentrano gli sforzi sulla grafica integrata della futura architettura Nova Lake e sul motore Xe3P. L’abilitazione open source del driver diventa un tassello cruciale per chi valuta l’inference LLM on-premise su piattaforme Intel, dove il controllo dei dati e l’efficienza hardware contano più della potenza bruta.

2026-07-03 📰 Fonte
Starling Bank taglia 130 posti e spinge sull’AI: cosa significa per il banking e il controllo dei dati
📁 Market AI generated ℹ️ Tech.eu

Starling Bank taglia 130 posti e spinge sull’AI: cosa significa per il banking e il controllo dei dati

Starling Bank elimina 130 ruoli tra banking e tecnicia per semplificare le operazioni e accelerare il lancio di prodotti. Profitti e ricavi in calo nell’ultimo esercizio. La challenger bank investe nell’AI, lanciando il primo assistente finanziario agentico del Regno Unito. L’automazione solleva interrogativi su sovranità dei dati e scelte architetturali: cloud o on-premise? Una ristrutturazione che segnala come l’adozione dell’AI stia ridisegnando il lavoro nel settore finanziario.

2026-07-03 📰 Fonte
Spotify rimuove 500mila stream sospetti: perché anche l’AI on-premise guarda a Kalshi
📁 Altro AI generated ℹ️ The Next Web

Spotify rimuove 500mila stream sospetti: perché anche l’AI on-premise guarda a Kalshi

Spotify cancella mezzo milione di ascolti di “Earrings” di Malcolm Todd dopo che la sua ascesa in classifica coincideva con una scommessa sul mercato predittivo Kalshi. L’azienda ha chiesto a Kalshi e Polymarket di rimuovere il proprio logo. Un campanello d’allarme sull’integrità dei dati, tema centrale per chi addestra LLM in ambienti on-premise.

2026-07-03 📰 Fonte
Linux 7.2-rc2 alza le difese contro il JIT spraying su BPF
📁 Altro AI generated ✅ Phoronix

Linux 7.2-rc2 alza le difese contro il JIT spraying su BPF

Il kernel Linux in arrivo integra modifiche per mitigare gli attacchi di tipo JIT spraying nel codice BPF. Una mossa che rafforza la sicurezza dei sistemi on-premise, dove la fiducia nello stack software parte dalle fondamenta del kernel.

2026-07-03 📰 Fonte
Crusoe in trattativa per 3 miliardi di dollari: l’AI incontra l’energia di scarto
📁 Market AI generated ℹ️ The Next Web

Crusoe in trattativa per 3 miliardi di dollari: l’AI incontra l’energia di scarto

La società, specializzata in data center modulari alimentati a gas di scarto, potrebbe triplicare la valutazione a 30 miliardi. Il round finanziario segnala la crescente fame di potenza di calcolo per l’AI e spinge verso infrastrutture distribuite, con possibili riflessi sul deployment on-premise e la sovranità del dato.

2026-07-03 📰 Fonte
L’India allarga la stretta sugli username a Telegram e Signal
📁 Altro AI generated ℹ️ The Next Web

L’India allarga la stretta sugli username a Telegram e Signal

Il ministero della Tecnologia indiano ha inviato avvisi a Telegram e Signal dopo aver intimato a WhatsApp di sospendere il lancio degli username. Un’escalation regolatoria che riaccende il dibattito su sovranità dei dati e controllo delle comunicazioni.

2026-07-03 📰 Fonte
Infineon Cina contesta la rimozione dei GaN alla fiera di Shanghai
📁 Hardware AI generated ✅ DigiTimes

Infineon Cina contesta la rimozione dei GaN alla fiera di Shanghai

La filiale cinese di Infineon reagisce dopo che i suoi prodotti al nitruro di gallio sono stati tolti da un evento a Shanghai. La vicenda getta luce sul ruolo cruciale del GaN nell’efficienza energetica dei data center e sulle tensioni crescenti nelle filiere dei semiconduttori per l’AI.

2026-07-03 📰 Fonte
DeepSeek V4 Flash su RTX PRO 6000: coding 3x più veloce di Sonnet, qualità simile
📁 Altro AI generated ℹ️ LocalLLaMA

DeepSeek V4 Flash su RTX PRO 6000: coding 3x più veloce di Sonnet, qualità simile

Un benchmark indipendente mostra che DeepSeek V4 Flash eseguito in locale su due GPU RTX PRO 6000 con vLLM completa task di coding in circa 2 minuti, contro i 6 minuti di Sonnet 5 via API, con qualità paragonabile. Opus e Fable restano superiori per precisione, ma i risultati segnano un punto di svolta per l'inference on-premise.

2026-07-03 📰 Fonte
Anthropic e la Casa Bianca negano colloqui su una quota pubblica nell’azienda
📁 Altro AI generated ℹ️ The Next Web

Anthropic e la Casa Bianca negano colloqui su una quota pubblica nell’azienda

Fonti vicine ai colloqui smentiscono che l'amministrazione Trump e Anthropic abbiano discusso la cessione di una partecipazione statale. La precisazione arriva dopo indiscrezioni su una proposta simile di OpenAI. AI-RADAR analizza cosa significa per la sovranità dei dati e le scelte di deployment on-premise in un contesto di crescente intreccio tra AI e potere pubblico.

2026-07-03 📰 Fonte
Rack AI da megawatt: l’ascesa dei semiconduttori wide-bandgap nell’infrastruttura on-premise
📁 Altro AI generated ✅ DigiTimes

Rack AI da megawatt: l’ascesa dei semiconduttori wide-bandgap nell’infrastruttura on-premise

L’evoluzione dei cluster per l’addestramento di LLM spinge la densità di potenza dei rack verso il megawatt. I semiconduttori a banda larga come SiC e GaN promettono efficienza superiore e minor calore, riducendo il TCO per le infrastrutture on-premise. Un’analisi che trasforma la scelta dei componenti elettrici in una leva strategica per la sovranità dei dati.

2026-07-03 📰 Fonte
I robot U1 di Ubtech aprono il dibattito: l’AI intima deve restare locale
📁 Altro AI generated ✅ DigiTimes

I robot U1 di Ubtech aprono il dibattito: l’AI intima deve restare locale

Ubtech lancia i robot compagni U1 per testare il confine dell’intimità artificiale in Cina. L’elaborazione di dati personali sensibili spinge verso architetture edge e on-device, dove privacy e sovranità prevalgono sul cloud. AI-RADAR analizza i trade-off tecnici di un deployment che deve bilanciare reattività, TCO e vincoli normativi.

2026-07-03 📰 Fonte
Alibaba vieta Claude Code ai dipendenti: rischio backdoor dietro la scelta
📁 Altro AI generated ℹ️ The Next Web

Alibaba vieta Claude Code ai dipendenti: rischio backdoor dietro la scelta

Dal 10 luglio Alibaba proibirà l’uso di Claude Code in azienda, citando un presunto rischio backdoor. La decisione arriva dopo che Anthropic ha accusato operatori legati a Qwen di condurre la più vasta campagna di distilazione contro Claude. Una mossa che rilancia il confronto su sicurezza degli strumenti AI esterni e controllo dei dati.

2026-07-03 📰 Fonte
Quantum Systems incassa 1,2 miliardi: i droni autonomi tedeschi volano a 8 miliardi di valutazione
📁 Market AI generated ℹ️ The Next Web

Quantum Systems incassa 1,2 miliardi: i droni autonomi tedeschi volano a 8 miliardi di valutazione

La startup bavarese Quantum Systems ha chiuso un round Serie D da 1,2 miliardi di dollari, portando la sua valutazione a circa 8 miliardi. Guidato da Blackstone, Noteus, Airbus e Advent, è uno dei più grandi finanziamenti mai ottenuti da una startup europea della difesa. Il mercato dei velivoli autonomi a uso militare accelera, trainato dalla domanda crescente di capacità di sorveglianza e combattimento senza pilota.

2026-07-03 📰 Fonte
← Precedente Page 32 / 62 Successiva →
Vedi Archivio Completo 🗄️

AI-Radar is an independent observatory covering AI models, local LLMs, on-premise deployments, hardware, and emerging trends. We provide daily analysis and editorial coverage for developers, engineers, and organizations exploring local AI solutions.

AI-RADAR badge LaunchTry LAUNCHING SOON ON LaunchTry Fazier badge