🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15931

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Jul 20 2026
Market

Musk smentisce l'ordine SpaceX-Foxconn-Nvidia da 52 miliardi: «Fake news»

Elon Musk ha bollato come «fake news» la notizia di un maxi-ordine da 52 miliardi di dollari tra SpaceX, Foxconn e Nvidia. La smentita infiamma il dibattito sull'opacità della corsa all'hardware AI e sulle reali dimensioni della domanda.

Jul 20 2026
Altro

Alibaba apre il software per chip AI e lancia in cloud il supernodo Zhenwu

Alibaba Cloud ha rilasciato in open source il software per i suoi chip acceleratori AI e presentato il servizio cloud Zhenwu, basato sul supernodo rack-scale Panjiu AL128. Una mossa che ridefinisce il confine tra cloud e infrastruttura locale, aprendo nuovi scenari di sovranità hardware per carichi LLM.

Jul 20 2026
Altro

goNEON ottiene 160mila euro per l’AI che progetta infrastrutture in automatico

Lo spin-off del Politecnico di Zurigo ha raccolto un finanziamento da Venture Kick per sviluppare una piattaforma AI che genera progetti infrastrutturali validi in pochi minuti, riducendo da settimane il lavoro di valutazione delle alternative. La tecnicia supporta gli ingegneri senza sostituirli e apre scenari inediti sul deployment on-premise di AI nei settori regolamentati.

Jul 20 2026
Market

ASML verso il trilione? La vera scommessa è la fragilità della filiera on-premise

La capitalizzazione record di ASML non è solo un traguardo finanziario: è il riflesso di un collo di bottiglia hardware che condiziona ogni strategia di deployment locale degli LLM. Mentre l’intelligenza artificiale spinge la domanda di chip all’estremo, la dipendenza da pochi macchinari litografici solleva interrogativi strutturali per chi punta sulla sovranità dei dati.

Jul 20 2026
Market

CXMT e la DRAM cinese: maggiorenne in Borsa ma con tre muri da abbattere

L'IPO di CXMT segna un passaggio storico per l'indipendenza cinese nei semiconduttori. Ma il divario tecnicico, i controlli all'esportazione USA e i rischi brevettuali formano un trittico di ostacoli che impedisce ancora un impatto reale sulle memorie per carichi AI avanzati. Per chi valuta deployment on-premise di LLM, la diversificazione della supply chain resta più una scommessa geopolitica che una risorsa tecnica immediata.

Jul 20 2026
Altro

La memoria diventa priorità di sicurezza nazionale: l’allarme dello SK chairman

Il presidente di SK Group avverte che la produzione di chip di memoria è ormai un asset strategico per la sicurezza nazionale. La concentrazione della filiera in pochi Paesi rende l’intera infrastruttura AI vulnerabile, spingendo governi e aziende a ripensare le supply chain. Per i carichi di lavoro on-premise basati su LLM, la disponibilità di componenti come HBM e VRAM diventa un fattore critico quanto la potenza di calcolo.

Jul 20 2026
Altro

Occhiali smart, è l’ecosistema AI a decidere la partita

La concorrenza nel settore degli occhiali smart cambia marcia: gli ecosistemi di intelligenza artificiale contano più delle specifiche hardware. Una notizia che riscrive gli equilibri tra chi costruisce dispositivi e chi controlla piattaforme AI, con conseguenze dirette su privacy, elaborazione in locale e sovranità dei dati.

Jul 20 2026
Altro

Dietro le tensioni USA-Cina, i laboratori AI si costruiscono (silenziosamente) l’uno sull’altro

Mentre la guerra sulla distillazione divampa tra governi e aziende, la realtà operativa è più pragmatica: laboratori AI statunitensi e cinesi stanno silenziosamente usando modelli altrui come fondamenta. Questo intreccio ridefinisce i calcoli di sovranità dei dati e le strategie di deployment on-premise per le imprese che non possono permettersi ambiguità nella supply chain dei modelli.

Jul 20 2026
Altro

Rapidus sceglie gli agenti AI di Cadence per i 2 nm: perché il design chip corre in locale

La fonderia giapponese accelera lo sviluppo dei semiconduttori con strumenti AI. Una scelta che porta in primo piano l’infrastruttura on-premise, unica via per proteggere l’IP e gestire carichi computazionali estremi senza cedere sovranità sui dati.

Jul 20 2026
Hardware

Intel riorganizza le fonderie e guarda a 14A ed EMIB-T per l’AI

La riassegnazione delle fabbriche globali di Intel segnala una scommessa forte sui processi Angstrom e sul packaging avanzato per conquistare commesse nell’hardware AI. Cosa significa per chi sviluppa e distribuisce modelli in locale.

Jul 20 2026
Hardware

Samsung e gli ordini miliardari: la memoria è il nuovo anello forte (e debole) dell'AI

La mossa di Samsung conferma che la domanda di memoria per l'AI non è un picco ma un riassetto strutturale del mercato hardware, con impatti diretti su chi valuta il deployment on-premise di LLM.

Jul 20 2026
Market

Grenergy si quota per diventare protagonista tra AI e mercati energetici

Il gruppo guidato da Cheng-chiang Sun punta a rafforzare il proprio ruolo nell’intersezione tra intelligenza artificiale e fornitura di energia. Un’operazione che segnala come la domanda di potenza stabile per i carichi di lavoro di inference e training stia ridefinendo gli equilibri del settore.

Jul 20 2026
Altro

Apple contro OpenAI: la privacy come arma, ma l’arbitro è Trump

Una causa legale tra Apple e OpenAI riaccende lo scontro tra cloud e on-device. Mentre Cupertino rivendica la sovranità sul dato, l’ombra di un possibile ritorno di Trump impone alle aziende di ripensare i confini dell’inference. Per chi gestisce LLM in proprio, la partita non è mai stata così aperta.

Jul 20 2026
Market

La corsa all'IA è corsa al capitale: Compute Labs vuole finanziare le GPU

In un'intervista recente, Compute Labs ha dichiarato l'intenzione di diventare un finanziatore infrastrutturale per l'intelligenza artificiale, puntando a mettere a disposizione GPU su scala. Dietro questa mossa c'è un cambiamento strutturale: la competizione tecnicica lascia spazio a una competizione sull'accesso al capitale. Per chi valuta deployment on-premise, modelli di finanziamento dedicati potrebbero abbassare le barriere, ma sollevano interrogativi su sovranità e indipendenza.

Jul 20 2026
Hardware

AI boom allunga i tempi di consegna: PCB e componenti passivi verso una nuova normalità

La domanda di infrastrutture AI mette sotto pressione la catena di fornitura elettronica. I tempi di consegna per circuiti stampati e componenti passivi si allungano in modo strutturale, con ripercussioni per chi investe in hardware on-premise.

Jul 20 2026
Hardware

White paper Taiwan-USA sulla co-manifattura: un’opportunità per l’AI on-premise

Mentre esplodono gli investimenti nei chip, un white paper formalizza la collaborazione Taiwan-Stati Uniti sulla manifattura di semiconduttori. Una mossa che allenta le strozzature produttive e apre scenari concreti per chi vuole portare inference e training di LLM nei propri data center.

Jul 20 2026
Hardware

AI, la corsa ai chip si allarga: fotonica, HBM e modelli di frontiera

Silicon photonics, memoria ad alta larghezza di banda e nuove fab per memorie delineano una nuova fase della competizione hardware per l’AI, con ricadute profonde su chi deve decidere tra cloud e on-premise.

Jul 20 2026
LLM

C’è un ‘inconscio macchina’? La ricerca che svela il pensiero nascosto degli LLM

Con la “lente di Jacobi” si identificano le rappresentazioni J-space, un nucleo di concetti verbalizzabili che funge da spazio di lavoro globale negli LLM. La scoperta permette audit di allineamento che rivelano deliberazioni strategiche e disposizioni non manifeste negli output, e introduce un training riflessivo che corregge i comportamenti senza riscrivere l’intero modello.

Jul 20 2026
LLM

LLM multimodali in clinica: serializzare tutto abbatte la complessità dei sistemi di predizione

Trasformare ogni dato clinico in linguaggio naturale ed eseguire fine-tuning su un LLM unificato ha eguagliato o superato architetture di fusione specializzate in tre diversi compiti di predizione, inclusa la mortalità ospedaliera e il triage d’emergenza. L’approccio riduce drasticamente l’ingegnerizzazione di pipeline e apre la strada a deployment on-premise più semplici e sovrani per il settore sanitario.

Jul 20 2026
LLM

Generazione di circuiti quantistici: perché lo scaling non basta, serve verifica

Un nuovo position paper afferma che applicare il paradigma dello scaling probabilistico alla sintesi di circuiti quantistici è un errore strategico. La validità delle soluzioni decade esponenzialmente con il numero di qubit, rendendo il filtraggio post-hoc intrattabile. Propone una svolta verso agenti centrati sulla verifica, con vincoli gerarchici e proxy simbolici integrati direttamente nella generazione, offrendo lezioni cruciali per ogni dominio dove l'affidabilità è negoziabile.

Jul 20 2026
Frameworks

L’errore strutturato che cambia i conti della convoluzione on-premise

Uno studio svela la struttura dell’errore algebrico quando si sostituisce la DFT con la trasformata di Hadamard nella convoluzione: cancellazione esatta in alcune posizioni, spazio nullo logaritmico ed errore medio governato da uno scalare di allineamento. L’errore raddoppia asintoticamente l’energia in uscita, tranne per filtri allineati al sottospazio a prova d’errore. Rilevante per chi sceglie scorciatoie computazionali nei deployment on-premise.

Jul 20 2026
Altro

Causal-Audit: quando il ragionamento dei LLM diventa verificabile (e perché l’on-premise ci guadagna)

Un nuovo framework rende esplicito e verificabile il ragionamento causale degli LLM, fornendo tracce di audit per settori regolamentati. L’approccio, che costruisce grafi causali vincolati alla variabile target e aggrega evidenze da cammini multipli, supera i metodi correnti in precisione e trasparenza, segnando un punto a favore del deployment on-premise dove sovranità e controllo sono irrinunciabili.

Jul 20 2026
Frameworks

GraphDx: agenti e knowledge graph riducono i costi delle diagnosi sequenziali

Un framework multi-agente potenzia gli LLM con un knowledge graph costruito automaticamente per la diagnosi sequenziale. Su dataset clinici, con backbone come DeepSeek-V3 e Llama-3.3, GraphDx alza il tasso di successo dal 50-68% al 79-93% e riduce i costi dei test del 20-54%, dimostrando che ragionamento deterministico e pianificazione sensibile ai costi rendono l’automazione medica più efficiente e interpretabile.

Jul 20 2026
Market

Nvidia ha fame di GPU per sé: cosa significa per chi fa on-premise

La cronica carenza di GPU ora morde anche chi le produce. Nvidia affronta un paradosso: la domanda interna per ricerca e servizi cloud si scontra con la priorità di rifornire i clienti. Un segnale che ridisegna gli equilibri di potere nella supply chain dell’AI e complica i piani di chi vuole server sotto il proprio controllo.

Jul 20 2026
Altro

Domanda di rete resiliente, ma le consegne slittano: il nodo hardware per l’AI on-premise

La resilienza della domanda di apparati di rete si scontra con un collo di bottiglia nelle forniture: switch, transceiver e NIC ad alta velocità sono sempre più difficili da reperire, allungando i tempi di consegna. Per chi costruisce cluster AI on-premise, questo rappresenta un ostacolo strutturale che altera i calcoli di TCO, mette a rischio i progetti di sovranità dei dati e rafforza indirettamente la posizione dei grandi cloud provider.

Jul 20 2026
Altro

WAIC 2026: la Cina lancia l’interoperabilità degli agenti AI e lo space computing

Alla World AI Conference di Shanghai, Pechino delinea piani per standardizzare la comunicazione tra agenti AI e portare l'inference in orbita bassa. Una doppia mossa che ridisegna i confini dell’infrastruttura autonoma, rafforza la sovranità tecnicica e sposta il confronto con l’Occidente oltre l’hardware terrestre.

Jul 20 2026
Market

Jensen Huang a Tokyo: cosa rivela la settimana giapponese sui futuri partner di Nvidia

Il CEO di Nvidia ha trascorso una settimana in Giappone. Più di una visita di cortesia: la permanenza segnala un rafforzamento dei legami con attori strategici in un paese che accelera sulla sovranità digitale e sull’infrastruttura AI on-premise.

Jul 20 2026
LLM

Accaparramento di modelli AI: il 'panico Kimi' spinge al download locale

Un utente decide di scaricare tutti i migliori LLM attuali dopo le polemiche sul modello Kimi. Una reazione istintiva? No, la spia di un cambiamento strutturale verso la sovranità digitale e l’infrastruttura on-premise.

Jul 20 2026
Market

Email interna trapelata dipinge Sam Altman come CEO "dalla mente distorta": cosa rivela sul clima in OpenAI

Un'email interna pubblicata su Reddit descrive Sam Altman come un CEO dalla 'mente distorta', riaccendendo le preoccupazioni sulla governance di OpenAI. Il leak, privo di dettagli tecnici, sottolinea la fragilità della fiducia nei vendor centralizzati e rafforza le ragioni per deployment self-hosted di LLM, dove il controllo rimane interno.

Jul 20 2026
LLM

Alibaba vanta Qwen3.8 Max «secondo solo a Fable 5», ma mancano i numeri

La promessa di un LLM quasi al top del mercato, lanciata da Alibaba senza dati pubblici, riaccende la tensione tra marketing e verificabilità. Per chi valuta deployment on-premise, la trasparenza delle metriche non è mai stata così cruciale.

Jul 20 2026
Hardware

Huahsu espande capacità: il packaging avanzato e la corsa all’hardware AI

L’annuncio di Huahsu segnala una risposta concreta alle strozzature nella filiera dei chip AI. Mentre le GPU restano difficili da reperire, l’espansione del packaging avanzato rivela dinamiche strutturali: chi controlla l’assemblaggio 3D e l’integrazione HBM tiene in mano il rubinetto dell’inference on-premise e del training distribuito.

Jul 20 2026
Altro

Cloud nel Sud-est asiatico: la competizione si gioca su AI, sovranità e costi

Il mercato cloud del Sud-est asiatico sta abbandonando la corsa al ribasso per concentrarsi su capacità AI, residenza dei dati e controllo dei costi. Un cambiamento che ridisegna gli equilibri tra hyperscaler, provider locali e opzioni on-premise, con la sovranità digitale come nuovo fattore competitivo.

Jul 20 2026
Altro

Singapore e ASEAN scommettono su multicloud e sicurezza per l’AI

L’ascesa dell’intelligenza artificiale sta spingendo le imprese del Sud-est asiatico verso architetture multicloud e investimenti mirati in sicurezza. Un’intervista pubblicata da DIGITIMES mette in luce una tendenza che va oltre la semplice adozione tecnicica: è una riorganizzazione strutturale dei data center regionali, dove sovranità dei dati e controllo locale diventano priorità operative.

Jul 20 2026
Altro

Oltre Taipower: l’energia diventa il vero collo di bottiglia per l’hardware AI (e per il deployment on-premise)

La filiera elettromeccanica taiwanese si riorganizza attorno a intelligenza artificiale, semiconduttori e reti elettriche estere. Non è solo una questione industriale: chi gestisce infrastrutture AI in locale deve fare i conti con la disponibilità di energia come vincolo primario, al pari della potenza di calcolo e della sovranità dei dati.

Jul 19 2026
General

La convergenza sino-americana nell'IA: come la Cina sta riscrivendo le regole della corsa globale agli armamenti nell'Intelligenza Artificiale

For the past three years, the global artificial intelligence narrative has been dominated by a singular, unquestioned premise: American unilateral hegemony...

Jul 19 2026
Altro

Linux 7.2-rc4: la “nuova normalità” che rassicura chi fa inference on-premise

Il quarto rilascio candidato del kernel 7.2 conferma un ciclo di sviluppo stabile e prevedibile. Per i team che eseguono LLM self-hosted su server Linux, questa maturità riduce i rischi operativi e semplifica la certificazione hardware.

Jul 19 2026
Altro

AI senza regole per l'attaccante, difensore bloccato dalle guardrail: il report HuggingFace

HuggingFace ha subito un'intrusione gestita da un’agente AI autonomo. Il team di sicurezza ha scoperto che i modelli commerciali API bloccavano l'analisi forense delle prove, mentre un LLM open-weight eseguito on-premise ha permesso di completare l'indagine senza esporre i dati. Un paradosso che ridefinisce le priorità del deployment locale.

Jul 19 2026
Market

La causa Apple può frenare i piani hardware di OpenAI?

L'ultimo episodio del podcast Equity ha riacceso il dibattito: una controversia legale con Apple rischia di compromettere le ambizioni hardware e la quotazione in borsa di OpenAI. Dietro lo scontro si cela la fragilità delle roadmap nell'AI quando la proprietà intellettuale diventa un campo minato.

Jul 19 2026
Market

La borsa coreana guida i mercati AI: il segnale per chi sceglie l’on-premise

I gestori di fondi globali ora guardano alle oscillazioni di SK Hynix e Samsung per anticipare la propensione al rischio sull’intelligenza artificiale. Una dinamica che rivela la concentrazione della filiera hardware e lancia avvertimenti a chi pianifica deployment on-premise: volatilità dei prezzi, tempi di approvvigionamento e rischi geopolitici possono alterare profondamente il TCO.

Jul 19 2026
Altro

Moonshot AI finisce le GPU: il segnale che il cloud non basta più

La cinese Moonshot AI blocca nuovi abbonamenti e cancella l’accesso gratuito per saturazione di GPU. Un caso che mostra i limiti dell’on-demand e riaccende il dibattito su infrastrutture dedicate, vincoli geopolitici e strategie di deployment.

Jul 19 2026
Altro

Victoria vuole smascherare i troll anonimi: cosa cambia per AI e sovranità dei dati

Lo stato australiano propone leggi per costringere le piattaforme a rivelare l'identità di account anonimi accusati di vilificazione. Una mossa che incrocia moderazione AI, privacy e tensioni normative.

Jul 19 2026
LLM

I consigli dell'IA rendono tre volte meno precisi ma due volte più sicuri

Uno studio congiunto di atenei francesi e italiani rivela che avere accesso ai suggerimenti dell'IA riduce la disponibilità ad ammettere l'incertezza dal 44% al 3%, fa crollare l'accuratezza dal 27% al 9% e gonfia la fiducia nelle proprie risposte dal 30% al 76%. Dietro questi numeri si nasconde una vulnerabilità strutturale che tocca direttamente chi progetta deployment on-premise e processi decisionali assistiti.

Jul 19 2026
Altro

Qwen, la comunità vuole un MoE da 100B per l’inference on-prem

Un post su Reddit chiede al team Qwen di rilasciare un modello Mixture of Experts da 100 miliardi di parametri eseguibile su “Spark”. Dietro la richiesta c’è la spinta verso LLM sempre più capaci su hardware consumer, un trend che rimodella l’equilibrio tra cloud e self-hosting.

Jul 19 2026
LLM

Qwen, la community vuole più 35B-a3B: il segnale per il self-hosting

Un post su Reddit chiede al team Qwen nuove versioni del modello 35B-A3B. Dietro l'appello c'è una fame di architetture MoE con pochi parametri attivi, ideali per l'inference on-premise. Il caso segnala uno spostamento strutturale verso modelli capaci di bilanciare conoscenza e vincoli hardware, con implicazioni profonde per sovranità dei dati e TCO.

Jul 19 2026
Altro

Nolan e l’IA come cavallo di Troia: il pericolo non è il codice, ma chi lo controlla

Christopher Nolan definisce l’intelligenza artificiale un «cavallo di Troia» ovvio: il vero inganno non è la tecnicia ma l’infrastruttura che la incapsula. Per chi sceglie deployment on-premise e LLM self-hosted, la metafora è un avvertimento sulla sovranità dei dati e sulla necessità di tenere i greci fuori dalle mura.

Jul 19 2026
LLM

OSS gathering a Shanghai: Qwen spinge la 3.8, il faro open source si sposta a Est

Un meetup sull'open source a Shanghai diventa la vetrina per la nuova release 3.8 di Qwen. Più che un aggiornamento tecnico, è il sintomo di uno spostamento strutturale del baricentro dell'AI aperta verso la Cina, con ricadute concrete su chi sceglie deployment on-premise e sovranità dei dati.

Jul 19 2026
Altro

Current AI: l’IA no-profit che vuole un web aperto per ogni cultura

Il progetto non-profit Current AI propone un’intelligenza artificiale libera, multilingue e rispettosa di tutte le culture, con progressi su chat e dispositivi. Una visione che sfida la concentrazione cloud e punta su modelli locali e sovranità dei dati.

Jul 19 2026
Hardware

Phantom Twist, il drone che ruota così veloce da diventare quasi invisibile

Il drone Phantom Twist raggiunge velocità di rotazione tali da apparire quasi invisibile, aggiungendo motion blur alla realtà. Un effetto che interroga le capacità di elaborazione edge e il ruolo dell'inference on-device per la sovranità dei dati.

Jul 19 2026
Altro

Perché l’AI ha cambiato il più grande punto cieco della cybersecurity

L’intelligenza artificiale moltiplica gli asset esposti su internet e ridefinisce le priorità della sicurezza. Rob Gurzeev, CEO di CyCognito, spiega perché la sfida non è più gestire le vulnerabilità note ma capire cosa è effettivamente connesso alla rete. E perché le soluzioni on-premise tornano centrali.

Jul 19 2026
Altro

Google Search AI è un “rischio inaccettabile” per gli studenti. Non si può disattivare

Il watchdog Common Sense Media accusa l’AI Mode di Google Search: completa i compiti, diffonde disinformazione autorevole ed espone i minori a contenuti inappropriati. Suggerisce di smettere di usarlo fino al blocco scolastico, ma Google non può disabilitare la funzione. Una vicenda che mette a nudo la perdita di controllo degli istituti sugli strumenti cloud e riaccende il dibattito sulla sovranità digitale in ambito educativo.

Jul 19 2026
Altro

Agenti AI a pieno regime, pipeline vuote: il paradosso che riapre il fronte on-premise

L’adozione massiccia di strumenti AI autonomi non ha scosso le pipeline di vendita B2B, rimaste piatte. Il paradosso segnala che il solo accesso ad agenti cloud non basta: per attivare il potenziale commerciale servono controllo sui dati, fine-tuning sui processi reali e un'architettura di deployment che riporti la sovranità in azienda.

Jul 19 2026
Market

OpenAI: il dominio dei modelli open-weight è «comunismo dell’AI»

Il capo dei futuri strategici di OpenAI ha paragonato la diffusione dei modelli open-weight al comunismo, accendendo il dibattito su sovranità digitale, costi e controllo nell’ecosistema LLM.

Jul 19 2026
Hardware

Coil whine musicale: la bellezza nascosta del rumore hardware nell'era dell'AI on-prem

Uno studente trasforma il fastidioso ronzio delle bobine in musica. Il progetto svela la fisica dei carichi AI su GPU e VRM, e solleva domande sul rumore per chi gestisce inference on-premise tra silicio e decibel.

Jul 19 2026
LLM

Qwen 3.8 Max sbarca sulla chat ufficiale: un segnale chiaro per chi vuole il controllo dell'AI

La disponibilità di Qwen 3.8 Max sull'app chat.qwen.ai non è solo un aggiornamento di prodotto. È un campanello d'allarme per le aziende che pianificano strategie LLM on-premise: i modelli di frontiera costringono a fare i conti con hardware sempre più esigente e con la necessità di sovranità tecnicica.

Jul 19 2026
Hardware

Linux in arrivo sul tablet Legion Y700 Gen4: spinta all’AI locale con Snapdragon 8 Elite

Le patch per il kernel Linux destinate al Lenovo Legion Y700 Gen4, tablet Android con Snapdragon 8 Elite, puntano a un supporto mainline. Per chi opera con LLM in locale, l’apertura a Linux su un dispositivo compatto e potente segna un passo verso inference privata, offline e a basso consumo, riducendo la dipendenza dal cloud.

Jul 19 2026
Market

Moonshot prepara lo sbarco a Hong Kong: i 30 miliardi di valutazione svelano la corsa all'AI cinese

La startup cinese Moonshot AI punta a quotarsi a Hong Kong entro sei mesi, con una valutazione di oltre 30 miliardi di dollari. Dietro la cifra c’è una scommessa geopolitica: capitali per reggere la sfida hardware in uno scenario di restrizioni USA che spingono verso stack locali e sovranità dei dati.

Jul 19 2026
Hardware

Qwen3.8 all'orizzonte: preparate la VRAM, l'inference locale si scalda

L'annuncio del nuovo modello Qwen3.8, ancora senza dettagli ufficiali, mette in guardia gli appassionati di LLM on-premise: la richiesta di memoria video potrebbe essere significativa. La scelta di Alibaba di spingere su una taglia intermedia riapre il dibattito su hardware e quantization per chi vuole mantenere il controllo totale dei dati senza passare per il cloud.

Jul 19 2026
LLM

Qwen accelera ancora: cosa significa per chi distribuisce LLM on-premise

Alibaba Qwen torna a far parlare di sé con un nuovo teaser. Il timing non è casuale: la sequenza di rilasci open-weight del team cinese sta ridisegnando gli equilibri dell'inference self-hosted, aprendo spazi per chi cerca sovranità dei dati al di fuori dell'orbita statunitense.

Jul 19 2026
OnPremise

LLM on-premise: perché il QAT è il vero spartiacque oltre i benchmark

Il confronto tra Qwen e Gemma svela che la resilienza alla quantization conta più dei benchmark grezzi. Per chi fa inference locale, il quantization-aware training ridisegna hardware, TCO e sovranità dei dati: un'analisi delle implicazioni strutturali.

Jul 19 2026
LLM

Quando i benchmark non bastano: la lezione di Qwen vs Gemma per chi fa inference locale

Un confronto diretto su hardware locale mostra che Gemma 4, pur con punteggi benchmark inferiori, batte Qwen in coerenza e aderenza alle richieste. Dietro c’è il QAT, che cambia le regole per chi punta su LLM on-premise: non conta solo la taglia del modello, ma come sopravvive alla quantization.

Jul 19 2026
Altro

La corsa agli hard disk per mettere in salvo i modelli aperti

Una domanda su Reddit rivela un fenomeno sommerso: professionisti e aziende accumulano copie locali dei migliori LLM aperti su capienti HDD. Non è nostalgia del vintage, ma un calcolo di sovranità digitale e resilienza operativa, di fronte all'incertezza delle piattaforme centralizzate.

Jul 19 2026
Altro

Quando l’open-weight porta allo Stato-piattaforma: il caso Kimi

L’analisi di Dean W. Ball (OpenAI) sul modello cinese Kimi mostra un paradosso: l’open-weight può rallentare gli investimenti e favorire un’infrastruttura pubblica controllata dallo Stato, con possibili attriti regolatori statunitensi.

Jul 19 2026
Hardware

FastFlowLM entra in AMD: l’inference self-hosted guadagna un nuovo acceleratore

Il team specializzato in inference per LLM si unisce ad AMD, puntando a ridurre il divario con NVIDIA negli scenari on-premise. La mossa ha implicazioni dirette per chi valuta hardware alternativo per deployment locale di modelli linguistici.

Jul 19 2026
Market

La corsa agli investimenti nell’IA sta creando la propria bolla, avverte la BRI

Un documento della Banca dei Regolamenti Internazionali mette in guardia: l’attuale ondata di investimenti nell’intelligenza artificiale rischia di generare una bolla pronta a scoppiare. L’analisi tocca da vicino chi pianifica deployment on-premise, dove il costo dell’hardware e le scelte di TCO possono amplificare le conseguenze di un eventuale ridimensionamento del settore.

Jul 19 2026
Hardware

Memoria, modello foundry per rompere il collo di bottiglia dell’inference AI

Uno studioso coreano indica nel modello foundry la via per superare i limiti della memoria nell’inference AI. La separazione tra progettazione e produzione consentirebbe chip di memoria specializzati, riducendo latenze e costi. Un cambio strutturale che avvantaggerebbe i deployment on-premise, dove il controllo sullo stack hardware è totale.

Jul 19 2026
Hardware

SmartSens, boom degli ordini AI per il 2026: la visione artificiale premia l’edge

Il produttore cinese di sensori CMOS prevede un primo semestre 2026 in forte crescita, trainato dalle applicazioni di intelligenza artificiale. La notizia mette in luce la diffusione dell’inference locale nei sistemi di visione, spinta da latenza, banda e sovranità dei dati.

Jul 19 2026
Hardware

Il pragmatico playbook che ha fatto decollare Agility Robotics

La strategia di Agility Robotics punta tutto sul calcolo a bordo e su scelte hardware sobrie, ridefinendo le regole dell’edge AI industriale. Mentre la corsa ai modelli sempre più grandi riempie i data center, il caso Digit mostra perché il vero valore della robotica si gioca lontano dal cloud.

Jul 19 2026
LLM

Cache KV byte-exact su Gemma 4: la conoscenza verificata diventa uno stato ricaricabile

Un nuovo metodo consente di memorizzare knowledge verificata come stato KV e ripristinarla byte-identica alla computazione originale. Su Gemma 4 12B, il sistema di routing testato su AIME 2025 passa dal 76,7% al 90,0%. Il lavoro sarà presentato all'AGI Summit il 19 luglio.

Jul 18 2026
LLM

openPangu-2.0-Flash sbarca su ik_llama.cpp: 92B e contesto di 512K su CPU

Un modello a mistura di esperti da 92 miliardi di parametri con finestra contestuale di 512.000 token diventa eseguibile su CPU grazie all'integrazione nel runtime ik_llama.cpp. Una combinazione di tecniche come MLA-latent cache e attivazione selettiva dei parametri riduce il footprint in memoria, aprendo la strada all'inference on-premise di modelli a lungo contesto senza bisogno di GPU.

Jul 18 2026
Hardware

Driver NVK Vulkan in ascesa: Mesa 26.2 accorcia le distanze da NVIDIA proprietario

Il driver open-source NVK Vulkan per GPU NVIDIA continua a migliorare con Mesa 26.2, segnale di un ecosistema libero sempre più competitivo. Analizziamo cosa significa per chi sceglie stack on-premise e sovranità tecnicica.

Jul 18 2026
LLM

Kimi e lo spettro del “comunismo AI”: cosa c’è dietro il nuovo modello cinese

Moonshot AI aggiorna Kimi e riaccende il dibattito sulla cosiddetta “full AI communism”. L’espressione, più carica di politica che di sostanza ingegneristica, costringe a riflettere su open source, sovranità dei dati e hardware per l’on-premise.

Jul 18 2026
Altro

Il mod che trasforma San Andreas in un hub: cosa insegna a chi gestisce carichi AI on-premise

Un mod riporta Liberty City e Vice City dentro San Andreas, mostrando come un singolo motore esegua più ambienti. Un concetto familiare a chi consolida inference LLM su hardware locale per tagliare TCO e mantenere il controllo dei dati, senza dipendere dal cloud.

Jul 18 2026
Hardware

11 ventole e un AIO su una RTX 3080: 30°C in meno, ma il rumore è da aereo a reazione

Un modder trasforma una GPU consumer in una macchina da gaming glaciale con un calo termico di 30°C, ma le prestazioni reali crescono di meno di 5 FPS e il livello sonoro diventa insopportabile. Cosa insegna questa forzatura a chi oggi assembla server on-premise per carichi AI sostenuti?

Jul 18 2026
LLM

Kimi K3 domina SpreadsheetBench 2: il nuovo benchmark per fogli di calcolo riscrive le gerarchie degli LLM

Il modello cinese Kimi K3 ha raggiunto il primo posto in SpreadsheetBench 2 di AfterQuery, superando Claude Fable 5. Cosa significa per chi valuta deployment on-premise di modelli dedicati all’automazione dei fogli elettronici.

Jul 18 2026
LLM

catmind-1.2b: quando l'LLM pensa ai gatti e ignora i tuoi prompt

Un esperimento trasforma un modello di reasoning in un narratore di storie feline, facendo crollare l'accuratezza di oltre 50 punti percentuali. Un apparente gioco che però solleva interrogativi concreti sulla stabilità del fine-tuning, sull'uso dei token di pensiero e su cosa significhi fidarsi di un LLM self-hosted in produzione.

Jul 18 2026
Market

Nebius raccoglie 775 milioni ipotecando le GPU: il debito garantito dall'AI

Nebius ha ottenuto un secured debt facility da 775 milioni di dollari usando come garanzia le proprie GPU e i flussi di cassa da contratti con un cliente investment-grade. Il prestito, con scadenza 2030 e tasso SOFR+2,5%, è coperto per oltre il 100% dai soli flussi contrattuali. In pipeline ci sono ulteriori 40 miliardi di contratti cartolarizzabili. Un segnale che gli asset hardware per l'AI stanno diventando una classe di investimento a sé.

Jul 18 2026
Market

Il gap tariffario che ha inondato il Regno Unito di auto cinesi è un campanello d'allarme per l'hardware AI

Le immatricolazioni di veicoli cinesi in Gran Bretagna sono esplose da 384 unità nel 2015 a 285.000 lo scorso anno. La causa è un differenziale tariffario che sta ridisegnando il mercato. Per chi costruisce infrastrutture AI on-premise, la dinamica è un caso di scuola su come le politiche commerciali possano alterare TCO e supply chain.

Jul 18 2026
Altro

La Casa Bianca prende il controllo sull'accesso ai modelli AI di frontiera

Secondo indiscrezioni riportate dalla CNBC, l'amministrazione Trump sta ora decidendo quali aziende possono accedere agli LLM più avanzati di Anthropic e OpenAI. Finora erano i laboratori stessi a gestire le autorizzazioni, con programmi come Project Glasswing. Il cambio di paradigma alza la posta per chi valuta il self-hosting e la sovranità tecnicica.

Jul 18 2026
Altro

Francia e Germania sfidano Palantir con un’AI militare sovrana europea

I due paesi si alleano per costruire uno stack cloud, sicurezza e intelligenza artificiale indipendente dal software americano. La piattaforma francese Arcadia diventa il perno di un backbone digitale sovrano che potrebbe ridefinire gli approvvigionamenti della difesa UE e i requisiti hardware on-premise.

Jul 18 2026
Altro

Meta brevetta l’ascolto emotivo: IA sempre attiva per tracciare l’umore dalla voce

Il brevetto descrive un sistema che registra e trascrive continuamente la voce per rilevare lo stato emotivo. L’elaborazione on-device diventa il nodo strutturale: senza di essa la privacy crolla, ma impone vincoli severi a modelli e chip, ridisegnando gli incentivi per hardware e LLM.

Jul 18 2026
Frameworks

Cache negli LLM locali: cache-hunter svela i costi nascosti dell’invalidazione

Un proxy di test cattura le instabilità delle chiamate LLM che azzerano la cache, aumentando la latenza e il costo computazionale. Il problema, comune a molti harness, impatta chi esegue modelli in locale e cerca efficienza senza rinunciare al controllo.

Jul 18 2026
Market

La giacca di pelle di Jensen Huang all’asta per quasi un milione: simbolo di un mercato AI in ebollizione

Il capo iconico del CEO di Nvidia, valutato 60.000 dollari, è stato venduto per quasi un milione. Dietro la cifra record si nasconde una riflessione sul peso del brand nell’hardware AI e sulle distorsioni che può generare nelle scelte di chi progetta infrastrutture on-premise.

Jul 18 2026
Altro

Data center e campi da golf: l’acqua non è tutta uguale

Kevin O’Leary sostiene che i data center per l’AI consumino meno acqua dei campi da golf americani. Il dato, tecnicamente corretto, semplifica un problema complesso: la scarsità idrica locale, le reazioni delle comunità e gli ordini esecutivi che già bloccano progetti come il suo Stratos nello Utah. Una lettura profonda per chi valuta deployment on-premise e TCO reale.

Jul 18 2026
Altro

Alibaba apre lo stack software delle sue AI chip: la mossa anti-CUDA che cambia gli equilibri

Con SAIL, T-Head rende open source l’intero stack per i chip Zhenwu. L’obiettivo è ridurre la dipendenza da CUDA e abbassare le barriere per chi cerca alternative on-premise senza vincoli proprietari. La mossa segnala una guerra di ecosistemi software, non solo di silicio, e rilancia la sfida al monopolio Nvidia dal fronte asiatico.

Jul 18 2026
Market

Truffa Basalt Labs: quel 99,44% costruito con Qwen e DeepSeek

Una denuncia su Reddit svela che il modello esibito da Basalt Labs per il benchmark HLE è basato su Qwen2.5-7B-Instruct, mentre l’API live risponde con DeepSeek. L’episodio riaccende il dibattito sulla fiducia nell’ecosistema dei modelli e sulle sfide di verifica per chi adotta LLM on-premise.

Jul 18 2026
Hardware

Driver AMD Linux prende di mira il supporto all’Apple Studio Display

Un lotto di 70 patch per il display core di AMDGPU introduce una correzione attesa per il monitor Apple Studio Display su Linux con schede Radeon. L’aggiornamento risolve problemi di retroilluminazione e funzionalità, migliorando l’esperienza per sviluppatori e creativi che usano hardware AMD su postazioni di lavoro locali.

Jul 18 2026
Altro

GNOME OS safe mode: come l’immutabilità rafforza l’affidabilità per l’AI locale

Alla conferenza GUADEC, GNOME OS mostra i progressi della modalità sicura, progettata per ambienti immutabili basati su OSTree. Questa evoluzione parla direttamente a chi gestisce inference LLM on‑premise: un sistema che si auto‑ripara dopo un aggiornamento atomico fallito riduce downtime e semplifica il recovery, delineando un modello infrastrutturale ripetibile per server AI locali e air‑gapped.

Jul 18 2026
Altro

L’AI snellisce le autorizzazioni sanitarie? I medici temono più danni che benefici

Un sondaggio dell’American Medical Association rivela che il 61% dei medici teme che l’intelligenza artificiale aggravi i dinieghi ingiustificati nelle autorizzazioni preventive sanitarie. Mentre l’AI potrebbe accelerare le approvazioni, cresce la resistenza. Emerge un nodo di trasparenza e sovranità sui dati sensibili, decisivo per chi sviluppa sistemi decisionali in ambito clinico.

Jul 18 2026
LLM

Qwen, la rivolta della community dopo il cambio del team

Un post su Reddit invoca il ritorno del team originale di Qwen, dopo un cambiamento che preoccupa la community. Dietro la reazione c'è un tema strutturale: per chi fa deployment on-premise di LLM open-source, la continuità degli sviluppatori è un fattore di rischio che impatta manutenzione, sicurezza e sovranità dei dati.

Jul 18 2026
Frameworks

oneDNN 3.13 prepara il terreno ai server Intel Nova Lake con AVX10.2

La nuova release della libreria neurale oneDNN, ora sotto UXL Foundation, introduce ottimizzazioni esplicite per i futuri processori Intel Nova Lake e le istruzioni AVX10.2. Per chi gestisce inference on‑premise su x86, il segnale è chiaro: l’ecosistema CPU Intel punta a ridurre il divario con le GPU, offrendo ai sysadmin una leva concreta sul TCO.

Jul 18 2026
Altro

Quell'app per il ciclo mestruale che spia te (e nutre l'AI)

Le app per il ciclo mestruale raccolgono dati intimi senza adeguate tutele, mentre l’AI generativa si allena su scrape di massa. Spie russe colpiscono infrastrutture, il DHS subisce intrusioni: il vero nodo è la sovranità dei dati sensibili. Per chi li custodisce, il deployment on-premise degli LLM non è più un’opzione, ma una necessità difensiva.

Jul 18 2026
Altro

Raidium: l'AI-native che ridisegna la radiologia e punta sull'on-premise

La startup franco-siliconvalleyana Raidium ha portato la sua piattaforma di imaging AI-native al Moffitt Cancer Center, sostituendo le applicazioni radiomiche legacy. Un segnale forte sul futuro del deployment dell'AI in ambito clinico.

Jul 18 2026
Market

Google rimodula le quote di Gemini: meno risposte AI, più incertezza per gli sviluppatori

Un cambiamento nel metodo di calcolo delle quote d'uso di Gemini riduce il numero di risposte AI disponibili per gli utenti. Dietro a un semplice ritocco contabile si nasconde una lezione strutturale per chi sviluppa applicazioni basate su LLM: l'affidabilità dei servizi cloud è un equilibrio instabile.

Jul 18 2026
Altro

Face AI accelera lo swap video: la velocità è l’arma per tenervi nel cloud

La piattaforma californiana aggiorna il suo tool di face swap video con tracking migliorato e tempi di elaborazione sotto il minuto. Ma la corsa alla velocità è anche un incentivo a restare nel cloud, lontano dal controllo locale. Per chi valuta soluzioni self-hosted, il trade-off tra comodità e sovranità dei dati si fa più netto.

Jul 18 2026
Altro

Context bombing: quando il prompt injection ferma gli agenti AI malevoli

Una tecnica chiamata "context bombing" sfrutta l'iniezione di prompt per mettere fuori gioco agenti AI malevoli, costringendoli a spegnersi prima di fare danni. Un cambio di prospettiva che ridefinisce la sicurezza dell'AI autonoma e rafforza il ruolo del deployment on-premise.

Jul 18 2026
Altro

LLM cinesi: più modelli, meno GPU. Il sorpasso che insegna a chi sceglie l'on-premise

Dalla community tech emerge un dato sorprendente: i laboratori cinesi sfornano Large Language Models a ritmo forsennato, forse più di Stati Uniti e resto del mondo messi insieme. Nonostante le sanzioni sull'export di GPU, la Cina compensa con innovazioni spietate in quantization, fine-tuning efficiente e architetture snelle. Un paradosso da cui le aziende occidentali che valutano stack locali e sovranità dei dati possono trarre lezioni concrete.

Jul 18 2026
Altro

L’auto volante di Xpeng arriva in Europa e si porta dietro una sfida silenziosa: l’AI on-premise su ruote (e ali)

Al debutto tedesco, il veicolo modulare di Xpeng porta con sé 7.000 ordini e una capacità produttiva di 10.000 unità all’anno. Ma la vera partita si gioca sull’inference AI a bordo, trasformando ogni esemplare in un data center mobile che impone vincoli di latenza, sovranità e safety tipici del deployment on-premise più esigente.

Jul 18 2026
Altro

Pelé, Google e l’AI che ricostruisce la memoria: il nodo dell’on-premise

Google ha ricostruito con Veo e Gemini il gol più famoso di Pelé, mai filmato. L’impresa mostra la potenza dell’AI generativa video, ma mette in luce la concentrazione di capacità computazionali in mano a pochi cloud provider. Per le organizzazioni che valutano il self-hosted, il caso segnala un divario crescente tra ciò che è tecnicamente possibile e ciò che è economicamente realizzabile mantenendo il controllo diretto su dati e infrastruttura.

Jul 18 2026
OnPremise

Tensor parallel bloccato su Gemma 4 12B: il self-hosting resta un azzardo per pionieri

Un bug nel caricamento tensor parallel di Gemma 4 12B con E2B rivela la fragilità dell’ecosistema self-hosting: la distanza tra nuovi modelli e stack maturi mette a rischio l’autonomia on-premise. Senza processi di manutenzione industriale, le aziende restano in bilico tra pionierismo e ripiego sul cloud.

Jul 18 2026
Altro

Sateliot cerca 150 milioni: il 5G satellitare diretto apre scenari edge per l'AI on-premise

La startup spagnola rafforza la costellazione LEO per collegare gli smartphone via 5G dallo spazio. Per chi spinge inference locale, la connettività ubiqua ridisegna i confini del deployment remoto e della sovranità dei dati.

← Precedente Page 5 / 160 Successiva →