🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15931

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Jul 13 2026
LLM

L'IA scrive storie banali e moraliste: lo studio che smaschera la narrativa sintetica

Una ricerca congiunta di University of Maryland e Google DeepMind su oltre 50.000 racconti brevi dimostra che la fiction generata dall'IA è riconoscibile non solo per lo stile, ma per una struttura narrativa rigida e prevedibile. I modelli privilegiano trame lineari, moralismi goffi e mancano di complessità temporale, rivelando quanto distino dalla creatività umana.

Jul 13 2026
Market

LeCun e il fondo fantasma durato otto ore: cosa insegna a chi compra hardware AI

Venerdì mattina, Extelligence Invest annunciava Yann LeCun come partner. In serata, il fondo non esisteva più. Un episodio surreale che getta ombre su un ecosistema AI dove la frenesia degli investimenti può nascondere insidie — e un monito per chi costruisce stack on-premise a non fidarsi delle apparenze.

Jul 13 2026
LLM

Never-skilling: la ricerca conferma, i junior con l'IA non imparano mai il debugging

Un nuovo termine, 'never-skilling', descrive il fenomeno per cui i programmatori alle prime armi che si affidano agli LLM non sviluppano mai la capacità di fare debugging. L'analisi rivela implicazioni profonde per chi gestisce stack on-premise: senza debugger esperti, l'autonomia promessa dal self-hosting diventa un'illusione.

Jul 13 2026
Hardware

AMD FSR Multi-Frame Generation 8x: un segnale per chi punta sull’hardware locale

Nei driver sperimentali spunta una modalità 8x per la generazione multi-frame di FSR. L’evoluzione promette di spremere le GPU Radeon, con ricadute dirette su chi costruisce stack on-premise per workload intensivi, dall’inference di LLM alla gestione privata dei dati.

Jul 13 2026
Altro

Cloudflare blocca i crawler AI: fine del web aperto anche per i modelli locali

Dal 15 settembre Cloudflare blocca di default i crawler degli agenti AI sulle pagine con pubblicità. La mossa spezza il trentennale accesso libero al web, costringendo chi fa inference in tempo reale a negoziare accessi o pagare i contenuti. Per le aziende con architetture on-premise, è un campanello d’allarme: il dato esterno non è più gratuito, e il TCO dei sistemi agentici sale.

Jul 13 2026
Altro

Calorie tracking 2026: l’innovazione corre sul device, non nel cloud

Le app per il tracciamento calorico usano l’AI per foto dei pasti e consigli personalizzati. Ma sono i modelli di deployment a fare la differenza: l’inference locale protegge i dati sanitari, ridefinisce il TCO e sposta la decisione dal cloud al device.

Jul 13 2026
Hardware

Raspberry Pi 5 verso il mainline: il driver IOMMU completa la piattaforma per l’AI on-premise

Dopo oltre due anni dal lancio, il Raspberry Pi 5 si prepara a ricevere nel kernel Linux ufficiale il driver IOMMU, finora assente. Un tassello che trasforma la scheda in un nodo edge più sicuro e versatile per carichi AI locali, dove la contesa delle risorse e l’isolamento contano.

Jul 13 2026
Altro

Huakun e Huawei: l’on-premise diventa il cavallo di Troia per l’AI cinese all’estero

Huakun rafforza la partnership con Huawei puntando su applicazioni AI on-premise per crescere all’estero. Dietro l’annuncio, la scommessa su stack alternativi a NVIDIA e la leva della sovranità dei dati per aggirare le tensioni geopolitiche.

Jul 13 2026
Altro

Raxio in Tanzania: l'infrastruttura dati che serve all'AI africana

L'espansione di Raxio Group in Tanzania, con un pool di finanziamenti ora a 380 milioni di dollari, segna un passo cruciale per la sovranità digitale del continente. La domanda di data center di qualità accelera, spinta non solo dalla digitalizzazione ma dall'esigenza di inference LLM a bassa latenza e dati in loco. L'arrivo di colocation carrier-neutral abilita scenari on-premise per aziende e governi, riducendo la dipendenza da cloud esteri e ponendo le basi per un ecosistema AI autosufficiente.

Jul 13 2026
Altro

Xi Jinping al summit AI cinese: il messaggio sul hardware sovrano

La presenza di Xi alla World AI Conference di Shanghai non è cerimoniale: è il sigillo su una strategia di autosufficienza che punta tutto su chip domestici e deployment on-premise dei Large Language Models, scavalcando le restrizioni americane.

Jul 13 2026
Altro

Cloud Hypervisor 53 sgancia lo snapshot: un tassello per l’AI self-hosted

La release 53 del VMM Rust-based introduce un demone separato per snapshot e restore asincroni. Meno overhead sulle VM, meno downtime: per chi fa inference LLM on-premise, significa poter spostare carichi memoria-pesanti senza bloccare il servizio, avvicinando i vantaggi operativi del cloud ai data center privati.

Jul 13 2026
Altro

Minori e social: la mossa UE e l’accelerazione sull’AI on-premise

Ursula von der Leyen annuncia restrizioni all'accesso dei minori ai social. La notizia va oltre la cronaca: è l'ultimo tassello di una strategia che lega sovranità digitale, privacy e controllo degli algoritmi, spingendo le aziende a rivedere i propri stack di AI verso soluzioni self-hosted.

Jul 13 2026
Altro

Doctorsa raccoglie 1 milione di euro: la telemedicina per viaggiatori punta sull'AI agentic e la sovranità dei dati

La startup milanese Doctorsa ha chiuso un round da 1 milione di euro per espandere la sua piattaforma che già connette oltre 550 medici in 40 Paesi. Al cuore del modello c'è un'infrastruttura di prenotazione agentic basata su standard aperti, che solleva interrogativi sulla gestione dei dati sanitari e spinge verso architetture self-hosted.

Jul 13 2026
Altro

Helsing vale 18 miliardi: perché l’AI militare non può vivere sul cloud

La società europea di AI per la difesa Helsing ha raccolto 1,8 miliardi di dollari in un round Serie E, raggiungendo una valutazione di 18 miliardi. L’investimento segnala un distacco strutturale del settore difesa dalle architetture cloud, con l’AI destinata a girare on-premise e in ambienti senza connettività. L’espansione verso droni autonomi e sorveglianza subacquea accelera la domanda di hardware specializzato e stack di inference self-hosted.

Jul 13 2026
Altro

Gemma 4 gira su Godot con solo GDScript e Vulkan: cosa significa per l'AI on-premise

L'esperimento di un utente fa girare un LLM Gemma 4 direttamente in Godot usando shader Vulkan, senza server né estensioni. Prestazioni 10× inferiori a llama.cpp CUDA, ma il progetto segnala come l'inference locale entri in contesti inaspettati.

Jul 13 2026
Hardware

SK Hynix avvia le prime spedizioni di HBM4 per Nvidia: segnale per l'AI on-premise

SK Hynix ha iniziato le spedizioni di moduli HBM4 destinati a Nvidia, in anticipo rispetto all'accelerazione produttiva prevista per settembre. La mossa suggerisce che la prossima generazione di GPU per data center è ormai alle porte, con effetti concreti per chi progetta infrastrutture AI on-premise e per gli equilibri nella catena di fornitura della memoria.

Jul 13 2026
Altro

La svolta high-tech dei componentisti auto di Taiwan: raffreddamento AI e chip equipment

I produttori taiwanesi di parti auto si stanno riorientando verso settori tech come il raffreddamento per l’intelligenza artificiale e le apparecchiature per semiconduttori, trainati dalla domanda in forte crescita. Una mossa che ridisegna la supply chain dell’hardware AI e potrebbe influenzare costi e disponibilità delle soluzioni di raffreddamento per data center on-premise.

Jul 13 2026
Market

TCS schiera 8.900 ingegneri AI: la difesa del modello IT services passa dall'on-premise

Tata Consultancy Services investe in un esercito di ingegneri per portare l'AI agentica dentro le aziende clienti, spesso on-premise. Una scommessa che ridefinisce il settore e mette al centro controllo e sovranità dei dati.

Jul 13 2026
Market

Corea del Sud, budget record da 530 miliardi $ pagato dal boom dei chip AI

Seul annuncia una spesa pubblica di oltre 800 trilioni di won per il 2027, sostenuta dalle entrate fiscali dell’industria dei semiconduttori per l’intelligenza artificiale. Il governo sceglie di spendere la rendita dei chip invece di accantonarla.

Jul 13 2026
Altro

PrismML comprime Qwen 3.6: 27 miliardi di parametri in esecuzione su iPhone 17 Pro

La startup californiana PrismML, spin-off del Caltech e sostenuta da Khosla, ha compresso il modello open-source Qwen 3.6 di Alibaba da 54 GB a meno di 4 GB, facendolo funzionare su un iPhone 17 Pro con tutti i 27 miliardi di parametri attivi. Il modello sarà scaricabile la prossima settimana e, secondo il CEO Babak Hassibi, segna un punto di svolta verso un’IA elaborata prevalentemente in locale, con ricadute profonde su costi, privacy e architettura hardware.

Jul 13 2026
Hardware

Tesla porta l'AI su architettura proprietaria: l'AI5 completa il tape-out da Samsung in Texas

Il chip AI5 di Tesla ha completato il tape-out presso la fab texana di Samsung, segnando un passo verso un’infrastruttura AI verticalmente integrata e geograficamente diversificata. La scelta del Texas ridefinisce gli equilibri della supply chain e rilancia il dibattito su costi, controllo e autonomia per chi gestisce carichi di lavoro on-premise.

Jul 13 2026
OnPremise

Flash-MSA: il training su un milione di token sbarca on-premise

Flash-MSA introduce kernel di attention sparsa che riducono drasticamente calcolo e memoria per l’addestramento di LLM su contesti fino a un milione di token. Per i deploy on-premise ciò significa poter addestrare modelli specializzati su dati interni con poche GPU server, abbassando il TCO e rafforzando la sovranità dei dati. L’analisi di AI-Radar esplora le implicazioni per l’hardware, il fine-tuning verticale, la filiera dei chip e la competitività delle organizzazioni che scelgono di non dipendere dal cloud.

Jul 13 2026
Frameworks

Flash-MSA accelera l’addestramento di LLM su contesti da un milione di token

Un nuovo kernel per attention sparsa promette di rendere praticabile l’addestramento di grandi modelli linguistici su sequenze lunghissime, con ricadute dirette per chi preferisce il deployment on-premise e il controllo dei dati.

Jul 13 2026
Market

Pegatron accelera sui server AI: ricavi giugno +15,9%, la spinta è on-premise

Le spedizioni di server e l'espansione dell'intelligenza artificiale portano i ricavi mensili di Pegatron a un balzo del 15,9%. Il dato segnala una domanda strutturale di hardware per inference e training, sempre più installato in data center privati.

Jul 13 2026
Altro

Obiettivo Cina 30% NEV al 2030: cosa cambia per l'AI e l'hardware delle auto estere

Pechino punta al 30% di veicoli a nuova energia entro il 2030, costringendo le case estere a ripensare l'intero stack AI. Dalla sovranità dei dati all'inference edge, la partita si gioca su chip locali e modelli addestrati su strade cinesi.

Jul 13 2026
Market

TSMC, a giugno 2026 balzo del 68%: chi fa self-hosting paga dazio

Il fatturato di TSMC segna un balzo del 68% a giugno 2026, alimentato dalla domanda di acceleratori IA. Dietro il dato, una catena di fornitura sempre più sbilanciata che penalizza le piccole commesse: per chi punta a deployment on-premise, la scarsità di chip e i tempi di attesa rischiano di vanificare i vantaggi del self-hosting.

Jul 13 2026
Hardware

Intel e l'alimentazione dual-side a 1,4 nm: una mossa strutturale per il futuro dell'AI on-premise

Intel integra l'alimentazione dual-side nel nodo a 1,4 nm per competere con TSMC. La scelta non è solo tecnica: ridefinisce gli incentivi nella produzione di chip AI, con implicazioni per chi costruisce infrastruttura di inference on-premise, dalla sovranità dei dati al costo totale di possesso.

Jul 13 2026
Altro

MiniMax investe 2 miliardi nell’infrastruttura AI: il segnale per chi vuole lo stack sotto controllo

La società cinese rilancia con un investimento massiccio in hardware e data center mentre le tensioni con Z.ai aumentano. L’operazione evidenzia una corsa all’autonomia computazionale che ridisegna gli equilibri tra cloud e infrastruttura proprietaria, con implicazioni dirette per chi valuta deployment on-premise di LLM e il costo totale di possesso.

Jul 13 2026
Altro

Leadsun e Xiangyin ridisegnano il retail energetico a Taiwan: le implicazioni per l'AI on-premise

Leadsun cerca partnership strategiche mentre Xiangyin punta allo status di rivenditore top-tier. In un mercato dove l'elettricità incide profondamente sul TCO dei cluster self-hosted, queste mosse segnalano una competizione che può ridurre i costi per chi addestra e serve LLM in sede.

Jul 13 2026
Market

Componenti per server AI fanno volare i ricavi di Trans-Sun Materials

L'azienda taiwanese segna un record di fatturato trainato dalla domanda di server per intelligenza artificiale e calcolo ad alte prestazioni. Un segnale inequivocabile di un’infrastruttura in espansione, con riflessi diretti su costi e strategie di deployment on-premise.

Jul 13 2026
Hardware

Meta, MediaTek e TSMC uniscono le forze sui chip AI: la sfida a Google è aperta

La collaborazione riportata tra Meta, MediaTek e TSMC per acceleratori AI segnala un cambiamento strutturale nel mercato dell'hardware, con potenziali ripercussioni su chi vuole gestire in proprio i carichi di lavoro di inference.

Jul 13 2026
Market

La Cina si avvicina alla corona dei notebook: l’effetto domino sugli ODM e sull’hardware on-premise

Gli original design manufacturer cinesi stanno colmando il distacco da Taiwan nel mercato dei notebook. Un segnale che va oltre i PC portatili: gli stessi attori dominano la produzione di server e l’infrastruttura cloud. Analizziamo come lo spostamento del baricentro manifatturiero potrebbe influenzare i costi, la disponibilità e la sovranità dell’hardware per carichi di lavoro on‑premise e AI.

Jul 13 2026
Altro

AI, LEO e banda larga: vento in poppa per i produttori taiwanesi di rete

La domanda congiunta di cluster AI, costellazioni satellitari e reti a banda ultralarga sta alimentando l’industria taiwanese di apparati di rete. Un’analisi delle forze che spingono switch, moduli ottici e ground station, e di come il controllo della supply chain localizzata stia spostando gli equilibri a favore delle ODM locali, con ricadute concrete per chi progetta infrastrutture on-premise.

Jul 13 2026
LLM

Emergent Misalignment: la fragilità dell’allineamento su misura

Un nuovo studio riproduce l’Emergent Misalignment, ma mostra che disallineamento e riallineamento sono sensibili a dettagli superficiali del dataset. Il riallineamento rapido svanisce controllando la lunghezza delle risposte. Le firme meccanicistiche non correlano con il comportamento. Un campanello d’allarme per chi fa fine-tuning on-premise.

Jul 13 2026
LLM

HALO: il ragionamento adattivo che fa rendere i modelli congelati senza sprecare calcolo

Un nuovo metodo, HALO, applica passaggi di perfezionamento selettivo sui token, superando approcci fissi su MMLU-Pro e GPQA-Diamond. Meno passi, stessa accuratezza: un segnale per chi gestisce modelli on-premise senza volerli riaddestrare.

Jul 13 2026
Altro

LLM che spiegano le diagnosi: con iLENS il self-hosting diventa un obbligo clinico

Il framework iLENS unisce modelli linguistici e mixture-of-experts per prevedere l'Alzheimer in modo trasparente. Un passo avanti che rende inevitabile il deployment on-premise, dove privacy e interpretabilità sono prerequisiti normativi.

Jul 13 2026
LLM

Sparsificazione delle interazioni: il meccanismo unificato dietro la distillazione degli LLM

Un nuovo studio scompone l'output degli LLM in interazioni non lineari, rivelando che la distillazione della conoscenza (KD) forza lo studente a mantenere poche interazioni e azzerare le altre. La performance dipende dalla capacità di gestire interazioni complesse. Proposto un termine di penalità (CIP) per migliorare la sparsità e le prestazioni.

Jul 13 2026
Frameworks

CogniConsole: per LLM affidabili, il controllo dell’inference batte la scalabilità

Uno studio dimostra che l’affidabilità dei large language models non dipende solo dalle capacità del modello, ma da come si struttura l’inference. Con CogniConsole, l’astrazione del controllo riduce drift e fallimenti: un cambio di paradigma con implicazioni concrete per chi gestisce deployment on-premise.

Jul 13 2026
Frameworks

Robustezza AI su base matematica: il lattice traversal che riscrive la verifica delle reti neurali

Un nuovo framework teorico dimostra che la robustezza avversariale può essere ridotta a un percorso su reticolo di intervalli. Viene introdotta la certificazione ‘complete’ — quando uscire dall’intervallo cambia forzatamente la predizione — finora assente in letteratura. L’ottimizzazione per la certificazione sound è intrattabile, mentre per quella completa esiste una soluzione polinomiale. Un asso nella manica per chi vuole modelli verificabili, auto-ospitati e sotto controllo diretto.

Jul 13 2026
Altro

Nvidia punta sull'HVDC: la potenza AI ridisegna l'architettura elettrica dei data center

La scelta di Nvidia di adottare l'HVDC per i carichi AI segnala un cambiamento nell'infrastruttura di potenza: meno conversioni, maggiore efficienza e nuove sfide per chi gestisce deployment on-premise di LLM su larga scala.

Jul 13 2026
Market

La Cina si affida all'H200 di Nvidia, e CUDA resta il re dell'AI

Nonostante le sanzioni statunitensi e gli investimenti in chip domestici come l'Ascend di Huawei, l'ultima mossa del settore AI cinese — orientarsi verso le GPU H200 di Nvidia — dimostra che l'ecosistema software CUDA è un vantaggio competitivo quasi impossibile da replicare. Questo pivot non riguarda solo la potenza dei chip, ma il software che li anima: un monito per chiunque progetti infrastrutture AI on-premise puntando all'indipendenza dall'hardware estero.

Jul 13 2026
Hardware

TSMC allarga il vantaggio AI: i colli di bottiglia su HBM e CoWoS ridisegnano le filiere

Le strozzature nella produzione di memoria ad alta larghezza di banda (HBM) e nel packaging avanzato CoWoS stanno ridefinendo gli equilibri dell’hardware per AI. Per TSMC è un rafforzamento della leadership, ma per l’intero ecosistema il vero nodo è strutturale: la disponibilità di GPU e acceleratori per deployment on-premise e cloud dipende da capacità produttive che richiedono anni per scalare, con effetti a catena su costi, sovranità dei dati e architetture alternative.

Jul 13 2026
Hardware

Apple accelera la roadmap AI: i prossimi Mac punteranno sul neural processing

Secondo indiscrezioni, Apple avrebbe rivisto le priorità nello sviluppo dei propri chip, portando l'elaborazione neurale al centro dei prossimi Mac. Un segnale forte per chi guarda all'AI on-device: più potenza locale significa meno dipendenza dal cloud, massima privacy e uno scatto nella reattività delle applicazioni. Una mossa destinata a pesare negli equilibri del computing personale e aziendale.

Jul 13 2026
Altro

Mac Studio, Qwen 122B e i tre bug che bloccavano l’inference long-context

Un fork del serving stack svela perché Qwen3.5-122B su Mac Studio diventava inutilizzabile dopo pochi messaggi: colpa di instabilità del prompt, mancata persistenza degli streaming e avvelenamento dei checkpoint. Risolti i bug, il tempo di prefill crolla da minuti a frazioni di secondo.

Jul 13 2026
Altro

AI in finanza: la frattura regolatoria tra Europa, UK e Stati Uniti

Le autorità di vigilanza di Europa, Regno Unito e Stati Uniti stanno adottando approcci divergenti sull’AI nel settore finanziario. Questa frammentazione normativa spinge banche e assicurazioni verso architetture self-hosted e data center locali, ridefinendo il TCO e le scelte hardware per gli LLM.

Jul 13 2026
LLM

Il miraggio della distillazione: perché addestrare su CoT filtrate peggiora gli LLM

Addestrare modelli open sui tracciati di ragionamento delle API commerciali sembra una scorciatoia, ma quei tracciati sono censurati o riassunti, non la catena di pensiero reale. Il risultato è garantito peggiore del modello originale. L'illusione mina la qualità dei fine-tuning e crea rischi concreti per chi sceglie deployment sovrani basati su questi dati.

Jul 13 2026
Hardware

Il CEO di Arm: gli agenti AI spingeranno la domanda di CPU, oltre le GPU

La dichiarazione del CEO di Arm segnala un possibile spostamento dell'infrastruttura AI verso architetture CPU, con implicazioni rilevanti per chi gestisce carichi di lavoro in locale, dove efficienza energetica e sovranità dei dati contano più dei picchi di petaflop.

Jul 13 2026
LLM

DeepMind: l’AI si sposta verso il “pensiero lento” mentre si avvicina l’era degli agenti

Il vicepresidente della ricerca di Google DeepMind indica una transizione strutturale: l’inference non è più solo velocità, ma ragionamento multi-step su cluster on-premise. Questo ridefinisce i requisiti hardware, allontana il cloud puro e premia chi investe in sovranità dei dati e controllo del TCO per carichi agentici.

Jul 13 2026
Altro

Il boom dei server AI spinge i ricavi di Trio: il backup energetico è il nuovo collo di bottiglia

Trio, produttore di sistemi di backup, registra a giugno un balzo dei ricavi grazie alla domanda di batterie per server AI. Un segnale chiaro che l’infrastruttura elettrica è un fattore critico — e sottovalutato — nei progetti on-premise.

Jul 12 2026
Market

La carenza di MLCC frena l'AI: gli ordini scivolano al 2026 e Taiwan detta i tempi

L'espansione dell'infrastruttura AI aggrava la carenza globale di condensatori ceramici multistrato (MLCC). Produttori taiwanesi prevedono ordini inevasi fino alla seconda metà del 2026. Le implicazioni per chi pianifica deployment on-premise.

Jul 12 2026
Altro

Linux 7.2-rc3 e la 'nuova normalità': perché il kernel conta per l'AI on-premise

Con il rilascio di Linux 7.2-rc3, il team di sviluppo parla di 'nuova normalità' nel processo di maturazione. Per chi gestisce infrastrutture AI on-premise, la stabilità del kernel non è un dettaglio tecnico: impatta driver GPU, gestione della memoria e costi operativi.

Jul 12 2026
Altro

Apple fa causa a OpenAI: segreto industriale violato «a ogni livello»

La battaglia legale tra Apple e OpenAI accende i riflettori sulla protezione della proprietà intellettuale nel cloud AI. Per chi sviluppa LLM, il caso solleva un interrogativo strutturale: è ancora sensato delegare dati e modelli a fornitori esterni?

Jul 12 2026
Hardware

Linux 7.2 abilita UltraRISC nel kernel: un tassello concreto per l'hardware AI aperta

La configurazione predefinita del kernel RISC-V in Linux 7.2 aggiunge il supporto per UltraRISC, dopo Eswin. Un dettaglio tecnico che segnala la maturità dell’ecosistema RISC-V e porta con sé prospettive concrete per l’inference on-premise, riducendo la dipendenza da architetture chiuse.

Jul 12 2026
LLM

moondream3.1-9B-A2B: il punto di svolta per la visione artificiale locale

Con soli 2 miliardi di parametri attivi su un totale di 9, il nuovo modello MoE sfida il presupposto che servano GPU datacenter per ragionamento visivo di qualità. Un segnale strutturale per chi progetta applicazioni on-premise.

Jul 12 2026
LLM

J-space su Qwen3-8B: il ragionamento silenzioso diventa guardiano on‑prem

Un ricercatore ha replicato localmente la “lente Jacobiana” che Anthropic aveva usato per svelare il pensiero nascosto di Claude. Su Qwen3-8B, la sonda intercetta derive prima delle tool call e aziona guardie che bloccano, annullano o recuperano l’output. Uno scenario concreto per la sicurezza agentica senza dipendere da API cloud.

Jul 12 2026
Market

La corsa all’AI ha silenziosamente smesso di puntare tutto sul modello più grande

Per anni l’industria ha rincorso modelli sempre più mastodontici. Ora, secondo CNBC, le aziende scelgono per compito, costo e controllo. Il cambiamento apre scenari concreti per chi valuta deployment self-hosted e sovranità dei dati.

Jul 12 2026
Altro

Zhipu, il manifesto dell’AI aperta che sfida Pechino

Il fondatore di Zhipu, Tang Jie, sostiene che la sicurezza dell’AI di frontiera dipenda dalla trasparenza e dalla partecipazione collettiva, in rotta con il controllo statale cinese. Un contrasto che ridefinisce i confini della sovranità digitale.

Jul 12 2026
Market

La domanda AI è ‘quasi illimitata’? Il mercato non ci crede più

I dirigenti AI giurano che la domanda non ha fondo, ma i titoli traballano. Pat Gelsinger indica l'energia come unico freno. Tuttavia, gli investitori ora chiedono fatti, non slogan. Cosa significa per l'hardware e per chi sceglie l'on-premise.

Jul 12 2026
Altro

Cancro da sconfiggere, chatbot da rinchiudere: la doppia anima del Congresso sull’IA

In dieci giorni, il Congresso USA ha presentato una valanga di proposte di legge sull’intelligenza artificiale, con due anime opposte: una spinge per accelerare l’adozione (ad esempio in sanità), l’altra vuole imbrigliare i rischi (dai deepfake ai chatbot). Una schizofrenia legislativa che per le aziende con dati sensibili rende sempre più concreta la scelta di stack on-premise.

Jul 12 2026
Market

GPT-5.6, i cinesi scelgono qualità e costi extra scavalcando il Great Firewall

Sviluppatori cinesi usano VPN per accedere a GPT-5.6, bloccato in Cina, accettando costi aggiuntivi. I modelli locali sono più economici, ma la qualità superiore giustifica il sovrapprezzo. Un segnale di quanto il divario prestazionale conti più del prezzo.

Jul 12 2026
Hardware

Hunyuan3D in tasca: generare modelli 3D in 20 secondi su iPhone grazie a MLX

Un progetto open source porta l'intera pipeline di Hunyuan3D su Apple Silicon e iOS, sfruttando MLX per inference in FP16 con picchi sotto i 6 GB di memoria. Le prime prove su M4 Max mostrano tempi inferiori ai 21 secondi per la geometria e, con quantization Q4/Q8, la promessa di esecuzione persino su iPhone. L'approccio aggira l'overhead di PyTorch e ribadisce la potenza dell'architettura a memoria unificata per carichi AI locali.

Jul 12 2026
Altro

Allarme backdoor su Claude Code: la Cina accelera verso gli strumenti di coding domestici

L’allerta del database nazionale cinese sulle vulnerabilità accelera la migrazione degli sviluppatori verso soluzioni locali. Analisti: in gioco sovranità dei dati e sicurezza, cresce l’interesse per tool on-premise.

Jul 12 2026
Hardware

RISC-V adotta un firmware standardizzato con HFI: ricadute sull'AI on-premise

L'iniziativa Harmonic Firmware (HFI) mira a fornire un'esperienza di avvio unificata per le schede RISC-V, simile al BIOS x86 con schermata POST e utility di configurazione. Un tassello di maturità che riduce la frammentazione e apre la strada a hardware completamente aperto per l'inference locale, abbassando le barriere per chi cerca sovranità sui dati e controllo dello stack.

Jul 12 2026
Altro

Realtek RTL8723BS: il driver Wi-Fi Linux si blinda contro access point malevoli

Le patch in arrivo per il kernel Linux 7.2-rc3 correggono vulnerabilità di accesso fuori limite nel driver Realtek RTL8723BS, chiudendo il fianco a host Wi-Fi compromessi. La notizia interessa chi costruisce nodi di inference on-premise: un chip economico e diffuso nell'edge esce rafforzato.

Jul 12 2026
Altro

AI e quantum computing per nuovi peptidi: il side hustle degli scienziati

Ricercatori hanno messo insieme finanziamenti e tempo per dimostrare come l’AI e il calcolo quantistico possano generare nuovi peptidi, accelerando lo sviluppo di farmaci per popolazioni trascurate e malattie rare. Un proof-of-concept che solleva interrogativi su come le infrastrutture di calcolo accessibili possano determinare il successo di progetti simili, in un settore dove la sovranità dei dati e il costo totale di possesso sono spesso trascurati.

Jul 12 2026
LLM

Xiaomi rilascia MiMo-V2.5-DFlash: 300B parametri per l'inference locale

Xiaomi ha caricato su Hugging Face i pesi di MiMo-V2.5-DFlash, un LLM da oltre 300 miliardi di parametri, e un modello MTP separato. Su due GPU da 24 GB con offload su RAM DDR5 raggiunge 8-10 token/s; DFlash promette di raddoppiare la velocità. L'operazione segnala che l'inference di modelli massivi su hardware consumer è una realtà concreta, con ricadute immediate per chi sceglie deployment on-premise e sovranità dei dati.

Jul 12 2026
Hardware

Il bug matematico della Tesla P100: tre righe di codice che ridisegnano il TCO on-premise

Una patch di tre linee per llama.cpp corregge un errore di precisione che affliggeva da anni le GPU Tesla P100, migliorando la fedeltà dei calcoli di oltre 2000 volte senza impatto prestazionale. La scoperta ridisegna il rapporto costo-efficacia di queste schede da 80 dollari per l’inference on-premise, solleva interrogativi sulla verifica dell’aritmetica a basso livello nei framework open-source e rafforza il legame tra controllo dello stack e qualità del modello.

Jul 12 2026
Hardware

Il bug matematico nascosto nel tuo P100 da 80$: tre righe di codice lo hanno risolto

Per anni le GPU Tesla P100 hanno eseguito calcoli FP16 viziati in llama.cpp, con una divergenza KL mediana 2000 volte superiore al dovuto e un accordo sul token successivo fermo al 96,5%. Una patch di tre linee, disponibile su turboquant, ripristina la precisione di riferimento senza alcun costo prestazionale. Il fix rivaluta il profilo economico della P100 per l'inference on-premise, ridimensionando il sovrapprezzo della P40 e sollevando interrogativi sulla copertura dei test per l'hardware datato nei framework LLM.

Jul 12 2026
Market

Corea del Sud, i soldi delle startup e il futuro dell’AI on-premise

Leggere i flussi di finanziamento delle startup sudcoreane non è un esercizio da economisti: è un radar che anticipa quale hardware circolerà per l’inference LLM self-hosted. I capitali parlano e chi valuta sovranità dei dati deve ascoltare.

Jul 12 2026
Altro

Cina: un modello di previsione urbana affonda le radici nei dati locali

Un'azienda AI cinese ha addestrato un modello di previsione urbana su oltre 20.000 categorie di dati multimodali raccolti a Zhangjiang. Dietro il lancio c'è una scelta di campo: dati e calcolo restano nel perimetro locale, segnale di un'architettura pensata per la sovranità digitale delle città.

Jul 12 2026
LLM

Dopo Qwen 3.6 27B: quanta VRAM serve per il prossimo LLM locale?

Un utente Reddit chiede quale modello sia il naturale upgrade dopo il Qwen 3.6 27B e quanta VRAM richieda. La domanda svela il vero snodo dei deployment self-hosted: la scelta del modello è subordinata alla memoria disponibile. Analizziamo perché il salto generazionale sposta l’attenzione dalla qualità del singolo LLM all’architettura hardware, al costo totale di possesso e alla sovranità dei dati.

Jul 12 2026
Market

AI nel venture capital: la fretta è davvero una buona consigliera?

La pressione sui VC di adottare l'intelligenza artificiale è altissima. Ma integrare LLM senza considerare i costi di inference, la sovranità dei dati e le scelte di deployment può trasformare un presunto vantaggio competitivo in un boomerang. Ecco chi rischia di più e quali infrastrutture contano davvero.

Jul 12 2026
Altro

JD.com punta sull’AI locale: al via la RoboBase di Guangzhou per robotica a ciclo chiuso

JD.com ha avviato i lavori per la sua prima RoboBase nel distretto di Huangpu, a Guangzhou, puntando a un ecosistema robotico a ciclo chiuso. L’infrastruttura locale permetterà di gestire training, inference e raccolta dati senza uscire dal perimetro aziendale, segnando un passo deciso verso l’AI on-premise nel settore logistico.

Jul 12 2026
Market

Anthropic sbarca in India: AI per i servizi pubblici e la partita della sovranità

Anthropic apre il suo primo ufficio in India a Bengaluru, secondo mercato globale, e discute col Karnataka l’uso dell’AI per i servizi ai cittadini. Un banco di prova per la sovranità dei dati e il deployment locale dei Large Language Models.

Jul 12 2026
Altro

SmartSens e i Micro LED ottici: nel 2027 l’AI avrà collegamenti più veloci

L’azienda cinese punta a commercializzare interconnessioni ottiche basate su Micro LED per i data center AI entro il 2027. Una mossa che segnala un’accelerazione nella ricerca di alternative alle soluzioni tradizionali, con potenziali ricadute su banda, consumi e costi dei cluster di calcolo.

Jul 12 2026
Market

Palo Alto Networks: gli agenti AI spingono la domanda di sicurezza delle identità

L’ascesa degli agenti AI autonomi moltiplica i rischi di compromissione delle credenziali: Palo Alto Networks segnala una crescente richiesta di soluzioni di identity security per gestire l’accesso di modelli e automazioni, ridefinendo le architetture di sicurezza aziendali.

Jul 12 2026
Hardware

AI, il nuovo collo di bottiglia non è il calcolo ma la memoria: i fornitori ne prendono atto

L'industria ha corso per anni dietro ai FLOPS. Oggi il vincolo reale per LLM e inference è la capacità e la banda di memoria. I produttori lo sanno e stanno riorientando le roadmap hardware. Per chi valuta deployment on-premise, la memoria diventa il fattore dirimente.

Jul 12 2026
Altro

Infinitix e Sarawak siglano un patto AI per il cloud sud-est asiatico

Un accordo che porta nuovi servizi cloud nel cuore del Borneo. Dietro le quinte, la partita per la sovranità dei dati e l’infrastruttura regionale si fa più concreta.

Jul 12 2026
Hardware

DeepSeek sviluppa un suo chip AI: la mossa per l’indipendenza hardware

Secondo fonti vicine all’azienda, DeepSeek sta lavorando a un processore AI proprietario, segnando un passo strategico verso l’autosufficienza tecnicica e il controllo della pipeline inferenziale.

Jul 11 2026
Hardware

Server LLM da 35 miliardi di parametri a 100 dollari: il segreto sono due vecchie GPU Pascal

Due NVIDIA P102-100 da mining, acquistabili per circa 100 dollari, fanno girare Qwen 35B con llama.cpp servendo tre utenti in parallelo a 23 token al secondo. Un dimostratore di come l'inference on-prem possa diventare accessibile grazie al supporto CUDA 12.x mantenuto dal framework.

Jul 11 2026
Altro

Flaxeo Image porta Stable Diffusion sul desktop, nessun cloud richiesto

Un'interfaccia locale per sd.cpp rende la generazione di immagini accessibile su Windows e Linux, segnando un passo verso la sovranità creativa e il controllo dell'hardware.

Jul 11 2026
LLM

Sovrascrivere il comportamento di un LLM con Jacobian-Lens: l'esperimento Nikusui-v1

Un utente Reddit ha esportato un modello modificato manipolando direttamente il J-Space, sbloccando capacità esplicite. L'episodio mostra che gli strumenti per alterare la personalità dei modelli sono già accessibili, con conseguenze dirette per chi gestisce deployment on-premise e per la governance dei contenuti.

Jul 11 2026
Hardware

Apple fa causa a OpenAI: la guerra dei chip AI passa dai tribunali

La denuncia coinvolge l’ex VP Apple Tang Tan e l’ingegnere Chang Liu, ora in OpenAI. Al centro c’è il controllo dell’hardware per LLM su scala: la posta in gioco è la sovranità computazionale e il TCO dell’inference self-hosted.

Jul 11 2026
Altro

Chip AI: gli USA allentano le restrizioni per gli Emirati, nel mirino un campus da 5 GW

Con l’approvazione di Washington, l’azienda emiratina G42 progetta un campus AI da 5 gigawatt tra Emirati e Stati Uniti, sostenuto da chip avanzati. Una mossa che ridisegna la geopolitica dei semiconduttori e apre nuove opportunità per deployment on-premise e ibridi nella regione.

Jul 11 2026
Hardware

AIO liquido su un Ryzen da 65W: il bundle Newegg a $520 è l’anello mancante per l’AI on-premise?

Newegg propone a $520 un pacchetto con Ryzen 5 9600X, 16GB DDR5, motherboard B650 e dissipatore AIO da 240 mm. Più che un affare per il gaming, il bundle segnala un cambio di strategia nella distribuzione e un punto d’ingresso per chi vuole sperimentare con l’inference locale, nonostante alcune scelte di raffreddamento discutibili.

Jul 11 2026
Altro

Debian 13.6: la patch di manutenzione che ricorda perché il sistema operativo è il primo mattone dell’AI on-premise

L’ultimo aggiornamento di Debian Trixie porta correzioni di sicurezza e inverte il database GeoIP. Dietro la routine tecnica si nasconde una lezione per chi gestisce infrastrutture LLM self-hosted: stabilità e sovranità passano anche da queste release minori.

Jul 11 2026
Market

ChatGPT in salotto: OpenAI cerca famiglie, ma la casa chiede sovranità

L'assunzione di un product manager per nuclei domestici segna l'ingresso di ChatGPT nella vita quotidiana di anziani e caregiver. Un cambio strategico che però riaccende la tensione tra comodità cloud e controllo locale dei dati sensibili, spingendo molte famiglie a valutare alternative on-premise.

Jul 11 2026
Hardware

Linux 7.3-rc3: display più affidabili sui sistemi multi-GPU

La release candidate Linux 7.3-rc3 introduce un fix per il rilevamento dei display nei sistemi con più GPU. Il miglioramento evita blocchi all’avvio e rende più affidabili le macchine usate per l’AI on-premise, dove la diagnosi remota è essenziale. Un dettaglio tecnico che riflette la maturazione del kernel Linux per carichi di lavoro enterprise e riduce i costi nascosti di gestione.

Jul 11 2026
Hardware

Qwen3-30B a 50 tok/s su una RTX 5060 Ti: il motore CUDA che riscrive l’inference locale

Un esperimento con codice C++ e CUDA su misura porta un modello MoE da 30 miliardi di parametri a superare 50 token al secondo su una GPU consumer con 16 GB di VRAM. Il motore garlic-inference supera llama.cpp del 50%, mostrando margini di ottimizzazione ancora inesplorati per l'inference self-hosted e rafforzando la tesi di un’alternativa concreta al cloud.

Jul 11 2026
Altro

Microsoft: la corsa all’AI mette a repentaglio la promessa di sostenibilità 2030

L'espansione dell'intelligenza artificiale ad alta intensità di carbonio sta mettendo sotto pressione l'impegno di Microsoft per la neutralità carbonica entro il 2030, anche se il chief sustainability officer ritiene l'obiettivo ancora raggiungibile. La vicenda svela tensioni più ampie tra crescita dell'AI e vincoli ambientali, con implicazioni dirette per chi valuta deployment on-premise.

Jul 11 2026
Altro

OpenAI assorbe la sicurezza nella ricerca: una scelta che pesa sulla fiducia enterprise

L’uscita del responsabile dei sistemi di sicurezza segue la fusione dei team di safety e ricerca sotto un’unica guida. Per le aziende che valutano il controllo dei dati e la conformità, il messaggio è chiaro: la separazione dei poteri interni non è più garantita.

Jul 11 2026
Altro

Meta ritira Muse dopo tre giorni: l’AI generativa affrettata si infrange sulla privacy

Il richiamo immediato della prima AI per immagini nata nei Meta Superintelligence Labs mostra quanto sia fragile l’equilibrio tra velocità di rilascio e protezione dei dati. L’episodio rafforza il caso per chi sceglie deployment on-premise e controlla direttamente il flusso dei dati sensibili.

Jul 11 2026
Hardware

Apple fa causa a OpenAI: prototipi hardware rubati in colloqui "show and tell"

Apple ha citato in giudizio OpenAI in un tribunale federale della California, accusandola di aver utilizzato dipendenti attuali ed ex per rubare progetti hardware mentre prepara dispositivi AI consumer. Nella denuncia compaiono il chief hardware officer Tang Tan e l'ex ingegnere Apple Chang Liu. La vicenda mette in luce la posta in gioco della progettazione hardware nell'era dell'IA e solleva interrogativi sulla catena di fornitura per i deployment on-premise.

Jul 11 2026
Altro

CISA senza un piano di risposta agli incidenti: lezione per l'on-premise

Un rapporto postmortem di CISA rivela che a maggio l'agenzia non disponeva di un playbook di risposta agli incidenti. Il personale ha dovuto improvvisare le procedure sul momento. Un campanello d'allarme per chiunque gestisca dati sensibili in proprio, dai modelli LLM ai sistemi governativi. La prontezza operativa non si improvvisa.

Jul 11 2026
Hardware

Mesa attiva di default Rusticl per le GPU Mali: una svolta per l’IA on-device

Un ingegnere Arm ha integrato in Mesa una modifica che abilita per impostazione predefinita il supporto di Rusticl per i driver Panfrost delle GPU Mali. L’intervento elimina la necessità di variabili d’ambiente manuali, democratizzando il calcolo GPGPU su hardware Arm a basso costo. Un passo che ridisegna le possibilità per l’inference locale di LLM, con vantaggi in termini di sovranità dei dati e riduzione del TCO per i carichi edge.

Jul 11 2026
OnPremise

Qwen3.6 a 8 bit su CPU: quando la qualità dell’output ridisegna gli investimenti on-premise

Un test con un Qwen3.6 35B-A3B mostra che la quantization a 8 bit su CPU produce codice HTML complesso migliore della versione a 4 bit su GPU, nonostante la lentezza. L’esperimento accende un riflettore sul trade-off qualità-velocità, sul ruolo delle architetture MoE e sulla possibilità di usare server CPU ad alta densità di RAM per inference on-premise di LLM. Un segnale per chi cerca sovranità dei dati senza rinunciare alla fedeltà dell’output.

Jul 11 2026
LLM

Qwen3.6 a 8-bit su CPU: quando la qualità della risposta supera la velocità

Un utente ha scoperto che il modello Qwen3.6 35B-A3B, quantizzato a Q8_0 ed eseguito su CPU, ha generato codice HTML complesso con una qualità inaspettata rispetto alla versione a 4 bit su GPU. Un test che solleva interrogativi sui compromessi tra precisione, hardware e creatività nei LLM auto-ospitati.

Jul 11 2026
Altro

Cisco: l'agentic AI triplicherà il traffico di rete aziendale in tre anni

Cisco prevede che l'AI agenziale farà crescere il traffico di rete aziendale fino a tre volte entro tre anni. La stima accende un riflettore sull'infrastruttura di rete on-premise: per gestire agenti autonomi che coordinano flussi di dati in tempo reale, le architetture dovranno evolversi rapidamente, con implicazioni profonde per chi sceglie di tenere l'inference dentro i propri data center.

Jul 11 2026
Hardware

Geckos: i materiali, non i chip, guideranno il salto delle prestazioni AI

Secondo Geckos, il prossimo balzo prestazionale nell’intelligenza artificiale arriverà dai materiali, non dall’architettura dei chip. La tesi apre interrogativi su chi dominerà la filiera hardware e su come evolveranno le infrastrutture on-premise per LLM. Mentre la legge di Moore rallenta, l’innovazione nei substrati, nelle interconnessioni e nella memoria potrebbe ridefinire TCO e sovranità dei dati.

Jul 11 2026
Market

WITS segna ricavi record nel semestre: IA e chip design trainano la crescita

L'azienda taiwanese ha registrato nel primo semestre il fatturato più alto di sempre, spinta dalla progettazione di chip per intelligenza artificiale. Un indicatore della rilevanza crescente del silicio custom nell'inference on-premise.

← Precedente Page 11 / 160 Successiva →