🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15934

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Jun 29 2026
Altro

Wimbledon porta in casa dati e AI con IBM: meno debito tecnico e TCO sotto controllo

L’All England Club lancia Match Chat e Key Moments per analisi live durante i match. Ma la novità più significativa è la ricostruzione della piattaforma digitale: servizi critici in casa, modello operativo AI e una riduzione del technical debt che segna il passo per il deployment ibrido.

Jun 29 2026
Altro

Fibra cava cinese a 51,3 Tb/s su 206 km: la rete AI si spoglia del rame che la rallenta

Un esperimento cinese ha trasmesso 51,3 Tb/s su 206 chilometri di fibra a nucleo cavo senza rigenerazione del segnale. Il risultato, pensato per i centri dati dell’era AI, accende i riflettori sulla lotta alla latenza e ai colli di bottiglia che strangolano l’addestramento distribuito di LLM. Per chi gestisce stack on-premise, la notizia segnala un cambio di passo possibile nell’interconnessione locale di GPU.

Jun 29 2026
Altro

Tesla transige sull'incidente mortale con Full Self-Driving, ma l'indagine federale resta aperta

Tesla ha raggiunto un accordo extragiudiziale per la causa legata a un incidente mortale del 2023 in cui era attivo il sistema Full Self-Driving (Supervised). I termini dell’intesa non sono stati resi noti. La vera partita, però, è l’inchiesta federale statunitense ancora in corso. La vicenda solleva interrogativi su responsabilità, trasparenza e il ruolo delle valutazioni indipendenti quando l’AI critica gira on-premise o sull’edge.

Jun 29 2026
LLM

DeepSeek V4 atterra su llama.cpp: ora gira in locale

Una pull request della community aggiunge il supporto a DeepSeek V4 in llama.cpp, abilitando l'inference on-premise e su hardware consumer. Si apre una nuova fase per il deployment privato del modello.

Jun 29 2026
Market

Ex-Anthropic raccoglie 200 milioni per l'AI che si migliora da sola

Mirendil, fondata da due ex ricercatori di Anthropic, ha raccolto 200 milioni di dollari con una valutazione di 1 miliardo. La promessa: commercializzare i sistemi di auto-miglioramento che i grandi laboratori custodiscono gelosamente. L’operazione segnala una nuova frontiera per le aziende che cercano di replicare internamente i processi di training avanzato.

Jun 29 2026
Altro

Taiwan e il suo primo sottomarino: uno sguardo al futuro autonomo

Taiwan ha avviato le prove in mare del suo primo sottomarino di produzione nazionale, un passo significativo per le sue capacità di difesa. L'iniziativa, che include l'interesse del costruttore per i contratti di imbarcazioni senza equipaggio, solleva questioni cruciali sull'integrazione dell'AI in contesti strategici, evidenziando la necessità di infrastrutture self-hosted e la sovranità dei dati per i sistemi autonomi.

Jun 29 2026
Altro

Taiwan investe nel quantum: 15 talenti all'estero per la sovranità tech

Il governo di Taipei ha avviato un programma per formare esperti in tecnicie quantistiche, inviando 15 ricercatori in centri internazionali. La mossa punta a costruire competenze strategiche in un campo che ridefinirà crittografia, simulazioni e intelligenza artificiale. Per un ecosistema on-premise come quello analizzato da AI-RADAR, la disponibilità di talenti locali è cruciale quanto l'hardware: la vera sovranità digitale passa per la conoscenza.

Jun 29 2026
Altro

Il lato oscuro dell’NLP nel networking: allucinazioni e privacy spingono verso l’on-premise

L'NLP sta rendendo il networking professionale più intelligente e personalizzato, ma solleva interrogativi su allucinazioni, bias e controllo dei dati. Per le aziende, il deployment on-premise di questi modelli diventa una strada obbligata per garantire sovranità e conformità, come analizza AI-RADAR.

Jun 29 2026
Altro

Quasi 400 giornali locali fanno causa a OpenAI e Microsoft per copyright

Una coalizione di quasi 400 testate locali americane ha citato in giudizio OpenAI e Microsoft. Al centro della disputa l'addestramento dell'IA su articoli protetti da diritto d'autore. Per AI-RADAR, il caso segnala l'urgenza di governance sui dati di training e rinfocola il dibattito sul controllo delle fonti nei sistemi cloud.

Jun 29 2026
Altro

La Germania punta sull’AI per colmare la carenza di manodopera: una questione di calcolo

In Germania, il dibattito sull'intelligenza artificiale si fa aritmetico: la tecnicia serve a compensare la cronica mancanza di operai. Il caso emblematico di un'impresa edile del nord-ovest mostra applicazioni concrete e lontane da ogni glamour. L'articolo indaga il fenomeno e le implicazioni per chi sceglie il deployment locale, tra sovranità del dato e controllo operativo.

Jun 29 2026
Hardware

OpenAI soffia ad Apple il capo del Vision Pro: Paul Meade guiderà l’hardware AI

La defezione più illustre da Cupertino segnala che la guerra per i talenti dell’hardware AI non risparmia nessuno. Meade lascia la Mela per costruire i dispositivi di OpenAI, confermando che il futuro dell’intelligenza artificiale passa anche da corpi fisici, non solo da software.

Jun 29 2026
Altro

Austria vuole Anthropic in Europa: la richiesta che sfida il paradigma cloud

Il governo austriaco ha formalmente chiesto all'UE di trovare un modo per ospitare Anthropic in Europa. Una mossa inusuale che accende i riflettori su sovranità dei dati e controllo dell'inference LLM lontano dai data center USA.

Jun 29 2026
Market

Domanda AI spinge i ricavi delle fonderie Foundry 2.0: +23% nel primo trimestre 2026

Crescita del 23% anno su anno per il mercato delle fonderie di nuova generazione, trainata dalla domanda di chip per l’intelligenza artificiale. Mentre l’IA continua ad alimentare investimenti importanti nei nodi avanzati, le organizzazioni interessate al deployment on-premise di LLM devono prepararsi a un panorama di offerta ancora teso, tra costi crescenti e finestre di disponibilità limitata, ma con segnali di ampliamento della capacità produttiva.

Jun 29 2026
Market

Cina, via alla filiera del diamante per chip: cosa cambia per l'AI on-premise

Un progetto a Zhengzhou punta a creare la prima filiera cinese di semiconduttori al diamante, materiale che promette enorme efficienza termica. Per chi gestisce infrastrutture AI locali, la notizia apre scenari su TCO, densità di potenza e controllo della catena di approvvigionamento.

Jun 29 2026
Market

Fintech e chip spingono la settimana europea: 2,1 miliardi in 75 round

La scorsa settimana il tech europeo ha raccolto oltre 2,1 miliardi di euro, con fintech, sicurezza e semiconduttori in testa. Germania e Francia dominano la classifica paese. Il nuovo Tech.eu Funding Explorer, in beta aperta, offre accesso ai dati per fondatori e investitori. Uno sguardo ai deal e alle implicazioni per le infrastrutture on-premise.

Jun 29 2026
Altro

Scam.ai lancia Halo: rilevamento deepfake on-device con Qualcomm

A Computex 2026, Scam.ai svela Halo, modello di rilevamento deepfake per videochiamate che gira in locale sui PC ottimizzati per Qualcomm. Nessun dato video lascia il computer, riducendo rischi privacy e latenza. Partnership strategica per portare l’intelligenza artificiale contro le frodi vocali e video direttamente sull'edge.

Jun 29 2026
LLM

Scaffold inferenziale: i modelli piccoli imparano a strutturare senza fine-tuning

Un test manuale su modelli di generazione di scene 3D mostra che uno scaffold ricavato da un dominio può migliorare l'organizzazione del codice in modelli più piccoli. L'effetto asimmetrico suggerisce un possibile trasferimento di disciplina procedurale, con implicazioni per l’uso di LLM su hardware locale.

Jun 29 2026
Market

Wistron espande la produzione USA per i server AI: una spinta per l'on-premise

Wistron aumenta la capacità produttiva in Nord America per far fronte alla domanda di server dedicati all'intelligenza artificiale. La mossa riflette la corsa globale alla potenza di calcolo e ha implicazioni dirette per chi valida architetture on-premise, tra sovranità dei dati e catene di fornitura.

Jun 29 2026
Altro

La Cina mette l’energia per l’AI al centro del piano quinquennale

Il nuovo piano energetico quinquennale cinese eleva l’alimentazione dell’intelligenza artificiale a priorità nazionale. Per chi gestisce LLM on-premise, l’annuncio segnala una politica industriale che punta a garantire capacità elettrica e sovranità infrastrutturale.

Jun 29 2026
Altro

Perché il machine unlearning negli LLM è un termine abusato: serve rigore per il deployment reale

Un nuovo articolo di posizione critica l'uso inflazionato del termine 'machine unlearning' nella ricerca sugli LLM, sostenendo che andrebbe riservato alla cancellazione di dati specifici dal training, con garanzie equivalenti al riaddestramento senza quei dati. La confusione terminologica mina la fiducia nei sistemi on-premise dove la sovranità dei dati impone obblighi di eliminazione verificabili.

Jun 29 2026
LLM

I quattro assiomi che svelano i pensieri nascosti degli LLM

Un framework assiomatico valuta la qualità delle rappresentazioni interne degli LLM senza affidarsi ai benchmark. Nessun modello analizzato soddisfa tutti e quattro gli assiomi, rivelando un difetto strutturale. Per chi gestisce deployment on-premise, questa ricerca apre nuove strade per audit e scelta dei modelli.

Jun 29 2026
Frameworks

RANSAC senza parametri di scala: il punteggio che elimina la calibrazione manuale

Un nuovo punteggio per RANSAC rimuove la necessità di stimare la scala degli inlier, marginalizzandola analiticamente. Risultato: robustezza estrema su 70mila coppie di immagini, anche con solo due esempi di validazione. Una svolta per chi gestisce pipeline di visione artificiale in ambienti locali, dove la riduzione degli iperparametri significa meno interventi manuali e maggiore affidabilità.

Jun 29 2026
Altro

OverFlowLight: come l'AI prevede gli ingorghi e sblocca gli incroci in tempo reale

Un framework basato su sensori multimodali e reinforcement learning, testato su 43 incroci in tre metropoli, riduce gli overflow del 60,4% e aumenta la capacità di rete del 18,2%. L’approccio ibrido unisce regole rapide e controllo adattivo, segnando un punto di svolta per infrastrutture urbane resilienti.

Jun 29 2026
LLM

Agenti LLM con lungimiranza: il training a tre stadi per simulare il futuro

Un approccio unificato inietta capacità predittive negli agenti linguistici, superando la semplice mimica testuale. Ricercatori affrontano il gap formato-capacità con un training sequenziale che include mid-training per la predizione latente, SFT strutturato e reinforcement learning condizionato dalla simulazione. I risultati su compiti di ricerca e ragionamento matematico indicano una strada per agenti più pianificatori in ambienti on-premise.

Jun 29 2026
LLM

Personalità degli agenti LLM: quando serve una squadra affiatata?

Una nuova ricerca indaga se la personalità assegnata via prompt agli agenti LLM influenzi i risultati dei compiti in team multi-agente. In tre ambiti – codice, collaborazione aperta e negoziazione – l’effetto cambia radicalmente. Scopri cosa significa per chi progetta sistemi multi-agente on-premise.

Jun 29 2026
Frameworks

DeepSeek accelera l’inference con DSpark: fino all’85% di risposte più rapide

Il framework DSpark di DeepSeek sfrutta il speculative decoding per ridurre la latenza delle risposte dei LLM fino all’85%. Una tecnica che promette vantaggi per chi gestisce inference on-premise, ma con trade-off in risorse e complessità.

Jun 29 2026
Hardware

Hong Kong alza 44 miliardi: il boom dell’hardware dietro l’AI on-premise

Nel primo semestre 2026 l’emissione azionaria a Hong Kong è cresciuta del 29% toccando quasi 44 miliardi di dollari, trainata da produttori di batterie e circuiti stampati. Un segnale che investe direttamente la catena di fornitura per l’infrastruttura LLM on-premise: disponibilità, costi e controllo passano anche da qui.

Jun 29 2026
Market

Momenta verso l'IPO da 751 milioni: la mossa che rivela la fame di GPU on-premise

La cinese Momenta ha depositato la richiesta per quotarsi a Hong Kong con un'offerta fino a 751 milioni di dollari. L'operazione segnala la crescente necessità di capitali per finanziare infrastrutture di calcolo, in particolare per l'addestramento di reti neurali nel settore della guida autonoma. Per chi opera in questo settore, il deployment on-premise di GPU e server dedicati diventa un fattore critico per gestire dati sensibili e latenze ridotte, rilanciando il dibattito su sovranità e TCO.

Jun 29 2026
Market

360 One in procinto di investire 25 milioni in Rocket, startup AI indiana

L’asset manager 360 One guiderebbe un round tra 20 e 25 milioni di dollari per Rocket, con altri investitori pronti a unirsi. Il finanziamento segnala l’interesse del capitale per l’AI indiana e, più in generale, per le soluzioni che favoriscono il deployment on-premise di LLM, tra sovranità dei dati, controllo del TCO e necessità di personalizzazione.

Jun 29 2026
Altro

Modello 800M trasforma immagini in personaggi giocabili, tutto in esecuzione locale

Un ricercatore ha rilasciato la versione da 800 milioni di parametri del suo modello di diffusione causale per la generazione di personaggi controllabili. L'esecuzione avviene interamente in locale su GPU consumer, con la variante da 500M che supera i 60 fps su RTX 5090. Il contesto è stato ampliato a 12 frame latenti, migliorando stabilità, ma la coerenza resta un punto critico. L'architettura sfrutta una KV cache con finestra scorrevole per gestire la memoria.

Jun 29 2026
Altro

Johor, rete elettrica sotto stress: cosa significa per i data center on-premise

L'espansione della pipeline di data center a Johor mette in luce la pressione sulle infrastrutture energetiche locali. Per le aziende che valutano deployment on-premise, diventa urgente pesare TCO, sostenibilità e sovranità dei dati.

Jun 29 2026
Altro

Potens entra nel raffreddamento IA: il TCO on-premise passa dal calore

Potens si espande nei mercati del raffreddamento e dell'alimentazione per server AI, con una quota del fatturato server che raggiunge la doppia cifra. Per chi gestisce deployment on-premise di LLM, la gestione termica non è più un optional: condiziona densità, longevità hardware e costo totale di possesso.

Jun 29 2026
Hardware

La memoria diventa strategica nell’AI: Winbond punta su DRAM e Flash per il prossimo salto

Per l’AI on-premise la memoria non è più una commodity: è la risorsa che decide cosa puoi eseguire. Il presidente di Winbond, James Chen, indica DRAM e Flash come direttrici di sviluppo. Cosa significa per chi costruisce infrastrutture locali per LLM.

Jun 29 2026
Altro

AI fisica: la Corea del Sud passa alla pratica, l'Europa cerca fornitori non cinesi

Mentre Seul trasforma la strategia sull’intelligenza artificiale per la robotica e il manifatturiero in progetti concreti, Bruxelles accelera la ricerca di catene di approvvigionamento hardware che evitino la dipendenza da Pechino. Due mosse destinate a incidere sulle scelte di deployment on-premise, sulla sovranità dei dati e sul calcolo del TCO per le aziende.

Jun 29 2026
Altro

Mageia 10 debutta: l’eredità Mandrake e il valore della sovranità Linux per gli stack on-prem

La distribuzione comunitaria Mageia 10, discendente di Mandrake e Mandriva, offre una base stabile per infrastrutture self-hosted. Per chi costruisce pipeline LLM on-premise, la scelta di un sistema indipendente richiama i principi di controllo, trasparenza e TCO, senza sorprese da roadmap corporate.

Jun 29 2026
Market

HP Inc. lancia la partnership Frontier con OpenAI: IA enterprise e implicazioni on-premise

HP Inc. estende la partnership strategica Frontier per portare l'AI nelle esperienze cliente, nello sviluppo software e nelle operazioni aziendali. Per i team che valutano l'adozione su larga scala, il nodo cruciale resta il deployment: cloud o on-premise? L'analisi di AI-RADAR esplora i trade-off tra controllo dei dati, hardware necessario e costi.

Jun 29 2026
Altro

LG spinge sul raffreddamento a liquido per i data center AI, nel mirino i server partner taiwanesi

Il colosso coreano accelera sugli impianti di raffreddamento a liquido per data center, puntando a collaborazioni con i produttori taiwanesi di server. Una mossa che ridefinisce la geografia dell'infrastruttura AI on-premise, tra efficienza termica e sovranità dei carichi di lavoro.

Jun 29 2026
Altro

Crescita a doppia cifra per AIC: l'infrastruttura AI si sposta sui sistemi a livello rack

AIC registra una crescita a doppia cifra mentre l'infrastruttura per l'intelligenza artificiale si evolve verso architetture rack-level. Cosa significa per il deployment on-premise e la sovranità dei dati.

Jun 29 2026
Hardware

L’export AI spinge l’elettronica taiwanese: che segnale è per chi sceglie il self-hosted

La domanda di AI alimenta l’ottimismo del comparto elettronico di Taiwan, con export in crescita. AI-RADAR legge il fenomeno guardando alla disponibilità futura di hardware per inference on-premise, ai possibili effetti sulla catena di fornitura globale e ai riflessi in termini di TCO e sovranità dei dati per chi oggi valuta stack locali.

Jun 29 2026
Hardware

Goertek, wafer AR da 12 pollici: più guide d’onda, meno costi per occhiali AI

La nuova linea di produzione del gigante cinese promette di raddoppiare la resa di guide d’onda ottiche, componente cruciale per gli occhiali a realtà aumentata. Sfruttando wafer da 12 pollici, Goertek mira ad abbattere i costi unitari e ad accelerare l’adozione di dispositivi indossabili con AI integrata, rimescolando le carte dell’intero settore.

Jun 28 2026
Altro

Motore NPC locale con LLM leggeri: la scommessa on-premise per gli RPG del futuro

Un backend NPC game-agnostic gira interamente in locale grazie a STT NVIDIA Parakeet, all’LLM Gemma 4 26B e alla sintesi vocale Qwen3-TTS. L’ingrediente segreto è il RAG: inietta solo le azioni contestualmente sensate, mantenendo i prompt snelli e le risposte fulminee. L’esperimento mostra come modelli locali sempre più capaci possano alimentare esperienze immersive senza dipendere dal cloud.

Jun 28 2026
LLM

L’invasione dei modelli trash su HuggingFace: cosa ci dice sul mercato AI

Sempre più modelli fine-tuned su HuggingFace non reggono il confronto con il base. È solo un problema di curriculum padding o c’è dell’altro? L’analisi di AI-RADAR mette in guardia chi valuta LLM per deployment on-premise: la selezione è critica e il rumore abbonda.

Jun 28 2026
LLM

Ornith-1.0-35B GGUF: il graft MTP nativo accelera il decoding locale del 35%

Un aggiornamento sperimentale per Ornith-1.0-35B introduce un decoding speculativo nativo MTP che su singola GPU con llama.cpp porta la velocità a 233.8 token/s (+35%), con distribuzione del token successivo byte-identica al modello originale. Pubblicati benchmark completi su diverse quantizzazioni, latenza TTFT fino a 32k token e una fidelity ladder basata sulla divergenza KL, tutto testato su RTX PRO 6000 Blackwell da 96 GB. Un segnale forte per chi cerca efficienza nell'inference on-premise.

Jun 28 2026
Market

Ford riassume gli ingegneri veterani: l’AI da sola non garantisce qualità

Dopo aver pensato che l’intelligenza artificiale potesse produrre prodotti di alta qualità da sola, Ford ha dovuto richiamare ingegneri esperti. Un caso emblematico di come la tecnicia senza supervisione umana e competenza di dominio sia insufficiente. Una lezione per chiunque valuti il deployment di sistemi AI, specie in contesti on-premise dove il controllo diretto è cruciale.

Jun 28 2026
Altro

Cina raggiunge Anthropic nella cybersecurity: la corsa all’AI si riavvia

La notizia che la Cina ha eguagliato le capacità di cybersecurity di Anthropic ridisegna gli equilibri della competizione globale sull’intelligenza artificiale. Per chi gestisce LLM on-premise, dove sovranità dei dati e controllo degli accessi sono imprescindibili, l’avanzata cinese impone una riflessione urgente sulla robustezza delle difese, sulle architetture air-gapped e sul rischio di escalation asimmetrica.

Jun 28 2026
LLM

Dario Amodei non capisce l’AI open source? Ecco perché conta per il deployment on-premise

Le dichiarazioni del CEO di Anthropic sollevano un polverone: dalla trasparenza dei modelli alla possibilità di eseguirli in locale. La replica della community open source chiarisce che modelli come Qwen 27B e Nemotron3 Ultra offrono alternative concrete, ridefinendo i confini tra cloud e infrastruttura proprietaria.

Jun 28 2026
Altro

Un terapista AI legge i sensori di smartwatch e auricolari per rilevare lo stress in tempo reale

Ricercatori dell'Università di Ottawa hanno sviluppato UbiMyTherapist, un assistente AI che sfrutta i dati di dispositivi indossabili e auricolari per cogliere segnali di disagio emotivo prima che l'utente chieda aiuto. L'approccio capovolge il tradizionale modello dei chatbot per la salute mentale, sollevando questioni cruciali su privacy, latenza e dove convenga elaborare dati così sensibili.

Jun 28 2026
Market

Perché Wall Street crede che Micron sarà la prossima Nvidia

Gli investitori guardano a Micron come potenziale protagonista nel boom dell'AI, puntando sulla memoria ad alta larghezza di banda che alimenta GPU e acceleratori. Per le aziende che valutano infrastrutture on-premise, la disponibilità e il costo di questa tecnicia diventano variabili critiche nel calcolo del TCO.

Jun 28 2026
Frameworks

DeepSpec: DeepSeek open-source per accelerare l'inference con speculative decoding

DeepSeek ha rilasciato DeepSpec, una codebase completa per addestrare e valutare modelli “draft” per speculative decoding. I checkpoint coprono Qwen3 e Gemma-4, con tre algoritmi: Eagle3, DFlash e DSpark. Per chi gestisce LLM on-premise, questo framework promette guadagni di throughput senza GPU aggiuntive, rinforzando il controllo sulla pipeline di inference.

Jun 28 2026
Hardware

RAMageddon è la nuova normalità: la guida Lenovo per sopravvivere alla scarsità di memoria

A ISC 2026, un dirigente Lenovo ha dichiarato che il 'RAMageddon' – la crisi delle memorie – è la nuova normalità, e che nulla tornerà come prima. L'azienda ha tracciato una guida alla sopravvivenza per le organizzazioni che devono pianificare infrastrutture AI on-premise. L'analisi di AI-RADAR su cosa significa per chi investe in hardware locale.

Jun 28 2026
Market

BIS mette in guardia: una bolla dell’IA può colpire i mercati del credito come la crisi del 2008

La Banca dei Regolamenti Internazionali avverte che un crollo degli investimenti in intelligenza artificiale potrebbe destabilizzare i mercati del credito con conseguenze paragonabili alla crisi finanziaria del 2008. Il rapporto annuale inserisce i rischi legati all’IA tra i punti di pressione globali, accanto a inflazione e tensioni fiscali. Per chi valuta deployment on-premise, l’allarme solleva interrogativi sulla sostenibilità degli attuali livelli di spesa hardware.

Jun 28 2026
Frameworks

Llama.cpp adotta DFlash: attenzione ottimizzata per l'inference locale

Il progetto llama.cpp ha integrato il supporto per DFlash, una nuova variante del meccanismo di attenzione pensata per ridurre l’uso di VRAM e accelerare l’esecuzione di Large Language Models su hardware consumer. L’aggiornamento rafforza le capacità on-premise del framework, rendendo più accessibili contesti lunghi e fine-tuning su macchine autonome, con ricadute dirette per chi cerca sovranità sui dati e controllo dei costi.

Jun 28 2026
Altro

L’autoriparazione, l’ultimo bastione analogico: l’AI locale cambia le regole

Oltre 280.000 officine indipendenti in Nord America operano ancora con flussi di lavoro cartacei. Un mercato da 8,6 miliardi di dollari al 2033 spinge verso la digitalizzazione. L’AI on-premise, tra privacy, latenza e costi, potrebbe essere la chiave per superare decenni di immobilismo.

Jun 28 2026
LLM

LLM on-premise: cercare il modello giusto tra benchmark frammentati e dimensioni inutili

Chi esegue modelli linguistici in locale si scontra con benchmark che ignorano i vincoli on-premise. La differenza reale tra open e closed source spesso conta meno della VRAM disponibile, mentre i modelli oltre i 70B promettono più di quanto offrono. Un'analisi del gap tra test sintetici e utilità pratica.

Jun 28 2026
Market

Google raziona l'accesso a Gemini per Meta: carenza di potenza di calcolo

Secondo il Financial Times, Google ha imposto limiti a Meta nell'uso dei modelli Gemini perché non riesce a fornire la capacità di calcolo richiesta. La mossa, che penalizza diversi clienti, colpisce i progetti interni della società di Mark Zuckerberg e rilancia il dibattito sulla dipendenza dal cloud.

Jun 28 2026
Altro

Linux sfoltisce i driver, l'AI scova le falle: così il kernel prepara l'infrastruttura del futuro

Mentre il Q2 2026 volge al termine, Phoronix fa il punto sulle novità del kernel Linux: rimozione di driver obsoleti, rilevamento di vulnerabilità tramite intelligenza artificiale e altri sviluppi cruciali per la stabilità dei sistemi on-premise. Un segnale chiaro per chi gestisce infrastrutture critiche.

Jun 28 2026
Market

UPI verso il miliardo di transazioni: l’AI è il motore, ma serve un’infrastruttura locale

Il sistema di pagamenti indiano UPI punta al miliardo di transazioni giornaliere. Secondo il CEO di NPCI, l’intelligenza artificiale sarà decisiva. Un traguardo che solleva domande su latenza, sovranità dei dati e architetture di deployment per chi sviluppa AI su scala nazionale.

Jun 28 2026
Altro

Per accedere all’anteprima di GPT 5.6 Sol servono impronte e passaporto: cosa significa?

Un utente Reddit ha condiviso la procedura di candidatura per l’anteprima di GPT 5.6 Sol: scanner del volto, controllo delle impronte digitali e verifica del passaporto. Un livello di verifica biometrica senza precedenti per testare un LLM. C’è chi ironizza, ma il gesto segnala un cambiamento di paradigma: accesso sempre più blindato ai modelli di frontiera. AI-RADAR analizza le implicazioni per chi sviluppa su stack locali e la crescente tensione tra apertura della ricerca e protezione dell’IP.

Jun 28 2026
Hardware

Tiny PC, grandi passioni: Tarlin lancia capsule toy con licenza dei ‘big four’

L'azienda giapponese Tarlin sigla un accordo con i quattro principali produttori mondiali di componenti PC per creare schede madri, case e CPU in miniatura iper-realistiche da montare e collezionare. Un gadget che unisce nostalgia e passione per l'hardware. AI-RADAR analizza cosa racconta al mercato on-premise: la cultura del fai‑da‑te e del controllo fisico resta un pilastro anche nell'era del cloud.

Jun 28 2026
Altro

Instagram trasforma l’algoritmo in esperienza centrale

Mosseri vuole portare in primo piano 'Your Algorithm', lo strumento per scegliere i temi da vedere. Non più un’impostazione nascosta, ma un pilastro dell’uso quotidiano. La mossa riflette la richiesta di controllo algoritmico e tocca il nodo della sovranità digitale.

Jun 28 2026
Market

Microsoft affida Copilot a un 33enne ex-Snap: ora comanda 11.000 persone

Jacob Andreou, promosso da Satya Nadella dopo un solo anno in Microsoft, ha unificato i team consumer ed enterprise di Copilot, eliminando versioni ridondanti. Sta costruendo una super app che integra chat, coding e un flusso agentivo chiamato Autopilot. La mossa segna una svolta nella strategia AI dell'azienda.

Jun 28 2026
Market

Perché Salesforce promuove un concorrente AI su Slack? La strategia che confonde i dipendenti

L’annuncio di Claude Tag di Anthropic ha scatenato confusione dentro Salesforce: la società, proprietaria di Slack, ha promosso il prodotto sui social nonostante competa con i propri strumenti AI interni. Un cortocircuito strategico che solleva domande più ampie su data sovereignty, controllo dei flussi informativi e sul confine sempre più labile tra piattaforme collaborative e assistenti AI. Per chi valuta deployment on-premise, il caso è emblematico.

Jun 28 2026
Altro

Sunrise: piattaforma energetica integrata per data center AI

Sunrise sviluppa una piattaforma energetica integrata per rispondere ai consumi crescenti dei data center AI. L'iniziativa affronta picchi di carico, raffreddamento e sostenibilità, temi critici per chi ospita LLM in locale. AI-RADAR analizza l'impatto sul TCO e sulle scelte architetturali.

Jun 28 2026
Altro

Kaori vede ordini fuel cell estendersi a un anno e accelera l’espansione produttiva

Il portafoglio commesse di Kaori per celle a combustibile raggiunge orizzonti annuali, mentre l’azienda potenzia gli impianti a Taiwan e all’estero. Un segnale di domanda robusta per la componentistica energetica, con ricadute dirette sul calcolo del TCO per infrastrutture on-premise di AI.

Jun 28 2026
Market

LG Chem valuta più CCL: l’AI fa pressione sulla filiera dei semiconduttori

Il gigante chimico sudcoreano studia l’aumento della produzione di copper clad laminate, materiale chiave per i circuiti stampati di chip AI. La mossa segnala tensioni nella fornitura di componenti essenziali per GPU e acceleratori, con possibili ripercussioni sui tempi e i costi delle infrastrutture on-premise.

Jun 28 2026
Altro

Sfida a Starlink: la joint venture Rakuten-AST SpaceMobile per il Giappone

Rakuten e AST SpaceMobile annunciano una joint venture per fornire banda larga satellitare diretta agli smartphone in Giappone, mirando a contrastare il dominio di Starlink. L'iniziativa si inserisce nella corsa alle costellazioni LEO, con potenziali ricadute per la connettività di sistemi on-premise e carichi di AI distribuiti in aree a bassa copertura terrestre. L'analisi di AI-RADAR evidenzia i collegamenti con la sovranità dei dati e i trade-off infrastrutturali.

Jun 28 2026
LLM

Sfida a due nel benchmark US Ban: OpenAI e Anthropic pareggiano

L'anteprima di GPT 5.6 porta OpenAI in parità con Anthropic nel benchmark US Ban. I modelli cinesi restano indietro, Gemini da aggiornare. Per chi valuta il deployment on-premise, il pareggio sposta l'attenzione su inference, TCO e controllo dei dati, oltre i semplici punteggi.

Jun 28 2026
Altro

Model Registry: i modelli open viaggiano su torrent, Hugging Face fa da riserva

Un nuovo progetto sfrutta file torrent e web seeding per distribuire Large Language Models open source, con Hugging Face come fonte di fallback. L'iniziativa punta a ridurre la dipendenza da CDN centralizzati e abilita scenari di download più resilienti, con potenziali ricadute per deployment self-hosted e ambienti on-premise.

Jun 27 2026
Altro

Modelli open source cinesi: l'unica via d'uscita per l'on-premise?

Un dibattito su Reddit, ripreso da AI-RADAR, mette in guardia: la strategia delle big tech USA di trattenere modelli avanzati potrebbe aprire un varco inaspettato per gli LLM cinesi open source. Per le aziende che puntano su deployment on-premise e sovranità dei dati, lo scenario costringe a riflettere su alternative fino a ieri impensabili.

Jun 27 2026
LLM

Anche Google crede nei modelli piccoli per il coding

Google ha organizzato hackathon per Gemma 4 31B, un LLM compatto che nel cloud raggiunge 1500 token/s, da 50 a 100 volte più di quanto si ottenga in locale. La notizia conferma l’importanza dei modelli ridotti per l’assistenza alla programmazione e apre interrogativi sul divario che i deployment on-premise devono colmare per restare competitivi.

Jun 27 2026
Altro

Dalle risate dei primati alla musica egocentrica: il lato computazionale della scienza

Quattro studi rivelano scoperte eterogenee, dall'evoluzione del riso all'impatto sugli eventi meteo. Ma dietro questi risultati c'è un'esigenza comune: infrastrutture di calcolo capaci di gestire dati complessi, modelli e pipeline. Per i team che valutano l'on-premise, la sovranità dei dati e il TCO diventano centrali.

Jun 27 2026
Market

Il capo di Vision Pro verso OpenAI: cosa significa per l’hardware AI

Paul Meade, il vicepresidente Apple responsabile del visore Vision Pro, lascerebbe l’azienda per unirsi al team hardware di OpenAI. Un passaggio che segnala l’accelerazione di OpenAI sulla progettazione di dispositivi fisici, con potenziali ricadute per l’intero ecosistema dell’AI on-premise e le architetture di calcolo locale.

Jun 27 2026
Altro

Dopo Mythos, anche GPT-5.6 viene frenato: il peso delle richieste governative sui modelli cloud

OpenAI limita il lancio di GPT-5.6 in seguito a una richiesta governativa, dichiarando che le restrizioni non dovrebbero diventare la norma. Il commento su Reddit coglie un punto: è un segnale per i modelli online avanzati, con gli LLM locali che diventano una risposta concreta. Per chi guarda all'on-premise, l'episodio riapre la riflessione su sovranità e controllo.

Jun 27 2026
Altro

FBI: hacker russi leggono i messaggi Signal con le chiavi di backup, inutile cambiare telefono

L’FBI e il CISA mettono in guardia da una nuova escalation: hacker legati all’intelligence russa prendono di mira le chiavi di recupero dei backup di Signal. Una volta ottenuta la chiave con il phishing, gli attaccanti possono ripristinare lo storico messaggi su un proprio dispositivo, aggirando anche la sostituzione del telefono.

Jun 27 2026
LLM

SpectralQuant riduce il gap della quantization Q4_K_M al 96.5%: un salto per i modelli locali

Spectral Labs ha rilasciato una quantization Q4_K_M di Qwen3.5 0.8B con un nuovo metodo calibrato che recupera il 96.5% del divario qualitativo rispetto al BF16, restando identica per dimensioni e compatibilità con llama.cpp. Un risultato che ridisegna le aspettative per l'inference on-premise con footprint ridotto.

Jun 27 2026
Market

OpenAI pesca da Uber India per guidare l'espansione nel suo mercato più grande fuori dagli USA

Prabhjeet Singh, ex presidente di Uber India e Sud Asia, è il primo managing director per l'India di OpenAI. Guiderà crescita consumer, adozione enterprise, partnership e regolamentazione, segnando una mossa che pone il paese al centro della strategia commerciale dell'azienda, con implicazioni forti per sovranità dei dati e deployment on-premise.

Jun 27 2026
Altro

Diagnosi di cancro, combatte con l'AI: il caso Christou accende il dibattito sulla privacy

Connor Christou ha usato Claude per analizzare esami, immagini e dati biometrici durante il suo percorso oncologico. Una scelta potente ma che solleva allarmi sul controllo dei dati sensibili in cloud. Per chi sviluppa in sanità, la lezione è chiara: la sovranità informatica non è un lusso.

Jun 27 2026
Hardware

Intel Nova Lake: 52 core e fino a 474W per il desktop di nuova generazione

Secondo indiscrezioni, la futura CPU Intel Nova Lake a 52 core potrebbe raggiungere un valore di potenza di picco di 474W, imponendo ai costruttori di motherboard LGA1954 l'adozione di tre connettori EPS a 8 pin. Una cifra che ridefinisce i limiti termici e di alimentazione per le postazioni workstation, con ricadute dirette sulle scelte infrastrutturali di chi gestisce server on-premise.

Jun 27 2026
LLM

Da Tokyo e Pechino, due nuovi tool AI che aggirano il blocco export di Anthropic

Sakana AI e 360 Security lanciano modelli di orchestrazione e vulnerability discovery che sostituiscono le soluzioni Anthropic non più esportabili. Un segnale chiaro per chi cerca alternative on-premise in un mercato frammentato.

Jun 27 2026
LLM

ConlangCrafter: l'AI che inventa lingue immaginarie (e potrebbe insegnarci come pensiamo)

Un team di ricercatori ha sviluppato ConlangCrafter, un modello capace di generare linguaggi artificiali rispettando regole fonologiche e morfosintattiche. Più creativo e coerente dei LLM generalisti, lo strumento è già disponibile online e apre nuove strade nello studio delle strutture linguistiche e del loro impatto sui modelli di NLP.

Jun 27 2026
Hardware

4090 e 5090 con 96 GB di VRAM? L'alert dal mondo dei laboratori GPU

Un piccolo laboratorio GPU americano lancia un avviso pubblico: le schede customizzate GeForce RTX 4090 e 5090 con 96 GB di VRAM sono una truffa. A giugno 2026 non esistono chip funzionanti, e chi le propone sfrutta la disperazione di chi cerca GPU ad alta memoria per inference LLM on-premise. Le uniche schede moddate verificate sono le 4090 da 48 GB e le 4080 Super da 32 GB.

Jun 27 2026
Altro

Startup asiatiche lanciano modelli AI 'Mythos-like' sfidando l'export ban USA

Nell'ombra delle restrizioni all'esportazione di tecnicie AI imposte dagli Stati Uniti, startup asiatiche stanno rilasciando modelli con capacità paragonabili a Mythos. Il divieto, che coinvolge Anthropic, sta spingendo lo sviluppo di alternative locali. Per il mercato enterprise, questo segnala un'accelerazione verso la sovranità dei dati e apre scenari inediti per deployment on-premise. AI-RADAR analizza le implicazioni strategiche.

Jun 27 2026
Altro

Linux MD RAID5 migliora la scalabilità fino al 17%: cosa cambia per lo storage on-prem

Una nuova serie di patch per il codice RAID5 di Linux MD promette miglioramenti di scalabilità tra il 10 e il 17% in alcune configurazioni. Un progresso che tocca direttamente le infrastrutture self-hosted, dove l'efficienza dello storage a blocchi incide su TCO e prestazioni di carichi AI.

Jun 27 2026
LLM

Orthrus porta la testa a diffusione su Qwen 3.5/3.6 e Gemma 4: codice open source in arrivo

I modelli Orthrus con head a diffusione stanno per atterrare su Hugging Face, accompagnati dal codice completo di training e evaluation. Una combinazione che può cambiare le carte per chi cerca controllo e sovranità nel self-hosting di LLM, rendendo trasparente l’intero ciclo di vita.

Jun 27 2026
Frameworks

GNOME ora ha un assistente AI che genera immagini: Newelle 1.4.5

Dopo tre anni di sviluppo, Newelle raggiunge la versione 1.4.5 con due novità: il supporto alla generazione di immagini tramite AI e un’interfaccia chat ridisegnata. Un assistente virtuale pensato per l’ecosistema GNOME che riaccende il dibattito sul controllo locale dei dati.

Jun 27 2026
Altro

L’AI del futuro non sarà guidata solo da modelli migliori

Secondo il CEO di Oxylabs, il vero salto non è nei modelli ma nella qualità e freschezza dei dati. Per chi gestisce LLM on-premise, la sovranità informativa e pipeline robuste diventano il nuovo oro.

Jun 27 2026
Hardware

Dal mercato di Shenzhen una RTX 5090 con 96 GB di VRAM: costa 8.200 dollari

Un report da Huaqiangbei conferma l'offerta di GPU GeForce RTX 5090 modificate con 96 GB di VRAM. Il costo totale si aggira sui 8.200 dollari, tra prezzo base della scheda e intervento di sostituzione della memoria. Il confronto con la RTX 6000 professionale mette in luce rischi di garanzia e potenziali benefici per carichi di inference on-premise.

Jun 27 2026
Altro

USA sblocca Mythos 5 di Anthropic per una cerchia ristretta di difensori informatici

Il Dipartimento del Commercio autorizza Anthropic a ripristinare l’accesso a Mythos 5, il modello di cybersecurity più potente dell’azienda, solo per partner fidati. Fable 5 resta oscurato. La mossa segnala un’evoluzione nel controllo governativo degli LLM difensivi e riapre il dibattito su come bilanciare sicurezza e utilità strategica.

Jun 27 2026
Frameworks

Meno sincronizzazioni CUDA in llama.cpp: guadagni prestazionali per l'inference on-prem

Un nuovo commit nel progetto llama.cpp reintroduce una gestione asincrona più aggressiva per i backend CUDA, riducendo le sincronizzazioni tra token e velocizzando la copia dei dati da CPU a GPU. L'ottimizzazione, pensata per migliorare il throughput sui carichi di inference, apre la strada a un'adozione su più backend e semplifica il motore di scheduling. Un passo avanti concreto per chi gestisce LLM su hardware locale.

Jun 27 2026
Hardware

Chip AI: la strozzatura logistica minaccia i piani on-premise

La domanda di acceleratori per AI sta congestionando le spedizioni aeree e marittime, facendo lievitare i costi di trasporto. Per le aziende che puntano su deployment on-premise di LLM, la pressione sulla logistica complica il calcolo del TCO e introduce ritardi nella messa in opera di server e cluster. Uno scenario che obbliga a ripensare le strategie di procurement.

Jun 27 2026
Market

SYM: utili in calo nel 2025 nonostante la quota di mercato record

Il produttore taiwanese di motocicli ha registrato un calo degli utili nel 2025, pur avendo raggiunto la quota di mercato più alta di sempre. Un paradosso che riflette le tensioni del manifatturiero globale e spinge a ripensare le strategie di resilienza operativa.

Jun 27 2026
Hardware

JCET investe 1,1 miliardi: la svolta cinese per i chip AI passa dal packaging

L’espansione da 1,1 miliardi di dollari di JCET nel packaging avanzato indica la strategia cinese per superare le restrizioni sui semiconduttori e garantire la fornitura di acceleratori per l’intelligenza artificiale. Un segnale che per il mercato on-premise la partita decisiva si gioca sull’integrazione di chiplet e memoria ad alta larghezza di banda, ben oltre il singolo nodo produttivo.

Jun 27 2026
LLM

Fine-tuning Qwen: perché i modelli ottimizzati faticano a convincere

Nonostante la popolarità del fine-tuning sui modelli Qwen, mancano riscontri concreti su versioni realmente superiori alla base. Un’indagine sulle possibili cause tecniche e sulle implicazioni per chi valuta deployment on-premise, dove l’adattamento a dati proprietari è cruciale ma rischia di diventare un boomerang senza metriche solide.

Jun 27 2026
Frameworks

DeepSeek V4 Flash e MiniMax M3 su llama.cpp: a che punto è il supporto nativo?

La community attende l'integrazione ufficiale dei modelli DeepSeek V4 Flash e MiniMax M3 in llama.cpp. Le fork offrono soluzioni parziali, ma lo stato non consolidato pone interrogativi sul deployment stabile in ambienti on-premise.

Jun 27 2026
LLM

DeepSeek-V4-Pro-DSpark: il nuovo LLM open source che guarda al deployment locale

DeepSeek pubblica su Hugging Face il modello V4-Pro-DSpark e il paper tecnico DSpark. Un rilascio che alimenta la strategia di chi punta su LLM self-hosted e sovranità dei dati, riducendo la dipendenza dal cloud.

Jun 27 2026
LLM

Ornith-1.0-35B Q3_K_M: 17 GB di VRAM e benchmark verde, la quantization estrema regge

Il modello Ornith-1.0-35B è stato quantizzato a Q3_K_M, scendendo a 16.8 GB su disco e ~17 GiB di VRAM caricata. Verificato con metriche KL divergence e comportamento 14/14, cede solo 16 punti di accordo top-1 rispetto a Q6_K ma dimezza la memoria necessaria. Throughput fino a 493 tok/s su singola GPU con llama.cpp. Tutto open-source su HuggingFace.

Jun 27 2026
LLM

Distillare LLM in proprio per il theorem proving: quando lo stack on-premise batte il cloud

Un utente con fondi per hardware ma non per crediti cloud vuole distillare un LLM per theorem proving su Rocq, dove i modelli scarseggiano. La via on-premise solleva questioni di costo, controllo e specializzazione che meritano un’analisi approfondita.

Jun 27 2026
Hardware

Wiwynn e TE Connectivity raffreddano a liquido le sbarre DC a 800V per i datacenter AI

Al booth di Wiwynn abbiamo visto le nuove sbarre DC a 800V di TE Connectivity con raffreddamento a liquido integrato. Un segnale di come l'infrastruttura di potenza per l'IA stia spingendo oltre i limiti termici convenzionali, con implicazioni dirette su efficienza e densità dei rack on-premise.

Jun 27 2026
LLM

Mythos 5 di Anthropic autorizzato a oltre 100 enti USA: svolta per l'AI sovrana?

L’amministrazione Trump ha concesso a più di 100 aziende e agenzie governative l’uso di Mythos 5 di Anthropic, estendendo i permessi anche ai dipendenti non americani. La mossa accelera l’adozione di LLM in ambiti sensibili e riapre il dibattito su controllo, residenza dei dati e convenienza di un deployment on-premise.

Jun 27 2026
LLM

Anthropic può rilasciare Mythos a organizzazioni USA: il via libera della Casa Bianca

Dopo settimane di negoziati, la Casa Bianca ha autorizzato Anthropic a ripristinare l'accesso al suo modello più avanzato, Mythos, per un gruppo selezionato di aziende e agenzie governative statunitensi. Una decisione che sottolinea il ruolo sempre più strategico dei modelli di frontiera.

← Precedente Page 22 / 160 Successiva →