AI-Radar - Osservatorio su LLM locali, hardware AI e trend

AI-Radar per LLM on-prem & AI in casa

Il radar quotidiano su modelli, framework e hardware per far girare l'AI in locale. LLM, LangChain, Chroma, mini-PC e tutto ciò che serve per un cervello distribuito "in-house".

⚙️ Stack: LLM locali · LangChain · Transformers · ChromaDB · MiniPC · AI boxes
🛰️ Ask Observatory (Q&A + RAG) già collegato all'archivio articoli.
👥 160+ membri · Iscriviti gratis →

⚡ In Tendenza

View All →

🛠️ Guide & Osservatorio On-Premise

🚀 Esegui i modelli in locale → Tutte le guide →

Riferimenti evergreen e pratici per far girare l'AI in locale — hardware, costi, privacy e stack completo.

🖥️ Osservatorio LLM On-Premise Hardware, stack, governance e architetture di riferimento per l'AI in locale.

Ultime analisi & news dal radar

Articoli generati dall'AI sulla base dei feed, con spazio per layer editoriale umano sopra il contenuto grezzo.

Addio pedale del freno per le auto autonome: la mossa Trump e le ricadute sull’AI on-premise
📁 Market AI generated ℹ️ The Next Web

Addio pedale del freno per le auto autonome: la mossa Trump e le ricadute sull’AI on-premise

L’amministrazione Trump propone di eliminare l’obbligo del pedale del freno per i veicoli a guida completamente autonoma. La modifica rimuoverebbe una barriera regolatoria chiave, accelerando il design di mezzi senza comandi umani. Per chi sviluppa AI on-premise, la notizia apre riflessioni su responsabilità, sicurezza e scomparsa del controllo manuale nei sistemi automatici.

2026-06-25 📰 Fonte
Notion chiude Mail: gli agenti AI rimpiazzano l’email tradizionale
📁 Market AI generated ✅ Ars Technica AI

Notion chiude Mail: gli agenti AI rimpiazzano l’email tradizionale

Dopo l’acquisizione di Skiff e il lancio di Notion Mail, l’azienda archivia il client e punta sugli agenti AI. Uno stop che riflette un cambiamento più profondo: l’automazione della posta elettronica passa dai client alle intelligenze artificiali, con implicazioni per chi gestisce dati in proprio.

2026-06-25 📰 Fonte
Sarah Wynn-Williams fa causa a Meta: la battaglia per non essere messa a tacere
📁 Altro AI generated ℹ️ The Next Web

Sarah Wynn-Williams fa causa a Meta: la battaglia per non essere messa a tacere

L'ex dirigente e autrice del memoir Careless People porta in tribunale l'azienda di Menlo Park, accusandola di azioni legali volte a sopprimere la sua voce. Il caso segnala tensioni profonde su controllo e trasparenza, con risvolti per chi architetta infrastrutture AI orientate alla sovranità dei dati.

2026-06-25 📰 Fonte
Anthropic accusa Alibaba: il più grande attacco mai misurato per clonare Claude
📁 Altro AI generated ✅ Ars Technica AI

Anthropic accusa Alibaba: il più grande attacco mai misurato per clonare Claude

Un’operazione da 28,8 milioni di scambi, quasi 25mila account fraudolenti e l’obiettivo di estrarre capacità di ragionamento agentico e ingegneria del software. L’incidente solleva interrogativi sulla protezione dei modelli esposti via API e rafforza il caso per deployment on-premise in scenari sensibili.

2026-06-25 📰 Fonte
Unconventional AI lancia Un-0: architettura a oscillatori per un consumo energetico mille volte inferiore
📁 Hardware AI generated ℹ️ The Next Web

Unconventional AI lancia Un-0: architettura a oscillatori per un consumo energetico mille volte inferiore

La startup fondata da Naveen Rao ha rilasciato un sistema di generazione immagini che gira su una nuova architettura di calcolo a oscillatori, promettendo consumi drasticamente ridotti. L’approccio potrebbe ridefinire i parametri di costo ed efficienza per il deployment on-premise e edge dell’AI generativa, anche se restano incognite tecniche da chiarire.

2026-06-25 📰 Fonte
Perché una banca ha bisogno di un Chief Scientist?
📁 Altro AI generated 🏆 IEEE Spectrum

Perché una banca ha bisogno di un Chief Scientist?

Prem Natarajan ha lasciato la guida di Alexa AI per diventare Chief Scientist di Capital One. La banca statunitense investe in ricerca scientifica per andare oltre i modelli di fondazione e costruire AI affidabile, in tempo reale e rispettosa della privacy, un cambio di passo che ridefinisce il ruolo della scienza nei servizi finanziari.

2026-06-25 📰 Fonte
Sail raccoglie 80 milioni per dimezzare il costo degli agenti AI
📁 Altro AI generated ℹ️ The Next Web

Sail raccoglie 80 milioni per dimezzare il costo degli agenti AI

La startup Sail Research, fondata da ex ingegneri Apple e NVIDIA, promette di servire i token consumati dagli agenti AI a costi fino a 10 volte inferiori. Un round da 80 milioni di dollari accende i riflettori sulla corsa per rendere sostenibile l'inference su larga scala.

2026-06-25 📰 Fonte
Netris raccoglie 15 milioni da a16z per sbloccare il networking che frena i cluster GPU
📁 Altro AI generated ℹ️ The Next Web

Netris raccoglie 15 milioni da a16z per sbloccare il networking che frena i cluster GPU

La startup di Santa Clara ha ottenuto un Series A guidato da Andreessen Horowitz dopo una crescita del +800% dell’ARR e oltre 35 installazioni live. L’automazione dello strato di rete promette di ridurre la complessità nei data center GPU, un tema caldo per chi sposta training e inference on-premise. AI-RADAR analizza le implicazioni per la latenza, la sovranità e il costo totale di possesso.

2026-06-25 📰 Fonte
Coval raccoglie 28 milioni per stressare gli agenti vocali AI
📁 Market AI generated ℹ️ The Next Web

Coval raccoglie 28 milioni per stressare gli agenti vocali AI

Coval raccoglie 28 milioni di dollari per mettere alla prova gli agenti vocali AI prima del contatto con gli utenti. Il fondatore replica l’approccio safety-critical di Waymo, segnalando una crescente attenzione alla robustezza dei modelli vocali. Per chi valuta deployment on-premise, la necessità di test locali e affidabili diventa un tassello strategico.

2026-06-25 📰 Fonte
Dai LLM alle teorie: i test causali generativi spiegano il cervello
📁 LLM AI generated 🏆 Microsoft Research

Dai LLM alle teorie: i test causali generativi spiegano il cervello

Un team internazionale ha sviluppato il Generative Causal Testing, un framework che distilla i modelli black-box di predizione cerebrale in spiegazioni verbali verificabili. I test fMRI confermano le ipotesi e portano alla luce nuove micro-regioni corticali, offrendo una strada per riunire modelli predittivi e scienza interpretabile.

2026-06-25 📰 Fonte
Nasce ARX Industries: produzione di massa di robot terrestri per l’Ucraina
📁 Altro AI generated ℹ️ Tech.eu

Nasce ARX Industries: produzione di massa di robot terrestri per l’Ucraina

La tedesca ARX Robotics e l’ucraina Roboneers hanno dato vita a ARX Industries, joint venture per industrializzare la produzione del veicolo terrestre senza pilota Rys Pro. L’obiettivo è consegnare migliaia di unità già nel primo anno, scalando verso decine di migliaia annuali, per coprire evacuazione, logistica, sminamento e combattimento. Sostenuta da Berlino e Kiev, l’operazione rafforza la sovranità difensiva europea.

2026-06-25 📰 Fonte
Toyota tallona GM grazie all’ibrido: la vera partita si gioca sull’AI on-premise
📁 Altro AI generated ℹ️ The Next Web

Toyota tallona GM grazie all’ibrido: la vera partita si gioca sull’AI on-premise

Le ultime proiezioni di Cox Automotive accorciano il distacco tra Toyota e General Motors nella corsa alle vendite USA. Mentre l’ibrido avanza e l’elettrico puro arranca, il sorpasso non è solo una questione di motori: dietro le quinte si delinea una competizione parallela sull’infrastruttura di calcolo per lo sviluppo software e la guida autonoma, dove il controllo dei dati spinge sempre più case verso architetture on-premise.

2026-06-25 📰 Fonte
Esplosione dei costi token: nemmeno chi vende AI sa misurarne l’efficacia
📁 Market AI generated ℹ️ Tom's Hardware

Esplosione dei costi token: nemmeno chi vende AI sa misurarne l’efficacia

Un audio trapelato da uno studio di consulenza rivela che le aziende faticano a calcolare il ritorno degli investimenti in intelligenza artificiale generativa, mentre la corsa al "tokenmaxxing" — l'uso massiccio di token per spremere gli LLM — fa lievitare i costi di inference. Un campanello d'allarme per chi valuta deployment on-premise: senza metriche interne, il controllo della spesa resta un miraggio.

2026-06-25 📰 Fonte
Ornith-1.0: nuova famiglia di LLM su Hugging Face, dal dense 9B al MoE 397B
📁 LLM AI generated ℹ️ LocalLLaMA

Ornith-1.0: nuova famiglia di LLM su Hugging Face, dal dense 9B al MoE 397B

DeepReinforce AI pubblica quattro modelli con architetture dense e Mixture of Experts. Dichiarati risultati SOTA sui benchmark, ma la cautela è d'obbligo: i test indipendenti diranno se le prestazioni reggono. Per i carichi on-premise, la famiglia offre un ventaglio raro di taglie, aprendo scenari di deployment granulare.

2026-06-25 📰 Fonte
Netris incassa 15 milioni da a16z per accelerare i neocloud AI
📁 Altro AI generated ✅ TechCrunch AI

Netris incassa 15 milioni da a16z per accelerare i neocloud AI

Il round Serie A guidato da Andreessen Horowitz finanzia la piattaforma software per switch di rete che riduce i tempi di attivazione dei servizi cloud dedicati all'intelligenza artificiale. La mossa segnala la crescente importanza dell'infrastruttura di rete per i carichi di lavoro AI, anche in ottica on-premise.

2026-06-25 📰 Fonte
Linux 7.2 elimina il driver PROFIBUS: codice del 1998 dimenticato da anni
📁 Altro AI generated ✅ Phoronix

Linux 7.2 elimina il driver PROFIBUS: codice del 1998 dimenticato da anni

Il kernel Linux 7.2 ha rimosso il driver per il bus di campo PROFIBUS, codice originariamente importato da SCO Unix nel 1998 e rimasto senza manutenzione per anni. L’operazione rientra nella strategia di sfoltimento dei componenti obsoleti, mirata a ridurre il carico di manutenzione e i rischi di sicurezza. Per chi gestisce infrastrutture on-premise, la rimozione ricorda l’importanza di monitorare le dipendenze dai driver e valutare il ciclo di vita dell’hardware, soprattutto in ambienti industriali legacy.

2026-06-25 📰 Fonte
TokenSpeed-Kernel: l’inference LLM diventa multi-silicio con API portabili e kernel performanti
📁 Frameworks AI generated ✅ PyTorch Blog

TokenSpeed-Kernel: l’inference LLM diventa multi-silicio con API portabili e kernel performanti

Un nuovo sottosistema open source separa il runtime dai kernel hardware-specifici, consentendo a modelli come GPT-OSS 120B di girare su AMD e NVIDIA con la stessa API pubblica. Le prestazioni su MI355X mostrano guadagni fino a 3.6x rispetto a Triton, senza sacrificare la portabilità. Per chi ospita modelli on-premise, l'architettura a plugin disaccoppia l’ottimizzazione hardware dalla logica di serving: un tassello per la sovranità multi-fornitore.

2026-06-25 📰 Fonte
Chamath Palihapitiya: Meta ha perso l’occasione nell’IA
📁 Market AI generated ℹ️ The Next Web

Chamath Palihapitiya: Meta ha perso l’occasione nell’IA

L’investitore e co-host di All-In ha dichiarato ad Axios che Meta ha "perso il vantaggio" nell’intelligenza artificiale, liquidando le paure di un’apocalisse occupazionale e definendo i propri incentivi SPAC "grossolanamente disallineati". Un giudizio che pesa molto nel mondo dei modelli aperti e delle strategie on-premise.

2026-06-25 📰 Fonte
RTX 5070 Ti a $899: il prezzo giusto per l’AI on-premise?
📁 Hardware AI generated ℹ️ Tom's Hardware

RTX 5070 Ti a $899: il prezzo giusto per l’AI on-premise?

La nuova RTX 5070 Ti è disponibile a $899, con un risparmio di $220 rispetto al prezzo al dettaglio. Un’occasione per ridurre la barriera economica all’inference locale di LLM, tra sovranità dei dati e costi operativi.

2026-06-25 📰 Fonte
Campionatore con verifica: il trucco che potenzia i piccoli LLM senza cambiare i pesi
📁 LLM AI generated ℹ️ LocalLLaMA

Campionatore con verifica: il trucco che potenzia i piccoli LLM senza cambiare i pesi

Un nuovo approccio che combina un campionatore con backtrack e un modello verificatore della stessa dimensione consente a un LLM da 0,5 miliardi di parametri di raggiungere prestazioni di coding paragonabili a modelli 2-4 volte più grandi. Il prezzo da pagare è il raddoppio della VRAM, un aumento del carico computazionale tra 1,5 e 3 volte e un rallentamento del 5-30% nella decodifica. La tecnica, integrabile in llama.cpp ma non prevista per vLLM o SGLang, apre prospettive concrete per il self-hosting di modelli più piccoli e affidabili.

2026-06-25 📰 Fonte
Serpier raccoglie 1,4 milioni: l'agente Navi conquista i chatbot e ridisegna il marketing e-commerce
📁 Market AI generated ℹ️ Tech.eu

Serpier raccoglie 1,4 milioni: l'agente Navi conquista i chatbot e ridisegna il marketing e-commerce

La startup danese Serpier ha chiuso un round da 1,4 milioni di euro per potenziare la sua piattaforma che ottimizza la presenza dei retailer online su motori di ricerca e chatbot basati su LLM. L'agente Navi gestisce già analisi, contenuti e pubblicazione, mentre l'azienda prepara l'estensione a landing page e campagne automatizzate.

2026-06-25 📰 Fonte
Apple ingloba lo Swift Package Index: addio dipendenza da GitHub
📁 Altro AI generated ✅ The Register AI

Apple ingloba lo Swift Package Index: addio dipendenza da GitHub

Apple ha preso il controllo del motore di ricerca per pacchetti Swift, mantenendolo open source ma annunciando un distacco progressivo da GitHub. Il progetto punta a un registro autonomo con firma dei pacchetti e maggiore sicurezza, mentre la community soppesa i benefici dell’accelerazione contro la perdita di indipendenza del progetto.

2026-06-25 📰 Fonte
Upwind lancia un sensore AI per endpoint: la sicurezza segue l’intelligenza artificiale sui dispositivi
📁 Altro AI generated ℹ️ The Next Web

Upwind lancia un sensore AI per endpoint: la sicurezza segue l’intelligenza artificiale sui dispositivi

La startup israeliana Upwind ha annunciato l’AI Sensor for Endpoints, pensato per monitorare in tempo reale le interazioni tra strumenti di AI e dati aziendali direttamente sui dispositivi degli sviluppatori. Mentre i team di sicurezza faticano a tracciare i flussi di dati tra prompt, modelli e sistemi interni, questa soluzione segna un’evoluzione nella protezione periferica, con ricadute concrete per chi gestisce LLM in locale e deve presidiare il fattore umano sull’edge.

2026-06-25 📰 Fonte
Adobe acquisisce Topaz Labs: l’enhancement AI arriva in Creative Cloud
📁 Market AI generated ✅ TechCrunch AI

Adobe acquisisce Topaz Labs: l’enhancement AI arriva in Creative Cloud

L’integrazione degli strumenti di Topaz Labs nelle app Adobe porta il miglioramento di immagini e video basato su AI direttamente nel flusso di lavoro dei creativi. Mentre il dettaglio tecnico resta da definire, la mossa riaccende il dibattito sull’inference locale rispetto al cloud, la sovranità dei dati e le esigenze hardware per chi lavora con modelli di enhancement sempre più sofisticati.

2026-06-25 📰 Fonte
Anthropic accusa Alibaba di distillazione illecita del Claude: 25mila account falsi e 28,8 milioni di interazioni
📁 Altro AI generated ℹ️ Tom's Hardware

Anthropic accusa Alibaba di distillazione illecita del Claude: 25mila account falsi e 28,8 milioni di interazioni

Secondo Anthropic, la società cinese avrebbe utilizzato decine di migliaia di identità fittizie per estrarre il comportamento del modello Claude, violando i termini di servizio. L’episodio solleva interrogativi sulla sicurezza delle API cloud e rafforza l’attrattiva del deployment on-premise per chi cerca sovranità sui dati.

2026-06-25 📰 Fonte
Rimosse le app VK, il Cremlino esige spiegazioni da Apple (e un cambio di OS)
📁 Altro AI generated ℹ️ The Next Web

Rimosse le app VK, il Cremlino esige spiegazioni da Apple (e un cambio di OS)

La scomparsa delle app del gruppo russo VK dall’App Store ha scatenato la reazione del Cremlino: il portavoce Peskov chiede spiegazioni e consiglia il passaggio ad altri sistemi operativi. L’episodio mostra come la dipendenza da un ecosistema chiuso possa diventare vulnerabilità geopolitica, spingendo organizzazioni e Stati a riconsiderare le proprie infrastrutture digitali in ottica di sovranità e controllo on-premise.

2026-06-25 📰 Fonte
Qualcomm: chip data center per la Cina, Dragonfly acceleratori AI depotenziata
📁 Hardware AI generated ℹ️ Tom's Hardware

Qualcomm: chip data center per la Cina, Dragonfly acceleratori AI depotenziata

Qualcomm pianifica una nuova linea di chip per data center, Dragonfly, specifica per il mercato cinese. Gli acceleratori AI saranno intenzionalmente depotenziate per rispettare le soglie di prestazione imposte dai controlli all'esportazione statunitensi. Una mossa che segnala l'adattamento dell'industria dei semiconduttori alla crescente frammentazione tecnicica tra USA e Cina, con implicazioni dirette per chi gestisce infrastrutture on-premise nel paese asiatico.

2026-06-25 📰 Fonte
Solare diretto ai data center: la scelta cinese che scavalca la rete
📁 Altro AI generated ℹ️ The Next Web

Solare diretto ai data center: la scelta cinese che scavalca la rete

Nel deserto del Ningxia, quattro linee dedicate portano energia da un campo fotovoltaico a un cluster di calcolo, senza passare dalla rete pubblica. Pechino spinge l’industria dei data center verso questa strada, con implicazioni dirette su sovranità energetica, TCO e affidabilità per chi gestisce carichi AI on-premise.

2026-06-25 📰 Fonte
Michigan, una township ferma fabbrica cinese di batterie: ora rischia la bancarotta
📁 Altro AI generated ℹ️ The Next Web

Michigan, una township ferma fabbrica cinese di batterie: ora rischia la bancarotta

Green Charter Township, 3.000 anime, ha revocato il consiglio comunale e bloccato un investimento da 2,36 miliardi di dollari per una fabbrica di batterie per veicoli elettrici. Ora l’azienda cinese minaccia di far fallire la piccola comunità. La vicenda mostra quanto sia fragile la costruzione di infrastrutture on-premise quando la politica locale non è allineata, un monito per chi progetta data center AI e impianti critici.

2026-06-25 📰 Fonte
Russia sblocca iPhone attivista con Cellebrite, nonostante la società avesse 'lasciato'
📁 Altro AI generated ℹ️ The Next Web

Russia sblocca iPhone attivista con Cellebrite, nonostante la società avesse 'lasciato'

Un'unità governativa russa ha violato l'iPhone di un politico detenuto usando uno strumento forense di Cellebrite, tre mesi dopo che l'azienda israeliana aveva annunciato il ritiro dal Paese. La vicenda solleva interrogativi su come gli strumenti digitali, una volta venduti, sfuggano al controllo del fornitore e su quali garanzie cercare per proteggere i dati sensibili.

2026-06-25 📰 Fonte
N26 tocca il primo utile annuale ma la sfida è l’infrastruttura
📁 Market AI generated ℹ️ Tech.eu

N26 tocca il primo utile annuale ma la sfida è l’infrastruttura

La challenger bank tedesca chiude il 2025 con un attivo netto di 1,6 milioni di euro, grazie al boom delle transazioni e al contenimento dei costi. Dietro il risanamento resta il nodo della compliance regolatoria e delle scelte architetturali che sempre più banche affrontano quando valutano dove far girare i propri dati e i futuri LLM.

2026-06-25 📰 Fonte
IBM svela i transistor nanostack: oltre il nanometro si sale in verticale
📁 Hardware AI generated ✅ ServeTheHome

IBM svela i transistor nanostack: oltre il nanometro si sale in verticale

IBM ha presentato l’architettura nanostack, pensata per guidare la costruzione di chip nell’era sub-nanometrica del prossimo decennio. L’idea: impilare i wafer per ottenere transistor più densi e prestazioni superiori, un cambio di paradigma che potrebbe ridefinire il silicio per l’IA on-premise.

2026-06-25 📰 Fonte
IBM annuncia il transistor a 0,7 nm: primo nodo sub-1 nm, ma occhio ai nomi
📁 Hardware AI generated ℹ️ The Next Web

IBM annuncia il transistor a 0,7 nm: primo nodo sub-1 nm, ma occhio ai nomi

IBM ha realizzato la prima architettura a transistor con nodo inferiore a 1 nm, a 0,7 nm (7 ångström). Un traguardo simbolico che però impone cautela: le etichette dei nodi produttivi non corrispondono più a misure fisiche. Dietro l'annuncio si intrecciano progressi nella litografia e promesse di maggiore efficienza, aspetti destinati a influenzare, nel lungo periodo, anche l'hardware per carichi IA on-premise.

2026-06-25 📰 Fonte
Oracle taglia 500 posti in Romania: il cloud e l'AI ridefiniscono l'azienda
📁 Market AI generated ℹ️ The Next Web

Oracle taglia 500 posti in Romania: il cloud e l'AI ridefiniscono l'azienda

Nuovo round di licenziamenti in Oracle: circa 500 dipendenti romeni sono stati colpiti da una riorganizzazione legata alla transizione verso cloud e intelligenza artificiale. È il secondo taglio in Romania in poco tempo e si inserisce in una strategia globale che ridisegna il profilo della multinazionale.

2026-06-25 📰 Fonte
AMD porta ONNX Runtime in FFmpeg: inference video senza cloud
📁 Frameworks AI generated ✅ Phoronix

AMD porta ONNX Runtime in FFmpeg: inference video senza cloud

AMD ha contribuito un backend ONNX Runtime per il filtro DNN di FFmpeg, consentendo di eseguire modelli AI direttamente su GPU e NPU per compiti come upscaling e object detection. L’integrazione rafforza le opzioni di inference locale, riducendo la dipendenza dal cloud e migliorando la sovranità dei dati per le pipeline video.

2026-06-25 📰 Fonte
Berlino, Almetra alza 16,3 milioni per trasformare i video di fabbrica in dati in tempo reale
📁 Altro AI generated ℹ️ The Next Web

Berlino, Almetra alza 16,3 milioni per trasformare i video di fabbrica in dati in tempo reale

La startup Almetra ha chiuso un round Serie A da 16,3 milioni di euro per la sua piattaforma che filma le linee produttive e converte i video in informazioni operative live. Già adottata da Bosch e ABB, ora punta al mercato americano. L'elaborazione locale garantisce sovranità dei dati e bassa latenza, temi centrali per chi valuta architetture on-premise per carichi di AI.

2026-06-25 📰 Fonte
Linux 7.2 ancora alle prese con la 'bestia' Realtek RTL8723BS, in staging da un decennio
📁 Altro AI generated ✅ Phoronix

Linux 7.2 ancora alle prese con la 'bestia' Realtek RTL8723BS, in staging da un decennio

A quasi dieci anni dall’inserimento in staging, il driver WiFi Realtek RTL8723BS resta il grande incompiuto del kernel Linux. Le pulizie di codice dominano la pull request per la 7.2, mentre la community cerca di portarlo nel sottosistema networking ufficiale, sollevando questioni su affidabilità e manutenzione per i dispositivi embedded.

2026-06-25 📰 Fonte
Framework AI in Europa: il costo nascosto che la politica non cancella
📁 Altro AI generated ✅ DigiTimes

Framework AI in Europa: il costo nascosto che la politica non cancella

Non bastano le normative per colmare il divario hardware che frena l'intelligenza artificiale europea. Mentre USA e Cina accelerano, il continente affronta costi di GPU, energia e data center che limitano la sovranità tecnicica. Un'analisi delle implicazioni per chi deve mantenere i dati in sede.

2026-06-25 📰 Fonte
La corsa all'AI fa volare l'elettronica di Taiwan: produzione +93% nei primi 5 mesi del 2026
📁 Market AI generated ✅ DigiTimes

La corsa all'AI fa volare l'elettronica di Taiwan: produzione +93% nei primi 5 mesi del 2026

La produzione elettronica di Taiwan registra un balzo record del 93% nei primi cinque mesi del 2026, spinta dalla domanda di hardware per AI. Un’impennata che ridefinisce la filiera globale e ha implicazioni dirette per chi guarda al deployment on-premise degli LLM: dall’espansione della capacità produttiva di GPU e server alla gestione dei costi energetici.

2026-06-25 📰 Fonte
Qualcomm svela HBC: architettura near-memory per gli acceleratori AI250 e AI350
📁 Hardware AI generated ℹ️ Tom's Hardware

Qualcomm svela HBC: architettura near-memory per gli acceleratori AI250 e AI350

Qualcomm ha presentato l’architettura near-memory HBC e i nuovi acceleratori AI250 e AI350, rivendicando un’efficienza di banda per watt 6 volte superiore a HBM e una capacità 200 volte maggiore rispetto alla SRAM on-chip. Un annuncio che punta a ridefinire l’efficienza dell’inference AI per carichi di lavoro on-premise e edge.

2026-06-25 📰 Fonte
IBM rivendica il primo chip 'sub-1 nanometro': 100 miliardi di transistor per l'AI
📁 Hardware AI generated ✅ Ars Technica AI

IBM rivendica il primo chip 'sub-1 nanometro': 100 miliardi di transistor per l'AI

La nuova architettura nanostack di IBM promette densità di transistor quasi doppia e un salto di efficienza energetica, ridefinendo le possibilità di deployment on-premise per carichi di lavoro AI. Non si tratta di transistor fisicamente inferiori al nanometro, ma di un equivalente prestazionale che evita i limiti quantistici, aprendo scenari inediti per data center locali.

2026-06-25 📰 Fonte
← Precedente Page 34 / 123 Successiva →
Vedi Archivio Completo 🗄️

AI-Radar is an independent observatory covering AI models, local LLMs, on-premise deployments, hardware, and emerging trends. We provide daily analysis and editorial coverage for developers, engineers, and organizations exploring local AI solutions.

AI-RADAR badge LaunchTry LAUNCHING SOON ON LaunchTry Fazier badge