AI-Radar - Osservatorio su LLM locali, hardware AI e trend

AI-Radar per LLM on-prem & AI in casa

Il radar quotidiano su modelli, framework e hardware per far girare l'AI in locale. LLM, LangChain, Chroma, mini-PC e tutto ciò che serve per un cervello distribuito "in-house".

⚙️ Stack: LLM locali · LangChain · Transformers · ChromaDB · MiniPC · AI boxes
🛰️ Ask Observatory (Q&A + RAG) già collegato all'archivio articoli.
👥 160+ membri · Iscriviti gratis →

⚡ In Tendenza

View All →

🛠️ Guide & Osservatorio On-Premise

🚀 Esegui i modelli in locale → Tutte le guide →

Riferimenti evergreen e pratici per far girare l'AI in locale — hardware, costi, privacy e stack completo.

🖥️ Osservatorio LLM On-Premise Hardware, stack, governance e architetture di riferimento per l'AI in locale.

Ultime analisi & news dal radar

Articoli generati dall'AI sulla base dei feed, con spazio per layer editoriale umano sopra il contenuto grezzo.

Spiro e lo scambio batterie: la lezione per l’IA on-premise
📁 Altro AI generated ℹ️ The Next Web

Spiro e lo scambio batterie: la lezione per l’IA on-premise

La startup africana raccoglie 55 milioni di dollari per il suo modello di battery swapping. Una storia che rivela le stesse dinamiche di chi gestisce carichi LLM in locale: risorse limitate, costi di attesa, e la necessità di un’infrastruttura efficiente.

2026-06-22 📰 Fonte
Talkin’ Things ottiene il sostegno di Orbit Capital: la tracciabilità RFID diventa un asset per l’on-premise
📁 Market AI generated ℹ️ Tech.eu

Talkin’ Things ottiene il sostegno di Orbit Capital: la tracciabilità RFID diventa un asset per l’on-premise

Il produttore europeo di tag RFID Talkin’ Things ha ricevuto finanziamento di debito da Orbit Capital per accelerare la crescita in un mercato spinto da digitalizzazione retail, logistica automatizzata e regolamenti come il Digital Product Passport UE. La tecnicia, pur pensata per retail e farmaceutico, abilita scenari di tracciamento asset nei data center on-premise, migliorando controllo operativo e conformità.

2026-06-22 📰 Fonte
Paradosso verde: la Cina spinge le rinnovabili per l’AI ma la rete non tiene il passo
📁 Altro AI generated ℹ️ The Next Web

Paradosso verde: la Cina spinge le rinnovabili per l’AI ma la rete non tiene il passo

La corsa cinese ad alimentare i data center per l’intelligenza artificiale con fonti rinnovabili si scontra con l'incostanza di sole e vento. Le GPU che eseguono LLM richiedono carichi stabili 24/7, mettendo sotto pressione una rete già fragile. Per chi valuta deployment on-premise, l'equazione energetica — tra sostenibilità e affidabilità — diventa centrale nel calcolo del TCO e nella sovranità operativa.

2026-06-22 📰 Fonte
llama.cpp accelera l'inference locale con il supporto Multi-Token Prediction per i modelli Step Flash
📁 Frameworks AI generated ℹ️ LocalLLaMA

llama.cpp accelera l'inference locale con il supporto Multi-Token Prediction per i modelli Step Flash

Un nuovo pull request nel repository llama.cpp estende il supporto per la previsione multi-token (MTP), una tecnica che accorcia i tempi di inference. La novità, focalizzata sui modelli Step3.5/3.7 Flash, segna un ulteriore passo verso l'efficienza nell'AI self-hosted, riducendo il carico computazionale senza sacrificare la qualità del testo generato.

2026-06-22 📰 Fonte
Seedcamp alza 320 milioni: il venture capital europeo scommette su AI e sovranità digitale
📁 Market AI generated ℹ️ The Next Web

Seedcamp alza 320 milioni: il venture capital europeo scommette su AI e sovranità digitale

Il fondo londinese Seedcamp ha chiuso un round da 320 milioni di dollari per rafforzare il suo ponte transatlantico. Con un portafoglio che include realtà come Fluidstack e Synthesia, l’operazione segnala un crescente interesse del capitale di rischio verso l’infrastruttura AI, con possibili ricadute sulle scelte di deployment on-premise e sul controllo della filiera hardware.

2026-06-22 📰 Fonte
Quando il boom dei chip AI rischia di drogare il mattone: l’allarme dalla Corea
📁 Market AI generated ℹ️ The Next Web

Quando il boom dei chip AI rischia di drogare il mattone: l’allarme dalla Corea

Il responsabile della politica economica sudcoreana mette in guardia: la pioggia di miliardi generata dai semiconduttori per l’intelligenza artificiale può surriscaldare il mercato immobiliare. Un campanello d’allarme che, nella prospettiva di AI‑RADAR, interroga chi pianifica deployment on‑premise: la corsa ai chip si traduce in costi hardware più alti e pressioni sulla supply chain.

2026-06-22 📰 Fonte
Seedcamp chiude un round da 320 milioni e scommette sul ponte USA per le startup AI
📁 Market AI generated ℹ️ Tech.eu

Seedcamp chiude un round da 320 milioni e scommette sul ponte USA per le startup AI

Il venture capital londinese Seedcamp, noto per aver sostenuto Revolut e Synthesia, ha raccolto 320 milioni di dollari. Il capitale sarà distribuito tra un fondo seed e un fondo growth, con una nuova sede a New York per creare un “ponte transatlantico”. L’operazione segnala la maturità dell’ecosistema AI europeo e solleva questioni cruciali su sovranità dei dati e opzioni on-premise per le startup che scalano oltreoceano.

2026-06-22 📰 Fonte
Hermes Agent, quando l'UX zoppica l'inference locale
📁 Frameworks AI generated ℹ️ LocalLLaMA

Hermes Agent, quando l'UX zoppica l'inference locale

Un’esperienza d’uso deludente può minare anche i framework più promettenti. Il caso Hermes Agent mostra come interfaccia e reattività restino nodi critici per chi adotta stack on-premise, specie se affiancato a modelli come Qwen3.6-35B e Gemma4-26B. Percezione, latenza e design impattano la produttività reale, oltre le spec tecniche.

2026-06-22 📰 Fonte
Isometric raccoglie 40 milioni per certificare l’industria con l’AI
📁 Market AI generated ℹ️ The Next Web

Isometric raccoglie 40 milioni per certificare l’industria con l’AI

La startup londinese Isometric ha ottenuto un finanziamento di 40 milioni di dollari per portare l’intelligenza artificiale nei processi di certificazione industriale. Un settore finora governato da controlli manuali e a campione trova nell’AI una scorciatoia per velocità e scala, ma i requisiti di riservatezza impongono architetture on-premise e modelli ottimizzati per l’edge.

2026-06-22 📰 Fonte
Google perde il co-lead di Gemini: va in OpenAI per la ricerca sui modelli
📁 Market AI generated ✅ DigiTimes

Google perde il co-lead di Gemini: va in OpenAI per la ricerca sui modelli

Un vicepresidente dell'ingegneria e co-responsabile di Gemini lascia Google per entrare in OpenAI e dedicarsi alla ricerca sulla costruzione di modelli. Il passaggio mette in luce la competizione per i talenti nel settore degli LLM e solleva interrogativi su come le innovazioni nell'efficienza e nell'architettura dei modelli potranno influenzare chi valuta deploy on-premise.

2026-06-22 📰 Fonte
Componenti auto da Taiwan: ripresa prevista nel 2H26 grazie a distensione dazi e geopolitica
📁 Market AI generated ✅ DigiTimes

Componenti auto da Taiwan: ripresa prevista nel 2H26 grazie a distensione dazi e geopolitica

I produttori taiwanesi di componenti per auto prevedono un ritorno alla crescita nella seconda metà del 2026, scommettendo su un allentamento delle tensioni tariffarie e geopolitiche globali. Secondo DIGITIMES, il settore si prepara a superare le incertezze degli ultimi anni, riportando gli investimenti e la produzione su un sentiero di espansione.

2026-06-22 📰 Fonte
La Cina apre il mercato STAR alle aziende di AI per alimentare la corsa ai capitali
📁 Market AI generated ✅ DigiTimes

La Cina apre il mercato STAR alle aziende di AI per alimentare la corsa ai capitali

Il nuovo canale di quotazione per le imprese che sviluppano modelli di intelligenza artificiale segnala la volontà di Pechino di sostenere il settore con capitali pubblici e accelera la competizione tecnicica globale. Le implicazioni per l’ecosistema hardware e per le strategie di deployment on‑premise si intrecciano con la spinta alla sovranità tecnicica.

2026-06-22 📰 Fonte
L'AI fisica sposta l'asticella: dai robot a funzionalità ai robot realmente intelligenti
📁 Hardware AI generated ✅ DigiTimes

L'AI fisica sposta l'asticella: dai robot a funzionalità ai robot realmente intelligenti

La colonna di DIGITIMES segnala un passaggio epocale nella robotica: non più automi rigidi con funzioni predefinite, ma macchine capaci di comprendere l'ambiente e adattarsi grazie all'AI integrata. Questa evoluzione impone hardware di inference locale, nuove metriche di progettazione e un ripensamento dell'architettura software, con vincoli stringenti di latenza, consumi e sovranità dei dati.

2026-06-22 📰 Fonte
Toto scommette sui materiali per semiconduttori: l’AI spinge verso il nodo a 1nm
📁 Hardware AI generated ✅ DigiTimes

Toto scommette sui materiali per semiconduttori: l’AI spinge verso il nodo a 1nm

Fonti indicano che Toto rafforza gli investimenti in materiali avanzati per chip, mentre la domanda di intelligenza artificiale accelera la transizione ai processi a 1 nanometro. L’impatto si annuncia significativo per l'hardware dedicato ai LLM, con benefici potenziali per i deployment on-premise in termini di efficienza e costi.

2026-06-22 📰 Fonte
Intel e AMD svelano ACE, la riscossa x86 contro l’avanzata di Arm
📁 Hardware AI generated ✅ DigiTimes

Intel e AMD svelano ACE, la riscossa x86 contro l’avanzata di Arm

Le due rivali storiche mettono da parte le divergenze per contrastare l’ascesa di Arm nei data center. L’annuncio congiunto segna una nuova fase nella guerra delle architetture, con possibili ripercussioni su TCO, sovranità dei dati e deployment on-premise per carichi AI.

2026-06-22 📰 Fonte
Intel e Nvidia sviluppano insieme un processore PC: debutto previsto al CES 2028
📁 Hardware AI generated ✅ DigiTimes

Intel e Nvidia sviluppano insieme un processore PC: debutto previsto al CES 2028

Secondo DIGITIMES, Intel e Nvidia starebbero lavorando a un processore PC congiunto che potrebbe vedere la luce al CES 2028. Al di là delle indiscrezioni ancora sottili, l’idea di un chip frutto della collaborazione tra le due rivali di Santa Clara segnala un possibile riassetto della competizione nell’hardware per l’intelligenza artificiale, con ricadute concrete per chi cerca soluzioni di inference locale e deployment on-premise.

2026-06-22 📰 Fonte
La supply chain del foldable Apple si prepara: obiettivo lancio nel 2026
📁 Market AI generated ✅ DigiTimes

La supply chain del foldable Apple si prepara: obiettivo lancio nel 2026

Digitimes riferisce che i fornitori Apple stanno già predisponendo le linee produttive per un iPhone pieghevole previsto per il 2026. La mossa segnala la crescente maturità del segmento foldable e le ambizioni dell'azienda di Cupertino in un mercato finora dominato da Samsung.

2026-06-22 📰 Fonte
Samsung System LSI in rosso: i chip Exynos frenano la divisione, quali effetti sull'AI on-device?
📁 Market AI generated ✅ DigiTimes

Samsung System LSI in rosso: i chip Exynos frenano la divisione, quali effetti sull'AI on-device?

Il presidente Park Yong-In conferma le continue perdite dei SoC System LSI, con impatti visibili fino al 2026. La divisione arranca nella competizione mobile, mettendo a rischio innovazioni chiave per l'AI edge: Exynos e i chip affini vedranno meno investimenti, mentre la domanda di inference LLM locale cresce. Uno scenario che ridefinisce il panorama hardware per deployment on-premise di modelli linguistici su dispositivi mobili e gateway.

2026-06-22 📰 Fonte
MiTAC al Computex 2026: raffreddamento a diamante e rack 52U per l’era on-prem
📁 Hardware AI generated ✅ ServeTheHome

MiTAC al Computex 2026: raffreddamento a diamante e rack 52U per l’era on-prem

Al Computex 2026 MiTAC ha mostrato sistemi GPU, storage e server con raffreddamento a diamante, fino a rack da 52 unità. Uno sguardo al futuro dell'hardware per l'inference LLM on-premise, dove densità e gestione termica ridefiniscono i trade-off tra TCO, sovranità e controllo dell'infrastruttura.

2026-06-22 📰 Fonte
GPU AMD GCN: Valve guida il miglioramento del recovery su Linux
📁 Hardware AI generated ✅ Phoronix

GPU AMD GCN: Valve guida il miglioramento del recovery su Linux

Il team di driver open-source di Valve sta portando un recovery più robusto per le GPU AMD Graphics Core Next (GCN) in caso di freeze. Un passo avanti per la stabilità delle vecchie schede su Linux, con ricadute concrete per chi esegue carichi on-premise senza interruzioni.

2026-06-22 📰 Fonte
Tongtai entra nell’hardware AI e nei semiconduttori: cosa cambia per chi fa inference locale
📁 Hardware AI generated ✅ DigiTimes

Tongtai entra nell’hardware AI e nei semiconduttori: cosa cambia per chi fa inference locale

Con un nuovo vertice, il costruttore taiwanese di macchine utensili punta ad aerospazio, IA e chip. La mossa si inserisce nella corsa alla sovranità tecnicica e alla catena di fornitura per l’hardware on-premise: componentistica di precisione, raffreddamento e attrezzature per semiconduttori diventano snodi critici per chi valuta il TCO dell’inference locale.

2026-06-21 📰 Fonte
Samsung scommette sull’AI di OpenAI: ChatGPT Enterprise e Codex per tutti
📁 Market AI generated 🏆 OpenAI Blog

Samsung scommette sull’AI di OpenAI: ChatGPT Enterprise e Codex per tutti

L’azienda coreana porta ChatGPT Enterprise e Codex a tutti i dipendenti nel mondo, segnando una delle più estese adozioni enterprise di OpenAI. Una mossa che accelera l’ingresso dell’AI generativa nelle grandi organizzazioni, ma riapre il dibattito su cloud, sovranità dei dati e costi di scala.

2026-06-21 📰 Fonte
La comunità dei self-hoster e quel grazie inaspettato nel giorno del papà
📁 Altro AI generated ℹ️ LocalLLaMA

La comunità dei self-hoster e quel grazie inaspettato nel giorno del papà

Un post di ringraziamento su Reddit ricorda che dietro l'hardware e i dibattiti sulla quantization ci sono persone che condividono una passione. Per chi sceglie deployment on-premise, il supporto informale di una comunità è spesso la risorsa più preziosa. Un augurio che diventa occasione per riflettere su collaborazione e isolamento tecnico.

2026-06-21 📰 Fonte
zlib-rs 0.6.4: correzione crash Raptor Lake e ottimizzazioni SIMD
📁 Frameworks AI generated ✅ Phoronix

zlib-rs 0.6.4: correzione crash Raptor Lake e ottimizzazioni SIMD

La libreria Rust per la compressione Zlib si aggiorna con ottimizzazioni SIMD e una correzione critica per i processori Intel Raptor Lake. Un passo avanti nella corsa a librerie di sistema più sicure e performanti, con ricadute per chi gestisce infrastrutture on-premise.

2026-06-21 📰 Fonte
Come addestrare un LLM da 500M parametri con 800 dollari: il progetto HobbyLM e la via locale all'IA
📁 LLM AI generated ℹ️ LocalLLaMA

Come addestrare un LLM da 500M parametri con 800 dollari: il progetto HobbyLM e la via locale all'IA

Un singolo sviluppatore ha creato da zero un modello linguistico da 500 milioni di parametri e un generatore di immagini da 330 milioni, spendendo solo 800 dollari in calcolo cloud. Il progetto HobbyLM dimostra come la pre-formazione su dataset pubblici e l’uso di GPU di fascia alta in cloud rendano accessibile la creazione di modelli piccoli ma funzionali. Il rilascio dei pesi in formato GGUF apre la strada al deployment on-premise, con implicazioni per la sovranità dei dati e il Total Cost of Ownership.

2026-06-21 📰 Fonte
TikTok, il 60% dei contenuti per nuovi utenti è spazzatura generata dall’AI
📁 LLM AI generated ℹ️ The Next Web

TikTok, il 60% dei contenuti per nuovi utenti è spazzatura generata dall’AI

Un’analisi della piattaforma di editing video Kapwing mostra che quasi sei clip su dieci nel feed “For You” di account freschi sono slop prodotti da AI. Il dato solleva interrogativi sulla moderazione e spinge a ripensare le strategie di rilevamento, anche in chiave on-premise, dove il controllo sui dati e la latenza fanno la differenza.

2026-06-21 📰 Fonte
Due Radeon R9700 spingono un LLM da 27B: i numeri di una build on-premise
📁 Hardware AI generated ℹ️ LocalLLaMA

Due Radeon R9700 spingono un LLM da 27B: i numeri di una build on-premise

Un server con due GPU Radeon AI PRO R9700 e 64 GB di VRAM totale mette alla prova Qwen 3.6 27B in quantization Q8 con Multi-Token Prediction. Decode fino a 67 token/s su contesti pieni, prefill oltre 1.500 t/s e prompt caching efficiente: uno spaccato concreto per chi valuta deployment locale di LLM senza dipendere dal cloud.

2026-06-21 📰 Fonte
La stretta su Anthropic accende i riflettori sull’on-premise
📁 Altro AI generated ✅ TechCrunch AI

La stretta su Anthropic accende i riflettori sull’on-premise

L’ultima mossa dell’amministrazione Trump contro Anthropic, discussa nel podcast Equity, non è solo una questione politica. Per le aziende che valutano dove far girare i propri LLM, la vicenda segnala un rischio concreto: la dipendenza da provider cloud può diventare un collo di bottiglia strategico quando la regolamentazione si fa imprevedibile. Il controllo diretto dell’infrastruttura torna al centro della partita.

2026-06-21 📰 Fonte
Modder ingegnoso raffredda una RTX 3060 con una macchina del ghiaccio: -62% in gioco
📁 Hardware AI generated ℹ️ Tom's Hardware

Modder ingegnoso raffredda una RTX 3060 con una macchina del ghiaccio: -62% in gioco

Un appassionato ha convertito una macchina per il ghiaccio da banco in un sistema di raffreddamento per una RTX 3060, regolato da un termostato da frigo per birra. Il risultato? Temperature ridotte fino al 62% nei giochi, con Cyberpunk 2077 che viaggia a 22°C. Una trovata estrema che riaccende il dibattito sul thermal management per l’hardware ad alte prestazioni.

2026-06-21 📰 Fonte
MiniMax M3 on-premise: 19 token/s su 8 MI50, ma gli agenti sono ancora lontani
📁 Hardware AI generated ℹ️ LocalLLaMA

MiniMax M3 on-premise: 19 token/s su 8 MI50, ma gli agenti sono ancora lontani

Un test su GPU AMD MI50 del 2018 con MiniMax M3 quantizzato a 4 bit raggiunge 19 token/s su 8 schede e 18 token/s su 16, grazie al decoding speculativo. Ma la latenza elevata (oltre 70 secondi per il primo token su prompt lunghi) e la generazione interminabile del ragionamento rendono l’esperienza inadatta allo sviluppo agentivo. I dati offrono uno sguardo concreto sulle possibilità e i limiti dell’hardware datacenter di vecchia generazione per il deployment locale di LLM.

2026-06-21 📰 Fonte
GMKtec EVO-X3: il mini PC AI porta la firma di Lisa Su e il cuore AMD Strix Halo
📁 Hardware AI generated ℹ️ Tom's Hardware

GMKtec EVO-X3: il mini PC AI porta la firma di Lisa Su e il cuore AMD Strix Halo

GMKtec ha svelato una versione ridisegnata del suo EVO-X3, una workstation AI in formato mini PC basata sul potente processore AMD Ryzen AI Max+ 395 'Strix Halo'. Il dispositivo esibisce la firma di Lisa Su, CEO di AMD, segnale di una stretta collaborazione e di un’offerta pensata per chi cerca elevate prestazioni di inference locale in un corpo compatto.

2026-06-21 📰 Fonte
I super-bonus a chi fabbrica chip diventano un rischio per l’inflazione: il caso Corea
📁 Market AI generated ℹ️ Tom's Hardware

I super-bonus a chi fabbrica chip diventano un rischio per l’inflazione: il caso Corea

La Banca di Corea avverte: le retribuzioni straordinarie erogate da Samsung e SK hynix ai dipendenti del settore semiconduttori stanno alimentando la dinamica dei prezzi, con l’inflazione 2024 destinata a superare nettamente il target del 2%. Una pressione che, dalla supply chain hardware, può incidere direttamente sul Total Cost of Ownership di chi gestisce infrastrutture per LLM on-premise.

2026-06-21 📰 Fonte
Capre di Age of Empires II usate per una rete neurale: l'ironico esperimento sulla coscienza AI
📁 LLM AI generated ℹ️ Tom's Hardware

Capre di Age of Empires II usate per una rete neurale: l'ironico esperimento sulla coscienza AI

Un ricercatore Microsoft ha costruito una rete neurale utilizzando i capri del videogioco Age of Empires II come elementi base. L’obiettivo? Dimostrare in modo assurdo che attribuire coscienza ai chatbot è fuorviante quanto pensare che un gregge di capre virtuali stia davvero elaborando pensieri. Una riflessione che interpella anche le aziende che valutano il deployment on-premise di LLM.

2026-06-21 📰 Fonte
ASUS Ascent GX10: Recensione Completa del Supercomputer AI da Scrivania
📁 General Editoriale

ASUS Ascent GX10: Recensione Completa del Supercomputer AI da Scrivania

The artificial intelligence industry is currently witnessing a violent correction in compute strategy: the retreat from total cloud-dependency back toward localized, high-performance "AI on Premises." The ASUS Ascent GX10 is the tip of this spear.

2026-06-21
Linux KUnit ora genera output JUnit: più facile integrare il testing del kernel nella CI
📁 Frameworks AI generated ✅ Phoronix

Linux KUnit ora genera output JUnit: più facile integrare il testing del kernel nella CI

Il framework di unit testing del kernel Linux, KUnit, ora supporta l'output in formato JUnit. Ispirato originariamente a JUnit, KUnit consente finalmente ai team di sviluppo di integrare il testing del kernel nelle pipeline di continuous integration senza conversioni manuali. Per chi gestisce infrastrutture on-premise – dai server tradizionali ai nodi per l'inference di LLM – la standardizzazione del reporting migliora la stabilità del sistema operativo e semplifica le pratiche di validazione automatica.

2026-06-21 📰 Fonte
Hacker bucano il sistema di allerta brasiliano e diffondono misantropia su milioni di telefoni
📁 Altro AI generated ℹ️ The Next Web

Hacker bucano il sistema di allerta brasiliano e diffondono misantropia su milioni di telefoni

Nella notte di venerdì, un attacco informatico ha violato la piattaforma nazionale di protezione civile del Brasile, inviando falsi allarmi estremi con la parola 'misantropi4' a milioni di dispositivi mobili in sette stati. Il sistema è stato spento d'urgenza, mentre la polizia federale indaga sull'accaduto. L'intrusione riporta al centro del dibattito la sicurezza delle infrastrutture critiche e i rischi legati a piattaforme centralizzate di comunicazione d'emergenza.

2026-06-21 📰 Fonte
La lobby dei taxi ferma Waymo a New York: la politica blocca l’innovazione
📁 Market AI generated ℹ️ The Next Web

La lobby dei taxi ferma Waymo a New York: la politica blocca l’innovazione

Nonostante oltre 500mila corse a settimana in 10 città USA e un’espansione internazionale, Waymo resta fuori da New York. Non c’entra la tecnicia: sindacati e politici locali hanno alzato un muro. Una lezione su come le barriere normative ridefiniscano il percorso dell’intelligenza artificiale, portando a rivalutare il controllo diretto delle infrastrutture.

2026-06-21 📰 Fonte
AutoRound: il metodo di quantization che tutti ignorano (ma perché?)
📁 LLM AI generated ℹ️ LocalLLaMA

AutoRound: il metodo di quantization che tutti ignorano (ma perché?)

Sperimentando con un modello Qwen3.6 da 27 miliardi di parametri su hardware AMD, un utente ha notato che AutoRound conserva perplexity e accuratezza a bassa precisione molto meglio di AWQ o RTN. Eppure su Hugging Face quasi nessuno lo usa. Il motivo non è tecnico, ma di percezione: il logo Intel allontana chi crede sia legato a Gaudi. Ora che esporta nativamente in GGUF, è un’occasione persa per chi fa deployment on-premise.

2026-06-21 📰 Fonte
Linux 7.2 prepara la strada alle GPU NVIDIA "Blackwell-Next"
📁 Hardware AI generated ✅ Phoronix

Linux 7.2 prepara la strada alle GPU NVIDIA "Blackwell-Next"

Nei preparativi per il merge window di Linux 7.2, spunta un primo, discreto accenno al supporto per la prossima generazione di GPU NVIDIA, di cui ancora nulla si sa. Un indizio che conta per chi gestisce infrastrutture on-premise e guarda già ai refresh del parco hardware.

2026-06-21 📰 Fonte
Qwen chiude i battenti all'open source: cosa significa per lo stack locale
📁 Market AI generated ℹ️ LocalLLaMA

Qwen chiude i battenti all'open source: cosa significa per lo stack locale

Dopo il licenziamento di Junyang Lin, Qwen non ha più rilasciato modelli aperti. Il laboratorio di Alibaba è ora l'ultimo tra i grandi player cinesi a tenere chiuso il suo 3.7, mentre concorrenti come DeepSeek e GLM continuano a pubblicare. Una scelta che riduce le opzioni per chi deve fare deployment on-premise e mantenere il controllo sui dati.

2026-06-21 📰 Fonte
SupraLabs inaugura la famiglia Any2Any: un Transformer da 30 milioni di parametri fonde testo e immagini in un flusso unico di token
📁 LLM AI generated ℹ️ LocalLLaMA

SupraLabs inaugura la famiglia Any2Any: un Transformer da 30 milioni di parametri fonde testo e immagini in un flusso unico di token

Supra-A2A-Nano-Exp è un prototipo da ~30M parametri che tratta testo, immagini e video come una singola sequenza di token, senza encoder visivi o moduli di diffusione. Un esperimento di radicale semplificazione che interroga gli stack on-premise sull’effettiva necessità di pipeline complesse. Open-source, con pesi in FP32 e contesto da 384 token, mostra come la multimodalità possa ridursi a puro language modeling.

2026-06-21 📰 Fonte
← Precedente Page 40 / 123 Successiva →
Vedi Archivio Completo 🗄️

AI-Radar is an independent observatory covering AI models, local LLMs, on-premise deployments, hardware, and emerging trends. We provide daily analysis and editorial coverage for developers, engineers, and organizations exploring local AI solutions.

AI-RADAR badge LaunchTry LAUNCHING SOON ON LaunchTry Fazier badge