🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15931

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Jul 07 2026
Market

Una startup spaziale porta la ricerca anti-età in orbita per addestrare l'AI

Un laboratorio in microgravità invierà dati per modelli predittivi sulle proteine coinvolte in Alzheimer e cancro. L'iniziativa segnala un incrocio crescente tra biotech, spazio e infrastrutture di calcolo specializzate.

Jul 07 2026
Altro

Haaland è ovunque ai Mondiali (grazie all’AI), ma la verità ora serve on-premise

L’attaccante norvegese non è in Qatar, ma la sua versione sintetica invade i social. Il fenomeno mostra come l’AI generativa stia diventando infrastruttura culturale, imponendo a media e aziende un ripensamento della verifica dei contenuti e, per chi cerca controllo, un ritorno al deployment locale.

Jul 07 2026
Hardware

XBM di Intel: niente interposer, stack DRAM e riparazione integrata per l'AI

Un brevetto Intel mostra XBM, un'architettura di memoria che impila DRAM con transistor posteriori e usa collegamenti UCIe, eliminando il costoso interposer di silicio tipico dell'HBM. Il design include meccanismi di riparazione integrati per migliorare l'affidabilità. L'obiettivo è alleviare il collo di bottiglia della banda di memoria nei carichi di lavoro AI, un vincolo critico per l'inference on-premise di LLM su larga scala.

Jul 07 2026
Altro

IBM manda in pensione il driver EHEA 10Gb: il crepuscolo dei server POWER legacy in un mondo Linux che corre avanti

Con il kernel Linux 7.3, IBM rimuove il driver per le interfacce Ethernet 10Gb delle vecchie macchine POWER. Un gesto simbolico che segnala la fine del supporto vendor, costringendo chi ha carichi on-prem a rivedere le strategie di manutenzione a lungo termine.

Jul 07 2026
Altro

Luffy AI incassa 8,1 milioni per l’AI che impara in fabbrica senza mandare dati in cloud

Il round Series A guidato da BGF punta su reti neurali sparse che si adattano al volo nei motori industriali, con un occhio a droni e robotica. Un segnale per chi progetta AI fisica on-premise: meno dipendenza dal cloud, più controllo sui dati.

Jul 07 2026
Market

Samsung vola a 89 trilioni di won: la memoria per AI domina il trimestre

Samsung ha guidato un utile operativo trimestrale di 89,4 trilioni di won, 19 volte superiore a un anno fa e record assoluto per il tech. La domanda di memoria per AI è il motore. AI-RADAR analizza cosa significa per chi valuta deployment on-premise: la corsa alla larghezza di banda può ridefinire costi e sovranità dei dati.

Jul 07 2026
Altro

Audex-30B-A3B: l'LLM MoE di NVIDIA che ora fonde voce e testo per il self-hosting

NVIDIA mette a disposizione Audex-30B-A3B, un LLM a mistura di esperti da 30 miliardi di parametri che estende Nemotron-Cascade-2 all'audio senza regredire nelle capacità testuali. Il modello supporta recognition, traduzione, sintesi vocale e generazione audio, con contesto fino a 1 milione di token e doppia modalità thinking/instruct. L'architettura MoE tiene attivi solo 3 miliardi di parametri per token, ma per l'uso on-premise restano da valutare i requisiti di VRAM complessivi, soprattutto con contesti lunghi.

Jul 07 2026
Hardware

AI server e MacBook fanno decollare Quanta: un segnale per l'hardware on-premise

Quanta Computer registra un fatturato record grazie all’impennata di server per intelligenza artificiale e alla domanda di MacBook. Un segnale che va oltre i numeri: la corsa all’infrastruttura AI sta ridisegnando la catena di fornitura hardware, con effetti strutturali per chi valuta deployment locale di LLM.

Jul 07 2026
Altro

Carichi IA e 5G in Asia: l’upload (e la latenza) diventano il vero banco di prova

L’analisi Ookla svela che le reti mobili APAC gestiscono i modelli testuali senza scossoni, ma cedono sotto i carichi di IA conversazionale e visione multimodale. Upload insufficienti, latenza sotto carico e jitter nel routing verso il cloud impongono un ripensamento: l’inference si sposta sull’edge per garantire prestazioni stabili e sovranità dei dati.

Jul 07 2026
Altro

Whering alza 7 milioni, l'AI nell'armadio accende il dibattito su dove gira l'inference

Whering, piattaforma di guardaroba digitale con 10 milioni di utenti, ottiene 7M da eBay Ventures e Google AI Futures Fund per funzionalità AI come raccomandazione outfit, scansione foto e prova virtuale. Ma la raccolta dati su abbigliamento, umore e sensazioni solleva la questione cruciale: l'inference deve restare on-device o migrare nel cloud?

Jul 07 2026
Altro

L’energia costa cara nelle ore di punta: la lezione dei frigoriferi per l’AI on-premise

Gyre Energy ha raccolto 1,3 milioni per insegnare ai magazzini frigoriferi a evitare i picchi dei prezzi elettrici. Lo stesso principio investe i data center locali che ospitano modelli linguistici: la bolletta energetica non è mai neutrale e chi sceglie il self-hosting deve leggerne i segnali per contenere il TCO.

Jul 07 2026
Altro

I primi veicoli autonomi americani combattono in Ucraina

Forterra ha schierato oltre 100 veicoli terrestri autonomi in Ucraina, i primi di produzione americana a entrare in combattimento. Il passaggio dal laboratorio al campo segna un punto di svolta per l'inference on-premise estrema, con hardware che deve operare senza nuvola in scenari contestati. Un banco di prova che ridisegna le priorità della difesa sull'AI locale.

Jul 07 2026
Altro

Dalla strategia alla produzione, il baratro che TechEx 2026 proverà a colmare

Migliaia di dirigenti tech si incontrano ad Amsterdam per affrontare il nodo più spinoso dell’AI enterprise: non i budget o le roadmap, ma il passaggio in produzione. Un divario che parla di infrastrutture, dati e scelte di deployment.

Jul 07 2026
Market

BIZAY raccoglie 55 milioni: il consolidamento del custom printing punta su AI e sovranità dei dati

Il round Serie D prepara l'espansione negli Stati Uniti e un'aggressiva campagna acquisizioni nel frammentato mercato dei prodotti personalizzati. Dietro i numeri, emerge una scommessa sull'infrastruttura AI locale per blindare design e dati dei clienti enterprise.

Jul 07 2026
Altro

HuggingBay: l'ironia di Reddit diventa strumento per il self-hosting dei modelli

Dalla community di LocalLLaMA nasce HuggingBay, un progetto che concretizza il bisogno di condividere Large Language Models al di fuori delle piattaforme ufficiali. L'iniziativa segnala una spinta verso infrastrutture decentralizzate e mette in luce i limiti dei repository centralizzati, con ricadute dirette sulla sovranità dei dati e sul deployment on-premise.

Jul 07 2026
LLM

Quando l'LLM crolla al quarto turno: Qwen 3.6 27B e l'illusione dell'agente self-hosted

Un report da Reddit mostra come Qwen 3.6 27B, eseguito su singola RTX 6000 con llama.cpp, perda coerenza dopo quattro turni in task agentici, mentre il più grande Qwen 3.5 122B rimane stabile. Il caso svela una tensione critica nei deployment self-hosted: la creatività nel singolo prompt non equivale all’affidabilità multi-turno, con implicazioni su TCO e strategie di quantization.

Jul 07 2026
Altro

Microsoft sotto accusa per il data center AI: la questione ambientale diventa un nodo strategico

Una causa in Wisconsin contesta l’impatto acustico e luminoso del nuovo data center AI di Microsoft. Dietro la disputa locale si profila una tensione sistemica tra espansione cloud e accettazione sociale, con implicazioni dirette per chi valuta deployment on-premise come leva di controllo e sostenibilità.

Jul 07 2026
Hardware

Geckos punta sui materiali per l'AI oltre le polveri di nano rame e le guide d'onda CPO

Geckos esplora soluzioni avanzate per l'hardware AI, spingendosi oltre il nano rame e le guide d'onda CPO. Un segnale di come l'innovazione nei materiali stia diventando un fattore competitivo per l'inference on-premise, dove gestione termica e bandwidth sono colli di bottiglia sempre più critici.

Jul 07 2026
Market

ARC Intelligence raccoglie 4 milioni per la finanza AI, e la prossima sfida è dove processare i dati

La berlinese ARC Intelligence chiude un seed da 4 milioni di euro per la sua Finance OS AI-native, che connette ERP e sistemi aziendali. Il round finanzia sviluppo e integrazioni, ma per i clienti regolamentati la questione dirimente sarà l’architettura di deployment: cloud o on-premise?

Jul 07 2026
Altro

Porelio scala i filtri FOMS: il futuro del cooling sostenibile nei data center on-prem

La startup tedesca Porelio ha raccolto 2,4 milioni di euro per industrializzare la produzione di silici mesoporose funzionalizzate (FOMS). Il processo continuo promette di catturare metalli preziosi e PFAS dall’acqua. Per l’infrastruttura AI on-prem, materiali del genere potrebbero rendere più efficiente e sostenibile il raffreddamento dei cluster GPU, grazie alla depurazione on-site dei circuiti di raffreddamento.

Jul 07 2026
Altro

Auxilius raccoglie €1,3M: l’automazione della compliance si avvicina al self-hosting

La startup tedesca Auxilius ha chiuso un round pre-seed per sviluppare software che trasforma policy e regolamenti in codice deterministico. L'operazione segnala un'evoluzione del settore GRC verso sistemi che girano in locale, spinta dalle esigenze di sovranità di banche e industrie.

Jul 07 2026
Altro

Panora ottiene 5 milioni: l'AI per broker assicurativi tra controllo e conformità

La startup francese Panora ha raccolto 5 milioni di dollari per la sua piattaforma AI che automatizza i workflow amministrativi dei broker assicurativi. Con crittografia a livello di azienda e auditabilità delle operazioni, il sistema promette di ridurre l'immissione manuale di dati e i colli di bottiglia operativi, mantenendo il rispetto delle normative europee e ampliando il mercato.

Jul 07 2026
Hardware

Chip AI: startup giapponese supera la validazione e punta alla produzione di massa

Una startup giapponese, con il supporto di Oppstar e UMC, ha completato la validazione del suo chip per l’AI, avvicinandosi alla produzione di massa. Il traguardo segna un nuovo tassello nel panorama degli acceleratori custom, in un momento di forte domanda di alternative ai chip tradizionali per l’inference on-premise.

Jul 07 2026
Altro

Hyundai Rotem verso il treno a idrogeno: i costi di Foshan e l’impatto sull’AI

Hyundai Rotem punta a lanciare il treno a idrogeno nel 2029, mentre il caso Foshan in Cina solleva dubbi sulla sostenibilità economica. Una questione che tocca anche l’infrastruttura AI: chi valuta l’idrogeno per l’alimentazione di data center on-premise deve confrontarsi con le stesse incognite di costo e maturità tecnicica.

Jul 07 2026
Hardware

Climax si quota sull’onda degli ordini USA-Europa: il wireless che abilita l’AI edge

Lo specialista taiwanese del wireless Climax Technology si prepara al listing sulla scia di ricavi record nel primo semestre 2026, trainati da Stati Uniti ed Europa. La notizia segnala un’accelerazione della domanda di connettività periferica, tassello sempre più strategico per chi sposta inference e raccolta dati fuori dal cloud, in ottica di sovranità e latenza.

Jul 07 2026
LLM

Qwen 3.6 27B si sgretola nei task agentici: la prova su RTX 6000 con llama.cpp

La versione ridotta del modello di Alibaba eccelle nei prompt singoli ma non mantiene la coerenza nei flussi multi-turno. I test in locale su una NVIDIA RTX 6000 rivelano errori ogni quattro interazioni, costringendo a tornare al Qwen 3.5 122B per carichi agentici. Il fallimento riapre il dibattito sulle metriche di valutazione e sulle aspettative nei deployment on-premise.

Jul 07 2026
Market

Adlink segna un trimestre da record: l'edge AI sposta il baricentro dell'inference

Adlink ha riportato ricavi trimestrali senza precedenti, trainati dall’edge AI. Il dato segnala un’accelerazione strutturale verso l’elaborazione locale dell’intelligenza artificiale, con conseguenze per la sovranità dei dati, le architetture hardware e le strategie cloud.

Jul 07 2026
Altro

La rete USA non regge l'AI: Taiwan macina ordini, l'on-premise come approdo sicuro

L’esplosione della domanda energetica dei datacenter AI americani mette sotto pressione la rete elettrica, prolungando il boom di ordini per i produttori taiwanesi di alimentatori e raffreddamento. Ma questo collo di bottiglia infrastrutturale segnala un punto di svolta: la corsa al gigantismo cloud sbatte contro limiti fisici, spingendo le aziende verso deployment on-premise più efficienti, sovrani e a TCO prevedibile. AI-RADAR analizza le implicazioni di secondo ordine per chi valuta l’AI self-hosted.

Jul 07 2026
Altro

AI multimodale contro fake news e violenza: il framework che anticipa le crisi

Un nuovo framework NLP multimodale combina XLM-RoBERTa e CLIP con meccanismi di attenzione e dati geospaziali per rilevare disinformazione e rischi di violenza di massa. Testato su oltre 138 mila campioni bilingue, ha raggiunto il 98% di accuratezza. L’approccio apre scenari concreti per sistemi di early warning on-premise, ma pone vincoli stringenti su hardware, latenza e sovranità dei dati.

Jul 07 2026
LLM

FCPA: il training che allinea i LLM alle loro stesse valutazioni

Un nuovo metodo di addestramento, FCPA, riduce il divario tra le risposte generate da un LLM e il suo stesso giudizio di validità. I miglioramenti su IFEval e HumanEval raggiungono +27 punti percentuali di correlazione, preservando la qualità del validatore. Un passo verso modelli più affidabili per chi li esegue in locale.

Jul 07 2026
Frameworks

QuantFlow: il modello Mamba che porta previsioni on-premise senza cedere dati

Un framework di previsione probabilistico unisce Mamba bidirezionale, regressione quantilica e apprendimento federato per ottenere errori contenuti su serie finanziarie, energetiche e meteo, aprendo la strada a scenari in cui i dati sensibili restano sempre locali.

Jul 07 2026
Altro

Audit di sicurezza: la fragilità nascosta che inganna i benchmark degli LLM

Uno studio smaschera cinque classi di fallimento negli audit di validità basati su perturbazioni, spesso usati come prova nei framework di governance. I risultati diventano inaffidabili per dettagli implementativi invisibili, un problema critico per chi esegue modelli on-premise e punta sulla sovranità dei dati.

Jul 07 2026
LLM

Prompt batte parametri: perché i modelli piccoli ora guidano l'AI in contesti opachi

Un nuovo studio mostra che la qualità del prompt è più determinante della scala del modello nel fornire assistenza AI in contesti parzialmente osservabili. Con il giusto contesto, un modello da 2 miliardi di parametri eguaglia o supera uno da 4, aprendo la strada a deployment on-premise efficienti ed economici.

Jul 07 2026
LLM

Pluralismo interno: perché i confronti a coppie non bastano per addestrare l'AI

Un nuovo modello formale mostra che le persone valutano le regole decisionali con priorità multiple e potenzialmente conflittuali. I confronti a coppie locali falliscono nel catturare principi globali come proporzionalità o equità, e forzare risposte può distorcere le preferenze. Consentire l'indecisione accelera l'apprendimento. Implicazioni dirette per il fine-tuning di LLM on-premise.

Jul 07 2026
Hardware

La domanda AI spinge i prezzi delle memorie: nuovi rincari nel Q3 2026

Il mercato delle memorie rimane rovente: nonostante le attese di un calo, la domanda legata all’AI impone aumenti freschi nella seconda metà del 2026. Per chi investe in hardware on-premise per LLM, il costo di GPU e server rischia di lievitare ancora, ridefinendo i calcoli di convenienza economica.

Jul 07 2026
Hardware

Kyber, il rumor del ritardo e la smentita Nvidia: perché non cambia i piani di chi fa on-premise

Una voce su un presunto slittamento della piattaforma rack Kyber di Nvidia è stata subito smentita. Ma anche fosse vera, per chi costruisce infrastrutture self-hosted l’impatto sarebbe minimo: le vere variabili sono software, maturità dell’ecosistema e sovranità dei dati, non la finestra di rilascio di un singolo componente hardware.

Jul 07 2026
Altro

Anthropic sigla con TeraWulf un leasing infrastrutturale da 19 miliardi di dollari

L’accordo ventennale segna il passaggio dal cloud ai data center controllati direttamente, con TeraWulf che da ex miner Bitcoin si trasforma in fornitore di capacità per l’AI. Una mossa che ridisegna equilibri tra hyperscaler, hardware vendor e startup dell’intelligenza artificiale.

Jul 07 2026
Hardware

Domanda di server AI: componenti di potenza introvabili, attesa fino a 270 giorni

L’impennata degli ordini di server per l’intelligenza artificiale sta strozzando la fornitura di semiconduttori di potenza, con tempi di consegna saliti a 270 giorni. Il collo di bottiglia colpisce chi punta su deployment on-premise, dove GPU assetate di energia dipendono da regolatori e convertitori sempre più rari. Aumentano costi, ritardi e il rischio di dover rinunciare alla sovranità dei dati, mentre i grandi cloud provider consolidano il vantaggio.

Jul 07 2026
Hardware

TSMC AI bottleneck: l'effetto domino sulla supply chain

La capacità produttiva di TSMC non regge l'urto della domanda di chip per l'IA. L'onda si propaga a cascata: dai fornitori alternativi ai ripensamenti delle architetture, fino alle decisioni di deployment on-premise e al riemergere di logiche di sovranità tecnicica.

Jul 07 2026
Altro

AI: il collo di bottiglia ora è l'infrastruttura, e il divario geopolitico si allarga

Il vero limite dell’intelligenza artificiale non sono più i chip, ma la capacità di costruire e alimentare i data center. Mentre la Cina adotta una pianificazione centralizzata, gli Stati Uniti procedono in ordine sparso tra conflitti locali. La disponibilità di energia e gli ostacoli normativi stanno ridisegnando la competizione globale.

Jul 07 2026
Market

SYM vede il mercato motociclistico taiwanese salire fino al 10% nel 2026

Il produttore taiwanese SYM prevede una crescita fino al 10% per il mercato interno delle due ruote entro il 2026. Un segnale di vitalità economica che s’inserisce nel più ampio ecosistema tech dell’isola, da cui dipendono le catene globali dell’hardware per AI.

Jul 07 2026
Hardware

Samsung cavalca il boom delle memorie AI: gli utili volano e l’on-premise sale di livello

L'utile operativo di Samsung Electronics esplode nel secondo trimestre grazie alla domanda di memorie ad alta larghezza di banda per l’AI. Per chi adotta LLM autogestiti, la corsa alle HBM segnala un punto di svolta: costi hardware in rialzo, catene di fornitura sotto pressione e la necessità di ricalibrare il TCO di deployment che devono garantire sovranità dei dati.

Jul 07 2026
Altro

Taiwan spinge i robot da cura: il vuoto legale spiana la strada all’AI on-premise

La carenza di personale spinge Taipei verso robot di assistenza, ma la mancanza di regole su responsabilità e privacy dei dati finisce per premiare l’inference locale a scapito del cloud. Un’analisi delle implicazioni strutturali per chi sviluppa e sceglie hardware di computing on-device.

Jul 07 2026
Market

Scooter elettrici a Taiwan: fra shortage e domanda debole, un campanello per il mondo AI

Il mercato taiwanese degli scooter elettrici scivola verso il 2026 con colli di bottiglia produttivi e consumi in calo. Una dinamica che si intreccia con la catena globale dei semiconduttori e offre spunti inattesi per chi pianifica deployment on-premise di LLM.

Jul 07 2026
Altro

Microsoft spinge l’AV1 via DX12 in Mesa 26.2: encoding accelerato per i carichi video on-premise

Gli ingegneri Microsoft hanno contribuito a Mesa 26.2 il supporto per l’encoding AV1 tramite DirectX 12 e HMFT. La mossa rafforza la pipeline video delle GPU AMD su Windows, con implicazioni dirette per gli ambienti WSL e i flussi di AI on-premise che manipolano contenuti video, abbattendo la latenza e preservando la sovranità dei dati.

Jul 07 2026
LLM

Qwen 27B con MTP raddoppia i token/s: l'inference locale accelera

Un utente segnala un balzo prestazionale usando Multi-Token Prediction con Qwen 27B. La tecnica, che prevede più token a passo, promette di cambiare l'economia dell'inference on-premise, rendendo fruibili modelli di fascia media senza hardware aggiuntivo.

Jul 06 2026
Altro

Ransomware e intelligenza artificiale: la prima volta non è stata un’apocalisse autonoma

Un agente AI ha eseguito tecnicamente un attacco ransomware reale, ma qualcuno ha scelto la vittima, costruito l’infrastruttura e fornito credenziali rubate. Il debutto del crimine cibernetico autonomo è meno automatico di quanto i titoli lascino intendere.

Jul 06 2026
Market

JLC corre (+40%) sull’economia circolare di Taiwan: un segnale per i conti dell’hardware AI

L’impennata del fatturato di JLC mostra come la normativa sull’economia circolare stia ridisegnando la catena di fornitura elettronica. Per chi gestisce infrastrutture AI on-premise, la sostenibilità obbligatoria promette di incidere su disponibilità, costo totale di possesso e strategie di rinnovo dei componenti.

Jul 06 2026
Market

AI PC, la domanda cresce e Chicony Electronics segna ricavi in rialzo

Chicony Electronics ha registrato un incremento dei ricavi a giugno, segnale che la domanda di PC con accelerazione AI sta uscendo dalla nicchia. Una tendenza che ridisegna la filiera hardware e spinge le aziende a ripensare il deployment dell'inference in ottica locale.

Jul 06 2026
Hardware

Fulltech in Thailandia: la fabbrica che alimenta l’AI on-premise

L’espansione produttiva di Fulltech in Thailandia per soddisfare la domanda di AI e satelliti segnala un cambiamento strutturale nella filiera hardware. Mentre le GPU dominano le cronache, sono i componenti passivi come i connettori a determinare la scalabilità dei cluster on-premise. L’investimento riflette la maturazione dell’ecosistema AI e promette di ridurre i colli di bottiglia per chi costruisce infrastrutture locali, con implicazioni su costi e sovranità dei dati.

Jul 06 2026
Altro

La domanda di BBU traina i produttori taiwanesi di batterie: è l'effetto server AI

La crescita dei server per intelligenza artificiale sta aumentando la richiesta di Battery Backup Unit, portando benefici ai produttori taiwanesi di moduli batteria. Un fenomeno che segnala come la densità di potenza e la diffusione di deploy on-premise rendano l'infrastruttura energetica un tassello sempre più centrale nella catena del valore dell'AI.

Jul 06 2026
Hardware

SK Hynix sbarca a Wall Street: il boom AI ora passa dalla memoria

La quotazione miliardaria del produttore coreano segnala che la VRAM HBM è il nuovo anello strategico per l'inference LLM on-premise: chi controlla la memoria può strozzare l'intero stack hardware.

Jul 06 2026
Hardware

Intel Arc su Linux riabilita la codifica H.264/H.265 via Vulkan Video

Dopo mesi di stop per test insufficienti, la codifica hardware Vulkan Video torna sulle GPU Intel di 12.5 generazione e successive. Un segnale per l’ecosistema Linux e per chi costruisce nodi on-premise dove l’elaborazione video affianca i carichi di inference.

Jul 06 2026
Hardware

GPU Huawei: l'alternativa a NVIDIA esiste, ma il software fa muro

Un post su Reddit ironizza su chi ha comprato una GPU Huawei nell’ultimo anno. Dietro la battuta, la conferma di un ecosistema AI ancora schiacciato dall’inerzia di CUDA, nonostante la spinta delle sanzioni americane e la ricerca di alternative per deployment on-premise e sovrani.

Jul 06 2026
Altro

Siri personalizza ritmo ed espressività in iOS 27: la spinta on-device per l'AI generativa

Con iOS 27 beta, Apple introduce un controllo granulare su ritmo ed espressività di Siri, potenziando l’assistente con LLM generativi in locale. La novità mette in luce la tendenza verso l’elaborazione on-device, con ricadute su privacy, latenza e scelte di deployment per le aziende che considerano soluzioni on-premise.

Jul 06 2026
Altro

L’Alberta affida la cybersicurezza a Claude: il nodo sovranità acceso dal cloud

Il governo dell’Alberta usa Claude per scovare vulnerabilità nei sistemi pubblici. Una mossa efficiente, ma che espone dati sensibili a un LLM cloud. AI-RADAR analizza perché questo caso incarna la tensione tra rapidità operativa e controllo dei dati, e come potrebbe spingere le PA verso stack di inference on-premise.

Jul 06 2026
Altro

RADV e VRS: l'ottimizzazione di Marek Olšák a Valve raddoppia le prestazioni in alcuni scenari

Il nuovo codice per il Variable Rate Shading nel driver RADV, firmato da Marek Olšák, entra in Mesa 26.2. In certe condizioni le prestazioni raddoppiano. L’investimento di Valve nei driver open source per GPU AMD segnala una maturità che va ben oltre il gaming.

Jul 06 2026
Altro

Il bug nell’ufficio di Schwab e la sicurezza fisica dell’AI on-premise

Klaus Schwab ha trovato una cimice in casa. Per chi gestisce infrastrutture AI auto-ospitate, l’episodio ricorda quanto la sicurezza fisica resti un anello debole, anche quando si investe in sovranità dei dati e crittografia.

Jul 06 2026
Market

Licenziamenti tech 2026: quando l’IA è la scusa ufficiale

Un elenco aggiornato in tempo reale monitora le grandi aziende tech che nel 2026 giustificano i tagli di personale citando l’intelligenza artificiale come fattore determinante. Oltre la cronaca, una lettura strutturale delle scelte di automazione e delle conseguenze su occupazione, controllo dei dati e modelli di deployment.

Jul 06 2026
LLM

ThinkingCap-Qwen3.6-27B: Stessa Accuratezza, Metà dei Token di Ragionamento

Un checkpoint non ufficiale del Qwen3.6-27B promette di dimezzare i token di ragionamento senza perdere accuratezza. Test su benchmark generali, matematica, codice e agenti. La comunità attende verifiche indipendenti prima di considerarlo un punto di svolta.

Jul 06 2026
LLM

Reddit usa gli LLM per arginare lo spam che gli LLM stessi alimentano

Reddit sta ricorrendo ai Large Language Models per filtrare lo spam generato dagli stessi sistemi, innescando una corsa agli armamenti che ridefinisce la moderazione dei contenuti e solleva interrogativi sulla sostenibilità delle piattaforme.

Jul 06 2026
Market

Quota pubblica in OpenAI: 300 dollari a famiglia e una narrazione da costruire

Sam Altman discute con Trump una partecipazione del 5% in OpenAI per gli americani, traducibile in circa 320 dollari a nucleo familiare. Dietro i numeri modesti, la vera posta in gioco è politica: legittimare l'IA, guadagnare favori a Washington e spostare il dibattito sulla distribuzione della ricchezza prima che vincoli concreti arrivino per chi gestisce LLM.

Jul 06 2026
Altro

Il terzo binario: cosa insegna l’elettrificazione ferroviaria a chi sceglie l’on-premise AI

Voltify propone un modello oltre catenarie e batterie per decarbonizzare il trasporto merci su rotaia. L’analogia con le infrastrutture di calcolo è sorprendente: può esistere una terza via tra cloud centralizzato e edge per l’inference LLM, e cosa significherebbe per la sovranità dei dati e il TCO.

Jul 06 2026
LLM

Pocket TTS clona una voce da 5 secondi di audio, su CPU e sotto licenza MIT

Il nuovo modello di Kyutai gira su CPU, fa clonazione zero-shot in 5 secondi e ha licenza MIT. Il benchmark a 180 run mostra una latenza piatta ma più lenta dei rivali. Nessun altro TTS su CPU offre voice cloning.

Jul 06 2026
Altro

Google usa i tuoi dati per addestrare l'AI: come opporsi

Google ha modificato in sordina le sue policy privacy, ampliando la raccolta di dati per l'addestramento dei modelli. L'opt-out è possibile ma nascosto: un segnale di come il confine tra servizio e sorveglianza si stia spostando a sfavore degli utenti, con implicazioni pesanti per chi valuta la sovranità dei dati e il deployment on-premise dei LLM.

Jul 06 2026
Altro

Anthropic e il tracker nascosto: l’ennesima crepa nella fiducia sul cloud AI

Un ricercatore ha scoperto che Claude Code celava un meccanismo di tracciamento basato su steganografia per monitorare utenti cinesi. Il caso segnala una tensione irrisolta tra sicurezza dei modelli e controllo dell’utente, spingendo le organizzazioni verso deployment self-hosted per la piena sovranità dei dati.

Jul 06 2026
Altro

AI leggera, impatto massiccio: i modelli piccoli conquistano il mondo (e girano in locale)

Dallo scanner farmaceutico che gira su uno smartphone alle reti neurali su Arduino a 3 watt: i piccoli modelli AI stanno portando capacità di inference ovunque, senza dipendere da datacenter. Il World Bank spinge questa tendenza, ma dietro c’è un cambiamento strutturale: hardware a basso consumo, modelli distillati e una crescente domanda di elaborazione locale per sovranità e costi.

Jul 06 2026
Altro

Raccogliere 200 milioni senza perdere il controllo: la lezione di Skello per la sovranità tech europea

La startup HR francese ha ottenuto 200 milioni di euro guidati da Bridgepoint, aumentando la quota dei fondatori. Un segnale per chi costruisce infrastrutture AI indipendenti e valuta deployment on-premise in Europa.

Jul 06 2026
Market

Reddit combatte lo slop del marketing AI con la sua stessa arma: l’IA

Sempre più persone chiedono a ChatGPT anziché a Google, così i marketer inondano Reddit di opinioni finte per influenzare le risposte dei chatbot. Reddit risponde sviluppando un proprio sistema di AI per stanare questi contenuti. Il fenomeno segnala un passaggio epocale dalla SEO alla GEO, con conseguenze profonde sulla qualità dei dati che alimentano i modelli linguistici e sulla trasparenza dell’informazione in rete.

Jul 06 2026
Hardware

AMD Ryzen AI Halo: potenza e software open source per l'AI locale

AMD inizia a spedire il Ryzen AI Halo, un mini PC basato su Strix Halo con stack software completamente open source. Un passo concreto per chi cerca deployment on-premise di LLM senza vincoli proprietari.

Jul 06 2026
Altro

Klarna chiede la licenza bancaria USA: il vero banco di prova è l’infrastruttura dati

La fintech svedese vuole operare direttamente come banca negli Stati Uniti, superando i partner attuali. L’amministrazione Trump appare più aperta, ma la posta in gioco va oltre la regolamentazione: è il controllo dell’infrastruttura su cui girano i modelli di credito e, in prospettiva, gli LLM proprietari. Una mossa che ridisegna il confine tra servizi finanziari e sovranità tecnicica.

Jul 06 2026
LLM

Dai videogiochi all'AI: Worldmodeldata e la sfida dell’interazione nel mondo reale

La startup di Cambridge ha raccolto 8 milioni di euro per trasformare sessioni di gioco in dati di addestramento interattivi. Un segnale che il futuro dell’AI richiede mondi simulati con cui interagire, non solo descrizioni statiche.

Jul 06 2026
Market

Station F lancia la nuova edizione del programma F/ai per le promesse dell'AI europea

Il maxi-hub parigino creato da Xavier Niel ripropone l'acceleratore verticale per startup dell'intelligenza artificiale, puntando a consolidare il proprio ruolo di rampa di lancio per i talenti del settore nel continente. L'iniziativa si inserisce in un framework europeo sempre più attento alla sovranità tecnicica e alle architetture on-premise.

Jul 06 2026
Altro

Sherpa.ai raccoglie 18 milioni per l’IA che non tocca mai i dati sensibili

La startup basca Sherpa.ai ha chiuso un round da 18 milioni di dollari per sviluppare sistemi di intelligenza artificiale che non accedono mai ai dati grezzi. L’azienda si rivolge a banche, ospedali e governi, settori dove la sovranità dei dati è critica. L’annuncio, riportato da tech.eu, rilancia il dibattito su come portare la potenza dell’AI in ambienti regolati senza cedere il controllo delle informazioni.

Jul 06 2026
Altro

CurifyLabs raccoglie $14M per stampare farmaci personalizzati nelle farmacie USA

La startup finlandese CurifyLabs ha chiuso un round Serie A da 14 milioni di dollari per portare negli Stati Uniti macchine e software che permettono alle farmacie di stampare in 3D medicinali personalizzati. Una spinta alla decentralizzazione della produzione farmaceutica, con implicazioni che vanno oltre il settore.

Jul 06 2026
Market

Hedge fund vendono ancora chip: quarta settimana consecutiva, l’AI trade vacilla

I mercati mostrano segnali di cautela: per la quarta settimana di fila gli hedge fund riducono le posizioni sui produttori di semiconduttori. Il segmento è ora il più venduto negli USA. Un campanello d’allarme per l’ecosistema dell’AI, che dipende in modo critico dalla disponibilità e dal costo dell’hardware.

Jul 06 2026
Altro

Intel i915: il driver grafico verso la compatibilità RT, ma senza display

Il driver grafico i915 di Intel è a un passo dal funzionare stabilmente con il kernel Linux real-time (PREEMPT_RT), a patto di escludere il supporto per lo schermo. Questa evoluzione permetterebbe di usare le GPU integrate Intel come acceleratori deterministici per inference in ambito edge e industriale, abbassando il TCO di deployment auto-ospitati che richiedono bassa latenza.

Jul 06 2026
Hardware

Drone elettrico tedesco a 434 mph: record di velocità per intercettori anti-aerei

Un drone elettrico tedesco ha infranto il record mondiale di velocità raggiungendo 434 mph, superando i 409 mph ufficiali. Progettato per missioni di intercettazione anti-aerea, il velivolo senza pilota mostra come il computing edge spinto sia cruciale per l’autonomia in scenari difensivi — un’architettura che richiama i principi del deployment on-premise per l’AI.

Jul 06 2026
Hardware

Huawei porta in Corea i SuperPod Atlas: 8.192 Ascend 950 per sfidare Nvidia

Huawei entra nel mercato coreano dei chip AI con cluster SuperPod Atlas da 8.192 acceleratori Ascend 950. Dichiarate prestazioni di inference triple rispetto all'H20 di Nvidia, a un quarto del costo. Un segnale per chi valuta infrastrutture on-premise e alternative al dominio del silicio statunitense.

Jul 06 2026
Hardware

Turing sfida Nvidia con chip AMD: la startup giapponese rompe il monopolio nella guida autonoma

Turing Inc. ha ricevuto un investimento da AMD Ventures e ha iniziato a utilizzare chip AMD per l'AI dei suoi veicoli autonomi, abbandonando progressivamente Nvidia. La mossa segnala una diversificazione hardware cruciale per il deployment edge, dove costi, latenza e controllo diretto dell'inference contano più che mai.

Jul 06 2026
Altro

Cooper: «Non aspettiamo un Hiroshima IA per regolamentare»

La ministra degli Esteri britannica Yvette Cooper lancia un allarme sulla sicurezza dell’intelligenza artificiale, paragonandola alla bomba atomica e chiedendo regole globali prima di un evento catastrofico. Il saggio per Chatham House apre un dibattito sulla sovranità dei dati e sul controllo delle infrastrutture.

Jul 06 2026
Altro

FCA: il Regno Unito valuta la regolamentazione diretta degli LLM

Un alto dirigente della Financial Conduct Authority solleva la necessità di regole per modelli come ChatGPT, Claude e Gemini nell'ambito finanziario. La mossa riflette una tendenza globale che spinge le aziende a riconsiderare i deployment on-premise per garantire audit e conformità.

Jul 06 2026
Market

Midjourney cambia strategia: ora pretende che le major svelino il loro uso dell'AI

In una controversa battaglia legale, Midjourney ribalta la situazione: dopo essere stata accusata di addestrare la propria AI su personaggi protetti da copyright, chiede a un giudice federale di costringere gli studi che l'hanno citata a rendere pubblici i dettagli sull'uso interno di modelli AI. Una mossa che alza la posta sulla trasparenza.

Jul 06 2026
Market

TaiSan, fondata da un campione di scacchi, raccoglie 4,65 milioni per batterie al sodio

La startup britannica TaiSan ha chiuso un seed da 4,65 milioni di sterline per portare sul mercato batterie agli ioni di sodio più efficienti per bici elettriche, scooter, veicoli e utensili. Il round è stato co-guidato da Eos Advisory e dal Midlands Engine Investment Fund II.

Jul 06 2026
LLM

GigaChat3.5-432B-A28B di Sberbank: GGUF day-one per il deployment locale

Il nuovo modello Mixture of Experts di Sberbank, con 432 miliardi di parametri totali e 28 attivi per token, esordisce con una versione GGUF pronta per l'uso su hardware consumer. Un segnale forte per chi costruisce stack on-premise con LLM di grandi dimensioni.

Jul 06 2026
Hardware

Il rack AI Kyber di Nvidia slitta al 2028: un circuito manda in tilt il piano

Un singolo circuito elettronico ha causato il rinvio del rack Kyber di Nvidia, progettato per i chip Rubin Ultra. Il ritardo, segnalato da SemiAnalysis e CNBC, posticipa la disponibilità dal 2027 al 2028, con possibili ripercussioni sui piani di chi investe in infrastrutture AI on-premise.

Jul 06 2026
Altro

Il mixer DJ Pioneer DJM-S11 arriva su Linux con il kernel 7.3

Ottantasette righe di codice nel prossimo kernel Linux 7.3 renderanno finalmente utilizzabile il Pioneer DJM-S11, mixer scratch a due canali da oltre 2.200 dollari. La patch, già inserita nel ramo di sviluppo del sottosistema audio, risolve un'assenza che pesava sugli utilizzatori professionali di Linux in ambito musicale.

Jul 06 2026
OnPremise

Qwen3.6-27B Q8 e cache KV: 115K token su singola RTX 5090

L’esperimento di un utente dimostra che un LLM da 27B quantizzato a Q8 può servire contesti fino a 115.000 token su una GPU consumer con 32 GB di VRAM, grazie alla quantization selettiva della cache chiave-valore. I compromessi tra memoria, velocità e qualità percepita aprono prospettive concrete per il deployment on-premise senza hardware enterprise, ma sollevano la necessità di valutazioni oggettive sulle prestazioni reali.

Jul 06 2026
Hardware

Samsung Foundry tenta il rilancio con Meta e Anthropic: chip custom per l’AI on-premise

Le indiscrezioni su accordi di produzione con due big dell’AI segnalano un possibile riequilibrio nel mercato delle fonderie. Per chi gestisce infrastrutture self-hosted, l’arrivo di un secondo fornitore di processo avanzato cambierebbe gli scenari di approvvigionamento.

Jul 06 2026
Market

Stoa raccoglie 2,4 milioni per una piattaforma di cash rewards

La startup fintech britannica Stoa ha chiuso un round pre-seed da 2,4 milioni di dollari. La sua piattaforma combina finanza comportamentale, infrastrutture bancarie integrate e partnership commerciali per offrire premi anticipati sui depositi in contanti, proponendo un’alternativa ai soli tassi di interesse.

Jul 06 2026
Altro

L’ONU: l’IA corre più veloce delle regole, e c’è un rapporto a provarlo

L'intelligenza artificiale accelera più in fretta della capacità dei governi di comprenderla, testarla e regolarla: il rapporto delle Nazioni Unite diffuso a Ginevra mette in guardia su un divario che rischia di diventare incolmabile. Per le aziende che valutano deployment on-premise di LLM, il messaggio è chiaro: l'assenza di quadri normativi certi sposta la responsabilità della sicurezza su chi adotta la tecnicia, rendendo la sovranità infrastrutturale un fattore strategico.

Jul 06 2026
Market

Shampoo e biscotti diventano AI-made: così i colossi del largo consumo riscrivono i loro laboratori

La corsa all'intelligenza artificiale esce dai data center ed entra nei reparti R&D di beni di consumo. Le aziende dietro ai prodotti che invadono le nostre case usano l'AI per formulare, testare e personalizzare tutto, dalle creme ai cibi confezionati. Un cambiamento che solleva nuove domande su dati, privacy e architetture di deployment.

Jul 06 2026
Hardware

Samsung vola grazie alle memorie AI: utile 18 volte superiore

Il boom dell'AI spinge la domanda di DRAM e NAND: Samsung registra il terzo trimestre consecutivo da record con un utile operativo stimato di 86 trilioni di won. Un segnale per chi costruisce infrastrutture on-premise: la disponibilità e il costo delle memorie impattano direttamente il deployment locale dei modelli.

Jul 06 2026
Altro

Droni, Taiwan avanza in Europa: la carta della fiducia industriale

La svolta europea verso fornitori ritenuti più affidabili sta ridisegnando le quote di mercato dei droni, con i produttori taiwanesi in prima fila. Un segnale chiaro di come la sovranità tecnicica e la resilienza delle filiere stiano diventando criteri d’acquisto determinanti.

Jul 06 2026
Market

Anthropic progetta chip con Samsung: obiettivo ridurre i costi di inference, non le massime prestazioni

Indiscrezioni sulla collaborazione tra Anthropic e Samsung indicano lo sviluppo di chip custom focalizzati sull'inference, per abbattere i costi operativi dei modelli Claude senza inseguire i benchmark NVIDIA. Una mossa che potrebbe cambiare gli equilibri del deployment on-premise.

Jul 06 2026
Market

SaaSpocalypse: il vero costo del software AI che costruisci da solo

Sostituire gli abbonamenti SaaS con software AI interno sembra un risparmio facile, ma il costo di mantenimento, sicurezza ed evoluzione continua resta spesso nascosto. La domanda non è se si può costruire, ma se si può gestire nel tempo.

Jul 06 2026
LLM

Qwen e Gemma in stallo sui benchmark: che succede ai modelli open?

Una sensazione condivisa da più parti suggerisce che la corsa ai punteggi tra Qwen e Gemma stia raggiungendo un punto morto. Cosa significa per chi valuta questi LLM in contesti reali e, soprattutto, per il deployment on-premise?

Jul 06 2026
Market

Longsys: utili in crescita esplosiva nel 1H26 grazie alla domanda AI di memoria

Il produttore Longsys prevede un netto aumento degli utili nella prima metà del 2026, trainato dal mercato delle memorie e dalla domanda AI. La richiesta di HBM e storage veloce, essenziali per LLM, influenzerà costi e disponibilità per i deployment on-premise. Un segnale da tenere d'occhio per chi pianifica infrastrutture self-hosted.

Jul 06 2026
Hardware

Ricavi Foxconn a quota 821,8 miliardi di NT$: la spinta dell’AI non si ferma

Il gigante della manifattura registra un giugno da record grazie alla domanda di server e infrastrutture per l’intelligenza artificiale. Una crescita che ridisegna la supply chain e tocca da vicino chi valuta deployment on-premise di LLM.

Jul 06 2026
Altro

CurifyLabs raccoglie 12 milioni per automatizzare la produzione locale di farmaci personalizzati

Il round Serie A da 12 milioni di euro permetterà all'azienda finlandese di espandere le operazioni negli Stati Uniti e accelerare lo sviluppo della sua piattaforma di stampa 3D per farmaci personalizzati, già attiva in 21 stati USA e in Europa.

← Precedente Page 16 / 160 Successiva →