🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15939

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Jun 03 2026
Altro

L'impatto dell'AI sulla rete elettrica europea: l'UE chiede di ridurre i consumi

La Commissione Europea ha invitato i cittadini a ridurre il consumo di elettricità nelle ore di punta. La causa principale è la rapida crescita dei data center AI, che, insieme all'elettrificazione e alla domanda di infrastrutture digitali, sta mettendo sotto pressione le reti energetiche europee. L'iniziativa coincide con un pacchetto sull'efficienza energetica dei data center, pubblicato il 3 giugno, che mira a mitigare tali impatti.

Jun 03 2026
Altro

Google Dreambeans: l'AI che trasforma i dati personali in storie illustrate

Google ha presentato Dreambeans, un nuovo strumento basato su intelligenza artificiale che genera "storie" illustrate a partire dai dati personali degli utenti Google. Questa iniziativa solleva questioni rilevanti sulla gestione della privacy e sull'architettura di deployment per carichi di lavoro AI che elaborano informazioni sensibili, un tema centrale per le aziende che valutano soluzioni on-premise per la sovranità dei dati.

Jun 03 2026
Altro

La sicurezza nell'era dell'AI: nuove sfide per i deployment aziendali

L'adozione rapida dell'intelligenza artificiale nelle applicazioni aziendali sta creando pressioni inedite sui team di sicurezza. Le applicazioni basate su AI introducono superfici di attacco sconosciute, comportamenti imprevedibili e nuove vie per gli aggressori per manipolare gli input, accedere ai dati o concatenare vulnerabilità. È cruciale ripensare le strategie di protezione per garantire la resilienza dei sistemi.

Jun 03 2026
Altro

xAI chiede la revoca dell'anonimato per le presunte vittime di deepfake Grok

xAI, l'azienda di intelligenza artificiale di Elon Musk, ha chiesto a un tribunale di obbligare quattro querelanti, che sostengono di essere vittime di deepfake a sfondo intimo generati da Grok, a rivelare le proprie identità. Le persone coinvolte avevano agito in giudizio sotto pseudonimo, citando i rischi legati alla loro identificazione pubblica, ponendole di fronte a una difficile scelta tra privacy e prosecuzione della causa.

Jun 03 2026
Altro

Ordine Esecutivo USA su AI: Test Volontari e Critiche alla Regolamentazione

L'amministrazione Trump ha firmato un ordine esecutivo per promuovere test di sicurezza volontari sui Large Language Models (LLM) “frontier”. Nonostante l'intento dichiarato di garantire un deployment sicuro, i critici lo considerano un provvedimento “annacquato” che offre rassicurazioni superficiali senza imporre requisiti vincolanti alle aziende. L'iniziativa segue tensioni interne tra esperti di cybersecurity e sostenitori della deregolamentazione, sollevando interrogativi sull'efficacia della supervisione governativa.

Jun 03 2026
LLM

Gemma 4 12B: un modello multimodale unificato per l'AI on-premise

È stato presentato Gemma 4 12B, un nuovo modello multimodale unificato e 'encoder-free'. Questa architettura innovativa promette di semplificare i carichi di lavoro AI che combinano testo e altri media, offrendo nuove opportunità per deployment on-premise dove il controllo dei dati e l'ottimizzazione delle risorse hardware sono prioritari per le aziende.

Jun 03 2026
Hardware

MSI Claw 8 EX AI+ e Intel Arc G3 Extreme: l'AI on-device nei palmari

MSI ha presentato il Claw 8 EX AI+, un palmare gaming che integra la GPU Intel Arc G3 Extreme, un display da 8 pollici a 120 Hz e nuove impugnature ergonomiche. Questo dispositivo evidenzia la crescente tendenza all'integrazione di capacità AI direttamente nell'hardware consumer, spingendo verso l'elaborazione on-device e l'inference locale, un tema rilevante anche per le strategie di deployment AI aziendali all'edge.

Jun 03 2026
Altro

OpenAI definisce l'agenda di policy per un'IA responsabile

OpenAI ha delineato la sua agenda di policy pubblica per l'intelligenza artificiale, focalizzandosi su sicurezza, protezione dei giovani, transizione della forza lavoro e standard globali. L'obiettivo è garantire che l'IA apporti benefici concreti alla società, indirizzando le sfide etiche e pratiche legate al suo sviluppo e deployment.

Jun 03 2026
Altro

OpenAI propone un framework federale per la governance dell'AI di frontiera negli USA

OpenAI ha presentato una proposta per la governance dell'intelligenza artificiale di frontiera negli Stati Uniti. Il piano suggerisce un framework federale incentrato su sicurezza, resilienza e protezione nazionale, delineando un potenziale percorso per la regolamentazione di queste tecnicie emergenti.

Jun 03 2026
LLM

Gemma 4: La community chiede una variante da 124 miliardi di parametri

La community di sviluppatori e professionisti AI sta esprimendo un forte interesse per una versione più grande del modello Gemma 4 di Google, in particolare una variante da 124 miliardi di parametri. Attualmente, il modello Gemma 4 da 12B è apprezzato per le sue capacità, ma la richiesta di una versione più potente evidenzia la necessità di LLM con maggiore complessità per carichi di lavoro enterprise. Questa spinta riflette le crescenti esigenze di performance e controllo nei deployment on-premise, dove la dimensione del modello incide direttamente sui requisiti hardware e sul TCO.

Jun 03 2026
LLM

Meta AI e la manipolazione: implicazioni per la sicurezza dei Large Language Models

Un recente episodio ha messo in luce le vulnerabilità dei Large Language Models (LLM): hacker sono riusciti a manipolare l'AI di Meta per ottenere accesso a un account Instagram, semplicemente chiedendole di modificare un indirizzo email. Questo incidente, insieme a un caso simile di frode interna su un sistema di tracciamento AI di Amazon, solleva interrogativi cruciali sulla sicurezza, il controllo e la sovranità dei dati in contesti di deployment AI, sia cloud che on-premise, evidenziando la necessità di robuste strategie di mitigazione.

Jun 03 2026
LLM

Google DeepMind lancia Gemma 4: LLM aperti e multimodali per ogni scala

Google DeepMind ha rilasciato Gemma 4, una famiglia di Large Language Models aperti e multimodali. Disponibili in diverse dimensioni, da E2B a 31B, supportano architetture Dense e Mixture-of-Experts (MoE). Con una finestra di contesto fino a 256K token e ottimizzati per deployment su dispositivi locali, laptop e server, i modelli Gemma 4 offrono flessibilità per carichi di lavoro AI on-premise, garantendo controllo e sovranità dei dati.

Jun 03 2026
LLM

Qwen 3.6 27B e il limite di contesto: le sfide hardware per gli LLM

L'introduzione di modelli come Qwen 3.6 27B, seppur in un contesto ipotetico, evidenzia l'importanza critica dell'hardware per le capacità dei Large Language Models. In particolare, il limite della finestra di contesto, come un ipotetico 4K token, pone vincoli significativi sulle applicazioni. Questo articolo esplora come le specifiche delle GPU e l'architettura di sistema influenzino direttamente le performance e le possibilità di deployment on-premise, delineando i trade-off per CTO e architetti infrastrutturali.

Jun 03 2026
LLM

Gemma 4-12B in GGUF: Nuove opportunità per l'Inference On-Premise

La recente disponibilità del modello Gemma 4-12B in formato GGUF su Hugging Face, gestito da ggml-org, segna un passo significativo per l'esecuzione di Large Language Models in ambienti self-hosted. Questa versione ottimizzata apre scenari interessanti per le aziende che cercano maggiore controllo, sovranità dei dati e costi operativi ridotti per i loro carichi di lavoro AI.

Jun 03 2026
LLM

Gemma 4 Unified: L'integrazione anticipata in llama.cpp svela un'architettura inedita

Una recente pull request nel repository `llama.cpp` ha rivelato l'implementazione del nuovo modello "Gemma 4 Unified" di Google. L'integrazione anticipata suggerisce un lancio con supporto immediato per l'inference locale. Dettagli nel codice accennano a una "vision tower" priva di architettura transformer, indicando una potenziale innovazione significativa nel design dei modelli multimodali e sollevando interrogativi sulla sua architettura finale.

Jun 03 2026
Altro

AI: Trump firma l'ordine esecutivo, tra attese e implicazioni future

Donald Trump ha siglato un ordine esecutivo sull'intelligenza artificiale, un passo che arriva dopo un rinvio del mese precedente. La mossa sottolinea la crescente attenzione globale verso la regolamentazione dell'AI, con potenziali impatti significativi sulle strategie di deployment e sulla sovranità dei dati per le aziende che gestiscono Large Language Models on-premise.

Jun 03 2026
Frameworks

llama.cpp integra i diagrammi Mermaid: visualizzazione avanzata per LLM on-premise

Il progetto Open Source llama.cpp, punto di riferimento per l'inference di Large Language Models su hardware locale, introduce una nuova funzionalità UI: la generazione e l'anteprima interattiva dei diagrammi Mermaid direttamente nelle chat. Questa integrazione migliora la capacità degli sviluppatori di visualizzare flussi di lavoro complessi e documentare architetture, rafforzando l'utilità delle soluzioni LLM self-hosted e il controllo sui dati.

Jun 03 2026
Hardware

AMD presenta il Ryzen AI Halo: un PC per sviluppatori AI a Computex 2026

AMD ha mostrato il suo nuovo PC per sviluppatori AI, il Ryzen AI Halo, durante una demo dal vivo a Computex 2026. Questa macchina è progettata per supportare lo sviluppo di applicazioni e modelli di intelligenza artificiale in locale, sottolineando l'impegno dell'azienda nel fornire hardware dedicato per l'ecosistema AI on-premise. L'iniziativa evidenzia la crescente domanda di soluzioni che garantiscano controllo e sovranità dei dati per i carichi di lavoro AI.

Jun 03 2026
Hardware

AMD alza il tono sulla competizione AI mobile: "Sbagliato non scegliere Strix Halo"

I dirigenti di AMD hanno lanciato una sfida diretta nel mercato dell'AI su dispositivi mobili, dichiarando che i notebook basati su architettura Strix Halo rappresentano la scelta obbligata. Questa affermazione, che si confronta con l'iniziativa RTX Spark di Nvidia, sottolinea l'intensificarsi della competizione per portare le capacità di Large Language Models e altre applicazioni AI direttamente sui dispositivi client, enfatizzando l'importanza dell'elaborazione locale.

Jun 03 2026
Altro

Regno Unito: i publisher potranno escludere i contenuti dalla ricerca AI di Google

I regolatori del Regno Unito hanno imposto a Google di introdurre uno strumento che permetta ai publisher di escludere i propri siti dalle funzionalità di ricerca basate su intelligenza artificiale generativa. Questa opzione sarà inizialmente testata nel Regno Unito per poi essere estesa a livello globale. La mossa risponde alle crescenti preoccupazioni riguardo l'uso dei contenuti online da parte degli LLM e segna un passo significativo verso una maggiore sovranità dei dati per i creatori di contenuti.

Jun 03 2026
Altro

Dall'alta finanza all'AI vocale: la startup che punta su stack proprietari per l'Africa e il Medio Oriente

Due ex-dirigenti di Goldman Sachs e Meta hanno fondato una startup focalizzata sull'AI vocale, mirando a mercati spesso trascurati come l'Africa e il Medio Oriente. La loro strategia si basa su uno stack tecnicico proprietario e self-hosted, che attualmente gestisce oltre 17.000 chiamate al giorno, evidenziando l'efficacia di un approccio on-premise per esigenze specifiche di localizzazione e sovranità dei dati.

Jun 03 2026
Altro

L'Unione Europea punta alla sovranità tecnicica per proteggere i cittadini

L'Unione Europea ha presentato il suo "Pacchetto per la Sovranità Tecnologica", un'iniziativa strategica per ridurre la dipendenza da fornitori tech esterni e rafforzare le capacità interne in AI, semiconduttori, cloud computing e Open Source. L'obiettivo è garantire autonomia decisionale e protezione dei cittadini, con proposte che includono il triplicare la capacità dei data center e promuovere l'uso di chip e soluzioni Open Source europee, pur tra le preoccupazioni per le relazioni internazionali.

Jun 03 2026
Market

Anthropic Rafforza l'Ecosistema Claude con un Nuovo Partner Network

Anthropic ha annunciato l'introduzione del Services Track e del Partner Hub all'interno del suo Claude Partner Network. Questa iniziativa mira a espandere il supporto e le capacità di integrazione per gli LLM di Claude, offrendo nuove opportunità per le aziende che cercano soluzioni AI robuste e personalizzate, con un occhio di riguardo alle complessità dei deployment enterprise e alla sovranità dei dati.

Jun 03 2026
Market

Apoha svela la 'Liquid State Intelligence' con 36 milioni di dollari

Apoha, una deeptech, ha raccolto 36 milioni di dollari per sviluppare la 'Liquid State Intelligence', un nuovo paradigma per comprendere il comportamento molecolare in condizioni reali. La piattaforma VIBE® genera dati empirici cruciali per l'AI nel mondo fisico, permettendo previsioni accurate in settori come farmaceutica, alimentare e materiali, riducendo incertezze e costi. Il finanziamento supporterà l'espansione di questa classe di dati fondamentale.

Jun 03 2026
Market

L'AI fa risparmiare ore, ma le aziende le disperdono: il paradosso dell'efficienza

Un nuovo studio Workday rivela che l'85% dei dipendenti risparmia fino a sette ore settimanali grazie all'AI. Tuttavia, gran parte di questo tempo guadagnato viene disperso, evidenziando una sfida critica per le aziende: trasformare il potenziale dell'AI in valore concreto. La corretta integrazione e gestione delle soluzioni AI, sia on-premise che in cloud, è fondamentale per capitalizzare questi benefici.

Jun 03 2026
Altro

Sovranità Digitale UE: Nuove Norme su Chip e Dati Sensibili

La Commissione Europea ha presentato un pacchetto di quattro misure legislative per rafforzare la sovranità tecnicica del blocco. Le proposte includono poteri di emergenza per la gestione della catena di fornitura dei chip e restrizioni per i fornitori cloud statunitensi nell'accesso a dati governativi sensibili. L'iniziativa, attesa da tempo, mira a ridurre la dipendenza dell'UE da tecnicie extra-europee, in particolare nel settore dei semiconduttori.

Jun 03 2026
LLM

Qwen 3.7 Plus: l'apparizione lampo su OpenRouter

Un nuovo modello, Qwen 3.7 Plus, è apparso e poi rapidamente scomparso dalla piattaforma OpenRouter, generando interrogativi nella comunità tech. L'episodio evidenzia le sfide legate alla disponibilità dei Large Language Models e le complessità che le aziende affrontano nel pianificare deployment robusti, sia tramite API esterne che con soluzioni self-hosted.

Jun 03 2026
Market

Meta e la sfida AI: Muse Spark e la scommessa su una nuova leadership

Un anno dopo l'incarico ad Alexandr Wang, Meta presenta Muse Spark, il suo modello AI più promettente. La decisione di Zuckerberg di affidare la guida a un fondatore di startup esterno, anziché a un ricercatore interno, mirava a infondere urgenza e ambizione. Nonostante le sfide iniziali e le critiche, Wang sta ora ottenendo i primi risultati, segnando un'evoluzione nella strategia AI del colosso tecnicico.

Jun 03 2026
Market

Meta lancia l'agente AI per WhatsApp Business: disponibilità globale e tariffazione a token

Meta ha esteso la disponibilità globale del suo agente AI per WhatsApp Business, introducendo un modello di tariffazione basato sull'utilizzo dei token. Questa mossa integra l'intelligenza artificiale generativa nelle comunicazioni aziendali, offrendo strumenti avanzati per l'automazione. Per le imprese, il nuovo approccio alla fatturazione solleva importanti considerazioni sul Total Cost of Ownership (TCO) e sulla gestione dei dati, spingendo a valutare attentamente le implicazioni economiche e strategiche rispetto a soluzioni self-hosted.

Jun 03 2026
Altro

L'AI nei servizi consumer: dalla ricerca all'ottimizzazione dei deployment enterprise

L'integrazione di strumenti AI in piattaforme consumer come Google Search e Shopping evidenzia la crescente pervasività dell'intelligenza artificiale. Per le aziende che valutano l'adozione di capacità AI simili, emergono considerazioni critiche relative al deployment on-premise, alla sovranità dei dati e al Total Cost of Ownership. L'analisi di queste architetture è fondamentale per ottimizzare le strategie infrastrutturali.

Jun 03 2026
LLM

Abliteration di LLM: confronto tra Apostate, Heretic e Huihui su Qwen 2.5 7B

Un'analisi comparativa approfondisce le capacità di tre strumenti di 'abliteration' – Apostate, Heretic e Huihui – nel rimuovere il 'safety training' dal Large Language Model Qwen 2.5 7B. I benchmark, eseguiti su una GPU RTX 5090 32GB, rivelano differenze significative nell'efficacia della rimozione del rifiuto, nell'impatto sulle performance del modello e nell'entità delle modifiche ai parametri, offrendo spunti cruciali per i deployment on-premise e la sovranità dei dati.

Jun 03 2026
Market

Coralogix raccoglie 200 milioni di dollari per la supervisione degli agenti AI

Coralogix ha annunciato un round di finanziamento Series F da 200 milioni di dollari, portando la sua valutazione a 1,6 miliardi di dollari. L'investimento, avvenuto a meno di un anno dal precedente, sottolinea la crescente domanda di soluzioni per la supervisione e l'osservabilità degli agenti AI. Questo posizionamento strategico mira a rispondere alla necessità di monitorare l'operato dei sistemi di intelligenza artificiale, un aspetto cruciale per le aziende che adottano LLM e altre tecnicie AI.

Jun 03 2026
Hardware

Microsoft Solara AI: la piattaforma 'chip-to-cloud' per dispositivi enterprise con agenti AI

Microsoft ha presentato Project Solara AI, una piattaforma 'chip-to-cloud' progettata per alimentare una nuova generazione di dispositivi enterprise 'agent-first'. Questi hardware sono concepiti per eseguire agenti AI, superando le applicazioni tradizionali. Tra i primi concept di riferimento figurano un compagno desktop e un badge indossabile, evidenziando un cambio di paradigma verso l'integrazione profonda dell'intelligenza artificiale direttamente nell'hardware aziendale.

Jun 03 2026
Altro

E.ON: l'AI e SAP S/4HANA per modernizzare la rete e garantire la sovranità dei dati

E.ON sta trasformando la sua infrastruttura energetica attraverso la standardizzazione dei dati con SAP S/4HANA e l'integrazione dell'AI. L'azienda ha internalizzato competenze chiave in dati e cybersecurity, riducendo i tempi di inattività IT del 77%. Adottando un approccio pragmatico all'AI, E.ON si concentra su casi d'uso specifici come la manutenzione predittiva e l'automazione del servizio clienti, bilanciando innovazione e controllo per una maggiore resilienza operativa e sovranità dei dati.

Jun 03 2026
Hardware

Qwen 3.6 27B e contesto da 262K: quanta VRAM serve per il deployment on-premise?

L'implementazione di Large Language Models come Qwen 3.6 27B con finestre di contesto estese (262K token) e requisiti di quantization specifici (Q8 con KV cache non compressa) pone sfide significative in termini di VRAM. Un utente valuta l'acquisto di una GPU e si interroga sull'adeguatezza di 48GB di VRAM per un deployment on-premise, evidenziando le complessità nella pianificazione dell'infrastruttura AI.

Jun 03 2026
Altro

Ubuntu 26.04 LTS: Canonical accelera gli aggiornamenti ROCm per le GPU AMD

Canonical ha annunciato un cambio di strategia per Ubuntu 26.04 LTS, introducendo aggiornamenti più rapidi per lo stack di calcolo GPU open source ROCm di AMD tramite Stable Release Updates (SRUs). Questa mossa risponde alla necessità di mantenere la piattaforma aggiornata, dato che la versione iniziale di ROCm inclusa nella distribuzione era già obsoleta. La decisione facilita l'accesso a versioni più recenti di ROCm per gli sviluppatori e gli architetti che utilizzano GPU AMD in ambienti Linux.

Jun 03 2026
Altro

USA: Ordine Esecutivo AI Richiede Accesso Preventivo ai Modelli Frontier

L'amministrazione statunitense ha firmato un ordine esecutivo sull'intelligenza artificiale che mira a garantire al governo un accesso di 30 giorni ai "modelli frontier" prima del loro rilascio pubblico. Il framework, di natura volontaria, includerà un benchmark classificato per determinare quali modelli rientrano in questa categoria, evidenziando la crescente attenzione alla sicurezza e alla governance degli LLM avanzati.

Jun 03 2026
Altro

Boom nel settore dei semiconduttori coreano: implicazioni per l'infrastruttura AI on-premise

La provincia di Gyeonggi, cuore dell'industria coreana dei semiconduttori, registra una significativa crescita economica, evidenziata da un aumento del 150% nelle vendite di beni di lusso. Questo boom sottolinea l'importanza strategica del settore per l'avanzamento dell'AI. Per le aziende che valutano deployment on-premise di Large Language Models, la prosperità di queste "cinture del silicio" è cruciale, influenzando la disponibilità di hardware, la sovranità dei dati e il TCO delle infrastrutture AI locali.

Jun 03 2026
Market

CoreWeave accelera l'infrastruttura AI nel Regno Unito: la velocità è la chiave

CoreWeave, neocloud supportata da Nvidia, sta espandendo rapidamente la sua capacità di calcolo AI nel Regno Unito. L'azienda ha scelto di affittare spazi in data center esistenti piuttosto che costruirne di nuovi, una strategia dettata dalla necessità di soddisfare l'enorme domanda di compute con la massima velocità. Questa mossa, parte di un investimento multimiliardario, mira a ridurre i tempi di deployment da anni a mesi, posizionando CoreWeave come attore centrale nei piani AI del governo britannico.

Jun 03 2026
Market

Suno: la valutazione sale a 5,4 miliardi di dollari tra partnership e sfide AI

Suno, l'azienda di intelligenza artificiale per la musica, ha raggiunto una valutazione di 5,4 miliardi di dollari, raddoppiando il suo valore in sei mesi. Questo traguardo arriva dopo un periodo di contenziosi legali con le major discografiche, ora trasformatesi in partner. La vicenda evidenzia la rapida evoluzione del mercato AI e le complesse dinamiche tra innovazione tecnicica e proprietà intellettuale.

Jun 03 2026
Altro

Il Ruolo Indispensabile del Calcolo Classico nell'Era dei Computer Quantistici

I computer quantistici, pur promettendo capacità di calcolo rivoluzionarie, dipendono in modo critico da un'infrastruttura classica robusta per la calibrazione e la correzione degli errori. L'aumento del numero di qubit impone nuove sfide di scalabilità, spingendo aziende come Nvidia, Q-CTRL, IBM e Google a sviluppare soluzioni innovative, inclusi approcci basati sull'AI, per gestire la complessità operativa di questi sistemi ibridi.

Jun 03 2026
Hardware

Nvidia RTX Spark: i chip che ridefiniscono il futuro dell'AI su PC

Nvidia sta puntando a trasformare il concetto di "AI PC" in realtà grazie ai suoi nuovi chip RTX Spark per laptop. Questa mossa potrebbe segnare un punto di svolta per l'elaborazione dell'intelligenza artificiale direttamente sui dispositivi client, riducendo la dipendenza dal cloud e aprendo nuove opportunità per applicazioni locali e per la sovranità dei dati, aspetti cruciali per molte organizzazioni e utenti finali.

Jun 03 2026
Hardware

Noctua entra nel mercato AIO: raffreddamento silenzioso per sistemi ad alte prestazioni

Noctua, noto produttore di soluzioni di raffreddamento, ha presentato il suo primo sistema All-in-One (AIO) per CPU. Caratterizzato da una pompa Asetek Emma V2 silenziosa e ventole NF-A12/14, il modello NL-LC1 sarà disponibile in varianti da 240mm e 420mm, con prezzi a partire da circa 250 dollari. Sebbene si tratti di un prodotto consumer, il suo debutto evidenzia l'importanza crescente di soluzioni di raffreddamento efficienti e silenziose per qualsiasi carico di lavoro ad alte prestazioni, inclusi i server on-premise per LLM.

Jun 03 2026
Market

L'AI spinge i costi della DDR5: 32GB a 375 dollari, impatto sui deployment on-premise

Il costo della memoria DDR5 da 32GB ha raggiunto un minimo di 375 dollari, un aumento significativo attribuito alla crescente domanda nel settore dell'intelligenza artificiale. Questa tendenza mette sotto pressione il mercato dell'assemblaggio PC e solleva interrogativi sui costi per le infrastrutture AI self-hosted, influenzando il TCO per le aziende che valutano soluzioni on-premise.

Jun 03 2026
Market

Vivilo raccoglie 628mila euro per l'AI negli eventi: focus su computer vision

La startup italiana Vivilo ha chiuso un round pre-seed da 628.000 euro per potenziare la sua piattaforma di intelligenza artificiale. La tecnicia proprietaria automatizza la creazione di contenuti personalizzati da filmati di eventi, riconoscendo volti e oggetti. I fondi supporteranno la crescita commerciale, lo sviluppo della piattaforma e l'espansione nel settore motorsport, puntando a rafforzare la presenza europea e l'espansione internazionale.

Jun 03 2026
Market

Lovable e Google Cloud: una partnership strategica per l'AI aziendale

Lovable, sviluppatore svedese di app che gestisce milioni di progetti settimanali, ha stretto una partnership strategica con Google Cloud. L'obiettivo è attrarre clienti aziendali, sfruttando i modelli Gemini e un robusto strato di sicurezza. La proposta di Lovable permette a chiunque di creare software conversando con un'intelligenza artificiale, mirando ora a scalare questa offerta nel mercato corporate con il supporto dell'infrastruttura cloud di Google.

Jun 03 2026
LLM

Ricerca LLM: il divario tra pubblicazione su Arxiv e implementazione pratica

La comunità tech si interroga sul "timeshift" tra la pubblicazione di ricerche innovative su Arxiv da parte di laboratori come Google DeepMind e la loro effettiva integrazione in Large Language Models commerciali. Comprendere se le scoperte vengono divulgate prima o dopo i test su larga scala è cruciale per chi valuta strategie di deployment e l'adozione di nuove tecnicie.

Jun 03 2026
Hardware

NVIDIA: Il driver open-source Nova si avvicina al supporto per Hopper e Blackwell

Lo sviluppo del driver open-source Nova per le GPU NVIDIA Hopper e Blackwell prosegue, con il rilascio della dodicesima iterazione. Questo driver, scritto in Rust, mira a offrire un'alternativa al Nouveau, già compatibile tramite GSP. La sua evoluzione è cruciale per gli ambienti Linux e per chi cerca maggiore controllo sull'hardware NVIDIA, specialmente in contesti on-premise dove la flessibilità e la sovranità dei dati sono prioritarie.

Jun 03 2026
Market

GoPro e la Crisi della Memoria AI: Un Campanello d'Allarme per il Mercato

GoPro ha sollevato dubbi significativi sulla propria continuità operativa, citando una carenza di memoria AI come fattore critico. Questo evento evidenzia le crescenti sfide nella catena di approvvigionamento di componenti essenziali per l'intelligenza artificiale, con ripercussioni che vanno oltre i settori tradizionali e influenzano le strategie di deployment on-premise e cloud.

Jun 03 2026
Altro

Mappare le minacce cyber abilitate dall'AI: un anno di sfide per l'on-premise

L'analisi di un anno di minacce cyber potenziate dall'intelligenza artificiale rivela sfide crescenti per la sicurezza delle infrastrutture. Per le aziende che valutano deployment on-premise di LLM, comprendere queste dinamiche è cruciale per proteggere la sovranità dei dati e garantire la compliance, bilanciando controllo e TCO in un panorama di attacchi sempre più sofisticati.

Jun 03 2026
Hardware

Il CEO di MIPS promuove RISC-V per l'AI su hardware fisico al Computex

Al Computex, il CEO di MIPS ha evidenziato il potenziale di RISC-V per l'intelligenza artificiale su hardware fisico. Questa architettura aperta offre flessibilità e controllo, elementi cruciali per le aziende che cercano soluzioni AI on-premise o edge, con un'attenzione particolare alla sovranità dei dati e all'ottimizzazione del TCO. La discussione sottolinea l'evoluzione del panorama dei processori per carichi di lavoro AI.

Jun 03 2026
Altro

Molfar raccoglie 1,5 milioni di euro per radar anti-drone tattici on-premise

Molfar Defence Technologies, azienda polacco-ucraina, ha chiuso la prima tranche di un round di finanziamento da 1,5 milioni di euro. L'investimento di Front Ventures supporterà lo sviluppo e il deployment di sistemi radar tattici per la rilevazione di piccoli UAV. Questi sistemi, progettati per operare in ambienti complessi e vicini alle unità operative, enfatizzano la sovranità dei dati e il controllo sul campo, aspetti cruciali per le infrastrutture di difesa.

Jun 03 2026
Market

Immobiliare a San Francisco: le azioni Anthropic superano il contante

Nel dinamico mercato immobiliare della Bay Area, alcune proprietà vengono offerte in cambio di quote azionarie di Anthropic, la startup di intelligenza artificiale. Questo fenomeno sottolinea la percezione di un valore eccezionale per le aziende leader nel settore AI, riflettendo l'intensa corsa agli investimenti e l'importanza strategica dell'intelligenza artificiale generativa.

Jun 03 2026
Hardware

KRAID: Nuovo Compilatore per GPU Arm Mali Integrato in Mesa 26.2

Il nuovo compilatore KRAID, progettato per le moderne GPU Arm Mali, è stato integrato in Mesa 26.2. Questa mossa strategica mira a migliorare le prestazioni e l'efficienza dei driver open-source Panfrost e PanVK, con implicazioni significative per i deployment AI su hardware Arm, in particolare in contesti edge e on-premise dove il controllo e il TCO sono prioritari.

Jun 03 2026
Altro

Microsoft Porta Coreutils su Windows, Basato su Rust

Durante la conferenza Build 2026, Microsoft ha svelato Coreutils per Windows, un set di utility di sistema derivato da Rust Coreutils. L'iniziativa mira a standardizzare e semplificare l'esperienza degli sviluppatori su piattaforme eterogenee come Windows, WSL, macOS e Linux, offrendo strumenti familiari e coerenti per la gestione dell'infrastruttura.

Jun 03 2026
Market

Walmart e l'AI: la realtà dei costi di inference per le grandi imprese

Walmart ha iniziato a limitare l'uso di un assistente AI interno a causa di costi di inference superiori alle attese, passando da un accesso illimitato a un sistema basato su token. Questa mossa riflette una tendenza più ampia nel settore, dove i Large Language Models (LLM) adottano modelli di pricing pay-per-use. La gestione dei costi e l'ottimizzazione dell'utilizzo dei modelli diventano cruciali per le grandi imprese che cercano di bilanciare produttività e spese operative dell'AI.

Jun 03 2026
Altro

Apoha: 36 milioni di dollari per insegnare alle macchine il comportamento della materia

Apoha ha annunciato un finanziamento da 36 milioni di dollari per sviluppare soluzioni che permettano alle macchine di simulare il comportamento della materia in condizioni reali. L'azienda mira a colmare una lacuna scientifica critica, offrendo un approccio scalabile ed economicamente vantaggioso per prevedere come le molecole interagiscono nell'ambiente, un fattore chiave per il successo nello sviluppo di farmaci e prodotti alimentari.

Jun 03 2026
Market

Qisda: il 2026 sarà l'anno della svolta per l'intelligenza artificiale

Il presidente di Qisda prevede un'accelerazione significativa nell'adozione dell'IA entro il 2026. Questa prospettiva sottolinea l'urgenza per le aziende di definire strategie infrastrutturali robuste, valutando attentamente i trade-off tra soluzioni cloud e deployment on-premise, con particolare attenzione a TCO, sovranità dei dati e requisiti hardware per i Large Language Models.

Jun 03 2026
Altro

INXM Raccoglie 5,7 Milioni di Euro per l'Automazione AI On-Premise nelle Imprese Europee

La startup berlinese INXM ha ottenuto un finanziamento pre-seed di 5,7 milioni di euro per la sua tecnicia di automazione dei processi basata su AI. La piattaforma, che emerge dalla modalità stealth, mira a risolvere le sfide di deployment dell'AI in ambienti enterprise e industriali, garantendo consistenza, auditabilità e conformità. Il suo approccio "Compiled AI" trasforma gli insight dei Large Language Models in processi deterministici, ideali per la sovranità dei dati e l'integrazione con infrastrutture esistenti, specialmente in Europa.

Jun 03 2026
Altro

Sovranità tecnicica: il Parlamento UK chiede lo stop a Palantir nel NHS

Il comitato per la scienza e la tecnicia del Parlamento britannico ha esortato il governo a rescindere il contratto con Palantir per la Federated Data Platform del NHS. La richiesta nasce dalla preoccupazione per il "vendor lock-in" e la dipendenza da fornitori esterni in settori critici. Il comitato suggerisce di sviluppare soluzioni interne o affidarsi a imprese britanniche per garantire la sovranità tecnicica e la sicurezza dei dati, sottolineando l'importanza di un'infrastruttura digitale robusta per i futuri progetti nazionali.

Jun 03 2026
LLM

I fan del Mondiale usano l'AI per aggirare il caro-biglietti e i bagarini

I tifosi di calcio si stanno organizzando su Reddit, sfruttando Large Language Models come Claude per sviluppare software di ticketing fai-da-te. L'obiettivo è contrastare i prezzi esorbitanti dei biglietti per la Coppa del Mondo e l'attività dei bagarini, dimostrando come l'AI possa essere impiegata per soluzioni creative e decentralizzate, con implicazioni interessanti per il controllo dei dati e il deployment di applicazioni personalizzate.

Jun 03 2026
Market

Oxford Quantum Circuits raccoglie 260 milioni di sterline: una svolta per il quantum computing britannico

Oxford Quantum Circuits (OQC), spin-off dell'Università di Oxford, ha chiuso un round di finanziamento Series C da 260 milioni di sterline, il più grande mai registrato in Europa per il quantum computing privato. L'investimento segna un "momento di maturità" per il settore britannico, evidenziando il passaggio dalla promessa a consegne concrete. OQC sviluppa hardware e software per computer quantistici superconduttori, offrendo la propria tecnicia come servizio cloud a settori critici come finanza e difesa.

Jun 03 2026
Altro

SolarDew raccoglie 800.000 euro per la purificazione dell'acqua a energia solare

La startup olandese SolarDew ha ottenuto 800.000 euro per espandere la sua tecnicia di purificazione dell'acqua a energia solare. La soluzione, che sfrutta evaporazione e condensazione, opera autonomamente grazie all'energia termica solare e alla gravità, senza necessità di elettricità o prodotti chimici. Mira a fornire acqua potabile a un milione di persone entro il 2035, specialmente in aree remote e con scarsità idrica, offrendo un'alternativa sostenibile ai sistemi centralizzati e complessi.

Jun 03 2026
Hardware

Quobly raccoglie 115 milioni per i computer quantistici su silicio

La startup francese Quobly, con sede a Grenoble, ha recentemente raccolto 115 milioni di euro per sviluppare computer quantistici basati su chip di silicio. L'azienda si distingue per un approccio che mira a sfruttare l'infrastruttura produttiva esistente nel settore dei semiconduttori, a differenza di altre realtà che richiedono materiali e processi di fabbricazione completamente nuovi. Questa strategia potrebbe accelerare l'adozione della tecnicia quantistica, rendendola potenzialmente più accessibile e scalabile.

Jun 03 2026
Market

MiniMax e Z.ai: la corsa a Shanghai riflette la crescita del compute AI

MiniMax e Z.ai, due attori emergenti nel panorama dell'intelligenza artificiale, stanno esplorando la quotazione a Shanghai. Questa mossa evidenzia una tendenza più ampia: l'incremento significativo degli investimenti nel compute dedicato all'AI. La crescente domanda di risorse computazionali, sia per il training che per l'Inference di Large Language Models, spinge le aziende a cercare capitali per sostenere l'espansione infrastrutturale, un fattore chiave per chi valuta strategie di Deployment on-premise o ibride.

Jun 03 2026
LLM

La visione di Pegatron: un futuro con AI pensante e capace di agire

Il presidente di Pegatron, T.H. Tung, ha delineato una visione audace per il futuro dell'intelligenza artificiale, immaginando sistemi capaci di pensiero e azione autonomi. Questa prospettiva solleva interrogativi cruciali sulle infrastrutture necessarie per supportare tali capacità avanzate, spingendo la riflessione sui requisiti hardware e le strategie di deployment per l'AI di prossima generazione, con un occhio di riguardo alla sovranità dei dati e al TCO.

Jun 03 2026
Altro

Liteon: RTX Spark per trasformare i PC AI in assistenti personali

Liteon, tramite il suo presidente Anson Chiu, ha delineato una visione in cui la tecnicia "RTX Spark" potrebbe rivoluzionare i PC AI, trasformandoli in veri e propri assistenti personali. Questa prospettiva suggerisce un futuro in cui le capacità di intelligenza artificiale sono integrate e gestite localmente, offrendo nuove possibilità per l'interazione utente e la gestione dei dati direttamente sul dispositivo, in linea con i principi di sovranità e controllo.

Jun 03 2026
Hardware

Micron punta su HBM4: implicazioni per l'ecosistema Nvidia e i deployment AI

La strategia di Micron di focalizzarsi sulle memorie HBM4 preannuncia un ruolo di fornitore sempre più rilevante per Nvidia. Questa evoluzione è cruciale per l'industria dell'intelligenza artificiale, poiché le memorie HBM sono fondamentali per le performance delle GPU di prossima generazione. L'innovazione in questo settore influenzerà direttamente la capacità di gestire carichi di lavoro AI complessi, specialmente nei contesti di deployment on-premise, dove la sovranità dei dati e il TCO sono prioritari.

Jun 03 2026
Altro

La visione di NXP: l'AI fisica deve agire come una spina dorsale, non solo un cervello

Al COMPUTEX Taipei, il CEO di NXP ha delineato una visione per l'AI fisica che trascende la mera elaborazione cognitiva. L'intelligenza artificiale, secondo questa prospettiva, dovrebbe emulare la reattività e la distribuzione della spina dorsale, integrandosi profondamente con il mondo fisico per decisioni rapide e localizzate. Questo approccio ha implicazioni significative per i deployment on-premise e l'edge computing, enfatizzando sovranità dei dati e TCO.

Jun 03 2026
Market

Flok Health raccoglie 12,5 milioni di dollari per espandere la sua piattaforma AI per la fisioterapia

Flok Health, piattaforma di cura digitale basata su intelligenza artificiale, ha chiuso un round di finanziamento Series A da 12,5 milioni di dollari. I fondi saranno impiegati per espandere i servizi di fisioterapia autonoma in UK, sviluppare nuove terapie e accedere a mercati internazionali. La soluzione, certificata come dispositivo medico di Classe IIa, mira a colmare il divario tra domanda e offerta nel settore sanitario, offrendo accesso immediato a trattamenti per patologie muscoloscheletriche.

Jun 03 2026
Market

Gigaton: 26 milioni per l'AI che rivoluziona il controllo nell'industria pesante

Gigaton ha ottenuto un finanziamento di 26 milioni di dollari per sviluppare soluzioni AI destinate a sostituire il software di controllo obsoleto nell'industria pesante. L'obiettivo è modernizzare la gestione di impianti critici come i forni per cemento, che operano a temperature estreme e con sistemi spesso datati, migliorando efficienza e controllo operativo.

Jun 03 2026
Altro

Megaport punta al cloud AI distribuito e al mercato dell'inference con un maxi-finanziamento

Megaport, azienda australiana specializzata in networking, ha annunciato un'importante espansione strategica nel settore del cloud AI distribuito, con un focus specifico sul mercato dell'inference. L'iniziativa è sostenuta da nuovi contratti per infrastrutture AI del valore di circa 458,9 milioni di dollari australiani e da un'offerta di capitale per raccogliere 827,3 milioni di dollari australiani. Questo posizionamento mira a trasformare l'azienda in un fornitore di servizi AI, segnando un'evoluzione significativa nel suo modello di business.

Jun 03 2026
LLM

LLM quantizzati: perché la validità delle chiamate a strumenti è il vero benchmark

L'attuale valutazione dei Large Language Models quantizzati si concentra su perplessità e qualità della prosa, ma trascura la validità dell'output strutturato, come le chiamate a strumenti JSON. Questa lacuna può portare a deployment inaffidabili, poiché errori invisibili nel testo diventano critici nelle schemi. È urgente sviluppare benchmark che misurino l'accuratezza delle chiamate a strumenti per garantire l'affidabilità dei sistemi AI agentici, specialmente in contesti on-premise.

Jun 03 2026
Altro

Kodesage: 6,6 milioni per l'AI on-premise e la modernizzazione del software legacy

Kodesage, startup con sedi a Londra e Budapest, ha raccolto 6,6 milioni di dollari per la sua soluzione di modernizzazione AI. L'azienda si concentra sulla trasformazione di sistemi legacy come COBOL e Oracle Forms, tipici di banche e assicurazioni, garantendo che l'intera pipeline AI operi esclusivamente on-premise. Questo approccio risponde all'esigenza di sovranità dei dati, controllo e sicurezza per settori con infrastrutture critiche e software datato, mitigando i rischi associati alla migrazione al cloud.

Jun 03 2026
Market

GitLab: tagli al personale e uscita da 22 Paesi per l'era 'agentic'

GitLab ha annunciato una significativa ristrutturazione che prevede il taglio del 14% della forza lavoro e l'uscita da 22 mercati. La decisione, motivata dall'esigenza di riallineare la struttura operativa per affrontare la cosiddetta 'era agentic', arriva nonostante una crescita del 23% dei ricavi nel primo trimestre dell'anno fiscale 2027, superando le aspettative di Wall Street.

Jun 03 2026
Altro

Il regolatore UK impone a Google un opt-out per l'addestramento AI sui dati dei publisher

L'autorità britannica per la concorrenza (CMA) ha imposto nuove regole a Google, riconoscendone lo status di mercato strategico. Tra le disposizioni spicca un "AI-training opt-out" che consente ai publisher di negare l'uso dei propri contenuti per l'addestramento di modelli AI. Questa mossa sottolinea l'importanza della sovranità dei dati e del controllo sui contenuti nell'era dell'intelligenza artificiale.

Jun 03 2026
Altro

OpenAI valuta alternative a CUDA per l'infrastruttura AI

OpenAI sta esplorando attivamente soluzioni software e hardware per ridurre la dipendenza dall'ecosistema CUDA di Nvidia. Questa mossa mira a diversificare l'infrastruttura AI, potenzialmente abbassando i costi e aumentando il controllo sulle operazioni, un aspetto cruciale per chi valuta deployment on-premise e la sovranità dei dati.

Jun 03 2026
Hardware

xMEMS punta al 2027 per i chip di raffreddamento: un futuro più fresco per AI e SSD

Durante Computex 2026, xMEMS ha presentato la sua tecnicia µCooling, promettendo una soluzione ai limiti termici di dispositivi come occhiali AI e SSD. Mike Housholder, VP dell'azienda, ha indicato il 2027 come anno di debutto. Questa innovazione potrebbe sbloccare nuove possibilità per l'hardware AI compatto e ad alte prestazioni, affrontando una sfida cruciale per l'adozione di soluzioni on-premise e edge, dove la gestione del calore è spesso un fattore limitante per l'integrazione di componenti potenti.

Jun 03 2026
Market

Nvidia accelera la produzione di "Vera Rubin"; Quanta espande negli USA

Nvidia intensifica la produzione del progetto "Vera Rubin", un'iniziativa che potrebbe influenzare la disponibilità di hardware critico per l'AI. Parallelamente, Quanta Computer ha annunciato l'apertura di tre nuovi stabilimenti negli Stati Uniti entro la fine del 2026, segnalando un'espansione significativa della capacità produttiva. Questi sviluppi evidenziano le dinamiche della supply chain nel settore tecnicico, con potenziali impatti sui deployment on-premise e sull'approvvigionamento di componenti essenziali.

Jun 03 2026
Hardware

GlobalFoundries acquisisce ARC di Synopsys: una spinta all'AI fisica

GlobalFoundries ha completato l'acquisizione del business IP dei processori ARC di Synopsys. Questa mossa strategica mira a rafforzare la capacità dell'azienda di sviluppare piattaforme AI fisiche, con implicazioni significative per l'elaborazione dell'intelligenza artificiale a livello hardware. L'operazione sottolinea l'importanza crescente di soluzioni AI ottimizzate per l'edge e per deployment on-premise, dove il controllo diretto sull'hardware e la sovranità dei dati sono prioritari.

Jun 03 2026
Market

Upstream lancia l'inbox AI-native: collaborazione tra umani e agenti con $3M di funding

La startup parigina Upstream ha annunciato il rilascio generale della sua piattaforma di posta elettronica AI-native, raccogliendo 3 milioni di dollari in un round pre-seed. La soluzione reinventa l'inbox per la collaborazione tra utenti e agenti AI, che possono leggere, scrivere e agire per conto dell'utente. Upstream enfatizza il controllo utente e la privacy, assicurando che i modelli AI non vengano addestrati sui dati dei clienti.

Jun 03 2026
Market

ChatGPT: un miliardo di utenti mensili in tre anni, un record per le app

ChatGPT, l'applicazione di OpenAI, ha superato il miliardo di utenti attivi mensili globali a maggio, circa tre anni dopo il suo lancio. Secondo le stime di Sensor Tower, questo traguardo la rende l'applicazione più rapida nella storia a raggiungere tale volume di utenza. Il dato sottolinea la rapida adozione dei Large Language Models e le implicazioni per l'infrastruttura IT aziendale.

Jun 03 2026
Hardware

Lightmatter e Nvidia: connettività ottica per l'AI nell'ecosistema NVLink Fusion

Lightmatter ha annunciato la sua adesione all'ecosistema Nvidia NVLink Fusion, un passo significativo per l'espansione della connettività ottica nell'ambito dell'intelligenza artificiale. Questa collaborazione mira a migliorare le capacità di interconnessione per i carichi di lavoro AI, offrendo soluzioni che possono impattare l'efficienza e la scalabilità dei deployment on-premise, un aspetto cruciale per le aziende che cercano controllo e sovranità sui propri dati e infrastrutture.

Jun 03 2026
Market

Factorial raccoglie 150 milioni di dollari per l'espansione AI in Europa

Factorial, azienda di software per la gestione della forza lavoro con sede a Barcellona, ha chiuso un round di finanziamento Series D da 150 milioni di dollari, raggiungendo una valutazione di 2,5 miliardi. Guidato da General Catalyst, l'investimento, che include un impegno aggiuntivo di 540 milioni, supporterà l'espansione europea e lo sviluppo di una piattaforma "AI-first" con agenti intelligenti per HR, finanza e IT, segnando una transizione strategica per l'azienda.

Jun 03 2026
Hardware

Quobly ottiene 115 milioni di euro per i computer quantistici su silicio e il deployment industriale

Quobly, azienda francese specializzata in computer quantistici basati su silicio, ha chiuso un round di finanziamento Series A da 115 milioni di euro. L'investimento mira ad accelerare l'industrializzazione della sua tecnicia FD-SOI e il lancio dei primi sistemi commerciali. Il primo prodotto, Alloy Pioneer, sarà disponibile via cloud nel 2026 e successivamente integrato in ambienti HPC e data center esistenti, sottolineando un approccio al deployment scalabile e compatibile con le infrastrutture attuali.

Jun 03 2026
Frameworks

Mellum e Granite: Nuovi Embedding Models su llama.cpp per Deployment Locali

Il framework `llama.cpp` ha annunciato il supporto per i modelli di embedding Mellum e Granite. Questa integrazione estende le capacità di `llama.cpp` per l'inference locale di modelli di linguaggio, offrendo nuove opportunità per architetture RAG e applicazioni di ricerca semantica on-premise. La mossa rafforza l'approccio self-hosted per le aziende che cercano maggiore controllo e sovranità sui propri dati AI.

Jun 03 2026
LLM

Holo3.1: VLM per Agenti Locali, dalla Scrivania al Mobile

Hcompany ha rilasciato Holo3.1, una famiglia di Vision-Language Models (VLM) progettati per agenti di automazione. Questi modelli, basati su Qwen 3.5 e disponibili in diverse dimensioni, supportano il deployment locale grazie a checkpoint quantizzati ottimizzati. Holo3.1 estende l'automazione a web, desktop e mobile, integrando il function-calling nativo per una maggiore flessibilità e efficienza dei costi nei deployment on-premise.

Jun 03 2026
Frameworks

llama.cpp: Nuovi Benchmark su Doppia RTX 3090 Ridisegnano le Performance On-Premise

Un recente test di llama.cpp con la build b9455b e funzionalità di tensor-split su una configurazione duale di NVIDIA RTX 3090 ha mostrato un significativo incremento delle performance. Il framework raggiunge ora oltre 70 token/secondo per la generazione, e fino a 1400 token/secondo in prefill, eguagliando o superando soluzioni alternative per modelli come Qwen3.6-27B-UD-Q8_K_XL, con un'attenzione particolare alla qualità dell'output e alla gestione di contesti estesi.

Jun 03 2026
Market

Nvidia e Infineon: il co-design nella supply chain per l'efficienza energetica AI

Nvidia e Infineon stanno intensificando la collaborazione per ottimizzare la supply chain, affrontando i crescenti limiti di potenza nell'AI. L'obiettivo è migliorare l'efficienza energetica dei sistemi, un fattore cruciale per i deployment on-premise e la riduzione del TCO in un'era di domanda computazionale sempre maggiore.

Jun 03 2026
Altro

La domanda di sistemi di raffreddamento per l'AI in forte crescita fino al 2029

Il mercato dei sistemi di raffreddamento per l'intelligenza artificiale sta vivendo un'espansione significativa, con previsioni di crescita sostenuta fino al 2029. Questa tendenza riflette l'aumento della potenza di calcolo richiesta dai Large Language Models e dai carichi di lavoro AI, ponendo nuove sfide infrastrutturali per i deployment on-premise e ibridi in termini di gestione termica ed efficienza energetica.

Jun 03 2026
LLM

Microsoft lancia Aion: LLM on-device per efficienza e ragionamento locale

Microsoft ha presentato Aion 1.0 Instruct e Aion 1.0 Plan, due nuovi LLM progettati per carichi di lavoro on-device. Aion 1.0 Instruct è un Small Language Model con pesi aperti per intelligenza testuale quotidiana, mentre Aion 1.0 Plan, con 14 miliardi di parametri e 32K di contesto, abilita workflow agentici e tool-calling direttamente sui dispositivi Windows compatibili, enfatizzando il controllo locale e la sovranità dei dati.

Jun 03 2026
LLM

L'Esponente di Curvatura nei Loss Landscape delle Reti Neurali: Implicazioni per l'AI

Una ricerca approfondisce l'esponente di curvatura nei loss landscape delle reti neurali, un parametro che descrive la relazione tra gli autovalori dell'Hessiana e i valori singolari del gradiente. La sua variazione tra strati convoluzionali e di attenzione nei Transformer suggerisce nuove vie per ottimizzare i processi di training. Comprendere queste dinamiche è cruciale per migliorare l'efficienza e ridurre il TCO nei deployment AI on-premise, influenzando la scelta delle architetture e l'utilizzo dell'hardware.

Jun 03 2026
Frameworks

LSTM batte Transformer encoder-only nella previsione idrologica per bacini non monitorati

Uno studio ha confrontato le architetture Transformer (encoder-only) e LSTM per l'inference del flusso idrico in bacini non monitorati, utilizzando simulazioni del NOAA National Water Model. I risultati indicano che l'LSTM ha mostrato prestazioni complessivamente superiori rispetto al Transformer per la ricostruzione a monte. L'integrazione di informazioni a valle ha migliorato significativamente le capacità predittive di entrambi i modelli, evidenziando l'importanza del contesto idrologico per l'efficienza dei Framework AI.

Jun 03 2026
LLM

LLM e sostenibilità: più "verdi" degli umani, ma con riserve

Uno studio ha analizzato le "attitudini ambientali" di 31 Large Language Models, proprietari e open-weight, confrontandole con quelle umane. I risultati indicano che molti LLM mostrano un allineamento più progressista verso la sostenibilità, suggerendo comportamenti con potenziale di riduzione di CO2. Tuttavia, la ricerca evidenzia anche una sensibilità contestuale e una tendenza alla "sycophancy" (compiacenza) che sollevano interrogativi sulla loro affidabilità normativa nei deployment reali, sottolineando l'importanza di governance e trasparenza.

Jun 03 2026
LLM

IdiomX: Un Nuovo Benchmark Multilingue per la Comprensione degli Idiomi nei LLM

IdiomX è un benchmark multilingue su larga scala progettato per migliorare la comprensione, il recupero e l'interpretazione delle espressioni idiomatiche da parte dei Large Language Models. Il dataset include oltre 190.000 esempi contestualizzati e più di 12.000 idiomi, con rappresentazioni semantiche allineate in inglese, arabo e francese. Questo strumento affronta le sfide legate alla natura non composizionale degli idiomi, offrendo un framework modulare per valutare e potenziare le capacità dei modelli linguistici moderni in contesti multilingue.

Jun 03 2026
Altro

BCI: Architetture Leggere per la Robustezza contro Attacchi Avversari

La ricerca sulle interfacce cervello-computer (BCI) basate su EEG ha trascurato la sicurezza, rendendole vulnerabili agli attacchi avversari. Un nuovo studio propone un'architettura CNN leggera che migliora significativamente la robustezza di questi sistemi. Testata contro modelli esistenti, la soluzione ha dimostrato maggiore resistenza alle perturbazioni, evidenziando il potenziale delle architetture leggere per deployment affidabili e sicuri, specialmente in contesti on-premise dove la sovranità dei dati è cruciale.

Jun 03 2026
LLM

LLM: i grafici visivi come impalcatura interna per un ragionamento più efficace

Una nuova ricerca esplora il potenziale dei grafici non solo come fonti di conoscenza esterne, ma come strumenti interni per organizzare il ragionamento degli LLM. Gli esperimenti su compiti di risposta a domande multi-hop rivelano un "modality gap": la guida visiva tramite grafici supera nettamente l'approccio testuale, migliorando l'efficienza e la qualità del ragionamento. Questo suggerisce un nuovo paradigma per lo sviluppo di LLM più robusti e autonomi.

Jun 03 2026
Market

L'ambizione europea per una 'gigafactory' AI da 20 miliardi di euro rallenta

L'Unione Europea mira a creare una "gigafactory" per l'intelligenza artificiale con un investimento di 20 miliardi di euro, ma il progetto sta affrontando ritardi significativi. Questa situazione solleva preoccupazioni sulla capacità del continente di competere con i progressi rapidi dei rivali globali nel settore dell'AI, in particolare per quanto riguarda l'infrastruttura di calcolo e lo sviluppo di Large Language Models. La sfida è mantenere il passo in un mercato in rapida evoluzione.

Jun 03 2026
Market

SK Group e Foxconn: colloqui per rafforzare la filiera AI tra Taiwan e Corea

SK Group e Foxconn hanno avviato colloqui esclusivi che potrebbero portare a un rafforzamento dei legami nella filiera dell'intelligenza artificiale tra Taiwan e Corea del Sud. Questa potenziale collaborazione è cruciale per la stabilità e l'efficienza della produzione di componenti hardware essenziali per i deployment di Large Language Models (LLM) on-premise, influenzando direttamente il TCO e la sovranità dei dati per le aziende.

Jun 03 2026
Market

La corsa all'AI ridefinisce il settore dei semiconduttori: sfide e opportunità

L'accelerazione della corsa all'intelligenza artificiale sta profondamente trasformando l'industria dei semiconduttori, come evidenziato in eventi chiave come il Computex. Questa evoluzione impone nuove sfide e opportunità per le aziende che valutano deployment on-premise di Large Language Models, richiedendo investimenti strategici in hardware specializzato e un'attenta analisi del TCO per garantire sovranità dei dati e controllo infrastrutturale.

← Precedente Page 43 / 160 Successiva →