🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15941

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

May 31 2026
Hardware

Il Ritorno dell'Hardware Specializzato: Lezioni per i Deployment LLM On-Premise

Il recente ritorno della scheda audio ISA Orpheus II, spinto dalla domanda di nicchia per sistemi DOS e Windows legacy, offre uno spunto di riflessione. Questo fenomeno evidenzia come la richiesta di hardware specifico, ottimizzato per carichi di lavoro ben definiti, sia cruciale anche nel contesto dei Large Language Models. Per CTO e architetti infrastrutturali, la scelta di soluzioni on-premise richiede un'attenta valutazione delle specifiche hardware per garantire sovranità dei dati e TCO.

May 31 2026
LLM

Ottimizzare LLM on-premise per assistenti agentici: il caso Gemma 4B

Un utente cerca consigli per migliorare le capacità di *tool calling* di LLM da circa 4 miliardi di parametri, come Gemma-4-E4B, in un ambiente *self-hosted*. L'implementazione attuale sfrutta `llama-server` con una finestra di contesto di 65536 *token*, *quantization* Q8_0 e il 99% dei *layer* del modello scaricati su GPU, evidenziando le sfide nel bilanciare performance e risorse locali per carichi di lavoro agentici.

May 31 2026
Hardware

Controllo Granulare delle GPU Nvidia: Il Pannello Originale Resta Cruciale per RTX Pro e Framework On-Premise

Nonostante l'evoluzione dei driver, il Pannello di Controllo Nvidia originale mantiene la sua rilevanza per la gestione e l'ottimizzazione delle GPU professionali RTX Pro e Framework. La sua disponibilità tramite il Microsoft Store sottolinea l'importanza di un controllo granulare sulle impostazioni hardware, fondamentale per i deployment on-premise di carichi di lavoro AI/LLM e per le attività di troubleshooting.

May 31 2026
Altro

LLM on-premise: Windows 11 e Linux, parità di performance con llama.cpp per i modelli MoE

Un test approfondito su hardware consumer ha sfatato il mito di una superiorità prestazionale di Linux rispetto a Windows 11 nell'esecuzione di Large Language Models (LLM) di tipo Mixture of Experts (MoE) tramite `llama.cpp`. L'analisi, condotta con modelli come Qwen 3.5 122B e 397B, ha rivelato differenze marginali nei tassi di elaborazione del prompt e generazione di token. WSL, tuttavia, ha mostrato un calo significativo delle performance, evidenziando l'importanza dell'ambiente nativo per deployment on-premise efficienti.

May 31 2026
Frameworks

Zrythm 2.0 Alpha: La DAW open source si rinnova con C++ e Qt/QML

Zrythm, la Digital Audio Workstation (DAW) open source, ha rilasciato la prima alpha della versione 2.0. Questa release segna un passaggio significativo dalla storica base GTK a un nuovo stack tecnicico basato su C++ e Qt6/QML. L'aggiornamento mira a migliorare le performance e la compatibilità multipiattaforma, aspetti cruciali per gli sviluppatori e gli architetti di sistema che valutano le scelte di framework per applicazioni complesse e deployment on-premise.

May 31 2026
Market

DuckDuckGo: installazioni in forte crescita, picchi del 70% su dispositivi Apple

DuckDuckGo ha registrato un notevole aumento delle installazioni della sua app negli Stati Uniti, con una crescita media del 18% settimana su settimana tra il 20 e il 25 maggio. Il picco ha raggiunto il 30% il Memorial Day. Su dispositivi Apple, l'incremento settimanale è stato del 33%, con un picco giornaliero di quasi il 70%, a seguito di recenti modifiche annunciate da Google.

May 31 2026
Market

FSD di Tesla: chi ha addestrato l'AI non si fida del sistema

Un'indagine Reuters ha rivelato che la maggior parte degli ex specialisti di dati e ingegneri che hanno lavorato all'addestramento dell'intelligenza artificiale per la modalità Full Self-Driving (FSD) di Tesla non si sentirebbe sicura a bordo di un veicolo che la utilizza. Sette dei nove data labeler intervistati hanno espresso una netta sfiducia, con uno che ha rifiutato categoricamente l'idea di un robotaxi Tesla. Questo solleva interrogativi sulla maturità e l'affidabilità percepita dei sistemi di guida autonoma.

May 31 2026
Hardware

Linux 7.1-rc6: La documentazione su "clearcpuid" sarà rimossa per scoraggiarne l'uso

Il kernel Linux 7.1-rc6 vedrà la rimozione della documentazione relativa al parametro `clearcpuid`. Questo strumento, utile per disabilitare specifiche funzionalità CPUID e in passato impiegato per benchmark comparativi di AVX-512, non sarà più documentato per scoraggiarne l'utilizzo. La decisione mira a limitare l'impiego di una funzionalità che permetteva di alterare il comportamento della CPU a livello di sistema operativo, promuovendo configurazioni hardware più trasparenti e prevedibili, cruciali per i deployment on-premise di carichi di lavoro AI.

May 31 2026
Market

Ex-dirigenti Snap lanciano un fondo per l'AI e il social media del futuro

Venti ex-dipendenti di Snap hanno fondato Ghost Angels, un fondo di investimento per startup che operano nel settore dei social media di nuova generazione e dell'AI consumer. Il fondo ha già finanziato almeno cinque aziende e prevede ulteriori investimenti in almeno quindici startup entro il prossimo anno, sebbene l'ammontare complessivo non sia stato divulgato. L'iniziativa riflette la convinzione che i concetti di "social" e "media" si stiano evolvendo separatamente.

May 31 2026
Altro

Utah inasprisce le regole per i data center: impatto sui progetti hyperscale

Il governatore dello Utah, Spencer Cox, ha firmato un ordine esecutivo che eleva gli standard per lo sviluppo di nuovi data center nello stato. La decisione arriva dopo mesi di proteste locali contro il "Stratos Project", un campus hyperscale da 40.000 acri che potrebbe richiedere fino a 9 gigawatt di energia. La mossa riflette la crescente attenzione all'impatto ambientale e infrastrutturale dei grandi impianti, un fattore cruciale per chi valuta deployment on-premise per carichi di lavoro AI.

May 31 2026
Altro

L'innovazione nei trapianti di capelli: il ruolo del Machine Learning e le sfide del deployment

L'industria turca dei trapianti di capelli, un settore da miliardi di dollari, è un esempio di innovazione continua, che spazia dai motori specializzati all'impiego di algoritmi di Machine Learning. Questa adozione tecnicica solleva questioni cruciali relative alla sovranità dei dati, ai requisiti hardware per l'Inference e alle implicazioni sul Total Cost of Ownership (TCO) per le aziende che valutano soluzioni di deployment on-premise.

May 31 2026
LLM

Qwen 3.6 35B-A3B: Nuova Quantization APEX-MTP per Deployment On-Premise

È stata rilasciata una nuova versione quantizzata APEX-MTP del modello Qwen 3.6 35B-A3B, ottimizzata per l'inference locale tramite `llama.cpp`. Questa release integra la testa di predizione multi-token (MTP) per il self-speculative decoding, riducendo la necessità di modelli ausiliari separati. L'iniziativa, supportata da hardware come NVIDIA DGX Spark, mira a rendere i Large Language Models più accessibili per carichi di lavoro on-premise, enfatizzando l'efficienza e il controllo sui dati.

May 31 2026
Altro

L'Automotive Spinge AUO: Riflessioni sull'Framework AI On-Premise

AUO prevede una crescita dei ricavi a partire dal 2026, trainata dagli ordini nel settore automotive. Questa proiezione evidenzia la crescente integrazione dell'intelligenza artificiale nei veicoli e nei processi produttivi, ponendo nuove sfide per le aziende che devono gestire volumi massivi di dati. Per i decision-maker tech, ciò solleva interrogativi cruciali sulle strategie di deployment AI, con un'enfasi crescente sulle soluzioni on-premise per sovranità dei dati e controllo sui costi.

May 31 2026
Altro

Benchmark Motori di Inference LLM su Apple M1 Max 64GB: Efficienza On-Premise

Un recente benchmark ha analizzato le performance di diversi motori di inference per Large Language Models su un MacBook Pro con chip Apple M1 Max e 64GB di memoria unificata. I test, condotti con il modello Qwen3.5-4B, hanno rivelato che rapid-mlx offre la migliore combinazione di velocità ed efficienza della memoria, fornendo dati preziosi per le strategie di deployment on-premise.

May 31 2026
Hardware

Confronto visivo dei sistemi DGX Station GB300 OEM: sfide nella valutazione hardware

Un'analisi visiva affiancata dei sistemi DGX Station GB300 OEM rivela le sfide nella raccolta di dati tecnici completi, in particolare per soluzioni come l'HP ZGX Fury AI Station G1N. La difficoltà di accesso alle specifiche ufficiali evidenzia la complessità nel valutare le opzioni hardware per i deployment di Large Language Models, un aspetto cruciale per CTO e architetti infrastrutturali.

May 31 2026
Altro

AI on-premise: un utente svela il suo data center casalingo per LLM

Un utente ha condiviso i dettagli del suo sofisticato setup on-premise, composto da quattro sistemi distinti equipaggiati con CPU Threadripper, Xeon, Intel e Ryzen, affiancati da un totale di undici GPU NVIDIA di fascia alta, tra cui RTX 3090 Ti, 5070 Ti e una 5090. Questa infrastruttura è dedicata a esperimenti di ML, training di modelli TTS e all'esecuzione di LLM come Qwen 27B per lo sviluppo di codice, evidenziando i vantaggi del controllo e dell'assenza di costi per Token.

May 31 2026
Hardware

Nvidia, Microsoft e Arm: l'alba di una nuova era per il PC con l'AI locale

Nvidia, Microsoft e Arm preannunciano una "nuova era del PC" in vista del Computex, suggerendo un profondo cambiamento guidato dall'intelligenza artificiale. Questa evoluzione sposta l'elaborazione AI verso i dispositivi locali, promettendo vantaggi in termini di privacy, latenza e controllo sui dati, aspetti cruciali per le aziende che valutano deployment on-premise o edge.

May 31 2026
Altro

Taiwan Mobile: AI ed enterprise, la spinta alla crescita e le decisioni infrastrutturali

Taiwan Mobile ha delineato un ambizioso obiettivo di fatturato, identificando i servizi basati sull'intelligenza artificiale e le soluzioni per le aziende come motori chiave. Questa strategia evidenzia una tendenza di mercato in cui le imprese devono affrontare decisioni critiche riguardo al deployment dell'AI, bilanciando aspetti come la sovranità dei dati, il Total Cost of Ownership e le prestazioni per carichi di lavoro sempre più esigenti.

May 31 2026
Market

Domanda AI e investimenti in chip: impatto strategico sui deployment on-premise

L'escalation della domanda di intelligenza artificiale e i crescenti investimenti nel settore dei semiconduttori stanno influenzando profondamente il mercato globale. Questo scenario ha ripercussioni significative per le aziende che valutano strategie di deployment on-premise per i Large Language Models, toccando aspetti come la disponibilità hardware, i costi e la sovranità dei dati, e ridefinendo le priorità infrastrutturali.

May 31 2026
Hardware

Yageo punta sul raffreddamento a liquido e componenti di protezione per l'AI

Yageo, un attore chiave nel settore dei componenti elettronici, sta esplorando attivamente opportunità di dealmaking nel campo del raffreddamento a liquido e dei componenti di protezione per l'intelligenza artificiale. Questa mossa strategica riflette la crescente domanda di soluzioni avanzate per gestire il calore e salvaguardare l'hardware AI ad alte prestazioni, un aspetto cruciale per i deployment on-premise e le infrastrutture AI di nuova generazione.

May 31 2026
Hardware

Huawei Aito M9: L'SUV di lusso diventa una piattaforma AI on-the-edge

Huawei ha presentato l'Aito M9, un SUV di lusso che ridefinisce il concetto di veicolo integrando capacità avanzate di intelligenza artificiale direttamente a bordo. Questa trasformazione in una "piattaforma AI mobile" evidenzia la crescente tendenza a spostare l'elaborazione di carichi di lavoro AI dal cloud all'edge, con implicazioni significative per la sovranità dei dati, la latenza e l'efficienza operativa.

May 30 2026
LLM

Ottimizzare LLM Quantizzati su Hardware On-Premise: Un Approccio Sperimentale

Un utente esplora strategie per stabilizzare Large Language Models pesantemente quantizzati su configurazioni hardware locali con 80GB di VRAM. L'obiettivo è mitigare output imprevedibili, spesso associati a modelli quantizzati, attraverso la calibrazione dei parametri di campionamento come `temperature` e `top_p`, offrendo spunti preziosi per i deployment on-premise efficienti e il controllo della qualità degli output.

May 30 2026
Altro

Qwen 3.6 35b MoE su M1 Max: il potenziale degli LLM locali per la programmazione

Un utente ha dimostrato l'esecuzione del Large Language Model Qwen 3.6 35b MoE su un chip Apple M1 Max, evidenziando le capacità di deployment completamente locale e alimentato a batteria. Questa configurazione trasforma il dispositivo in una potente workstation per la programmazione, sottolineando come le soluzioni self-hosted possano offrire controllo e autonomia per carichi di lavoro AI, specialmente in contesti dove la sovranità dei dati e l'efficienza energetica sono prioritarie.

May 30 2026
Altro

SoftBank investe 75 miliardi di euro per data center da 5 GW in Francia

SoftBank ha annunciato un investimento massiccio, fino a 75 miliardi di euro, per la costruzione e l'operatività di nuovi data center in Francia. L'obiettivo è espandere la capacità infrastrutturale del paese di 5 gigawatt, un'iniziativa che potrebbe avere un impatto significativo sul panorama europeo dell'AI e del cloud, specialmente per le aziende che cercano soluzioni on-premise o ibride con enfasi sulla sovranità dei dati.

May 30 2026
LLM

NVIDIA e Qwen: l'efficienza dell'Inference con la Quantization NVFP4

NVIDIA ha rilasciato il modello Qwen3.6-35B-A3B-NVFP4, una versione quantizzata del Qwen3.6-35B-A3B di Alibaba. Utilizzando la Post Training Quantization a NVFP4, il modello riduce i requisiti di VRAM e spazio su disco di circa 3.06x, mantenendo un'accuratezza elevata. Ottimizzato per l'inference con vLLM, offre una soluzione efficiente per deployment di LLM, particolarmente vantaggiosa per ambienti on-premise con vincoli di risorse e TCO.

May 30 2026
Altro

Rust Coreutils 0.9: Sicurezza rafforzata e I/O Zero-Copy per l'infrastruttura

La versione 0.9 di Rust Coreutils introduce significative migliorie, focalizzandosi sul rafforzamento della sicurezza e sull'implementazione di I/O Zero-Copy. Questo aggiornamento dell'implementazione in Rust delle utility GNU Coreutils raggiunge ora una compatibilità del 90.4% con la suite di test GNU, offrendo una base più robusta ed efficiente per l'infrastruttura, particolarmente rilevante per i deployment on-premise che richiedono controllo e performance.

May 30 2026
Market

Meta prepara un ciondolo AI e un abbonamento "Wearables for Work"

Meta sta sviluppando un ciondolo basato su intelligenza artificiale, con test previsti entro il prossimo anno. Il dispositivo si basa sull'acquisizione di Limitless e sarà affiancato da un servizio in abbonamento chiamato "Wearables for Work", mirando a espandere l'uso dell'AI in contesti professionali e sollevando interrogativi sulle strategie di deployment e la sovranità dei dati.

May 30 2026
Market

Accordo Milionario per le Big Tech: Oltre il Budget Annuale di un Distretto Scolastico

Meta, Snap, TikTok e YouTube hanno raggiunto un accordo extragiudiziale da 27 milioni di dollari con il distretto scolastico di Breathitt County, Kentucky. La cifra supera dell'8% il budget annuale del distretto, evidenziando le significative implicazioni finanziarie che le grandi aziende tecniciche possono affrontare in contenziosi legali.

May 30 2026
Market

Il panorama degli investimenti AI in Asia: chi sono i protagonisti

L'Asia emerge come un hub cruciale per l'innovazione nell'intelligenza artificiale, con un flusso significativo di capitali diretti verso le startup del settore. Questo articolo esplora il ruolo degli investitori più attivi nella regione, analizzando come tali dinamiche finanziarie influenzino le scelte infrastrutturali e i modelli di deployment, ponendo l'accento sulle implicazioni per le strategie on-premise e la sovranità dei dati.

May 30 2026
Market

OpenAI esplora il mercato azionario: colloqui con Citi e JPMorgan per l'IPO

OpenAI, la società leader nello sviluppo di Large Language Models, sta avviando discussioni con istituzioni finanziarie di primo piano come Citi e JPMorgan per definire i ruoli in vista di una potenziale offerta pubblica iniziale (IPO). Questa mossa segue una valutazione di 852 miliardi di dollari ottenuta in un round di finanziamento a marzo 2026, evidenziando l'enorme interesse del mercato per il settore dell'intelligenza artificiale.

May 30 2026
Market

Groq cerca 650 milioni per potenziare il suo servizio cloud di LLM

Groq, startup statunitense specializzata in chip AI, sta cercando di raccogliere 650 milioni di dollari per accelerare l'espansione di GroqCloud. Il servizio, compatibile con OpenAI, mira a servire oltre 2 milioni di sviluppatori e numerose aziende Fortune 500 entro settembre 2025, consolidando la sua strategia nel crescente mercato dei Large Language Models basati su cloud.

May 30 2026
Market

Investimenti nel Settore AI: Nuovi Capitali per l'Innovazione On-Premise

Diverse aziende attive nel panorama dell'intelligenza artificiale, tra cui Ordermentum, Airis Labs e Cyient Semiconductors, hanno recentemente annunciato nuovi round di finanziamento. Questi capitali freschi alimentano lo sviluppo di soluzioni AI, con implicazioni significative per le strategie di deployment on-premise, la sovranità dei dati e l'ottimizzazione dell'infrastruttura per i Large Language Models.

May 30 2026
Hardware

Meta punta sull'hardware AI: in sviluppo un pendente intelligente

Meta sta investendo in modo significativo nello sviluppo di hardware basato sull'intelligenza artificiale. Le recenti indiscrezioni suggeriscono che l'azienda stia lavorando a un pendente intelligente con capacità AI. Questo approccio sottolinea la crescente tendenza a integrare l'AI direttamente nei dispositivi fisici, sollevando questioni importanti per le aziende che considerano il deployment di modelli AI su edge device o in ambienti on-premise, dove il controllo dei dati e l'efficienza hardware sono cruciali.

May 30 2026
Market

Anthropic riduce la lista di piattaforme non autorizzate per la vendita di azioni

Anthropic ha aggiornato il suo avviso riguardo le piattaforme non autorizzate che negoziano le sue azioni sul mercato secondario. Inizialmente, l'azienda aveva segnalato otto entità, ma ha successivamente ridotto la lista a quattro nomi specifici: Open Door Partners, Unicorns Exchange, Pachamama e Upmarket. Questa revisione ha visto la rimozione di alcuni attori di rilievo nel trading di mercati privati, tra cui Hiive, evidenziando la complessità della gestione della proprietà azionaria in contesti di rapida crescita.

May 30 2026
Altro

Gemini Spark di Google: l'assistente AI per le attività quotidiane e i dilemmi del deployment

Google ha introdotto Gemini Spark, un assistente AI progettato per automatizzare compiti quotidiani come la gestione della posta e la pianificazione di eventi. Sebbene la sua utilità sia evidente, il posizionamento di questo prodotto come entità separata solleva interrogativi, specialmente per le aziende che valutano soluzioni AI. Per i decisori tech, l'adozione di tali strumenti implica considerazioni critiche su architettura, sovranità dei dati e Total Cost of Ownership (TCO), aspetti centrali per i deployment on-premise.

May 30 2026
Altro

Robot Umanoidi in Zona di Guerra: Foundation Future Industries Testa i Phantom MK-1 in Ucraina

Una startup di San Francisco, Foundation Future Industries, ha inviato due robot umanoidi Phantom MK-1 in Ucraina per test logistici, segnando il primo deployment noto di tale tecnicia in un teatro di combattimento. L'iniziativa, supportata dal governo statunitense, mira a valutare l'efficacia di questi sistemi in ambienti critici, con l'obiettivo di un possibile impiego sulle linee del fronte americane entro 18 mesi. L'operazione solleva interrogativi sulle sfide e le implicazioni dei deployment robotici on-premise in contesti complessi.

May 30 2026
Hardware

AMD Rafforza i Driver Grafici per Linux 7.2: Implicazioni per i Carichi di Lavoro AI

AMD ha recentemente presentato una serie di aggiornamenti significativi per i suoi driver grafici AMDGPU e AMDKFD destinati al kernel Linux 7.2. Questi miglioramenti, integrati in DRM-Next, mirano a ottimizzare le prestazioni grafiche e di calcolo. Per le aziende che implementano LLM on-premise, la qualità e l'efficienza dei driver sono cruciali per massimizzare l'investimento hardware e garantire la sovranità dei dati.

May 30 2026
Market

Nikon sfida il monopolio ASML nella litografia: impatto sulla filiera dei chip AI

Nikon sta intensificando la competizione nel mercato della litografia, un settore cruciale per la produzione di chip, sfidando la posizione dominante di ASML. L'azienda giapponese punta su prezzi aggressivi e la propria capacità produttiva interna per attirare i produttori di chip, inclusi quelli americani. Questa mossa potrebbe avere ripercussioni significative sulla disponibilità e sul costo dell'hardware fondamentale per i carichi di lavoro AI, influenzando le strategie di deployment on-premise.

May 30 2026
Hardware

Qwen3.6 su 2x RTX 4060 Ti: Efficienza e Potenza per LLM On-Premise

Un recente test utente ha evidenziato prestazioni notevoli per il modello Qwen3.6 (q4xl) su una configurazione hardware accessibile. Utilizzando due NVIDIA GeForce RTX 4060 Ti, con un totale di 32GB di VRAM e un costo inferiore ai 1000 dollari, è stato possibile raggiungere 125 token/secondo con un consumo di circa 300 watt. Questo risultato sottolinea il potenziale delle soluzioni self-hosted per l'inference di Large Language Models, offrendo un'alternativa competitiva ai servizi cloud, specialmente per chi cerca controllo sui dati e ottimizzazione del TCO.

May 30 2026
Altro

La sfida alle piattaforme dominanti: alternative per l'AI on-premise

Nel panorama tecnicico, la ricerca di alternative alle soluzioni dominanti è una costante. Questo articolo esplora come questa dinamica si rifletta nel settore dell'intelligenza artificiale, dove la crescente adozione di Large Language Models (LLM) spinge le organizzazioni a valutare opzioni self-hosted per garantire sovranità dei dati, controllo e ottimizzazione del Total Cost of Ownership (TCO), sfidando l'egemonia delle piattaforme cloud.

May 30 2026
Market

Kevin O'Leary: Propaganda Cinese dietro il Rifiuto dei Datacenter USA per Frenare l'AI

Kevin O'Leary sostiene che la propaganda cinese stia alimentando il sentiment anti-datacenter negli Stati Uniti, con centinaia di milioni di dollari spesi per minare la leadership americana nell'AI. Le sue affermazioni, che vedono un'interferenza straniera, sono corroborate da esponenti del settore e dall'amministrazione Trump, evidenziando le tensioni geopolitiche sull'infrastruttura AI.

May 30 2026
Altro

Huawei: le restrizioni USA hanno accelerato lo sviluppo del silicio cinese e Ascend

Il presidente di Huawei ha espresso gratitudine per le restrizioni all'export di chip imposte dagli Stati Uniti, sostenendo che tali misure abbiano catalizzato lo sviluppo dell'industria cinese dei semiconduttori. Queste politiche hanno spinto le aziende locali a investire massicciamente in ricerca e sviluppo, portando alla creazione di stack tecnicici proprietari, come la piattaforma Huawei Ascend, che ora competono con le soluzioni americane. Questo scenario evidenzia una crescente spinta verso la sovranità tecnicica.

May 30 2026
Market

Inherent emerge dallo stealth con 50 milioni per un'AI che guida la ricerca scientifica

Il laboratorio AI londinese Inherent ha annunciato un round seed da 50 milioni di dollari, co-guidato da Index Ventures e Radical Ventures, con la partecipazione di NVentures di Nvidia. Fondato da ex-ricercatori di DeepMind e Microsoft, Inherent mira a sviluppare un'intelligenza artificiale in grado di identificare le domande scientifiche più rilevanti, posizionandosi tra le maggiori raccolte di capitale europee per il 2026.

May 30 2026
Altro

Microsoft e la controversia sulle vulnerabilità: minacce legali a un ricercatore scatenano l'ira della community

Microsoft ha generato una forte reazione nella comunità della cybersecurity dopo aver criticato pubblicamente il ricercatore "Nightmare Eclipse" per aver rivelato vulnerabilità non patchate in Windows Defender e BitLocker. L'azienda ha poi coinvolto la sua Digital Crimes Unit, un'unità che gestisce segnalazioni penali e coordinamento con le forze dell'ordine, provocando indignazione per le implicazioni sulla divulgazione responsabile delle falle di sicurezza e sul ruolo dei ricercatori.

May 30 2026
Market

Il G7 definisce una posizione comune sull'AI open source e i modelli a pesi aperti

I Ministri del Digitale e della Tecnologia del G7 hanno raggiunto un accordo su un linguaggio condiviso per l'intelligenza artificiale open source e l'importanza dei modelli a pesi aperti. Questa intesa, raggiunta in vista del 52° Summit del G7, sottolinea il crescente riconoscimento del ruolo cruciale dell'open source nello sviluppo e nel deployment dell'AI, con implicazioni significative per la sovranità dei dati e le strategie on-premise.

May 30 2026
Market

Parloa: 350 milioni e nuove alleanze per gli agenti AI enterprise

Parloa, piattaforma berlinese specializzata nella gestione di agenti AI, ha annunciato una serie di partnership strategiche con SAP, Microsoft, OpenAI, Five9 ed Epic. L'azienda sta impiegando i 350 milioni di dollari raccolti nel round Series D di gennaio 2026 per potenziare la sua offerta di agenti AI per il servizio clienti enterprise, avendo già superato i 50 milioni di dollari di ricavi ricorrenti annuali.

May 30 2026
Market

Groq raccoglie 650 milioni dopo l'accordo da 20 miliardi con Nvidia

Groq, l'azienda specializzata nell'accelerazione dell'Inference per Large Language Models, ha annunciato una nuova raccolta fondi da 650 milioni di dollari. L'investimento, proveniente dagli attuali azionisti, mira a potenziare il suo business di cloud per l'Inference. Questa mossa segue un accordo da 20 miliardi di dollari siglato sei mesi fa con Nvidia, che ha visto il colosso del silicio acquisire ingegneri chiave e licenziare la tecnicia hardware di Groq, pur non trattandosi di un'acquisizione completa.

May 30 2026
Altro

HeartFocus Link: l'AI per l'imaging cardiaco su ogni ecografo ospedaliero

DESKi ha lanciato HeartFocus Link, una soluzione che integra il software AI HeartFocus con gli ecografi ospedalieri esistenti. Utilizzando un tablet e un cavo HDMI, il sistema fornisce istruzioni in tempo reale per il posizionamento della sonda, supportando medici e tirocinanti nell'acquisizione di immagini cardiache diagnostiche di alta qualità. Questo approccio on-premise mira a migliorare l'efficienza clinica e la formazione, garantendo al contempo la sovranità dei dati.

May 30 2026
Altro

Il Pentagono esplora imbarcazioni militari in fibra vulcanica stampate in 3D: stealth e supply chain

Il Pentagono sta valutando l'adozione di imbarcazioni militari stampate in 3D, realizzate con fibra vulcanica. Questa tecnicia, sviluppata da Voltage Vessels, promette scafi non conduttivi che migliorano le capacità stealth. L'iniziativa mira a rivoluzionare la logistica, sostituendo una catena di approvvigionamento di oltre 10.000 km e consentendo una produzione annuale di decine di migliaia di unità direttamente nelle basi avanzate, con implicazioni significative per la sovranità produttiva e il controllo operativo.

May 30 2026
Altro

L'AI è ormai irrinunciabile per gli sviluppatori: uno studio non riesce a misurarne l'impatto

Nel febbraio 2026, il laboratorio di ricerca AI METR ha tentato di replicare uno studio del 2025 sull'impatto dell'AI sulla produttività degli sviluppatori. L'esperimento è fallito perché i programmatori si sono rifiutati di lavorare senza strumenti AI, anche per un numero limitato di compiti in un contesto di ricerca. Questo evidenzia una crescente e profonda dipendenza dagli strumenti di intelligenza artificiale nel settore dello sviluppo software.

May 30 2026
LLM

Gryphe lancia Pantheon-Reasoning-27B: Ragionamento Avanzato per LLM On-Premise

Gryphe ha rilasciato Pantheon-Reasoning-27B, un LLM da 27 miliardi di parametri basato su Qwen 3.6, progettato per migliorare le capacità di ragionamento nei contesti di roleplay. Il modello integra "thinking traces" estese e dati diversificati, offrendo una soluzione promettente per chi cerca deployment on-premise grazie alla disponibilità di quantizzazioni GGUF. Si pone come un'alternativa interessante per scenari che richiedono controllo e sovranità dei dati.

May 30 2026
Frameworks

GNOME Circle inasprisce le politiche contro la "AI Slop"

GNOME Circle, l'iniziativa per le applicazioni e librerie di terze parti nell'ecosistema GNOME, ha aggiornato le sue politiche per contrastare la "AI slop". La nuova direttiva mira a rifiutare software a basso sforzo o generato senza responsabilità diretta dello sviluppatore, promuovendo qualità e integrità all'interno della piattaforma.

May 30 2026
Altro

Trascrizione AI: il dilemma tra soluzioni self-hosted e servizi a pagamento

L'ascesa dei Large Language Models ha rivoluzionato la trascrizione automatica. Questo articolo esplora il dibattito tra l'adozione di soluzioni di trascrizione AI a pagamento e l'implementazione di alternative self-hosted, come Wispr Flow, per comprendere quale approccio offra il miglior equilibrio tra costi, controllo dei dati e performance per le esigenze aziendali.

May 30 2026
Market

SpaceX si aggiudica un contratto da 4,16 miliardi di dollari per satelliti di difesa

La US Space Force ha assegnato a SpaceX un contratto da 4,16 miliardi di dollari per la costruzione di satelliti. Questi sistemi avranno il compito di monitorare aeromobili e missili stranieri, rientrando nel programma Space-Based Advanced Moving Target Indicator (SB-AMTI). L'iniziativa fa parte del più ampio progetto di difesa missilistica Golden Dome, del valore complessivo di 185 miliardi di dollari.

May 30 2026
Hardware

RTX 6000 Ada o GB300: Il bivio hardware per i Large Language Models

La scelta tra un cluster di otto NVIDIA RTX 6000 Ada Generation e un singolo NVIDIA GB300 rappresenta un dilemma cruciale per chi pianifica deployment on-premise di Large Language Models. L'analisi si concentra sui trade-off tra la larghezza di banda effettiva delle schede PCIe (64 GB/s per lo sharding) e la memoria HBM unificata del GB300 (252 GB con 7 TB/s di throughput), elementi chiave per le performance e la scalabilità in ambienti multi-utente.

May 30 2026
Market

L'AI ridefinisce gli stage estivi: l'evoluzione delle competenze per l'infrastruttura

L'avanzata dell'intelligenza artificiale sta trasformando radicalmente il tradizionale percorso di ingresso nel mondo del lavoro, in particolare gli stage estivi. Questa evoluzione impone nuove sfide e opportunità, richiedendo competenze specialistiche sempre più orientate alla gestione e al deployment di Large Language Models (LLM) su infrastrutture on-premise, con un focus critico su hardware, sovranità dei dati e Total Cost of Ownership (TCO).

May 30 2026
Altro

Moss TTS 1.5: La clonazione vocale avanza, tra licenze e deployment on-premise

Il nuovo modello Text-to-Speech Moss TTS v1.5, sviluppato dal team OpenMOSS, sta generando interesse per le sue capacità di clonazione vocale. La preferenza espressa da alcuni utenti rispetto ad alternative come Fish Audio S2 Pro, in particolare per l'assenza di restrizioni sull'uso commerciale, evidenzia l'importanza delle politiche di licenza nelle decisioni di deployment aziendale, specialmente per soluzioni self-hosted e la sovranità dei dati.

May 30 2026
Hardware

AI on-premise compatta: un confronto tra i sistemi mini PC ispirati al DGX Spark

Un'analisi delle dimensioni e del peso dei mini PC AI disponibili sul mercato, che si presentano come alternative compatte al DGX Spark di NVIDIA. Questi sistemi, ideali per deployment on-premise o edge, evidenziano una notevole uniformità nelle specifiche fisiche tra i vari produttori, suggerendo requisiti simili per l'integrazione hardware interna e le applicazioni di intelligenza artificiale distribuita.

May 30 2026
Hardware

SteamOS 3.8.6 Beta: Supporto nativo per HDMI VRR su hardware AMD

Valve ha rilasciato la versione beta di SteamOS 3.8.6, introducendo il supporto nativo per la tecnicia HDMI Variable Refresh Rate (VRR) su hardware AMD. Questa novità, sebbene inizialmente pensata per il gaming, evidenzia l'evoluzione delle capacità di gestione video a livello di sistema operativo. Per gli architetti di infrastrutture, l'ottimizzazione delle performance di visualizzazione è cruciale in contesti che vanno dal monitoraggio di sistemi complessi alla visualizzazione di dati ad alta intensità.

May 30 2026
Market

Wendell Industrial verso l'IPO: la spinta dalla domanda di server AI

Wendell Industrial, azienda specializzata nel testing di server AI, si prepara a quotare in borsa la sua unità di laboratorio ad alta potenza. La mossa riflette la crescente domanda di apparecchiature rack, un indicatore chiave dell'espansione delle infrastrutture AI. Questo sviluppo sottolinea l'importanza dell'hardware fisico e delle soluzioni on-premise nel panorama attuale dell'intelligenza artificiale, dove controllo e sovranità dei dati sono prioritari per molte aziende.

May 30 2026
Hardware

GPU per LLM on-premise: oltre la banda, il valore reale dell'hardware

L'analisi delle GPU per carichi di lavoro LLM on-premise rivela che la banda di memoria non è l'unico fattore critico. Modelli come le NVIDIA P100 offrono un rapporto costo/prestazioni sorprendente per l'entry-level (32GB VRAM, 700GB/s a ~200$), mentre le V100 superano le 3090 per valore in single-stream. Si enfatizza l'importanza del "prefill" rispetto ai benchmark di generazione pura, cruciale per i modelli multimodali e i deployment self-hosted.

May 30 2026
Hardware

Intel entra nell'ecosistema indiano dei semiconduttori con substrati in vetro

Intel ha siglato un Memorandum d'Intesa (MoU) per avviare la produzione di substrati avanzati in vetro in India. Questa mossa rappresenta il primo ingresso significativo dell'azienda nel fiorente ecosistema indiano dei semiconduttori, con implicazioni potenziali per la supply chain globale e la disponibilità di componenti chiave per l'hardware di calcolo ad alte prestazioni, essenziale per i deployment AI on-premise.

May 29 2026
Hardware

Memoria automotive: Micron in testa, Samsung e SK Hynix inseguono

La domanda di memoria per il settore automobilistico è in forte crescita, spingendo i principali produttori di semiconduttori a competere per la leadership. Attualmente, Micron si posiziona come leader in questo segmento, con Samsung e SK Hynix che cercano di recuperare terreno. Questo scenario evidenzia l'importanza strategica della memoria ad alte prestazioni per le tecnicie emergenti, inclusi i sistemi AI integrati nei veicoli e le infrastrutture on-premise.

May 29 2026
Hardware

NVIDIA e la catena di fornitura taiwanese: al via la produzione di Vera Rubin

Jensen Huang, CEO di NVIDIA, ha celebrato i partner della catena di fornitura di Taiwan mentre la produzione della prossima architettura GPU, Vera Rubin, entra nella fase di 'ramp-up'. Questo segna un passo cruciale per la disponibilità di hardware di nuova generazione, essenziale per i carichi di lavoro AI più esigenti e per le strategie di deployment on-premise.

May 29 2026
Market

Pegatron: il boom dell'AI a Taiwan non ha ancora raggiunto l'apice

Il Presidente di Pegatron, uno dei principali produttori di elettronica, ha dichiarato che l'attuale crescita del settore AI a Taiwan è ancora lontana dal suo picco. Questa osservazione sottolinea la robusta e continua domanda di hardware e componenti essenziali per l'intelligenza artificiale, con implicazioni significative per la supply chain globale e per le aziende che pianificano deployment di Large Language Models (LLM) on-premise.

May 29 2026
Hardware

SpaceX delinea piani per chip AI 'space-optimized' e una megafab

SpaceX ha rivelato, tramite un documento per la quotazione in borsa, i suoi piani per lo sviluppo di chip ottimizzati per l'ambiente spaziale e la costruzione di una "megafab" dedicata all'intelligenza artificiale. Questa iniziativa, denominata Terafab, segna un passo significativo verso l'integrazione verticale nell'hardware AI, con implicazioni per la sovranità tecnicica e il controllo della supply chain.

May 29 2026
Market

L'AI spinge la domanda di fibra ottica: Nvidia e Corning accelerano la produzione

L'esplosione dell'intelligenza artificiale sta mettendo a dura prova la catena di fornitura di componenti ottici. Per rispondere alla crescente domanda di connettività ad alta velocità, essenziale per i carichi di lavoro AI, aziende chiave come Nvidia e Corning stanno intensificando la produzione di fibra ottica. Questo scenario evidenzia le sfide infrastrutturali legate alla rapida espansione dell'AI, con impatti significativi per chi pianifica deployment on-premise e valuta il Total Cost of Ownership (TCO) delle proprie soluzioni.

May 29 2026
Hardware

Addestramento di modelli linguistici su 8GB VRAM: un esperimento con TinyStories

Un recente esperimento ha dimostrato la possibilità di addestrare modelli linguistici da zero utilizzando solo 8GB di VRAM. L'iniziativa, partita da una discussione su Reddit e concretizzata in un progetto Open Source su GitHub, ha esplorato diverse tecniche di ottimizzazione per un modello TinyStories da 25 milioni di parametri. I risultati evidenziano i compromessi tra efficienza della memoria e velocità di training, offrendo spunti preziosi per i deployment on-premise con risorse hardware limitate.

May 29 2026
General

Introducing AI-Portable, the Twin Site to AI-Radar**

A newcomer in the Machina-Intelligence.com constellation.! Welcome to AI-Portable

May 29 2026
LLM

L'AI accelera lo sviluppo, ma la qualità del codice resta un'incognita

L'intelligenza artificiale sta rivoluzionando la velocità di produzione del codice per i developer, ma alcuni ricercatori avvertono che questa accelerazione potrebbe non tradursi in un miglioramento della qualità. Questa dicotomia solleva interrogativi sulle implicazioni a lungo termine per la manutenzione, la sicurezza e il TCO dei progetti software, specialmente in contesti di deployment on-premise.

May 29 2026
Market

La 'psicosi da AI' dei CEO: quando l'automazione incontra la realtà

Aaron Levie, fondatore di Box, ha coniato il termine "psicosi da AI" per descrivere i leader aziendali che credono l'intelligenza artificiale possa sostituire i ruoli lavorativi senza comprenderne la complessità. Questo fenomeno si manifesta con decisioni drastiche, come i recenti tagli del 22% della forza lavoro di ClickUp in favore di agenti AI, e un aumento dei licenziamenti tecnicici che già eguagliano i totali dell'anno precedente, sollevando interrogativi sulla maturità delle strategie di adozione dell'AI.

May 29 2026
Market

Groq punta a 650 milioni per rafforzare il focus sull'inference AI

Groq, azienda specializzata in chip, sta cercando di raccogliere 650 milioni di dollari in finanziamenti interni. La mossa segna un cambio di strategia significativo, con l'azienda che sposta il proprio focus dallo sviluppo hardware puro per concentrarsi maggiormente sull'inference AI, ovvero il processo di ottimizzazione delle risposte dei modelli AI alle richieste. Questa decisione arriva in un contesto di forte dinamismo nel settore dei semiconduttori per l'intelligenza artificiale.

May 29 2026
Altro

Musica infinita e personalizzata: un setup on-premise con DGX Spark e LLM

Un utente ha illustrato la sua architettura self-hosted per la generazione musicale, basata su due server DGX Spark interconnessi via ConnectX 7. Sfruttando modelli Ace-Step 1.5 XL e Plex, il sistema offre un catalogo musicale infinito, personalizzato e privato, sostituendo le tradizionali sottoscrizioni. Questo approccio evidenzia i vantaggi del controllo sui dati e della personalizzazione profonda, pur presentando il trade-off della mancanza di una comunità di ascolto.

May 29 2026
LLM

LLM nel trading: individuare i segnali di deriva e fallimento con il feedback di rischio

Uno studio approfondisce l'allineamento comportamentale degli LLM in contesti finanziari, utilizzando la piattaforma TradeArena. La ricerca ha identificato segnali predittivi di fallimento, come la deriva degli embeddings di pianificazione e la contrazione del rango effettivo, anche sotto stress. Il feedback di rischio strutturato può migliorare l'allineamento senza fine-tuning, ma non è una soluzione universale. I risultati evidenziano l'importanza di strumenti diagnostici per comprendere l'affidabilità degli LLM in applicazioni ad alto rischio.

May 29 2026
Market

Il panorama tech europeo: tra investimenti, AI specializzata e nuove strategie di deployment

L'ecosistema tecnicico europeo ha registrato oltre 3,1 miliardi di euro in investimenti e diverse acquisizioni strategiche. Emergono tendenze significative nel settore AI, con un focus crescente su soluzioni specializzate e un potenziale riposizionamento rispetto ai servizi cloud tradizionali, evidenziando l'importanza di controllo e sovranità dei dati.

May 29 2026
LLM

Gemma4 26B A4B: Un LLM versatile per deployment locali efficienti

Gemma4 26B A4B emerge come un Large Language Model (LLM) promettente per scenari di deployment on-premise. Le prime valutazioni ne evidenziano l'elevata velocità e la notevole versatilità su hardware con larghezza di banda di memoria limitata, come l'M5 Pro. Il modello si distingue per prestazioni equilibrate in compiti diversi, dalla scrittura creativa alla programmazione, offrendo un'alternativa efficiente e controllabile per le aziende che privilegiano la sovranità dei dati.

May 29 2026
Altro

Iniezione di Prompt: Un Dev Inserisce Codice Pericoloso, Dati a Rischio negli LLM

Un recente episodio ha visto un developer inserire intenzionalmente una "prompt injection" distruttiva in codice, motivato dalla frustrazione verso pratiche di coding scadenti. L'azione, che mira alla cancellazione o corruzione di dati, solleva serie questioni sulla sicurezza degli LLM e sulla sovranità dei dati, specialmente in contesti di deployment on-premise. Le implicazioni legali sono già all'orizzonte, evidenziando la necessità di robuste strategie di protezione e controlli rigorosi.

May 29 2026
LLM

L'agente AI di Google e la sfida della comprensione contestuale

Un nuovo agente AI di Google, progettato per organizzare eventi accedendo a dati personali come email e calendari, ha mostrato limiti significativi nella comprensione delle relazioni umane. L'esperienza evidenzia le complessità nell'inferire il contesto personale da dati strutturati, sollevando interrogativi sulle capacità attuali degli LLM e sulle implicazioni per la sovranità dei dati in contesti aziendali.

May 29 2026
Altro

Intel estende il supporto DRM: arriva la proprietà colore di sfondo nel kernel Linux 7.2

Il kernel Linux 7.1 ha introdotto una specifica proprietà per il colore di sfondo CRTC nei driver grafici DRM. Questa funzionalità, denominata "BACKGROUND_COLOR", definisce il colore predefinito per le aree non coperte da piani o da regioni trasparenti. Con il prossimo ciclo di sviluppo del kernel Linux 7.2, Intel integrerà il supporto per questa proprietà all'interno del proprio driver DRM, migliorando la gestione grafica a livello di sistema.

May 29 2026
Altro

Microsoft allerta: malware di cryptojacking sfrutta SEO e chatbot AI per colpire PC di fascia alta

Microsoft ha lanciato un allarme riguardo a una nuova campagna di cryptojacking. Il malware, progettato per il mining di criptovalute tramite GPU, si diffonde attraverso tecniche di SEO poisoning e l'uso di chatbot AI. I bersagli principali sono i gamer e gli utenti con PC di fascia alta, attirati da download malevoli mascherati da utility popolari. L'obiettivo è trasformare i sistemi compromessi in "crypto farm" per generare valuta digitale illecitamente.

May 29 2026
Hardware

Nvidia e Microsoft: un SoC ARM per la "nuova era del PC"

Nvidia e Microsoft stanno coordinando una campagna sui social media per anticipare una "nuova era del PC" in vista del Computex 2026. Al centro di questa iniziativa vi sarebbe un SoC ARM di Nvidia, destinato a equipaggiare i futuri laptop N1X con sistemi Windows on Arm, promettendo nuove capacità per l'elaborazione locale e impattando le strategie di deployment edge.

May 29 2026
LLM

OpenAI: un playbook per la valutazione affidabile di LLM di terze parti

OpenAI ha rilasciato una guida per le valutazioni esterne dei sistemi AI avanzati. Il documento si concentra su come analizzare le capacità dei modelli, le misure di sicurezza e la validità dei "frontier systems". Questa iniziativa mira a stabilire standard condivisi per garantire trasparenza e fiducia, aspetti cruciali per le aziende che considerano deployment on-premise e la sovranità dei dati, offrendo un framework per decisioni informate.

May 29 2026
LLM

Architettura Modulare per Lessici Artificiali: Controllo e Riproducibilità oltre gli LLM

La generazione di lessici artificiali coerenti e strutturati rappresenta una sfida aperta. Un nuovo framework modulare affronta le limitazioni degli attuali generatori, spesso basati su LLM opachi e non riproducibili. Il sistema campiona inventari fonemici, genera forme di parole con grammatiche fonologiche interscambiabili e assegna significati tramite un'ontologia specifica. I risultati mostrano che le grammatiche probabilistiche superano le baseline deterministiche in coerenza fonotattica e realismo tipologico, offrendo maggiore controllo e trasparenza.

May 29 2026
LLM

Valutazione Difetti Apparecchiature Elettriche con MLLM Leggeri: Un Nuovo Approccio

Un nuovo framework basato su Large Language Models Multimodali (MLLM) promette di rivoluzionare la valutazione dei difetti nelle apparecchiature di trasmissione elettrica. Sfruttando l'in-context learning e la generazione di coppie domanda-risposta, il metodo riduce i costi di annotazione manuale e addestra modelli leggeri come Qwen3-VL-8B tramite fine-tuning LoRA, raggiungendo prestazioni all'avanguardia con un singolo MLLM.

May 29 2026
LLM

Editing di conoscenza negli LLM: svelato il meccanismo comune per modifiche mirate

Nuove ricerche esplorano il funzionamento interno dei metodi di editing di conoscenza come ROME e MEMIT, che modificano i pesi MLP nei modelli transformer. Contrariamente a quanto si pensava, gli studi rivelano che diverse modifiche fattuali condividono un meccanismo funzionale comune, agendo su un sottoinsieme critico di pesi. Un'analisi approfondita tramite una "maschera binaria" ha dimostrato che le modifiche sopprimono la conoscenza piuttosto che sovrascriverla, influenzando la propagazione delle informazioni e offrendo nuove prospettive per la rilevazione e la difesa contro alterazioni indesiderate nei Large Language Models.

May 29 2026
Frameworks

Correzioni 'Behavior-Aware' per stabilizzare il Temporal-Difference Learning off-policy

Un nuovo studio introduce le correzioni "behavior-aware" per affrontare l'instabilità nel Temporal-Difference Learning off-policy con approssimazione di funzione. Proponendo gli algoritmi BA-TDC e BA-TDRC, la ricerca mira a migliorare la robustezza e la stabilità dei sistemi di apprendimento per rinforzo, fornendo un modello trattabile per l'approssimazione del valore tramite reti neurali. I risultati evidenziano l'importanza della regolarizzazione per prestazioni affidabili in scenari complessi.

May 29 2026
Frameworks

STHTD-MP: Ottimizzare la Previsione Off-Policy nel Reinforcement Learning

Un nuovo studio introduce STHTD-MP, un metodo di differenza temporale Mirror-Prox che mira a velocizzare la previsione off-policy. Sostituendo la metrica di covarianza con una metrica "behavior-induced", l'algoritmo migliora la geometria dell'aggiornamento, offrendo un potenziale fattore di contrazione medio inferiore rispetto ad approcci esistenti come GTD2-MP. Questa innovazione algoritmica è cruciale per l'efficienza computazionale nei sistemi AI complessi e per la gestione delle risorse on-premise.

May 29 2026
Altro

Fattori Esterni e Deployment AI: L'Equilibrio tra On-Premise e Cloud

Le decisioni strategiche relative all'infrastruttura per i Large Language Models (LLM) sono sempre più influenzate da dinamiche esterne, come incentivi economici o nuove normative. Questo contesto mutevole spinge le aziende a riconsiderare l'equilibrio tra i deployment on-premise e le soluzioni cloud, ponendo l'accento su aspetti cruciali come la sovranità dei dati, il Total Cost of Ownership (TCO) e il controllo diretto sull'hardware.

May 29 2026
Altro

Airoha rafforza la strategia su networking e AI all'edge

Airoha intensifica il proprio impegno nello sviluppo di soluzioni per il networking e l'intelligenza artificiale distribuita all'edge. Questa mossa strategica riflette la crescente domanda di elaborazione AI locale, cruciale per scenari che richiedono bassa latenza, sovranità dei dati e ottimizzazione del TCO. L'approccio di Airoha si allinea alle esigenze delle aziende che valutano deployment on-premise e ibridi per i carichi di lavoro AI.

May 29 2026
Hardware

China Resources Microelectronics punta ai server AI con il packaging PLP

China Resources Microelectronics (CR Micro), un produttore cinese di semiconduttori, sta orientando la propria strategia verso il segmento dei server AI. L'azienda intende sfruttare la tecnicia di packaging Panel Level Packaging (PLP) per ottimizzare i chip destinati a carichi di lavoro di intelligenza artificiale, mirando a migliorare l'efficienza e la densità dei componenti hardware. Questa mossa evidenzia l'importanza crescente delle soluzioni di packaging avanzate per l'infrastruttura AI.

May 29 2026
Hardware

L'AI riaccende i riflettori sull'hardware: il sogno dei semiconduttori si avvera

Il CEO di Plug and Play, Saeed Amidi, ha dichiarato che il boom dell'intelligenza artificiale ha finalmente realizzato il suo sogno sui semiconduttori, concepito nel 2006. Questa affermazione sottolinea il rinnovato ruolo centrale dell'hardware nell'era dell'AI, spingendo le aziende a riconsiderare le proprie strategie di deployment infrastrutturale e i trade-off tra cloud e on-premise.

May 29 2026
Market

Le cene di Jensen Huang a Taipei: la mappa della supply chain AI e le implicazioni per l'infrastruttura

Le recenti cene di Jensen Huang a Taipei, descritte come un "banchetto da trilioni di dollari", offrono uno spaccato delle dinamiche che plasmano la supply chain globale dell'intelligenza artificiale. Queste interazioni ad alto livello evidenziano l'intensa attività del mercato e le sfide che le aziende affrontano nel garantire l'hardware necessario per i deployment di LLM, influenzando le strategie on-premise e i costi totali di proprietà.

May 29 2026
Altro

Geordie AI raccoglie 30 milioni per la governance e la sicurezza degli agenti AI in azienda

Geordie AI ha chiuso un round di finanziamento Series A da 30 milioni di dollari, portando il capitale totale a 36,5 milioni. La piattaforma si propone di risolvere le crescenti sfide di visibilità, governance e controllo operativo legate all'adozione degli agenti AI nelle aziende. Offrendo strumenti per monitorare e gestire il comportamento degli agenti, Geordie AI mira a consentire deployment sicuri e scalabili, rafforzando la sovranità dei dati e la compliance in ambienti enterprise complessi.

May 29 2026
Market

Inherent emerge dal silenzio: 50 milioni di dollari per l'AI nella scienza

Inherent, un nuovo laboratorio AI con sede a Londra, ha annunciato un finanziamento seed da 50 milioni di dollari. Fondato da ex membri di DeepMind, Microsoft e della Casa Bianca, il team mira a definire un nuovo paradigma per la scienza basata sull'intelligenza artificiale. Il loro sistema, Faraday, è progettato per potenziare la scoperta scientifica attraverso la collaborazione tra intelligenza artificiale auto-migliorante ed esperti umani, promettendo un approccio innovativo alla ricerca.

May 29 2026
Altro

MokN raccoglie 15 milioni di dollari per l'Active Identity Recovery

MokN, azienda francese di cybersecurity, ha ottenuto 15 milioni di dollari in un round di Serie A guidato da GV. L'investimento mira a espandere la sua piattaforma di protezione contro il furto di credenziali e gli attacchi basati sull'identità. La startup intende rafforzare la sua presenza globale e sviluppare nuove soluzioni per l'Active Identity Recovery, un approccio proattivo fondamentale per la sicurezza delle identità digitali in contesti aziendali.

May 29 2026
Altro

Picogrid: 45 milioni per unificare l'infrastruttura di difesa

Picogrid, una startup californiana, ha ottenuto un finanziamento di 45 milioni di dollari per sviluppare uno strato di integrazione neutrale per la difesa moderna. L'obiettivo è risolvere la crescente sfida del Pentagono nel far comunicare tra loro i numerosi sistemi hardware acquisiti, dai sensori alle piattaforme autonome e all'edge compute, che attualmente operano in modo isolato.

May 29 2026
Market

Autodesk si espande oltre la progettazione: acquisita MaintainX per 3,6 miliardi di dollari

Autodesk, leader quarantennale nel software di progettazione per ingegneri e architetti, ha annunciato l'acquisizione di MaintainX per circa 3,6 miliardi di dollari in contanti. Questa mossa strategica segna un'espansione significativa per l'azienda, che mira a integrare le proprie competenze dal design alla gestione delle operazioni e della manutenzione delle strutture e dei macchinari una volta realizzati.

May 29 2026
Altro

Software compatto e sovranità dei dati: il manifesto 'Fits on a Floppy' nell'IT moderno

Il manifesto 'Fits on a Floppy' promuove software piccolo e semplice come antidoto alla complessità IT. Nonostante il nome retrò, l'iniziativa sottolinea l'importanza della compattezza per la leggibilità, la manutenibilità a lungo termine e la sovranità dei dati. In un'epoca di dipendenza dal cloud e sistemi gonfi, il movimento suggerisce un ritorno a soluzioni self-hosted e al controllo diretto dell'infrastruttura, riflettendo principi come la Legge di Wirth e il KISS Principle.

May 29 2026
LLM

Liquid AI lancia LFM2.5-8B-A1B: un LLM ottimizzato per l'edge computing

Liquid AI ha rilasciato LFM2.5-8B-A1B, un Large Language Model da 8 miliardi di parametri progettato per applicazioni edge. Il modello introduce una finestra di contesto di 128K token, 38T token di pre-training e un vocabolario esteso per le lingue non latine. La sua capacità di operare su hardware entry-level lo rende particolarmente interessante per scenari di deployment on-premise, garantendo sovranità dei dati e riducendo il TCO.

May 29 2026
Market

L'impatto di DeepSeek: R&D e prezzi competitivi per un'AI più efficiente

DeepSeek sta influenzando positivamente l'ecosistema dell'intelligenza artificiale, condividendo la propria ricerca e sviluppo e adottando una strategia di prezzi aggressiva. Queste azioni contribuiscono a rendere l'AI più accessibile ed efficiente, riducendo i costi complessivi per gli utenti e favorendo l'innovazione, specialmente per chi valuta deployment on-premise.

← Precedente Page 47 / 160 Successiva →