🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15940

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Jun 01 2026
Market

Servizio Clienti 'Tech-First': Le Insidie dell'Automazione e il Caso Norse Atlantic

Il caso di Norse Atlantic Airways, con numerose lamentele alla Federal Trade Commission per il suo approccio "tech-first" al servizio clienti e perdite economiche per gli utenti, evidenzia i rischi di un'automazione mal gestita. L'episodio solleva interrogativi cruciali sulla necessità di controllo, trasparenza e robustezza nelle soluzioni AI per interazioni critiche, spingendo le aziende a valutare deployment on-premise per garantire sovranità dei dati e affidabilità.

Jun 01 2026
LLM

OpenAI e la Congettura di Erdős: un Traguardo per l'AI in Matematica

OpenAI ha annunciato che un suo modello di intelligenza artificiale ha risolto la Congettura di Erdős sulla distanza unitaria, un problema di geometria discreta che ha eluso i matematici per 80 anni. L'evento, definito una "pietra miliare" da esperti come il medaglia Fields Tim Gowers, segna un progresso significativo nelle capacità autonome dell'AI nella ricerca scientifica.

Jun 01 2026
Altro

Phoronix celebra 22 anni: l'importanza dell'hardware Linux per l'AI on-premise

Phoronix.com festeggia il 5 giugno i suoi 22 anni di attività, un traguardo significativo nella copertura dell'hardware Linux e delle notizie open source. Questa ricorrenza sottolinea la crescente rilevanza di piattaforme e soluzioni aperte per le infrastrutture AI, specialmente per le aziende che privilegiano deployment on-premise. L'analisi approfondita di Phoronix ha fornito per anni un riferimento cruciale per decisioni infrastrutturali che bilanciano controllo, sovranità dei dati e TCO.

Jun 01 2026
Altro

Linux: AF_ALG verso la deprecazione per rischi sicurezza e strumenti IA

Il kernel Linux si appresta a rimuovere l'interfaccia AF_ALG, che permette alle applicazioni di accedere al motore crittografico integrato. Questa rapida deprecazione è motivata da una "superficie di attacco massiva" e da un aumento delle vulnerabilità, messe in luce anche dall'impiego di strumenti basati su intelligenza artificiale e Large Language Models (LLM). La decisione evidenzia l'evoluzione del panorama della sicurezza informatica.

Jun 01 2026
Hardware

Computex 2026: L'Hardware AI al Centro dell'Innovazione On-Premise

Il Computex 2026 di Taipei si conferma un appuntamento cruciale per l'innovazione hardware. Sebbene i dettagli specifici degli annunci del primo giorno siano ancora in fase di emersione, l'evento è un barometro fondamentale per le tendenze che influenzeranno i deployment di Large Language Models (LLM) on-premise, la sovranità dei dati e l'ottimizzazione del Total Cost of Ownership (TCO) per le infrastrutture AI.

Jun 01 2026
Market

Intel e l'ingresso di Nvidia nel mercato PC: tra 'paranoia' e l'elogio di x86

Intel ha espresso una "sana dose di paranoia" riguardo all'ingresso di Nvidia nel mercato dei PC, pur riconoscendo che RTX Spark è "ottimo per il mercato". L'azienda ha ribadito il valore dell'architettura x86, sottolineando la crescente competizione nel settore e le implicazioni per le strategie di deployment on-premise, dove la scelta dell'hardware è cruciale per il TCO e la sovranità dei dati.

Jun 01 2026
Market

Return Helper: 4 milioni di dollari per l'AI che trasforma i resi e-commerce in profitto

Return Helper ha concluso un round di finanziamento Series A da 4 milioni di dollari. L'azienda, specializzata nella gestione dei resi e-commerce transfrontalieri, intende utilizzare i fondi per espandere la propria presenza internazionale, in particolare in Europa, e potenziare le sue capacità di intelligenza artificiale. L'AI è stata fondamentale per la crescita del 60% nel 2025 e il raggiungimento della redditività, trasformando i resi da costo a opportunità di valore per i commercianti.

Jun 01 2026
Market

La Corsa alle GPU: Tra Domanda Globale e la Centralità di NVIDIA

Il mercato delle GPU è in fermento, con una domanda globale che supera l'offerta, spinta dall'espansione dell'intelligenza artificiale. NVIDIA, guidata da Jensen Huang, si trova al centro di questa dinamica, fornendo l'hardware essenziale per lo sviluppo e il deployment di Large Language Models. Questa situazione evidenzia le sfide per le aziende che pianificano infrastrutture AI on-premise.

Jun 01 2026
Hardware

NBD-VRAM: Swap Space on NVIDIA GeForce VRAM for On-Premise LLMs (Updated)

An Open Source developer has released NBD-VRAM, a tool that enables the creation of swap space on the VRAM of consumer NVIDIA GeForce GPUs under Linux. This solution aims to extend available memory capacity for intensive workloads, such as Large Language Models, offering new possibilities for on-premise deployments with existing hardware and contributing to data sovereignty.

Jun 01 2026
Hardware

NVIDIA presenta RTX Spark: un nuovo superchip per desktop compatti e laptop

Durante il keynote di Computex, Jensen Huang di NVIDIA ha annunciato ufficialmente RTX Spark, un nuovo "superchip" progettato per equipaggiare PC desktop compatti e laptop. Questa mossa mira a portare capacità di calcolo avanzate direttamente sui dispositivi locali, aprendo nuove prospettive per l'esecuzione di carichi di lavoro AI e LLM in ambienti on-premise e edge.

Jun 01 2026
Altro

Le aziende taiwanesi avviano la validazione del Wi-Fi 8 in anticipo sulla finalizzazione

Le aziende taiwanesi di networking hanno iniziato la validazione del futuro standard Wi-Fi 8, anticipando la sua finalizzazione ufficiale. Questa mossa strategica mira a garantire compatibilità ed efficienza per la prossima generazione di connettività wireless ad alte prestazioni. Per i decision-maker tech, un'infrastruttura di rete robusta è cruciale per i deployment on-premise di LLM, migliorando throughput e latenza per carichi di lavoro AI intensivi.

Jun 01 2026
LLM

Un LLM da 1 miliardo di parametri sfida i rilevatori AI con testo 'umano'

Un nuovo Large Language Model da 1 miliardo di parametri è stato presentato, dimostrando la capacità di generare testo indistinguibile dalla scrittura umana per i rilevatori di intelligenza artificiale. Questo sviluppo solleva interrogativi sulla validità degli strumenti di rilevamento e sulle implicazioni per la creazione di contenuti, la verifica dell'autenticità e le strategie di deployment on-premise per modelli di dimensioni contenute ma efficaci.

Jun 01 2026
Hardware

DLSS 4.5 Ray Reconstruction: a fondo sull'architettura transformer di seconda generazione

L'aggiornamento DLSS 4.5 Ray Reconstruction, previsto per agosto, promette di elevare la qualità visiva del ray tracing. Questa evoluzione si basa su un set di dati di training più ampio e su un'architettura transformer di seconda generazione, fattori chiave per migliorare la fedeltà delle immagini. Per i professionisti IT, queste innovazioni sottolineano la crescente complessità dell'inference AI e la necessità di hardware dedicato, con implicazioni dirette sui deployment on-premise.

Jun 01 2026
Altro

PLD Space rafforza l'investimento nel complesso di lancio di Kourou

PLD Space, azienda spagnola specializzata in lanci spaziali, ha annunciato un aumento dell'investimento a 35 milioni di euro per il suo complesso di lancio presso il Centro Spaziale della Guyana a Kourou. L'azienda si posiziona come il primo operatore privato a destinare un capitale di tale portata a questo storico spazioporto, in vista del primo volo del MIURA 5 previsto per il 2026.

Jun 01 2026
Market

Foxconn accelera in Francia: nuovi investimenti in packaging chip e progetti AI

Foxconn sta espandendo le sue operazioni in Francia con due iniziative chiave: una venture per il packaging di chip, denominata Tessalia, e un progetto dedicato all'intelligenza artificiale in collaborazione con Bull. Questa mossa sottolinea l'interesse crescente per la localizzazione della produzione hardware e lo sviluppo di capacità AI, temi centrali per la sovranità tecnicica e i deployment on-premise.

Jun 01 2026
Altro

Formosa Plastics Group: nuova rotta su AI, semiconduttori e infrastrutture energetiche

Formosa Plastics Group, tramite il presidente di Nanya Plastics Chia-Chau Wu, sta riorientando le proprie strategie. L'attenzione si sposta verso settori chiave come l'intelligenza artificiale, i semiconduttori e le opportunità legate alle reti energetiche. Questa mossa riflette una tendenza più ampia di diversificazione e investimento in tecnicie abilitanti, cruciale per le aziende che valutano l'evoluzione delle proprie infrastrutture IT e i deployment on-premise di carichi di lavoro AI.

Jun 01 2026
LLM

MiniMax: un nuovo LLM in arrivo e le sfide per il deployment on-premise

Un nuovo Large Language Model, MiniMax, è atteso sul mercato tra circa dieci giorni. L'annuncio, diffuso tramite l'account X di MiniMax_AI, solleva interrogativi sui requisiti hardware. La preoccupazione espressa da un utente riguardo alla dimensione del modello rispetto al proprio setup evidenzia le costanti sfide che le aziende affrontano nel gestire LLM sempre più grandi in ambienti self-hosted.

Jun 01 2026
Hardware

LianDe Holdings avvia la produzione di massa per il raffreddamento a liquido dei chip USA

LianDe Holdings ha annunciato l'avvio della produzione di massa per i suoi raccordi flottanti a raffreddamento liquido, destinati alla supply chain dei produttori di chip statunitensi. Questa iniziativa evidenzia la crescente importanza delle soluzioni termiche avanzate per gestire la densità di potenza e le prestazioni richieste dai processori di nuova generazione, in particolare per i carichi di lavoro intensivi come i Large Language Models (LLM) in ambienti on-premise.

Jun 01 2026
Market

GTC Taipei 2026: L'automazione AI ridefinisce il ruolo del giudizio umano

Al GTC Taipei 2026, NVIDIA ha evidenziato come l'intelligenza artificiale stia automatizzando il proprio sviluppo. Questo cambiamento sposta la domanda verso il giudizio umano, enfatizzando decisioni strategiche su deployment, sovranità dei dati e TCO, specialmente per le architetture on-premise. Le aziende devono ora concentrarsi sulla gestione dell'infrastruttura e sulla governance etica, piuttosto che sulla mera programmazione.

Jun 01 2026
Market

Nvidia Vera Rubin: produzione a pieno regime con 150 fornitori taiwanesi

Nvidia ha confermato che la sua piattaforma Vera Rubin è entrata in piena produzione, supportata da una vasta rete di 150 fornitori taiwanesi. Questo annuncio sottolinea l'impegno dell'azienda nel rafforzare la propria catena di approvvigionamento per le future generazioni di hardware AI, un fattore cruciale per i deployment on-premise e le infrastrutture locali che richiedono controllo e sovranità dei dati.

Jun 01 2026
Hardware

NVIDIA Vera: Anthropic, OpenAI e altri tra i primi ad adottare il nuovo processore

NVIDIA ha annunciato a Computex che il suo nuovo processore "Vera", sviluppato internamente, è già in uso presso importanti realtà del settore tech. Tra i primi ad adottarlo figurano Anthropic, OpenAI, SpaceX e Oracle. Questa mossa segna un'espansione strategica per NVIDIA, tradizionalmente leader nelle GPU, verso soluzioni di calcolo più integrate, con implicazioni significative per le infrastrutture AI e i deployment on-premise.

Jun 01 2026
Market

hephaistos.bio: 161mila euro per enzimi su misura e manifattura chimica sostenibile

La startup svizzera hephaistos.bio ha ottenuto 161.000 euro da Venture Kick per accelerare lo sviluppo di soluzioni enzimatiche personalizzate. L'azienda sfrutta biologia computazionale e machine learning per creare biocatalizzatori su misura, mirando a rendere la produzione chimica e farmaceutica più efficiente, sostenibile e resiliente. L'obiettivo è supportare il rientro della produzione in Europa, riducendo la dipendenza da catene di approvvigionamento fragili e l'impatto ambientale.

Jun 01 2026
Altro

AI-native SaaS: il dibattito tra cloud e on-premise per l'innovazione aziendale

Un recente evento ad Amsterdam ha messo in luce le strategie per il successo nel panorama del SaaS basato sull'AI. Mentre il modello AI-native SaaS offre agilità e scalabilità, le aziende devono valutare attentamente i trade-off rispetto alle soluzioni on-premise. Questioni come la sovranità dei dati, il Total Cost of Ownership e la personalizzazione dell'infrastruttura emergono come fattori critici per CTO e architetti IT che gestiscono carichi di lavoro LLM.

Jun 01 2026
Hardware

L'AI ridefinisce il ruolo dei PCB: Zhen Ding osserva un'accelerazione della domanda

Zhen Ding, attore chiave nella produzione di circuiti stampati (PCB), evidenzia come l'intelligenza artificiale stia trasformando il ruolo di questi componenti. L'azienda rileva una crescente domanda, suggerendo un impatto significativo sulla supply chain e sull'infrastruttura hardware necessaria per supportare i carichi di lavoro AI, in particolare per i deployment on-premise.

Jun 01 2026
Market

Compeq prevede una crescita robusta per l'infrastruttura AI tra il 2027 e il 2028

Compeq, attore chiave nella catena di fornitura elettronica, anticipa un'accelerazione significativa dei ricavi e dei profitti tra il 2027 e il 2028. Questa previsione è trainata dalla crescente domanda di infrastrutture dedicate all'intelligenza artificiale, segnalando un periodo di espansione per il settore. Le aziende si preparano a investire in soluzioni hardware e software per supportare carichi di lavoro AI sempre più complessi, con implicazioni dirette per le strategie di deployment on-premise.

Jun 01 2026
Altro

Deployment di LLM on-premise: tra sovranità dei dati e ottimizzazione dei costi

La scelta di implementare Large Language Models (LLM) on-premise presenta un equilibrio delicato tra il controllo sui dati e l'ottimizzazione del Total Cost of Ownership (TCO). Le aziende devono valutare attentamente le implicazioni hardware, i requisiti infrastrutturali e le strategie di deployment per garantire sovranità, compliance e performance, bilanciando investimenti iniziali e costi operativi a lungo termine.

Jun 01 2026
Altro

Revolut, Mistral e Wayve lanciano la campagna 'Built in Europe' per il tech locale

Revolut, Mistral, Wayve ed ElevenLabs, con il supporto di Balderton e oltre 100 leader europei, hanno avviato la campagna 'Built in Europe'. L'iniziativa, dal costo di centinaia di migliaia di sterline, mira a sfidare la percezione che le aziende tecniciche debbano trasferirsi nella Silicon Valley per scalare. Promuove lo sviluppo di startup in Europa, evidenziando il talento, i capitali e l'ecosistema disponibili, anche grazie a fondi come l'EU Scaleup Europe Fund e il UK Sovereign AI fund.

Jun 01 2026
Market

MiniMax punta a Shanghai dopo il successo a Hong Kong: implicazioni per il mercato AI

La startup cinese MiniMax, attiva nel settore dell'intelligenza artificiale, sta valutando una quotazione sul mercato STAR di Shanghai. Questa mossa segue un notevole incremento del 400% del valore delle sue azioni a Hong Kong in meno di cinque mesi. La decisione riflette una strategia di consolidamento nel mercato interno e sottolinea l'attrattiva degli investimenti nelle aziende AI, con potenziali ripercussioni sulle capacità di sviluppo e deployment di soluzioni LLM.

Jun 01 2026
Hardware

Invisix, spin-out di ASML, ottiene 20 milioni per l'ispezione avanzata dei chip

Invisix, una startup nata da ASML, ha raccolto 20 milioni di euro per sviluppare nuove tecnicie di ispezione dei chip. L'obiettivo è superare i limiti degli strumenti ottici tradizionali, incapaci di analizzare le strutture interne dei semiconduttori moderni, sempre più complessi e miniaturizzati. Questa innovazione è cruciale per la produzione di hardware avanzato, fondamentale per i deployment on-premise di carichi di lavoro AI, garantendo qualità e affidabilità del silicio.

Jun 01 2026
Altro

Delta Electronics: L'AI ridefinisce energia e produzione nei data center

Delta Electronics individua due fattori chiave per la futura competizione nel settore dell'intelligenza artificiale: la trasformazione delle infrastrutture energetiche dei data center e la revisione dei processi produttivi hardware. Questi cambiamenti, guidati dalle crescenti esigenze dei carichi di lavoro AI, avranno un impatto significativo sulle strategie di deployment e sui costi operativi per le aziende che adottano soluzioni di Large Language Models.

Jun 01 2026
Hardware

Metrologia dei chip: Invisix chiude un round seed da 20 milioni di euro

Invisix, azienda specializzata in metrologia per semiconduttori, ha raccolto 20 milioni di euro in un round seed oversubscribed. L'azienda sviluppa piattaforme di metrologia a raggi X "soft" per misurazioni non distruttive e ad alto volume di strutture complesse nei chip avanzati. Questa tecnicia è cruciale per migliorare la produzione di semiconduttori destinati all'AI e all'High-Performance Computing, affrontando le crescenti sfide poste dalla miniaturizzazione e dalla complessità dei dispositivi.

Jun 01 2026
Hardware

Nvidia svela la roadmap DGX Spark per PC e laptop: tre generazioni, da Rubin a Rosa Feynman

Nvidia ha presentato a Computex 2026 la roadmap per le sue soluzioni DGX Spark, destinate a laptop e PC desktop. Il piano delinea tre generazioni future, tra cui la piattaforma Rubin, che integrerà memoria LPDDR6, e la successiva Rosa Feynman. Questa iniziativa estende le capacità di calcolo AI di Nvidia a dispositivi client, con un focus sulle prestazioni e l'efficienza per carichi di lavoro locali, includendo la linea RTX Spark.

Jun 01 2026
Altro

Qualcomm al Computex 2026: L'IA Agente e il Futuro dei PC Consumer

Al Computex 2026, Cristiano Amon, CEO di Qualcomm, ha tenuto il suo keynote concentrandosi sull'intelligenza artificiale agente e sull'evoluzione dei PC consumer. L'evento ha offerto uno sguardo sulle direzioni strategiche dell'azienda, con implicazioni significative per l'elaborazione AI distribuita e le architetture on-premise, evidenziando il potenziale per carichi di lavoro AI eseguiti direttamente sui dispositivi.

Jun 01 2026
Market

USA: Stretta sulle esportazioni di chip Nvidia per le aziende AI cinesi all'estero

Il Dipartimento del Commercio degli Stati Uniti ha introdotto nuove direttive che collegano le regole per le licenze di esportazione alla sede legale di un'azienda, non alla sua posizione fisica. Questa mossa mira a chiudere una falla che per circa un anno ha permesso alle unità estere di aziende AI cinesi di accedere ai processori Nvidia più avanzati, aggirando i controlli statunitensi sulle esportazioni di chip. La misura rafforza le restrizioni esistenti.

Jun 01 2026
Altro

Cina: nuove regole per gli investimenti esteri complicano le acquisizioni AI

La Cina ha formalizzato un nuovo framework normativo per la revisione degli investimenti esteri, rendendo più complesse le acquisizioni transfrontaliere nel settore dell'intelligenza artificiale. Questa mossa codifica l'approccio già adottato dalla Commissione Nazionale per lo Sviluppo e la Riforma (NDRC) per bloccare l'acquisizione di Manus da parte di Meta, evidenziando una crescente attenzione alla tracciabilità tecnicica e alla sovranità.

Jun 01 2026
Hardware

Computex: CPU e ASIC ridefiniscono l'hardware per l'AI on-premise

Il Computex ha messo in luce l'espansione dell'influenza dell'AI, portando CPU e ASIC al centro della scena hardware accanto alle GPU. Questa evoluzione offre nuove opportunità e sfide per le strategie di deployment on-premise, spingendo CTO e architetti a valutare attentamente i trade-off tra flessibilità, efficienza e TCO per i carichi di lavoro AI, dalla gestione dei Large Language Models (LLM) all'inference su scala.

Jun 01 2026
Hardware

Meta punta sull'hardware AI: in arrivo pendente e occhiali smart

Meta starebbe pianificando un'espansione significativa nel settore dell'hardware AI, con l'introduzione di un pendente e una roadmap per occhiali smart. Questa mossa suggerisce un'accelerazione verso dispositivi AI edge, potenzialmente in grado di elaborare carichi di lavoro complessi direttamente sul dispositivo. L'iniziativa potrebbe ridefinire l'interazione utente con l'intelligenza artificiale, portando capacità avanzate al di fuori dei tradizionali data center e aprendo nuove frontiere per la sovranità dei dati.

Jun 01 2026
Market

Nvidia: la domanda di AI manterrà la fornitura di chip critica oltre il 2027

Nvidia prevede che l'elevata domanda di hardware per l'intelligenza artificiale persisterà, mantenendo la fornitura di chip specializzati estremamente limitata ben oltre il 2027. Questa prospettiva a lungo termine impone ai decision-maker tecnici di riconsiderare le strategie di acquisizione, i piani di deployment on-premise e la gestione del Total Cost of Ownership (TCO) per le infrastrutture AI.

Jun 01 2026
Hardware

Memoria e AI: i leader del settore si preparano a Computex 2026

I vertici dei principali produttori di memoria si sono riuniti a Taiwan in vista di Computex 2026. L'incontro sottolinea l'importanza crescente della memoria ad alte prestazioni per l'evoluzione dei Large Language Models e le strategie di deployment on-premise. Le decisioni su VRAM e bandwidth influenzeranno direttamente il TCO e la sovranità dei dati per le aziende che sviluppano stack AI locali.

Jun 01 2026
Hardware

Otto brand PC adottano Nvidia-MediaTek RTX Spark per i laptop AI di nuova generazione

Otto importanti produttori di PC si sono impegnati a integrare la piattaforma Nvidia-MediaTek RTX Spark nei loro prossimi laptop. Questa mossa segna un passo significativo verso l'adozione diffusa di "AI agent laptops" entro l'autunno, spostando le capacità di intelligenza artificiale direttamente sui dispositivi client e aprendo nuove prospettive per l'elaborazione AI all'edge.

Jun 01 2026
Market

SoftBank supera Toyota: l'onda dell'AI ridefinisce il mercato giapponese

SoftBank Group ha superato Toyota Motor, diventando l'azienda quotata di maggior valore in Giappone. Questo storico sorpasso, il primo in 23 anni, è stato trainato dalla sua significativa partecipazione in OpenAI e da un Nikkei che ha superato la soglia dei 67.000 punti, evidenziando l'impatto crescente dell'intelligenza artificiale sui mercati finanziari globali.

Jun 01 2026
LLM

NVIDIA presenta Nemotron 3 Ultra: un nuovo orizzonte per i Large Language Models

NVIDIA ha annunciato Nemotron 3 Ultra, una novità che si inserisce nel panorama in rapida evoluzione dei Large Language Models. Questo sviluppo è particolarmente rilevante per le aziende che valutano strategie di deployment on-premise o ibride, ponendo l'accento sulla necessità di infrastrutture robuste e soluzioni che garantiscano sovranità dei dati e controllo sui carichi di lavoro AI.

Jun 01 2026
Hardware

Nvidia svela RTX Spark: un Superchip per PC e laptop con 128GB di memoria unificata

Nvidia ha annunciato il Superchip RTX Spark a Computex 2026, una nuova piattaforma destinata a laptop e desktop. Integrando una CPU Arm e una GPU Blackwell con 128GB di memoria unificata, Nvidia mira a trasformare Windows in un sistema operativo "agentic AI". Questa soluzione promette di portare capacità avanzate di intelligenza artificiale direttamente sui dispositivi locali, offrendo nuove opportunità per l'elaborazione on-premise e la sovranità dei dati.

Jun 01 2026
Market

Balderton lancia "Built in Europe" per rafforzare la fiducia nel tech europeo

Balderton Capital ha avviato la campagna "Built in Europe", sostenuta da fondatori di aziende come Revolut, Mistral e Wayve. L'iniziativa mira a contrastare la percezione che il settore tecnicico europeo sia in ritardo rispetto alla Silicon Valley, nonostante i successi e le opportunità di crescita. L'obiettivo è promuovere una narrativa più positiva e valorizzare l'innovazione locale, evidenziando il potenziale del continente.

Jun 01 2026
LLM

Ingegneria dei Dati Autonoma: LLM come Agenti per la Specializzazione dei Modelli

Una nuova ricerca esplora il concetto di Ingegneria dei Dati Autonoma, dove i Large Language Models (LLM) agiscono come agenti per curare e ottimizzare i dati di training. L'obiettivo è superare le difficoltà degli LLM nell'adattarsi a domini specializzati. Gli esperimenti dimostrano che un LLM autonomo può migliorare significativamente le performance di un modello studente, con un incremento del 57,29% ottenuto tramite adattamento iterativo dei dati.

Jun 01 2026
LLM

Valutazione di ChatGPT: un protocollo RAG con LLM open source contro le allucinazioni

Un nuovo protocollo propone un metodo rigoroso per valutare la capacità di ChatGPT di generare associazioni biomediche. Il processo include la validazione delle entità tramite ontologie e la verifica con la letteratura scientifica. Per migliorare l'affidabilità, il protocollo introduce una strategia di auto-consistenza e un workflow di verifica semantica basato su Retrieval-Augmented Generation (RAG). Quest'ultimo sfrutta Large Language Models (LLM) open source per stabilire la veridicità dei contenuti generati da altri LLM, offrendo uno strumento efficace per identificare le allucinazioni.

Jun 01 2026
Frameworks

Gait2Hip-60: Deep Learning per la Previsione delle Dinamiche dell'Anca nella Deambulazione

Uno studio ha sviluppato un framework di deep learning per prevedere le forze muscolari e i momenti articolari dell'anca direttamente dalla cinematica della deambulazione. Confrontando modelli come LSTM, Transformer e Mamba, il Transformer ha dimostrato la migliore performance su soggetti sani e una moderata capacità predittiva in validazione esterna su pazienti. I risultati aprono nuove prospettive per l'applicazione clinica, sottolineando l'importanza di un'ulteriore validazione e generalizzazione.

Jun 01 2026
LLM

QASM-Eval: Addestrare LLM per la programmazione quantistica hardware-oriented

Il dataset QASM-Eval mira a colmare una lacuna nell'addestramento degli LLM per la programmazione quantistica. Si concentra sulle funzionalità hardware-oriented di OpenQASM-3, cruciali nell'era NISQ. Con set di training e test verificati, QASM-Eval permette di migliorare significativamente le performance degli LLM nella generazione di codice per il controllo preciso dei sistemi quantistici, offrendo una base per assistenti affidabili in questo campo emergente.

Jun 01 2026
LLM

Modelli di Mondo Fisicamente Coerenti: La Chiave per l'IA Incarnata Affidabile

L'IA incarnata richiede modelli di mondo che rappresentino la struttura fisica per rispondere a query di intervento, superando i limiti dei modelli predittivi che generano risultati visivamente plausibili ma fisicamente errati. Un nuovo approccio propone modelli modulari e un orchestratore autonomo per garantire affidabilità, interpretabilità e auditabilità, aspetti cruciali per deployment on-premise in settori critici dove la sicurezza e il controllo dei dati sono prioritari.

Jun 01 2026
LLM

PhyDrawGen: Generare diagrammi fisici accurati dal linguaggio naturale

PhyDrawGen è una pipeline neuro-simbolica che affronta le imprecisioni dei modelli generativi attuali nella creazione di diagrammi fisici da testo. Integrando un LLM per la comprensione semantica e un risolutore deterministico per le leggi fisiche, con un modello Qwen-VL per la verifica visiva, PhyDrawGen supera modelli come GPT-5-image e Gemini 2.5 Flash in accuratezza fisica. La sua capacità di aderire a vincoli geometrici e leggi di conservazione lo rende un passo avanti significativo nella generazione di contenuti tecnici affidabili.

Jun 01 2026
Market

Nvidia rafforza i legami con l'industria coreana in vista del COMPUTEX

Nvidia sta intensificando le relazioni con i principali gruppi industriali della Corea del Sud, un'iniziativa strategica che precede il COMPUTEX. Questo avvicinamento sottolinea l'importanza crescente delle soluzioni AI per le grandi imprese, con un focus implicito sulle infrastrutture on-premise e sui requisiti di sovranità dei dati, aspetti cruciali per i settori industriali che valutano l'adozione di Large Language Models e altre tecnicie di intelligenza artificiale.

Jun 01 2026
Altro

Maggio 2026: Sicurezza AI, NVIDIA Vera e Linux 7.1 tra le novità

Il mese di maggio 2026 ha portato diverse novità significative nel panorama tecnicico, con particolare attenzione alla sicurezza guidata dall'AI, agli sviluppi legati a NVIDIA Vera e alle nuove funzionalità introdotte con Linux 7.1. Questi temi offrono spunti cruciali per i professionisti che gestiscono infrastrutture LLM on-premise, influenzando decisioni su controllo, sovranità dei dati e TCO.

Jun 01 2026
Market

La Legge Tau di Huawei: nuove dinamiche nella corsa ai chip AI

L'introduzione della "Legge Tau" di Huawei ridefinisce il panorama competitivo dei chip AI, sfidando il "compute moat" di Nvidia e la leadership di TSMC nei nodi di produzione. Questa evoluzione impatta direttamente le strategie di deployment on-premise di LLM, spingendo le aziende a valutare alternative per sovranità dei dati e controllo, in un mercato caratterizzato da alta domanda e offerta limitata di hardware specializzato.

Jun 01 2026
Market

Semiconduttori: Taiwan ottiene sollievo parziale dai dazi USA

Taiwan ha ottenuto un sollievo parziale dai dazi statunitensi imposti dalla Sezione 232 su alcuni prodotti, mentre continua a negoziare per l'ottenimento di quote di semiconduttori esenti da tariffe. Questa mossa, annunciata dall'Ufficio Presidenziale, ha implicazioni significative per la catena di fornitura globale e per il costo dell'hardware essenziale per le infrastrutture AI, influenzando direttamente le strategie di deployment on-premise.

Jun 01 2026
Market

Le restrizioni USA sui chip AI Nvidia: impatto sulle strategie on-premise globali

Gli Stati Uniti hanno intensificato le misure per limitare l'accesso di aziende cinesi, anche quelle operanti all'estero, ai chip AI di Nvidia. Questa mossa strategica evidenzia le crescenti tensioni geopolitiche e le loro ripercussioni sulla catena di fornitura di hardware critico per l'intelligenza artificiale. Per le imprese che valutano deployment on-premise di LLM, tali restrizioni sottolineano l'importanza di una pianificazione infrastrutturale resiliente e diversificata, considerando alternative e la sovranità tecnicica.

Jun 01 2026
Market

TSMC SoIC: implicazioni per i chip AI e i limiti di Huawei

La tecnicia SoIC di TSMC sta ridefinendo il panorama della produzione di chip AI, approfondendo la dipendenza dei produttori da soluzioni di packaging avanzate. Parallelamente, Huawei si trova ad affrontare significativi ostacoli nelle tecnicie di processo più recenti. Questo scenario evidenzia le complesse dinamiche della supply chain dei semiconduttori, con dirette implicazioni per le strategie di deployment on-premise, la sovranità tecnicica e l'analisi del TCO per le infrastrutture AI.

Jun 01 2026
LLM

LLM e HTML: Contenuti Interattivi Direttamente dal Modello, Anche On-Premise

Un'innovativa sperimentazione propone l'uso diretto dell'HTML come linguaggio di output primario per i Large Language Models, consentendo la creazione di contenuti animati e interattivi all'interno delle conversazioni. Questo approccio supera i limiti di formati come Markdown, gestendo l'output tramite iframe per il sandboxing. La fattibilità è dimostrata su configurazioni hardware on-premise, come un sistema dual NVIDIA RTX 3090 che esegue Qwen3.6-27B a circa 70 token/secondo, suggerendo un futuro in cui il software "usa e getta" generato dagli LLM diventerà la norma con modelli più potenti.

Jun 01 2026
Hardware

MediaTek punta sull'AI distribuita: occhiali smart, PC e server domestici

MediaTek sta orientando la propria strategia verso l'intelligenza artificiale distribuita, focalizzandosi su dispositivi edge come occhiali smart, PC e server domestici. Questa mossa riflette una visione in cui il calcolo AI si sposta oltre i tradizionali data center cloud, privilegiando soluzioni più vicine all'utente per garantire maggiore controllo, latenza ridotta e sovranità dei dati. L'azienda mira a capitalizzare questa transizione nel panorama computazionale, sviluppando silicio ottimizzato per l'inference locale.

Jun 01 2026
Market

Il boom dell'AI a Taiwan: impatto sui server ODM e i margini dei fornitori

L'esplosione della domanda di intelligenza artificiale sta ridefinendo il panorama manifatturiero a Taiwan, con un significativo aumento delle valutazioni per i produttori di server ODM. Questa tendenza spinge i fornitori a ricercare margini più elevati, riflettendo la crescente pressione sulla catena di approvvigionamento globale per l'hardware AI. Per le aziende, ciò implica una pianificazione strategica cruciale per i deployment on-premise.

Jun 01 2026
Market

Nvidia e TSMC: Strategie e sfide interne dei giganti del silicio AI

Le recenti notizie sui CEO di Nvidia e TSMC, rispettivamente legate a un evento di alto profilo e a questioni interne sui bonus, evidenziano la centralità di queste aziende nell'ecosistema dell'intelligenza artificiale. Le loro dinamiche strategiche e operative influenzano direttamente la disponibilità e il costo dell'hardware essenziale per i deployment on-premise di Large Language Models, un aspetto cruciale per CTO e architetti infrastrutturali.

Jun 01 2026
Market

MiniMax: la mossa A-share apre a nuovi capitali per l'AI in Cina

La decisione di MiniMax di esplorare il mercato azionario A-share cinese potrebbe ampliare le opzioni di finanziamento per le aziende di modelli AI nel paese. Questa mossa evidenzia la crescente necessità di capitali per sostenere lo sviluppo e il deployment di Large Language Models, influenzando le scelte infrastrutturali tra soluzioni on-premise e cloud, con implicazioni dirette su sovranità dei dati e TCO.

Jun 01 2026
Hardware

Intel lancia i processori Xeon 6+ e la nuova Ethernet E835

Intel ha annunciato il lancio della serie di processori Xeon 6+, precedentemente nota come Clearwater Forest, a partire dal 1° giugno. Contestualmente, l'azienda introduce anche la nuova scheda di rete Intel Ethernet E835. Questi nuovi componenti hardware sono cruciali per le infrastrutture on-premise, offrendo aggiornamenti significativi per i carichi di lavoro AI e per le esigenze di sovranità dei dati. Sono attesi ulteriori dettagli su Crescent Island e Diamond Rapids.

Jun 01 2026
Hardware

Intel svela Crescent Island a Computex: fino a 480 GB LPDDR5X per l'AI on-premise

Durante il Computex, Intel ha presentato nuovi dettagli sulla sua GPU AI Crescent Island, evidenziando una configurazione con fino a 480 GB di memoria LPDDR5X. Questa capacità mira a risolvere le carenze di memoria, cruciali per il deployment di Large Language Models (LLM) su infrastrutture self-hosted. L'azienda ha anche fornito aggiornamenti sull'acceleratore di inference Xe3P, rafforzando la sua offerta hardware per carichi di lavoro AI.

Jun 01 2026
Frameworks

Un server on-premise per esplorare i frattali di Mandelbrot con gli LLM

Un nuovo progetto open source introduce un server MCP (`openmandel`) che consente a Large Language Models di esplorare e visualizzare il set di Mandelbrot. Sfruttando un LLM come qwen3.6-35B-A3B tramite LM Studio, il sistema offre strumenti per il rendering, la selezione di palette e la generazione di gallerie, evidenziando il potenziale dei deployment locali per compiti computazionali specifici e creativi.

Jun 01 2026
Hardware

Skymizer HTX301: un acceleratore "decode-first" per l'inference LLM on-premise

Skymizer introduce HTX301, un nuovo acceleratore hardware progettato per ottimizzare l'inference di Large Language Models (LLM) direttamente on-premise. La soluzione si concentra sull'architettura "decode-first", mirando a migliorare l'efficienza e ridurre la latenza nei deployment locali. Questo approccio risponde all'esigenza crescente delle aziende di mantenere il controllo sui dati e sui costi operativi, offrendo un'alternativa alle soluzioni basate su cloud per carichi di lavoro AI intensivi.

Jun 01 2026
Market

Wistron: investimenti strategici in quantum computing e satelliti per l'era AI

Wistron sta investendo in tecnicie emergenti come il quantum computing e i piccoli satelliti. L'obiettivo è sostenere la crescita nell'era dell'intelligenza artificiale. Questi investimenti riflettono una strategia volta a esplorare nuove frontiere hardware e infrastrutturali, cruciali per lo sviluppo e il deployment di soluzioni AI avanzate, sia on-premise che in scenari distribuiti, con un occhio alla sovranità dei dati e al TCO.

Jun 01 2026
Altro

AI ridefinisce le priorità: Taiwan Mobile sposta il focus da satellite a data center

Taiwan Mobile ha annunciato che i servizi satellitari Direct-to-Consumer (D2C) non rappresentano più una priorità urgente. Questa decisione strategica è motivata dalle crescenti preoccupazioni legate all'infrastruttura dei data center e al consumo energetico, fattori sempre più critici a causa della rapida espansione delle applicazioni di Intelligenza Artificiale. Il cambio di rotta evidenzia come l'AI stia influenzando le scelte di investimento e le sfide operative nel settore delle telecomunicazioni e dell'infrastruttura IT.

Jun 01 2026
Market

Riorientamento delle Catene di Approvvigionamento Elettroniche: Impatti Geopolitici e Strategie On-Premise

Le recenti normative FEOC statunitensi e i tagli tariffari stanno ridisegnando le catene di approvvigionamento globali per l'elettronica automobilistica, con un notevole riorientamento verso Taiwan. Questo scenario geopolitico evidenzia la crescente complessità nella gestione delle forniture di componenti critici, con implicazioni dirette per le strategie di deployment on-premise di Large Language Models e altre infrastrutture AI.

Jun 01 2026
Altro

Advantech rafforza la strategia Edge AI e approva la distribuzione dei dividendi

Advantech ha annunciato l'approvazione dei dividendi e l'elezione del consiglio di amministrazione, contestualmente all'espansione della sua strategia nel campo dell'intelligenza artificiale perimetrale (Edge AI). Questa mossa sottolinea l'impegno dell'azienda verso soluzioni AI che operano direttamente sui dispositivi, riducendo la dipendenza dal cloud e potenziando la sovranità dei dati, un aspetto cruciale per le implementazioni on-premise e ibride.

Jun 01 2026
Hardware

AMD Radeon RX 9070 GRE: la GPU RDNA 4 ex-esclusiva cinese debutta globalmente a 549 dollari

AMD ha annunciato il rilascio globale della Radeon RX 9070 GRE, una GPU basata su architettura RDNA 4 precedentemente disponibile solo in Cina. Con un prezzo di 549 dollari e un debutto fissato per il 2 giugno, questa scheda grafica si posiziona strategicamente tra i modelli RX 9060 XT e RX 9070, offrendo una nuova opzione per gli utenti che cercano un equilibrio tra performance e costo nel segmento delle GPU.

Jun 01 2026
LLM

Quando il Fine-tuning non Basta: LLM e la Sfida delle Allucinazioni

Un recente episodio evidenzia la frustrazione di sviluppatori che, dopo giorni di fine-tuning, si trovano ancora a gestire Large Language Models che generano informazioni errate con sicurezza. Questa problematica solleva interrogativi cruciali sull'affidabilità dei modelli e sulle strategie di deployment, specialmente in contesti on-premise dove la sovranità dei dati e il controllo sono prioritari.

Jun 01 2026
LLM

MiniMax M3: L'LLM Multimodale da 1 Milione di Token per Agenti e Coding

MiniMax ha presentato il suo nuovo modello M3, un LLM multimodale che si distingue per una finestra di contesto di 1 milione di token. Progettato per applicazioni avanzate di coding e per lo sviluppo di agenti AI, M3 offre capacità significative per scenari che richiedono elaborazione complessa e mantenimento di stati conversazionali estesi. Le sue caratteristiche lo rendono un candidato interessante per valutazioni in ambienti on-premise, dove il controllo sui dati e le performance sono prioritari.

Jun 01 2026
Hardware

Nvidia al Computex 2026: Jensen Huang delinea il futuro dell'AI

Jensen Huang, CEO di Nvidia, salirà sul palco del Computex 2026 e GTC Taipei il 31 maggio per un keynote attesissimo. L'evento rappresenta un momento cruciale per comprendere le prossime direzioni di Nvidia nel panorama dell'intelligenza artificiale, con implicazioni significative per le strategie di deployment on-premise, l'hardware per LLM e le decisioni infrastrutturali che i CTO e gli architetti IT devono affrontare.

Jun 01 2026
Market

E Ink: la crisi energetica dell'AI accelera l'adozione di display a basso consumo

E Ink, leader nei display e-paper, identifica la crescente crisi energetica dell'AI come motore per l'espansione dei suoi prodotti in contesti urbani e outdoor. Questa osservazione evidenzia come l'efficienza energetica stia diventando un fattore cruciale per l'intera infrastruttura AI, influenzando le decisioni di deployment e il Total Cost of Ownership (TCO) per CTO e architetti infrastrutturali.

Jun 01 2026
Market

Il boom dell'AI a Taiwan: i finanziatori colmano il 'punto cieco' infrastrutturale

Taiwan sta vivendo una rapida espansione nel settore dell'intelligenza artificiale, ma questo sviluppo presenta un 'punto cieco' significativo, in particolare per quanto riguarda le infrastrutture necessarie per i deployment on-premise. Il settore finanziario sta intervenendo per colmare questa lacuna, offrendo supporto cruciale alle aziende che mirano a implementare soluzioni AI self-hosted, garantendo sovranità dei dati e controllo sui costi operativi a lungo termine.

Jun 01 2026
Market

Le catene di fornitura di Taiwan: interesse USA per difesa e tecnicia drone

L'interesse degli Stati Uniti per le catene di fornitura taiwanesi nel settore della difesa e della tecnicia drone sottolinea la crescente importanza strategica del controllo sull'hardware critico. Questo scenario evidenzia le sfide per le aziende che adottano deployment on-premise di LLM, dove la sovranità dei dati e la resilienza operativa dipendono da una supply chain robusta e sicura, dal silicio al software.

Jun 01 2026
Market

Flexium punta su prodotti a valore aggiunto e applicazioni AI per la ripresa

Flexium ha annunciato una strategia focalizzata su prodotti a più alto valore e applicazioni di intelligenza artificiale, con l'obiettivo di una ripresa economica prevista per la seconda metà del 2026. Questa mossa riflette una tendenza più ampia nel settore tecnicico, dove le aziende cercano di capitalizzare la crescente domanda di soluzioni AI avanzate, spesso richiedendo infrastrutture robuste e considerazioni specifiche sul deployment.

Jun 01 2026
Altro

L'AI spinge il rame ai limiti: la fotonica al silicio risorsa strategica fino al 2028

L'infrastruttura per l'intelligenza artificiale sta raggiungendo i limiti fisici delle interconnessioni in rame, spingendo l'industria verso soluzioni più avanzate. La fotonica al silicio emerge come tecnicia chiave per gestire l'enorme fabbisogno di banda. Le fonderie stanno già bloccando la capacità produttiva di questi componenti fino al 2028, segnalando una corsa strategica per assicurarsi le risorse necessarie allo sviluppo futuro dell'AI e per supportare i deployment on-premise ad alte prestazioni.

Jun 01 2026
LLM

Previsione Semantica dei Passi: Nuovi Orizzonti per il Ragionamento degli LLM

Un recente studio introduce la "Previsione Semantica dei Passi", una metodologia innovativa per migliorare il ragionamento multi-step nei Large Language Models (LLM). Attraverso il campionamento dei passi e la previsione latente, il sistema mira a rendere le traiettorie di ragionamento più robuste e accurate. Questo approccio ha implicazioni significative per l'efficienza e l'affidabilità dei deployment LLM on-premise, dove l'ottimizzazione delle risorse e il controllo sui processi sono cruciali per il Total Cost of Ownership (TCO) e la sovranità dei dati.

May 31 2026
Altro

Linux 7.1-rc6: il kernel si avvicina al rilascio stabile, base per l'AI on-premise

Il kernel Linux 7.1-rc6 è stato rilasciato, segnando un'altra tappa nello sviluppo prima della versione stabile attesa per metà giugno. Questa release candidata, sebbene descritta come di dimensioni maggiori del previsto, rappresenta un aggiornamento fondamentale per le infrastrutture tecniciche. Per le aziende che considerano deployment di Large Language Models (LLM) on-premise, la stabilità e le capacità del kernel Linux sono cruciali per garantire performance, sicurezza e controllo sui dati.

May 31 2026
Altro

Il G7 concorda sul linguaggio per l'AI open source e open weights

I leader del G7 hanno raggiunto un'intesa su una terminologia comune per l'intelligenza artificiale open source e i modelli con pesi aperti. Questa mossa indica una crescente consapevolezza governativa riguardo alle implicazioni di queste tecnicie, cruciali per chi valuta strategie di deployment on-premise e la sovranità dei dati. L'accordo sottolinea l'importanza di definizioni chiare in un settore in rapida evoluzione.

May 31 2026
Altro

Qwen on-premise: le insidie del deployment locale per i Large Language Models

Il deployment di Large Language Models (LLM) come Qwen in ambienti on-premise presenta sfide significative. Dalla gestione della VRAM alle complessità di configurazione, gli architetti e i team DevOps devono bilanciare performance, costi e sovranità dei dati. Un'analisi approfondita è cruciale per evitare frustrazioni e ottimizzare il Total Cost of Ownership (TCO) delle infrastrutture AI.

May 31 2026
Altro

Erin Brockovich e i data center: l'attivismo ambientale sfida la segretezza dell'infrastruttura AI

L'attivista ambientale Erin Brockovich ha intrapreso una nuova missione, puntando i riflettori sulla segretezza che circonda le operazioni dei data center. Questa iniziativa solleva questioni cruciali sull'impatto ambientale dell'infrastruttura tecnicica, in particolare quella dedicata ai Large Language Models (LLM), e sulla trasparenza necessaria per valutare il Total Cost of Ownership (TCO) e la sostenibilità dei deployment on-premise e cloud.

May 31 2026
Altro

Parakeet di NVIDIA su ggml: Speech-to-Text on-premise più veloce e leggero

Un recente porting dei modelli speech-to-text Parakeet di NVIDIA su ggml promette prestazioni superiori e un consumo di memoria ridotto rispetto all'implementazione NeMo originale. Questa soluzione, priva di dipendenze Python e PyTorch, è ottimizzata per deployment on-premise su CPU e GPU, offrendo un endpoint locale compatibile con le API OpenAI tramite LocalAI e supportando la quantization GGUF per diverse configurazioni. Un passo significativo verso l'efficienza e il controllo nei carichi di lavoro AI locali.

May 31 2026
LLM

Ottimizzazione dei LLM: Il Ruolo Cruciale della Quantization della KV Cache

La discussione sulla quantization dei Large Language Models (LLM) si concentra spesso sul modello stesso, trascurando l'ottimizzazione della KV Cache. Per modelli come Qwen3.6b-27b, impiegati nello sviluppo di codice, la gestione efficiente della memoria VRAM è fondamentale, specialmente in contesti on-premise. Approfondire la quantization della KV Cache può sbloccare nuove efficienze e ridurre il TCO per i deployment self-hosted.

May 31 2026
Hardware

LLM on-premise: quando la VRAM non basta e il modello 'spilla' in RAM

L'esecuzione di Large Language Models (LLM) in ambienti self-hosted presenta sfide significative, in particolare quando la VRAM della GPU è insufficiente. Un utente ha sperimentato questo problema con un modello Gemma 26B (21GB) su una GPU AMD RX6600XT, costringendo il modello a 'spillare' nella RAM di sistema. Questo scenario solleva interrogativi cruciali sul meccanismo di ripartizione del carico tra CPU e GPU e sull'impatto della velocità del bus PCIe e della RAM sulle performance di inference, un aspetto fondamentale per chi valuta deployment on-premise.

May 31 2026
Frameworks

Llama Studio v0.2.0: Nuove Funzionalità per la Gestione On-Premise di LLM

Llama Studio, una WebUI Open Source per la gestione di istanze llama-server, raggiunge la versione 0.2.0 introducendo significative novità. L'aggiornamento migliora la configurazione dei modelli tramite script shell e introduce il supporto per la ripartizione dei Large Language Models su più GPU. Queste funzionalità, insieme alla persistenza delle sessioni, ottimizzano il deployment e la gestione di LLM in ambienti self-hosted, offrendo maggiore controllo e flessibilità agli operatori infrastrutturali.

May 31 2026
Hardware

Nvidia N1X e N1: la memoria DDR5 a 16 canali promette oltre 500 GB/s

Un leak rivela dettagli sui prossimi processori Nvidia N1X e N1. Le specifiche indicano l'adozione di memoria DDR5 a 16 canali, con una larghezza di banda che supererà i 500 GB/s. Questi dati, se confermati, suggeriscono un significativo passo avanti nelle capacità di elaborazione, con implicazioni per i carichi di lavoro intensivi come quelli legati ai Large Language Models (LLM) e all'inference on-premise, dove la velocità di accesso alla memoria è cruciale per le performance.

May 31 2026
Hardware

Nvidia N1/N1X: trapelano i dettagli del SoC Arm con fino a 20 core prima del Computex

Prima del lancio ufficiale al Computex, sono trapelate le specifiche del System-on-Chip Nvidia N1/N1X. Il nuovo SoC, basato su architettura Arm, dovrebbe integrare fino a 20 core, con configurazioni standard da 10 e 12 core. Questi dettagli offrono un primo sguardo sulle future soluzioni di Nvidia per l'elaborazione, potenzialmente rilevanti per scenari di deployment on-premise e edge computing, dove efficienza e controllo sono prioritari.

May 31 2026
Altro

Il dibattito sulla 'psicosi da AI': percezione e controllo nei deployment enterprise

Un recente dibattito ha sollevato interrogativi sulla "psicosi da AI" tra i CEO, una metafora per le sfide di controllo e prevedibilità dei sistemi avanzati. Per le aziende, ciò si traduce in rischi concreti legati a governance, sicurezza e sovranità dei dati. Le soluzioni on-premise emergono come risposta strategica, offrendo controllo diretto su hardware e software, mitigando i comportamenti indesiderati dei modelli e garantendo la compliance, aspetti cruciali per i decision-maker tech.

May 31 2026
Altro

SoftBank investe fino a 87 miliardi in data center AI in Francia, puntando sull'energia nucleare

SoftBank ha annunciato un piano di investimento fino a 87 miliardi di dollari per la costruzione di data center dedicati all'intelligenza artificiale in Francia. La scelta strategica del paese è motivata dalla disponibilità di una robusta rete elettrica basata sull'energia nucleare, un fattore critico per l'alimentazione di infrastrutture AI ad alta intensità energetica, che rappresenta un vantaggio competitivo rispetto ad altre regioni, come gli Stati Uniti.

May 31 2026
Hardware

Snapdragon X Elite: Il Ruolo dei Processori Client nell'AI On-Device

L'emergere di processori come lo Snapdragon X Elite segna un punto di svolta per l'AI on-device, spostando l'elaborazione dei Large Language Models e altre funzionalità AI direttamente sui dispositivi client. Questa evoluzione offre nuove opportunità per la sovranità dei dati e la riduzione della latenza, ponendo le basi per un'architettura AI più distribuita e meno dipendente dalle infrastrutture cloud centralizzate.

May 31 2026
Market

Tesla e Waymo in Texas: il divario nelle flotte di robotaxi è ufficiale

Un nuovo requisito legale in Texas ha rivelato le dimensioni delle flotte di robotaxi autorizzate per il servizio di ride-hailing senza conducente. I dati, pubblicati il 28 maggio, mostrano che Waymo opera con 577 veicoli autonomi, mentre Tesla ne ha 42. Questo divario significativo, con la flotta di Tesla inferiore a un decimo di quella di Waymo, evidenzia le diverse scale di deployment nel settore e le implicazioni della crescente trasparenza normativa.

May 31 2026
Altro

Linux 7.1-rc6: Nuovi Controller e la Base dell'Framework

Il prossimo kernel Linux 7.1-rc6 introdurrà il supporto per nuovi dispositivi di input, tra cui i controller ASUS ROG RAIKIRI II e Nova 2 Lite. Questo aggiornamento, sebbene focalizzato su periferiche utente, sottolinea l'importanza dell'evoluzione continua del kernel come fondamento per la stabilità e la compatibilità hardware in qualsiasi ambiente, inclusi i deployment on-premise di carichi di lavoro AI, dove il controllo sull'intera pipeline è cruciale.

May 31 2026
Hardware

Raffreddamento Custom per Cluster DGX Spark On-Premise: Una Soluzione Fai-da-Te

La gestione termica rappresenta una sfida cruciale nei deployment on-premise di hardware AI ad alta densità. Un utente ha sviluppato una soluzione di raffreddamento fai-da-te per un cluster di DGX Spark, affrontando il problema del surriscaldamento causato dalla vicinanza forzata delle unità. Il progetto, che include un case stampato in 3D e un sistema di ventilazione automatico, evidenzia l'ingegno necessario per ottimizzare l'infrastruttura locale e mantenere il controllo sui costi e sulla sovranità dei dati.

May 31 2026
Hardware

Windows su Arm e Nvidia Tegra: un veterano Microsoft ricorda il 2010

Steven Sinofsky, ex dirigente Microsoft, ha condiviso un ricordo significativo: il momento in cui Windows girò per la prima volta su hardware Arm con chip Nvidia Tegra. L'episodio risale al 2010 e fu un tentativo di esplorare nuove architetture per il sistema operativo. Questa retrospettiva offre spunti sulle sfide e le opportunità che hanno plasmato l'evoluzione di Windows e il panorama dei processori, in particolare l'ascesa di Arm nel settore computing.

May 31 2026
Market

Pearl: il mining GPU per l'AI-compute vede la redditività dimezzarsi a 17 dollari

La criptovaluta Pearl, focalizzata sull'AI-compute, ha generato una corsa al mining tramite GPU. Tuttavia, la redditività per hardware come la RTX 5090 è già in forte calo. Da aprile, i ricavi giornalieri per una singola RTX 5090 si sono dimezzati, attestandosi ora a circa 17,19 dollari. Questo scenario evidenzia le rapide fluttuazioni nel settore del mining di criptovalute legate all'AI e le implicazioni per l'allocazione delle risorse hardware.

May 31 2026
Altro

AI ed Edge Computing: un modello custom per il controllo parassitario con i laser

Un innovativo sistema sfrutta l'intelligenza artificiale e la tecnicia laser per identificare ed eliminare le zanzare, impiegando un modello custom addestrato specificamente per questo scopo. Questa applicazione, apparentemente di nicchia, solleva questioni cruciali per i decision-maker tech riguardo al deployment di modelli AI specializzati sull'edge, ai requisiti hardware per l'inference in tempo reale e alle implicazioni per il Total Cost of Ownership (TCO) e la sovranità dei dati in ambienti distribuiti.

May 31 2026
LLM

DeepSWE: DeepSeek v4 Pro supera solo l'8% dei test, ma l'esperienza d'uso diverge

Un recente benchmark DeepSWE ha rilevato che DeepSeek v4 Pro completa con successo solo l'8% dei compiti assegnati. Tuttavia, l'esperienza di un utente suggerisce una performance quasi pari a quella di Sonnet 4.6 in contesti reali, sollevando interrogativi sull'accuratezza dei benchmark sintetici e la loro correlazione con l'efficacia pratica degli LLM in ambienti enterprise.

May 31 2026
Hardware

Il Ritorno dell'Hardware Specializzato: Lezioni per i Deployment LLM On-Premise

Il recente ritorno della scheda audio ISA Orpheus II, spinto dalla domanda di nicchia per sistemi DOS e Windows legacy, offre uno spunto di riflessione. Questo fenomeno evidenzia come la richiesta di hardware specifico, ottimizzato per carichi di lavoro ben definiti, sia cruciale anche nel contesto dei Large Language Models. Per CTO e architetti infrastrutturali, la scelta di soluzioni on-premise richiede un'attenta valutazione delle specifiche hardware per garantire sovranità dei dati e TCO.

← Precedente Page 46 / 160 Successiva →