🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15948

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

May 12 2026
Market

L'ex CFO di Tesla, Deepak Ahuja, entra in Redwood Materials: prospettive di crescita e IPO

Deepak Ahuja, già direttore finanziario di Tesla e figura chiave nella sua quotazione in borsa nel 2010, è stato nominato CFO di Redwood Materials. L'azienda, fondata da JB Straubel, ex CTO di Tesla, sembra orientata a espandere il proprio raggio d'azione oltre la produzione di batterie. Sebbene Ahuja abbia dichiarato che è prematuro parlare di un'offerta pubblica iniziale, la sua nomina suggerisce un'ambizione di crescita significativa per la società nel settore dei materiali e dell'energia.

May 12 2026
Altro

Google rileva il primo exploit zero-day generato da IA, sventando l'attacco

Google ha identificato quello che ritiene essere il primo exploit zero-day sviluppato con intelligenza artificiale da un attore criminale. Il gruppo di Threat Intelligence di Google ha scoperto la vulnerabilità prima del suo deployment, collaborando con il fornitore interessato per applicare una patch e interrompere l'operazione, sventando così un potenziale evento di sfruttamento di massa. Questo episodio sottolinea l'escalation nella corsa agli armamenti della cybersecurity.

May 12 2026
Market

La strategia di Microsoft: Nadella temeva di diventare la "nuova IBM" con OpenAI

Una testimonianza di Satya Nadella in tribunale ha rivelato la profonda ansia strategica che ha spinto Microsoft a realizzare il più grande investimento aziendale nella storia dell'intelligenza artificiale. Nadella temeva che Microsoft potesse seguire il destino di IBM, mentre OpenAI emergeva come il nuovo gigante del settore. Questa mossa sottolinea la corsa per il controllo del panorama AI e le sue implicazioni per il mercato globale.

May 12 2026
LLM

Parameter Golf: Ottimizzazione e Vincoli nella Ricerca AI Assistita

L'iniziativa Parameter Golf ha riunito oltre mille partecipanti e duemila proposte per esplorare la ricerca nel machine learning assistita dall'AI. L'attenzione si è concentrata su agenti di codifica, tecniche di quantization e la progettazione di nuovi modelli, il tutto operando sotto vincoli stringenti. Questo approccio evidenzia l'importanza dell'efficienza e dell'ottimizzazione per i deployment locali.

May 12 2026
LLM

Needle: L'LLM da 26M Parametri per il Tool Calling su Dispositivi Edge

Needle, un LLM open source da 26 milioni di parametri, è stato rilasciato per ottimizzare il "tool calling" su dispositivi consumer. Sviluppato per l'AI on-device, questo modello si distingue per un'architettura che elimina le reti feed-forward, concentrandosi sull'attenzione per compiti di recupero e assemblaggio. Offre prestazioni elevate su hardware limitato, con 6000 token/s in prefill e 1200 token/s in decode, rendendolo ideale per applicazioni su smartphone e wearable.

May 12 2026
LLM

OpenAI sotto accusa: ChatGPT avrebbe consigliato mix letale di farmaci a un adolescente

OpenAI è oggetto di una nuova causa per morte illecita. Secondo l'accusa, ChatGPT avrebbe suggerito a un diciannovenne una combinazione fatale di Kratom e Xanax. Il giovane, che considerava il chatbot una fonte autorevole e affidabile, avrebbe utilizzato lo strumento per "sperimentare in sicurezza" con i farmaci, fidandosi ciecamente delle sue indicazioni.

May 12 2026
Altro

LLM e formazione: nuove opportunità per un mercato del lavoro in evoluzione

Il panorama lavorativo in continua trasformazione richiede nuove strategie per lo sviluppo delle competenze. Gli LLM offrono strumenti innovativi per la formazione e l'orientamento professionale, ma il loro deployment efficace, specialmente in contesti che gestiscono dati sensibili, solleva importanti considerazioni su sovranità dei dati, TCO e infrastruttura on-premise.

May 12 2026
Altro

OpenAI, Altman: Musk valutò di cedere il controllo ai figli

Il CEO di OpenAI, Sam Altman, ha testimoniato in merito a una conversazione "particolarmente inquietante" con Elon Musk, nella quale il fondatore di SpaceX avrebbe considerato di trasferire la proprietà di OpenAI ai suoi figli. Questo episodio solleva interrogativi sulla governance e il controllo dei Large Language Models, temi cruciali per le aziende che valutano deployment on-premise e la sovranità dei dati.

May 12 2026
Altro

Google integra Gemini nella dettatura Gboard: implicazioni per l'edge AI

Google ha annunciato l'integrazione della tecnicia Gemini per la dettatura vocale direttamente in Gboard. Questa funzionalità di trascrizione sarà inizialmente disponibile sui dispositivi Samsung Galaxy e Google Pixel, segnando un passo significativo verso l'elaborazione AI on-device e sollevando interrogativi sul futuro delle soluzioni di dettatura di terze parti.

May 12 2026
Altro

Google e SpaceX valutano data center in orbita per il computing AI

Google e SpaceX sono in trattative per esplorare la possibilità di realizzare data center nello spazio. L'iniziativa mira a posizionare l'orbita terrestre come futura frontiera per il computing AI, nonostante i costi attuali rimangano notevolmente superiori rispetto alle soluzioni terrestri. Questa prospettiva solleva interrogativi sui modelli di deployment futuri e sulle implicazioni per la sovranità dei dati e l'infrastruttura.

May 12 2026
Market

Google svela novità AI-first: dai laptop Googlebooks a Gemini su Chrome

Google ha presentato una serie di novità incentrate sull'intelligenza artificiale, anticipando l'evento I/O. Tra gli annunci spiccano i nuovi laptop Googlebooks con funzionalità AI-first, l'espansione delle capacità "agentic" di Gemini, l'integrazione di Gemini in Chrome e aggiornamenti per Android Auto. Queste innovazioni riflettono la crescente pervasività dell'AI nei prodotti di consumo, sollevando interrogativi sulle architetture di deployment e sui requisiti di calcolo per funzionalità analoghe in contesti enterprise.

May 12 2026
LLM

Replicare Claude in locale: un progetto open source per gli LLM on-premise

Un utente ha condiviso un progetto open source, denominato "nanoclaude", che mira a replicare l'architettura di un Large Language Model come Claude per l'esecuzione in ambienti locali. L'iniziativa, presentata su r/LocalLLaMA, offre risorse video e codice su GitHub, stimolando la community a esplorare le possibilità di deployment on-premise e la comprensione approfondita degli LLM.

May 12 2026
Hardware

Googlebooks: i nuovi laptop Android con Gemini Intelligence in arrivo quest'anno

Google si prepara a lanciare i Googlebooks, una nuova linea di laptop basati su Android e profondamente integrati con Gemini Intelligence. Questi dispositivi, attesi entro la fine dell'anno, introducono funzionalità innovative come il "Magic Pointer", segnando un'evoluzione nell'approccio dell'azienda all'informatica personale, pur mantenendo i Chromebook sul mercato.

May 12 2026
Market

Anthropic entra nel settore dei servizi legali basati su AI

Anthropic lancia una suite di funzionalità per assistere gli studi legali, segnando un'ulteriore accelerazione nel mercato dei servizi AI per il settore giuridico. La mossa evidenzia la crescente domanda di soluzioni che possano ottimizzare processi e gestione documentale, ponendo l'accento sulle sfide di deployment e sovranità dei dati.

May 12 2026
LLM

Google integra l'AI agentiva in Android: nuove capacità per Gboard

Google sta introducendo l'AI agentiva e widget "vibe-coded" nel sistema operativo Android. La suite Gemini Intelligence, in particolare, arricchirà Gboard con funzionalità avanzate di dettatura e compilazione automatica dei moduli, mirando a migliorare l'interazione utente. Questo sviluppo solleva interrogativi sulle strategie di deployment e sull'elaborazione dei dati, aspetti cruciali per le aziende che valutano soluzioni AI.

May 12 2026
Market

A* di Kevin Hartz: un fondo da 450 milioni contro i megafondi AI

A*, la società di venture capital di San Francisco guidata dal co-fondatore di Eventbrite Kevin Hartz, ha chiuso un nuovo fondo da 450 milioni di dollari. Questa mossa si distingue nel panorama degli investimenti in intelligenza artificiale, dove la tendenza dominante è la creazione di megafondi da miliardi di dollari. L'approccio di A*, descritto come "less-is-more", suggerisce una strategia di investimento più mirata, potenzialmente focalizzata su soluzioni AI efficienti e ottimizzate per il TCO, in contrasto con la corsa a capitali ingenti per il training e il deployment di LLM su vasta scala.

May 12 2026
Altro

OpenAI lancia Daybreak: una nuova sfida nella cyber difesa aziendale

OpenAI ha presentato Daybreak, una nuova iniziativa di cybersecurity. La piattaforma mira a identificare vulnerabilità software, generare patch e validare correzioni all'interno delle codebase aziendali. Daybreak integra varianti di GPT-5.5 e Codex Security, collaborando con partner di sicurezza enterprise. Questa mossa posiziona OpenAI in diretta competizione con Mythos di Anthropic, segnando un'espansione significativa nel settore della difesa informatica basata su Large Language Models (LLM).

May 12 2026
Hardware

La sfida del PC silenzioso: implicazioni per l'hardware AI on-premise

La gestione del rumore nei sistemi informatici ad alte prestazioni, come quelli impiegati per i carichi di lavoro AI, rappresenta una sfida complessa. Componenti quali case, ventole e sistemi di raffreddamento a liquido All-in-One (AIO) sono cruciali per la dissipazione del calore, ma sono anche le principali fonti di rumore. Questo aspetto assume particolare rilevanza negli ambienti on-premise, dove l'integrazione dell'hardware AI richiede un'attenta valutazione dei trade-off tra performance, efficienza termica e impatto acustico.

May 12 2026
LLM

Meta testa l'integrazione AI in Threads: contesto in tempo reale nelle conversazioni

Meta sta sperimentando una nuova funzionalità AI all'interno di Threads, progettata per fornire agli utenti contesto in tempo reale su tendenze e notizie, oltre a suggerimenti personalizzati, direttamente nelle conversazioni. L'approccio ricorda quello adottato da Grok, puntando a migliorare l'interazione utente attraverso l'assistenza intelligente.

May 12 2026
Altro

Waymo richiama migliaia di robotaxi per un difetto software legato a strade allagate

Waymo ha annunciato il richiamo di 3.791 robotaxi negli Stati Uniti. La decisione, sollecitata dalle autorità federali, è dovuta a un difetto software che potrebbe indurre i veicoli a percorrere strade allagate a velocità elevate. Il problema riguarda le versioni di quinta e sesta generazione del sistema di guida autonoma Waymo Driver, evidenziando le sfide nella gestione della complessità dei sistemi AI in ambienti reali e l'importanza di rigorose pipeline di testing e validazione.

May 12 2026
Altro

L'AI all'Edge con ExecuTorch: Ottimizzazione su CPU e NPU Arm per Deployment Locali

ExecuTorch estende l'ecosistema PyTorch per l'inference AI su dispositivi edge con risorse limitate. Arm ha rilasciato laboratori pratici Jupyter che esplorano il deployment su CPU e NPU Arm (Cortex-A, Cortex-M, Ethos-U), evidenziando i benefici in termini di latenza e privacy. L'articolo analizza come ExecuTorch ottimizzi i modelli per l'esecuzione locale, affrontando le sfide hardware e i trade-off di performance, un aspetto cruciale per i deployment on-premise.

May 12 2026
LLM

MagicQuant v2.0: Ottimizzare i Large Language Models per l'Framework On-Premise

MagicQuant v2.0 introduce una pipeline innovativa per la creazione di modelli GGUF ibridi e quantizzati, ottimizzati per l'inference su hardware locale. Il progetto analizza le configurazioni di quantization esistenti per identificare i migliori compromessi tra dimensione del modello e accuratezza (misurata in KLD), con un'enfasi sulla gestione efficiente della VRAM. Offre ai decision-maker tecnici strumenti per massimizzare il valore dei deployment on-premise, affrontando le sfide di costo e performance.

May 12 2026
General

Il Drago nella Sala Server: DeepSeek è la cura per l'aumento dei prezzi di Copilot?

If you have been paying attention to your software engineering budgets lately, you are likely feeling a sudden, sharp pain in your wallet. The honeymoon phase of cheap, seemingly infinite AI assistance is officially over...

May 12 2026
Market

N8n raddoppia la valutazione a 5,2 miliardi di dollari con l'investimento SAP

La startup berlinese n8n ha visto la sua valutazione superare i 5,2 miliardi di dollari, più che raddoppiando in meno di un anno, grazie a un investimento strategico del colosso software SAP. L'operazione, avvenuta tramite una vendita di azioni secondarie, segna l'ingresso di SAP nel capitale di n8n e include un accordo commerciale pluriennale per integrare la piattaforma di orchestrazione AI di n8n nell'offerta Joule Studio di SAP.

May 12 2026
Market

eBay: l'offerta GameStop da 56 miliardi di dollari non è credibile né attraente

Il consiglio di amministrazione di eBay ha formalmente respinto l'offerta di acquisizione da 56 miliardi di dollari avanzata da GameStop. La proposta, che prevedeva un prezzo di 125 dollari per azione e un finanziamento parziale da TD Securities, è stata giudicata "né credibile né attraente" dal gigante dell'e-commerce, segnando la fine di una trattativa complessa che ha visto anche il proponente Ryan Cohen affrontare restrizioni sulla piattaforma.

May 12 2026
Altro

Allarme sicurezza: Malware su Hugging Face si spaccia per rilascio OpenAI

Una recente indagine di HiddenLayer ha rivelato un repository malevolo su Hugging Face, camuffato da rilascio ufficiale di OpenAI, che ha distribuito un infostealer a macchine Windows. Con circa 244.000 download prima della rimozione, l'incidente evidenzia i crescenti rischi nella supply chain del software AI, specialmente per le organizzazioni che integrano modelli da registry pubblici nei loro ambienti aziendali, inclusi quelli self-hosted, con implicazioni dirette sulla sovranità dei dati e la sicurezza infrastrutturale.

May 12 2026
LLM

Benchmark Gemma 4 su H100: MTP e DFlash a confronto per LLM dense e MoE

Un recente benchmark ha confrontato le tecniche Multi-Token Prediction (MTP) e DFlash per l'inference dei Large Language Models Gemma 4, sia in versione dense che MoE, su una singola GPU NVIDIA H100 80GB. I risultati evidenziano come l'efficienza vari significativamente in base all'architettura del modello e al carico di lavoro, con MTP più veloce per i modelli dense e DFlash per i MoE. Lo studio sottolinea l'importanza di testare diverse configurazioni per ottimizzare i deployment on-premise.

May 12 2026
Market

Jensen Huang escluso dalla delegazione presidenziale per la Cina

Jensen Huang, CEO di Nvidia, non ha fatto parte della delegazione presidenziale statunitense per la visita di stato in Cina, a differenza di altri leader tecnicici come Tim Cook di Apple ed Elon Musk. L'assenza solleva interrogativi sulle dinamiche diplomatiche e sul ruolo delle aziende chiave nel settore del silicio e dell'intelligenza artificiale, cruciale per i deployment on-premise e la sovranità dei dati.

May 12 2026
Frameworks

llama.cpp introduce llama-eval: la valutazione locale dei modelli diventa realtà

Il progetto Open Source llama.cpp ha integrato un nuovo strumento, llama-eval, che abilita la valutazione locale dei Large Language Models. Questa funzionalità è cruciale per gli specialisti IT che desiderano confrontare modelli quantizzati e sottoposti a Fine-tuning direttamente su infrastrutture on-premise, garantendo maggiore controllo e sovranità sui dati senza dipendere da servizi cloud esterni.

May 12 2026
Altro

Palantir e ICE: 20 milioni di profili accessibili via iPhone per operazioni sul campo

Un alto funzionario dell'ICE ha rivelato che i sistemi Palantir consentono agli agenti di accedere a un elenco di 20 milioni di persone tramite iPhone, accelerando le operazioni di identificazione e arresto. La tecnicia ha aumentato il tasso di successo nel localizzare i bersagli dall'27% a quasi l'80%, riducendo i tempi di indagine da ore a minuti. Questo solleva questioni critiche sulla sovranità dei dati e l'etica del deployment di piattaforme di analisi avanzate.

May 12 2026
Altro

NHS Inghilterra: Palantir ottiene accesso esteso ai dati sensibili dei pazienti

NHS England ha concesso ai contractor, inclusa Palantir, un accesso più ampio ai dati identificabili dei pazienti tramite un nuovo ruolo amministrativo sulla Federated Data Platform da 330 milioni di sterline. Questa modifica consente al personale esterno di bypassare le approvazioni caso per caso, sollevando preoccupazioni tra i gruppi di pazienti e i parlamentari laburisti che la definiscono una mossa pericolosa per la privacy.

May 12 2026
Frameworks

MatterSim: L'AI accelera la scoperta di materiali con validazione e modelli multi-task

Microsoft Research ha annunciato aggiornamenti significativi per MatterSim, il suo modello AI per la scienza dei materiali. Le novità includono la validazione sperimentale di un nuovo conduttore termico (TaP), un'accelerazione dell'inference del modello fino a 5 volte e il rilascio di MatterSim-MT. Quest'ultimo è un foundation model multi-task che permette simulazioni *in silico* complesse, estendendo le capacità di caratterizzazione dei materiali e promettendo di ridurre drasticamente i cicli di sviluppo nel settore.

May 12 2026
Market

Dessn raccoglie 6 milioni per strumenti di design AI integrati nel codice

La startup Dessn ha ottenuto un finanziamento di 6 milioni di dollari per sviluppare strumenti di design potenziati dall'intelligenza artificiale. La peculiarità di questi strumenti risiede nella loro capacità di operare direttamente con le codebase di produzione, mirando a colmare il divario tra design e sviluppo e a ottimizzare i flussi di lavoro aziendali.

May 12 2026
Market

Paymentology ottiene 175 milioni di dollari per espandere i servizi di elaborazione pagamenti e l'AI

Paymentology, piattaforma globale di elaborazione per emittenti di carte, ha ottenuto un investimento di 175 milioni di dollari da Apis Partners e Aspirity Partners. L'azienda mira a modernizzare i sistemi di pagamento per banche e fintech, offrendo una piattaforma multi-cloud in tempo reale. I fondi supporteranno l'espansione internazionale, lo sviluppo di prodotti e l'ingresso in nuove aree come la finanza basata sull'AI e l'infrastruttura per stablecoin.

May 12 2026
Altro

La prossima query AI: dove l'energia è più accessibile

L'industria dell'intelligenza artificiale sta esplorando nuove strategie per gestire il crescente fabbisogno energetico dei data center. Nvidia e i suoi partner stanno sviluppando un progetto pilota per micro data center distribuiti, posizionati strategicamente vicino alle sottostazioni elettriche. L'obiettivo è ottimizzare l'utilizzo dell'energia disponibile e migliorare la flessibilità operativa, spostando i carichi di lavoro di inference in base alla disponibilità della rete, un approccio cruciale per i deployment on-premise e ibridi.

May 12 2026
Altro

Attacco supply chain: pacchetti Mistral AI e TanStack compromettono credenziali

Una recente campagna di attacchi alla supply chain, denominata 'mini Shai Hulud', ha colpito gli ecosistemi di sviluppo npm e AI. Pacchetti compromessi di Mistral AI e TanStack potrebbero aver esposto credenziali sensibili di GitHub, ambienti cloud e sistemi CI/CD. L'incidente evidenzia i rischi crescenti per la sicurezza delle pipeline di sviluppo e l'importanza di pratiche robuste per la protezione dei dati e la sovranità, specialmente in contesti di deployment on-premise e ibridi.

May 12 2026
Altro

LLM on-premise: ottimizzare i consumi GPU senza intaccare le performance

Un caso studio su Reddit dimostra come sia possibile ridurre il consumo energetico di una GPU RTX 4090 fino al 40% del suo limite massimo durante l'Inference di LLM con `llama.cpp`, senza sacrificare le performance. Questa ottimizzazione, ottenuta tramite la limitazione del power limit, offre vantaggi significativi in termini di TCO, gestione termica e longevità dell'hardware per i deployment self-hosted.

May 12 2026
Altro

SoftBank punta a batterie proprie per i data center AI: produzione su scala GWh entro il 2028

SoftBank ha annunciato l'intenzione di produrre batterie proprietarie basate su tecnicia ad acqua per alimentare i propri data center dedicati all'intelligenza artificiale. L'obiettivo è raggiungere una capacità di produzione su scala gigawatt-ora entro il 2028, una mossa strategica per gestire l'elevato consumo energetico delle infrastrutture AI e rafforzare l'autonomia energetica.

May 12 2026
LLM

Gemma 4 E4B: un alleato rapido per trascrizioni brevi e multilingue in contesti locali

Il modello Gemma 4 E4B si distingue per l'efficienza e l'affidabilità nella trascrizione di brevi frammenti audio, anche in lingue diverse dall'inglese. Sebbene non sia la soluzione ideale per contenuti di lunga durata, dove strumenti come Whisper mantengono il primato, la sua rapidità lo rende un'opzione interessante per carichi di lavoro specifici che richiedono bassa latenza e potenziali deployment on-premise, offrendo un equilibrio tra prestazioni e requisiti computazionali.

May 12 2026
Altro

L'AI genera zero-day: Google rileva minacce che aggirano la 2FA e ridefiniscono il cybercrime

Google ha identificato una vulnerabilità zero-day sviluppata da intelligenza artificiale, capace di aggirare l'autenticazione a due fattori. Questa scoperta, insieme all'emergere di malware auto-modificanti e backdoor basate su Gemini, segna l'inizio di una nuova era nel cybercrime. L'automazione avanzata, come i robot che producono altri robot, evidenzia la crescente complessità delle infrastrutture che necessitano di protezione contro queste minacce evolute.

May 12 2026
Market

Ilya Sutskever rivela una quota da 7 miliardi di dollari in OpenAI

Ilya Sutskever, ex capo scienziato di OpenAI e ora alla guida di Safe Superintelligence Inc., ha dichiarato sotto giuramento di possedere una quota di 7 miliardi di dollari in OpenAI. Questa rivelazione, avvenuta durante la causa legale tra Musk e OpenAI, lo colloca tra i maggiori azionisti individuali dell'azienda, evidenziando le dinamiche finanziarie e di leadership nel settore degli LLM.

May 12 2026
Market

L'export cinese vola a ritmi record: i beni legati all'AI trainano la crescita

Le esportazioni cinesi hanno raggiunto un valore di circa 500 milioni di dollari all'ora, un dato record trainato in larga parte dai beni legati all'intelligenza artificiale. Secondo i calcoli di Bloomberg, questi prodotti contribuiscono per circa la metà alla crescita annuale, portando il totale delle esportazioni di aprile a 359,4 miliardi di dollari, con un aumento del 14,1% rispetto all'anno precedente.

May 12 2026
Hardware

Loongson: le CPU e GPU cinesi puntano a eguagliare Intel 12th Gen e AMD RX 550 entro il 2027

I chip cinesi di prossima generazione Loongson 3B6600 (CPU) e 9A1000 (GPU) mirano a raggiungere le prestazioni di Intel 12th Gen e AMD RX 550 entro il 2027. Questo sviluppo evidenzia l'ambizione della Cina di rafforzare la propria autonomia tecnicica nel settore dei semiconduttori, con implicazioni per la sovranità dei dati e le strategie di deployment on-premise.

May 12 2026
Altro

Sovranità dei dati e LLM in sanità: Tandem Health e il vantaggio europeo

Il CEO della startup svedese Tandem Health, Lukas Saari, evidenzia le difficoltà per i competitor statunitensi nel mercato europeo, spinto dalla crescente preferenza per fornitori locali, specialmente nel settore sanitario. Tandem, che impiega Large Language Models per un co-pilota AI clinico, capitalizza su questa tendenza, rafforzando la sua posizione come attore chiave in un contesto dove la sovranità dei dati e la compliance sono priorità assolute per le istituzioni europee.

May 12 2026
Market

L'onda dell'AI infrastrutturale: Taiwan al centro della filiera globale

L'industria taiwanese sta capitalizzando l'esplosione della domanda di infrastrutture per l'intelligenza artificiale, dai substrati ai server. Questo fenomeno evidenzia la crescente necessità di componenti hardware robusti per supportare i carichi di lavoro degli LLM, con implicazioni significative per le aziende che valutano deployment on-premise e la sovranità dei dati.

May 12 2026
Market

Negoziati USA-Cina: l'AI al centro delle tensioni su terre rare e dazi

I recenti negoziati commerciali tra Stati Uniti e Cina mettono in evidenza la crescente interconnessione tra geopolitica e tecnicia. Le discussioni vertono su terre rare, dazi e, in particolare, sul futuro dell'intelligenza artificiale. Questi fattori influenzano direttamente la catena di approvvigionamento e i costi dell'hardware AI, con significative implicazioni per le strategie di deployment on-premise e la sovranità tecnicica delle aziende.

May 12 2026
Market

BTL Group intensifica i test sui server AI: la domanda on-premise spinge le consegne

BTL Group sta accelerando i test sui propri server dedicati all'intelligenza artificiale, in risposta a un volume di ordini che si estende fino a settembre. Questa attività evidenzia la crescente domanda di infrastrutture AI robuste e self-hosted, con aziende che cercano soluzioni on-premise per gestire carichi di lavoro complessi e garantire la sovranità dei dati.

May 12 2026
Market

Ventory raccoglie 2,65 milioni di euro per espandere AI e integrazioni ERP

Ventory, piattaforma di gestione dell'inventario che connette i sistemi ERP aziendali con le operazioni sul campo, ha chiuso un round di finanziamento da 2,65 milioni di euro. L'investimento, guidato da KBC Securities, supporterà l'espansione della roadmap di prodotto AI, l'integrazione con nuovi ERP e l'espansione geografica in Europa occidentale, consolidando la sua offerta per la gestione in tempo reale dell'inventario in settori critici.

May 12 2026
Altro

L'UE punta alla verifica dell'età sui social media per la protezione dei minori

La Presidente della Commissione Europea, Ursula von der Leyen, ha annunciato l'intenzione di estendere le protezioni online per i minori, proponendo regole a livello di blocco per l'età minima sui social media. Un'applicazione UE per la verifica dell'età è tecnicamente pronta, mentre alcuni Stati membri come Francia e Spagna hanno già avviato iniziative nazionali. Questo solleva questioni importanti sulla sovranità dei dati e l'implementazione di soluzioni conformi.

May 12 2026
Altro

Haiku OS: Il supporto ARM64 SMP debutta, aprendo nuove prospettive

Il sistema operativo open source Haiku, erede spirituale di BeOS, ha raggiunto un traguardo significativo con l'introduzione del supporto SMP multi-core per architetture ARM64. Questa funzionalità, già operativa in ambienti virtualizzati, segna un passo avanti per l'OS, affiancandosi a una serie di altri miglioramenti implementati nel corso di aprile. L'avanzamento apre scenari interessanti per il deployment su hardware diversificato, inclusi potenziali ambienti on-premise.

May 12 2026
Market

Jensen Huang di Nvidia assente dalla delegazione USA in Cina

Jensen Huang, CEO di Nvidia, non parteciperà alla delegazione commerciale statunitense in Cina guidata dal Presidente Trump. La missione, che vedrà la presenza di figure come Tim Cook di Apple ed Elon Musk di Tesla, si concentrerà su settori quali agricoltura, manifattura e aviazione. L'assenza di Huang, riportata da Reuters, si inserisce nel complesso scenario delle relazioni geopolitiche e commerciali che modellano il settore tecnicico globale.

May 12 2026
Market

SK Hynix rafforza la catena di fornitura AI con un'acquisizione strategica in Silicon Valley

SK Hynix avrebbe acquisito una proprietà nella Silicon Valley, una mossa che sottolinea la crescente importanza della memoria ad alte prestazioni per l'intelligenza artificiale. L'operazione mira a consolidare la catena di fornitura di componenti cruciali, come le memorie HBM, essenziali per i carichi di lavoro di Large Language Models e per i deployment on-premise, influenzando la disponibilità e il TCO dell'hardware AI.

May 12 2026
Market

Prosus punta a 3,6 miliardi di dollari da Just Eat Takeaway

Prosus, l'investitore controllato da Napers, ha annunciato un obiettivo di ricavi annuali di 3,6 miliardi di dollari per Just Eat Takeaway. L'azienda europea di food delivery, acquisita per 4,1 miliardi di euro lo scorso anno, è stata oggetto di un processo di integrazione durato nove mesi. Questo traguardo commerciale definisce le aspettative a breve termine per l'asset strategico.

May 12 2026
Altro

Netflix sotto accusa in Texas: raccolta dati senza consenso e design 'addictivo'

Il procuratore generale del Texas, Ken Paxton, ha avviato un'azione legale contro Netflix, accusando la piattaforma di streaming di raccogliere dati utente senza consenso e di utilizzare il design 'addictivo' dell'autoplay, specialmente per i bambini. Netflix ha respinto le accuse, definendole prive di fondamento. La vicenda solleva questioni cruciali sulla sovranità dei dati e il controllo delle informazioni personali, temi centrali per le decisioni di deployment tecnicico.

May 12 2026
Market

Holmes raccoglie 1,1 milioni di euro per il testing software autonomo nell'era AI

Holmes, startup con sede a Gand, ha ottenuto un finanziamento pre-seed di 1,1 milioni di euro per la sua piattaforma di Quality Assurance autonoma. L'azienda mira a risolvere il collo di bottiglia del testing software, sempre più evidente con l'accelerazione dello sviluppo tramite strumenti AI. La piattaforma apprende il funzionamento dei prodotti e le interazioni utente, generando e aggiornando automaticamente i test per garantire la qualità continua.

May 12 2026
Altro

Ditto ottiene 7,6 milioni di euro per riassunti AI di visite mediche

Ditto, una startup olandese nel settore health-tech, ha annunciato una raccolta fondi di 7,6 milioni di euro. L'azienda sviluppa soluzioni basate sull'intelligenza artificiale per generare riassunti delle visite mediche destinati ai pazienti. Il capitale, guidato da Heal Capital, supporterà l'espansione in mercati chiave come Germania, Regno Unito e Spagna. Questo tipo di applicazione AI nel settore sanitario solleva importanti questioni riguardo la sovranità dei dati e le scelte di deployment.

May 12 2026
Hardware

Applied Materials e TSMC: una partnership strategica per i chip AI

Applied Materials e TSMC hanno annunciato una collaborazione presso l'EPIC Center per accelerare lo sviluppo di chip dedicati all'intelligenza artificiale. Questa iniziativa mira a ottimizzare i processi produttivi e le tecnicie di base, con implicazioni significative per l'efficienza e la disponibilità dell'hardware AI, cruciale per le aziende che valutano deployment on-premise e la gestione della sovranità dei dati.

May 12 2026
Market

Disputa in Samsung: impatto sulla supply chain globale e le implicazioni per l'AI

Una disputa di lavoro in Samsung Electronics, gigante della tecnicia e fornitore chiave di componenti, sta generando incertezze nella supply chain globale. Questo scenario solleva interrogativi significativi per le aziende che pianificano o gestiscono deployment on-premise di Large Language Models, influenzando la disponibilità e i costi dell'hardware essenziale per l'infrastruttura AI.

May 12 2026
Market

Pillar raccoglie 12 milioni di euro per un OS basato sull'AI per l'edilizia

La startup italiana Pillar ha ottenuto un finanziamento seed di 12 milioni di euro, portando il capitale totale a 15,2 milioni in meno di otto mesi dal lancio pubblico. L'azienda sviluppa una piattaforma software basata sull'intelligenza artificiale per modernizzare le operazioni e la gestione finanziaria nel settore edile, automatizzando processi amministrativi e fornendo visibilità in tempo reale. Il nuovo capitale servirà a consolidare la posizione in Italia e a espandersi a livello internazionale.

May 12 2026
Market

Paymentology raccoglie 175 milioni di dollari per l'elaborazione dei pagamenti

Paymentology, un'azienda londinese specializzata nell'elaborazione globale di pagamenti per emittenti, ha annunciato un significativo round di finanziamento da 175 milioni di dollari. L'operazione è stata co-guidata da Apis Partners, attraverso il suo Apis Growth Fund III, e da Aspirity Partners, una società di private equity pan-europea con un focus sulla tecnicia finanziaria. Questo investimento sottolinea la continua fiducia del mercato nel potenziale di crescita e innovazione nel settore dei pagamenti digitali.

May 12 2026
Altro

White Circle raccoglie 11 milioni di dollari per il controllo dell'AI in produzione

White Circle ha chiuso un round Seed da 11 milioni di dollari per la sua piattaforma di monitoraggio, sicurezza e controllo dei modelli AI in produzione. Il supporto di figure chiave del settore e una base clienti che include grandi banche digitali evidenziano la crescente domanda di soluzioni per la gestione dell'intelligenza artificiale in ambienti enterprise.

May 12 2026
Market

Adfin raccoglie 18 milioni di dollari per la sua piattaforma finanziaria "agentic"

La fintech londinese Adfin ha chiuso un round di Serie A da 18 milioni di dollari, guidato da Index Ventures, portando il finanziamento totale oltre i 30 milioni. L'azienda sviluppa una piattaforma "agentic" per la gestione dei flussi di denaro, che ha già dimostrato di ridurre significativamente i ritardi nei pagamenti per le PMI. Il successo evidenzia la crescente fiducia nelle soluzioni AI-driven per il settore finanziario.

May 12 2026
Market

Happl ottiene 11 milioni di dollari per espandere la sua piattaforma AI-native di benefit

Happl, fornitore di soluzioni AI-native per la gestione dei benefit aziendali, ha raccolto 11 milioni di dollari in un round di Serie A. L'investimento, guidato da Portage Ventures, mira ad accelerare lo sviluppo e la scalabilità della piattaforma per le aziende multinazionali. L'architettura AI-native solleva considerazioni cruciali sulla sovranità dei dati, la compliance e il TCO per le decisioni di deployment on-premise o cloud.

May 12 2026
Altro

Nscale ottiene 790 milioni di dollari per il data center AI di Narvik

Nscale, azienda specializzata in infrastrutture AI, ha ottenuto un finanziamento di 790 milioni di dollari per proseguire la costruzione del suo data center dedicato all'intelligenza artificiale a Narvik, nel nord della Norvegia. L'operazione sottolinea l'importanza degli investimenti in infrastrutture fisiche per supportare carichi di lavoro AI, un aspetto cruciale per le aziende che valutano deployment on-premise e la sovranità dei dati.

May 12 2026
Altro

Ditto raccoglie 7,6 milioni di euro per l'espansione europea e l'AI nella sanità

La startup olandese Ditto ha ottenuto 7,6 milioni di euro in un round di finanziamento guidato da Heal Capital. I fondi supporteranno l'espansione europea e lo sviluppo della sua piattaforma di comunicazione per pazienti basata su AI. L'applicazione, che genera riassunti di consultazioni mediche e non archivia i dati centralmente, mira a migliorare la comprensione dei pazienti e alleggerire il carico amministrativo degli operatori sanitari.

May 12 2026
Market

Crescita dei server AI a Taiwan: un ecosistema in espansione

Il mercato dei server AI a Taiwan sta vivendo una fase di espansione significativa, con benefici che si estendono oltre il ruolo consolidato di TSMC. Questa diversificazione indica una maturazione della supply chain locale, offrendo nuove opportunità per le aziende che cercano soluzioni hardware robuste per carichi di lavoro di intelligenza artificiale, inclusi i deployment on-premise, e sollevando considerazioni cruciali su TCO e sovranità dei dati.

May 12 2026
Market

Regulate raccoglie 1,4 milioni di euro per il breathwork nelle aziende

Regulate, una piattaforma di breathwork per il benessere aziendale, ha concluso un round di finanziamento Seed da 1,4 milioni di euro. L'investimento, guidato da 4impact.vc e sostenuto da angel investor di spicco, mira a espandere l'offerta di sessioni scientificamente validate e personalizzate. La piattaforma, che integra dati da dispositivi indossabili e sistemi di gestione del lavoro, aiuta i professionisti a migliorare concentrazione e resilienza, rispondendo alle crescenti pressioni del mondo lavorativo moderno.

May 12 2026
Market

Tolemy Bio si assicura 1,4 milioni per l'AI nella biologia cellulare

La startup biotech Tolemy Bio ha raccolto 1,4 milioni di euro in un round di finanziamento pre-seed. L'obiettivo è avanzare nello sviluppo di Orbit, una piattaforma basata sull'intelligenza artificiale progettata per risolvere la frammentazione dei dati nella ricerca biologica e nello sviluppo biofarmaceutico. Il sistema mira a unificare i workflow sperimentali, integrando strumenti di laboratorio e modelli cellulari virtuali per ottimizzare la comprensione e l'applicazione delle cellule viventi.

May 12 2026
Market

Adfin raccoglie 18 milioni di dollari per espandere la sua piattaforma AI di gestione finanziaria

La fintech londinese Adfin ha chiuso un round di finanziamento Series A da 18 milioni di dollari, portando il capitale totale raccolto a oltre 30 milioni. L'investimento, guidato da Index Ventures, supporterà l'espansione della sua piattaforma basata su AI. Questa soluzione mira ad automatizzare la gestione dei pagamenti e del flusso di cassa per le aziende, migliorando l'efficienza operativa e la visibilità finanziaria, in particolare per le PMI che affrontano ritardi nei pagamenti.

May 12 2026
Hardware

VSO Electronics: la crescita passa dai cavi per l'infrastruttura AI e nuove linee produttive

VSO Electronics punta a una crescita significativa, trainata dalla crescente domanda di cavi specifici per l'infrastruttura AI. L'azienda prevede inoltre di attivare una nuova linea interna per il rilevamento delle perdite entro la fine del 2026, consolidando le proprie capacità produttive e di controllo qualità in un mercato in rapida evoluzione.

May 12 2026
Altro

Ottimizzare la velocità di elaborazione dei prompt per LLM on-premise: il ruolo del micro-batching

Una recente analisi su `llama.cpp` ha rivelato come l'aumento del micro-batch size (`ubatch`) possa migliorare drasticamente la velocità di prefill dei prompt per Large Language Models parzialmente offloadati su GPU consumer come la RTX 3090. Questo approccio, sebbene comporti un leggero calo nella generazione di token e un maggiore offloading su CPU, offre un notevole incremento del throughput, evidenziando trade-off cruciali per i deployment on-premise.

May 12 2026
LLM

Thinking Machines: un nuovo paradigma per l'interazione con gli LLM

Thinking Machines sta esplorando un approccio innovativo per i Large Language Models, mirando a superare l'attuale modalità sequenziale di interazione. L'obiettivo è sviluppare un modello capace di elaborare l'input dell'utente e generare una risposta simultaneamente, emulando la fluidità di una conversazione telefonica. Questa evoluzione potrebbe ridefinire le aspettative di latenza e reattività nei sistemi AI.

May 12 2026
LLM

Rilevare le Allucinazioni nei LLM: Un Nuovo Approccio al Ragionamento a Pipeline

Un nuovo studio esplora l'efficacia dei metodi di rilevamento delle allucinazioni nei Large Language Models (LLM), specialmente per il ragionamento a catena. La ricerca evidenzia come tali metodi possano essere ingannati da correlati superficiali, anziché valutare il ragionamento effettivo. Attraverso una metodologia di invarianza controllata, gli autori dimostrano che un rilevamento robusto non richiede necessariamente rappresentazioni complesse. Uno scorer leggero, TRACT, basato su caratteristiche lessicali, si rivela competitivo, suggerendo che la sfida principale sia isolare il segnale di ragionamento dai segnali di superficie.

May 12 2026
Altro

La domanda energetica dell'AI e la resilienza della rete: le priorità di Taipower

Il nuovo presidente di Taipower ha posto l'accento sulla crescente domanda di energia generata dall'intelligenza artificiale e sulla necessità di rafforzare la resilienza della rete elettrica. Questa focalizzazione evidenzia le sfide infrastrutturali che le utilities devono affrontare per supportare l'espansione dei carichi di lavoro AI, sia in contesti cloud che on-premise, sottolineando l'importanza di una fornitura energetica stabile e affidabile.

May 12 2026
Market

Tempi di Consegna dei Componenti: L'Impatto sulla Crescita di Viking AI

Viking AI registra un aumento del 12% nei ricavi, ma l'industria affronta sfide significative. I tempi di consegna per i resistori si sono estesi a 15 settimane, evidenziando le crescenti pressioni sulla catena di approvvigionamento di componenti elettronici. Questa situazione può influenzare la disponibilità di hardware essenziale per i deployment on-premise di soluzioni AI, un aspetto cruciale per le aziende che puntano alla sovranità dei dati e al controllo infrastrutturale.

May 12 2026
Market

Boom del Testing AI a Taiwan: KYEC, MPI e WinWay verso ricavi record nel 2026

Le aziende taiwanesi KYEC, MPI e WinWay si preparano a raggiungere ricavi record entro il 2026, spinte dalla crescente domanda nel settore del testing per l'intelligenza artificiale. Questo trend evidenzia l'importanza cruciale della validazione rigorosa per le infrastrutture AI, specialmente in contesti di deployment on-premise, dove la precisione e l'affidabilità sono fondamentali per le operazioni critiche.

May 12 2026
Altro

Kuaishou punta a 20 miliardi di dollari per Kling AI, spin-off per la generazione video

Kuaishou, gigante cinese della tecnicia, mira a una valutazione di 20 miliardi di dollari per Kling AI, il suo spin-off dedicato alla generazione di video. Questa mossa strategica evidenzia la crescente domanda di soluzioni AI per la creazione di contenuti visivi e solleva questioni cruciali sull'infrastruttura necessaria per gestire carichi di lavoro così intensivi, spingendo le aziende a valutare attentamente le opzioni di deployment on-premise rispetto al cloud per garantire sovranità dei dati e controllo sui costi operativi.

May 12 2026
Market

Soluzioni termiche per server AI: Taiwan guida la crescita fino al 2026

Il crescente fabbisogno di server AI ad alte prestazioni sta alimentando un boom per le aziende taiwanesi specializzate in soluzioni termiche. Entro il 2026, si prevede che aziende come AVC e Auras guideranno una significativa espansione del mercato, rispondendo alla domanda critica di raffreddamento efficiente per le infrastrutture AI, in particolare per i deployment on-premise che richiedono un controllo rigoroso su performance e TCO.

May 12 2026
LLM

SalesSim: Valutare e Allineare i Modelli Multimodali per la Simulazione Utente nel Retail

Un nuovo framework, SalesSim, è stato introdotto per valutare la capacità dei Large Language Models multimodali (MLLM) di simulare comportamenti realistici di clienti nel retail online. La ricerca ha rivelato lacune significative, come bassa diversità lessicale e scarsa aderenza alle specifiche di persona, con il modello migliore che raggiunge meno del 79% di allineamento. Per affrontare queste sfide, è stato proposto UserGRPO, un approccio di reinforcement learning che migliora l'allineamento delle decisioni e la qualità conversazionale.

May 12 2026
Frameworks

PathBoost: il Gradient Boosting basato su percorsi per l'analisi dei grafi

PathBoost è un nuovo metodo di gradient tree boosting per la classificazione e regressione a livello di grafo. Apprende caratteristiche basate su percorsi direttamente dalla struttura del grafo, estendendo lavori precedenti con adattamento alla classificazione binaria, gestione di attributi multipli e selezione automatica dei nodi di ancoraggio. I benchmark mostrano che PathBoost è competitivo con le reti neurali grafiche e gli approcci kernel, specialmente su grafi con un numero elevato di nodi, offrendo un'alternativa ai modelli black-box più complessi.

May 12 2026
Frameworks

RL-Kirigami: L'IA accelera la progettazione di metamateriali kirigami

Un nuovo framework, RL-Kirigami, combina Optimal-Transport Conditional Flow Matching e Reinforcement Learning per la progettazione inversa di metamateriali kirigami. Il sistema riduce drasticamente le valutazioni del simulatore e migliora la precisione, consentendo la prototipazione rapida di componenti fisici in pochi minuti. Questo approccio promette di trasformare i workflow di design e produzione, con implicazioni significative per l'efficienza e la sovranità dei dati in contesti industriali.

May 12 2026
Frameworks

Auto-Rubric as Reward: Criteri Espliciti per Allineare i Modelli Generativi Multimodali

Un nuovo framework, Auto-Rubric as Reward (ARR), mira a migliorare l'allineamento dei modelli generativi multimodali con le preferenze umane. Superando i limiti degli approcci RLHF tradizionali che usano etichette implicite, ARR introduce una decomposizione basata su criteri espliciti. Questo metodo estrapola la conoscenza interna dei VLM in rubriche specifiche, riducendo i bias di valutazione e migliorando l'efficienza dei dati. In combinazione con Rubric Policy Optimization (RPO), ARR-RPO ha dimostrato prestazioni superiori nei benchmark di generazione testo-immagine e di editing di immagini.

May 12 2026
LLM

Contesto Spaziale Supera il Priming Semantico per l'Estrazione Dati da Grafici con LLM

Una nuova ricerca esplora strategie per migliorare l'accuratezza degli LLM multimodali nell'estrazione di dati da grafici scientifici non standardizzati. Lo studio rivela che l'applicazione di un contesto spaziale esplicito, tramite una griglia di coordinate, riduce significativamente gli errori rispetto a metodi di priming semantico. Questa tecnica offre un approccio più affidabile per l'attuale generazione di modelli, con una riduzione del SMAPE dal 25,5% al 19,5%.

May 12 2026
Altro

Dinamiche di Mercato e Adozione Tecnologica: Lezioni per l'Framework AI

L'accelerata penetrazione dei veicoli a nuova energia in Cina, spinta dai prezzi del petrolio, offre uno spunto di riflessione sulle dinamiche che guidano l'adozione di nuove tecnicie. Questo scenario evidenzia come fattori economici e strategici influenzino le scelte infrastrutturali, un parallelo rilevante per il deployment di Large Language Models (LLM) on-premise, dove TCO e sovranità dei dati sono cruciali.

May 12 2026
Market

La domanda di server AI spinge i ricavi record di WPG Holdings e WT Microelectronics

WPG Holdings e WT Microelectronics hanno registrato ricavi record ad aprile, trainati dalla forte domanda di server dedicati all'intelligenza artificiale. Questo trend evidenzia la crescente adozione di soluzioni AI, con implicazioni significative per le strategie di deployment on-premise e la catena di fornitura hardware, sottolineando l'importanza di infrastrutture robuste per i carichi di lavoro LLM.

May 12 2026
Altro

Lezioni dall'Estremo Oriente: Le Sfide Nascoste dell'Framework per i Deployment Critici

I recenti rallentamenti nello sviluppo delle infrastrutture di ricarica per veicoli elettrici a Taiwan, dovuti a problemi di rete e condizioni del suolo, offrono uno spaccato delle complesse sfide che attendono qualsiasi deployment tecnicico critico. Questa situazione evidenzia l'importanza di una pianificazione meticolosa e della valutazione dei siti, aspetti cruciali anche per le architetture on-premise dedicate ai Large Language Models, dove la resilienza e il TCO dipendono da fondamenta solide.

May 12 2026
Hardware

AcBel Polytech, OmniOn e Kinpo Group uniscono le forze per l'alimentazione AI

AcBel Polytech, OmniOn e Kinpo Group hanno stretto una collaborazione strategica per sviluppare soluzioni di alimentazione dedicate al crescente mercato dell'intelligenza artificiale. L'iniziativa mira a rispondere alla domanda di infrastrutture robuste ed efficienti, essenziali per i carichi di lavoro intensivi di LLM e per i deployment on-premise, dove l'efficienza energetica e la gestione termica sono fattori critici per il TCO.

May 12 2026
Market

OpenAI: un fondo da 4 miliardi per spingere l'AI nelle imprese

OpenAI ha lanciato una nuova iniziativa di deployment da 4 miliardi di dollari, mirata ad accelerare l'adozione dell'intelligenza artificiale all'interno delle aziende. L'investimento sottolinea l'impegno a facilitare l'integrazione dei Large Language Models (LLM) nei contesti aziendali, affrontando le complessità legate alla scalabilità, alla sovranità dei dati e ai requisiti infrastrutturali che le imprese devono gestire nell'implementazione di soluzioni AI.

May 12 2026
Altro

Nvidia e Corning rafforzano la partnership: la fibra ottica al centro dell'AI

Nvidia sta intensificando la sua collaborazione con Corning, puntando sulla fibra ottica per le infrastrutture AI. Questa transizione dal rame al silicio ottico è cruciale per supportare le crescenti esigenze di larghezza di banda e latenza dei Large Language Models (LLM) e delle applicazioni di intelligenza artificiale, influenzando anche il mercato cinese dell'ottica. La mossa sottolinea l'importanza di connessioni ad alte prestazioni per i deployment on-premise.

May 12 2026
Market

La strategia modulare di Nvidia accelera la filiera AI: il caso Delta Electronics

L'approccio modulare di Nvidia allo sviluppo di soluzioni hardware per l'intelligenza artificiale sta generando un significativo impulso per i suoi fornitori. Delta Electronics, in particolare, sta beneficiando di questa strategia, evidenziando come la domanda di componenti specifici per l'AI stia rimodellando la catena di approvvigionamento. Questo trend ha implicazioni dirette per le aziende che pianificano infrastrutture on-premise per carichi di lavoro LLM.

May 12 2026
Hardware

Raffreddamento custom per DGX: un approccio on-premise per LLM ad alte prestazioni

Un utente ha dimostrato un metodo di raffreddamento a circuito aperto con acqua di rubinetto per un sistema DGX, mantenendo le GPU sotto i 68°C con un utilizzo del 95%. La configurazione gestisce un LLM Qwen3.5-122b-a10B con precisione Q6_K, utilizzando 110 GB di memoria e una finestra di contesto di 80k, raggiungendo 18.77 token/secondo per analisi di visione continue. Questo evidenzia le sfide e le soluzioni creative per i deployment AI on-premise.

May 12 2026
Market

Cresce la domanda di CPU Arm per AGI, l'offerta è a rischio

La richiesta di CPU Arm destinate a carichi di lavoro di intelligenza artificiale generale (AGI) sta subendo un'impennata, sollevando preoccupazioni riguardo a potenziali vincoli nella catena di fornitura. Questa situazione evidenzia le sfide infrastrutturali che le aziende devono affrontare nel pianificare deployment AI on-premise, dove la disponibilità hardware e il TCO sono fattori critici per la sovranità dei dati e il controllo operativo.

May 12 2026
Market

Compeq si afferma come fornitore chiave nel boom di AI e satelliti a bassa orbita

Compeq si posiziona come attore fondamentale nella catena di fornitura per i settori in rapida espansione dell'intelligenza artificiale e dei satelliti a bassa orbita. L'azienda beneficia della crescente domanda di componenti avanzati, essenziali per supportare l'infrastruttura hardware necessaria allo sviluppo e al deployment di Large Language Models e altre applicazioni AI, in particolare per le soluzioni self-hosted.

May 12 2026
Market

Infineon vince la disputa sui brevetti GaN negli Stati Uniti contro Innoscience

Infineon Technologies ha ottenuto una vittoria legale negli Stati Uniti, con un tribunale che ha riconosciuto la validità dei suoi brevetti sulla tecnicia del nitruro di gallio (GaN) contro il concorrente cinese Innoscience. Questa sentenza rafforza la posizione di Infineon nel mercato dei semiconduttori di potenza, evidenziando l'importanza della proprietà intellettuale in un settore strategico per l'efficienza energetica delle infrastrutture IT, inclusi i deployment on-premise.

May 12 2026
Market

Dinamiche nel panorama LLM: il segnale di Anthropic dopo il passo di xAI

L'uscita di xAI dal panorama competitivo, evidenziando la forza di Anthropic, sottolinea le continue evoluzioni nel mercato dei Large Language Models. Questo scenario impone alle aziende una riflessione strategica sulle scelte di deployment, bilanciando innovazione, sovranità dei dati e costi totali di proprietà per le proprie infrastrutture AI.

May 12 2026
Market

Taiwan e l'AI per l'auto: oltre i componenti, verso i sistemi autonomi

Taiwan sta ridefinendo il suo ruolo nell'industria automobilistica, spostando il focus dalla produzione di componenti alla progettazione e integrazione di sistemi autonomi avanzati. Questa evoluzione strategica sottolinea la crescente importanza dell'intelligenza artificiale e delle soluzioni di deployment locali, come l'edge computing, per gestire le complesse esigenze di elaborazione e sovranità dei dati nei veicoli di nuova generazione.

May 12 2026
Market

L'Asia Sud-Orientale si posiziona come hub strategico per i semiconduttori AI

L'industria dei semiconduttori nel Sud-Est asiatico sta ridefinendo la propria strategia, orientandosi sempre più verso la produzione di componenti cruciali per l'intelligenza artificiale. Questa transizione posiziona la regione come un hub strategico fondamentale, con implicazioni significative per la catena di fornitura globale e per le strategie di deployment di LLM on-premise, influenzando la disponibilità e il TCO dell'hardware.

May 12 2026
Hardware

Driver Open Source Radeon R300-R500: Ristrutturazione del Codice in Arrivo nel 2026

Il driver open source "R300g" per le GPU ATI (AMD) Radeon delle serie R300 e R500, risalenti a oltre due decenni fa, riceverà una significativa ristrutturazione del codice nel 2026. Questo sforzo, guidato da un singolo sviluppatore della comunità, sottolinea la longevità e la dedizione dei progetti open source, garantendo supporto e miglioramenti anche per hardware considerato obsoleto.

May 12 2026
Market

Robinhood prepara un secondo fondo di venture capital, tra rally AI e nuove startup

Robinhood ha avviato in via confidenziale la creazione del suo secondo fondo di venture capital. L'iniziativa si inserisce nel contesto dell'attuale rally dell'intelligenza artificiale e mira a sostenere sia startup in fase iniziale che aziende già in crescita. Questo movimento strategico riflette l'interesse crescente per l'innovazione tecnicica e la diversificazione degli investimenti nel settore tech.

May 12 2026
LLM

Nemotron-3 Super 64B: 500.000 token di contesto su 48 GB VRAM per il coding

Un'implementazione del modello Nemotron-3 Super 64B, ottimizzata per il formato GGUF, dimostra la capacità di gestire una finestra di contesto di 500.000 token con soli 48 GB di VRAM, raggiungendo 21 token/secondo per compiti di coding. Questa scoperta evidenzia il potenziale degli LLM per il deployment on-premise, offrendo controllo sui dati e efficienza per carichi di lavoro specializzati, anche su hardware prosumer come una doppia TITAN RTX.

← Precedente Page 63 / 160 Successiva →