🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15965

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Apr 10 2026
Market

Restrizioni USA sulla Cina: i test di laboratorio si spostano a Taiwan

Le recenti decisioni del governo statunitense di ampliare le restrizioni sui laboratori in Cina stanno innescando un significativo riassetto nelle strategie di testing e sviluppo tecnicico. Questo spostamento strategico vede Taiwan emergere come destinazione preferenziale per tali operazioni, con implicazioni dirette per la supply chain globale e per le strategie di deployment tecnicico, in particolare per settori che richiedono elevata sicurezza e sovranità dei dati.

Apr 10 2026
Market

Maeconomy ottiene 1,5 milioni di euro per la tracciabilità dei materiali edili

La startup olandese Maeconomy ha raccolto 1,5 milioni di euro per sviluppare una piattaforma. L'obiettivo è conferire un'identità digitale ai materiali da costruzione, risolvendo la loro scarsa tracciabilità. Questo permetterà di trasformarli in asset circolari, verificabili e monetizzabili, facilitandone il riutilizzo in caso di demolizione o ristrutturazione di edifici, promuovendo un'economia più sostenibile nel settore.

Apr 10 2026
Market

Serve First: 5,7 milioni di euro per l'espansione europea della piattaforma AI di CX

Serve First, startup britannica di Milton Keynes, ha ottenuto un finanziamento di 5,7 milioni di euro. L'azienda, che ha triplicato il proprio fatturato ricorrente annuale, intende utilizzare i fondi per assumere un Chief Revenue Officer, accelerare lo sviluppo del prodotto e scalare la sua piattaforma di customer experience basata sull'AI oltre i confini del Regno Unito, puntando all'espansione europea.

Apr 10 2026
Hardware

Gli occhiali AR Micro LED di PlayNitride: nuove frontiere per industria e droni

PlayNitride sta guadagnando terreno con i suoi occhiali smart AR basati su tecnicia Micro LED, che trovano applicazione crescente nel controllo industriale e nelle operazioni con droni. Questi dispositivi offrono nuove possibilità per l'interazione uomo-macchina e la visualizzazione di dati in tempo reale, spingendo verso soluzioni di elaborazione edge per garantire bassa latenza e sovranità dei dati, aspetti cruciali per i deployment critici.

Apr 10 2026
Market

Oracle accelera gli investimenti in infrastrutture AI per soddisfare la domanda

Oracle sta potenziando significativamente i suoi investimenti nelle infrastrutture dedicate all'intelligenza artificiale. Questa mossa strategica mira a rafforzare la capacità della sua supply chain, permettendole di rispondere all'impennata degli ordini da parte dei clienti. L'espansione riflette la crescente domanda di risorse computazionali per carichi di lavoro AI, sottolineando l'importanza di infrastrutture robuste e scalabili nel panorama tecnicico attuale.

Apr 10 2026
Altro

Matei Zaharia (Databricks, Spark) vince il Premio ACM per l'infrastruttura AI

Matei Zaharia, co-fondatore di Databricks e creatore di Apache Spark, ha ricevuto il prestigioso Premio ACM in Computing 2026. Il riconoscimento, del valore di 250.000 dollari, celebra i suoi contributi fondamentali allo sviluppo di sistemi di dati distribuiti e infrastrutture AI, pilastri essenziali per il deployment di Large Language Models e carichi di lavoro complessi.

Apr 10 2026
Market

L'onda di investimenti degli OSAT cinesi nel packaging avanzato per l'AI

Le aziende cinesi di assemblaggio e test di semiconduttori (OSAT) stanno intensificando gli investimenti nel packaging avanzato. Questa mossa strategica è una risposta diretta alla crescente domanda di hardware per l'intelligenza artificiale, evidenziando una corsa tecnicica cruciale per il futuro dei chip AI. Le innovazioni in questo campo sono fondamentali per migliorare le prestazioni e l'efficienza dei sistemi AI, con impatti significativi sulla catena di fornitura globale e sui deployment on-premise.

Apr 10 2026
Altro

LocalLLama: Lo Stato dell'Arte dei Large Language Models On-Premise

Il movimento LocalLLama sta ridefinendo il panorama dei Large Language Models, spostando il focus dal cloud ai deployment on-premise. Questa tendenza risponde all'esigenza di maggiore controllo sui dati, sovranità e ottimizzazione dei costi, pur presentando sfide tecniche legate all'hardware e all'ottimizzazione dei modelli per l'inference locale.

Apr 10 2026
Altro

Sviluppare LLM Personalizzati On-Premise: Un Caso Studio con Gemma 4 per l'Apprendimento Linguistico

Un utente della community r/LocalLLaMA ha presentato un'applicazione personalizzata per l'apprendimento linguistico, basata sul modello gemma-4-E4B-it. Il progetto, che integra sintesi vocale omnivoice tts e un'interfaccia 3D, evidenzia le potenzialità del deployment di Large Language Models in ambienti self-hosted, offrendo controllo completo su dati e funzionalità. Questo approccio risponde alle esigenze di sovranità dei dati e personalizzazione, tipiche degli scenari on-premise.

Apr 10 2026
LLM

Aggiornamenti per Gemma 4: Miglioramenti in Tool Calling e Dialog Compliance

Un recente aggiornamento per il modello Gemma 4 di Google mira a ottimizzare le funzionalità di "tool calling" e la "dialog compliance". Questo intervento, che richiede l'aggiornamento dei template Jinja, promette di migliorare l'affidabilità e la coerenza delle interazioni con il modello, un aspetto cruciale per gli sviluppatori che implementano LLM in ambienti controllati e on-premise.

Apr 10 2026
Altro

Taiwan e USA: un hub robotico in Georgia per l'AI on-premise

Taiwan sta espandendo la sua impronta tecnicica negli Stati Uniti con la creazione di un hub robotico in Georgia. Questa iniziativa mira a rafforzare i legami tecnicici oltre il settore dei semiconduttori, puntando su soluzioni AI che spesso richiedono infrastrutture on-premise per esigenze di latenza, sovranità dei dati e controllo operativo. L'investimento sottolinea una strategia di diversificazione e un focus sulle applicazioni AI critiche.

Apr 10 2026
Hardware

MetaOptics e Pinjie: una partnership per l'hub globale di produzione di metalenti

MetaOptics e l'azienda taiwanese Pinjie hanno stretto una collaborazione strategica per realizzare un centro di produzione globale dedicato alle metalenti. Questa iniziativa mira a consolidare la capacità produttiva di componenti ottici avanzati, fondamentali per l'evoluzione di diverse tecnicie, inclusi i sistemi di visione per l'intelligenza artificiale e l'edge computing.

Apr 10 2026
Market

SpaceX e i ritardi nei semiconduttori: implicazioni per l'AI on-premise

Un recente report evidenzia ritardi nella produzione di componenti chiave per SpaceX, legati a FOPLP e alla resa dei PCB. Questo evento specifico illumina le fragilità della catena di fornitura globale dei semiconduttori, con potenziali ripercussioni significative per le aziende che pianificano deployment on-premise di Large Language Models. La disponibilità e il costo dell'hardware specializzato, come le GPU ad alta VRAM, diventano fattori critici per il TCO e la sovranità dei dati.

Apr 10 2026
Altro

Spingence e Advantech accelerano l'AI edge nel manifatturiero coreano

Spingence e Advantech hanno stretto una collaborazione per potenziare l'adozione dell'AI edge nel settore manifatturiero della Corea del Sud. L'iniziativa mira a ottimizzare i processi produttivi e a migliorare l'efficienza operativa attraverso soluzioni di intelligenza artificiale distribuite direttamente sui siti di produzione. Questo approccio risponde all'esigenza di elaborazione dati in tempo reale e di sovranità dei dati, fattori cruciali per l'industria moderna.

Apr 10 2026
Hardware

MetaOptics punta su Taiwan per scalare la produzione di metalens per l'AI

MetaOptics ha scelto Taiwan come hub strategico per espandere la produzione di metalens, componenti ottici di nuova generazione. Questa mossa mira a supportare lo sviluppo di soluzioni avanzate per l'intelligenza artificiale e l'ottica del futuro, sfruttando l'ecosistema manifatturiero dell'isola per accelerare l'adozione di queste tecnicie innovative e compatte in diversi settori.

Apr 10 2026
LLM

Architettura Ibrida CNN-Transformer per il Riconoscimento delle Emozioni nel Parlato Arabo

Un nuovo studio presenta un'architettura ibrida CNN-Transformer per il riconoscimento delle emozioni nel parlato arabo, un'area con dataset limitati. Il modello combina strati convoluzionali per le caratteristiche spettrali e encoder Transformer per le dipendenze temporali, raggiungendo un'accuratezza del 97,8% sul corpus EYASE e dimostrando il potenziale di tali approcci per le lingue con risorse scarse.

Apr 10 2026
LLM

Contextual Earnings-22: Un Nuovo Benchmark per il Riconoscimento Vocale Contestuale

Un nuovo studio introduce Contextual Earnings-22, un dataset open source progettato per superare i limiti degli attuali benchmark di riconoscimento vocale. L'obiettivo è migliorare l'accuratezza dei sistemi speech-to-text (STT) in contesti industriali, dove il vocabolario personalizzato e raro è cruciale. I test con approcci di keyword prompting e boosting hanno dimostrato un significativo miglioramento delle prestazioni su larga scala, evidenziando il potenziale per applicazioni enterprise che richiedono elevata precisione e gestione di terminologie specifiche.

Apr 10 2026
Altro

LLM e LDM per la sicurezza dei sistemi autonomi su Edge: un nuovo framework di test

Un nuovo framework propone l'uso di LLM e Latent Diffusion Models per generare scenari di errore e degradazioni dei sensori, migliorando la validazione dei sistemi di visione autonomi su dispositivi edge. Questa architettura disaccoppiata, con una fase offline intensiva e una online leggera, permette ai dispositivi edge di eseguire inference consapevole degli errori in tempo reale. I test su un modello di guida autonoma hanno rivelato significative carenze di robustezza, evidenziando l'insufficienza dei metodi di valutazione tradizionali per i deployment reali.

Apr 10 2026
LLM

Prediction Arena: Il benchmark per i modelli AI nei mercati predittivi

Prediction Arena introduce un nuovo benchmark per valutare l'accuratezza predittiva e la capacità decisionale dei modelli AI. Operando autonomamente su mercati di previsione reali con capitale effettivo, il sistema offre una "ground truth" oggettiva. I risultati preliminari evidenziano differenze significative nelle performance tra piattaforme diverse, con alcuni modelli che mostrano ritorni positivi e altri perdite consistenti, sottolineando l'impatto cruciale del design della piattaforma sul successo dei modelli.

Apr 10 2026
Hardware

CoWoS: la capacità di packaging avanzato di TSMC limita l'espansione AI

La tecnicia di packaging avanzato CoWoS di TSMC si sta affermando come un fattore critico per l'espansione dell'intelligenza artificiale. Nonostante una crescita impressionante dell'80% nel Compound Annual Growth Rate (CAGR) per il packaging avanzato, la capacità produttiva di CoWoS fatica a tenere il passo con la domanda esplosiva di chip AI, creando un potenziale collo di bottiglia per l'industria.

Apr 10 2026
Altro

Blaize e Nokia: un'alleanza strategica per l'AI ibrida in Asia-Pacifico

Blaize e Nokia hanno rafforzato la loro partnership per validare soluzioni di infrastruttura AI ibrida nella regione Asia-Pacifico. L'iniziativa mira a supportare le aziende che cercano un equilibrio tra controllo dei dati on-premise e flessibilità del cloud, affrontando le esigenze di sovranità, latenza e TCO per i carichi di lavoro AI. Questo approccio ibrido è cruciale per l'adozione enterprise dell'intelligenza artificiale.

Apr 10 2026
Altro

Intel e Google: un'alleanza per l'infrastruttura AI basata su CPU

Intel e Google hanno stretto un'alleanza strategica per ridefinire l'infrastruttura AI, spostando l'attenzione verso le CPU. Questa mossa suggerisce un potenziale cambiamento nel panorama dei deployment AI, offrendo nuove prospettive per le aziende che cercano alternative alle soluzioni GPU-centriche, in particolare per carichi di lavoro specifici e contesti on-premise, dove il controllo e la sovranità dei dati sono prioritari.

Apr 10 2026
Market

La crescente domanda di infrastrutture AI estende le carenze di componenti oltre le memorie

L'esplosione della domanda per l'intelligenza artificiale, in particolare per i Large Language Models, sta mettendo sotto pressione la catena di approvvigionamento globale. Le carenze, inizialmente concentrate sui chip di memoria, si stanno ora diffondendo ai condensatori ceramici multistrato (MLCC), componenti essenziali per l'hardware AI, con potenziali ripercussioni sui costi e sulla disponibilità delle infrastrutture.

Apr 10 2026
Market

Meta e CoreWeave: l'accelerazione della spesa in infrastrutture AI

Meta ha rafforzato la sua partnership con CoreWeave, un segnale della crescente domanda di infrastrutture specializzate per l'intelligenza artificiale. Questa mossa evidenzia l'accelerazione della spesa nel settore, spinta dalle elevate esigenze di calcolo degli LLM e dalla necessità di ingenti investimenti di capitale per sostenere lo sviluppo e il deployment di soluzioni AI avanzate.

Apr 10 2026
Hardware

Anthropic valuta la progettazione di chip proprietari per l'AI

Anthropic, azienda leader nel campo dell'intelligenza artificiale, starebbe esplorando la possibilità di progettare chip proprietari. Questa mossa strategica si inserisce in un contesto di rapida crescita dei ricavi e di un'evoluzione costante dello stack di calcolo per l'AI. La decisione riflette la crescente necessità di ottimizzare l'hardware per i carichi di lavoro specifici dei Large Language Models.

Apr 10 2026
Market

Hyundai e la corsa ai talenti AI: Taiwan a rischio nella robotica umanoide

Hyundai sta intensificando la ricerca di talenti specializzati in intelligenza artificiale negli Stati Uniti, puntando a poli di eccellenza nel sud del paese. Parallelamente, emerge una preoccupazione per Taiwan, che potrebbe trovarsi in ritardo nello sviluppo della robotica umanoide. Questi scenari evidenziano la crescente competizione globale per le competenze e le innovazioni nel settore AI e robotico, settori cruciali per l'evoluzione tecnicica e industriale.

Apr 10 2026
Altro

OpenAI supporta legge che limita la responsabilità per danni critici da IA

OpenAI, l'azienda dietro ChatGPT, ha espresso il proprio sostegno a una proposta di legge in Illinois che mira a limitare la responsabilità dei laboratori di intelligenza artificiale. La normativa ridurrebbe l'onere legale per i produttori di IA, anche in scenari in cui i loro prodotti causano "danni critici", sollevando interrogativi sulle implicazioni per la gestione del rischio e il deployment di sistemi AI.

Apr 10 2026
Altro

Swancor: Robotica AI e Compositi Aerospaziali per una Crescita a Doppio Motore

Swancor sta puntando su due settori strategici per la sua espansione futura: la robotica basata sull'intelligenza artificiale e i materiali compositi avanzati per l'industria aerospaziale. Questa strategia mira a diversificare le fonti di ricavo e a capitalizzare sulle crescenti opportunità offerte da questi mercati ad alta innovazione. L'approccio riflette una tendenza più ampia nel settore manifatturiero verso l'adozione di tecnicie AI per ottimizzare processi e prodotti.

Apr 10 2026
Altro

Auden di Taiwan: Algoritmi integrati nelle antenne satellitari per l'Edge Computing globale

Auden, un'azienda taiwanese, sta integrando algoritmi direttamente nelle sue antenne satellitari. Questa mossa strategica mira a potenziare le capacità di elaborazione all'edge, offrendo soluzioni avanzate per i mercati globali. L'approccio promette di migliorare l'efficienza, la sicurezza e la sovranità dei dati, aspetti cruciali per le infrastrutture AI distribuite e i deployment on-premise, riducendo la dipendenza dalla connettività cloud per l'elaborazione critica.

Apr 10 2026
LLM

Qwen di Alibaba primeggia in un benchmark AI coreano

Il modello Qwen di Alibaba ha ottenuto un risultato di spicco in un recente benchmark sull'intelligenza artificiale condotto in Corea. Questo successo evidenzia la crescente competitività nel panorama degli LLM e sottolinea l'importanza delle valutazioni comparative per le aziende che considerano deployment on-premise, dove efficienza e performance sono cruciali per la sovranità dei dati e il TCO.

Apr 10 2026
Market

Inventec: ricavi record a marzo e nel primo trimestre 2026 spinti dai server AI

Inventec ha annunciato ricavi record per marzo e il primo trimestre del 2026. Questo risultato eccezionale è stato trainato dalla forte domanda di server dedicati all'intelligenza artificiale. La performance sottolinea la crescente importanza dell'hardware specializzato per i carichi di lavoro AI, un fattore cruciale per le aziende che valutano deployment on-premise e la gestione della propria infrastruttura, bilanciando TCO, sovranità dei dati e performance.

Apr 10 2026
Market

Taiwan e Polonia: Strategie per la Pipeline di Fornitura di Droni nell'Est Europa

Taiwan mira a rafforzare la catena di fornitura di droni in Polonia, rispondendo a una crescente domanda nell'Europa orientale. L'iniziativa sottolinea l'importanza strategica delle tecnicie autonome e la necessità di resilienza nelle supply chain globali, con implicazioni per la sovranità tecnicica e la sicurezza regionale, un tema rilevante anche per le decisioni di deployment AI on-premise.

Apr 10 2026
LLM

Alibaba lancia Marco-Mini e Marco-Nano: LLM MoE ad alta sparsità per l'efficienza

Alibaba International Digital Commerce ha rilasciato Marco-Mini e Marco-Nano, due nuovi Large Language Models basati su architettura Mixture-of-Experts (MoE). Questi modelli si distinguono per l'elevata sparsità, attivando solo una frazione dei loro parametri totali per token, promettendo efficienza computazionale e prestazioni competitive su benchmark multilingue. La loro architettura li rende particolarmente interessanti per scenari di deployment on-premise, riducendo i requisiti hardware e il TCO.

Apr 09 2026
Market

CyberAgent accelera l'adozione dell'AI con ChatGPT Enterprise e Codex

CyberAgent ha integrato ChatGPT Enterprise e Codex per potenziare l'adozione dell'intelligenza artificiale, migliorare la qualità dei processi e velocizzare le decisioni strategiche. L'iniziativa copre i settori della pubblicità, dei media e del gaming, evidenziando come le grandi aziende stiano cercando soluzioni scalabili e sicure per sfruttare il potenziale degli LLM.

Apr 09 2026
Altro

LLM on-premise: un anno di progressi che ridefinisce le aspettative

Un anno fa, l'idea di confrontare LLM locali con soluzioni cloud come OpenAI sembrava audace. Oggi, grazie a progressi rapidi, modelli come Gemma 4 31b dimostrano la crescente maturità delle implementazioni on-premise. Questo cambiamento ridefinisce le aspettative per CTO e architetti infrastrutturali che valutano sovranità dei dati e TCO, evidenziando la vitalità della community di sviluppo locale.

Apr 09 2026
LLM

CyberAgent: l'AI in azienda con ChatGPT Enterprise e Codex per decisioni più rapide

CyberAgent, azienda leader nei settori pubblicitario, media e gaming, ha integrato ChatGPT Enterprise e Codex per accelerare l'adozione dell'intelligenza artificiale. L'obiettivo è migliorare la qualità dei processi e velocizzare le decisioni operative, garantendo al contempo un'espansione sicura delle capacità AI all'interno dell'organizzazione.

Apr 09 2026
Market

OpenAI introduce un piano Pro da 100 dollari al mese per ChatGPT

OpenAI ha annunciato un nuovo piano di abbonamento per ChatGPT, al costo di 100 dollari al mese. Questa opzione si posiziona tra le precedenti fasce da 20 e 200 dollari, rispondendo alle esigenze degli utenti professionali che richiedono un accesso più intensivo al servizio. La mossa mira a bilanciare costi e funzionalità per diverse tipologie di utilizzo, influenzando le valutazioni TCO per le aziende.

Apr 09 2026
LLM

Anthropic e Claude Mythos: tra capacità estreme e dilemmi etici

Anthropic ha presentato Claude Mythos, il suo LLM più avanzato, ma ne ha limitato il rilascio a pochi partner per la sua eccezionale capacità di individuare vulnerabilità di cybersecurity. Il documento di accompagnamento, una "system card" di 244 pagine, rivela anche le crescenti preoccupazioni dell'azienda riguardo alla possibilità che i modelli AI più potenti possano sviluppare forme di esperienza e interessi intrinseci, sollevando interrogativi etici sul loro futuro.

Apr 09 2026
Market

Meta rafforza la partnership con CoreWeave: 21 miliardi per l'infrastruttura AI

Meta ha annunciato un ulteriore investimento di 21 miliardi di dollari in CoreWeave per capacità cloud dedicate all'AI, estendendo l'accordo fino a dicembre 2032. Questo porta il valore complessivo della collaborazione infrastrutturale a circa 35 miliardi di dollari. L'intesa prevede il rilascio anticipato della piattaforma Nvidia Vera Rubin su più siti, evidenziando la crescente domanda di risorse computazionali specializzate per i Large Language Models e altre applicazioni di intelligenza artificiale.

Apr 09 2026
Hardware

Intel, un nuovo driver Linux per NPU Core Ultra: gestione avanzata di potenza e termica

Un nuovo driver per l'acceleratore Intel IVPU su Linux introduce la possibilità di limitare la frequenza di clock delle NPU integrate nei SoC Core Ultra. Questa funzionalità è cruciale per ottimizzare la gestione energetica e termica dei sistemi, offrendo ai professionisti IT un controllo più granulare sulle prestazioni e sul consumo. L'aggiornamento mira a migliorare l'efficienza operativa e la stabilità dei dispositivi che eseguono carichi di lavoro AI in ambienti edge e on-premise.

Apr 09 2026
Altro

OpenAI sospende il progetto Stargate UK: costi energetici e copyright frenano l'espansione

OpenAI ha interrotto il suo ambizioso progetto di data center "Stargate UK", che prevedeva il deployment di migliaia di GPU in Inghilterra. La decisione è motivata dagli elevati costi dell'elettricità industriale e da un framework normativo incerto sul copyright dell'IA nel Regno Unito, evidenziando le sfide infrastrutturali e legali per i grandi deployment di Large Language Models.

Apr 09 2026
LLM

Opus e la sfida dei 5 trilioni di parametri: implicazioni per il deployment locale

La comunità tech specula su un potenziale LLM "Opus" da 5 trilioni di parametri, ipotizzando un'architettura modulare. Questa discussione, emersa in contesti dedicati ai deployment locali, evidenzia le crescenti sfide infrastrutturali. Modelli di tale scala richiederebbero risorse hardware estreme, influenzando direttamente il TCO e le strategie di adozione on-premise per le aziende che puntano a controllo e sovranità dei dati.

Apr 09 2026
LLM

L'Attorney General della Florida indaga su OpenAI per presunto uso di ChatGPT in un attacco

L'Attorney General della Florida ha avviato un'indagine formale su OpenAI. Al centro dell'attenzione c'è il presunto ruolo di ChatGPT nella pianificazione di un attacco avvenuto lo scorso aprile alla Florida State University, che ha causato due vittime e cinque feriti. La famiglia di una delle vittime ha già annunciato l'intenzione di citare in giudizio l'azienda, sollevando questioni cruciali sulla responsabilità delle piattaforme AI.

Apr 09 2026
Hardware

Le GPU Intel Arc e la maturità dei driver: un segnale per i carichi AI?

La capacità delle GPU Intel Arc di eseguire il titolo "Crimson Desert", seppur senza supporto ufficiale, riaccende il dibattito sulla maturità dei driver e l'ottimizzazione software. Questo scenario offre spunti cruciali per le aziende che valutano deployment on-premise di Large Language Models, dove la stabilità dell'ecosistema software è tanto vitale quanto le pure specifiche hardware per garantire performance e TCO ottimali.

Apr 09 2026
Altro

Anthropic spinge sull'automazione AI con i Managed Agents cloud-hosted

Anthropic ha presentato Managed Agents, un nuovo servizio che permette alle aziende di creare e rilasciare automazioni basate su agenti AI per il knowledge work. Interamente ospitato nel cloud, il servizio offre alle organizzazioni una soluzione per gestire carichi di lavoro continui, eliminando la necessità di infrastrutture locali. Questo approccio mira a semplificare il deployment di agenti AI per l'automazione aziendale, ponendosi come alternativa alle soluzioni self-hosted.

Apr 09 2026
Altro

LLM in Locale: Le Prime Sfide per l'Adozione On-Premise

L'interesse per i Large Language Models (LLM) in locale è in crescita, spinto da esigenze di sovranità dei dati e controllo sui costi. Tuttavia, l'implementazione on-premise presenta una curva di apprendimento significativa, specialmente per chi si avvicina per la prima volta a queste tecnicie. Comprendere le sfide iniziali è cruciale per una strategia di deployment efficace e per massimizzare il ritorno sull'investimento.

Apr 09 2026
Altro

Google Cloud e Intel: partnership estesa per l'infrastruttura AI con Xeon e chip custom

Google Cloud e Intel hanno annunciato un'estensione pluriennale della loro partnership per l'infrastruttura AI. L'accordo prevede l'adozione continua dei processori Intel Xeon 6 per le istanze C4 e N4 di Google Cloud, oltre all'espansione dello sviluppo congiunto di Infrastructure Processing Units (IPU) personalizzate. Questa collaborazione mira a migliorare le capacità di calcolo e l'efficienza per i carichi di lavoro di intelligenza artificiale.

Apr 09 2026
Market

Intel: capitalizzazione record in 25 anni, spinta da CPU, AI e foundry

Intel ha raggiunto la sua più alta capitalizzazione di mercato in 25 anni, superando i 300 miliardi di dollari. Questo traguardo è attribuito ai progressi nei settori CPU, intelligenza artificiale (AI) e foundry, con un riferimento a un legame con TeraFab di Musk come fattore trainante.

Apr 09 2026
Market

L'app Meta AI scala le classifiche dopo il lancio del nuovo modello Muse Spark

L'applicazione Meta AI ha registrato un'impennata nelle classifiche dell'App Store, passando dalla 57esima alla quinta posizione dopo il rilascio del suo nuovo modello, Muse Spark. Questo balzo evidenzia l'impatto diretto che l'evoluzione dei Large Language Models può avere sull'adozione da parte degli utenti finali, un fattore cruciale anche per le strategie di deployment aziendali, sia on-premise che in cloud, dove performance e accessibilità sono determinanti.

Apr 09 2026
Market

Amazon: il business dei chip custom vale 50 miliardi e potrebbe aprirsi al mercato

La lettera annuale di Andy Jassy agli azionisti rivela che il business dei chip custom di Amazon, che include Graviton, Trainium e Nitro, genera oltre 20 miliardi di dollari di ricavi annualizzati, con una crescita a tre cifre. Jassy suggerisce che, se venduto sul mercato aperto, questo segmento potrebbe valere circa 50 miliardi di dollari, aprendo a possibili scenari di disponibilità esterna per le sue soluzioni hardware.

Apr 09 2026
LLM

Anthropic e Mythos: sicurezza informatica o strategia interna dietro il rilascio limitato?

Si specula sulle ragioni che potrebbero spingere Anthropic a limitare il rilascio del suo modello Mythos. Le preoccupazioni per la sicurezza informatica sono in primo piano, ma emergono interrogativi su possibili motivazioni interne al laboratorio. La decisione potrebbe avere implicazioni significative per l'adozione e la gestione dei Large Language Models nel panorama tecnicico, influenzando le strategie di deployment on-premise e la governance dei dati.

Apr 09 2026
Hardware

Google e Intel: una partnership strategica per chip AI personalizzati

Google e Intel hanno annunciato un'espansione della loro collaborazione, focalizzata sullo sviluppo congiunto di chip personalizzati per l'infrastruttura AI. Questa mossa strategica risponde alla crescente domanda di CPU e alla persistente carenza globale di componenti, evidenziando l'importanza di soluzioni hardware dedicate per sostenere l'espansione dei carichi di lavoro legati all'intelligenza artificiale.

Apr 09 2026
Market

Oracle nomina Hilary Maxson CFO per guidare l'investimento da 50 miliardi nell'infrastruttura AI

Oracle ha annunciato la nomina di Hilary Maxson a Chief Financial Officer, con decorrenza dal 6 aprile 2026. Maxson assumerà la guida finanziaria in un momento cruciale, mentre l'azienda si impegna a investire 50 miliardi di dollari in spese in conto capitale per potenziare la propria infrastruttura dedicata all'intelligenza artificiale e ai data center. Questa mossa sottolinea la crescente importanza strategica dell'AI per i giganti tecnicici.

Apr 09 2026
Altro

Anthropic AI: la Corte d'Appello non blocca il divieto imposto dall'amministrazione Trump

Una corte d'appello federale ha rifiutato di sospendere il divieto imposto dall'amministrazione Trump contro Anthropic, negando la mozione d'urgenza dell'azienda. La decisione, emessa da giudici nominati da repubblicani, rappresenta una battuta d'arresto per la società di AI. Anthropic sostiene di aver esercitato i propri diritti costituzionali rifiutando l'uso dei suoi modelli Claude AI per la guerra autonoma e la sorveglianza di massa, motivazioni che avrebbero portato al blocco governativo.

Apr 09 2026
Market

Black Forest Labs: la startup da 70 persone che sfida i giganti dell'AI con l'intelligenza artificiale fisica

Black Forest Labs, una startup di 70 persone, si è distinta nel campo della generazione di immagini AI. La sua prossima mossa strategica mira a potenziare l'intelligenza artificiale fisica, posizionandosi come sfidante dei colossi della Silicio Valley. Questo approccio solleva interrogativi sui requisiti infrastrutturali e sui modelli di deployment per l'AI nel mondo reale.

Apr 09 2026
Market

La "guerra civile" degli scimpanzé di Ngogo: uno studio rivela un conflitto letale

Un nuovo studio, pubblicato su *Science*, documenta un raro e letale conflitto interno tra gli scimpanzé di Ngogo in Uganda. Questa 'guerra civile' ha causato la morte di almeno sette adulti e diciassette cuccioli, offrendo nuove prospettive sulla natura dei conflitti sociali. I ricercatori hanno osservato la scissione del gruppo, il più grande mai registrato in natura, e le successive aggressioni tra fazioni un tempo unite.

Apr 09 2026
Altro

L'AI trasforma l'ospitalità: tra efficienza operativa e tocco umano

Il settore dell'ospitalità sta vivendo una profonda trasformazione, passando dai sistemi manuali a quelli digitali, e ora verso operazioni guidate dall'intelligenza artificiale. L'obiettivo è integrare l'AI per migliorare l'efficienza, mantenendo al contempo l'essenza dell'interazione umana. Questa evoluzione, esemplificata da figure come Arran Campolucci-Bordi di Casa Italia, solleva questioni cruciali su come bilanciare tecnicia e personalizzazione nell'era digitale.

Apr 09 2026
Altro

Inference LLM on-premise: il ruolo dei server Dell R750 senza GPU

L'interesse per il deployment di Large Language Models (LLM) su infrastrutture locali cresce, ma la sfida dell'inference senza GPU dedicate rimane centrale. Un'analisi delle capacità dei server Dell R750 con CPU Intel Xeon Gold 5318Y e 256GB di RAM, dotati di supporto VNNI, per carichi di lavoro LLM legati a coding e ricerca, esplorando i trade-off e le opportunità di questa configurazione.

Apr 09 2026
Altro

L'editing di immagini con LLM locali: sfide e requisiti hardware

Un utente con una NVIDIA RTX 4090 da 24GB VRAM evidenzia le difficoltà nell'ottenere risultati di editing immagine-a-immagine di qualità con Large Language Models (LLM) locali, a differenza della semplicità offerta da servizi cloud come Grok o Gemini. La discussione verte sulla necessità di prompting complessi o LORAs per compensare le limitazioni hardware e software in un contesto self-hosted, sollevando interrogativi sulle capacità attuali dei deployment on-premise per carichi di lavoro multimodali.

Apr 09 2026
Frameworks

ATLAS: Una pipeline AI multi-agente con memoria RAG e fallback locale

Il progetto ATLAS introduce una pipeline AI multi-agente in Python, progettata per suddividere le attività tra specialisti come Planner, Researcher, Executor e Synthesizer. Il sistema integra OpenRouter e Ollama per l'esecuzione dei modelli, con ChromaDB per una memoria persistente in stile RAG. Questa architettura permette al sistema di migliorare le sue risposte nel tempo riutilizzando il contesto delle interazioni passate, pur essendo ancora in fase V1 Alpha e con interrogativi sulla scalabilità.

Apr 09 2026
LLM

Il Rapporto ATOM Rileva la Crescente Influenza dei Laboratori Cinesi negli LLM Open Source

Un'analisi approfondita condotta da Nathan Lambert e Florian Brand, il Rapporto ATOM, evidenzia la significativa influenza dei laboratori cinesi nel panorama degli LLM Open Source. Monitorando circa 1.500 modelli tra novembre 2023 e marzo 2026, lo studio rileva come contributi di entità come Qwen e DeepSeek abbiano stimolato iniziative simili in Europa e negli Stati Uniti, suggerendo un impatto diretto anche sullo sviluppo di modelli come Gemma4.

Apr 09 2026
Frameworks

Eseguire LLM in Locale: La Sfida dei Dispositivi "Low-End" con llama.cpp

Un utente evidenzia le difficoltà nell'eseguire Large Language Models (LLM) su hardware limitato, cercando supporto per l'installazione di "codice Claude" tramite llama.cpp su Windows 10. La sua esperienza con un modello Qwen 0.8B sottolinea la crescente necessità di soluzioni efficienti per il deployment locale, un tema centrale per chi valuta alternative self-hosted.

Apr 09 2026
Frameworks

AWS punta alla trasparenza: un registro per gli agenti AI aziendali

AWS introduce un registro per gli agenti AI, mirando a risolvere la mancanza di visibilità sulle automazioni software in ambienti aziendali. L'iniziativa sottolinea l'importanza della governance e della trasparenza per i "roboscript", elementi cruciali per la conformità e la sicurezza dei dati in contesti enterprise, sia cloud che on-premise.

Apr 09 2026
LLM

Bret Taylor di Sierra: l'era delle interfacce grafiche è al tramonto

Bret Taylor, co-fondatore di Sierra, ha predetto che gli agenti AI renderanno obsolete l'attuale paradigma delle interfacce software. Questa visione suggerisce un futuro in cui l'interazione con i sistemi avverrà tramite linguaggio naturale, trasformando radicalmente lo sviluppo e il deployment delle applicazioni aziendali, con significative implicazioni per le strategie infrastrutturali on-premise.

Apr 09 2026
Altro

Coinspaid e The Residency: infrastruttura blockchain per le startup emergenti

Coinspaid, uno dei maggiori fornitori europei di infrastrutture di pagamento blockchain, ha siglato una partnership strategica con The Residency, una community globale per fondatori e innovatori emergenti. L'accordo garantirà alle startup di The Residency l'accesso esclusivo, a condizioni preferenziali, alle soluzioni di infrastruttura stablecoin di Coinspaid, supportando la crescita e l'innovazione nel settore.

Apr 09 2026
Market

Il futuro del lavoro con l'AI: trasformazione rapida e benefici disomogenei

L'intelligenza artificiale sta rivoluzionando il mondo del lavoro a un ritmo senza precedenti, alterando profondamente i processi di creazione, decisione e collaborazione. Un recente rapporto evidenzia come i benefici di questa trasformazione siano distribuiti in modo disomogeneo, con divari significativi nell'adozione e nell'accesso. In questo scenario, l'esperienza umana assume un ruolo ancora più cruciale, focalizzandosi sulla guida e la supervisione dei sistemi AI, mentre le organizzazioni devono investire in infrastrutture e cultura per massimizzare il potenziale collaborativo dell'AI.

Apr 09 2026
Altro

Dalla strategia AI alla produzione: le sfide per le aziende

Molte aziende definiscono strategie ambiziose per l'intelligenza artificiale, ma la transizione dalla visione alla concreta implementazione in ambienti di produzione presenta notevoli complessità. La pressione per ottenere risultati tangibili spinge i leader tecnicici a valutare attentamente le risorse, l'infrastruttura e i trade-off tra soluzioni self-hosted e cloud, cercando di accelerare e scalare le proprie iniziative AI.

Apr 09 2026
Frameworks

Parallelismo Tensoriale Backend-Agnostico Arriva in llama.cpp: Più Velocità per LLM Locali

Il progetto `llama.cpp` ha integrato il parallelismo tensoriale backend-agnostico, una novità che promette di accelerare significativamente l'inference di Large Language Models su sistemi dotati di più GPU. Questa implementazione non richiede l'uso di CUDA, estendendo i benefici a un'ampia gamma di hardware. Sebbene ancora sperimentale, rappresenta un passo avanti per i deployment on-premise e la gestione efficiente delle risorse hardware.

Apr 09 2026
Altro

Affidabilità estrema: quando l'1% di errore è un rischio sistemico per l'infrastruttura

Marceu Martins, con 25 anni di esperienza, progetta sistemi in cui l'affidabilità è assoluta. Per lui, un tasso di errore dell'1% non è un difetto minore, ma una vulnerabilità sistemica. Questo approccio è cruciale in settori come le catene di approvvigionamento globali e le infrastrutture di telecomunicazione, dove anche piccole anomalie possono avere ripercussioni a cascata su sistemi interconnessi.

Apr 09 2026
Altro

Nutanix estende KubeVirt all'edge per unificare VM e container su Kubernetes

Nutanix ha annunciato l'intenzione di integrare il supporto per KubeVirt, consentendo ai propri clienti di orchestrare macchine virtuali e container direttamente su Kubernetes, con un focus specifico sui deployment all'edge. Questa mossa mira a semplificare la gestione delle infrastrutture distribuite e include piani per l'adozione dell'architettura Arm, riconoscendo la sua crescente rilevanza per i carichi di lavoro di intelligenza artificiale su hardware diversificato.

Apr 09 2026
Altro

Prima condanna per immagini intime non consensuali generate da AI

Un uomo dell'Ohio è stato il primo a essere condannato ai sensi del Take It Down Act, dopo aver ammesso di aver creato e condiviso immagini esplicite, sia reali che generate da intelligenza artificiale, di almeno dieci vittime senza il loro consenso. L'imputato ha utilizzato oltre cento modelli AI e decine di piattaforme installate sul suo telefono per produrre migliaia di immagini.

Apr 09 2026
Hardware

Routing LLM su GPU consumer: i core Ray Tracing accelerano MoE di 218 volte

Una ricerca innovativa ha dimostrato come i core Ray Tracing (RT Cores) delle GPU consumer, solitamente inattivi durante l'inference LLM, possano essere riutilizzati per accelerare il routing degli esperti nei modelli Mixture-of-Experts (MoE). Questo approccio ha permesso di ottenere un aumento di velocità di 218 volte e una riduzione di 731 volte della VRAM necessaria per il routing, rendendo l'inference MoE più efficiente su singole GPU locali come la RTX 5070 Ti da 16GB.

Apr 09 2026
Altro

Google DeepMind: il ritorno alle origini startup per accelerare lo sviluppo AI

Demis Hassabis di Google DeepMind ha rivelato che la fusione con Google Brain ha permesso di accelerare lo sviluppo AI. Integrando le risorse di calcolo di Brain con la cultura di ricerca di DeepMind, l'organizzazione è tornata a un modello operativo più agile e imprenditoriale, migliorando l'efficienza e il ritmo delle innovazioni negli ultimi due-tre anni.

Apr 09 2026
Altro

Progetto Datacenter: cittadino arrestato per aver superato il tempo di parola

Un cittadino dell'Oklahoma è stato arrestato durante una riunione del consiglio comunale per aver superato di pochi secondi il tempo limite di parola. L'uomo stava esprimendo la sua opposizione a un proposto datacenter, sollevando preoccupazioni su consumo idrico, costi energetici e inquinamento acustico. Accusato di violazione di domicilio, ha dichiarato di voler combattere le accuse, sostenendo una violazione dei suoi diritti costituzionali.

Apr 09 2026
Altro

Le sfide di governance dell'AI agentica sotto l'EU AI Act nel 2026

L'adozione di sistemi AI agentici promette automazione, ma solleva complesse questioni di governance. Con l'entrata in vigore dell'EU AI Act, le organizzazioni devono garantire tracciabilità, controllo e interpretabilità delle azioni degli agenti. Questo è cruciale per evitare sanzioni, assicurare la conformità e mantenere la sovranità dei dati, focalizzandosi su log dettagliati, supervisione umana e capacità di revoca rapida.

Apr 09 2026
Altro

GoZTASP: Governance Zero-Trust per Sistemi Autonomi in Ambienti Critici

La piattaforma GoZTASP introduce un'architettura zero-trust per la governance di sistemi autonomi eterogenei, inclusi droni e robot, in contesti operativi reali. Convalidata a TRL 7 in ambienti mission-critical e con componenti già in deployment, affronta sfide di integrità e sicurezza, estendendo la sua applicabilità a settori come sanità e infrastrutture critiche.

Apr 09 2026
Hardware

Intel EMIB-T: il debutto in produzione per gli acceleratori AI

Intel si prepara a introdurre la tecnicia di packaging EMIB-T nei suoi stabilimenti quest'anno. Questa mossa arriva in un contesto di capacità limitata per le soluzioni CoWoS di TSMC e mira a supportare la progettazione di acceleratori AI avanzati. La tecnicia EMIB-T potrebbe offrire nuove opzioni per l'integrazione di componenti critici nei chip dedicati all'intelligenza artificiale, un fattore chiave per i deployment on-premise.

Apr 09 2026
Altro

OpenAI mette in pausa il progetto Stargate nel Regno Unito: costi e burocrazia frenano l'AI

OpenAI ha sospeso il suo ambizioso progetto di datacenter Stargate nel Regno Unito, citando l'onere dei costi energetici e le complessità normative. La decisione, annunciata a pochi mesi dal lancio, solleva interrogativi sulle sfide infrastrutturali e di deployment per i Large Language Models su vasta scala, evidenziando i vincoli che le aziende devono affrontare nella costruzione di capacità AI.

Apr 09 2026
Market

Il CTO di Workday lascia la C-suite per un ruolo tecnico in Anthropic

Peter Bailis, ex Chief Technology Officer di Workday, ha lasciato l'azienda il mese scorso per assumere un ruolo di membro dello staff tecnico presso Anthropic. Si concentrerà sull'ingegneria del reinforcement learning, segnando un passaggio da una posizione dirigenziale a un coinvolgimento diretto nello sviluppo di frontiera nel campo dell'intelligenza artificiale.

Apr 09 2026
Altro

LLM locali e sicurezza: le stesse vulnerabilità di Mythos

Una ricerca ha dimostrato come Large Language Models di dimensioni contenute, eseguiti in locale, siano in grado di identificare le medesime vulnerabilità di sicurezza rilevate da Mythos, un riferimento nel settore. Questo evidenzia il potenziale dei deployment on-premise per l'analisi della sicurezza, offrendo controllo sui dati e autonomia operativa, aspetti cruciali per le aziende che gestiscono informazioni sensibili.

Apr 09 2026
Hardware

SiFive raccoglie 400 milioni per accelerare lo sviluppo RISC-V per i data center

SiFive, fornitore di IP per processori RISC-V, ha annunciato un round di finanziamento di Serie G da 400 milioni di dollari. L'investimento mira a rafforzare la sua leadership nello sviluppo di soluzioni RISC-V ad alte prestazioni, specificamente progettate per le esigenze dei moderni data center, con un'enfasi sulla sovranità dei dati e l'efficienza energetica.

Apr 09 2026
Frameworks

Hugging Face introduce i 'Kernels': ambienti riproducibili per l'AI

Hugging Face ha annunciato il lancio di "Kernels", un nuovo tipo di repository che mira a standardizzare e rendere riproducibili gli ambienti di sviluppo per l'intelligenza artificiale. Questa iniziativa è rilevante per i team che cercano coerenza tra le fasi di prototipazione e i deployment on-premise, offrendo un potenziale per migliorare la gestione delle dipendenze e la portabilità dei carichi di lavoro LLM.

Apr 09 2026
Altro

Microsoft blocca sviluppatori open source, critiche al processo di verifica

Microsoft ha improvvisamente bloccato gli account di due figure di spicco dell'open source, tra cui gli sviluppatori di VeraCrypt e WireGuard, impedendo loro di firmare aggiornamenti. L'azienda ha motivato l'azione con un processo di verifica automatizzato, privo di comunicazioni umane, e ha promesso di migliorare le proprie procedure. L'incidente evidenzia le sfide nella gestione degli account sviluppatore e le potenziali ripercussioni sulla sicurezza dei progetti.

Apr 09 2026
Market

TechCrunch Disrupt 2026: Scenari tech e strategie di deployment on-premise

TechCrunch Disrupt 2026 si avvicina, offrendo un'ultima opportunità per accedere con uno sconto fino a 500 dollari. La scadenza è fissata per il 10 aprile alle 23:59 PT. Questo evento rappresenta un punto di osservazione privilegiato sulle tendenze che modellano il futuro della tecnicia, inclusi i dibattiti cruciali su deployment on-premise, sovranità dei dati e ottimizzazione del TCO per i carichi di lavoro AI. Per CTO e architetti infrastrutturali, è un'occasione per confrontarsi sulle strategie emergenti.

Apr 09 2026
Altro

Edmund si assicura 2,5 milioni di euro per portare la risoluzione dei problemi basata su AI nelle fabbriche

La startup ceca Edmund ha raccolto 2,5 milioni di euro per la sua piattaforma di debugging basata su AI, progettata per la manutenzione industriale. L'azienda mira ad affrontare la crescente complessità dei sistemi produttivi e la carenza di ingegneri qualificati, riducendo drasticamente i tempi di inattività e i rischi operativi attraverso agenti AI che forniscono guida passo-passo per la risoluzione dei problemi.

Apr 09 2026
Altro

Qoro Quantum raccoglie 750.000 dollari per l'infrastruttura ibrida quantistica-classica

Qoro Quantum, startup londinese fondata nel 2024, ha ottenuto 750.000 dollari in finanziamenti pre-seed. L'azienda si dedica allo sviluppo di un'infrastruttura software che unifica sistemi di computing classici, come CPU e GPU, con i nascenti processori quantistici. L'obiettivo è semplificare l'integrazione e il deployment di applicazioni ibride in ambienti eterogenei, affrontando la complessità attuale e il "collo di bottiglia" software per l'utilizzo delle macchine quantistiche.

Apr 09 2026
LLM

L'AI nella propaganda: il caso Explosive Media e i video virali

Il gruppo Explosive Media ha utilizzato l'intelligenza artificiale per creare video satirici in stile 'Lego Cartoons' contro Trump e gli Stati Uniti. Questo caso evidenzia l'impatto crescente dell'AI generativa nella produzione di contenuti a scopo politico, sollevando questioni cruciali su deployment, sovranità dei dati e controllo dell'informazione in un'era di rapida evoluzione tecnicica.

Apr 09 2026
Market

TeiaCare raccoglie 7 milioni di euro per espansione e innovazione nella cura assistenziale

TeiaCare, azienda italiana specializzata in soluzioni di monitoraggio assistenziale basate su sensori ottici e intelligenza artificiale, ha chiuso un round di finanziamento da 7 milioni di euro. L'investimento, guidato da P101 SGR, mira ad accelerare la crescita aziendale, l'espansione internazionale in mercati come Francia e Spagna, e lo sviluppo delle capacità di Data, Spatial e Care Intelligence della piattaforma Ancelia, estendendo l'offerta oltre le strutture residenziali.

Apr 09 2026
Frameworks

OpenWork: il controverso cambio di licenza per l'alternativa Open Source a Claude Cowork

OpenWork, un harness per agenti AI progettato per l'hosting locale e inizialmente rilasciato con licenza MIT, ha tacitamente modificato la propria politica di licenza. Alcuni componenti sono ora sotto licenza commerciale e la portata della licenza MIT è stata ristretta. Questi cambiamenti, non annunciati e con una descrizione del commit probabilmente generata da AI, sollevano interrogativi sulla trasparenza e sulle implicazioni per i deployment on-premise.

Apr 09 2026
LLM

Oltre il Contest: Le Implicazioni dei Modelli OpenAI per il Deployment Enterprise

Mentre OpenAI lancia un contest di marketing, le aziende si interrogano sulle implicazioni strategiche dei Large Language Models. Questo articolo esplora le sfide e le opportunità del deployment di LLM in contesti enterprise, con un focus sulla sovranità dei dati, il Total Cost of Ownership e le decisioni infrastrutturali tra soluzioni cloud e on-premise.

Apr 09 2026
Altro

OpenAI sospende il progetto Stargate UK: costi energetici e regolamentazione frenano l'hub AI

OpenAI ha messo in pausa il suo ambizioso progetto Stargate per un data center AI nel Regno Unito, citando gli elevati costi energetici e le incertezze normative come fattori determinanti. L'iniziativa, che prevedeva l'impiego di circa 8.000 processori Nvidia, era stata concepita per rafforzare le capacità di intelligenza artificiale sovrana del Regno Unito, in partnership con Nscale e Nvidia. La decisione evidenzia le sfide infrastrutturali per i deployment AI su larga scala.

Apr 09 2026
Altro

OpenWork: il cambio di licenza silenzioso solleva interrogativi per i deployment on-premise

OpenWork, un harness per agenti AI inizialmente presentato come alternativa open source a Claude Cowork con licenza MIT e pensato per l'hosting locale, ha silenziosamente modificato la sua politica di licenza. Alcuni componenti sono stati ri-licenziati sotto una licenza commerciale, e la portata della licenza MIT del progetto è stata limitata. Queste modifiche non annunciate sollevano interrogativi sulla trasparenza e l'impatto per gli utenti che lo adottano per deployment self-hosted, influenzando potenzialmente il TCO e la sovranità dei dati.

Apr 09 2026
Frameworks

ggml e llama.cpp: il parallelismo dei tensor 'backend-agnostic' potenzia gli LLM on-premise

Il framework `ggml`, componente chiave di `llama.cpp`, ha integrato il parallelismo dei tensor 'backend-agnostic'. Questa novità, approvata tramite una Pull Request, rappresenta un significativo avanzamento per l'esecuzione di Large Language Models su infrastrutture locali. Permette di distribuire i carichi di lavoro su più dispositivi, facilitando il deployment di modelli più grandi e complessi in ambienti on-premise, con benefici in termini di controllo, sovranità dei dati e potenziale ottimizzazione del TCO.

Apr 09 2026
Altro

Blaize e Nokia: progressi nel deployment ibrido di AI a GITEX Asia

Blaize e Nokia hanno presentato congiuntamente a GITEX Asia i loro progressi nel deployment ibrido di soluzioni AI. La collaborazione sottolinea l'importanza di architetture flessibili che combinano risorse on-premise e cloud per affrontare le esigenze di sovranità dei dati, latenza e TCO nelle applicazioni di intelligenza artificiale.

Apr 09 2026
Altro

Sybol raccoglie oltre 1 milione di euro per l'identità digitale aziendale e le credenziali verificabili

La startup spagnola Sybol ha ottenuto un finanziamento di oltre 1 milione di euro, combinando investimenti pubblici e privati. L'azienda sviluppa un wallet digitale aziendale per la gestione di identità e credenziali verificabili, in linea con il framework eIDAS2 e il modello European Business Wallet. La piattaforma mira a semplificare i processi documentali, migliorare la tracciabilità e rafforzare l'affidabilità dei dati, con un focus iniziale sulle certificazioni di sostenibilità. I fondi saranno impiegati per accelerare il rilascio della piattaforma.

Apr 09 2026
Altro

Degradazione dei Large Language Models: impatto sui deployment on-premise

Utenti e sviluppatori segnalano un calo di performance nei Large Language Models (LLM) di punta a poche settimane dal rilascio. Le ipotesi spaziano dai risparmi sui costi alla saturazione delle risorse di calcolo. Questo fenomeno solleva interrogativi sulla stabilità e affidabilità dei modelli, con implicazioni dirette per le strategie di deployment on-premise e la necessità di benchmark indipendenti e robusti.

Apr 09 2026
Altro

L'urgenza della crittografia post-quantistica: proteggere i dati nell'era dei computer quantistici

Un manutentore del progetto Go si unisce a un coro di esperti che lanciano l'allarme sulla minaccia dei computer quantistici all'attuale crittografia. L'appello è a un passaggio immediato a metodi post-quantistici per prevenire un potenziale disastro globale, sottolineando la necessità di preparare le infrastrutture digitali a questa evoluzione tecnicica.

Apr 09 2026
Altro

AMD potenzia l'integrazione di Lemonade AI per deployment locali

AMD sta semplificando l'integrazione del server AI locale open source Lemonade in altre applicazioni. Questa iniziativa mira a facilitare l'utilizzo di Large Language Models (LLM) su hardware AMD, inclusi Ryzen AI NPUs, GPU Radeon e CPU x86_64, sia su Linux che su Windows. La mossa rafforza le opzioni per deployment AI on-premise, offrendo maggiore controllo e sovranità dei dati alle aziende.

Apr 09 2026
Altro

Kia ridefinisce la strategia EV e integra la robotica avanzata nelle fabbriche

Kia ha presentato la sua strategia aggiornata all'Investor Day 2026, annunciando una revisione degli obiettivi di vendita per i veicoli elettrici, un'espansione della gamma ibrida e la conferma di un pickup elettrico per il Nord America. Un elemento chiave è l'integrazione dei robot Atlas nelle sue fabbriche in Georgia, segnando un passo significativo verso l'automazione industriale avanzata e il deployment di AI on-premise.

Apr 09 2026
Hardware

Elan: touchpad aptici e chip AI per la visione guidano la crescita nel 2026

Elan, azienda attiva nel settore dei semiconduttori, prevede una crescita significativa per l'inizio del 2026, trainata principalmente dall'innovazione nei touchpad aptici e nello sviluppo di chip per la visione basati su intelligenza artificiale. Queste tecnicie rappresentano pilastri strategici per l'espansione dell'azienda in mercati chiave, con implicazioni per i deployment on-premise e la sovranità dei dati.

← Precedente Page 89 / 160 Successiva →