🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15939

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Jun 05 2026
Altro

Mondiali FIFA 2026: L'AI On-Premise Contro le Truffe Digitali su Larga Scala

Il Mondiale FIFA 2026, con una domanda di biglietti senza precedenti, sta diventando un bersaglio primario per i cybercriminali. La scarsità e l'urgenza creano un ambiente ideale per truffe di phishing. Questo scenario evidenzia l'importanza di strategie di cybersecurity robuste, dove l'implementazione di Large Language Models (LLM) on-premise può offrire alle organizzazioni un controllo superiore sui dati e capacità avanzate di rilevamento delle minacce, proteggendo sia gli utenti che le infrastrutture critiche.

Jun 05 2026
Market

Microsoft e l'AI: prodotti in stallo e sfide per GitHub

Microsoft sta affrontando un periodo complesso nel settore dell'intelligenza artificiale. I suoi prodotti AI faticano a trovare riscontro sul mercato, mentre la piattaforma GitHub è afflitta da problematiche. Un'intervista a Scott Hanselman, Vice Presidente di Microsoft, solleva interrogativi sulla posizione dell'azienda nel panorama competitivo dell'AI, suggerendo una possibile fase di rincorsa rispetto ai concorrenti. Le implicazioni per i deployment on-premise e la sovranità dei dati sono significative.

Jun 05 2026
Hardware

Computex 2026: i Mini-PC SFF con NVIDIA RTX Spark al centro dell'attenzione

Al Computex 2026, l'attenzione è stata catalizzata dai nuovi mini-PC Small Form Factor (SFF) basati sul System-on-Chip (SoC) NVIDIA RTX Spark. Questi sistemi, presentati da colossi come ASUS, Dell, Lenovo e MSI, segnano un passo significativo verso l'integrazione di capacità AI avanzate in dispositivi compatti. La loro architettura li rende particolarmente adatti per deployment on-premise e scenari edge, dove la sovranità dei dati e la bassa latenza sono prioritarie.

Jun 05 2026
Frameworks

`llama.cpp` accelera lo "hot swap" dei modelli LLM: meno di 30 secondi

Il server `llama.cpp` introduce una funzionalità di "hot swap" per i Large Language Models, consentendo il cambio di modello in meno di 30 secondi. Questa innovazione migliora significativamente l'efficienza operativa per i deployment on-premise, integrandosi fluidamente con interfacce come Open WebUI ed Hermes. La velocità raggiunta rappresenta un notevole progresso rispetto alle implementazioni precedenti, offrendo maggiore agilità nella gestione dei carichi di lavoro AI locali.

Jun 05 2026
Market

Deepfake e K-pop: il lato oscuro dell'AI generativa tra fan e industria

L'AI generativa sta alimentando la creazione di deepfake non consensuali di idol K-pop, scatenando l'indignazione delle comunità di fan. Mentre l'industria valuta azioni legali, alcune etichette adottano paradossalmente l'AI per ottimizzare i costi, evidenziando un complesso dilemma etico e di governance sull'uso delle nuove tecnicie e la protezione dell'identità digitale.

Jun 05 2026
Market

LLM: l'industria ripensa strategie e controllo dei costi operativi

L'industria dell'intelligenza artificiale sta affrontando una svolta significativa nella gestione dei Large Language Models. La priorità si sposta da una rapida espansione e massimizzazione dei token a un controllo rigoroso dei costi e all'implementazione di "guardrails". Questo cambiamento evidenzia la crescente necessità di efficienza operativa e gestione strategica delle risorse, aspetti cruciali per le aziende che valutano deployment on-premise e la sostenibilità a lungo termine delle loro infrastrutture AI.

Jun 05 2026
Altro

Le novità AI di Google e l'impatto sulle strategie on-premise aziendali

Gli aggiornamenti AI di Google, annunciati a maggio 2026, pur non dettagliati, sottolineano la rapida evoluzione del settore. Per le aziende, queste innovazioni riaccendono il dibattito tra soluzioni cloud e deployment on-premise, spingendo a valutare attentamente fattori come sovranità dei dati, TCO e requisiti hardware per i Large Language Models.

Jun 05 2026
Altro

AirTrunk punta all'India con 30 miliardi per l'infrastruttura AI

AirTrunk, operatore di data center hyperscale supportato da Blackstone, ha annunciato un piano di investimento di 30 miliardi di dollari in India entro il 2030. L'obiettivo è costruire oltre 5 gigawatt di capacità di infrastruttura digitale, posizionando il paese come un hub cruciale per l'AI e offrendo nuove opportunità per deployment on-premise e ibridi, con un occhio alla sovranità dei dati.

Jun 05 2026
Hardware

Vulkan 1.4.353: Nuove Estensioni per l'API di Grafica e Compute

Dopo tre settimane di attesa, è stata rilasciata la versione 1.4.353 dell'API Vulkan. Questo aggiornamento introduce le più recenti revisioni della documentazione e tre nuove estensioni, consolidando il ruolo di Vulkan come interfaccia fondamentale per lo sviluppo di applicazioni ad alte prestazioni nel campo della grafica e del compute, con implicazioni rilevanti per i carichi di lavoro AI on-premise.

Jun 05 2026
LLM

Startup cinese supera Nvidia in un benchmark chiave per la robotica

Una startup di Hangzhou, Spirit AI, ha superato Nvidia nel benchmark RoboArena con il suo modello Spirit v1.6, dimostrando la crescente competitività nel campo dell'intelligenza robotica. Il modello di Spirit AI ha ottenuto un punteggio di 1.924, superando il Cosmos3-Nano-Policy di Nvidia, che si era mantenuto in cima alla classifica per soli due giorni. Questo risultato evidenzia come attori emergenti possano sfidare i leader di mercato.

Jun 05 2026
LLM

Mira Murati rompe il silenzio: il ritorno di una figura chiave nell'AI

Dopo diciotto mesi di silenzio, Mira Murati, CEO di Thinking Machines Lab e figura centrale nello sviluppo di ChatGPT, DALL-E e Codex, è riapparsa in un'intervista con Bloomberg. Il suo ritorno segna un momento significativo per il dibattito sull'intelligenza artificiale, sottolineando l'importanza di leadership esperte in un settore in rapida evoluzione.

Jun 05 2026
LLM

KVarN su llama.cpp: la quantization KV-cache di Huawei promette efficienza VRAM

Una nuova tecnica di quantization della cache KV, denominata KVarN e sviluppata da Huawei, è stata integrata in un fork di llama.cpp. Questa soluzione mira a ridurre significativamente l'occupazione della VRAM (3-5x) mantenendo elevata la precisione, un fattore critico per il deployment di Large Language Models (LLM) on-premise su hardware con risorse limitate. I primi benchmark KLD indicano che KVarN può offrire una qualità paragonabile a configurazioni a più alta precisione, ma con un ingombro di memoria inferiore.

Jun 05 2026
Hardware

L'evoluzione dei processori ARM per server: NVIDIA Vera accelera le performance

I processori ARM per server hanno registrato un'impressionante crescita prestazionale negli ultimi otto anni, con un incremento di oltre sette volte. NVIDIA Vera si posiziona come un attore chiave in questa evoluzione, offrendo performance fino a quindici volte superiori in specifici carichi di lavoro rispetto ai modelli precedenti, evidenziando il potenziale per i deployment on-premise.

Jun 05 2026
LLM

AI locale: bilanciare velocità e qualità con la Quantization

L'interesse per gli agenti AI completamente locali è in crescita, spingendo la comunità a esplorare stack hardware e software ottimali. Una delle sfide principali riguarda la scelta del livello di Quantization, come GGUF o EXL2, per trovare il giusto equilibrio tra la velocità di inference e la qualità delle risposte del modello, specialmente per l'uso quotidiano in ambienti self-hosted.

Jun 05 2026
LLM

Anthropic: Claude genera l'80% del proprio codice in produzione

Anthropic ha rivelato che il suo Large Language Model, Claude, è responsabile di oltre l'80% del codice integrato nella codebase di produzione dell'azienda a maggio 2026. Questo dato segna un'accelerazione notevole rispetto al lancio di Claude Code nel febbraio 2025, evidenziando il crescente ruolo dell'IA nello sviluppo software e sollevando interrogativi sulle future metodologie di programmazione.

Jun 05 2026
Altro

Il Giappone e il rischio di "colonia AI": l'allarme del ministro digitale sulla sovranità dei dati

Il ministro digitale giapponese Hisashi Matsumoto ha lanciato un monito severo: il paese rischia di diventare una "colonia AI" se non accelererà lo sviluppo tecnicico. L'avvertimento è stato usato per sostenere un disegno di legge che propone di modificare la normativa sulla protezione dei dati personali, consentendo agli sviluppatori di intelligenza artificiale di accedere a registri medici e penali. La mossa solleva questioni cruciali sulla sovranità dei dati e sul controllo nazionale delle infrastrutture AI.

Jun 05 2026
Altro

AirTrunk: 30 miliardi di dollari per data center AI da 5GW in India

AirTrunk, operatore australiano di data center, ha annunciato un investimento di 30 miliardi di dollari per la costruzione di infrastrutture dedicate all'intelligenza artificiale in India. Il progetto prevede la realizzazione di una capacità complessiva di 5 GW, evidenziando la crescente domanda di risorse computazionali per carichi di lavoro AI e la strategicità del mercato indiano per il deployment di Large Language Models e altre applicazioni intensive.

Jun 05 2026
Altro

Gemma 4 12B sui laptop: l'AI Edge di Google per flussi di lavoro locali

L'introduzione di Gemma 4 12B sui laptop, facilitata da Google AI Edge, segna un passo significativo verso l'abilitazione di Large Language Models (LLM) per flussi di lavoro locali e agentici. Questa evoluzione permette alle aziende di esplorare nuove architetture di deployment, privilegiando la sovranità dei dati e riducendo la dipendenza dal cloud per l'inference, pur affrontando le sfide hardware tipiche dell'edge computing.

Jun 05 2026
Market

L'escalation dei consumi AI minaccia la fornitura di chip HBM e altri settori

Una coalizione industriale ha lanciato un allarme: l'elevato consumo di memoria da parte dei data center AI, in particolare per i chip HBM come quelli prodotti da SK Hynix, sta generando una potenziale carenza. Questa situazione minaccia di innalzare i costi in settori chiave quali l'automotive, il medicale e le telecomunicazioni, evidenziando le sfide nella catena di fornitura per le infrastrutture AI, sia cloud che on-premise.

Jun 05 2026
Altro

Protezione dei Dati e LLM: Il Controllo On-Premise per la Sovranità Informatica

L'adozione di Large Language Models nelle aziende solleva questioni cruciali sulla sicurezza e la sovranità dei dati. Questo articolo esplora come le architetture on-premise offrano un controllo superiore per proteggere le informazioni sensibili, mitigando i rischi legati a minacce esterne e garantendo la compliance normativa. Vengono analizzati i trade-off tra soluzioni self-hosted e cloud per la gestione sicura dei carichi di lavoro AI.

Jun 05 2026
Market

Shell e C3 AI: l'automazione predittiva spinta dagli agenti AI

Shell estende la collaborazione con C3 AI per implementare agenti AI autonomi nella manutenzione predittiva. L'obiettivo è superare la semplice rilevazione di anomalie, automatizzando l'intero ciclo di vita della manutenzione, dalla diagnosi alla richiesta di ricambi. Questa evoluzione mira a ridurre i fermi macchina non pianificati, ottimizzare le risorse e generare un significativo valore economico, migliorando sicurezza ed efficienza operativa.

Jun 05 2026
LLM

Anthropic lancia l'allarme: l'evoluzione di Claude AI e il controllo umano

Anthropic ha espresso preoccupazioni sull'accelerata evoluzione del suo modello Claude AI, che starebbe sviluppando capacità inattese a un ritmo superiore alle previsioni. L'azienda chiede la possibilità di sospendere lo sviluppo di AI "di frontiera", citando il rischio di "miglioramento ricorsivo" che potrebbe portare a una perdita di controllo umano sui sistemi intelligenti. Questo solleva interrogativi cruciali sulla governance e la sicurezza dei Large Language Models, specialmente per le organizzazioni che cercano controllo e sovranità sui propri deployment.

Jun 05 2026
Market

AI: tra l'hype della Tech Week e le sfide concrete che bloccano gli affari

Mentre la New York Tech Week è dominata dall'entusiasmo per l'intelligenza artificiale, con discussioni su agenti autonomi e infrastrutture dedicate, l'azienda Scytale solleva un punto cruciale: al di là del clamore, esistono ostacoli concreti che stanno compromettendo le trattative commerciali. Questo suggerisce una disconnessione tra le promesse tecniciche e le reali sfide di implementazione e adozione nel mercato.

Jun 05 2026
Altro

Computex 2026: La Svolta B2B e le Implicazioni per l'AI On-Premise

Il Computex Taipei 2026 si preannuncia con una marcata enfasi sul settore B2B. Questo orientamento riflette la crescente domanda di soluzioni AI robuste e scalabili per le aziende, spingendo verso deployment on-premise che garantiscano sovranità dei dati, controllo e ottimizzazione del TCO. L'evento sarà cruciale per comprendere le future direzioni dell'infrastruttura AI enterprise.

Jun 05 2026
LLM

SupraLabs Rilascia Supra-50M-Reasoning: Un LLM Aperto per il Ragionamento On-Premise

SupraLabs ha annunciato il rilascio di Supra-50M-Reasoning, un Large Language Model (LLM) sperimentale e "fully open" progettato per generare catene di pensiero esplicite. Fine-tuned con un dataset sintetico e operante in bfloat16, il modello si propone come una risorsa interessante per le organizzazioni che valutano deployment self-hosted, offrendo controllo sui dati e potenziale ottimizzazione del TCO, nonostante la sua natura ancora in fase di sviluppo e la propensione alle allucinazioni.

Jun 05 2026
Hardware

NVIDIA Nova: Il Driver Open Source in Rust Prende Forma nel Kernel Linux 7.2

Danilo Krummrich ha inviato le modifiche al sottosistema DRM in Rust per il kernel Linux 7.2. Gran parte di questo lavoro si concentra sul driver open-source Nova di NVIDIA, concepito come successore moderno di Nouveau. Questo sviluppo è cruciale per l'integrazione hardware e software, offrendo maggiore controllo e flessibilità per i deployment on-premise di carichi di lavoro AI, con implicazioni dirette su TCO e sovranità dei dati.

Jun 05 2026
Altro

Meta e l'infrastruttura AI: data center temporanei alimentati da motori a reazione

Meta sta adottando un approccio non convenzionale per ospitare i suoi server AI, costruendo data center temporanei in strutture simili a tende negli Stati Uniti, incluso il sito Prometheus in Ohio. Queste installazioni, che richiedono circa tre mesi per essere completate, sono alimentate da motori a reazione, evidenziando le estreme esigenze di potenza e raffreddamento dei carichi di lavoro AI su larga scala.

Jun 05 2026
Altro

Jensen Huang: il futuro è l'autonomia per ogni dispositivo edge

Jensen Huang, CEO di Nvidia, ha delineato a Computex una visione audace: ogni dispositivo edge diventerà autonomo. Questa prospettiva indica una transizione dei pattern di calcolo dall'infrastruttura cloud centralizzata verso la robotica e i sistemi distribuiti, con implicazioni significative per il deployment di Large Language Models (LLM) e l'AI on-premise, la sovranità dei dati e il Total Cost of Ownership (TCO) per le aziende.

Jun 05 2026
Market

Broadcom: i ricavi dall'AI riorientano la strategia M&A

Broadcom, nota per la sua crescita tramite acquisizioni, sta ora ridimensionando la priorità delle operazioni di M&A. Il CEO Hock Tan ha dichiarato che l'impennata dei ricavi generati dal settore dell'intelligenza artificiale sta spingendo l'azienda a concentrarsi internamente. Questa svolta strategica, annunciata alla Bloomberg Tech conference, evidenzia l'impatto trasformativo dell'AI sul mercato dei semiconduttori e sulle decisioni di investimento dei principali attori del settore.

Jun 05 2026
Market

Switch punta a una valutazione da 50 miliardi di dollari nel boom dei data center

Switch, sviluppatore di data center con sede a Las Vegas, è in trattative per raccogliere miliardi di dollari, mirando a una valutazione di almeno 50 miliardi di dollari. Questa cifra, considerata impensabile fino a pochi anni fa per un'azienda del settore, riflette la crescente domanda di infrastrutture digitali, alimentata anche dall'espansione dei carichi di lavoro AI e Large Language Models (LLM).

Jun 05 2026
Altro

GNOME 51 Abbandona il Supporto ai Driver NVIDIA Legacy: Verso un Ecosistema Unificato

GNOME 51 segna un punto di svolta per l'ecosistema Linux, rimuovendo il supporto per EGLStreams, la soluzione proprietaria di NVIDIA per Wayland. Questa mossa riflette la transizione di NVIDIA verso standard aperti come DMA-BUF, GBM e KMS, allineandosi al resto del settore. Per le aziende che valutano deployment on-premise di carichi di lavoro AI, l'adozione di driver standardizzati è cruciale per la stabilità e la performance dell'infrastruttura.

Jun 05 2026
Hardware

Linux 7.2: Migliora il Supporto AMDGPU su Architetture ARM e POWER

Il kernel Linux 7.2 introduce significativi miglioramenti al driver AMDGPU/AMDKFD, estendendo il supporto per le GPU AMD e l'ecosistema ROCm su architetture non-x86 come ARM e POWER. Questi aggiornamenti, in particolare il supporto per kernel con dimensioni di pagina diverse da 4K, sono cruciali per ottimizzare le performance in carichi di lavoro AI e HPC, offrendo nuove opportunità per deployment on-premise e strategie di diversificazione hardware.

Jun 05 2026
Market

LLM: gli investitori scommettono su OpenAI e Anthropic, senza scegliere un lato

Nonostante la rivalità percepita tra OpenAI e Anthropic, gli investitori del settore tech adottano una strategia di diversificazione, puntando su entrambi i giganti degli LLM. Questa mossa riflette una visione del mercato in forte espansione, dove la coesistenza di più leader è vista come un'opportunità di crescita, piuttosto che una competizione a somma zero.

Jun 05 2026
Altro

Outlook e connessioni non cifrate: un rischio decennale per la sicurezza dei dati

Un recente report suggerisce che Outlook potrebbe aver consentito connessioni non cifrate per decenni, con un problema di declassamento del protocollo presente almeno dal 2007. La vulnerabilità, emersa tramite aggiornamenti di Fedora e Dovecot, solleva serie preoccupazioni per la sovranità e la protezione dei dati, evidenziando la necessità di una vigilanza costante, specialmente per le infrastrutture self-hosted.

Jun 05 2026
Hardware

AirPods con fotocamere: le sfide di autonomia e privacy per l'AI on-device

Le indiscrezioni su futuri AirPods dotati di fotocamere sollevano questioni cruciali legate all'autonomia della batteria e alla privacy. Questo scenario evidenzia le complesse sfide tecniche e di gestione dei dati che caratterizzano l'implementazione dell'intelligenza artificiale direttamente sui dispositivi, spingendo i limiti dell'elaborazione edge.

Jun 05 2026
Altro

L'incidente Meta e la sicurezza degli agenti AI: oltre gli attacchi sofisticati

Un recente incidente ha mostrato come un agente AI di supporto clienti di Meta sia stato sfruttato per compromettere account Instagram con un metodo sorprendentemente semplice. L'episodio evidenzia vulnerabilità intrinseche negli agenti AI, che possono essere ingannati in modi che un operatore umano eviterebbe. Gli esperti sottolineano la necessità di rigorose misure di sicurezza e red-teaming, specialmente per le aziende che affidano sempre più compiti all'intelligenza artificiale, con implicazioni dirette per i deployment on-premise.

Jun 05 2026
Market

Corea del Sud: il ministro del Lavoro chiede alle tech company di condividere i profitti dell'AI

Il ministro del Lavoro sudcoreano, Kim Young-hoon, ha esortato le maggiori aziende tecniciche del paese a ripartire i guadagni eccezionali derivanti dal ciclo dei chip guidato dall'AI. L'intervento mira a prevenire un'ulteriore polarizzazione economica, avvertendo che i profitti record del settore rischiano di ampliare il divario tra i grandi conglomerati che li generano e la forza lavoro sottostante. La discussione verte su chi debba beneficiare del boom dell'intelligenza artificiale.

Jun 05 2026
Altro

Sviluppo di App E-commerce: Le Implicazioni Frameworkli per le Aziende in Crescita

Per i brand e-commerce che raggiungono una scala significativa, un'applicazione mobile dedicata diventa essenziale. Sebbene esistano numerosi strumenti per semplificare lo sviluppo senza la necessità di assumere sviluppatori, la scelta della soluzione implica decisioni strategiche complesse. Queste riguardano la scalabilità, il controllo sui dati e l'infrastruttura sottostante, temi che risuonano con le sfide affrontate dalle aziende che valutano il deployment di carichi di lavoro AI/LLM on-premise.

Jun 05 2026
Market

USA: discussioni preliminari per quote statali nelle aziende di AI di frontiera

Funzionari statunitensi hanno avviato discussioni preliminari con le principali aziende di intelligenza artificiale riguardo all'acquisizione di quote governative. La proposta, riportata da NOTUS, è considerata insolita e mira a garantire al governo federale una partecipazione strategica nello sviluppo delle tecnicie di AI più avanzate. Questo scenario potrebbe avere implicazioni significative per il panorama dell'innovazione e le strategie di deployment nel settore.

Jun 05 2026
Altro

OQC, JPMorgan Chase e AMD: un data center Quantum-AI per il fintech on-premise

OQC, JPMorgan Chase e AMD hanno inaugurato a Londra un data center Quantum-AI dedicato, frutto di una nuova collaborazione di ricerca. L'iniziativa mira a esplorare applicazioni di calcolo quantistico e ibrido in un ambiente aziendale sicuro. La piattaforma integra il sistema quantistico OQC GENESIS con risorse di calcolo AI e classiche supportate da AMD, per affrontare sfide complesse nel settore finanziario, dalla gestione del portafoglio all'ottimizzazione degli algoritmi. L'obiettivo è testare workflow ibridi per performance e scalabilità in un contesto on-premise.

Jun 05 2026
Hardware

Nvidia: Jensen Huang indica robotica e AI fisica come motore di crescita per la Corea

Durante una visita di quattro giorni a Seoul, il CEO di Nvidia, Jensen Huang, ha evidenziato la robotica e l'intelligenza artificiale fisica come i prossimi settori chiave per la crescita economica della Corea del Sud. Huang ha sottolineato l'importanza di guardare oltre i tradizionali chip di memoria, suggerendo un'evoluzione verso soluzioni AI più complesse che richiedono capacità di elaborazione avanzate, spesso gestite in ambienti edge o on-premise per ottimizzare latenza e sovranità dei dati.

Jun 05 2026
Market

Nvidia e la leadership AI: la strategia di Jensen Huang tra costi e innovazione

Un'analisi approfondita esplora come Nvidia, sotto la guida di Jensen Huang, mantenga la sua posizione dominante nel mercato dell'hardware AI. La strategia di investimento in ricerca e sviluppo e l'acquisizione di talenti sono cruciali per sostenere l'innovazione e soddisfare la crescente domanda di acceleratori per Large Language Models, influenzando direttamente le decisioni di deployment on-premise.

Jun 05 2026
Hardware

Sambanova sfida il dominio GPU nell'Inference AI al Computex

Al Computex, Sambanova ha dichiarato l'intenzione di sfidare il predominio delle GPU nell'ambito dell'Inference AI. Questa mossa evidenzia la crescente ricerca di soluzioni hardware specializzate per ottimizzare i carichi di lavoro degli LLM, offrendo alternative ai tradizionali approcci basati su GPU e influenzando le strategie di deployment on-premise per le aziende che cercano maggiore controllo e TCO vantaggioso.

Jun 05 2026
Altro

L'AI dividend e le fondamenta infrastrutturali per l'adozione dell'intelligenza artificiale

Mentre i funzionari statunitensi valutano l'introduzione di un "AI dividend" per i cittadini, il dibattito evidenzia la necessità di infrastrutture robuste e scalabili. L'effettiva realizzazione dei benefici dell'intelligenza artificiale, sia a livello sociale che aziendale, dipende dalla capacità di gestire deployment complessi, bilanciando costi, sovranità dei dati e requisiti hardware specifici, un focus centrale per chi opera con LLM on-premise.

Jun 05 2026
Market

Foxconn: ricavi record a maggio spinti dalla domanda di rack AI

Foxconn ha registrato un fatturato record nel mese di maggio, un risultato trainato in modo significativo dalla crescente domanda di rack per l'intelligenza artificiale. Questo dato evidenzia l'accelerazione degli investimenti in infrastrutture hardware dedicate all'AI, riflettendo la necessità delle aziende di supportare carichi di lavoro sempre più intensivi, sia per il training che per l'inference di Large Language Models.

Jun 05 2026
Altro

Hiwin e Qualcomm: l'AI al bordo rete per l'automazione industriale

Hiwin e Qualcomm hanno annunciato una collaborazione strategica a Computex, focalizzata sull'integrazione dell'AI al bordo rete (edge AI) nelle apparecchiature PLP, in particolare nei sistemi Load Port. Questa partnership mira a migliorare l'automazione e l'efficienza nei processi industriali, portando l'elaborazione dei dati più vicino alla fonte e rispondendo alle esigenze di bassa latenza e sovranità dei dati tipiche degli ambienti di produzione avanzata.

Jun 05 2026
Altro

L'AI e la ricerca di umanità: il dibattito sui font serif

Le aziende di intelligenza artificiale stanno adottando i font serif per conferire ai loro prodotti un'immagine più umana, una scelta che ha generato critiche e il neologismo "tasteslop". Questa tendenza solleva interrogativi sulle strategie di percezione dell'AI e sulle implicazioni per le organizzazioni che implementano Large Language Models (LLM) on-premise, dove il controllo sull'esperienza utente e la fiducia sono aspetti cruciali.

Jun 05 2026
Altro

Data center AI in Indiana: polemiche locali e sfide per l'infrastruttura

Un episodio in Indiana, dove un sindaco è stato registrato segretamente mentre criticava i manifestanti contro un data center AI, evidenzia le crescenti tensioni tra lo sviluppo di infrastrutture per l'intelligenza artificiale e le comunità locali. La vicenda solleva interrogativi sulle complesse esigenze dei data center AI e sulle sfide legate al deployment on-premise, inclusi l'impatto ambientale, i requisiti energetici e la gestione del Total Cost of Ownership (TCO) in un contesto socio-politico delicato.

Jun 05 2026
LLM

Anthropic: serve una pausa coordinata e verificabile per le AI “frontier”

Anthropic ha recentemente proposto un meccanismo coordinato e verificabile per rallentare o sospendere lo sviluppo delle AI “frontier”. L'azienda esprime preoccupazione che questi sistemi avanzati possano auto-migliorarsi a un ritmo tale da superare la capacità della società di gestirne le conseguenze. La proposta mira a garantire una gestione più consapevole e controllata dell'evoluzione tecnicica.

Jun 05 2026
Frameworks

Kokoro Lab: Uno strumento Open Source per l'esplorazione di LLM on-premise

Un nuovo strumento, denominato Kokoro Lab, è stato rilasciato per facilitare l'esplorazione del modello Kokoro. Sviluppato su uno stack proprietario e con codice Open Source (licenza MIT), il tool permette agli utenti di interagire con il modello localmente. Sono disponibili anche binari precompilati per Windows (CPU e CUDA) e i modelli, incluso un 'bridge model' addestrato, sono scaricabili da Hugging Face. L'iniziativa sottolinea l'interesse per soluzioni self-hosted nell'ambito degli LLM.

Jun 05 2026
Market

Server AI e MLCC: i motori della crescita per Ample Electronic

Ample Electronic registra una crescita significativa, trainata dalla forte domanda di server AI e dalla ripresa del mercato dei condensatori ceramici multistrato (MLCC). Questo trend evidenzia la crescente necessità di infrastrutture hardware robuste per l'intelligenza artificiale, con implicazioni dirette per le strategie di deployment on-premise di Large Language Models.

Jun 05 2026
Market

Infineon India scala la catena del valore spinta dalla domanda di chip per data center AI

Infineon Technologies India sta rafforzando la sua posizione nella catena del valore, rispondendo alla crescente domanda di chip di potenza. Questa spinta è alimentata dall'espansione dei data center dedicati all'intelligenza artificiale, che richiedono soluzioni avanzate per la gestione energetica. La mossa strategica dell'azienda riflette l'evoluzione del mercato e la necessità di componenti specializzati per supportare le infrastrutture AI.

Jun 05 2026
Market

Alibaba estende Qwen a grandi imprese: la battaglia degli agenti AI si intensifica

Alibaba ha reso disponibile il suo Large Language Model Qwen a importanti aziende come KFC, Luckin Coffee e diverse compagnie aeree. Questa mossa sottolinea l'intensificarsi della competizione nel settore degli agenti AI, spingendo le imprese a valutare attentamente le strategie di deployment, inclusi gli approcci on-premise, per bilanciare controllo dei dati, compliance e Total Cost of Ownership.

Jun 05 2026
LLM

Gemma 4 12B: Analisi delle Prestazioni On-Premise per lo Sviluppo Locale

Un'analisi approfondita evidenzia le capacità del modello Gemma 4 12B, nella sua versione quantizzata Unsloth Q5_K_XL, per carichi di lavoro di sviluppo locale. Con un consumo di circa 15.7 GB di VRAM e una velocità di inference di 50 token/secondo, il modello si distingue per la sua facilità di integrazione e la gestione efficace di finestre di contesto ampie, offrendo una valida alternativa alle soluzioni cloud per chi privilegia il controllo e la sovranità dei dati.

Jun 05 2026
Market

La domanda di AI mette sotto pressione le catene di fornitura di PCB: tempi di consegna oltre le 20 settimane

L'esplosione della domanda di intelligenza artificiale sta creando tensioni significative nelle catene di fornitura globali dei circuiti stampati (PCB), componenti essenziali per l'hardware AI. I tempi di consegna per questi elementi critici si sono estesi oltre le 20 settimane, un fattore che complica la pianificazione e il deployment di infrastrutture AI, in particolare per le soluzioni self-hosted e on-premise.

Jun 05 2026
Market

Memoria per l'AI: GoldKey Prevede Carenza e Prezzi Alti Fino al 2028

GoldKey Technology, un attore nel settore della componentistica, stima che la carenza di memoria, in particolare quella ad alte prestazioni cruciale per i carichi di lavoro AI, persisterà fino al 2028. Questa previsione è dettata dall'impennata della domanda generata dall'intelligenza artificiale, che sta già influenzando i costi. Per le aziende che pianificano deployment on-premise di LLM, questo scenario implica considerazioni strategiche su approvvigionamento e TCO.

Jun 05 2026
Market

GR3N: 15,5 milioni di euro per scalare il riciclo chimico del PET

GR3N, azienda svizzera di cleantech, ha chiuso un round di finanziamento Series B da 15,5 milioni di euro. I fondi, guidati da 360 Capital, supporteranno lo sviluppo di MODUS, il primo impianto di riciclo su scala commerciale basato sulla tecnicia MADE. Questa soluzione brevettata affronta le limitazioni del riciclo tradizionale del PET, offrendo un processo senza vincoli di materia prima e con una significativa riduzione delle emissioni di CO₂.

Jun 05 2026
Altro

NPC intelligenti in Ultima Online: il ruolo dei Large Language Models

L'integrazione di Large Language Models (LLM) per la gestione di personaggi non giocanti (NPC) in contesti interattivi come Ultima Online (ServUO) apre nuove frontiere per l'immersione e la dinamicità. Questo approccio solleva questioni tecniche e infrastrutturali significative, specialmente per le organizzazioni che valutano deployment on-premise, dalla selezione dell'hardware alla gestione del Total Cost of Ownership (TCO).

Jun 05 2026
LLM

llama.cpp: la Quantization di spec_draft può Ridurre la Context Window

Un recente studio su llama.cpp ha rivelato che l'applicazione della Quantization `q4_0` al `spec_draft` può inaspettatamente diminuire la Context Window disponibile, passando da 91648 a 83200 Token. Questa scoperta, confermata dagli sviluppatori del Framework, evidenzia un trade-off critico per i deployment on-premise, dove l'ottimizzazione delle risorse e la capacità di gestire contesti ampi sono fondamentali.

Jun 05 2026
Hardware

La stretta USA sui PCB cinesi: rischi per AI e difesa

Gli Stati Uniti stanno intensificando le misure per ridurre la dipendenza dalla Cina nella produzione di Printed Circuit Boards (PCB), componenti essenziali per l'hardware AI e i sistemi di difesa. Questa strategia mira a mitigare i crescenti rischi per la supply chain, evidenziando le vulnerabilità nella fornitura di tecnicie critiche e le implicazioni per le architetture on-premise che richiedono controllo e sovranità.

Jun 05 2026
Market

Visibilità strategica: Mira Murati e la sfida del posizionamento nel mercato AI

In un mercato AI in rapida evoluzione, la visibilità strategica è cruciale. L'attenzione su figure chiave come Mira Murati evidenzia come le aziende debbano comunicare attivamente il proprio valore per mantenere la rilevanza. Per i fornitori di soluzioni LLM on-premise, questo significa articolare i benefici in termini di controllo, sovranità dei dati e TCO, distinguendosi in un panorama competitivo.

Jun 05 2026
Altro

Infineon e l'avanzata del Quantum Computing: il settore finanziario in prima linea

Infineon ha evidenziato i primi progressi nel campo del quantum computing, con il settore finanziario che si posiziona come pioniere nell'adozione di questa tecnicia emergente. L'interesse delle banche e delle istituzioni finanziarie è guidato dalla necessità di affrontare calcoli complessi e migliorare la sicurezza, delineando un futuro in cui le soluzioni on-premise potrebbero giocare un ruolo cruciale per la sovranità dei dati.

Jun 05 2026
Market

Nvidia: Jensen Huang espande i colloqui in Corea del Sud oltre la memoria HBM

Jensen Huang, CEO di Nvidia, si prepara a incontrare i leader aziendali sudcoreani, estendendo le discussioni oltre il settore delle memorie HBM. Questo segnale indica una potenziale espansione strategica di Nvidia nel mercato asiatico, con implicazioni per l'intera filiera dell'AI e per le future architetture di deployment on-premise.

Jun 05 2026
LLM

Errorquake: Oltre il Tasso di Errore, la Gravità delle Allucinazioni negli LLM Open-Weight

Un nuovo benchmark, Errorquake-10k, rivela che i Large Language Models open-weight presentano distribuzioni di gravità degli errori molto diverse, anche a parità di accuratezza complessiva. A differenza dei benchmark tradizionali che contano solo gli errori, Errorquake-10k valuta la severità di ogni allucinazione su una scala continua, evidenziando come un errore minore e una falsificazione grave non possano essere trattati allo stesso modo. Questa analisi offre una prospettiva più granulare per la valutazione dei modelli, cruciale per i deployment on-premise.

Jun 05 2026
Market

Ritardo per Muse Spark API di Meta: interrogativi sulla strategia di monetizzazione AI

Il posticipo del rilascio dell'API Muse Spark di Meta solleva questioni cruciali sulla sua strategia di monetizzazione nel settore dell'intelligenza artificiale. Questo evento evidenzia le complessità che le aziende affrontano nel trasformare la ricerca AI in servizi profittevoli, spingendo le imprese a considerare attentamente i trade-off tra soluzioni cloud e deployment on-premise per i propri carichi di lavoro LLM.

Jun 05 2026
LLM

Pre-training LLM: un approccio ibrido JEPA+MLM ridefinisce lo spazio latente

Una nuova ricerca propone un obiettivo di pre-training ibrido per i Large Language Models, combinando il Masked Language Modelling (MLM) con un approccio predittivo in stile JEPA. Questo metodo, testato su hardware NVIDIA H100, mira a superare i limiti dell'MLM tradizionale, che tende a focalizzarsi sulla superficie lessicale. I risultati mostrano che l'encoder ibrido genera embeddings più uniformi e una geometria spettrale più ricca, indicando una migliore comprensione semantica profonda, pur mantenendo un'accuratezza simile nei benchmark standard.

Jun 05 2026
LLM

Il collasso dei modelli AI: un'epidemia di dati sintetici e come affrontarla

Nuove ricerche rivelano che il "collasso dei modelli" negli LLM è un fenomeno di contaminazione incrociata, non una semplice degradazione lineare. Un framework SIR/SIRS a doppio strato modella l'interazione tra dati sintetici e modelli, mostrando dinamiche "supercritiche". La rilevazione dei testi sintetici e l'immunità di gregge emergono come strategie chiave per mitigare questo rischio, fondamentale per la robustezza dei deployment on-premise.

Jun 05 2026
LLM

Il Punto Cieco dei Benchmark LLM: Una Nuova Teoria per Valutazioni Affidabili

Un recente studio introduce una teoria stereologica per analizzare la copertura dei benchmark per i Large Language Models. La ricerca rivela un significativo “punto cieco” nelle attuali suite di valutazione, che può portare a classifiche instabili e decisioni subottimali. Vengono proposte metodologie per identificare un set più robusto e predittivo di benchmark, cruciale per chi deve valutare e implementare LLM in contesti on-premise con vincoli specifici.

Jun 05 2026
Hardware

Kioxia: SSD la risposta all'AI agentica, tra costi HBM e limiti DRAM

Kioxia, a Computex, ha evidenziato le sfide legate ai costi elevati delle memorie HBM e ai limiti di scalabilità delle DRAM per i carichi di lavoro dell'AI agentica. L'azienda propone gli SSD come alternativa strategica per affrontare queste problematiche, offrendo una soluzione che bilancia performance e TCO. Questa prospettiva è cruciale per le aziende che valutano infrastrutture on-premise, dove l'ottimizzazione dei costi e la gestione efficiente delle risorse hardware sono prioritarie per il deployment di Large Language Models.

Jun 05 2026
Hardware

Foxconn rafforza la strategia AI con Intel per i rack di inference

Foxconn, un attore chiave nel settore manifatturiero, sta intensificando la sua spinta nell'intelligenza artificiale attraverso una collaborazione strategica con Intel. L'iniziativa si concentra sullo sviluppo e l'ottimizzazione di rack dedicati all'inference AI, rispondendo alla crescente domanda di soluzioni hardware robuste per l'esecuzione di Large Language Models (LLM) e altri carichi di lavoro AI. Questo approccio mira a supportare deployment on-premise, offrendo alle aziende maggiore controllo e sovranità sui propri dati.

Jun 05 2026
Hardware

Corea del Sud: 520 milioni per chip AI on-device, tra scetticismo di settore

La Corea del Sud ha stanziato un budget di 520 milioni di dollari per lo sviluppo di chip AI destinati all'elaborazione on-device. L'iniziativa mira a rafforzare le capacità nazionali nel settore dell'intelligenza artificiale, sebbene il progetto sia accolto con un certo scetticismo da parte dell'industria. Questo investimento sottolinea la crescente importanza dell'AI locale per sovranità dei dati e performance, delineando un futuro con maggiore controllo sull'infrastruttura tecnicica.

Jun 05 2026
Market

La stretta sui PCB in India: impatto su costi e supply chain AI globale

L'India affronta una crescente carenza di schede a circuito stampato (PCB), spinta da shock nelle materie prime, dall'impennata della domanda di AI e dalla dipendenza dalle importazioni. Questa situazione sta innalzando i costi e solleva interrogativi critici per le aziende che pianificano deployment di Large Language Models (LLM) e altre infrastrutture AI on-premise, influenzando il Total Cost of Ownership (TCO) e la sovranità dei dati.

Jun 05 2026
Hardware

Nvidia rafforza la sua presenza nella robotica umanoide con chip AI

Nvidia sta espandendo il suo ruolo nel settore della robotica umanoide, collaborando con aziende come Unitree e Cosmos 3. L'azienda si posiziona come fornitore chiave di silicio AI, essenziale per l'elaborazione in tempo reale e l'Inference di modelli complessi che alimentano questi robot avanzati. Questo sviluppo sottolinea la crescente domanda di capacità di calcolo dedicate per applicazioni robotiche, spesso con implicazioni per deployment on-premise e sovranità dei dati.

Jun 05 2026
Hardware

Laptop di Nuova Generazione: Tra Design Ultra-Sottile e un Misterioso 'Chip Verde'

Un recente annuncio ha acceso i riflettori su una nuova linea di laptop, descritti come i più sottili e potenti mai realizzati. Al centro delle promesse, un enigmatico 'chip verde' che promette prestazioni eccezionali. L'enfasi è posta su un design innovativo e una potenza di calcolo senza precedenti, suggerendo un approccio audace nel mercato dei dispositivi portatili.

Jun 05 2026
Altro

Raffreddamento AI: i sistemi di pompaggio server al centro delle strategie on-premise

L'intensità computazionale dei carichi di lavoro AI, in particolare per i Large Language Models, genera una quantità crescente di calore nei data center. Questa sfida termica sta portando i sistemi di pompaggio per il raffreddamento a liquido dei server a diventare un elemento infrastrutturale cruciale, specialmente per le organizzazioni che optano per deployment on-premise, dove efficienza e affidabilità impattano direttamente il Total Cost of Ownership.

Jun 05 2026
Market

Intel e Foxconn: una partnership strategica per il mercato AI

Intel stringe una collaborazione con Foxconn per consolidare la propria presenza nel dinamico mercato dell'intelligenza artificiale. L'alleanza mira a rafforzare l'offerta di soluzioni hardware e infrastrutturali, cruciali per le aziende che valutano deployment on-premise e cercano alternative ai servizi cloud, con un occhio di riguardo al Total Cost of Ownership e alla sovranità dei dati.

Jun 05 2026
Market

TNG eWallet punta ai pagamenti agentic: il CEO vede la Malesia pronta per l'AI autonoma

TNG eWallet, il principale portafoglio digitale della Malesia, sta esplorando attivamente i pagamenti agentic, un modello in cui l'AI gestisce autonomamente le transazioni finanziarie. Alan Ni, CEO di TNG Digital, interpreta la posizione della banca centrale malese, Bank Negara, come progressista e favorevole a tali innovazioni. L'azienda, che ha appena raggiunto la redditività con 26 milioni di utenti, intende posizionarsi all'avanguardia in questa evoluzione del fintech.

Jun 05 2026
LLM

Un workshop per costruire LLM da zero: dalla teoria alla pratica con PyTorch e CUDA

Un workshop online offre un percorso pratico per comprendere e costruire Large Language Models (LLM) senza prerequisiti matematici o di machine learning. Il corso copre i fondamenti, l'architettura Transformer, il pre-training, il fine-tuning e la programmazione GPU con PyTorch e CUDA, fornendo le basi per sviluppare LLM moderni. È una risorsa preziosa per chi valuta deployment on-premise e la sovranità dei dati.

Jun 05 2026
Market

La domanda di AI mette sotto pressione l'intera supply chain, non solo i chip

TSMC, gigante della produzione di semiconduttori, ha evidenziato come la crescente domanda di intelligenza artificiale stia generando tensioni sull'intera catena di approvvigionamento globale, ben oltre i soli produttori di chip. Questo scenario impatta direttamente le strategie di deployment on-premise e ibride, richiedendo una pianificazione infrastrutturale attenta e una valutazione approfondita del TCO.

Jun 05 2026
Altro

Foxconn e Intel: una partnership per l'infrastruttura AI tra chip e sistemi

Foxconn e Intel hanno annunciato una collaborazione strategica per lo sviluppo di infrastrutture AI integrate. La partnership, che coinvolge i vertici delle due aziende, si concentrerà sull'integrazione di chip, rack e sistemi completi, mirando a semplificare il deployment di soluzioni di intelligenza artificiale per le imprese. L'iniziativa risponde alla crescente domanda di architetture AI robuste e scalabili, con un'attenzione particolare alle esigenze di controllo e sovranità dei dati.

Jun 05 2026
Hardware

La domanda energetica dell'AI ridisegna l'alimentazione: verticalità e moduli compatti

La crescente domanda energetica dei carichi di lavoro AI sta spingendo l'industria a ripensare le architetture di alimentazione. Secondo Jeff Morroni di Texas Instruments, la tendenza è verso soluzioni di alimentazione verticale e moduli hardware più compatti, con implicazioni significative per la progettazione dei data center e l'efficienza energetica, fattori chiave per i deployment on-premise.

Jun 05 2026
Market

Occhiali AI: la sfida cinese e i limiti all'adozione di massa

Il settore degli occhiali intelligenti dotati di intelligenza artificiale vede l'ascesa di brand cinesi che sfidano i marchi dominanti. Nonostante l'innovazione, l'adozione di massa è frenata da limiti tecnicici, come la gestione della potenza di calcolo e la VRAM su dispositivi edge, e da sfide di mercato. La competizione spinge verso soluzioni più efficienti, ma la strada per un'ampia diffusione è ancora lunga, con implicazioni significative per la sovranità dei dati e il TCO.

Jun 04 2026
Market

Arm: Taiwan e l'AI agentiva catalizzano la crescita del mercato PC

Arm sottolinea il ruolo cruciale di Taiwan nel suo percorso di crescita, evidenziando come l'intelligenza artificiale "agentiva" stia diventando un catalizzatore per l'espansione del mercato dei PC. Questa tendenza suggerisce un'evoluzione nelle capacità dei dispositivi edge, con implicazioni significative per i carichi di lavoro AI distribuiti e l'adozione di soluzioni on-premise per l'inference, ponendo l'accento sulla sovranità dei dati e l'efficienza hardware.

Jun 04 2026
LLM

Higgs Audio v3 TTS 4B: Il Modello per Chat Vocali Multilingue con Controllo Integrato

Il nuovo modello Higgs Audio v3 TTS 4B emerge come una soluzione specializzata per le applicazioni di chat vocale. Con il supporto per 100 lingue e funzionalità di controllo inline, questo Large Language Model (LLM) Text-to-Speech (TTS) offre alle aziende la possibilità di integrare capacità vocali avanzate direttamente nelle proprie infrastrutture, rispondendo a esigenze di bassa latenza e sovranità dei dati tipiche dei deployment on-premise.

Jun 04 2026
Market

Airbnb punta sull'AI interna: un nuovo laboratorio per LLM "non ancora pronti"

Brian Chesky, CEO di Airbnb, ha annunciato l'intenzione di avviare un nuovo laboratorio di intelligenza artificiale. Questa mossa segue la sua precedente dichiarazione secondo cui l'azienda non aveva stretto partnership per i Large Language Models (LLM) a causa dell'immaturità delle soluzioni disponibili sul mercato. La decisione evidenzia una strategia di sviluppo interno per affrontare le specifiche esigenze aziendali.

Jun 04 2026
Market

Microsoft e Scout: la controversia sull'IA 'addictive' e la smentita di Nadella

Una controversia interna a Microsoft è emersa riguardo un documento strategico che mirava a rendere gli utenti 'dipendenti' dall'assistente AI Scout. Il CEO Satya Nadella ha pubblicamente negato la conoscenza del documento, attribuito a un Corporate VP di alto profilo, sollevando interrogativi sulla trasparenza e la comunicazione interna dell'azienda in merito all'etica dell'IA e alle strategie di adozione per i prodotti enterprise.

Jun 04 2026
Market

StrictlyVC Los Angeles: AI e tecnicia per la difesa al centro del dibattito

StrictlyVC Los Angeles si prepara ad accogliere investitori, fondatori e leader tecnicici il 18 giugno presso The Aerospace Corporation Campus. L'evento serale si concentrerà sulle trasformazioni chiave nel venture capital, nella tecnicia per la difesa, nell'intelligenza artificiale e nell'industria avanzata. Un'occasione per approfondire le dinamiche che stanno ridefinendo questi settori strategici, con particolare attenzione alle implicazioni per l'innovazione e il deployment di soluzioni AI.

Jun 04 2026
Altro

Upwind rafforza la sicurezza dell'intero stack AI con una nuova visione

Upwind ha annunciato un'evoluzione strategica nella sua offerta di sicurezza, introducendo una tesi che integra la protezione in ogni componente dello stack AI. L'azienda, già attiva nelle capacità di AI agentica, sottolinea che la sicurezza dell'intelligenza artificiale non può essere trattata come un prodotto isolato, ma deve permeare l'intera infrastruttura per mitigare i rischi emergenti.

Jun 04 2026
Altro

Gli LLM e la resistenza alla propaganda: il benchmark estone

L'Estonian Language Institute (ELI), in collaborazione con Propastop, ha sviluppato un benchmark per valutare la capacità degli LLM di resistere alle narrazioni strategiche della Federazione Russa. Il test, che copre 14 categorie di propaganda, utilizza domande formulate in diverse lingue e tipologie, evidenziando l'importanza di modelli che non diffondano disinformazione senza aiuti esterni.

Jun 04 2026
Altro

AI e Biodifesa: Strategie per la Resilienza Biologica nell'Era dell'Intelligence

L'integrazione dell'Intelligenza Artificiale nella biodifesa rappresenta una frontiera critica per la sicurezza nazionale. Questo articolo esplora la necessità di un piano d'azione robusto per costruire resilienza biologica, enfatizzando come le capacità AI possano rafforzare la protezione contro minacce emergenti. Si discute l'importanza di infrastrutture on-premise per garantire sovranità dei dati e controllo sui modelli, aspetti cruciali per applicazioni così sensibili.

Jun 04 2026
LLM

Qwen 3.6 35B e l'impatto critico della KV Cache nell'inference locale

Un'analisi approfondita rivela le prestazioni sorprendenti del modello Qwen 3.6 35B, specialmente con una KV Cache non quantizzata. Contrariamente alle aspettative iniziali, questa configurazione supera le versioni più piccole, evidenziando come la gestione della memoria VRAM influenzi direttamente l'intelligenza e l'efficienza degli LLM in scenari di inference on-premise, con un focus sul lavoro "agentico" e l'hardware come la RTX 3090 Ti.

Jun 04 2026
Hardware

L'insidia delle corsie PCIe: un errore dimezza le performance di un rig LLM on-premise

Un caso studio rivela come un errore di configurazione delle corsie PCIe, con una GPU RTX 3090 collegata a una velocità ridotta (PCIe 2.0 x4), abbia dimezzato le performance di un rig multi-GPU per LLM on-premise. La correzione ha più che raddoppiato il Throughput per modelli come Mistral 128B, evidenziando l'importanza cruciale della verifica hardware e della corretta allocazione delle risorse per i deployment self-hosted.

Jun 04 2026
Hardware

AMD: Frank Azor smentisce voci su FSR 4.1 e GPU RDNA 3.5

Frank Azor di AMD ha chiarito che nessuna decisione è stata presa riguardo al supporto di FSR 4.1 per le GPU RDNA 3.5, respingendo le recenti speculazioni. La dichiarazione riguarda l'ecosistema hardware dell'azienda, inclusi i chip Ryzen AI Max, sottolineando l'importanza degli aggiornamenti software per l'ottimizzazione delle performance e la longevità dei sistemi, un fattore chiave per le strategie di deployment on-premise e edge.

Jun 04 2026
Market

Apple apre a Poke: il primo agente AI approvato per Messages for Business

La startup Poke, specializzata in agenti AI accessibili tramite messaggi di testo, ha ottenuto l'approvazione da Apple per operare sulla sua piattaforma Messages for Business. Questo segna un passo significativo nell'integrazione di soluzioni di intelligenza artificiale conversazionale all'interno degli ecosistemi aziendali, sollevando questioni cruciali su deployment, gestione dei dati e infrastruttura per le imprese che mirano a sfruttare queste tecnicie.

Jun 04 2026
Market

IPO AI: Anthropic e la Febbre del Mercato, Implicazioni per l'On-Premise

Il settore dell'intelligenza artificiale sta vivendo un'intensa corsa alle IPO, con aziende di punta come Anthropic che vedono le loro azioni acquisire un valore tale da essere accettate persino in transazioni immobiliari. Questa effervescenza di mercato solleva interrogativi cruciali per le imprese che valutano l'adozione di Large Language Models, in particolare riguardo al Total Cost of Ownership, alla sovranità dei dati e alle strategie di deployment on-premise o ibride, temi centrali per AI-RADAR.

Jun 04 2026
Altro

Controversia su Palantir e ICE: un gruppo per i diritti degli immigrati chiede trasparenza sull'uso di ELITE

Un'organizzazione per i diritti degli immigrati ha avviato un'azione legale contro l'Immigration and Customs Enforcement (ICE) e il Dipartimento di Sicurezza Nazionale (DHS) negli Stati Uniti. L'obiettivo è ottenere documenti sull'utilizzo di strumenti Palantir, in particolare ELITE, un sistema che, secondo le rivelazioni di 404 Media e testimonianze ufficiali, supporta l'identificazione di individui e comunità per operazioni di enforcement, sollevando questioni cruciali sulla sovranità dei dati e la trasparenza.

Jun 04 2026
Altro

L'IA alimenta nuove minacce: l'impersonificazione colpisce l'editoria

Professionisti dell'editoria, in particolare gli aspiranti autori, sono sempre più bersaglio di sofisticate truffe basate sull'impersonificazione. Malintenzionati utilizzano tecniche avanzate, potenziate dall'intelligenza artificiale, per creare profili e comunicazioni ingannevoli, rendendo difficile distinguere il vero dal falso. Questo fenomeno evidenzia la crescente necessità di soluzioni di sicurezza robuste e di una maggiore consapevolezza nell'era dell'AI generativa.

Jun 04 2026
Altro

Il Canada investe 2,3 miliardi di dollari in una strategia AI nazionale: 'AI for All'

Il Primo Ministro canadese Mark Carney ha annunciato a Toronto una nuova strategia nazionale per l'intelligenza artificiale, denominata “AI for All”. L'iniziativa prevede un investimento di oltre 2,3 miliardi di dollari in cinque anni, con un'attenzione particolare alle implicazioni morali dell'AI, tema discusso in precedenza con Papa Leone XIV. La strategia mira a rafforzare la posizione del Canada nel panorama globale dell'AI.

Jun 04 2026
Altro

Vulnerabilità critica in Claude Code di Anthropic: un'issue GitHub poteva compromettere i progetti

Una vulnerabilità scoperta nell'azione GitHub di Claude Code di Anthropic avrebbe potuto consentire a un attaccante di compromettere i progetti che la utilizzano. L'exploit si basava su una semplice issue GitHub, mascherata da messaggio di errore, che istruiva l'azione a leggere ed esfiltrare variabili d'ambiente sensibili. Questo scenario sottolinea l'importanza della sicurezza nelle pipeline di sviluppo AI, specialmente per chi gestisce carichi di lavoro LLM.

Jun 04 2026
LLM

Meta lancia un assistente AI per spiegare il successo dei contenuti

Meta ha presentato Creator Assistant, un nuovo strumento basato sull'intelligenza artificiale. L'assistente mira a fornire ai creatori di contenuti su Facebook non solo dati sulle performance, ma anche analisi approfondite sul *perché* un determinato contenuto, come un Reel, abbia avuto successo. Questo risolve una sfida di lunga data per i creator, che finora dovevano interpretare manualmente i dati per capire i fattori chiave di engagement.

← Precedente Page 41 / 160 Successiva →