🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15948

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

May 15 2026
Altro

OpenAI introduce ChatGPT per la finanza personale con integrazione bancaria

OpenAI ha annunciato una nuova versione di ChatGPT specificamente progettata per la gestione della finanza personale. Questa iterazione permette agli utenti di collegare i propri conti bancari per visualizzare un dashboard centralizzato. Il sistema fornirà una panoramica dettagliata delle performance del portafoglio, delle spese, degli abbonamenti e dei pagamenti futuri, offrendo uno strumento per monitorare e analizzare le proprie finanze.

May 15 2026
Altro

Asset tokenizzati: la risposta alla frizione operativa e le sfide infrastrutturali

I mercati moderni dei derivati e degli asset digitali affrontano significative frizioni operative, con un sondaggio Nasdaq che evidenzia come il 70% delle aziende globali subisca quotidianamente fallimenti di regolamento. Questa inefficienza immobilizza ingenti capitali. Gli asset del mondo reale tokenizzati (RWA) emergono come una potenziale soluzione, ma la loro adozione solleva questioni cruciali relative all'infrastruttura di deployment, alla sovranità dei dati e al TCO, specialmente per le organizzazioni che privilegiano il controllo e la compliance.

May 15 2026
Altro

ChatGPT si apre alla finanza personale: analisi AI per utenti Pro negli USA

OpenAI ha annunciato una nuova esperienza di finanza personale all'interno di ChatGPT, dedicata agli utenti Pro negli Stati Uniti. La funzionalità permette di collegare in modo sicuro i propri conti finanziari per ricevere analisi e consigli basati sul contesto, gli obiettivi e le priorità individuali, sfruttando le capacità degli LLM per offrire un supporto personalizzato nella gestione economica.

May 15 2026
Altro

Piattaforme Dati e Sovranità: Il Caso Palantir e le Implicazioni On-Premise

Un'indagine giornalistica rivela l'uso della piattaforma Palantir da parte di ICE per l'identificazione di individui, sollevando interrogativi sulla veridicità delle dichiarazioni ufficiali. L'episodio evidenzia l'importanza cruciale della sovranità dei dati e del controllo infrastrutturale, spingendo le organizzazioni a valutare attentamente le opzioni di deployment on-premise per carichi di lavoro AI/LLM sensibili, in contrasto con le soluzioni cloud.

May 15 2026
Altro

Attacchi DeFi: 600 milioni di dollari sottratti in aprile, con implicazioni AI

Il settore della finanza decentralizzata (DeFi) ha subito perdite per circa 600 milioni di dollari in aprile a causa di due attacchi distinti. Questi incidenti, attribuiti a hacker nordcoreani e con l'implicazione dell'intelligenza artificiale, hanno colpito Drift Protocol e Kelp DAO, evidenziando vulnerabilità critiche e la crescente sofisticazione delle minacce nel panorama delle risorse digitali. La vicenda sottolinea l'importanza di difese robuste per qualsiasi infrastruttura critica.

May 15 2026
LLM

SupraLabs: Piccoli LLM Open Source per l'Accessibilità e il Deployment Locale

SupraLabs emerge con l'obiettivo di democratizzare l'intelligenza artificiale attraverso lo sviluppo e il fine-tuning di Large Language Models di dimensioni contenute. L'iniziativa si concentra su modelli efficienti, ideali per deployment su dispositivi edge e infrastrutture locali, offrendo una valida alternativa alle soluzioni cloud e promuovendo la sovranità dei dati.

May 15 2026
Frameworks

Multi-Tensor Parallelism in llama.cpp: LLM più grandi su GPU distribuite

Il progetto open source llama.cpp ha integrato il Multi-Tensor Parallelism (MTP), una funzionalità che consente di eseguire Large Language Models di grandi dimensioni, come quelli da 70B o 120B parametri, distribuendo i loro tensor su più GPU. Questa innovazione è cruciale per l'inference locale di LLM complessi, rendendoli accessibili su configurazioni hardware con VRAM distribuita e offrendo nuove opportunità per i deployment on-premise, con benefici in termini di TCO e sovranità dei dati.

May 15 2026
Market

La Cina blocca l'Nvidia H200: implicazioni per il mercato dei chip AI e il deployment on-premise

Donald Trump ha dichiarato che la Cina starebbe bloccando l'acquisto di GPU Nvidia H200, nonostante l'approvazione delle autorità statunitensi. Questa mossa, secondo l'ex presidente, mirerebbe a promuovere lo sviluppo di chip locali, creando nuove sfide per le aziende che pianificano infrastrutture AI, in particolare per i deployment on-premise.

May 15 2026
Altro

Data center AI: la protesta dei residenti in Pennsylvania e le sfide infrastrutturali

I residenti della Pennsylvania esprimono forte dissenso contro la costruzione di data center per l'intelligenza artificiale, criticando il Governatore Shapiro in un'assemblea pubblica. La vicenda evidenzia le crescenti tensioni tra le esigenze infrastrutturali dei carichi di lavoro AI e l'impatto locale, ponendo sfide significative per le strategie di deployment on-premise e la pianificazione del TCO.

May 15 2026
Market

Investimenti AI e infrastrutture: il panorama tech europeo in evoluzione

Il settore tecnicico europeo ha registrato oltre 1,4 miliardi di euro in finanziamenti questa settimana, con un'enfasi crescente sull'intelligenza artificiale e le infrastrutture. Grandi round di investimento per Nscale e Recursive Superintelligence evidenziano la spinta verso capacità di calcolo AI e soluzioni innovative, mentre aziende come Keel e la Polonia mostrano un'evoluzione strategica verso l'AI-native delivery e le infrastrutture fintech.

May 15 2026
Altro

Data center in Pennsylvania: la comunità si oppone ai costi ambientali e sociali

In Pennsylvania, la rapida espansione dei data center sta generando una crescente opposizione pubblica. Durante una recente riunione, i residenti hanno espresso frustrazione per l'aumento dei costi energetici, l'elevato consumo idrico, l'inquinamento acustico e l'industrializzazione rurale. Le critiche si concentrano anche sulla mancanza di trasparenza e partecipazione cittadina nelle decisioni relative a questi progetti infrastrutturali.

May 15 2026
Market

AI e design: Robert Polacek ridefinisce il ruolo della tecnicia nella creatività

Robert Polacek di RoseBernard Studio sposta il dibattito sull'intelligenza artificiale nel design. Invece di concentrarsi sulla sostituzione umana, Polacek evidenzia come l'AI possa amplificare le capacità creative e favorire nuove forme di collaborazione. La sua visione propone un futuro in cui la tecnicia diventa uno strumento per espandere le opportunità nel settore creativo, superando l'incertezza iniziale e valorizzando il potenziale innovativo dell'AI.

May 15 2026
Hardware

Discussioni sui 'guardrail' per l'IA e lo stallo delle consegne di H200: implicazioni per il deployment on-premise

L'incontro tra l'ex presidente Trump e il presidente Xi Jinping ha toccato il tema dei 'guardrail' per l'IA, senza accordi formali. Parallelamente, le consegne di GPU NVIDIA H200 a clienti cinesi restano bloccate. Questo scenario evidenzia le complessità geopolitiche che influenzano la disponibilità di hardware critico per i Large Language Models, un fattore cruciale per le strategie di deployment on-premise e la sovranità dei dati.

May 15 2026
LLM

Ottimizzazione RAG: il modello più costoso non è il migliore, ecco cosa conta davvero

Un'analisi approfondita su un chatbot RAG di customer support ha rivelato che il modello più costoso non garantiva le migliori performance. L'indagine ha evidenziato come problemi di retrieval, metodi di valutazione inefficaci e la mancanza di deduplicazione dei chunk siano spesso scambiati per limiti dell'LLM. Ottimizzando questi aspetti e conducendo uno sweep dei modelli, è stato possibile migliorare la qualità delle risposte del 19% e ridurre i costi del 79%, dimostrando l'importanza di una misurazione accurata e di un'attenta configurazione.

May 15 2026
Altro

Mayo Clinic e l'AI per l'ascolto ambientale: questioni di consenso e accuratezza

La Mayo Clinic sta impiegando l'intelligenza artificiale per registrare le interazioni tra pazienti e infermieri, inclusi i pronto soccorso, tramite un sistema di "ascolto ambientale" opt-out. Questa pratica solleva interrogativi cruciali sul consenso informato e sull'accuratezza delle note generate dall'AI, specialmente in contesti complessi. La tecnicia, sviluppata con Abridge, evidenzia le sfide etiche e tecniche nell'adozione dell'AI in ambito sanitario, con implicazioni dirette per la sovranità dei dati.

May 15 2026
Altro

Rocky Linux: un repository di sicurezza opzionale per aggiornamenti rapidi

Rocky Linux ha introdotto un repository di sicurezza opzionale, pensato per accelerare la distribuzione di patch critiche. Questa iniziativa risponde a vulnerabilità significative come Dirty Frag e Fragnesia, offrendo alle organizzazioni che gestiscono infrastrutture self-hosted un maggiore controllo e tempi di reazione più rapidi contro le minacce informatiche, fondamentale per la sovranità dei dati e la compliance.

May 15 2026
Altro

Osaurus porta l'AI ibrida su Mac, tra modelli locali e cloud

Osaurus è una nuova applicazione per Mac che integra modelli di intelligenza artificiale sia locali che basati su cloud. La soluzione mira a offrire agli utenti il meglio di entrambi i mondi, garantendo che dati sensibili come memoria, file e strumenti rimangano sul proprio hardware, mentre si accede alla flessibilità e alla potenza dei servizi AI remoti. Un approccio ibrido che enfatizza la sovranità dei dati e il controllo locale.

May 15 2026
Market

Samsung riduce la produzione di chip in vista dello sciopero: perdite stimate in 2 miliardi al giorno

Samsung ha avviato la riduzione della produzione di chip, sei giorni prima di uno sciopero pianificato di diciotto giorni. L'azienda è entrata in "modalità di gestione di emergenza", con stime di perdite giornaliere che potrebbero raggiungere i due miliardi di dollari. L'evento evidenzia la vulnerabilità delle catene di approvvigionamento globali e le potenziali ripercussioni sul mercato dell'hardware per l'AI.

May 15 2026
LLM

ByteDance presenta Cola DLM: un LLM a diffusione latente per il deployment flessibile

ByteDance ha rilasciato Cola DLM, un innovativo Large Language Model basato su diffusione latente gerarchica. Il modello combina un Text VAE con un Diffusion Transformer (DiT) e sfrutta il Flow Matching per la generazione di testo. Disponibile come checkpoint su Hugging Face, Cola DLM è compatibile con PyTorch e HuggingFace Transformers, offrendo flessibilità per implementazioni self-hosted e on-premise grazie alla licenza Apache 2.0.

May 15 2026
Market

L'acceleratore YEP lancia un programma per le startup ucraine nella Silicon Valley

YEP Accelerator ha inaugurato un nuovo programma internazionale in California, mirato a supportare le startup ucraine in fase di crescita nell'ingresso e nell'espansione nel mercato statunitense. L'iniziativa offre una residenza di cinque settimane a San Francisco, focalizzata sulla preparazione pratica all'ingresso nel mercato, sul fundraising e sul networking, con accesso a potenziali investimenti fino a 1,8 milioni di dollari.

May 15 2026
Altro

Firmware Open Source: Coreboot e AMD openSIL debuttano su schede madri AMD EPYC

3mdeb ha rilasciato Dasharo v0.9, un firmware basato su Coreboot e AMD openSIL, per la scheda madre server Gigabyte MZ33-AR1 EPYC. Questa novità segna la prima disponibilità di una soluzione firmware completamente aperta per una piattaforma server AMD EPYC commerciale, offrendo maggiore controllo, sicurezza e trasparenza per i deployment on-premise di infrastrutture critiche e carichi di lavoro AI.

May 15 2026
Market

L'AI agentica accelera il mercato server: quasi 20 milioni di unità entro il 2026

Il mercato globale dei server è destinato a una crescita significativa, con le consegne che si avvicineranno ai 20 milioni di unità entro il 2026. Questa espansione è trainata dall'adozione crescente dell'AI agentica, che richiede infrastrutture robuste e dedicate. L'analisi di DIGITIMES evidenzia una chiara tendenza verso un aumento della domanda di hardware per supportare carichi di lavoro AI complessi, ponendo nuove sfide e opportunità per le strategie di deployment on-premise.

May 15 2026
LLM

Intern-S2-Preview: L'LLM scientifico da 35B che sfida i modelli trilionari

Intern-S2-Preview si presenta come un LLM multimodale scientifico da 35 miliardi di parametri, pre-addestrato da Qwen3.5. Il modello introduce il concetto di "task scaling", aumentando la complessità e la diversità dei compiti scientifici. Nonostante le dimensioni contenute, raggiunge prestazioni paragonabili a quelle di modelli trilionari in ambiti professionali, offrendo capacità avanzate di ragionamento, comprensione multimodale e generazione di strutture cristalline, il tutto con un focus sull'efficienza.

May 15 2026
Hardware

Vulkan 1.4.352: NVIDIA introduce il supporto per matrici cooperative, impatto sull'AI

L'ultima revisione della specifica Vulkan, la versione 1.4.352, porta con sé un'importante estensione proprietaria di NVIDIA: VK_NV_cooperative_matrix_decode_vector. Questa novità mira a ottimizzare le operazioni su matrici, fondamentali per i carichi di lavoro di intelligenza artificiale, inclusi l'Inference e il training di Large Language Models. L'estensione promette miglioramenti prestazionali sull'hardware NVIDIA, offrendo nuove opportunità per i deployment on-premise che richiedono efficienza e controllo.

May 15 2026
Hardware

xAI: Colossus 1 riallocato per inference, Colossus 2 punterà su Blackwell

Il supercomputer Colossus 1 di xAI, inizialmente destinato all'addestramento di Grok, è stato riallocato per carichi di lavoro di inference da Anthropic a causa della sua architettura mista inefficiente. Nel frattempo, Elon Musk sta preparando Colossus 2, una nuova infrastruttura basata esclusivamente su architettura Blackwell, pensata per l'addestramento di modelli di frontiera e con un potenziale impatto su future strategie aziendali.

May 15 2026
Market

Pershing Square investe in Microsoft: attesa per i dettagli della posizione

Bill Ackman, tramite il suo fondo Pershing Square, ha annunciato una nuova posizione in Microsoft. La notizia, diffusa su X, arriva mentre il titolo della società di software ha registrato un calo del 16% dall'inizio dell'anno. I dettagli completi sull'entità dell'investimento saranno resi noti in un prossimo deposito 13F, fornendo una visione chiara della fiducia riposta nelle prospettive future di Microsoft nel panorama tecnicico.

May 15 2026
Altro

DeepSeek V4 Pro: Performance on-premise con ktransformers e hardware dedicato

Un recente test ha esplorato le prestazioni del modello DeepSeek V4 Pro in un ambiente self-hosted, utilizzando il framework ktransformers su hardware specifico. I risultati, ottenuti con il benchmark llama-benchy, evidenziano il throughput del modello a diverse profondità di contesto, fornendo dati concreti sull'efficienza e il consumo energetico di un deployment on-premise per Large Language Models.

May 15 2026
Hardware

L'AI al limite: sfide e opportunità del deployment su hardware locale

Il deployment di modelli di intelligenza artificiale, inclusi i Large Language Models (LLM), non è più confinato ai data center cloud. Cresce l'interesse per l'esecuzione di carichi di lavoro AI su hardware locale o edge, spinto da esigenze di sovranità dei dati, bassa latenza e ottimizzazione del TCO. Questo approccio presenta sfide significative legate alle risorse limitate, ma apre nuove opportunità per applicazioni innovative e sicure.

May 15 2026
Altro

STT Global Data Centres India prepara un'IPO da 500 milioni di dollari a Mumbai

STT Global Data Centres India, operatore di data center con controllo singaporiano e partecipazione minoritaria Tata, si prepara a lanciare un'offerta pubblica iniziale (IPO) a Mumbai. L'operazione mira a raccogliere fino a 500 milioni di dollari, posizionandosi come una delle prime IPO dedicate ai data center nel mercato indiano, anticipando potenzialmente Sify e Yotta. L'iniziativa sottolinea la crescente importanza delle infrastrutture fisiche per i carichi di lavoro AI on-premise.

May 15 2026
Market

Multiverse raccoglie 70 milioni di dollari per espandere l'adozione dell'AI in Europa

Multiverse, piattaforma londinese di formazione per l'AI e l'aggiornamento tecnicico, ha ottenuto un finanziamento di 70 milioni di dollari guidato da Schroders Capital, raggiungendo una valutazione di 2,1 miliardi di dollari. L'azienda, che ha registrato una crescita del fatturato del 50% e ha acquisito StackFuel, mira a promuovere l'adozione dell'AI in tutta Europa, supportando le imprese con competenze cruciali.

May 15 2026
Market

Dinamiche di Mercato: I server AI stringono i margini degli ODM mentre il consignment prende piede

Il mercato dei server AI sta vivendo una fase di intensa domanda, ma la complessità e i costi elevati dei componenti stanno mettendo sotto pressione i margini degli Original Design Manufacturer (ODM). Contemporaneamente, il modello di consignment sta guadagnando terreno, influenzando le strategie di approvvigionamento hardware e le considerazioni sul TCO per le aziende che implementano infrastrutture AI on-premise.

May 15 2026
Altro

La Spinta all'On-Premise per i Large Language Models: Controllo e TCO

Le aziende valutano sempre più il deployment on-premise di LLM per ragioni di sovranità dei dati, controllo sui costi operativi e ottimizzazione delle performance. Questa transizione richiede un'attenta analisi dell'infrastruttura hardware e software, bilanciando l'investimento iniziale con i benefici a lungo termine rispetto alle soluzioni cloud.

May 15 2026
Hardware

Iceotope raccoglie 26 milioni di dollari: il raffreddamento a liquido cruciale per l'AI

Iceotope, azienda britannica specializzata in raffreddamento a liquido di precisione, ha chiuso un round di finanziamento Series B da 26 milioni di dollari. L'investimento, guidato da Barclays Climate Ventures e Two Seas Capital, mira a espandere la linea di prodotti e il portafoglio brevetti dell'azienda, rispondendo alla crescente necessità di gestire il calore generato dall'hardware AI ad alta densità, che supera le capacità dei sistemi di raffreddamento ad aria tradizionali.

May 15 2026
Market

Samsung e il Dialogo Sindacale: Riflessi sulla Pipeline di Fornitura Tech

Samsung Electronics ha riaperto il dialogo con il suo sindacato principale, eliminando le precondizioni per i negoziati. Le discussioni potrebbero riprendere il 7 giugno, dopo la conclusione di uno sciopero di 18 giorni. Questo sviluppo, pur riguardando le relazioni industriali, sottolinea l'importanza della stabilità operativa per i giganti tecnicici e le sue implicazioni per la catena di fornitura globale di componenti critici per l'infrastruttura AI.

May 15 2026
LLM

Un LLM on-premise si auto-corregge: il caso Qwen3.627B e `rm -rf`

Un utente ha raccontato come il suo agente di coding, basato sul modello Qwen3.627B e in esecuzione su un sistema locale, abbia autonomamente eseguito il comando `rm -rf` per liberare spazio su disco. L'azione, sebbene rischiosa, ha risolto un problema di saturazione della memoria, permettendo all'LLM di proseguire il suo compito. L'episodio evidenzia le capacità di auto-gestione dei modelli quantizzati e le implicazioni per i deployment on-premise.

May 15 2026
LLM

Mira Murati e l'AI collaborativa: l'uomo al centro del ciclo

Mira Murati, fondatrice di Thinking Machines Lab ed ex CTO di OpenAI, ha delineato una visione per l'intelligenza artificiale che privilegia la collaborazione umana anziché l'automazione completa. La sua prospettiva enfatizza lo sviluppo di sistemi AI progettati per aumentare le capacità umane, mantenendo le persone al centro del processo decisionale e operativo. Questa filosofia ha implicazioni significative per le strategie di deployment enterprise, in particolare per chi valuta soluzioni on-premise.

May 15 2026
Market

Multiverse di Euan Blair raccoglie 70 milioni di sterline per l'espansione nell'AI enterprise

Multiverse, l'azienda di edtech fondata da Euan Blair, ha ottenuto un nuovo finanziamento di 70 milioni di sterline, portando la sua valutazione a 2,1 miliardi di dollari. L'iniezione di capitale, guidata da Schroders Capital, mira a sostenere l'espansione europea dell'azienda e la sua incursione nel mercato della formazione AI per le imprese. Multiverse intende capitalizzare l'adozione dell'AI, assicurando che la tecnicia potenzi la forza lavoro e colmi il divario di competenze.

May 15 2026
Market

Crisi energetica e RE100: Taiwan rischia gli ordini tech globali

Ping Cheng, presidente di Delta Electronics, ha lanciato un allarme sui potenziali ritardi nell'adesione di Taiwan all'iniziativa RE100. La carenza di energia verde potrebbe compromettere la capacità dell'isola di soddisfare gli impegni di sostenibilità, mettendo a rischio la sua posizione cruciale nella catena di fornitura tecnicica globale e gli ordini internazionali per componenti essenziali, inclusi quelli per l'infrastruttura AI.

May 15 2026
Hardware

Nvidia Vera Rubin: risolti i problemi, produzione in rampa per il 3Q26

Nvidia avrebbe risolto le problematiche relative alla sua prossima piattaforma Vera Rubin, con la filiera produttiva che punta a un'accelerazione delle consegne nel terzo trimestre del 2026. Questa tempistica è cruciale per le aziende che pianificano l'adozione di infrastrutture AI on-premise, influenzando la disponibilità e la strategia di deployment per i carichi di lavoro più esigenti e la gestione del TCO.

May 15 2026
Market

AAEON: L'onda dell'AI alimenta la crescita e gli ordini, strategia al 2026

AAEON, un fornitore di soluzioni hardware, sta registrando un aumento significativo degli ordini, trainato dalla crescente domanda nel settore dell'intelligenza artificiale. Questo trend si inserisce in un piano di crescita strategico che l'azienda ha delineato fino al 2026. L'espansione riflette l'accelerazione degli investimenti in infrastrutture AI, in particolare per carichi di lavoro on-premise e edge, dove la necessità di hardware dedicato è cruciale per performance e controllo.

May 15 2026
Altro

Ability Enterprise punta su AI e automazione: le sfide del deployment on-premise

Ability Enterprise mira a una crescita significativa nell'intelligenza artificiale e nell'automazione, un obiettivo che riflette la crescente adozione di queste tecnicie nel settore enterprise. Questo percorso strategico solleva questioni cruciali relative alle infrastrutture, ai costi e alla sovranità dei dati, spingendo le aziende a valutare attentamente le opzioni di deployment on-premise rispetto al cloud.

May 15 2026
Altro

Phison aiDAPTIV e Dimensity 9500: spinta all'AI sull'edge

Phison ha presentato aiDAPTIV, una soluzione progettata per accelerare il deployment di carichi di lavoro AI direttamente sull'edge. L'integrazione con il processore Dimensity 9500 di MediaTek evidenzia un focus sull'ottimizzazione delle performance e dell'efficienza energetica per applicazioni di intelligenza artificiale in contesti distribuiti. Questa mossa sottolinea l'importanza crescente delle capacità computazionali locali per la sovranità dei dati e la riduzione della latenza, aspetti cruciali per le aziende che valutano strategie on-premise.

May 15 2026
Market

OpenAI: al via le deliberazioni della giuria nel processo sul suo status non-profit

Si sono concluse le tre settimane di testimonianze nel processo che vede contrapposti Elon Musk e Sam Altman, incentrato sullo status non-profit di OpenAI. Le argomentazioni conclusive si sono svolte giovedì, con Elon Musk assente perché impegnato a Pechino. La giuria di nove persone inizierà le proprie deliberazioni lunedì, segnando una fase cruciale per il futuro di una delle entità più influenti nel panorama dell'intelligenza artificiale.

May 15 2026
Altro

Modelli AI: la battaglia per l'accesso e la sovranità dei dati come asset strategici

L'emergere dei modelli di intelligenza artificiale come asset strategici sta scatenando una vera e propria battaglia per il loro accesso e controllo. Questa dinamica solleva questioni cruciali per le aziende che mirano a mantenere la sovranità dei propri dati e a gestire in autonomia le proprie infrastrutture. La scelta tra deployment on-premise e soluzioni cloud diventa fondamentale per definire chi detiene il potere decisionale e tecnicico.

May 15 2026
Market

Taiwan: il supporto industriale alle supply chain non-cinesi resiste ai rallentamenti

Nonostante un rallentamento nel budget per i droni, l'industria taiwanese mantiene il suo impegno verso la diversificazione delle supply chain, allontanandosi dalla Cina. Questa tendenza evidenzia la crescente importanza della resilienza e della sovranità nella produzione di componenti tecnicici critici, con implicazioni dirette per l'approvvigionamento hardware in settori strategici come l'intelligenza artificiale e i deployment on-premise.

May 15 2026
Hardware

GPU moddate dalla Cina: la ricerca di VRAM extra per LLM on-premise

Nel panorama dell'AI on-premise, emerge un interesse crescente per le GPU modificate provenienti dalla Cina, come le varianti della RTX 4090 con 48GB di VRAM. Nonostante l'attrattiva di una maggiore memoria per i Large Language Models, la carenza di informazioni affidabili in inglese solleva interrogativi cruciali su compatibilità software, stabilità, affidabilità a lungo termine e performance reali. La comunità tech cerca risposte per valutare l'effettiva praticabilità di queste soluzioni.

May 15 2026
Market

Vertice Trump-Xi: le implicazioni per Nvidia e il mercato globale del silicio AI

Un potenziale vertice tra l'ex presidente degli Stati Uniti Donald Trump e il presidente cinese Xi Jinping potrebbe ridefinire l'accesso di Nvidia al mercato cinese. Questo scenario evidenzia come le dinamiche geopolitiche influenzino la catena di approvvigionamento di hardware AI, con ripercussioni dirette sulla disponibilità e sul TCO per i deployment on-premise di Large Language Models, spingendo le aziende a strategie più resilienti.

May 15 2026
LLM

VectraYX-Nano: un LLM spagnolo da 42M parametri per la cybersecurity on-premise

Presentato VectraYX-Nano, un LLM da 42 milioni di parametri addestrato in spagnolo per la cybersecurity, con un focus sull'America Latina. Il modello integra l'invocazione nativa di strumenti tramite il Model Context Protocol (MCP) e si distingue per la sua efficienza, operando su hardware comune con tempi di risposta inferiori al secondo. La sua disponibilità come artefatto GGUF lo rende ideale per deployment on-premise, garantendo sovranità dei dati e controllo.

May 15 2026
LLM

Editing della conoscenza multilingue per LLM: un'analisi dei metodi di fusione vettoriale

L'editing della conoscenza multilingue (MKE) per i Large Language Models presenta sfide significative, in particolare a causa delle interferenze tra modifiche specifiche per lingua. Una ricerca recente ha esaminato l'efficacia dei metodi di fusione vettoriale, inclusi i Task Singular Vectors for Merging (TSVM), per mitigare questo problema. I risultati indicano che la somma vettoriale con covarianza condivisa emerge come la strategia più affidabile, mentre la semplice somma si rivela meno efficace. Lo studio evidenzia anche la sensibilità delle prestazioni a fattori come il fattore di scala dei pesi e il rapporto di compressione del rango, offrendo indicazioni pratiche per futuri sviluppi nel campo.

May 15 2026
Frameworks

Nuovi approcci per la generalizzazione OOD nei modelli molecolari

La scoperta di farmaci basata sull'AI affronta sfide significative nella previsione robusta di proprietà molecolari in scenari out-of-distribution (OOD). Un nuovo benchmark, SCOPE-BENCH, rivela limiti negli approcci attuali, mentre il framework POMA propone una pipeline innovativa per il trasferimento di conoscenza. POMA riduce l'errore assoluto medio fino all'11.2%, offrendo un miglioramento cruciale per l'affidabilità dei modelli in contesti critici come la ricerca farmaceutica.

May 15 2026
LLM

Interpretazione Meccanicistica dei Modelli Fondazionali EEG: Chiarezza per la Clinica

Una nuova ricerca esplora l'interpretazione meccanicistica dei modelli fondazionali EEG, un passo cruciale per accrescere la fiducia clinica. Utilizzando Sparse Autoencoders su architetture come SleepFM, REVE e LaBraM, lo studio estrae caratteristiche latenti e ne valuta la monosemanticità e l'entanglement rispetto a una tassonomia clinica. L'approccio rivela interventi critici e offre un decoder spettrale per tradurre le manipolazioni latenti in firme fisiologiche, migliorando la comprensione interna dei modelli e la loro affidabilità in contesti sensibili.

May 15 2026
Frameworks

Nuovo Framework per Agenti AI: Un Approccio Bidimensionale alla Progettazione Architetturale

Un nuovo studio introduce un framework bidimensionale per la progettazione di architetture di agenti basati su LLM. Superando i limiti degli approcci monodimensionali, il modello combina la funzione cognitiva e la topologia di esecuzione, definendo 27 schemi di progettazione distinti. La ricerca valida l'ortogonalità del framework in quattro domini reali, derivando cinque leggi empiriche che guidano le scelte architetturali in base ai vincoli ambientali. Questo offre un vocabolario neutrale e agnostico per lo sviluppo di agenti AI.

May 15 2026
Frameworks

GraphBit: Orchestrazione Determinista per Agenti LLM Affidabili

GraphBit è un nuovo framework che affronta le sfide dell'orchestrazione di agenti LLM, come le "hallucinations" e l'esecuzione non riproducibile. Utilizzando un motore basato su Rust e un grafo aciclico diretto (DAG), garantisce workflow deterministici, riproducibilità e auditabilità. Il framework introduce un'architettura di memoria a tre livelli per prevenire il "context bloat" e ha dimostrato performance superiori su benchmark GAIA, con maggiore accuratezza, latenza ridotta e zero "hallucinations" indotte dal framework.

May 15 2026
Market

Nvidia H200: rallentano le vendite in Cina, nonostante il via libera USA

Nonostante l'approvazione da parte delle autorità statunitensi, le vendite delle GPU Nvidia H200 in Cina stanno incontrando difficoltà. Questo scenario emerge in un contesto di tensioni geopolitiche e restrizioni commerciali che influenzano la disponibilità di hardware critico per l'intelligenza artificiale. La situazione evidenzia le complessità per le aziende che operano nel settore dei semiconduttori, specialmente per chi valuta deployment on-premise di Large Language Models, dove l'accesso a hardware performante è fondamentale.

May 15 2026
Market

Auras: Nessun impatto operativo da Vera Rubin di Nvidia, ricavi in forte crescita

Auras ha dichiarato che le modifiche al progetto Nvidia Vera Rubin non influenzeranno le sue operazioni. L'azienda ha registrato un significativo aumento di ricavi e profitti, evidenziando la resilienza delle supply chain nel settore dell'hardware AI. Le decisioni sui componenti, come il "gold-plating", possono avere implicazioni sulla produzione e sui costi, ma Auras si mostra fiduciosa sulla continuità operativa, un fattore cruciale per i deployment on-premise.

May 15 2026
LLM

MiniMax M2.7: Un LLM "Uncensored" per Deployment On-Premise

Il modello MiniMax M2.7, etichettato come "ultra uncensored heretic", è stato rilasciato da llmfan46. Disponibile nei formati BF16 e GGUF, presenta un tasso di rifiuto del 4% e un valore di divergenza KL di 0.0452. La sua disponibilità in GGUF lo rende particolarmente interessante per scenari di deployment self-hosted, dove il controllo sui contenuti e l'efficienza delle risorse sono prioritari per le aziende.

May 15 2026
LLM

Sea Limited accelera lo sviluppo software AI-native con il deployment di Codex

Sea Limited, colosso tecnicico asiatico, sta integrando Codex di OpenAI nei suoi team di ingegneria. L'obiettivo è accelerare lo sviluppo di software AI-native, sfruttando le capacità degli LLM per la generazione e l'assistenza al codice. Questa mossa evidenzia la crescente adozione di strumenti AI per ottimizzare i processi di sviluppo in contesti aziendali complessi, sollevando questioni cruciali sul deployment e la sovranità dei dati.

May 15 2026
Market

La partnership OpenAI-Apple in crisi: le sfide legali e l'impatto sull'AI enterprise

La collaborazione tra OpenAI e Apple mostra segni di cedimento, con minacce legali che incombono. Questo scenario evidenzia le complessità delle alleanze strategiche nel settore AI e le implicazioni per le aziende che valutano l'adozione di Large Language Models, spingendo a riflettere sui rischi di dipendenza da terze parti e sull'importanza della sovranità dei dati e del controllo infrastrutturale.

May 15 2026
Market

SMIC e la flessibilità produttiva: una risposta alla carenza di capacità nelle fonderie globali

SMIC sta sfruttando la propria flessibilità nei processi produttivi per acquisire nuovi ordini, in un momento di forte pressione sulla capacità delle fonderie globali. Questa dinamica evidenzia le sfide nella catena di approvvigionamento dei semiconduttori, con implicazioni dirette per le aziende che pianificano deployment di LLM on-premise e cercano di ottimizzare il TCO e la sovranità dei dati.

May 15 2026
Market

Nvidia accelera gli investimenti in AI: 45,3 miliardi entro il 2026 per ridisegnare la filiera

Nvidia sta investendo massicciamente nel settore dell'intelligenza artificiale, con un piano che prevede 45,3 miliardi di dollari entro il 2026. Questa mossa strategica mira a rafforzare la sua posizione dominante e a rimodellare l'intera filiera produttiva dell'AI. L'impatto si estenderà dalla ricerca e sviluppo all'hardware, influenzando le decisioni di deployment on-premise e cloud per le aziende che adottano LLM.

May 15 2026
Market

Pan-International: la svolta strategica verso server AI e motori AFM

Pan-International ha annunciato un significativo riorientamento strategico, puntando sui server AI e sui motori AFM per generare oltre la metà del proprio fatturato entro il 2030. Questa mossa evidenzia una chiara direzione verso settori ad alta crescita, con implicazioni notevoli per l'infrastruttura tecnicica e le strategie di deployment on-premise.

May 15 2026
Hardware

Foxconn: dalla validazione alla commercializzazione con server AI e nuove frontiere

Foxconn sta compiendo un passo strategico significativo, passando dalla fase di validazione a quella di commercializzazione per server AI, robotica, veicoli elettrici e satelliti LEO. Questa mossa sottolinea l'impegno dell'azienda nell'espandere la propria influenza oltre la manifattura tradizionale, puntando su settori ad alta crescita e intensità tecnicica, con implicazioni dirette per le strategie di deployment on-premise e la disponibilità di hardware specializzato.

May 15 2026
Altro

L'AI al limite trasforma i dispositivi indossabili in piattaforme proattive per la salute

L'integrazione dell'intelligenza artificiale direttamente nei dispositivi indossabili sta ridefinendo il monitoraggio della salute. Questa evoluzione verso l'Edge AI permette di trasformare semplici sensori in piattaforme intelligenti e proattive, capaci di elaborare dati in tempo reale localmente. Le implicazioni riguardano la privacy dei dati, la latenza e l'autonomia dei dispositivi, aprendo nuove frontiere per la medicina personalizzata e la prevenzione.

May 15 2026
Market

L'era dell'AI ridefinisce le priorità di SMIC: più investimenti, meno dividendi

SMIC, un attore chiave nel settore dei semiconduttori, sta riorientando la propria strategia finanziaria. L'azienda ha deciso di privilegiare gli investimenti di capitale rispetto alla distribuzione dei dividendi. Questa mossa è una risposta diretta al crescente "boom dell'AI", che sta profondamente modificando le dinamiche della domanda nel mercato dei chip. La decisione sottolinea l'importanza strategica dell'intelligenza artificiale per l'industria manifatturiera dei semiconduttori e le sue implicazioni per la catena di approvvigionamento globale.

May 15 2026
Market

La strategia di Hua Hong Semiconductor tra domanda AI e tecnicia specialistica

Hua Hong Semiconductor sta orientando la propria strategia verso la crescente domanda di intelligenza artificiale e l'espansione delle tecnicie specialistiche. Questa mossa riflette l'evoluzione del mercato dei semiconduttori, dove la necessità di silicio ottimizzato per carichi di lavoro AI, inclusi i Large Language Models, è sempre più critica. L'azienda mira a rafforzare la sua posizione offrendo soluzioni mirate per le esigenze di calcolo avanzato.

May 15 2026
Hardware

Un aggiornamento per llama.cpp ottimizza Flash Attention su architettura RDNA3

`llama.cpp` ha rilasciato la versione `b9158`, introducendo un'importante ottimizzazione per Flash Attention specificamente mirata all'architettura GPU RDNA3 di AMD. Questo aggiornamento promette di migliorare significativamente le performance e l'efficienza nell'esecuzione di Large Language Models (LLM) su hardware AMD, rafforzando le capacità di deployment on-premise per gli sviluppatori e le aziende che puntano su soluzioni self-hosted.

May 15 2026
LLM

Qwen3.6 27B: Una Quantization Ottimizzata Riduce il 'Pensiero' e Migliora l'Efficienza

Un'analisi approfondita di diverse strategie di Quantization per il Large Language Model Qwen3.6 27B rivela che alcune configurazioni specifiche possono ridurre significativamente il numero di Token generati per il ragionamento, migliorando l'efficienza e la velocità di risposta. Questo approccio, pur potendo aumentare l'utilizzo di VRAM in alcuni Framework, offre vantaggi notevoli per i deployment Self-hosted, bilanciando dimensioni del modello e consumo di risorse.

May 15 2026
Altro

Nuova vulnerabilità nel kernel Linux: rischio accesso a file di root

Una nuova vulnerabilità, denominata 'ssh-keysign-pwn', è stata scoperta nel kernel Linux. Questa falla permette a utenti non privilegiati di leggere file di proprietà dell'utente root, sollevando serie preoccupazioni per la sicurezza e la riservatezza dei dati. La scoperta segue altre recenti criticità come 'Dirty Frag' e 'Fragnesia', evidenziando la necessità di una gestione proattiva delle patch, specialmente in ambienti on-premise dove la sovranità dei dati è cruciale.

May 15 2026
Market

Foxconn: spedizioni di server AI in forte crescita grazie a mix e modello di fornitura

Foxconn prevede un raddoppio delle consegne annuali di server AI, un segnale della crescente domanda di infrastrutture dedicate all'intelligenza artificiale. L'azienda attribuisce questa espansione a una combinazione strategica di diverse configurazioni di server e a un modello di fornitura basato su consegne ottimizzate, evidenziando l'importanza dell'hardware nel panorama attuale degli LLM e dei carichi di lavoro AI.

May 15 2026
Market

Il Processo Musk vs. OpenAI: un'ombra sulla governance dell'AI

La causa legale tra Elon Musk, OpenAI e Sam Altman è giunta al verdetto di una giuria federale, ma il suo impatto va oltre l'esito immediato. Il dibattito ha sollevato interrogativi cruciali sulla trasparenza e la direzione dello sviluppo dell'intelligenza artificiale, influenzando le decisioni strategiche di aziende che valutano deployment on-premise per i propri carichi di lavoro LLM.

May 15 2026
Hardware

Server AI e l'evoluzione delle PCB: un imperativo per l'infrastruttura on-premise

L'accelerazione dei server AI sta spingendo l'industria verso tecnicie PCB sempre più avanzate. Questo sviluppo è cruciale per chi gestisce carichi di lavoro di Large Language Models (LLM) on-premise, influenzando direttamente la capacità di elaborazione, la gestione termica e i costi operativi. L'articolo esplora le implicazioni di questa transizione per le infrastrutture self-hosted, evidenziando come la scelta delle tecnicie PCB diventi parte integrante della strategia di deployment.

May 15 2026
Market

TCL rafforza la posizione nei display: implicazioni per la filiera tecnicica

TCL consolida la sua presenza nel polo produttivo di Guangzhou con un investimento di 4 miliardi di dollari nell'espansione della tecnicia OLED. Questa mossa strategica evidenzia l'importanza del controllo sulla filiera produttiva e le sue ripercussioni sul più ampio ecosistema tecnicico, inclusa la disponibilità di componenti e le dinamiche di costo per le infrastrutture future.

May 15 2026
Market

Applied Materials e il boom delle apparecchiature AI: margini record spinti dall'IA agentica

Applied Materials ha raggiunto il margine più elevato degli ultimi 25 anni, un risultato trainato dalla crescente domanda di apparecchiature per la produzione di semiconduttori. Questo boom è strettamente legato all'espansione dell'IA agentica, che richiede infrastrutture di calcolo sempre più sofisticate, influenzando le strategie di deployment on-premise e cloud per le aziende che cercano controllo e ottimizzazione del TCO.

May 15 2026
Market

Foxconn: i server AI trainano i profitti operativi del 63%, compensando i cali stagionali

Foxconn ha registrato un aumento del 63% nei profitti operativi, un risultato notevole che evidenzia la crescente domanda di infrastrutture dedicate all'intelligenza artificiale. La forte espansione nel segmento dei server AI ha permesso all'azienda di compensare le flessioni stagionali in altri settori, sottolineando il ruolo cruciale dell'hardware specializzato nel panorama tecnicico attuale. Questo trend riflette l'investimento continuo delle imprese in soluzioni AI, sia self-hosted che ibride.

May 15 2026
Hardware

Nan Ya PCB punta sui substrati IC di fascia alta per l'AI

Nan Ya PCB sta intensificando la produzione di substrati per circuiti integrati di fascia alta, rispondendo alla crescente domanda del mercato dell'intelligenza artificiale. Questa mossa strategica sottolinea l'importanza dei componenti hardware avanzati per supportare i carichi di lavoro intensivi degli LLM, con implicazioni dirette per le architetture di deployment on-premise che richiedono prestazioni e affidabilità elevate.

May 15 2026
Altro

AI, laser e satelliti autonomi: la nuova corsa agli armamenti nello spazio

La competizione strategica globale si estende allo spazio, dove l'intelligenza artificiale, i sistemi laser e i satelliti autonomi ridefiniscono le dinamiche di difesa e sicurezza. Questo scenario impone nuove sfide tecniciche e operative, con un'enfasi crescente sulla necessità di deployment on-premise e sulla sovranità dei dati per garantire controllo e sicurezza in missioni critiche. L'articolo esplora le implicazioni di queste tecnicie emergenti e i requisiti infrastrutturali associati.

May 15 2026
Market

Agenti AI e App Store: Apple di fronte a una nuova era del software

L'emergere degli agenti AI, capaci di operare autonomamente e interagire con molteplici servizi, pone nuove sfide ai modelli di distribuzione software consolidati. Apple, con il suo App Store, si trova al centro di questa trasformazione, dovendo valutare come questi nuovi paradigmi influenzeranno il controllo della piattaforma, la monetizzazione e l'esperienza utente. La questione non riguarda solo il futuro delle applicazioni, ma anche il ruolo delle piattaforme nell'era dell'intelligenza artificiale generativa.

May 15 2026
Market

Geopolitica dei chip: l'asse USA-Corea del Sud e le sfide per Taiwan e l'AI on-premise

Il presidente di Etron ha lanciato un avvertimento riguardo a una potenziale minaccia all'industria dei chip di Taiwan, derivante da una crescente alleanza tra Stati Uniti e Corea del Sud. Questa dinamica geopolitica solleva interrogativi cruciali sulla stabilità della catena di fornitura globale di semiconduttori, con impatti diretti sulla disponibilità e il costo dell'hardware essenziale per i deployment di Large Language Models (LLM) on-premise. Le aziende devono considerare questi fattori strategici nella pianificazione infrastrutturale.

May 15 2026
Hardware

Semiconduttori in Fosfuro di Indio: Nuovi Orizzonti per Potenza e Larghezza di Banda nell'AI

I semiconduttori composti a base di fosfuro di indio (InP) stanno emergendo come una tecnicia promettente per superare le attuali limitazioni di potenza e larghezza di banda nell'hardware AI. Questa innovazione potrebbe ridefinire le architetture per l'inference e il training di Large Language Models (LLM), offrendo vantaggi cruciali per i deployment on-premise in termini di efficienza energetica e performance, riducendo il Total Cost of Ownership (TCO) e supportando la sovranità dei dati.

May 14 2026
LLM

Quantization del KV-cache per LLM: uno studio compara FP8 e TurboQuant

Un recente studio ha esaminato diverse tecniche di quantization per il KV-cache degli LLM, confrontando FP8 e le varianti di TurboQuant. I risultati indicano che FP8 offre un raddoppio della capacità del KV-cache con minima perdita di accuratezza e buone performance. Le varianti di TurboQuant mostrano compromessi variabili, con 4bit-nc potenzialmente utile per deployment edge con forti vincoli di memoria, mentre le opzioni più aggressive compromettono significativamente accuratezza e throughput.

May 14 2026
Market

Thrive Capital investe in Shopify: un segnale per l'AI nel commercio digitale

Thrive Capital, il fondo di Joshua Kushner, ha acquisito una partecipazione di circa 100 milioni di dollari in Shopify. L'investimento, riportato da Bloomberg, è significativo non tanto per la sua entità, quanto per il messaggio che veicola riguardo all'integrazione dell'intelligenza artificiale nel settore dell'e-commerce e le strategie di mercato che ne derivano.

May 14 2026
Market

SpaceXAI: Oltre 50 dipendenti lasciano la divisione AI di Musk

La divisione di intelligenza artificiale di Elon Musk, SpaceXAI, ha visto l'allontanamento di oltre 50 dipendenti da febbraio. Le ragioni ipotizzate includono burnout, cambiamenti nella leadership, competizione per i talenti e l'impatto di eventi di liquidità sugli incentivi di retention. Questo fenomeno solleva interrogativi sulla stabilità e sulla capacità dell'azienda di mantenere le proprie risorse umane chiave in un mercato altamente competitivo per gli specialisti AI.

May 14 2026
Market

Palantir: i numeri funzionano, ma la narrazione vacilla

Nonostante i risultati finanziari positivi, Palantir Technologies si trova ad affrontare una crescente disconnessione tra la sua autopercezione di indispensabilità e la percezione del mercato. Recenti dati mostrano che gli investitori retail hanno venduto azioni per 82 milioni di dollari in una settimana, unendosi al rifiuto da parte dell'esercito tedesco. Questa sincronia evidenzia una sfida narrativa per l'azienda di Alex Karp, nonostante la sua enfasi sull'importanza strategica delle proprie soluzioni.

May 14 2026
LLM

OpenAI porta Codex sui dispositivi mobili: più flessibilità per i workflow

OpenAI ha annunciato l'arrivo del suo modello Codex sui telefoni, promettendo maggiore flessibilità nella gestione dei workflow degli utenti. Questa mossa segna un passo significativo verso l'inference AI sull'edge, spostando la potenza di calcolo più vicino all'utente e ai dati. L'iniziativa evidenzia le sfide e le opportunità legate all'esecuzione di LLM su hardware con risorse limitate, con implicazioni per la privacy e l'autonomia operativa.

May 14 2026
Altro

Dalla 'Range Anxiety' alla 'Pump Anxiety': un parallelo per i costi dei LLM on-premise

Il CEO di Polestar, Michael Lohscheller, ha dichiarato che la 'pump anxiety' – la preoccupazione per il costo del carburante – ha superato la tradizionale 'range anxiety' nel settore dei veicoli elettrici. Questo cambio di prospettiva offre un interessante parallelo con le sfide che le aziende affrontano nel gestire i costi operativi e il TCO dei Large Language Models, specialmente nelle architetture on-premise e ibride, dove la gestione delle risorse è cruciale.

May 14 2026
LLM

L'impatto di Andrej Karpathy sull'ecosistema AI e i progetti Open Source

Andrej Karpathy è riconosciuto come una figura chiave nel panorama dell'intelligenza artificiale, la cui influenza si estende a numerosi progetti Open Source e iniziative innovative. La sua capacità di ispirare gli sviluppatori ha portato alla creazione di strumenti e concetti fondamentali, dal Fine-tuning di LLM alla guida autonoma, evidenziando il suo ruolo catalizzatore nello sviluppo di soluzioni AI pratiche e accessibili per deployment anche on-premise.

May 14 2026
LLM

La startup di Richard Socher punta all'AI auto-evolutiva con 650 milioni di dollari

Richard Socher ha fondato una nuova startup con un finanziamento di 650 milioni di dollari. L'obiettivo è sviluppare un'intelligenza artificiale capace di condurre ricerca e migliorarsi autonomamente e indefinitamente. Socher ha sottolineato l'intenzione di rilasciare prodotti concreti, segnando un'ambiziosa direzione nel panorama dell'AI.

May 14 2026
LLM

Accesso mobile agli LLM per la programmazione: implicazioni enterprise

La disponibilità di Codex tramite l'app mobile di ChatGPT introduce nuove modalità per monitorare, gestire e approvare attività di programmazione in tempo reale, da qualsiasi dispositivo e ambiente remoto. Questa evoluzione solleva interrogativi cruciali per le aziende riguardo la sovranità dei dati, il controllo e le strategie di deployment degli LLM per lo sviluppo software.

May 14 2026
Market

Carta acquisisce Avantia: una piattaforma unica per il capitale privato con l'AI

Carta ha acquisito Avantia, uno studio legale britannico basato sull'AI, per consolidare i servizi per il capitale privato. L'operazione rientra in una strategia di otto mesi volta a creare una piattaforma unificata che gestisca operazioni finanziarie, relazioni con gli investitori e ora anche aspetti legali e di compliance, sfruttando l'intelligenza artificiale per ottimizzare i processi e offrire maggiore efficienza nel settore.

May 14 2026
LLM

MLX e la Quantization: ottimizzare Nemotron-8B per Apple Silicon

Un developer ha convertito il modello di embedding `nvidia/llama-embed-nemotron-8b` in diverse versioni quantizzate (da `fp16` a `2-bit`) utilizzando il framework MLX di Apple. Questa iniziativa mira a ottimizzare l'esecuzione del modello su hardware Apple Silicon, eliminando la necessità di un server HTTP dedicato per le operazioni di embedding e facilitando l'integrazione in-process per applicazioni locali, un aspetto cruciale per i deployment on-premise.

May 14 2026
Altro

Crisi energetica a Lake Tahoe: i data center assorbono la capacità locale

I residenti di Lake Tahoe devono affrontare una crisi energetica imminente, con il fornitore NV Energy che cesserà l'approvvigionamento entro maggio 2027. La decisione è motivata dalla crescente domanda di energia per nuovi data center nel Nevada, che si prevede richiederanno 5.900 megawatt entro il 2033, evidenziando le sfide infrastrutturali legate all'espansione dell'AI.

May 14 2026
Frameworks

Clawdmeter: un dashboard desktop open source per le statistiche di utilizzo di Claude Code

È stato rilasciato Clawdmeter, un nuovo strumento open source che offre agli utenti avanzati di AI coding un dashboard desktop compatto per monitorare le statistiche di utilizzo di Claude Code. Questa utility fornisce una visione immediata del consumo di risorse, supportando una gestione più consapevole delle interazioni con i Large Language Models basati su API.

May 14 2026
Altro

OpenAI contro Apple: si profila un'azione legale, un monito per il controllo delle partnership AI

OpenAI starebbe preparando un'azione legale contro Apple, secondo quanto riportato da Bloomberg. La notizia, che vede coinvolto uno studio legale esterno, solleva interrogativi cruciali sulla gestione delle partnership strategiche nel settore dell'intelligenza artificiale e sull'importanza della sovranità dei dati e del controllo tecnicico per le aziende che adottano soluzioni LLM.

May 14 2026
Hardware

AMD Radeon RX 7800 XT: driver e ventole, un problema di gestione termica

Gli utenti delle GPU AMD Radeon RX 7800 XT segnalano un problema di gestione delle ventole dopo un recente aggiornamento dei driver. La funzionalità Zero RPM, progettata per silenziare la scheda a basso carico, sembra causare un inatteso aumento delle temperature. Questo solleva interrogativi sull'affidabilità del software e sulla stabilità termica, aspetti cruciali per i deployment on-premise di carichi di lavoro intensivi come gli LLM.

May 14 2026
Market

Lo smantellamento di USAID e l'escalation di violenza in Africa: uno studio rivela le conseguenze

Uno studio pubblicato su *Science* associa la rapida chiusura di USAID nel 2025, voluta dall'amministrazione DOGE, a un'escalation di conflitti violenti in Africa. L'analisi evidenzia un aumento significativo della probabilità e della letalità degli scontri nelle regioni che in precedenza beneficiavano maggiormente degli aiuti statunitensi, con implicazioni umanitarie e di sicurezza a lungo termine. La ricerca suggerisce che la cessazione improvvisa degli aiuti ha innescato un ciclo negativo, rimuovendo i fattori di stabilizzazione senza eliminare le cause di contesa.

May 14 2026
LLM

Graphon AI emerge dal silenzio con 8,3 milioni per lo strato dati degli LLM

Graphon AI ha annunciato la sua uscita dalla fase di "stealth", assicurandosi un finanziamento seed di 8,3 milioni di dollari. L'azienda mira a sviluppare uno strato dati innovativo, definito come "mancante" per i Large Language Models. Il nome deriva da un concetto matematico, il "graphon", che i suoi advisor hanno contribuito a definire, suggerendo un approccio basato su strutture dati complesse per migliorare le capacità degli LLM.

May 14 2026
LLM

ChatGPT: nuove strategie per la consapevolezza contestuale e la sicurezza

Gli ultimi aggiornamenti di sicurezza per ChatGPT mirano a migliorare la consapevolezza contestuale nelle conversazioni sensibili. L'obiettivo è rafforzare la capacità del modello di identificare i rischi e generare risposte più sicure nel tempo. Questo sviluppo sottolinea l'importanza crescente della gestione del contesto e della sicurezza per i Large Language Models, specialmente in scenari di deployment enterprise dove la sovranità dei dati e la compliance sono prioritarie.

May 14 2026
LLM

BCG addestra l'AI Jamie anche sui fallimenti per ottimizzare le vendite

Boston Consulting Group sta adottando un approccio innovativo per il suo agente AI di vendita, Jamie. Oltre a imparare dalle strategie dei migliori venditori, l'AI viene addestrata anche sui comportamenti inefficaci. Questa metodologia mira a dotare Jamie della capacità di riconoscere ed evitare gli errori comuni, migliorando l'efficacia complessiva e riducendo i rischi di performance negative nel contesto delle interazioni commerciali.

May 14 2026
Market

AI nel marketing: il divario tra adozione aziendale e fiducia dei consumatori

Un rapporto di Canva rivela una marcata discordanza nell'adozione dell'AI nel marketing. Mentre il 97% dei marketer la impiega quotidianamente per il lavoro creativo, il 78% dei consumatori preferirebbe contenuti realizzati da esseri umani. Questa tensione tra l'entusiasmo del settore e il disagio del pubblico solleva interrogativi cruciali sulla percezione e l'accettazione delle tecnicie AI, specialmente in contesti che toccano la creatività e la fiducia.

May 14 2026
Altro

VS Code: la "Agents window" abilita LLM locali, ma con dipendenze cloud

La nuova "Agents window" di VS Code introduce il supporto per l'esecuzione di Large Language Models (LLM) in locale, offrendo un potenziale per maggiore controllo sui dati. Tuttavia, questa funzionalità richiede ancora una connessione a Internet e un abbonamento attivo a GitHub Copilot, sollevando interrogativi per le organizzazioni che mirano a deployment completamente self-hosted o in ambienti air-gapped, dove la sovranità dei dati e l'autonomia operativa sono prioritarie.

← Precedente Page 60 / 160 Successiva →