🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15960

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Apr 30 2026
Altro

Allerta sicurezza Linux: il modulo kernel `algif` sotto esame per i deployment on-premise

Un recente avviso di sicurezza ha richiamato l'attenzione sul modulo kernel `algif` di Linux, suggerendone la disabilitazione. Questa raccomandazione è particolarmente rilevante per le infrastrutture self-hosted e i deployment on-premise di LLM, dove la sicurezza del sistema operativo è fondamentale per la sovranità dei dati e la conformità. L'articolo esplora le implicazioni di questa vulnerabilità e le misure preventive per i responsabili IT.

Apr 30 2026
Market

ASE alza il CapEx a 8,5 miliardi di dollari: spinta al packaging avanzato per l'AI

ASE, attore chiave nel settore dei semiconduttori, ha annunciato un aumento record del proprio CapEx a 8,5 miliardi di dollari entro il 2026. La decisione è motivata dalla robusta domanda di packaging avanzato, un elemento fondamentale per le architetture hardware dedicate ai carichi di lavoro di intelligenza artificiale e Large Language Models. Questo investimento avrà un impatto significativo sulla supply chain globale e sulle strategie di deployment on-premise.

Apr 30 2026
Market

LG Electronics e Nvidia: sinergie AI per data center, robotica e mobilità

LG Electronics e Nvidia hanno annunciato l'esplorazione di una partnership strategica focalizzata sull'intelligenza artificiale. La collaborazione mira a sviluppare soluzioni innovative nei settori della robotica, dei data center e della mobilità, combinando l'esperienza di LG nell'elettronica con le capacità di Nvidia nel computing AI. Questa iniziativa sottolinea l'importanza crescente delle infrastrutture AI e delle applicazioni integrate.

Apr 30 2026
Market

Lenovo punta a 100 miliardi di dollari: i server GPU e gli AI PC motori della crescita

Lenovo ha fissato un ambizioso obiettivo di fatturato di 100 miliardi di dollari, identificando i server GPU e gli AI PC come i principali motori di questa crescita. L'annuncio sottolinea l'importanza crescente dell'hardware dedicato all'intelligenza artificiale, sia per l'infrastruttura centralizzata che per l'elaborazione distribuita, riflettendo le mutevoli esigenze del mercato AI.

Apr 30 2026
Market

La rivalità tech USA-Cina e la spinta all'integrazione asiatica: implicazioni per l'AI

Il presidente di SK Group, Chey Tae-won, ha sollecitato una maggiore integrazione tra Corea del Sud e Giappone per rafforzare il loro potere negoziale nel contesto della crescente rivalità tecnicica tra Stati Uniti e Cina. Questa mossa strategica mira a stabilizzare le catene di fornitura e a garantire l'accesso a tecnicie critiche, con ripercussioni significative per le strategie di deployment AI a livello aziendale, in particolare per chi valuta soluzioni on-premise.

Apr 30 2026
LLM

ICD: la nuova tecnica di jailbreak che aggira le difese di sicurezza degli LLM

Una nuova ricerca introduce Incremental Completion Decomposition (ICD), una strategia di jailbreak che aggira le difese di sicurezza dei Large Language Models. La tecnica sfrutta la generazione incrementale di singole parole per eludere i meccanismi di rifiuto, ottenendo un tasso di successo superiore sui benchmark di sicurezza. Questo studio evidenzia vulnerabilità critiche per le organizzazioni che implementano LLM, specialmente in contesti dove la sovranità dei dati e il controllo sono prioritari.

Apr 30 2026
LLM

LLM Leggeri per il Settore Sanitario: Efficienza e Privacy in Primo Piano

Una nuova analisi esplora l'efficacia dei Large Language Models (LLM) leggeri per il riconoscimento di entità nominate in ambito biomedico. Lo studio evidenzia come questi modelli, meno esigenti in termini computazionali, possano offrire prestazioni competitive rispetto alle controparti più grandi. Questa soluzione risponde alle stringenti esigenze di privacy e budget del settore sanitario, dimostrando il potenziale degli LLM ottimizzati per l'estrazione di informazioni mediche.

Apr 30 2026
Frameworks

Un nuovo Framework iterativo per soluzioni efficienti e stabili di Equazioni Differenziali Parziali

Un nuovo framework iterativo basato sull'energia delle equazioni differenziali parziali (PDE) promette soluzioni più efficienti e stabili. Questo approccio innovativo evita le tradizionali discretizzazioni matriciali e il costoso training dei modelli basati su apprendimento, evolvendo campi iniziali casuali tramite iterazioni di diffusione fisicamente vincolate. I risultati dimostrano convergenza stabile e precisione, offrendo un'alternativa flessibile e scalabile per applicazioni di ricerca e ingegneria, con implicazioni positive per il TCO in contesti on-premise.

Apr 30 2026
Frameworks

Approccio ML multimodale per la diagnosi di frazione di eiezione cardiaca

Un nuovo studio propone un framework di machine learning multimodale per classificare la frazione di eiezione ventricolare sinistra (LVEF) da eletrocardiogrammi (ECG) e dati clinici. Il modello, basato su XGBoost, combina caratteristiche ECG e variabili EHR per identificare quattro classi di LVEF, superando i modelli basati su singole fonti. L'approccio mira a migliorare lo screening e il triage in contesti con risorse limitate, offrendo anche spiegabilità tramite SHAP.

Apr 30 2026
Frameworks

Distill-Belief: Efficienza e Precisione nella Localizzazione di Sorgenti Fisiche

Un nuovo framework, Distill-Belief, affronta le sfide della localizzazione e caratterizzazione inversa di sorgenti (ISLC) in ambienti fisici. Progettato per agenti mobili con vincoli temporali, il sistema risolve il dilemma tra l'accuratezza dell'inference bayesiana, computazionalmente costosa, e l'efficienza dei modelli appresi, che possono portare a "reward hacking". Distill-Belief impiega un'architettura teacher-student per garantire precisione e costi operativi costanti in fase di deployment.

Apr 30 2026
Altro

Controlli operativi per agenti LLM onchain: la chiave per l'affidabilità con capitale reale

Uno studio approfondito su agenti LLM autonomi che gestiscono capitale reale in un mercato onchain rivela un dato cruciale: l'affidabilità non dipende solo dal modello di base, ma emerge da un robusto "operating layer". Componenti come la compilazione dei prompt e la validazione delle policy sono essenziali per prevenire errori critici e garantire il successo delle transazioni, evidenziando la necessità di un approccio olistico al deployment di sistemi AI in contesti finanziari.

Apr 30 2026
Market

Earlybird chiude il Fondo VIII da 360 milioni: focus su deeptech e infrastrutture AI

Earlybird VC ha annunciato la chiusura del suo ottavo fondo early-stage, raccogliendo 360 milioni di euro. Il fondo rafforza la strategia del venture capital, che punta su deeptech, infrastrutture AI e modelli fondazionali. La tesi d'investimento privilegia i livelli più profondi dello stack tecnicico per margini e difendibilità superiori, introducendo anche un modello di proprietà perpetua per la continuità generazionale.

Apr 30 2026
Altro

SoftBank punta alla robotica per costruire data center, IPO da 100 miliardi all'orizzonte

SoftBank sta fondando una nuova azienda specializzata in robotica, con l'obiettivo di costruire data center. L'iniziativa sottolinea la crescente interdipendenza tra intelligenza artificiale e infrastrutture, suggerendo che l'automazione avanzata sarà cruciale per lo sviluppo dei futuri ambienti di calcolo. Si ipotizza già una potenziale IPO da 100 miliardi di dollari, riflettendo l'ambizione del progetto nel settore delle infrastrutture AI.

Apr 30 2026
Market

Google Cloud apre le TPU ai clienti esterni: diversificazione e spinta AI

Google Cloud ha annunciato la disponibilità delle proprie unità di elaborazione tensoriale (TPU) personalizzate per una selezione di clienti. Questa iniziativa risponde alla crescente domanda di hardware specializzato per l'intelligenza artificiale e mira a diversificare le fonti di reddito del gigante tecnicico, in un contesto dove l'AI alimenta sempre più servizi e pubblicità.

Apr 30 2026
LLM

Le "anomalie goblin" nei Large Language Models: analisi e soluzioni per GPT-5

Un'analisi approfondita esplora l'origine, la diffusione e le soluzioni per le "anomalie goblin" nei modelli AI, concentrandosi sulle peculiarità comportamentali di GPT-5. L'articolo esamina la timeline di queste manifestazioni, le cause radice e gli approcci correttivi per garantire un comportamento più prevedibile e affidabile degli LLM in contesti di deployment critici.

Apr 30 2026
Market

Samsung Electronics: profitti record nei chip e il superciclo della memoria AI

Samsung Electronics ha annunciato profitti record nel settore dei semiconduttori, un segnale chiaro del rafforzamento del "superciclo" della memoria per l'intelligenza artificiale. Questo trend evidenzia la crescente domanda di componenti hardware essenziali per i carichi di lavoro AI, con implicazioni significative per le strategie di deployment on-premise e la gestione del TCO.

Apr 30 2026
Altro

L'espansione dell'AI e i limiti infrastrutturali: una sfida per i deployment on-premise

L'accelerazione nell'adozione dell'intelligenza artificiale sta mettendo sotto pressione le infrastrutture globali, evidenziando un potenziale "soffitto di capacità" per i carichi di lavoro più esigenti. Questo scenario impone nuove sfide alle organizzazioni che scelgono strategie di deployment on-premise o ibride, richiedendo una pianificazione attenta delle risorse hardware e una gestione oculata del TCO per garantire sovranità dei dati e performance.

Apr 30 2026
Altro

OpenAI accelera Stargate, superando l'obiettivo energetico e rafforzando l'impegno comunitario

OpenAI ha annunciato l'accelerazione del progetto Stargate, un'iniziativa infrastrutturale su vasta scala, e il superamento di un ambizioso obiettivo di consumo energetico di 10 GW negli Stati Uniti. L'azienda ha inoltre ribadito il proprio impegno verso un approccio più orientato alla comunità. Questi sviluppi sottolineano la crescente domanda di risorse computazionali per gli LLM e le sfide infrastrutturali connesse.

Apr 30 2026
Hardware

Samsung e la stabilità del 4nm: un pilastro per AI e automotive

Samsung ha posto l'accento sulla stabilità della sua tecnicia di processo a 4 nanometri, evidenziando come questa sia cruciale per soddisfare la crescente domanda proveniente dai settori dell'intelligenza artificiale e dell'automotive. La capacità di produrre chip affidabili e performanti a questa scala è fondamentale per lo sviluppo di soluzioni avanzate, sia per i data center on-premise che per le applicazioni edge.

Apr 30 2026
Market

CyberLink: costi di AI search e memoria minacciano la crescita nel 2Q26

CyberLink ha lanciato un avvertimento sui potenziali impatti dei crescenti costi legati all'AI search e alla memoria, prevedendo una possibile frenata della crescita aziendale nel secondo trimestre del 2026. L'analisi sottolinea come le esigenze computazionali degli LLM e l'aumento della domanda di VRAM stiano diventando fattori critici per le strategie di deployment e la sostenibilità economica nel settore tecnicico.

Apr 30 2026
Altro

LLM locali: usi pratici e il valore del monitoraggio on-premise

Un utente Reddit ha condiviso un esempio concreto di utilizzo di LLM locali per generare sintesi da un sistema di sorveglianza. L'esperienza evidenzia come, anche in un contesto self-hosted, il consumo di token possa aumentare rapidamente. La gestione tramite LiteLLM e il monitoraggio con Prometheus e Grafana si rivelano essenziali per comprendere e ottimizzare l'impiego delle risorse e il TCO.

Apr 30 2026
Market

Qualcomm tra sfide immediate e l'avanzata nel mercato data center

Qualcomm sta affrontando delle difficoltà nel breve termine, ma la sua strategia per il mercato dei data center sta mostrando progressi. Questo scenario evidenzia la complessità del settore dei semiconduttori, dove l'innovazione e l'espansione in nuovi segmenti, come l'AI on-premise, sono cruciali per la crescita a lungo termine. L'azienda punta a consolidare la propria presenza in un ambito dominato da pochi attori, offrendo soluzioni alternative per l'inference AI.

Apr 30 2026
Hardware

Lightelligence si quota a Hong Kong, focus sulla commercializzazione CPO per l'AI

Lightelligence, produttore cinese di chip fotonici, ha completato la quotazione a Hong Kong. L'azienda si concentra sulla commercializzazione delle Co-Packaged Optics (CPO), una tecnicia cruciale per le infrastrutture AI di nuova generazione. Questa mossa evidenzia la crescente importanza delle soluzioni ottiche integrate per gestire i carichi di lavoro intensivi degli LLM, offrendo vantaggi in termini di throughput e latenza per i deployment on-premise.

Apr 30 2026
Market

Amazon AWS: Spese in Capitale in Aumento con la Crescita del Cloud

Amazon Web Services (AWS) sta superando le aspettative di ricavo, ma l'azienda sta anche incrementando significativamente le sue spese in capitale, un trend che il CEO prevede continuerà nel breve termine. Questo scenario evidenzia le dinamiche di investimento nel settore cloud, con implicazioni per le strategie di deployment AI.

Apr 30 2026
Altro

Vulnerabilità critica nel codice crittografico Linux: rischio di escalation privilegi

Le principali distribuzioni Linux stanno rilasciando patch per affrontare una vulnerabilità di escalation dei privilegi locali (LPE) derivante da un difetto logico nel codice crittografico. Questa falla, identificata come "authencesn", potrebbe consentire a un attaccante locale di ottenere privilegi di root, compromettendo la sicurezza dei sistemi e l'integrità dei dati in ambienti self-hosted.

Apr 30 2026
Market

Anthropic: offerte pre-emptive spingono la valutazione verso i 900 miliardi di dollari

Secondo fonti vicine alla questione, Anthropic, l'azienda dietro il Large Language Model Claude, avrebbe ricevuto diverse offerte pre-emptive per un nuovo round di finanziamento. Le proposte valuterebbero la società tra gli 850 e i 900 miliardi di dollari, con un potenziale aumento di capitale di 50 miliardi di dollari. Questo scenario evidenzia l'intensa capitalizzazione e la rapida crescita nel settore degli LLM.

Apr 30 2026
Market

Meta e i costi dell'innovazione: miliardi tra AR/VR e AI

Meta continua a registrare perdite significative nel suo segmento Reality Labs, dedicato alla realtà aumentata e virtuale. Parallelamente, l'azienda sta intensificando gli investimenti nell'intelligenza artificiale, una mossa che, sebbene strategica, è destinata ad aumentare ulteriormente le sue spese complessive. Questa dinamica evidenzia le sfide finanziarie legate allo sviluppo di tecnicie emergenti e l'impatto degli ingenti capitali richiesti per l'avanzamento dell'AI.

Apr 30 2026
Market

Musk contro OpenAI: implicazioni legali e strategiche per gli LLM

Elon Musk è salito sul banco dei testimoni per il secondo giorno in una causa legale volta a smantellare OpenAI. La disputa solleva questioni cruciali sul futuro degli LLM, la loro governance e il controllo delle tecnicie emergenti. Per le aziende che valutano strategie di deployment on-premise, queste vicende evidenziano l'importanza di comprendere i modelli di proprietà intellettuale e le dinamiche di mercato che influenzano la disponibilità e l'affidabilità delle soluzioni AI.

Apr 29 2026
Market

Musk vs. OpenAI: il processo che ridefinisce i confini dell'AI enterprise

Il processo Musk contro Altman ha visto accendersi le tensioni con l'interrogatorio di Elon Musk da parte dei legali di OpenAI. Questo scontro legale, giunto al terzo giorno, evidenzia le complessità e le poste in gioco nel panorama dell'intelligenza artificiale. Per le aziende che valutano strategie di deployment on-premise, tali dispute sottolineano l'importanza della sovranità dei dati, del controllo sull'IP e della mitigazione dei rischi legati a dipendenze esterne.

Apr 29 2026
Altro

La domanda satellitare spinge i profitti record di UMT a Taiwan

UMT, azienda taiwanese, ha registrato profitti record grazie alla crescente domanda nel settore satellitare. Questo successo evidenzia l'importanza strategica dei dati satellitari e le implicazioni per l'infrastruttura IT, in particolare per le soluzioni di deployment on-premise e la gestione della sovranità dei dati nell'era dell'intelligenza artificiale e dei Large Language Models.

Apr 29 2026
Market

Nvidia e la corsa ai chip AI: la visione del CEO sui TPU di Google

Il CEO di Nvidia ha espresso la sua prospettiva sulla competizione nel mercato dei chip per l'intelligenza artificiale, affermando che i TPU di Google non rappresentano una minaccia significativa. Questa dichiarazione si inserisce in un contesto di crescente domanda di acceleratori AI, dove le aziende valutano attentamente le soluzioni hardware per carichi di lavoro on-premise, considerando fattori come performance, TCO e sovranità dei dati.

Apr 29 2026
Market

L'AI spinge la domanda di interconnessioni di potenza: BizLink e JPC puntano al segmento premium

L'espansione dell'intelligenza artificiale sta generando un'impennata nella richiesta di interconnessioni di potenza ad alte prestazioni. Aziende come BizLink e JPC si stanno posizionando per servire i mercati di fascia alta, rispondendo alle esigenze di infrastrutture AI sempre più complesse e potenti, cruciali per i deployment on-premise e le architetture distribuite che richiedono controllo e sovranità dei dati.

Apr 29 2026
Altro

La carenza di TPU di Google e la sfida dell'infrastruttura AI

La carenza di Tensor Processing Units (TPU) di Google sta mettendo in luce una crescente disparità nell'infrastruttura dedicata all'intelligenza artificiale. Questo scenario evidenzia come l'accesso a hardware specializzato sia cruciale per lo sviluppo e il deployment di Large Language Models, influenzando le strategie di aziende che valutano soluzioni self-hosted o cloud per i loro carichi di lavoro AI.

Apr 29 2026
Altro

Cina blocca nuovi permessi per la guida autonoma dopo incidente Baidu

La Cina ha sospeso il rilascio di nuovi permessi per i veicoli a guida autonoma, una decisione che segue un incidente che ha coinvolto un robotaxi Baidu Apollo Go. Questo evento sottolinea le complesse sfide tecniche e normative che il settore deve affrontare, evidenziando l'importanza di infrastrutture AI robuste e di strategie di deployment che garantiscano sicurezza e controllo, spesso orientate verso soluzioni self-hosted o edge computing.

Apr 29 2026
Market

Microsoft: Copilot supera i 20 milioni di utenti paganti, smentendo i dubbi sull'adozione

Microsoft ha annunciato che Copilot ha raggiunto oltre 20 milioni di utenti paganti, con un'adozione e un coinvolgimento in crescita. Questa dichiarazione mira a dissipare la percezione diffusa di un utilizzo limitato, evidenziando una solida penetrazione degli assistenti AI nel panorama aziendale e sollevando questioni strategiche per le imprese riguardo al deployment di Large Language Models.

Apr 29 2026
Altro

OpenAI potenzia Stargate: l'infrastruttura di calcolo per l'era dell'AGI

OpenAI sta espandendo il suo progetto Stargate, un'iniziativa strategica per costruire l'infrastruttura di calcolo necessaria a sostenere lo sviluppo dell'Intelligenza Artificiale Generale (AGI). L'azienda sta aumentando la capacità dei propri data center per rispondere alla crescente domanda di risorse computazionali nel settore dell'AI, sottolineando l'importanza critica di un'infrastruttura robusta per le future innovazioni.

Apr 29 2026
LLM

Qwen 27B per lo sviluppo software: un'analisi dall'esperienza sul campo

Un dibattito tra sviluppatori esplora le capacità di Qwen 27B per compiti di programmazione quotidiana. Il modello, nonostante le sue dimensioni, mostra prestazioni sorprendenti, ma la fiducia nella sua adozione completa rispetto a soluzioni cloud consolidate, come l'enigmatico GPT-5.5, rimane un punto interrogativo. L'analisi si concentra sull'uso pratico per debugging, refactoring e architettura software.

Apr 29 2026
Market

Google Cloud supera i 20 miliardi, ma la crescita AI frena per limiti di capacità

Google Cloud ha raggiunto per la prima volta i 20 miliardi di dollari di ricavi trimestrali, spinto dalla forte domanda di servizi AI. Tuttavia, l'azienda ha dichiarato che la crescita avrebbe potuto essere ancora più rapida se non fosse stata limitata dalle attuali capacità infrastrutturali.

Apr 29 2026
LLM

Modelli LLM Densi: La Sfida dell'Inference On-Premise per le Aziende

Il panorama dei Large Language Models (LLM) sta assistendo a una crescente preferenza per architetture più dense, come quelle proposte da Mistral AI. Questa tendenza, sebbene promettente per le capacità dei modelli, pone nuove sfide significative per le aziende che mirano a implementare soluzioni di intelligenza artificiale on-premise, richiedendo un'attenta valutazione dell'hardware e dell'infrastruttura per garantire efficienza e controllo sui dati.

Apr 29 2026
Market

Google accelera sulle sottoscrizioni: YouTube e Google One trainano la crescita

Google ha registrato un aumento significativo nel primo trimestre, aggiungendo 25 milioni di nuove sottoscrizioni a pagamento. Questo incremento porta il totale a 350 milioni, con YouTube e Google One identificati come i principali motori di questa espansione. La performance evidenzia la capacità dell'azienda di consolidare la propria base utenti attraverso servizi diversificati.

Apr 29 2026
Altro

Deepfake e furto di dati: l'AI minaccia la sicurezza personale

Ricercatori hanno evidenziato come truffatori sfruttino filmati manipolati tramite intelligenza artificiale, spesso interviste a celebrità, per ingannare gli utenti e indurli a condividere dati personali. Questo fenomeno, esemplificato da annunci deepfake su piattaforme come TikTok, solleva serie preoccupazioni sulla sovranità dei dati e la necessità di difese robuste contro l'abuso dell'AI.

Apr 29 2026
Altro

Apple corregge una falla che consentiva all'FBI di recuperare messaggi Signal eliminati

Apple ha rilasciato un aggiornamento cruciale per iOS, risolvendo una vulnerabilità che permetteva all'FBI di estrarre copie di messaggi Signal in arrivo da iPhone, anche dopo l'eliminazione dell'applicazione. La falla, che conservava i dati nel database delle notifiche, è stata corretta in seguito a un'indagine di 404 Media. L'intervento di Apple impedisce ora il salvataggio di tali messaggi e ne elimina le copie esistenti, rafforzando la privacy degli utenti.

Apr 29 2026
Altro

Il Futuro degli LLM Locali: Verso un Modello "Plug-and-Play" e Servizi Specializzati

Un utente Reddit ha condiviso una visione audace: entro i prossimi cinque anni, gli LLM locali potrebbero diventare comuni come gli elettrodomestici, dando vita a una nuova economia di servizi specializzati per l'installazione e la manutenzione. Questa prospettiva solleva interrogativi sulle implicazioni per il deployment on-premise e la gestione dell'infrastruttura AI in contesti aziendali, sottolineando la crescente domanda di controllo e sovranità dei dati.

Apr 29 2026
LLM

Il mistero dei goblin nei prompt di sistema di OpenAI Codex

Una recente scoperta nel codice open source di OpenAI Codex CLI ha rivelato una direttiva sorprendente per il modello GPT-5.5: "non parlare mai di goblin". Questa insolita istruzione, ripetuta due volte in un set di oltre 3.500 parole di istruzioni di base, suggerisce una sfida inattesa nel controllo del comportamento degli LLM. La trasparenza e la personalizzazione dei prompt di sistema sono cruciali per le aziende che cercano sovranità dei dati e controllo sui deployment on-premise.

Apr 29 2026
Market

Runway: dal video AI ai "world models", la visione del CEO

Runway, azienda di New York valutata 5,3 miliardi di dollari con quasi 860 milioni di finanziamenti, si afferma nel settore del video generativo AI. I suoi modelli competono con giganti come Google e OpenAI. Il CEO dell'azienda anticipa che la prossima frontiera dell'intelligenza artificiale saranno i "world models", superando l'attuale focus sul video.

Apr 29 2026
Market

Parallel Web Systems raggiunge una valutazione di 2 miliardi di dollari

La startup Parallel Web Systems, fondata dall'ex CEO di Twitter Parag Agrawal e specializzata in strumenti per agenti AI, ha completato un nuovo round di finanziamento da 100 milioni di dollari, guidato da Sequoia. Questo porta la sua valutazione a 2 miliardi di dollari, a pochi mesi da un precedente aumento di capitale di pari entità, evidenziando un rapido interesse nel settore.

Apr 29 2026
Hardware

Intel Lunar Lake: l'evoluzione delle performance CPU su Linux

L'analisi si concentra sull'evoluzione delle performance della CPU Intel Lunar Lake su sistemi Linux. Dopo aver esaminato i guadagni prestazionali della grafica integrata Xe2, l'attenzione si sposta sulle capacità di calcolo del processore. I benchmark, condotti su un periodo di un anno a partire da aprile 2025, mirano a delineare come le prestazioni della CPU si siano sviluppate in questo ambiente operativo, offrendo spunti per chi valuta l'hardware per carichi di lavoro on-premise.

Apr 29 2026
Hardware

SenseTime lancia un modello di immagini ottimizzato per chip cinesi e l'Open Source

Nonostante le restrizioni statunitensi che limitano l'accesso a tecnicie avanzate, l'azienda cinese SenseTime ha rilasciato un nuovo modello di intelligenza artificiale per l'elaborazione di immagini. Il modello è stato progettato per la velocità e ottimizzato per funzionare su chip di produzione cinese, segnando un'accelerazione nell'adozione di strategie Open Source.

Apr 29 2026
Market

Sviluppo data center in Medio Oriente in pausa dopo attacchi: impatto su AI e cloud

Pure Data Centres Group ha sospeso gli investimenti in Medio Oriente a seguito di danni subiti da una sua struttura per un attacco iraniano. La decisione riflette una più ampia riconsiderazione da parte di investitori e aziende tech sui piani di espansione di data center per AI e cloud nei Paesi del Golfo, stimati in un trilione di dollari, a causa dell'escalation del conflitto.

Apr 29 2026
Altro

LLM: un esperimento svela la facilità di manipolazione e i rischi per l'integrità dei dati

Un recente esperimento ha dimostrato quanto sia semplice indurre i Large Language Models a generare informazioni false, manipolando fonti web con un costo minimo. Un ingegnere della sicurezza ha convinto diversi chatbot dell'esistenza di un campione mondiale inesistente, evidenziando le sfide per l'integrità dei dati e la fiducia nelle risposte. Questo solleva interrogativi cruciali per le aziende che valutano deployment on-premise e la sovranità dei dati.

Apr 29 2026
Altro

Conferenza RightsCon 2026 a Lusaka: il governo dello Zambia ne annuncia il rinvio improvviso

La conferenza RightsCon 2026, uno degli appuntamenti globali più rilevanti sui diritti umani digitali, è stata improvvisamente rinviata dal governo dello Zambia pochi giorni prima del suo inizio a Lusaka. L'annuncio, che ha colto di sorpresa migliaia di ricercatori e partecipanti, ha generato confusione. Le motivazioni ufficiali riguardano la necessità di allineamento con procedure nazionali e protocolli diplomatici, oltre a questioni di autorizzazione per alcuni relatori.

Apr 29 2026
LLM

Google Photos e l'AI: il guardaroba di 'Clueless' diventa realtà virtuale

Google Photos sfrutta l'intelligenza artificiale per ricreare il celebre guardaroba di Cher Horowitz dal film 'Clueless'. Questa iniziativa evidenzia come l'AI stia integrandosi in applicazioni di consumo per offrire esperienze interattive e personalizzate, dimostrando la maturità delle tecnicie di visione artificiale e di elaborazione del linguaggio. L'applicazione, sebbene consumer-oriented, solleva questioni sulle capacità di inference e sui requisiti infrastrutturali per carichi di lavoro AI complessi.

Apr 29 2026
LLM

Mistral Medium 3.5: Nuove Opzioni di Deployment con Licenza Specifiche

Mistral AI ha rilasciato Mistral Medium 3.5, un Large Language Model che si distingue per le sue "Open Weights" e una licenza MIT modificata. Quest'ultima richiede il pagamento di una licenza per l'uso commerciale, introducendo considerazioni importanti per le aziende che valutano deployment on-premise e la sovranità dei dati. Il modello promette prestazioni elevate in relazione al suo numero di parametri, un fattore chiave per l'efficienza infrastrutturale.

Apr 29 2026
Market

LG Electronics e Nvidia: colloqui su robotica, data center AI e mobilità

LG Electronics e Nvidia hanno avviato discussioni per una potenziale collaborazione strategica in robotica, data center per l'intelligenza artificiale e mobilità. L'iniziativa, partita da Nvidia, mira a rafforzare le ambizioni di LG nell'AI fisica e a espandere la presenza di Nvidia nel settore dell'elettronica di consumo, in un momento cruciale per l'adozione dell'AI in ambito industriale.

Apr 29 2026
LLM

IBM presenta la famiglia Granite 4.1: modelli da 3 a 30 miliardi di parametri

IBM ha annunciato la nuova famiglia di Large Language Models Granite 4.1, disponibile in versioni da 3, 8 e 30 miliardi di parametri. Questi modelli offrono alle aziende opzioni flessibili per il deployment di LLM, bilanciando requisiti di performance, risorse infrastrutturali e considerazioni sulla sovranità dei dati, aspetti cruciali per le strategie on-premise.

Apr 29 2026
Altro

OpenAI Abbandona i Data Center Stargate: Priorità alla Flessibilità e al Leasing di Compute

OpenAI ha rivisto la sua strategia infrastrutturale, abbandonando l'idea di data center proprietari dedicati al progetto Stargate. L'azienda preferisce ora il leasing di risorse di calcolo per maggiore flessibilità, chiarendo che "Stargate" è un termine ombrello piuttosto che un'iniziativa di costruzione di infrastrutture fisiche. Questo cambio evidenzia un'evoluzione nelle decisioni di deployment per i carichi di lavoro AI.

Apr 29 2026
Altro

Cina avverte l'UE: ritorsioni se Huawei e ZTE saranno escluse dalle reti europee

Il Ministero del Commercio cinese ha formalmente avvertito la Commissione Europea che il suo progetto di Cybersecurity Act, che potrebbe imporre per la prima volta l'esclusione di fornitori specifici dalle reti europee, scatenerebbe ritorsioni. Pechino ha presentato un documento di 30 pagine, minacciando misure reciproche contro le aziende europee in Cina qualora Huawei e ZTE venissero bandite. La mossa evidenzia le crescenti tensioni geopolitiche nel settore tecnicico.

Apr 29 2026
LLM

Mistral Medium 3.5: Un LLM da 128B con finestra di contesto da 256k

Mistral AI ha presentato Mistral Medium 3.5, un LLM denso da 128 miliardi di parametri con una finestra di contesto di 256k token. Il modello è multimodale, supporta funzionalità di ragionamento configurabili e si propone come soluzione unificata per istruzioni, ragionamento e coding, sostituendo le versioni precedenti. La sua architettura lo rende un candidato interessante per deployment on-premise che richiedono controllo e sovranità dei dati.

Apr 29 2026
Frameworks

OpenCL introduce estensioni Cooperative Matrix per l'Inference AI

L'API OpenCL sta integrando estensioni Cooperative Matrix, una mossa che segue l'introduzione di funzionalità simili in Vulkan nel 2023. Queste estensioni sono progettate per ottimizzare le operazioni di Inference di machine learning e intelligenza artificiale, offrendo nuove opportunità per l'accelerazione hardware e il deployment on-premise di carichi di lavoro AI, migliorando l'efficienza e il TCO.

Apr 29 2026
Frameworks

AutoSP: Semplificare il Training di LLM con Contesti Estesi su Multi-GPU

AutoSP, una soluzione basata su compilatore, automatizza l'implementazione della Sequence Parallelism (SP) per il training di Large Language Models (LLM) con contesti lunghi. Integrato in DeepSpeed, risolve i problemi di memoria (OOM) e la complessità associata alla gestione di token oltre i 100k su configurazioni multi-GPU. Questo approccio consente di estendere la lunghezza massima del contesto addestrabile con un impatto minimo sulle performance, semplificando lo sviluppo per i team che operano su infrastrutture self-hosted.

Apr 29 2026
Altro

Un supercluster DGX Spark da 16 unità: potenziale e sfide on-premise

Un utente ha condiviso i dettagli di un ambizioso progetto: assemblare un cluster di 16 unità DGX Spark in un laboratorio domestico, equipaggiato con 2 TB di memoria unificata e una rete ad alta velocità. L'iniziativa solleva interrogativi sulle potenzialità di un tale sistema per carichi di lavoro AI e LLM, evidenziando le implicazioni di un deployment on-premise su larga scala.

Apr 29 2026
Hardware

llama.cpp: NVFP4 nativo accelera l'elaborazione dei prompt su Blackwell

Un recente benchmark su llama.cpp rivela che il supporto nativo per NVFP4 migliora significativamente le prestazioni di elaborazione dei prompt (fino al 68%) per il modello Qwen3.6-27B-NVFP4 su una GPU NVIDIA RTX 5090. La velocità di generazione dei token rimane invariata. Questo vantaggio è cruciale per carichi di lavoro on-premise che richiedono l'ingestione rapida di contesti lunghi, come RAG e analisi documentale.

Apr 29 2026
LLM

Claude e la sicurezza: l'AI scopre una falla critica in GitHub

I ricercatori di Wiz hanno scoperto una vulnerabilità di elevata gravità nell'infrastruttura `git` di GitHub, che consentiva l'accesso completo a repository privati. L'assistenza di Claude, un Large Language Model, ha accelerato significativamente il processo di scoperta, trasformando mesi di lavoro in tempi rapidi e portando a un riconoscimento per il team di Wiz.

Apr 29 2026
Altro

Firestorm Labs raccoglie 82 milioni per portare la produzione di droni sul campo

La startup Firestorm Labs ha ottenuto un finanziamento di 82 milioni di dollari per sviluppare fabbriche di droni mobili. L'iniziativa mira a integrare la produzione direttamente in container marittimi, consentendo il deployment di capacità manifatturiere avanzate in ambienti operativi remoti, come le linee del fronte. Questo approccio sottolinea l'importanza della logistica e della sovranità operativa in contesti critici, riducendo la dipendenza da catene di approvvigionamento tradizionali.

Apr 29 2026
Hardware

La "lotteria del silicio": variabilità inattesa nelle prestazioni GPU cloud

Una ricerca congiunta rivela significative variazioni prestazionali tra GPU dello stesso modello, un fenomeno noto come "lotteria del silicio". Questo impatta il valore del noleggio di risorse cloud per carichi di lavoro AI, con differenze fino al 38% nella larghezza di banda della memoria per le H200 SXM. La causa principale risiede nelle variazioni di fabbricazione dei chip stessi, rendendo il benchmarking delle istanze noleggiate una pratica essenziale.

Apr 29 2026
Altro

Università dell'Arizona: un tool AI acquisisce lezioni senza consenso, scoppia la polemica

L'Università dell'Arizona si trova al centro di una controversia per il rilascio di un tool basato su intelligenza artificiale. Lo strumento genera lezioni acquisendo contenuti dai corsi dei professori senza la loro autorizzazione, sollevando questioni etiche e di sovranità dei dati. Si discute anche di una ricerca Google che nega la coscienza alle Large Language Models.

Apr 29 2026
LLM

Shapes: L'integrazione di LLM nei canali di comunicazione di gruppo

Shapes introduce personaggi AI nelle chat di gruppo, richiamando l'esperienza di piattaforme come Discord. Questa innovazione solleva questioni cruciali per le aziende riguardo al deployment degli LLM, alla sovranità dei dati e ai requisiti infrastrutturali per gestire l'inference on-premise, bilanciando costi e controllo.

Apr 29 2026
Frameworks

Qwen presenta FlashQLA: ottimizzazione delle performance per LLM su dispositivi edge

Qwen ha introdotto FlashQLA, un set di kernel di attenzione lineare ad alte prestazioni basato su TileLang. Progettato per l'AI agentica su dispositivi personali, FlashQLA promette un aumento della velocità di 2-3 volte per il forward pass e di 2 volte per il backward pass. La soluzione mira a migliorare l'utilizzo degli SM e l'efficienza per modelli di piccole dimensioni e carichi di lavoro a lungo contesto, specialmente in scenari di deployment on-premise ed edge.

Apr 29 2026
Hardware

Framework: il nuovo modulo grafico RTX 5070 da 12GB debutta a 1.199 dollari

Framework ha introdotto un nuovo modulo grafico RTX 5070 con 12GB di VRAM, proposto a 1.199 dollari. Questo prezzo rappresenta un aumento del 72% rispetto alla precedente versione da 8GB, che costava 699 dollari. L'azienda ha dichiarato che il costo finale del modulo è influenzato da fattori esterni, evidenziando le sfide nella catena di approvvigionamento e nella determinazione dei prezzi nel settore hardware.

Apr 29 2026
Altro

OpenAI sotto accusa: le decisioni sulla sicurezza degli utenti e le implicazioni legali

OpenAI è oggetto di sette azioni legali in California, accusata di non aver prevenuto una sparatoria di massa in Canada. Le denunce sostengono che l'azienda abbia ignorato le raccomandazioni del proprio team di sicurezza interno, che aveva identificato un utente di ChatGPT come una minaccia credibile di violenza armata. Nonostante le indicazioni di allertare le forze dell'ordine, OpenAI avrebbe privilegiato la privacy dell'utente, disattivando l'account e fornendo istruzioni per aggirare il blocco.

Apr 29 2026
Market

USA bloccano l'export di strumenti a Hua Hong e Huali per la produzione a 7 nm

Gli Stati Uniti hanno imposto un blocco all'esportazione di strumenti tecnicici destinati a Hua Hong e Huali Microelectronics, il secondo produttore di chip cinese. La misura arriva mentre le due aziende sarebbero prossime all'avvio di una fabbrica per la produzione di semiconduttori a 7 nanometri a Shanghai, evidenziando le crescenti tensioni nel settore e le implicazioni per la catena di approvvigionamento globale.

Apr 29 2026
Hardware

Qwen3.6 27B su doppia RTX 5060 Ti 16GB: analisi delle prestazioni on-premise

Un'analisi dettagliata esplora le capacità del modello Qwen3.6 27B su una configurazione locale basata su due GPU NVIDIA RTX 5060 Ti da 16GB. I test evidenziano prestazioni di circa 60-66 token al secondo e la gestione di un contesto esteso fino a 204.800 token, seppur con margini di VRAM molto ridotti. Lo studio offre spunti concreti per chi valuta il deployment di LLM on-premise con hardware di fascia media.

Apr 29 2026
Hardware

Palit centralizza la gestione di Galax: il brand GPU prosegue l'attività

Palit Group ha annunciato una riorganizzazione interna che centralizza la gestione del brand di GPU Galax. Nonostante il cambiamento, l'azienda ha confermato che il marchio Galax, noto per le sue schede grafiche ad alte prestazioni come la linea HOF, continuerà a operare sul mercato. Questa mossa, definita "pre-pianificata", mira a ottimizzare le operazioni sotto l'ombrello del gruppo Palit, assicurando continuità ai clienti e al settore.

Apr 29 2026
Altro

Controllo proprietario e Open Source: il caso Bambu Lab e le implicazioni per l'AI on-premise

Un developer ha riabilitato funzionalità disabilitate su stampanti 3D Bambu Lab, portando a minacce legali e alla chiusura del progetto OrcaSlicer-BambuLab. Questo evento evidenzia le tensioni tra controllo proprietario e comunità Open Source, un tema cruciale per le aziende che valutano deployment di Large Language Models (LLM) on-premise. La capacità di modificare e controllare l'hardware e il software sottostante è fondamentale per la sovranità dei dati e l'ottimizzazione del TCO in ambienti self-hosted.

Apr 29 2026
Market

mbiomics raccoglie 30 milioni di euro per terapie oncologiche basate sul microbioma

L'azienda techbio mbiomics GmbH, con sede a Monaco, ha completato il suo round di finanziamento Series A, raccogliendo 30 milioni di euro. I fondi saranno impiegati per portare avanti lo sviluppo di un prodotto batterico vivo, mirato a migliorare la risposta agli inibitori del checkpoint immunitario nel melanoma avanzato, con uno studio di Fase 1B previsto per il 2027.

Apr 29 2026
Market

AI e costi operativi: quando la spesa supera il lavoro umano, ma non frena le aziende

Un dirigente Nvidia ha evidenziato come l'implementazione di soluzioni AI possa superare i costi del personale umano. Nonostante questa spesa maggiore, alcune aziende non considerano tali investimenti un aspetto negativo, suggerendo una valutazione strategica che va oltre il mero confronto economico diretto. Questo scenario apre a riflessioni sui trade-off tra CapEx e OpEx nel deployment di LLM on-premise e sull'importanza della sovranità dei dati.

Apr 29 2026
Hardware

Intel 18A: l'ottimizzazione dei wafer aumenta i ricavi e la disponibilità di CPU

Nuovi dettagli rivelano come Intel stia incrementando i ricavi per wafer, grazie a un'attenta ottimizzazione della produzione. Secondo le analisi, la riduzione della variabilità di resa su ciascun wafer, in particolare per il nodo 18A, permette di ottenere un maggior numero di CPU commercializzabili, migliorando l'efficienza e la redditività del processo produttivo.

Apr 29 2026
Altro

OpenAI e la cyber-difesa: un piano in cinque punti per l'era dell'AI

OpenAI ha presentato un piano d'azione in cinque punti per rafforzare la cybersecurity nell'era dell'intelligenza artificiale. L'iniziativa mira a democratizzare le capacità di difesa informatica basate sull'AI e a salvaguardare i sistemi critici, evidenziando l'importanza di strategie proattive per la sicurezza digitale.

Apr 29 2026
Altro

GitHub si scusa per i disservizi: l'affidabilità delle piattaforme è cruciale

GitHub, la piattaforma di code hosting di Microsoft, ha rilasciato un'ampia dichiarazione di scuse per i recenti problemi di disponibilità e affidabilità. L'incidente, evidenziato anche dalle critiche di un co-fondatore di HashiCorp, solleva interrogativi sulla dipendenza da servizi esterni e sull'importanza della stabilità infrastrutturale per lo sviluppo software, inclusi i progetti LLM.

Apr 29 2026
Frameworks

Hipfire: un nuovo motore di inference per GPU AMD con focus sulla quantization

Hipfire è un nuovo motore di inference progettato per ottimizzare le prestazioni dei Large Language Models (LLM) su tutte le GPU AMD. Utilizza una metodologia di quantization `mq4` e, secondo il sito di benchmarking Localmaxxing, offre notevoli accelerazioni nell'inference. Sebbene non sia un progetto ufficiale di AMD, Hipfire rappresenta un'alternativa open source rilevante per i deployment self-hosted, offrendo nuove opportunità per bilanciare costi e controllo nei carichi di lavoro AI.

Apr 29 2026
Altro

Qwen3.6 27B: vLLM e INT4 su Docker per inference locale ad alte prestazioni su 2x RTX 3090

Un recente progetto open source dimostra come sia possibile eseguire il modello Qwen3.6 27B in locale con prestazioni notevoli. Utilizzando un container Docker basato su vLLM, ottimizzato con quantization Lorbus AutoRound INT4 e decodifica speculativa MTP, il sistema raggiunge 118 token al secondo su due GPU NVIDIA RTX 3090. Questa soluzione offre un percorso efficiente per il deployment on-premise di Large Language Models, bilanciando costi e controllo dei dati.

Apr 29 2026
Market

Bolle AI e Prezzi GPU: Il Dilemma dell'Framework Locale

Il rapido sviluppo dell'intelligenza artificiale ha alimentato un'intensa domanda di GPU, ma un'ipotetica "bolla AI" potrebbe alterare radicalmente il mercato. L'articolo esplora due scenari contrapposti: un aumento dei prezzi delle GPU consumer per l'inference locale o un crollo dei prezzi dovuto a un eccesso di offerta di hardware enterprise, analizzando le implicazioni per le strategie di deployment on-premise.

Apr 29 2026
Altro

Heard: Una voce per gli agenti di codice, open source e con esecuzione locale

Heard è un nuovo progetto open source che offre una soluzione per dotare gli agenti di codice di una voce, fornendo output intermedi in tempo reale. Sviluppato come daemon Python e app macOS, Heard si distingue per la sua capacità di operare interamente in locale, garantendo la sovranità dei dati e l'assenza di telemetria. Supporta diversi agenti e offre opzioni per la sintesi vocale, privilegiando l'esecuzione on-device per chi cerca controllo e privacy.

Apr 29 2026
LLM

Ottimizzare gli LLM per il codice: il dibattito sul "pensiero" artificiale

Nel panorama degli LLM per la generazione di codice, emerge una pratica diffusa: disabilitare le fasi di "pensiero" intermedio. Questa strategia, sebbene raccomandata da molti, solleva interrogativi sulle sue motivazioni profonde. L'analisi di questa scelta rivela implicazioni dirette su efficienza, latenza e TCO, aspetti cruciali per i deployment on-premise, dove il controllo delle risorse è prioritario per CTO e architetti di infrastruttura.

Apr 29 2026
Hardware

Lisuan Tech: la GPU LX 7G100 ottiene la certificazione Microsoft WHQL, un primato cinese

Lisuan Tech, produttore cinese di GPU, ha ottenuto la certificazione Microsoft WHQL per la sua scheda grafica LX 7G100. Questo traguardo posiziona l'azienda come il quarto produttore globale a raggiungere tale standard, affiancandosi a Nvidia, AMD e Intel, e segna un primato per una società cinese nel settore. La certificazione è cruciale per l'affidabilità dei driver in ambienti enterprise e per i deployment on-premise.

Apr 29 2026
Market

Dex raccoglie 5,3 milioni di dollari per il recruiting di ingegneri AI

Dex, una startup specializzata nel recruiting di talenti AI, ha annunciato un round di finanziamento seed da 5,3 milioni di dollari. Fondata da un ex consulente di Atomico, l'azienda si propone di connettere ingegneri AI con le imprese che ne hanno più bisogno, operando con un modello di business basato sul successo. Ha già raggiunto 1,8 milioni di dollari di ARR in meno di sei mesi, evidenziando la forte domanda di specialisti nel settore.

Apr 29 2026
Altro

Robotica: oltre l'automazione, l'intelligenza fisica di Eka

I robot di Eka, capaci di compiti complessi come smistare alimenti e avvitare lampadine, mostrano un realismo sorprendente. L'industria si interroga sulla loro effettiva intelligenza fisica, un passo cruciale per replicare la flessibilità umana in ambienti dinamici. Questo scenario evoca il potenziale di un "momento ChatGPT" per la robotica, dove la comprensione del mondo fisico diventa centrale per nuove applicazioni e richiede deployment on-premise per latenza e sovranità dei dati.

Apr 29 2026
Altro

Scout AI Raccoglie 100 Milioni per Addestrare Modelli AI in Contesti Militari

Scout AI, guidata da Coby Adcock, ha ottenuto un finanziamento di 100 milioni di dollari. L'azienda si concentra sullo sviluppo di agenti AI per applicazioni militari, consentendo ai soldati di controllare flotte di veicoli autonomi. Il "campo di addestramento" di Scout AI evidenzia l'impegno verso ambienti controllati e self-hosted per lo sviluppo di queste tecnicie critiche, sottolineando l'importanza della sovranità dei dati e della sicurezza nel settore della difesa.

Apr 29 2026
Altro

GM integra Google Gemini in quattro milioni di veicoli: un'espansione AI su larga scala

General Motors ha annunciato il rilascio di Google Gemini su circa quattro milioni di veicoli negli Stati Uniti tramite aggiornamento OTA. L'integrazione, che sostituisce Google Assistant, rappresenta uno dei più vasti deployment di intelligenza artificiale in ambito automobilistico, sebbene avvenga in un periodo segnato da controversie sulla condivisione dei dati e un imminente ordine della FTC.

Apr 29 2026
Altro

Cognizant acquisisce Astreya per 600 milioni di dollari, rafforzando l'infrastruttura AI

Cognizant ha annunciato l'acquisizione di Astreya, una società specializzata in servizi IT gestiti per l'AI, per 600 milioni di dollari. Questa mossa strategica mira a colmare una lacuna nella sua offerta, potenziando la capacità di progettare, costruire e gestire l'infrastruttura fisica dei data center necessaria per i carichi di lavoro di intelligenza artificiale in ambito enterprise. L'operazione sottolinea l'importanza crescente delle fondamenta hardware e infrastrutturali per il deployment di soluzioni AI.

Apr 29 2026
Altro

SAP restringe l'uso delle API per l'AI: timori di lock-in e sovranità dei dati

SAP ha introdotto una nuova policy che vieta l'uso delle sue API per l'integrazione con sistemi di intelligenza artificiale esterni alle architetture approvate. Questa mossa genera preoccupazioni tra partner e clienti, che temono un "lock-in" tecnicico. Esperti del settore suggeriscono che tale restrizione potrebbe spingere all'adozione di API non documentate, compromettendo la flessibilità e la sovranità dei dati per le aziende che desiderano utilizzare soluzioni AI di terze parti con i propri dati SAP.

Apr 29 2026
Market

Luxshare, fornitore Apple: utili in crescita, ma il flusso di cassa preoccupa

Luxshare, un fornitore chiave di Apple, ha annunciato un aumento degli utili, segnalando una performance positiva sul fronte della redditività. Tuttavia, l'azienda continua a fronteggiare una debolezza nel flusso di cassa. Questa dinamica finanziaria, sebbene specifica per Luxshare, riflette le complessità e le sfide che possono caratterizzare la catena di approvvigionamento globale nel settore dell'elettronica.

Apr 29 2026
Altro

Reliance investe 17 miliardi in un mega-cluster AI in India: la corsa all'infrastruttura

Reliance sta pianificando un investimento massiccio di 17 miliardi di dollari per un cluster di data center dedicati all'intelligenza artificiale a Visakhapatnam, in India. Questa mossa strategica si inserisce nella crescente competizione del paese per costruire capacità computazionale AI, sottolineando l'importanza di infrastrutture locali per la sovranità dei dati e il controllo tecnicico. L'iniziativa riflette una tendenza globale verso deployment on-premise per carichi di lavoro AI critici.

Apr 29 2026
Altro

Qwen 3.6 e Gemma 4: l'efficienza degli LLM on-premise su singola GPU

L'esecuzione locale di Large Language Models come Qwen 3.6 e Gemma 4 sta dimostrando la sua efficacia in scenari lavorativi complessi. Un utente ha evidenziato come questi modelli, se supportati da hardware adeguato come una singola NVIDIA RTX 3090, possano gestire compiti specialistici, offrendo un'alternativa concreta e conveniente ai servizi cloud e garantendo maggiore controllo sui dati.

Apr 29 2026
Market

AI e Resistenza agli Antibiotici: La Sfida dell'Innovazione al Paziente

Il chirurgo britannico Ara Darzi ha evidenziato come l'intelligenza artificiale possa rivoluzionare la diagnosi e il trattamento delle infezioni resistenti ai farmaci. Tuttavia, la mancanza di incentivi adeguati rischia di ostacolare l'adozione di queste innovazioni, impedendo loro di raggiungere efficacemente i pazienti e di generare un impatto concreto sulla salute pubblica.

Apr 29 2026
LLM

DeepSeek avvia i test per il suo modello multimodale con capacità visive

DeepSeek ha dato il via alla fase di "grayscale testing" per il suo nuovo modello, "DeepSeek with Vision". Questa mossa indica un passo significativo nello sviluppo di Large Language Models multimodali, che integrano la comprensione visiva. Il processo di testing graduale è cruciale per validare le performance e la stabilità prima di un rilascio più ampio, ponendo nuove sfide per le strategie di deployment, in particolare per le implementazioni self-hosted.

Apr 29 2026
Market

Dex si assicura 5,3 milioni di dollari per potenziare la piattaforma di matching talenti AI

Dex, startup londinese, ha raccolto 5,3 milioni di dollari in un round di finanziamento seed, portando il totale a 8,4 milioni. La piattaforma utilizza l'intelligenza artificiale per connettere ingegneri software con opportunità di lavoro, offrendo un "agente di talenti" conversazionale. L'obiettivo è superare le inefficienze dei processi di recruitment tradizionali e contrastare l'abuso di AI nelle candidature, espandendosi nel mercato statunitense.

Apr 29 2026
Market

Crescita degli scambi Taiwan-Germania: implicazioni per la supply chain AI on-premise

L'incremento degli scambi commerciali tra Taiwan e Germania nel primo trimestre del 2026, come riportato dal German Trade Office Taipei, evidenzia dinamiche economiche rilevanti. Questo sviluppo, pur non specificando settori, suggerisce potenziali impatti sulla catena di fornitura globale di componenti critici per l'intelligenza artificiale, in particolare per le infrastrutture on-premise. Per le aziende europee, ciò potrebbe influenzare la disponibilità e il TCO delle soluzioni AI, con un'attenzione crescente alla sovranità dei dati.

Apr 29 2026
Hardware

AMD e il potenziale dell'AI locale: un "computer" per l'inference domestica

La crescente capacità dell'hardware consumer, con attori come AMD, sta rendendo sempre più accessibile l'esecuzione di carichi di lavoro AI, inclusi i Large Language Models, direttamente su sistemi locali. Questo sviluppo apre nuove prospettive per l'inference on-premise, offrendo vantaggi in termini di sovranità dei dati e controllo, un tema centrale per CTO e architetti di infrastruttura.

← Precedente Page 74 / 160 Successiva →