🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15944

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

May 25 2026
Frameworks

llama.cpp: Ottimizzazione della Gestione del Contesto per LLM Locali e Agenti

Un recente aggiornamento per `llama.cpp` mira a risolvere le inefficienze nella rielaborazione del contesto, un problema comune nelle applicazioni di agentic coding con Large Language Models locali. La modifica riduce i tempi di attesa e migliora la reattività, evitando la rielaborazione completa del prompt quando strumenti esterni o il modello stesso modificano la cronologia della conversazione. Questo è cruciale per i deployment on-premise, dove l'efficienza delle risorse è prioritaria.

May 25 2026
Altro

Kawasaki apre un centro AI fisico in Silicon Valley, rafforzando i legami con Nvidia

Kawasaki ha inaugurato un nuovo centro di intelligenza artificiale nella Silicon Valley. Questa iniziativa, che sottolinea l'impegno dell'azienda nel settore AI, mira a consolidare ulteriormente la sua collaborazione con Nvidia, un attore chiave nello sviluppo di soluzioni hardware e software per l'AI. Il centro fisico rappresenta un passo significativo per l'innovazione e il Deployment di nuove applicazioni.

May 25 2026
Market

La Nuova Frontiera della Guerra dei Chip AI: Strategie e Investimenti di Nvidia e AMD

Nvidia e AMD stanno ridefinendo le proprie strategie nel mercato dei chip per l'intelligenza artificiale. La riorganizzazione della rendicontazione di Nvidia e l'investimento da 10 miliardi di dollari di AMD a Taiwan segnalano una fase cruciale nella competizione per il dominio dell'hardware AI, con implicazioni dirette per le aziende che valutano deployment on-premise.

May 25 2026
Market

La domanda di server AI spinge la crescita degli ordini, con un focus sul raffreddamento

Il mercato dei server AI registra una forte espansione, trainata dalla crescente adozione di Large Language Models. Questa tendenza evidenzia l'importanza cruciale di componenti infrastrutturali come i driver IC per i motori delle ventole di Weltrend, essenziali per la gestione termica. La robustezza della catena di fornitura di questi elementi è fondamentale per sostenere i deployment on-premise e cloud, influenzando direttamente performance e TCO.

May 25 2026
Hardware

La spinta di Nvidia nel settore CPU con Vera: un impulso per la memoria LPDDR

Nvidia sta espandendo la sua presenza nel mercato delle CPU con il progetto Vera, una mossa che si prevede rafforzerà la domanda di memoria LPDDR. Questa strategia ha implicazioni significative per i principali produttori come Samsung e SK Hynix, evidenziando l'evoluzione delle architetture hardware per i carichi di lavoro AI e le scelte di deployment on-premise.

May 25 2026
Market

xFusion: l'ascesa dei server AI a basso costo e le implicazioni per il self-hosting

Le esportazioni di server AI di xFusion hanno registrato un incremento di quasi un terzo, segnalando una crescente domanda di soluzioni hardware più accessibili. Questa tendenza evidenzia l'importanza dei server a basso costo per le aziende che valutano deployment on-premise, con un impatto significativo sul Total Cost of Ownership e sulla sovranità dei dati.

May 25 2026
Altro

Qwen3.6 27B su V100: 1000 token/s in scenari di inference on-premise

Un recente test su Reddit ha dimostrato la capacità di generare 1000 token al secondo con il modello Qwen3.6 27B su un setup basato su GPU NVIDIA V100, gestendo 128 richieste concorrenti. Questo benchmark evidenzia il potenziale delle configurazioni self-hosted per l'inference di Large Language Models, offrendo spunti cruciali per CTO e architetti infrastrutturali che valutano soluzioni on-premise per carichi di lavoro AI.

May 25 2026
Altro

Occhiali smart: il nuovo punto d'accesso per gli agenti AI e l'elaborazione al confine

Gli occhiali smart stanno emergendo come un nuovo punto d'accesso cruciale per gli agenti di intelligenza artificiale. Questa tendenza suggerisce un'evoluzione nell'interazione uomo-macchina, spostando l'elaborazione AI verso il confine del network. Si aprono nuove sfide e opportunità per il deployment di modelli e la gestione della sovranità dei dati in contesti edge, richiedendo un'attenta valutazione delle implicazioni tecniche e di TCO per le infrastrutture aziendali.

May 25 2026
Frameworks

NeuroNL2LTL: Il Ponte Neurosimbolico tra Linguaggio Naturale e Logica LTL

NeuroNL2LTL è un nuovo framework neurosimbolico che affronta la sfida di tradurre il linguaggio naturale in Logica Temporale Lineare (LTL) con garanzie di correttezza formale. A differenza degli approcci puramente neurali o basati su template, NeuroNL2LTL integra l'apprendimento automatico con la verifica formale, utilizzando un meccanismo di training "verifier-in-the-loop". Il sistema ha dimostrato la sua efficacia su oltre 200.000 requisiti in settori critici come l'aerospaziale e la robotica, garantendo che l'86% degli output sia verificato come soddisfacibile.

May 25 2026
LLM

QASC: Il Chunking Adattivo alle Query che Potenzia i Sistemi RAG

Una nuova ricerca introduce Query-Adaptive Semantic Chunking (QASC), una strategia dinamica per il chunking dei documenti nei sistemi Retrieval-Augmented Generation (RAG). Integrando le query utente nella fase di segmentazione, QASC migliora significativamente la pertinenza e la coerenza dei contesti recuperati. I benchmark mostrano un incremento delle performance fino al 27% rispetto ai metodi tradizionali, offrendo un approccio più efficace per l'ottimizzazione dei Large Language Models in contesti aziendali.

May 25 2026
LLM

Risorse NLP per Hausa e Fongbe: uno sguardo tra disponibilità e lacune

Una recente indagine ha catalogato le risorse testuali e vocali pubblicamente disponibili per Hausa e Fongbe, due lingue dell'Africa occidentale. Lo studio evidenzia una maggiore diversità di risorse testuali per Hausa, mentre Fongbe beneficia di recenti iniziative per la raccolta di dati vocali. Entrambe le lingue sono presenti nei benchmark Masakhane. L'analisi identifica lacune critiche, come la necessità di testi Fongbe più diversificati per dominio e corpora vocali dedicati per Hausa, fattori essenziali per lo sviluppo di LLM efficaci.

May 25 2026
LLM

Misurare l'incertezza degli LLM: un nuovo approccio dalle traiettorie interne

Un recente studio propone un metodo innovativo per quantificare l'incertezza nei Large Language Models (LLM), superando i limiti della probabilità softmax. Analizzando le traiettorie interne degli LLM attraverso undici caratteristiche geometriche e una sonda lineare sparsa, la ricerca offre una calibrazione più accurata dell'incertezza. Questo approccio non solo migliora le prestazioni fino a 21 punti AURC, ma fornisce anche dettagli cruciali su come e dove gli errori si formano all'interno del modello, un aspetto fondamentale per i deployment aziendali.

May 25 2026
LLM

Latent Cache Flow: la comunicazione tra LLM supera i limiti del testo

Una nuova ricerca introduce Latent Cache Flow (LCF), un approccio innovativo per la comunicazione tra Large Language Models (LLM) che supera le inefficienze del testo. LCF consente lo scambio di informazioni tra modelli senza la necessità di decodifica e codifica autoregressiva, riducendo drasticamente la latenza e la perdita di dati. Con adapter significativamente più piccoli e una maggiore accuratezza, LCF offre una soluzione efficiente e flessibile, particolarmente vantaggiosa per deployment on-premise e scenari con contesti LLM differenti.

May 25 2026
LLM

RMA: Un Framework Agente per la Risoluzione di Problemi Matematici di Ricerca

Research Math Agents (RMA) è un nuovo framework agente che affronta problemi matematici complessi a livello di ricerca. Distinguendosi dai sistemi precedenti, RMA utilizza un'architettura modulare e un workflow iterativo per generare e verificare prove. Ha superato baselines come GPT-5.2R sul benchmark First Proof, risolvendo otto problemi su dieci e producendo dimostrazioni più logiche e leggibili.

May 25 2026
Market

La strategia di AMD in Cina e la sfida al "moat" CUDA di Nvidia

L'analisi si concentra sulle mosse strategiche di Lisa Su, CEO di AMD, nel mercato cinese. L'obiettivo è competere con il consolidato ecosistema CUDA di Nvidia, un fattore chiave nel deployment di Large Language Models. L'articolo esplora le implicazioni di questa rivalità per le aziende che valutano soluzioni on-premise, evidenziando i trade-off tra ecosistemi proprietari e alternative emergenti.

May 25 2026
Hardware

Global PMX e il raffreddamento per server AI: una risposta alla domanda di calcolo

Global PMX si sta orientando verso le soluzioni di raffreddamento per server AI, rispondendo alla crescente domanda di potenza di calcolo. Questo cambiamento sottolinea l'importanza critica della gestione termica per le infrastrutture AI, in particolare nei deployment on-premise, dove l'efficienza del raffreddamento incide direttamente su performance, affidabilità e TCO.

May 25 2026
Market

L'AI accelera la domanda di componenti passivi: il caso degli MLCC

Ample Electronic rileva un significativo aumento nella domanda di componenti passivi MLCC (Multi-Layer Ceramic Capacitor), essenziali per l'elettronica moderna, a causa della crescente adozione dell'intelligenza artificiale. Questo trend evidenzia l'impatto dell'AI sulla catena di fornitura hardware, influenzando la pianificazione infrastrutturale per i deployment on-premise e cloud, e sottolineando l'importanza di componenti spesso sottovalutati.

May 25 2026
Altro

I data center AI spingono l'adozione di HVDC a 800V: impatto sulla supply chain asiatica

La crescente domanda di infrastrutture per l'intelligenza artificiale sta accelerando l'adozione di sistemi di alimentazione HVDC a 800V nei data center. Questa transizione, mirata a migliorare efficienza e densità di potenza, genera un impatto significativo sulla supply chain, in particolare per i fornitori taiwanesi di lead frame, evidenziando le sfide infrastrutturali per i deployment on-premise e la gestione del TCO.

May 25 2026
Altro

Topco e Bloom Energy: a Taiwan il primo sistema energetico on-site a basse emissioni per data center

Topco e Bloom Energy hanno collaborato per installare a Taiwan il primo sistema di alimentazione on-site basato su celle a combustibile a ossido solido (SOFC) per un data center. Questa iniziativa segna un passo significativo verso l'adozione di infrastrutture IT a basse emissioni di carbonio, garantendo al contempo sovranità energetica e controllo diretto sull'alimentazione, aspetti cruciali per i deployment on-premise. Il progetto evidenzia l'impegno verso soluzioni energetiche sostenibili nel settore dei data center.

May 25 2026
Frameworks

llama.cpp: Un'Ottimizzazione Ingegno per Accelerare il KV Cache Locale

llama.cpp ha introdotto un'ingegnosa ottimizzazione nel suo llama-server, che accelera la decodifica del KV cache rialimentando immediatamente i token generati. Questa tecnica riduce drasticamente la latenza di elaborazione dei prompt, passando da decine di secondi a tempi quasi istantanei in scenari di generazione estesa o input complessi. L'approccio, sebbene non convenzionale, migliora significativamente la reattività dei Large Language Models in ambienti self-hosted.

May 25 2026
Altro

Stellantis e Qualcomm: l'espansione globale di Snapdragon Digital Chassis

Stellantis e Qualcomm hanno annunciato un'espansione significativa del deployment della piattaforma Snapdragon Digital Chassis. Questa mossa strategica mira a integrare ulteriormente le capacità di calcolo avanzate e la connettività nelle linee di veicoli globali di Stellantis. L'iniziativa sottolinea l'importanza crescente dell'elettronica e del software nell'industria automobilistica, con implicazioni per l'elaborazione dati a bordo e la gestione delle funzionalità AI.

May 25 2026
Altro

Singapore: un nuovo testbed fisico per l'AI nel Punggol Digital District

Singapore ha inaugurato un testbed fisico dedicato all'intelligenza artificiale nel Punggol Digital District. Questa iniziativa strategica mira a fornire un ambiente controllato per lo sviluppo e il test di soluzioni AI, ponendo l'accento su infrastrutture dedicate e la gestione diretta dei dati. L'approccio riflette la crescente importanza del deployment on-premise per le aziende che cercano sovranità dei dati e ottimizzazione delle performance per i Large Language Models.

May 25 2026
Hardware

Huawei investe nei chip InP per potenziare il networking ottico AI

Huawei ha annunciato un investimento strategico in Milphoton Semiconductor, una startup specializzata in chip basati su Indium Phosphide (InP). L'iniziativa mira a rafforzare le capacità di networking ottico per le infrastrutture di intelligenza artificiale, un settore cruciale per gestire i crescenti volumi di dati e le esigenze di throughput dei Large Language Models. Questo passo evidenzia l'importanza delle interconnessioni ad alta velocità nei deployment AI.

May 25 2026
Market

Competizione nel silicio e successi on-premise: le sfide di TSMC e Agibot

Il panorama tecnicico è in fermento: TSMC affronta una crescente concorrenza nel settore dei semiconduttori, un fattore cruciale per la catena di fornitura dell'AI. Parallelamente, Agibot annuncia un successo del 100% nei suoi deployment in fabbrica, evidenziando il potenziale delle soluzioni on-premise per l'automazione industriale e la sovranità dei dati.

May 25 2026
Market

Nvidia, Intel e AMD nell'AI: la catena di fornitura server fronteggia carenze critiche

Nvidia, Intel e AMD sono attori centrali nel panorama dell'intelligenza artificiale, ma la catena di fornitura di server specializzati per l'AI sta affrontando una carenza di tre risorse critiche. Questa situazione evidenzia la forte domanda di componenti specifici per l'AI, con potenziali impatti sui tempi di consegna e sui costi per le aziende che pianificano deployment on-premise di Large Language Models.

May 25 2026
Market

Alleanza strategica nel settore tech: un rappresentante WT Microelectronics alla guida di Nichidenbo

Nichidenbo ha nominato un rappresentante di WT Microelectronics come presidente, consolidando un accordo di scambio azionario. Questa mossa strategica evidenzia l'importanza delle alleanze nella filiera tecnicica, influenzando indirettamente la disponibilità e il costo di componenti cruciali per l'infrastruttura AI, inclusi i deployment on-premise.

May 25 2026
Market

La spesa per l'AI ridefinisce i contratti SaaS: più controllo e trasparenza

L'incremento della spesa per l'intelligenza artificiale sta spingendo le aziende a rinegoziare i contratti SaaS, cercando maggiore flessibilità e nuove protezioni sui prezzi. Questa tendenza riflette la necessità di un controllo più stringente sui costi e sulla gestione dei dati, specialmente per i carichi di lavoro legati ai Large Language Models, e spinge verso la valutazione di soluzioni self-hosted e on-premise.

May 25 2026
Altro

Taiwan e l'AI Open Source: Collaborazione Industriale a COMPUTEX

Il padiglione "Open Source Team Taiwan" a COMPUTEX metterà in luce l'impegno dell'isola nell'intelligenza artificiale e la collaborazione industriale. L'iniziativa sottolinea il ruolo cruciale dell'open source nello sviluppo di soluzioni AI, offrendo alle aziende maggiore controllo e flessibilità. Questo approccio è particolarmente rilevante per le strategie di deployment on-premise, dove sovranità dei dati e ottimizzazione del TCO sono priorità per i decision-maker tecnicici.

May 25 2026
Altro

LLM On-Premise per l'Educazione: Generazione Ricorsiva di Testi Interattivi Personalizzati

Un nuovo approccio all'educazione, denominato "Generative Recursive Education", sfrutta i Large Language Models (LLM) per creare testi didattici interattivi e personalizzati in tempo reale. Questa metodologia offre la possibilità di adattare i contenuti alle esigenze individuali degli studenti, con implicazioni significative per le organizzazioni che valutano il deployment di LLM in ambienti self-hosted, privilegiando il controllo sui dati e la personalizzazione profonda.

May 24 2026
LLM

World Models nell'AI Incarnata: Fondamenti e Implicazioni di Deployment

I World Models rappresentano una frontiera chiave nell'AI incarnata, consentendo agli agenti autonomi di costruire una comprensione interna del loro ambiente. Questo approccio riduce la necessità di esplorazione fisica e accelera l'apprendimento. L'articolo esplora i fondamenti tecnici e le significative implicazioni di deployment, evidenziando i requisiti computazionali e la crescente rilevanza delle soluzioni on-premise per la sovranità dei dati e il TCO.

May 24 2026
Market

Syntec Technology: Profitti record grazie all'AI e all'automazione industriale

Syntec Technology ha registrato profitti record, spinti dalla crescente domanda di soluzioni di automazione industriale basate sull'intelligenza artificiale. Questo trend evidenzia l'impatto trasformativo dell'AI nei settori manifatturieri e la necessità di infrastrutture robuste per supportare tali carichi di lavoro.

May 24 2026
Market

L'India accelera sulle ambizioni dei chip: sfide e opportunità per l'ecosistema

L'India sta intensificando gli sforzi per affermarsi nel settore dei semiconduttori, un'iniziativa strategica volta a rafforzare la propria sovranità tecnicica. Nonostante l'impegno, il paese si trova ad affrontare significative lacune nell'ecosistema, dalla carenza di talenti alle infrastrutture, che rappresentano ostacoli cruciali per la piena realizzazione di queste ambizioni. Questo percorso ha implicazioni dirette per il futuro dei deployment AI on-premise e la sicurezza delle catene di approvvigionamento globali.

May 24 2026
Altro

Data center AI: l'energia on-site come risposta ai limiti della rete

L'espansione dei carichi di lavoro AI sta spingendo i data center a considerare soluzioni di alimentazione on-site. Questa tendenza, discussa al Tech Forum 2026, emerge come strategia chiave per mitigare le crescenti limitazioni delle reti elettriche tradizionali e garantire la continuità operativa per l'inference e il training di LLM, evidenziando le sfide infrastrutturali e i trade-off economici.

May 24 2026
Altro

Catene di Fornitura Affidabili: L'Impatto Strategico sui Deployment AI On-Premise

Un recente vertice negli Stati Uniti ha evidenziato una transizione verso catene di fornitura più affidabili, ridisegnando le partnership manifatturiere globali. Questo cambiamento ha profonde implicazioni per le aziende che gestiscono carichi di lavoro AI, influenzando le decisioni su infrastruttura, sovranità dei dati e sicurezza, spingendo verso un maggiore controllo sui deployment on-premise e la valutazione del TCO.

May 24 2026
Altro

La sicurezza AI: un percorso in evoluzione per l'intero settore, Google inclusa

La sicurezza nell'ambito dell'intelligenza artificiale rappresenta una sfida dinamica e in tempo reale per tutte le organizzazioni, dai piccoli team alle grandi aziende come Google. Il settore si trova in una fase di transizione, dove la definizione di best practice e strategie di difesa efficaci è ancora in corso, richiedendo un'attenzione costante e un approccio proattivo alla protezione dei sistemi LLM.

May 24 2026
Frameworks

Interfacce utente per LLM on-premise: il dibattito sulle soluzioni locali

La gestione e l'interazione con i Large Language Models (LLM) in ambienti self-hosted rappresenta una sfida crescente per le aziende. Un recente dibattito online ha evidenziato la ricerca di soluzioni frontend efficaci, bilanciando la necessità di personalizzazione con i limiti delle opzioni predefinite, un tema cruciale per chi valuta deployment on-premise.

May 24 2026
Frameworks

Tool Calling negli LLM: Funzionalità Avanzate e Implicazioni On-Premise

La crescente complessità degli LLM e l'emergere di funzionalità come il 'tool calling' generano interrogativi sulla loro natura e accessibilità. Questo articolo esplora come gli LLM possano interagire con strumenti esterni, analizzando le implicazioni per i deployment self-hosted, la sovranità dei dati e il controllo aziendale, aspetti cruciali per CTO e architetti infrastrutturali.

May 24 2026
Altro

Linux 7.1-rc5: L'AI Contribuisce alle Correzioni del Kernel

La quinta release candidate di Linux 7.1 è stata rilasciata, con un'accelerazione delle correzioni che, in parte, provengono da agenti di codifica basati sull'intelligenza artificiale. Questo segna un'evoluzione significativa nel processo di sviluppo del kernel, evidenziando il ruolo crescente dell'AI nella manutenzione di software critici e sollevando interrogativi sulle implicazioni per le infrastrutture on-premise e la sovranità dei dati.

May 24 2026
LLM

McKinsey lancia uno strumento AI gratuito per la preparazione ai colloqui

McKinsey ha introdotto ad aprile uno strumento basato su intelligenza artificiale, disponibile gratuitamente a livello globale, per supportare i candidati ai ruoli entry-level di business analyst e associate. La piattaforma offre tentativi illimitati per i case study quantitativi, con l'obiettivo di democratizzare l'accesso a risorse di preparazione di alta qualità, riducendo la dipendenza da costosi coach esterni.

May 24 2026
Altro

LLM da 35 Miliardi di Parametri su GTX 1060 6GB: Un Caso di Studio On-Premise

Un utente ha dimostrato la capacità di eseguire un LLM da 35 miliardi di parametri, il `qwen3.6-35B-a3b-MTP-GGUF UD Q4_K_XL`, su una workstation Dell T5810 equipaggiata con una GPU NVIDIA GTX 1060 da 6GB di VRAM. Nonostante l'hardware datato (CPU Intel Xeon E5-2698v3, 32GB DDR3 RAM), il modello ha raggiunto prestazioni utilizzabili per la chat, con un prefill di 16k token a 130-150 tps e un decode di 4k token a 16 tps, sfruttando LMStudio e tecniche di offloading. Questo evidenzia il potenziale dell'hardware esistente per i deployment on-premise.

May 24 2026
Altro

APC PowerForge: La Trasformazione 3D da Prompt con Dell e NVIDIA a DTW 2026

A Dell Tech World 2026, APC ha presentato il sistema PowerForge, una soluzione rack sviluppata in collaborazione con Dell e NVIDIA. La dimostrazione ha evidenziato la capacità di generare modelli 3D direttamente da un input testuale, per poi stamparli fisicamente in tempo reale sul palco. Questo approccio sottolinea il potenziale dell'intelligenza artificiale nel prototipazione rapida e nella produzione, offrendo spunti significativi per l'integrazione di LLM in processi industriali on-premise.

May 24 2026
Hardware

NVIDIA e i LLM on-premise: la leadership resisterà fino al 2026?

La posizione dominante di NVIDIA nell'hardware per LLM on-premise è sotto esame in vista del 2026. L'articolo esplora le sfide attuali del deployment locale, le alternative emergenti e le considerazioni strategiche per CTO e architetti, focalizzandosi su TCO, sovranità dei dati e l'evoluzione del panorama degli acceleratori AI.

May 24 2026
LLM

IBM Granite Docling 2stage: analisi delle migliorie per l'OCR on-premise

IBM ha rilasciato `granite-docling-2stage-258m`, un Large Language Model (LLM) evoluto per l'OCR che si basa sulla versione precedente. La modifica chiave risiede nella generazione dinamica di prompt che precomputano gli oggetti di layout della pagina, puntando a una maggiore robustezza con dati fuori distribuzione. Questo sviluppo è particolarmente rilevante per i deployment self-hosted, dove la gestione di documenti eterogenei è una sfida cruciale per CTO e architetti infrastrutturali.

May 24 2026
Altro

Aggiornamento BIOS HP via Windows Update: laptop premium bloccati

Un aggiornamento critico del BIOS, distribuito da HP tramite Windows Update, ha reso inutilizzabili diversi laptop di fascia alta, inclusi i modelli ZBook Ultra G1a ed EliteBook X G1a. Questi update, classificati come essenziali, sono stati applicati automaticamente, senza richiedere l'intervento dell'utente. L'incidente solleva interrogativi sulla gestione degli aggiornamenti automatici in ambienti critici, un tema rilevante anche per le infrastrutture AI on-premise.

May 24 2026
LLM

L'AI nel kernel Linux: Copilot e Claude Code risolvono bug in driver grafici e WiFi

Questa settimana, un consistente numero di patch per il kernel Linux è stato corretto con il contributo di agenti AI come GitHub Copilot e Claude Code. Questi strumenti hanno supportato la risoluzione di problematiche relative ai driver grafici e WiFi, evidenziando la crescente integrazione dell'intelligenza artificiale nello sviluppo di componenti software critici. Il fenomeno sottolinea l'evoluzione delle metodologie di coding e l'impatto degli LLM nel settore.

May 24 2026
Altro

Anthropic nella lista nera USA: l'NSA continua a usare Claude per assenza di alternative

Il governo degli Stati Uniti ha ufficialmente inserito Anthropic nella lista nera per rischi alla sicurezza della supply chain. Nonostante ciò, la NSA continua a utilizzare un modello avanzato di Anthropic, Claude, a causa della mancanza di alternative valide. La decisione, autorizzata dal capo di gabinetto della Casa Bianca, Susie Wiles, evidenzia una complessa dicotomia tra sicurezza nazionale e necessità operative nel settore dell'AI.

May 24 2026
Market

Apple Watch: rallenta l'innovazione, i rivali senza schermo guidano la prossima fase

Dopo undici anni e 100 miliardi di dollari di vendite stimate, l'Apple Watch mostra segni di rallentamento nell'innovazione. Le preferenze dei consumatori si stanno spostando verso dispositivi indossabili meno intrusivi e privi di schermo, mettendo a rischio la leadership di Apple nel mercato che ha contribuito a creare.

May 24 2026
LLM

Gemma 4: La Community Valuta le Versioni Ottimizzate per i Deployment Locali

La community tech è al centro del dibattito sulle versioni ottimizzate di Gemma 4, in particolare i modelli 31B e 26B-A4B. La ricerca di implementazioni stabili e performanti per l'inference on-premise evidenzia l'importanza del feedback degli utenti per CTO e architetti infrastrutturali che valutano soluzioni self-hosted, bilanciando requisiti di VRAM e TCO.

May 24 2026
LLM

BitCPM-CANN: Addestramento NATIVO di LLM a 1.58-bit su NPU Ascend

La ricerca BitCPM-CANN introduce un sistema di addestramento per Large Language Models (LLM) a 1.58-bit (ternari) ottimizzato per le NPU Huawei Ascend. Questa innovazione permette di mantenere elevate capacità di ragionamento su modelli fino a 8 miliardi di parametri, con una riduzione della memoria per i pesi fino a 8x in fase di inference e un overhead minimo del 4.5% durante l'addestramento. Rappresenta un passo significativo per l'adozione di LLM a basso bit su hardware alternativo a CUDA.

May 24 2026
Altro

Amazon Bee: il wearable AI tra comodità e dilemmi sulla privacy

Il nuovo wearable AI di Amazon, il Bee, si inserisce nel panorama dei dispositivi intelligenti da indossare, promettendo un'esperienza utente migliorata dalla comodità dell'intelligenza artificiale. Tuttavia, come altri prodotti simili, solleva interrogativi significativi riguardo alla protezione dei dati personali e alla percezione della privacy, generando un dibattito sulla fiducia nell'era dell'AI onnipresente.

May 24 2026
Altro

Qwen e Gemma in locale: un confronto di performance su hardware consumer

L'esperienza di un utente con i Large Language Models Qwen3.6-35B e Gemma4-26B su una GPU Radeon 9070 XT evidenzia i trade-off tra qualità e velocità di inference in un ambiente self-hosted. Mentre Qwen offre risultati apprezzabili, Gemma si distingue per una maggiore rapidità, sottolineando l'importanza dell'ottimizzazione hardware e software per i deployment on-premise.

May 24 2026
Market

Contrabbando di GPU AI: Nvidia e Taiwan stringono i controlli, Supermicro sotto pressione

Un'operazione di contrabbando di chip GPU AI da 2,5 miliardi di dollari, che ha coinvolto Supermicro e destinata alla Cina, ha spinto il CEO di Nvidia, Jensen Huang, a sollecitare l'azienda a rafforzare la conformità ai controlli sulle esportazioni. Contemporaneamente, Taiwan ha avviato una stretta sul traffico illecito di questi componenti critici. La vicenda evidenzia le crescenti tensioni geopolitiche e l'importanza strategica dell'hardware AI, con ripercussioni significative per la supply chain globale e le strategie di deployment on-premise.

May 24 2026
Altro

Linux 7.2: Il kernel si alleggerisce, addio al driver ISA Speech Synthesizer

Il prossimo ciclo del kernel Linux 7.2 proseguirà l'opera di rimozione dei driver hardware obsoleti, iniziata con la versione 7.1. L'obiettivo è ridurre l'onere di manutenzione, eliminando componenti come il driver ISA Speech Synthesizer, probabilmente inutilizzato da decenni. Questa strategia riflette l'evoluzione costante dell'hardware e la necessità di ottimizzare le risorse per le infrastrutture moderne, inclusi i deployment on-premise.

May 24 2026
LLM

Ubisoft sperimenta l'AI generativa in Far Cry 7: tra sfide tecniche e perdite record

Ubisoft sta esplorando l'integrazione dell'AI generativa nel prossimo Far Cry 7. Nonostante l'innovazione, le prime valutazioni interne indicano risultati insoddisfacenti. Questo avviene in un momento critico per l'azienda, che ha recentemente registrato una perdita record di 1,3 miliardi di euro. L'episodio solleva interrogativi sulle sfide tecniche e sui costi associati all'implementazione di tecnicie AI avanzate in contesti di sviluppo complessi come i videogiochi.

May 24 2026
Hardware

Rivoluzionario rivestimento stealth per droni: roccia vulcanica riduce il segnale radar di 43dB

Un nuovo rivestimento stealth 'spray-on', sviluppato da un ricercatore, promette di rivoluzionare la tecnicia dei droni. Basato su una formulazione a base di roccia vulcanica, questo materiale innovativo è in grado di ridurre i segnali di ritorno radar fino a 43 decibel, superando significativamente l'efficacia dei materiali assorbenti radar tradizionali, che tipicamente offrono una riduzione tra i 20 e i 30 dB. Questa scoperta apre nuove prospettive per applicazioni che richiedono discrezione operativa.

May 24 2026
Altro

Sistemi Autonomi: Oltre la Superficie del Deployment On-Premise

L'introduzione di sistemi autonomi, anche in contesti apparentemente semplici, solleva interrogativi cruciali sulle strategie di deployment. Questo articolo esplora le complessità legate all'implementazione on-premise di tali soluzioni, analizzando i requisiti infrastrutturali, le implicazioni per la sovranità dei dati e l'analisi del TCO. Per CTO e architetti, comprendere questi trade-off è fondamentale per decisioni informate che bilancino controllo, sicurezza e costi.

May 24 2026
Frameworks

KernelScript: Un linguaggio per ottimizzare il kernel Linux e le applicazioni

Multikernel Technologies Inc. sta sviluppando KernelScript, un linguaggio specifico di dominio (DSL) progettato per la personalizzazione del kernel Linux e l'ottimizzazione delle applicazioni. Questo strumento si affianca a un'architettura multi-kernel, promettendo maggiore controllo e prestazioni per infrastrutture complesse, particolarmente rilevante per i deployment on-premise dove la gestione granulare delle risorse è cruciale.

May 24 2026
Altro

Manovre Satellitari Russe: Implicazioni per la Sicurezza dei Dati Spaziali

Funzionari statunitensi segnalano movimenti di quattro satelliti russi, e di un quinto, in prossimità di un satellite radar commerciale che fornisce intelligence all'Ucraina. L'episodio solleva interrogativi sulla sicurezza delle infrastrutture spaziali e sulle implicazioni per la sovranità dei dati raccolti, evidenziando l'importanza di strategie di deployment robuste per l'analisi di informazioni sensibili.

May 24 2026
Altro

Ottimizzare i Tempi di Avvio di Linux Embedded: Il Ruolo di Boot-Time Wizard

Mentre per i sistemi desktop e laptop i tempi di avvio di Linux non rappresentano più una criticità, nel mondo dell'embedded la rapidità di startup rimane un fattore cruciale. Il progetto Boot-Time Wizard emerge come una nuova iniziativa volta a supportare i produttori di dispositivi embedded Linux nel ridurre significativamente questi tempi, rispondendo a esigenze specifiche di reattività e affidabilità.

May 24 2026
Market

Moment raccoglie 78 milioni per l'infrastruttura AI nel wealth management

Moment, una fintech fondata da ex trader quantitativi di Citadel Securities, ha chiuso un round di finanziamento da 78 milioni di dollari. L'azienda sviluppa infrastrutture per il deployment di soluzioni AI nel settore del wealth management, mirando a soddisfare le esigenze di controllo e sovranità dei dati tipiche del settore finanziario.

May 24 2026
Market

Stellantis valuta la produzione di EV cinesi in Canada e Messico, escludendo gli Stati Uniti

Il CEO di Stellantis, Antonio Filosa, ha annunciato l'intenzione di produrre e commercializzare veicoli elettrici di marchi cinesi in Messico e potenzialmente in Canada. L'azienda ha escluso gli Stati Uniti da questi piani, citando la mancanza di opportunità attuali. La dichiarazione è stata rilasciata durante una conferenza stampa successiva all'investor day del gruppo.

May 24 2026
LLM

Qwen 3.6-35B Uncensored: un LLM robusto per deployment on-premise

Una variante del modello Qwen 3.6-35B di Alibaba Cloud, denominata Uncensored-Genesis-APEX-MTP, dimostra notevoli capacità di gestione del contesto e stabilità su hardware locale. Ottimizzata con tecniche di Quantization APEX e MTP, questa versione è pensata per ambienti self-hosted, offrendo controllo e sovranità dei dati, aspetti cruciali per le aziende che valutano soluzioni AI on-premise.

May 24 2026
Altro

Un Nuovo Benchmark Open Source per Sistemi Text-to-Speech Locali

Un utente ha sviluppato un benchmark per sistemi Text-to-Speech (TTS) pensato per progetti personali e deployment locali. Il progetto, disponibile su GitHub, offre risultati per Windows e macOS, con test su Linux in arrivo, e mira a supportare chi cerca soluzioni self-hosted con hardware specifico come la NVIDIA RTX 3090 e l'AMD Ryzen 9 5900XT.

May 24 2026
LLM

LLM con capacità visive vs. OCR: un benchmark sui documenti complessi

Un recente benchmark ha confrontato le prestazioni degli LLM con capacità visive native (per l'analisi diretta di PDF) con quelle di pipeline basate su OCR per l'estrazione di informazioni da documenti lunghi e ricchi di immagini. I risultati indicano che gli approcci basati su OCR, in particolare quelli premium con estrazione del layout, hanno superato gli LLM visivi sia in termini di accuratezza che di affidabilità, specialmente con grafici e tabelle. L'approccio nativo ha mostrato anche un tasso di fallimento intrinseco e costi più elevati.

May 24 2026
Altro

llampart 1.0.0: la nuova UI web locale per LLM on-premise e sovranità dei dati

È stata rilasciata la versione 1.0.0 di llampart, un'interfaccia web locale e standalone progettata per interagire con `llama-server` e i Large Language Models (LLM) eseguiti on-premise. llampart si distingue per l'attenzione all'esperienza utente in ambienti locali, offrendo un'interfaccia multilingue, ampie opzioni di personalizzazione e funzionalità avanzate per la gestione delle conversazioni. L'obiettivo è fornire una soluzione robusta e confortevole per chi cerca controllo e sovranità sui propri carichi di lavoro AI, evitando servizi chat ospitati su cloud.

May 24 2026
Frameworks

Wild Linker 0.9: La Velocità di Rust Incontra Nuove Piattaforme e API per Linux

È stato rilasciato Wild Linker 0.9, la nuova versione del linker ad alte prestazioni scritto in Rust per sistemi Linux. Questo aggiornamento introduce una maggiore copertura di piattaforma e una Linker Plugin API, promettendo di ottimizzare ulteriormente i tempi di compilazione e le pipeline di sviluppo. L'efficienza di strumenti come Wild Linker è cruciale per i team che gestiscono infrastrutture complesse, con impatti diretti sul TCO e sulla gestione delle risorse in ambienti on-premise.

May 23 2026
Frameworks

llama.cpp accelera: NVFP4 e Tensor Parallelism multi-GPU per LLM on-premise

Il framework open source llama.cpp introduce il supporto simultaneo per la Quantization NVFP4 e il Multi-GPU Tensor Parallelism (MTP). Questo aggiornamento migliora significativamente l'efficienza e le capacità di scalabilità per l'Inference di Large Language Models su hardware locale. La novità offre a CTO e architetti infrastrutturali nuove opportunità per Deploy LLM più grandi e complessi in ambienti self-hosted, ottimizzando l'utilizzo della VRAM e riducendo il TCO.

May 23 2026
Frameworks

llama.cpp: Strumenti Nativi Integrati Trasformano il Server in un Mini-Agente AI

Il server `llama.cpp` introduce strumenti nativi sperimentali come `exec_shell_command` e `edit_file`, consentendo funzionalità da mini-agente AI direttamente dal binario. Questa integrazione semplifica lo sviluppo di applicazioni locali basate su LLM, eliminando la necessità di wrapper esterni. Tuttavia, l'assenza di sandboxing richiede cautela nell'utilizzo, evidenziando l'importanza della sicurezza nei deployment on-premise.

May 23 2026
Frameworks

I repository AI in rapida crescita: il focus su soluzioni locali e agenti intelligenti

Una recente analisi ha rivelato i repository AI in più rapida crescita, evidenziando una chiara tendenza verso soluzioni local-first, intelligenze artificiali personali e agenti di codice. Questi progetti, che spaziano dalla gestione della conoscenza del codice su dispositivo alla sintesi vocale multilingue e ai framework per LLM in produzione, riflettono l'esigenza di maggiore controllo, sovranità dei dati e deployment on-premise, temi centrali per CTO e architetti infrastrutturali.

May 23 2026
LLM

Embeddings per le Personas Nemotron di NVIDIA: un approccio leggero alla ricerca semantica

Un progetto recente ha generato vettori di Embeddings per il vasto dataset NVIDIA Nemotron-Personas, composto da milioni di profili sintetici dettagliati. Utilizzando l'LLM leggero Qwen 0.6B, è ora possibile effettuare ricerche semantiche e raggruppare le personas in modo efficiente. Questa soluzione, ideale per progetti di agenti locali, evidenzia i vantaggi dei modelli compatti per i deployment on-premise, garantendo controllo e ottimizzazione delle risorse.

May 23 2026
Altro

L'efficienza dell'Inference LLM: il ruolo cruciale del Cache-Hit Rate

L'ottimizzazione dell'inference per i Large Language Models è fondamentale per contenere i costi e migliorare le performance. Un'analisi basata sui dati di OpenRouter evidenzia come i tassi di cache-hit siano un indicatore chiave dell'efficienza dei provider. Questo parametro è cruciale per le aziende che valutano deployment on-premise, influenzando direttamente il Total Cost of Ownership e la scalabilità delle infrastrutture AI.

May 23 2026
LLM

GPT-5.5 e la "Modalità Uomo delle Caverne": Speculazioni sull'Efficienza dei LLM

Un utente ha condiviso osservazioni su un presunto "trace" di GPT-5.5, suggerendo l'uso di una "modalità uomo delle caverne" per ottimizzare il processo di pensiero. La speculazione ruota attorno all'idea di migliorare l'efficienza dei Token tramite la semplificazione di tracce di ragionamento di alta qualità da modelli Open Source, seguita da Fine-tuning. Questa discussione evidenzia la costante ricerca di strategie per rendere i Large Language Models più performanti e meno esosi in termini di risorse.

May 23 2026
Altro

LLM su CPU: valutare Small Language Models per deployment senza GPU

L'interesse per gli Small Language Models (SLM) eseguibili su CPU è in crescita, spinto dalla necessità di contenere i costi e garantire la sovranità dei dati. Questo articolo esplora i fattori chiave – accuratezza, velocità e stack di deployment – che le aziende devono considerare per implementare efficacemente gli SLM in ambienti on-premise privi di accelerazione GPU, analizzando i compromessi tecnici e infrastrutturali.

May 23 2026
Altro

Ferrari e IBM: l'intelligenza artificiale ridefinisce l'esperienza dei fan in F1

La collaborazione tra Scuderia Ferrari HP e IBM mira a trasformare l'esperienza dei tifosi di Formula 1. Attraverso l'impiego dell'intelligenza artificiale di IBM, le due aziende puntano a creare un coinvolgimento più profondo e personalizzato per gli appassionati, esplorando nuove frontiere nell'interazione digitale con il mondo delle corse.

May 23 2026
Altro

Anthropic: Claude Mythos scopre oltre 10.000 vulnerabilità critiche in un mese

Anthropic ha rivelato che la sua iniziativa di cybersecurity, Project Glasswing, supportata da Claude Mythos, ha identificato più di 10.000 potenziali vulnerabilità ad alta o critica gravità in software cruciali in appena un mese. Di queste, oltre mille sono state confermate come critiche, evidenziando la sfida costante nella gestione della sicurezza e la rapidità con cui gli LLM possono analizzare codice.

May 23 2026
LLM

Ottimizzazione VRAM: rimuovere la componente vision dagli LLM per il deployment on-premise

Un utente ha esplorato la rimozione del file `mmproj` da un LLM multimodale (Qwen 3.6 35b a3b) per liberare VRAM, sollevando un quesito cruciale: questa modifica influisce sulle capacità di generazione testuale del modello? La questione è particolarmente rilevante per chi gestisce deployment on-premise, dove l'ottimizzazione delle risorse hardware è fondamentale per l'efficienza e il TCO.

May 23 2026
Market

Samsung: malcontento interno blocca la produzione e i progetti AI

Un'ondata di malcontento sta scuotendo Samsung Electronics dopo che i lavoratori del settore memorie hanno ricevuto un bonus di 400.000 dollari, a fronte dei soli 4.000 dollari destinati ad altre divisioni. Questa disparità ha innescato rallentamenti intenzionali nella produzione, interruzioni nelle operazioni di packaging e, in particolare, ha fermato le decisioni cruciali relative ai progetti di chip per l'intelligenza artificiale.

May 23 2026
Altro

L'AI entra in casa e in ufficio: Jensen Huang e l'adozione degli LLM

L'aneddoto di Jensen Huang, CEO di NVIDIA, che utilizza Claude per lavoro e vede il figlio impiegare agenti AI per la gestione domestica, evidenzia la crescente pervasività dell'intelligenza artificiale. Questo scenario solleva interrogativi cruciali per le aziende riguardo le strategie di deployment degli LLM, bilanciando controllo, sovranità dei dati e Total Cost of Ownership (TCO) tra soluzioni cloud e on-premise.

May 23 2026
Market

Peec AI raddoppia il fatturato: 10 milioni di ARR in sei mesi grazie a ChatGPT

La startup berlinese Peec AI ha superato i 10 milioni di dollari di fatturato annuo ricorrente (ARR) in soli sei mesi. L'azienda offre soluzioni per migliorare la visibilità dei brand nei risultati di ricerca generati dall'intelligenza artificiale, inclusi quelli di piattaforme come ChatGPT, capitalizzando sulla crescente integrazione dell'AI nel panorama della ricerca online.

May 23 2026
Altro

Tokens per joule: la metrica silenziosa per l'efficienza degli LLM on-premise

Mentre il settore dell'intelligenza artificiale è spesso dominato da metriche di pura potenza di calcolo, emerge una misura più sottile ma cruciale: i 'tokens per joule'. Questa metrica, considerata da attori come Microsoft, valuta l'efficienza energetica dei Large Language Models. È fondamentale per chi gestisce deployment on-premise, dove il TCO e la sostenibilità operativa sono prioritari, aiutando a distinguere la vera efficienza dall'iperbole del settore.

May 23 2026
Hardware

Jensen Huang in Taiwan: "Vera Rubin, il più grande lancio di prodotto nella storia dell'informatica"

Il CEO di NVIDIA, Jensen Huang, ha visitato Taiwan e ha definito "Vera Rubin" il più significativo lancio di prodotto nella storia dell'informatica. Questa dichiarazione sottolinea l'importanza strategica delle nuove architetture hardware per l'avanzamento dell'intelligenza artificiale e le implicazioni per i deployment on-premise, dove le capacità di calcolo e la gestione dei dati sono cruciali.

May 23 2026
Altro

Il Disgelo Artico Minaccia le Sepolture Storiche di "Corpse Point"

Il permafrost dell'Artico si sta sciogliendo a un ritmo allarmante, rivelando e degradando le sepolture secolari di balenieri a Likneset, noto come "Corpse Point" nell'arcipelago delle Svalbard. Un nuovo studio evidenzia come il cambiamento climatico stia accelerando la perdita del patrimonio culturale, mettendo a rischio reperti che raccontano le dure condizioni di vita dei marinai del XVII e XVIII secolo e sollevando interrogativi sulla conservazione in situ.

May 23 2026
Altro

La svolta energetica di xAI e SpaceX: dal solare ai data center orbitali

Le recenti strategie di xAI, orientate al gas naturale, e l'interesse di SpaceX per i data center in orbita, segnano un potenziale allontanamento dalla visione di un'economia solare-elettrica promessa da Elon Musk. Questo cambio di rotta solleva interrogativi sulle future infrastrutture per l'AI, le loro implicazioni ambientali e le sfide di deployment per carichi di lavoro intensivi.

May 23 2026
Hardware

Micron avvia la produzione di DRAM avanzata in Virginia: impatti su supply chain e settori strategici

Micron ha iniziato la produzione di memoria DRAM avanzata nel suo stabilimento in Virginia. L'espansione della fabbrica quadruplicherà la produzione, contribuendo a mitigare la carenza di DDR4, in particolare per i settori automobilistico e della difesa. Questa mossa rafforza la capacità produttiva interna negli Stati Uniti, con implicazioni significative per la supply chain globale di componenti critici e la sovranità tecnicica.

May 23 2026
Market

Corea del Sud: il vice premier avverte sui benefici pubblici dell'AI, citando Samsung

Il vice primo ministro sudcoreano Bae Kyung-hoon ha sottolineato la necessità che la ricchezza generata dall'intelligenza artificiale sia distribuita equamente. Ha citato le recenti tensioni lavorative in Samsung Electronics come un'anticipazione delle sfide sociali che l'era dell'AI potrebbe portare, evidenziando l'importanza di un approccio strategico e responsabile all'adozione delle nuove tecnicie.

May 23 2026
Altro

Il ciclo dell'hype per gli LLM locali: siamo oltre il picco delle aspettative?

Un'osservazione dalla community di LocalLLaMA e i trend di ricerca suggeriscono un possibile calo dell'interesse per i Large Language Models self-hosted. Questo solleva interrogativi sulla maturità del settore e sulle sfide reali che le aziende affrontano nel Deploy di soluzioni AI on-premise, tra requisiti hardware e complessità infrastrutturali.

May 23 2026
Altro

LLM da 1T di parametri su singola GPU: Optane e Kimi K2.5 per il deployment locale

Un recente esperimento ha dimostrato la possibilità di eseguire un LLM da un trilione di parametri su un sistema con una singola GPU, sfruttando 768GB di memoria Intel Optane DIMM. L'installazione locale di Kimi K2.5 ha raggiunto una velocità di circa 4 token al secondo, evidenziando un approccio innovativo per il deployment on-premise di modelli di grandi dimensioni, bilanciando costi e requisiti di memoria.

May 23 2026
Hardware

Hacknect: il cavo USB Wi-Fi che cela un microcontroller per attacchi mirati

Il cavo Hacknect di Little Gadgets è un dispositivo USB apparentemente innocuo che integra un microcontroller e uno storage microSD, controllabile via Wi-Fi. Progettato per l'esecuzione remota di payload e l'iniezione di sequenze di tasti, si presenta come uno strumento versatile. Sebbene le sue capacità lo rendano un potenziale strumento di hacking, è destinato a maker, sviluppatori e studenti di cybersecurity, offrendo un'opportunità per esplorare la sicurezza informatica e le vulnerabilità dei sistemi.

May 23 2026
Market

La visibilità dei brand nell'era degli LLM: una sfida per il monitoraggio SEO

L'emergere di Large Language Models come ChatGPT e Gemini sta creando un divario significativo nella capacità delle aziende di monitorare la propria visibilità online. Mentre i motori di ricerca tradizionali offrono metriche chiare sul posizionamento, le raccomandazioni generate dagli LLM rimangono un "punto cieco" per i team SEO, rendendo obsoleti molti strumenti di tracking attuali.

May 23 2026
Altro

SpaceX Starship V3: Un Volo di Test Tra Successi Parziali e Sfide Tecniche

SpaceX ha condotto il dodicesimo volo di test del suo razzo Starship, segnando il debutto della versione 3 aggiornata. Il lancio da Starbase, Texas, ha visto il successo nel rilascio di venti satelliti Starlink fittizi e la trasmissione di video in diretta. Tuttavia, il booster Super Heavy è stato distrutto dopo la separazione, non riuscendo a completare una discesa controllata. L'evento si è verificato a poche settimane dall'IPO di SpaceX, evidenziando le complessità dell'ingegneria spaziale e le implicazioni per la gestione di infrastrutture su larga scala.

May 23 2026
Market

Tesla lancia FSD in Cina: una mossa tardiva nel mercato EV più grande al mondo

Tesla ha ufficialmente reso disponibile il suo sistema Full Self-Driving (Supervised) in Cina, aggiungendo il paese ai 10 mercati globali in cui la tecnicia è accessibile. L'annuncio, privo di dettagli specifici, segna la prima conferma di Tesla per la disponibilità di FSD nel più grande mercato di veicoli elettrici, dove i concorrenti offrono soluzioni di guida autonoma da anni.

May 23 2026
Market

Corsair adotta DRAM cinese per i moduli DDR5: possibili impatti sui prezzi

Corsair, noto produttore di componenti PC, ha iniziato a integrare moduli DRAM di ChangXin Memory Technologies (CXMT), il maggiore produttore cinese di chip di memoria, nei suoi kit DDR5. L'identificazione, avvenuta tramite software diagnostici su un modulo Corsair Vengeance DDR5-6000, suggerisce un potenziale cambiamento nelle dinamiche del mercato delle memorie. Questa mossa potrebbe influenzare l'offerta e, di conseguenza, i prezzi della memoria, con ripercussioni sul Total Cost of Ownership per i deployment on-premise.

May 23 2026
Market

Waymo sospende i robotaxi in cinque città: il patch software non ha funzionato

Waymo ha interrotto il servizio di robotaxi in cinque città statunitensi il 21 maggio. La decisione segue il fallimento di un aggiornamento software, distribuito all'intera flotta di 3.791 veicoli meno di due settimane prima, che non è riuscito a impedire ai mezzi autonomi di finire in strade allagate. Un veicolo senza passeggeri si è bloccato a Midtown Atlanta, evidenziando le sfide nella gestione di condizioni ambientali complesse per i sistemi autonomi.

May 23 2026
Market

Xiaomi e la sfida dei prezzi: un nuovo SUV per competere nel mercato EV

Lei Jun, CEO di Xiaomi, ha ammesso pubblicamente che un precedente SUV dell'azienda non era competitivo sul prezzo rispetto a Tesla. In risposta, Xiaomi ha presentato il nuovo modello YU7 True Standard durante l'evento "Human x Car x Home" del 21 maggio, mirando a ridefinire la propria posizione nel segmento dei veicoli elettrici con un'offerta più aggressiva.

May 23 2026
LLM

Gemma4 26B A4B: La Quantization APEX Ottimizza l'Inference su GPU Locali

Un recente test su hardware consumer ha evidenziato le potenzialità della quantization APEX per il modello Gemma4 26B A4B. Utilizzando una GPU AMD RX 9060 XT da 16GB di VRAM e `llama.cpp` con Vulkan, è stato possibile raggiungere 38 token al secondo con una finestra di contesto di 90.000 token, mantenendo la qualità del modello. Questo risultato suggerisce un significativo passo avanti nell'efficienza per i deployment LLM self-hosted.

May 23 2026
LLM

Un template Jinja sperimentale migliora la stabilità di Gemma4 31B in llama.cpp

Un nuovo template Jinja, denominato "Preserve Thinking", è stato sviluppato per il modello Gemma4 31B, mirato a migliorare la stabilità delle interazioni multi-turn in ambienti `llama.cpp`. Questa soluzione sperimentale affronta problemi comuni legati alla gestione dei "thinking tags" durante le chiamate a tool, offrendo un'esperienza più robusta per chi implementa LLM on-premise. Google non ne raccomanda l'uso ufficiale.

May 23 2026
Frameworks

LongCat-Video-Avatar 1.5: un Framework Open Source per la Sintesi Video di Avatar Umani

Meituan-LongCat ha rilasciato LongCat-Video-Avatar 1.5, un framework open source potenziato per la generazione di video di avatar umani basati su audio. La versione 1.5 si concentra sull'ottimizzazione empirica e sulla prontezza per la produzione, offrendo stabilità elevata e sincronizzazione labiale accurata. Include un encoder audio Whisper-Large e un'inference efficiente a 8 passaggi, bilanciando costi e fedeltà visiva. Il modello supporta diverse applicazioni, dalla trasmissione di notizie alla promozione commerciale, con licenza MIT.

May 23 2026
LLM

LLM da 397B su 256 GB di VRAM: la sfida del deployment locale

La community tech si interroga sulla fattibilità di eseguire LLM di grandi dimensioni, nell'ordine dei 397 miliardi di parametri, su infrastrutture locali con un limite di 256 GB di VRAM. La discussione evidenzia le complessità e i compromessi legati al deployment on-premise di modelli avanzati, in particolare riguardo alla gestione delle risorse hardware e alle tecniche di ottimizzazione necessarie per bilanciare prestazioni e requisiti di memoria.

May 23 2026
Market

CXMT e la spinta cinese nel DRAM: implicazioni per l'AI on-premise

L'IPO di CXMT segnala la crescente ambizione della Cina nel rafforzare la propria filiera DRAM, con profonde implicazioni per la disponibilità hardware globale. Questo sviluppo è cruciale per le aziende che valutano deployment di Large Language Models (LLM) on-premise, influenzando la pianificazione del Total Cost of Ownership (TCO) e la sovranità dei dati. La diversificazione della filiera diventa un fattore chiave per la resilienza infrastrutturale.

May 23 2026
Altro

Ottimizzazione della Produzione e Logistica con LLM: Il Contesto On-Premise

Mentre Hotai si prepara a espandere la produzione automobilistica a Taiwan, emerge la discussione sull'applicazione di Large Language Models (LLM) per ottimizzare processi complessi come la supply chain e la gestione della produzione. L'articolo esplora le sfide e le opportunità del deployment on-premise di queste tecnicie, evidenziando l'importanza della sovranità dei dati e del controllo infrastrutturale per le aziende manifatturiere.

← Precedente Page 52 / 160 Successiva →