🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15951

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

May 10 2026
LLM

Hermes Agent in Vetta: Il Modello Più Utilizzato su Openrouter

Hermes Agent ha conquistato la posizione di modello più utilizzato a livello globale su Openrouter, superando giganti come Claude Code e OpenClaw nelle metriche di consumo di token. Questo dato, emerso dalle rilevazioni delle ultime 24 ore, evidenzia un significativo cambiamento nelle preferenze degli sviluppatori e delle aziende che si affidano a piattaforme aggregate per l'accesso ai Large Language Models, suggerendo un'attenzione crescente verso soluzioni performanti e potenzialmente ottimizzate per diversi scenari di deployment.

May 10 2026
Hardware

DeepSeek-V4-Flash: Alte prestazioni con MTP su GPU RTX PRO 6000 Max-Q

Un recente sviluppo dimostra come il modello DeepSeek-V4-Flash, ottimizzato con MTP self-speculation e tecniche di quantization avanzate, possa raggiungere prestazioni notevoli su hardware on-premise. Utilizzando due NVIDIA RTX PRO 6000 Max-Q con 96 GB di VRAM ciascuna, sono stati registrati fino a 85.52 token/secondo con un contesto di 524k token, evidenziando il potenziale per deployment LLM efficienti in ambienti locali.

May 10 2026
LLM

Gemma-4-26b-a4b eccelle nella generazione di codice three.js in un setup locale

Un esperimento condotto da un utente ha messo in luce le notevoli capacità del modello `gemma-4-26b-a4b` nella generazione di codice `three.js` da prompt singoli. Un'applicazione Python personalizzata ha automatizzato il testing, dimostrando come i Large Language Models possano produrre output complessi e funzionali in un ambiente self-hosted, con implicazioni dirette per i deployment on-premise e la sovranità dei dati.

May 10 2026
Altro

DS4: Salvatore Sanfilippo ottimizza DeepSeek V4 Flash per l'inference locale

Salvatore Sanfilippo, il creatore di Redis, ha lanciato DS4, un nuovo progetto su GitHub. L'iniziativa mira a eseguire DeepSeek V4 Flash con una finestra di contesto di 1 milione di token su hardware Mac Metal, sfruttando tecniche innovative. Il progetto è stato dimostrato anche su sistemi DGX e include endpoint per strumenti di codice agentici, evidenziando un focus sull'inference LLM on-premise e l'ottimizzazione hardware per carichi di lavoro AI.

May 10 2026
LLM

Percepire la velocità degli LLM: oltre i numeri di tokens/secondo

La velocità di output degli LLM, misurata in tokens/secondo, è un parametro cruciale per i deployment on-premise, ma spesso difficile da interpretare soggettivamente. Un nuovo strumento web mira a colmare questo divario, offrendo una percezione pratica delle performance per modelli come Qwen 3.6-27B, aiutando a valutare l'usabilità reale al di là delle metriche grezze.

May 10 2026
Altro

LLM locali per agenti di coding: sfide di performance su hardware consumer

Un utente ha testato Qwen 3.6 35B-A3B su una NVIDIA 5060 Ti (16GB VRAM) per un agente di coding locale. Sebbene le performance iniziali siano discrete, il modello rallenta significativamente con un contesto elevato, raggiungendo solo 9 token/sec. Questo solleva interrogativi sull'usabilità degli LLM on-premise per carichi di lavoro iterativi e sulla necessità di bilanciare requisiti hardware e prestazioni per la sovranità dei dati.

May 10 2026
Hardware

Dilemma On-Premise: Costruire un Server LLM per Coding Agentico con 100.000 Dollari

Un imprenditore si trova di fronte alla sfida di configurare un server LLM on-premise con un budget di 100.000 dollari. L'obiettivo primario è supportare modelli di coding agentico self-hosted, garantendo la sovranità dei dati e riducendo i costi operativi derivanti dall'uso di API esterne. La scelta hardware oscilla tra configurazioni GPU tradizionali e sistemi con memoria unificata ad alta larghezza di banda, con un'attenzione particolare al TCO e all'efficienza energetica.

May 10 2026
LLM

Agenti LLM: Navigare la Hype, le Sfide del Deployment Locale e le Applicazioni Reali

Un utente esprime confusione e frustrazione riguardo agli agenti basati su LLM, evidenziando la difficoltà di distinguere soluzioni valide dalla mera hype. La mancanza di una GPU impedisce test locali, mentre l'interesse si concentra su applicazioni non-coding come traduzione e assistenza creativa. L'articolo esplora queste sfide, i requisiti hardware per il deployment on-premise e la necessità di comprendere il funzionamento degli agenti per un controllo efficace.

May 10 2026
Hardware

Hanyuan-2: il primo computer quantistico dual-core cinese debutta con 200 qubit

La Cina ha presentato Hanyuan-2, un computer quantistico da 200 qubit che si dichiara il primo dual-core al mondo. Il sistema vanta un'incredibile efficienza energetica, ma la sua valutazione è ostacolata dalla mancanza di benchmark prestazionali critici. Questo solleva interrogativi sull'importanza della validazione indipendente per le nuove tecnicie, un aspetto fondamentale per i decision-maker che valutano deployment on-premise.

May 10 2026
Frameworks

llama.cpp: Tensor Parallelism senza NCCL su GPU Blackwell PCIe consumer

La versione b9095 del framework `llama.cpp` introduce il supporto per il Tensor Parallelism senza la necessità di NCCL, specificamente per configurazioni con due GPU Blackwell PCIe di fascia consumer. Questa novità rappresenta un passo significativo per l'inference di Large Language Models (LLM) in ambienti on-premise, rendendo più accessibile l'utilizzo di modelli complessi su hardware locale e riducendo le dipendenze da interconnessioni ad alta larghezza di banda.

May 10 2026
Frameworks

Navigare il codice con l'AI: i grafi semantici con LLM superano gli embeddings

Un team di sviluppatori ha rivelato che gli approcci tradizionali per il retrieval di codice, come gli embeddings vettoriali e il parsing AST, sono insufficienti per una comprensione profonda. La soluzione più efficace si basa su grafi di conoscenza arricchiti da Large Language Models (LLM) che generano contesto semantico per ogni file. Questa metodologia, rilasciata come Open Source, offre un'architettura locale e self-hosted, ideale per chi prioritizza la sovranità dei dati e il controllo del Total Cost of Ownership (TCO) nei deployment on-premise.

May 10 2026
Altro

Orbital punta allo spazio per l'inference AI: data center satellitari per superare i limiti terrestri

La startup Orbital Inc. sta sviluppando data center in orbita terrestre bassa per l'inference di Large Language Models, sfruttando l'energia solare. L'iniziativa mira a superare i crescenti vincoli energetici terrestri e le sfide infrastrutturali, proponendo una costellazione di satelliti dotati di server GPU. Il progetto, sebbene ambizioso, affronta complesse sfide ingegneristiche legate all'ambiente spaziale.

May 10 2026
Altro

Data center AI in Georgia: 29 milioni di galloni d'acqua consumati senza autorizzazione

Un data center AI di QTS in Georgia ha consumato 29 milioni di galloni d'acqua in 15 mesi senza autorizzazione, rilevato solo dopo le lamentele dei residenti per la bassa pressione. Nonostante l'entità del consumo, le autorità locali hanno deciso di non sanzionare la struttura da 6,2 milioni di piedi quadrati. L'episodio solleva interrogativi sulla gestione delle risorse e la trasparenza nei grandi progetti infrastrutturali per l'intelligenza artificiale.

May 10 2026
Altro

DeepSeek V4 Pro su workstation: un esempio di deployment LLM on-premise

Un utente ha dimostrato la capacità di eseguire il modello DeepSeek V4 Pro, nella sua versione quantizzata Q4_K_M, su una workstation Epyc dotata di una singola GPU NVIDIA RTX PRO 6000 Blackwell Max-Q con quasi 97 GB di VRAM. Questo caso evidenzia la fattibilità dei deployment LLM self-hosted, offrendo metriche di performance concrete per l'inference locale e rafforzando l'importanza del controllo sui dati e dell'infrastruttura dedicata.

May 10 2026
Altro

Il caso Bambu Lab: controllo, Open Source e le sfide per l'AI on-premise

La disputa legale tra Bambu Lab e uno sviluppatore di OrcaSlicer, con l'intervento di Louis Rossmann, solleva questioni cruciali sul controllo tecnicico e l'Open Source. Questo scenario offre spunti di riflessione per i decision-maker che valutano deployment di Large Language Models (LLM) on-premise, evidenziando l'importanza della sovranità dei dati, della libertà di modifica e della riduzione del Total Cost of Ownership (TCO) in ecosistemi dove il controllo del vendor può rappresentare un rischio.

May 10 2026
Altro

I data center AI e il problema dell'infrasuono: un impatto invisibile ma percepito

L'espansione dei data center dedicati all'intelligenza artificiale sta sollevando nuove sfide, tra cui le lamentele relative all'infrasuono. Questo fenomeno, impercettibile ai normali fonometri ma avvertito fisicamente, genera preoccupazioni per la salute dei residenti nelle vicinanze, ponendo interrogativi cruciali sulla pianificazione e il deployment delle infrastrutture AI.

May 10 2026
Hardware

GPU AI Nvidia Tesla V100: un hack da 200 dollari per l'inference on-premise

Un ingegnoso progetto ha trasformato una GPU Nvidia Tesla V100 SMX, basata sul chip GV100, in una scheda PCIe da server con un costo di circa 200 dollari. Questa soluzione modificata, dotata di PCB personalizzato e raffreddamento stampato in 3D, dimostra un'efficienza notevole nell'inference di LLM, superando molte offerte di fascia media attuali. Un esempio concreto di come l'ingegneria creativa possa ottimizzare i costi per i deployment on-premise.

May 10 2026
Hardware

NASA: rotori di elicotteri marziani superano la velocità del suono per la prima volta

L'agenzia spaziale NASA ha raggiunto un traguardo storico, spingendo per la prima volta i rotori di un elicottero marziano oltre la velocità del suono. Il velivolo di nuova generazione, denominato "SkyFall", ha visto i suoi rotori raggiungere i 3.750 RPM, una velocità dieci volte superiore a quella degli elicotteri convenzionali. Questo successo apre nuove prospettive per l'esplorazione spaziale e sottolinea le sfide ingegneristiche estreme.

May 10 2026
Market

NVIDIA e gli investimenti strategici nell'AI: oltre 40 miliardi di dollari nel 2026

NVIDIA ha allocato oltre 40 miliardi di dollari in investimenti azionari nel settore dell'intelligenza artificiale nei primi mesi del 2026. Una quota significativa, pari a 30 miliardi, è stata destinata a OpenAI, mentre il resto è stato distribuito tra aziende come CoreWeave, IREN, Corning e Nebius, oltre a circa due dozzine di round di finanziamento privati. Questa strategia, che evoca un'integrazione verticale, solleva interrogativi sulle dinamiche di mercato e le implicazioni per i deployment AI.

May 10 2026
LLM

Alibaba potenzia Taobao con Qwen AI per un'esperienza di acquisto 'agentica'

Alibaba sta integrando la sua applicazione Qwen AI con le piattaforme Taobao e Tmall. Questa mossa mira a creare un'esperienza di shopping "agentica" end-to-end, offrendo accesso a un catalogo di oltre 4 miliardi di articoli e un checkout nativo con Alipay. Si tratta del più grande lancio di commercio "agentico" da una piattaforma cinese, evidenziando l'evoluzione degli LLM nel retail.

May 10 2026
Hardware

RTX 3080 da 20GB: la ricerca di hardware custom per LLM on-premise

L'interesse per le GPU modificate, come la NVIDIA RTX 3080 con 20GB di VRAM, evidenzia la crescente domanda di soluzioni hardware economiche per l'esecuzione di Large Language Models (LLM) in locale. Gli utenti cercano alternative alle schede standard per gestire modelli come Qwen 3.6 27B, pur affrontando i rischi legati all'acquisto di hardware non ufficiale e alla potenziale scarsa affidabilità.

May 10 2026
Altro

Laser Tryzub: l'IA ucraina contro i droni, con potenziale per lo sminamento

L'Ucraina sta testando il sistema laser Tryzub, guidato dall'intelligenza artificiale, progettato per neutralizzare droni kamikaze Shahed a oltre 5 chilometri di distanza in pochi secondi. Montato su rimorchio, il Tryzub offre anche capacità per operazioni di sminamento, evidenziando l'integrazione dell'IA in soluzioni di difesa e sicurezza con requisiti di deployment on-premise ed edge.

May 10 2026
Market

Le criptovalute affossano Trump Media: 405,9 milioni di dollari di perdita nel Q1 2026

Trump Media & Technology Group ha registrato una perdita netta di 405,9 milioni di dollari nel primo trimestre del 2026. La quasi totalità di questa perdita è attribuibile a svalutazioni non realizzate sulle proprie partecipazioni in criptovalute, accumulate negli ultimi nove mesi. Nonostante ciò, il flusso di cassa operativo è rimasto positivo, attestandosi a 17,9 milioni di dollari. Questo risultato evidenzia come le decisioni finanziarie strategiche possano influenzare profondamente la stabilità di un'azienda tecnicica.

May 10 2026
Frameworks

La sfida dei framework per LLM on-premise: scegliere la soluzione giusta per llama.cpp

La proliferazione di strumenti per la gestione di Large Language Models in ambienti self-hosted, in particolare per `llama.cpp`, presenta una complessità crescente. Gli specialisti IT si trovano a dover bilanciare funzionalità, stabilità e compatibilità hardware per garantire deployment efficienti e affidabili, evitando interruzioni operative e costi imprevisti.

May 10 2026
Altro

LLM on-premise: l'esperienza insegna più della teoria

L'implementazione di Large Language Models (LLM) in ambienti self-hosted rivela una distinzione cruciale tra conoscenza teorica e comprensione pratica. Sebbene l'AI sembri abbassare la barriera d'ingresso, l'esperienza diretta dimostra che l'adozione di soluzioni esistenti è spesso più efficiente rispetto allo sviluppo da zero, richiedendo tempo e pazienza per un deployment efficace e ottimizzato.

May 10 2026
Frameworks

Kconfirm: Migliorare la Stabilità del Kernel Linux, un Fattore Chiave per l'AI On-Premise

Kconfirm è un nuovo strumento in fase di sviluppo per il kernel Linux, progettato per identificare e correggere configurazioni errate all'interno di Kconfig. La sua potenziale inclusione nel mainline kernel promette di rafforzare la stabilità e l'affidabilità dell'infrastruttura sottostante. Per le organizzazioni che adottano deployment di Large Language Models (LLM) on-premise, un kernel robusto e ben configurato è fondamentale per garantire performance ottimali, sicurezza e un TCO controllato.

May 10 2026
Market

Allarme di IntelliEPI: carenza di fosfuro di indio e impatti sulla supply chain tech

IntelliEPI, azienda taiwanese leader nella produzione di materiali semiconduttori, ha lanciato un avvertimento su una grave carenza imminente di fosfuro di indio. Questo materiale critico è fondamentale per componenti chiave in settori come le telecomunicazioni e l'optoelettronica, con potenziali ripercussioni sulla supply chain globale. La notizia solleva interrogativi sulla stabilità delle forniture per le infrastrutture AI e i deployment on-premise, dove la disponibilità di hardware è essenziale per la pianificazione a lungo termine.

May 10 2026
Market

Rallentamento di mercato e supply chain: implicazioni per l'hardware AI on-premise

Nonostante Samsung aumenti la produzione di modelli come Galaxy S26 Ultra e A17, il mercato tech globale si prepara a un rallentamento nel secondo trimestre. Questa dinamica, sebbene focalizzata sui dispositivi consumer, solleva interrogativi sulla supply chain e sulla disponibilità di componenti chiave. Per le aziende che valutano deployment di Large Language Models (LLM) on-premise, comprendere queste fluttuazioni è cruciale per la pianificazione degli investimenti in hardware e la gestione del Total Cost of Ownership (TCO).

May 10 2026
Altro

Violazione dati Coupang Taiwan: 33,7 milioni di account esposti e il ruolo del bug bounty

Coupang Taiwan ha annunciato una violazione dei dati risalente al 2025 che ha compromesso 33,7 milioni di account. L'incidente sottolinea l'importanza della sicurezza informatica e della sovranità dei dati, temi cruciali per le aziende che gestiscono carichi di lavoro sensibili, inclusi i Large Language Models. In risposta, l'azienda ha avviato un programma di bug bounty, una strategia proattiva per identificare e mitigare le vulnerabilità. Questo evento evidenzia i rischi associati alla gestione dei dati su larga scala e la necessità di robuste misure di protezione.

May 10 2026
Market

King Slide: la domanda di calcolo AI non è una bolla, attese robuste per il 2Q26

King Slide, fornitore chiave nel settore tecnicico, ha dichiarato che l'attuale domanda di capacità di calcolo per l'intelligenza artificiale non rappresenta una bolla speculativa. L'azienda prevede un flusso di ordini particolarmente robusto per il secondo trimestre del 2026, segnalando una prospettiva di crescita sostenuta per il mercato dell'AI e le infrastrutture ad essa dedicate.

May 10 2026
Market

La domanda di AI satura in anticipo lo stabilimento Vanguard di Singapore

La crescente richiesta di soluzioni di intelligenza artificiale ha portato lo stabilimento di produzione di Vanguard a Singapore a raggiungere la piena capacità operativa con largo anticipo rispetto alle previsioni. Questo fenomeno evidenzia la pressione sulla catena di fornitura globale di semiconduttori e le sfide che le aziende devono affrontare per assicurarsi l'hardware necessario per i deployment di Large Language Models (LLM) e altre applicazioni AI.

May 09 2026
Altro

Un Anno di Progressi nel Deployment Locale di LLM: Il Caso del Progetto MCP

Un anno dopo il suo lancio su Reddit, il progetto open source MCP di u/taylorwilsdon celebra i progressi nel campo dei Large Language Models locali. L'iniziativa evidenzia come l'esecuzione di LLM come Gemma4 e Qwen3.6 su hardware come il Mac Mini sia diventata affidabile e performante, segnando il passaggio da una fase pionieristica a una maggiore maturità per il deployment on-premise.

May 09 2026
LLM

AI: il glossario essenziale per decisioni informate su deployment e infrastruttura

L'ascesa dell'intelligenza artificiale ha introdotto una miriade di nuovi termini e concetti. Per i decision-maker tecnici, comprendere questo gergo è fondamentale per valutare correttamente le strategie di deployment, i requisiti hardware e le implicazioni di costo. Questo articolo offre una panoramica dei termini chiave, evidenziando come la loro chiara definizione sia cruciale per scelte infrastrutturali consapevoli, specialmente in contesti on-premise dove sovranità dei dati e TCO sono prioritari.

May 09 2026
Hardware

Apple ridimensiona l'offerta M3 Ultra: impatto sulle configurazioni per LLM on-premise

Apple ha rimosso il modello Mac Studio M3 Ultra da 256GB dal suo store online, alimentando preoccupazioni tra gli sviluppatori e gli architetti infrastrutturali che puntano a deployment di Large Language Models (LLM) in locale. Questa mossa, che segue una percezione di riduzione delle configurazioni di memoria unificata, solleva interrogativi sulla capacità di eseguire LLM di grandi dimensioni su hardware prosumer, influenzando le strategie di self-hosting e sovranità dei dati.

May 09 2026
Frameworks

BeeLlama.cpp: Ottimizzazione Estrema per LLM Locali su GPU Consumer

BeeLlama.cpp, una derivazione avanzata di llama.cpp, introduce DFlash e TurboQuant per migliorare l'inference di Large Language Models (LLM) su hardware locale. La soluzione permette di eseguire Qwen 3.6 27B Q5 con un contesto di 200.000 token su una singola RTX 3090, raggiungendo prestazioni fino a 135 token al secondo e superando la baseline di 2-3 volte, con supporto per ragionamento e visione.

May 09 2026
Hardware

Ottimizzazione LLM su hardware AMD: Qwen3.6-27B accelera con MTP e Parallelismo Tensoriale

Un recente test ha dimostrato significativi miglioramenti nelle prestazioni di inference per il modello Qwen3.6-27B, quantizzato in Q4_1, eseguito su una configurazione duale di GPU AMD Radeon Instinct Mi50. L'applicazione combinata delle tecniche Multi-Token Prediction (MTP) e Parallelismo Tensoriale ha permesso di raggiungere un raddoppio della velocità, evidenziando il potenziale di ottimizzazione anche su hardware meno recente per deployment on-premise, con implicazioni positive per il TCO e la sovranità dei dati.

May 09 2026
Market

Nvidia: 40 miliardi di dollari in investimenti AI nel 2024

Nvidia ha già destinato 40 miliardi di dollari a investimenti azionari nel settore dell'intelligenza artificiale quest'anno, consolidando la sua posizione di attore chiave nell'ecosistema AI. Questo impegno finanziario evidenzia la crescente importanza delle infrastrutture e delle soluzioni AI, con implicazioni per le strategie di deployment on-premise e cloud, e per la valutazione del TCO.

May 09 2026
Altro

Maryland: la bolletta da 2 miliardi per l'AI accende il dibattito sull'infrastruttura energetica

I cittadini del Maryland si trovano di fronte a un onere di 2 miliardi di dollari per l'aggiornamento della rete elettrica, destinato a supportare data center AI situati fuori dallo stato. La controversia evidenzia le crescenti sfide infrastrutturali e i costi nascosti associati alla rapida espansione dell'intelligenza artificiale, sollevando interrogativi sulla protezione dei contribuenti e sulla pianificazione energetica per i carichi di lavoro AI su larga scala.

May 09 2026
Altro

Analisi dei legami matrimoniali nella 'Ndrangheta: uno studio sui dati rivela dinamiche di potere

Un'indagine approfondita sui dati giudiziari di 906 matrimoni tra 623 clan della 'Ndrangheta ha svelato come i legami matrimoniali, in particolare quelli tra famiglie meno influenti, siano cruciali per la coesione e la struttura di potere dell'organizzazione. Lo studio evidenzia l'importanza dell'analisi dei dati per comprendere sistemi complessi e le implicazioni per la gestione di informazioni sensibili.

May 09 2026
Hardware

Nvidia RTX Mega Geometry: l'innovazione che riduce la VRAM per il path tracing

Nvidia introduce RTX Mega Geometry, una tecnicia progettata per ottimizzare l'uso della VRAM nel rendering path-traced. Questa innovazione rappresenta un significativo passo avanti, promettendo di ridurre il fabbisogno di memoria video e aprire nuove possibilità per applicazioni grafiche complesse, anche in contesti con risorse hardware limitate. La sua capacità di gestire geometrie complesse con minore VRAM ha implicazioni rilevanti per l'efficienza delle infrastrutture.

May 09 2026
Altro

macOS 27 e il futuro delle Time Capsule: la comunità FOSS al salvataggio

La prossima versione di macOS, la 27, minaccia di eliminare il supporto ad Apple Filing Protocol (AFP), rendendo inutilizzabili le vecchie Time Capsule. Tuttavia, la comunità Open Source ha sviluppato TimeCapsuleSMB, una soluzione che permette di aggiornare il software interno di questi dispositivi, basati su NetBSD, per continuare a funzionare con i sistemi operativi moderni, superando significative limitazioni hardware.

May 09 2026
LLM

LLM on-premise: Qwen3.6 35B raggiunge 80 tok/sec con 12GB VRAM

Un recente test dimostra come sia possibile ottenere prestazioni significative per l'inference di Large Language Models (LLM) su hardware consumer. Utilizzando il modello Qwen3.6 35B A3B e il framework llama.cpp con Multi-Token Prediction (MTP), un utente ha raggiunto oltre 80 token/secondo con una finestra di contesto di 128K, impiegando una GPU NVIDIA RTX 4070 Super dotata di soli 12GB di VRAM. Questo evidenzia il potenziale dell'ottimizzazione software per i deployment on-premise.

May 09 2026
Altro

Agenti LLM locali e Qwen3.6 27B: semplificare la gestione di Archlinux

Un utente ha sperimentato l'uso di un agente LLM, il "pi coding agent", in combinazione con Qwen3.6 27B su hardware locale per configurare un sistema Archlinux. L'approccio ha permesso di gestire complesse impostazioni di sistema, come Bluetooth e risoluzione dello schermo, tramite semplici comandi in linguaggio naturale, evidenziando il potenziale degli LLM self-hosted per l'automazione IT e sollevando interrogativi sul futuro delle interfacce utente.

May 09 2026
Market

Quantinuum punta a un'IPO da oltre 20 miliardi di dollari con ricavi limitati

Quantinuum, azienda attiva nel settore del quantum computing, ha avviato le procedure per un'offerta pubblica iniziale negli Stati Uniti. L'operazione potrebbe valutare la società oltre 20 miliardi di dollari, nonostante abbia registrato ricavi per 30,9 milioni di dollari e una perdita netta di 192,6 milioni di dollari nell'anno fiscale 2025, e il suo computer quantistico non sia ancora pienamente operativo.

May 09 2026
Altro

Pentest AI: Intruder automatizza i test di penetrazione in pochi minuti

La cybersecurity company Intruder ha introdotto agenti AI per il penetration testing, replicando la metodologia umana in pochi minuti. Questa innovazione contrasta i costi elevati (fino a 50.000 dollari) e i lunghi tempi di esecuzione dei test manuali, che spesso producono report obsoleti. La soluzione mira a offrire un'alternativa rapida ed efficiente per la valutazione della sicurezza, con implicazioni significative per il TCO e la sovranità dei dati.

May 09 2026
Market

L'investimento da 20 milioni di dollari dell'Università del Michigan in OpenAI vale ora 2 miliardi

Documenti giudiziari del processo Musk contro Altman hanno rivelato che l'Università del Michigan ha investito 20 milioni di dollari in OpenAI prima del lancio di ChatGPT e dell'impegno miliardario di Microsoft. Questa partecipazione, originariamente parte di un fondo di dotazione universitario, ha ora un valore di riscatto stimato in due miliardi di dollari, evidenziando la straordinaria crescita della valutazione dell'azienda nel settore dell'intelligenza artificiale.

May 09 2026
Altro

Anthropic Mythos: Migliaia di Zero-Day Rilevate, Allarme per la Sicurezza Globale

Anthropic ha sviluppato Mythos, un modello AI che ha identificato migliaia di vulnerabilità zero-day in sistemi operativi e browser. La scoperta ha innescato un allarme ai massimi livelli, con i vertici della Federal Reserve e del Tesoro che hanno contattato i CEO delle banche. L'azienda stima una finestra di 6-12 mesi per correggere le falle prima che attori malevoli possano sfruttarle.

May 09 2026
Altro

Ubuntu Touch 24.04-1.3: Miglioramenti per le applicazioni desktop su dispositivi mobili

La nuova release di manutenzione di Ubuntu Touch, la 24.04-1.3, introduce ottimizzazioni significative nella gestione delle applicazioni desktop. Questa distribuzione Linux, pensata per tablet e smartphone, rafforza la sua proposta di valore per scenari che richiedono controllo e flessibilità su dispositivi mobili e edge, con implicazioni per la sovranità dei dati e il TCO.

May 09 2026
Market

Indagine su spedizioni illecite di GPU Nvidia H100 ad Alibaba tramite entità thailandesi

Un'indagine rivela che dirigenti legati a Supermicro avrebbero utilizzato un'entità governativa thailandese per spedire GPU Nvidia AI, inclusi modelli Hopper H100, in Cina. Il rapporto suggerisce che il gigante tecnicico cinese Alibaba avrebbe ricevuto server soggetti a restrizioni all'esportazione, sollevando interrogativi sulla compliance e sulla catena di approvvigionamento globale per l'hardware AI ad alte prestazioni.

May 09 2026
Hardware

NVIDIA-VAAPI-Driver 0.0.17: Supporto Esteso per i Sistemi GB10

Il progetto open source NVIDIA-VAAPI-Driver ha rilasciato la versione 0.0.17, introducendo un supporto migliorato per i sistemi basati su architettura GB10. Questo driver, sviluppato dalla community, abilita la decodifica video accelerata tramite VA-API su GPU NVIDIA, essenziale per applicazioni come Mozilla Firefox e altri software che operano con i driver Linux proprietari di NVIDIA, contribuendo all'efficienza delle infrastrutture on-premise.

May 09 2026
Hardware

TSMC e Sony: una Joint Venture strategica per i sensori AI di nuova generazione

La collaborazione tra TSMC e Sony per lo sviluppo di sensori con capacità AI integrate segna un passo significativo verso l'intelligenza distribuita. Questa joint venture mira a potenziare le applicazioni edge, offrendo soluzioni che bilanciano performance, efficienza energetica e sovranità dei dati, aspetti cruciali per i deployment on-premise.

May 09 2026
Altro

Qwen e i costi nascosti del deployment LLM on-premise

Anche i Large Language Models (LLM) apparentemente "gratuiti" o open-weight come Qwen comportano costi significativi per il deployment on-premise. L'analisi del Total Cost of Ownership (TCO) rivela che l'investimento in hardware, l'energia, il raffreddamento e la gestione operativa sono fattori cruciali per le aziende che valutano soluzioni self-hosted, bilanciando controllo e sovranità dei dati con le spese reali.

May 09 2026
LLM

Quando la poesia anticipa l'AI: Shel Silverstein e le 'allucinazioni' degli LLM

Un utente di Reddit ha riscoperto una poesia di Shel Silverstein del 1981, trovandovi un'inaspettata premonizione sui Large Language Models (LLM) e il loro noto fenomeno delle "allucinazioni". L'osservazione, seppur umoristica, solleva interrogativi sulla natura dell'intelligenza artificiale e le sfide che le aziende affrontano nel garantire l'affidabilità dei sistemi AI in ambienti critici.

May 09 2026
LLM

Qwen3.6-35B-A3B: un LLM 'uncensored' per deployment on-premise e sovranità dei dati

È stato rilasciato Qwen3.6-35B-A3B, un Large Language Model da 35 miliardi di parametri caratterizzato da una configurazione "uncensored" e dalla piena preservazione dei suoi 19 MTP. Disponibile in formati ottimizzati come Safetensors, GGUF, NVFP4 e GPTQ-Int4, questo LLM si propone come una soluzione interessante per le aziende che cercano controllo, sovranità dei dati e flessibilità nei deployment on-premise, riducendo la dipendenza da infrastrutture cloud esterne.

May 09 2026
Market

Wistron: profitti triplicati grazie alla robusta domanda di server e AI

Wistron ha registrato un aumento significativo dei profitti, triplicando i risultati precedenti, spinto da una forte crescita nella domanda di server. Questo incremento riflette la robustezza del mercato dell'intelligenza artificiale, che continua a richiedere infrastrutture dedicate e performanti. Il fenomeno evidenzia le sfide e le opportunità per le aziende che valutano deployment on-premise di LLM, tra esigenze di sovranità dei dati e ottimizzazione del TCO.

May 09 2026
Market

La crescente carenza di chip di potenza minaccia l'espansione dei server AI

La domanda di server per l'intelligenza artificiale sta esacerbando la carenza di chip di potenza, un componente critico per l'infrastruttura di calcolo. Questa situazione, aggravata dalla competizione nello sviluppo di tecnicie come il nitruro di gallio (GaN), impone nuove sfide e considerazioni strategiche per le aziende che pianificano deployment di Large Language Models (LLM) on-premise, influenzando TCO e disponibilità hardware.

May 09 2026
Altro

Le nuove regole cyber UE: un cambio di paradigma per la sicurezza AI e la difesa umana

Le recenti normative europee sulla sicurezza informatica stanno ridefinendo l'approccio alla protezione dei sistemi basati sull'intelligenza artificiale. L'attenzione si sposta dall'entusiasmo per l'AI a una difesa più robusta, guidata dall'intervento umano. Questo implica nuove sfide per le aziende che implementano LLM, con un'enfasi crescente sulla sovranità dei dati e sulla compliance, influenzando le decisioni di deployment on-premise.

May 09 2026
Altro

Aprile 2026: Una Svolta per i Large Language Models Locali

Il mese di aprile 2026 ha segnato un punto di svolta significativo per i Large Language Models (LLM) destinati a deployment locali. Questa evoluzione apre nuove opportunità per le aziende che cercano maggiore controllo sui dati, sovranità e ottimizzazione del Total Cost of Ownership (TCO), spostando l'attenzione dalle soluzioni cloud-centriche verso architetture self-hosted e air-gapped, cruciali per la gestione di carichi di lavoro AI sensibili.

May 09 2026
Market

Semiconduttori e AI: la domanda spinge le supply chain al limite

Il mercato globale dei semiconduttori sta affrontando carenze significative, spinte dalla crescente domanda di intelligenza artificiale. Questa situazione mette sotto forte stress le catene di approvvigionamento, con implicazioni dirette per le aziende che pianificano deployment di Large Language Models (LLM), sia on-premise che in cloud. La disponibilità di hardware specializzato, come le GPU, diventa un fattore critico per la scalabilità e i costi operativi, influenzando il Total Cost of Ownership (TCO) e le strategie di deployment.

May 08 2026
Market

Oracle e i licenziamenti: la classificazione dei lavoratori remoti impatta le tutele

Alcuni dipendenti Oracle licenziati hanno tentato di negoziare condizioni di uscita migliori, ma l'azienda ha rifiutato. La classificazione come lavoratori remoti ha impedito ad alcuni di accedere alle tutele previste dal WARN Act, come il preavviso di due mesi, sollevando interrogativi sulle implicazioni delle politiche aziendali per la forza lavoro distribuita.

May 08 2026
Altro

Qwen3.6-27B su RTX 4090: 80 t/s con MTP e TurboQuant a 262K di contesto

Un recente esperimento ha dimostrato la capacità di eseguire il Large Language Model Qwen3.6-27B su una singola GPU NVIDIA RTX 4090, raggiungendo performance di 80-87 token al secondo con una finestra di contesto di ben 262K token. L'ottimizzazione è stata possibile grazie all'implementazione congiunta di MTP (Multi-Token Prediction) e TurboQuant, evidenziando il potenziale per deployment on-premise efficienti di LLM di grandi dimensioni su hardware consumer. Questo risultato apre nuove prospettive per le aziende che cercano soluzioni locali per la sovranità dei dati e il controllo dei costi.

May 08 2026
Hardware

Qwen 35B-A3B su 12GB VRAM: prestazioni solide per LLM on-premise

Un'analisi tecnica rivela che 12GB di VRAM, come quelli offerti da una RTX 3060, rappresentano un punto di equilibrio ideale per l'esecuzione locale del modello LLM Qwen 35B-A3B. Questa configurazione permette di mantenere un numero sufficiente di blocchi MoE sulla GPU, garantendo buone prestazioni di decoding e supportando contesti ampi fino a 32k token, un aspetto cruciale per i deployment on-premise che cercano efficienza e controllo.

May 08 2026
LLM

AI2 presenta EMO: un nuovo LLM MoE con routing documentale avanzato

AI2 ha rilasciato EMO, un nuovo Large Language Model basato su architettura Mixture of Experts. Addestrato su un trilione di token, EMO presenta 1 miliardo di parametri attivi su un totale di 14 miliardi. La sua innovazione risiede nel routing a livello di documento, che consente agli esperti di specializzarsi in domini specifici come salute o notizie, ottimizzando l'elaborazione delle informazioni.

May 08 2026
Market

Rocket Lab: Ricavi in Forte Crescita e Backlog Record, in Attesa del Lancio Neutron

Rocket Lab ha registrato una crescita dei ricavi del 64% e un backlog di 2,2 miliardi di dollari, con il titolo azionario a livelli record. L'azienda ha venduto più lanci nel primo trimestre del 2026 che nell'intero anno precedente, ma l'atteso razzo Neutron deve ancora effettuare il suo volo inaugurale, un fattore già prezzato dal mercato.

May 08 2026
Altro

Tesla Model Y: test di sicurezza superati, ma indagini in corso su 3,2 milioni di veicoli

L'NHTSA ha annunciato che la Tesla Model Y è il primo veicolo a superare i nuovi test di sicurezza per sistemi avanzati di assistenza alla guida. Contemporaneamente, l'agenzia sta indagando su 3,2 milioni di veicoli Tesla per incidenti avvenuti durante l'uso del sistema di guida autonoma avanzato dell'azienda. La notizia evidenzia la complessità della valutazione delle tecnicie AI in ambito automotive, tra certificazioni e sfide sul campo.

May 08 2026
Market

Google integra più link ai siti web negli AI Overviews

Google sta modificando i suoi AI Overviews per includere un maggior numero di link diretti a siti web, una mossa che segue le preoccupazioni dei publisher riguardo al calo di traffico. Le nuove sezioni "Further Exploration" e "Expert Advice" mirano a fornire agli utenti risorse aggiuntive, bilanciando le risposte generate dall'intelligenza artificiale con l'accesso ai contenuti originali del web.

May 08 2026
Altro

OpenAI e la sicurezza di Codex: un modello per gli agenti di codice

OpenAI ha delineato le strategie adottate per garantire la sicurezza del suo modello Codex, un agente di codice basato su Large Language Models. L'approccio si fonda su sandboxing, processi di approvazione rigorosi, politiche di rete mirate e telemetria nativa dell'agente. Queste misure sono cruciali per supportare un'adozione sicura e conforme degli agenti di programmazione, affrontando le sfide intrinseche legate all'esecuzione di codice generato dall'IA in ambienti produttivi.

May 08 2026
Altro

Violate cinque centrali idriche polacche: la minaccia delle password deboli

Nel 2025, hacker hanno compromesso cinque impianti di trattamento delle acque in Polonia, accedendo ai sistemi di controllo industriale. Il vettore d'attacco si è rivelato essere l'uso di password deboli o predefinite, una vulnerabilità che affligge anche il 70% delle utility idriche americane. L'incidente evidenzia i rischi per le infrastrutture critiche e l'importanza di robuste pratiche di sicurezza per i deployment on-premise.

May 08 2026
Altro

Il Pentagono pubblica 162 dossier UFO: trasparenza o segreti?

Il Dipartimento della Guerra statunitense ha lanciato un portale dedicato ai Fenomeni Aerei Non Identificati (UAP), comunemente noti come UFO. Il sito war.gov/ufo ospita 162 documenti, tra cui immagini della missione Apollo 17 e video militari, ma due terzi del materiale risulta parzialmente censurato. L'iniziativa, presentata come un gesto di trasparenza, solleva interrogativi sulla completezza delle informazioni divulgate al pubblico.

May 08 2026
Market

Indagine NHTSA su Avride: 16 incidenti in quattro mesi per i robotaxi di Uber

La National Highway Traffic Safety Administration (NHTSA) ha avviato un'indagine su Avride, partner di Uber per i veicoli autonomi, dopo aver registrato 16 incidenti e un infortunio minore in soli quattro mesi a Dallas. L'agenzia ha criticato i robotaxi per la loro "eccessiva assertività e insufficiente capacità", sollevando interrogativi sulla maturità delle tecnicie di guida autonoma e le loro implicazioni per il deployment di sistemi AI in contesti critici.

May 08 2026
Frameworks

Lemonade integra vLLM con supporto ROCm: un nuovo backend sperimentale per LLM on-premise

Lemonade, una piattaforma per l'esecuzione locale di Large Language Models, ha annunciato l'integrazione sperimentale di vLLM con supporto ROCm. Questa novità permette di eseguire LLM in formato `.safetensors` direttamente su hardware AMD, offrendo agli sviluppatori e alle aziende un'alternativa per i deployment on-premise. Il team cerca feedback dalla community per guidare lo sviluppo futuro di questa integrazione, mirando a un ecosistema AI più diversificato e flessibile.

May 08 2026
Market

Cloudflare: l'AI rende obsoleti 1.100 ruoli, ricavi record

Cloudflare ha annunciato il suo primo licenziamento su larga scala, che ha interessato circa 1.100 posizioni. Secondo il CEO Matthew Prince, l'efficienza operativa ottenuta grazie all'intelligenza artificiale ha ridotto la necessità di ruoli di supporto. Questo avviene in un contesto di crescita, con l'azienda che ha registrato ricavi record. La notizia solleva interrogativi sull'impatto dell'AI sulla forza lavoro aziendale.

May 08 2026
General

Il Dilemma di VS Code

Do you abandon your carefully curated Visual Studio Code environment for a sleek, AI-native fork like Windsurf or Cursor? Or do you fortify your existing VS Code setup with powerful, "bring-your-own-key" (BYOK) extensions like Cline, Roo Code, and Continue?

May 08 2026
Market

DeepSeek punta a un finanziamento record da 7,35 miliardi di dollari e accelera lo sviluppo LLM

DeepSeek, l'azienda cinese di intelligenza artificiale, starebbe cercando di raccogliere 7,35 miliardi di dollari in un round di finanziamento che potrebbe essere il più grande nella storia del settore AI cinese. L'operazione mira ad accelerare la strategia di commercializzazione e monetizzazione, con l'azienda che prevede di intensificare il rilascio dei suoi Large Language Models. Tra le novità attese, il lancio della versione V4.1 del suo modello è previsto per giugno.

May 08 2026
Hardware

La community DGX Spark: ingegno e ottimizzazione oltre i limiti hardware

Nonostante le iniziali critiche sulle specifiche hardware del DGX Spark, in particolare riguardo alla larghezza di banda della memoria e al chip SM-121, la sua community di sviluppatori sta dimostrando un'eccezionale tenacia. Attraverso un forum dedicato, i membri collaborano attivamente per ottimizzare ogni aspetto della piattaforma, migliorando le performance di inference e lo stack software. Questo sforzo collettivo mira a superare i limiti percepiti, trasformando le sfide tecniche in opportunità di innovazione e sviluppo di progetti specifici, sfruttando la coerenza dell'hardware e del sistema operativo.

May 08 2026
Altro

Violazione Canvas: il rischio della centralizzazione dei dati studenteschi nel cloud

Un attacco ransomware al sistema Canvas ha esposto i dati di oltre 275 milioni di studenti e miliardi di messaggi. L'incidente, definito "il più grande disastro di privacy dei dati studenteschi della storia", evidenzia i pericoli della centralizzazione delle informazioni sensibili in servizi cloud, in contrasto con le soluzioni self-hosted che offrono maggiore controllo e sovranità sui dati.

May 08 2026
Market

L'AI per l'impresa: alleanze strategiche e acquisizioni miliardarie infiammano il mercato

Il mercato dell'AI per l'impresa è in piena ebollizione, con un'intensa attività che spazia da nuove joint venture a significative acquisizioni. Aziende come Anthropic e OpenAI stanno stringendo alleanze per il deployment di soluzioni AI, mentre giganti come SAP investono massicciamente, come dimostra l'acquisizione da un miliardo di dollari della startup tedesca Prior Labs. Questo scenario suggerisce che le startup focalizzate su strumenti AI per le aziende sono ora obiettivi primari per acquisizioni strategiche.

May 08 2026
Frameworks

z-lab rilascia DFlash per Gemma 4 26B: un nuovo approccio all'inference LLM on-premise

z-lab ha introdotto DFlash, una nuova tecnicia per l'inference di Large Language Models come Gemma 4 26B. Promettendo miglioramenti significativi nella gestione del contesto e nella velocità rispetto ad alternative come MTP, DFlash si propone come soluzione per ottimizzare i deployment on-premise, sebbene sia attualmente limitato a vLLM. La sua efficienza è cruciale per chi cerca controllo e costi contenuti.

May 08 2026
Frameworks

Gemma 4 26B: Oltre 570 token/s su una singola RTX 5090 con DFlash

Un recente benchmark ha dimostrato come la decodifica speculativa DFlash in vLLM possa accelerare significativamente l'inference di Large Language Models. Testando Gemma 4 26B su una RTX 5090 con 32GB VRAM, si è raggiunto un throughput di quasi 580 token al secondo, con una riduzione della latenza di oltre il 60%. Questi risultati evidenziano il potenziale di ottimizzazione per i deployment on-premise.

May 08 2026
Altro

ICE valuta occhiali smart per potenziare il riconoscimento facciale

L'agenzia statunitense Immigration and Customs Enforcement (ICE) sta esplorando lo sviluppo di occhiali smart per integrare la sua applicazione di riconoscimento facciale, Mobile Fortify. Questo sistema permette agli ufficiali di identificare persone e interrogare database governativi per verificarne la cittadinanza e prendere decisioni di detenzione. La mossa rappresenta un'ulteriore escalation tecnicica nell'ambito delle operazioni di controllo migratorio, sollevando questioni cruciali su sovranità dei dati e deployment all'edge.

May 08 2026
Market

RingCentral potenzia AI Receptionist con integrazioni Shopify, Calendly e WhatsApp

RingCentral ha ampliato le funzionalità del suo prodotto AI Receptionist (AIR), integrando Shopify, Calendly e WhatsApp. Questa espansione mira a estendere le capacità di AIR oltre la gestione base delle chiamate, includendo la gestione degli ordini, la pianificazione degli appuntamenti e la risposta ai messaggi WhatsApp. L'obiettivo è supportare le organizzazioni di piccole e medie dimensioni nella gestione delle richieste dei clienti, migliorando l'efficienza operativa e riducendo i tempi di attesa.

May 08 2026
LLM

Quando l'AI Incontra la Creatività: Nuove Prospettive per la Pubblicità Locale

L'iniziativa "The Small Brief" vede quattro icone del settore pubblicitario collaborare per supportare le piccole imprese locali. Utilizzando l'intelligenza artificiale per creare campagne, il progetto esplora il potenziale dell'AI nel generare contenuti pubblicitari innovativi, evidenziando al contempo le sfide e le opportunità legate al deployment di tali tecnicie, dalla sovranità dei dati ai costi infrastrutturali e alla necessità di un'attenta valutazione del TCO per le soluzioni self-hosted.

May 08 2026
Market

California: proposta per tutelare i lavoratori dall'impatto dell'AI

Un candidato governatore della California ha avanzato una proposta per garantire nuovi posti di lavoro ai dipendenti che potrebbero essere sostituiti dall'intelligenza artificiale. L'iniziativa evidenzia il crescente dibattito sull'impatto sociale ed economico dell'AI, un tema rilevante per le aziende che valutano strategie di deployment on-premise o cloud e le relative implicazioni sulla forza lavoro e sul TCO.

May 08 2026
LLM

La visione di Nick Bostrom: l'IA avanzata per un "mondo risolto"

Il filosofo Nick Bostrom propone una visione audace per il futuro dell'umanità, immaginando un "grande ritiro" reso possibile da un'intelligenza artificiale altamente avanzata. Questa prospettiva suggerisce che l'IA potrebbe condurre a un "mondo risolto", dove le sfide fondamentali dell'esistenza umana sono superate, sollevando interrogativi sulle implicazioni tecniciche e infrastrutturali di sistemi così potenti.

May 08 2026
Market

Intel: la crescita del titolo e le sfide strategiche della leadership

Il valore azionario di Intel è triplicato in dodici mesi sotto la guida del CEO Lip-Bu Tan, in carica da marzo 2025. Nonostante il successo finanziario, il piano strategico aziendale non è ancora stato comunicato alla maggior parte dei dipendenti. La sua gestione si è concentrata sulle relazioni esterne, sollevando interrogativi sulle implicazioni per lo sviluppo interno e le future offerte hardware per il settore AI.

May 08 2026
Market

Proposta H-1B: Aumenti salariali significativi per ingegneri tech negli USA

Una proposta dell'amministrazione Trump, pubblicata a marzo, mira a innalzare le soglie salariali minime per i visti H-1B, con impatti notevoli sui costi del personale tech negli Stati Uniti. Per un ingegnere software entry-level a San Francisco, il salario minimo richiesto salirebbe a 162.000 dollari annui, mentre a Dallas e New York si registrerebbero aumenti simili, superando del 30% gli attuali requisiti.

May 08 2026
Altro

Transformer Lab: fine-tuning di LLM TTS su hardware locale

Transformer Lab, una piattaforma open source per la ricerca in machine learning, ha presentato una demo che illustra il processo di fine-tuning del modello Orpheus 3B per applicazioni text-to-speech. La soluzione permette agli utenti di eseguire l'addestramento direttamente sul proprio hardware, enfatizzando i benefici del deployment on-premise per la sovranità dei dati e il controllo sull'infrastruttura, offrendo sia un'interfaccia grafica che una CLI.

May 08 2026
Altro

Qwen3.6-27B su llama.cpp MTP: le sfide del contesto esteso on-premise

Un'analisi approfondita dell'implementazione di Qwen3.6-27B con llama.cpp MTP rivela sfide significative nella gestione di contesti estesi per i Large Language Models self-hosted. I dati mostrano un calo delle prestazioni di generazione oltre gli 85.000 token, evidenziando l'importanza dell'ottimizzazione della cache KV per i deployment on-premise. Le osservazioni sottolineano i trade-off tra la profondità del contesto e la velocità di Inference in ambienti locali.

May 08 2026
LLM

NVIDIA Personaplex e il Tool Calling: capacità e implicazioni per i LLM

NVIDIA Personaplex, un modello vocale in tempo reale, solleva interrogativi sul supporto al Tool Calling. Questa capacità, cruciale per l'interazione dei Large Language Models con sistemi esterni, è fondamentale per estendere le loro funzionalità. L'articolo esplora le implicazioni di tale integrazione, specialmente nei deployment on-premise, dove sovranità dei dati e controllo della pipeline sono prioritari.

May 08 2026
Altro

Consumi di memoria crescenti in llama.cpp: un'analisi on-premise

Un utente ha segnalato un consumo di memoria progressivamente crescente durante l'esecuzione di un LLM da 105GB con un contesto di 150K token su un sistema locale da 128GB, utilizzando `llama.cpp` e LM Studio. Nonostante i tentativi di liberare la memoria, il consumo è salito a 120GB, suggerendo una potenziale perdita di memoria. Questo solleva interrogativi sulla stabilità e l'efficienza dei deployment on-premise di LLM di grandi dimensioni.

May 08 2026
Hardware

HP Z6 G5 A: La workstation si aggiorna per l'AI on-premise con Threadripper PRO 9000 e Blackwell

HP ha aggiornato la sua workstation Z6 G5 A, ora equipaggiata con i processori AMD Ryzen Threadripper PRO 9000 e le GPU NVIDIA RTX PRO Blackwell. Questo sistema, già noto per la sua compatibilità con Linux, offre prestazioni elevate per carichi di lavoro AI e LLM, posizionandosi come una soluzione robusta per deployment on-premise che richiedono controllo e sovranità dei dati.

May 08 2026
Frameworks

NVIDIA lancia CUDA-Oxide 0.1: Rust incontra CUDA per le GPU

NVIDIA Labs ha rilasciato CUDA-Oxide 0.1, un compilatore sperimentale che permette di sviluppare kernel CUDA per le GPU NVIDIA utilizzando il linguaggio di programmazione Rust. Questo progetto mira a migliorare le capacità di programmazione ad alte prestazioni, offrendo i vantaggi di sicurezza e controllo di Rust. L'iniziativa è particolarmente rilevante per le organizzazioni che cercano di ottimizzare i carichi di lavoro AI e LLM in ambienti self-hosted, dove il controllo granulare sull'hardware e sul software è cruciale per il TCO e la sovranità dei dati.

May 08 2026
Market

Front Ventures: 5 milioni di euro per la tecnicia di difesa in Ucraina e Svezia

Front Ventures, società di investimento con sede a Stoccolma, ha raccolto 5 milioni di euro attraverso un'emissione di azioni sottoscritta al 278%. Il capitale sarà destinato a sostenere aziende di tecnicia di difesa in fase iniziale, con un focus su Ucraina e Svezia. L'obiettivo è accelerare la scalabilità di soluzioni innovative già testate sul campo, in settori come droni, comunicazioni e software, facilitando partnership industriali europee e NATO.

May 08 2026
Market

Mercato Tech Europeo: ElevenLabs raccoglie oltre 550 milioni, DeepL taglia 250 posti e le tendenze di aprile

Il panorama tecnicico europeo ha registrato un aprile dinamico, con oltre 65 accordi di finanziamento per un valore superiore a 1,4 miliardi di euro. Tra le notizie di spicco, ElevenLabs ha ampliato il suo Series D a oltre 550 milioni di dollari, coinvolgendo investitori come BlackRock e Nvidia. Parallelamente, DeepL, startup tedesca di traduzione AI, ha annunciato il taglio di 250 posti di lavoro, segnalando un periodo di consolidamento nel settore. Il mese ha visto anche importanti acquisizioni e un crescente focus sulla sovranità della difesa con il nuovo hub per droni.

May 08 2026
Altro

Coinbase: licenziamenti, perdite e un blackout di sette ore per un data center surriscaldato

Coinbase ha affrontato una settimana difficile, caratterizzata da un taglio di 700 posti di lavoro e una perdita trimestrale di 394 milioni di dollari. La situazione è culminata in un blackout di sette ore, causato dal surriscaldamento di un data center in Virginia. L'incidente evidenzia le sfide infrastrutturali che possono colpire anche aziende che puntano sull'efficienza dell'intelligenza artificiale per le proprie operazioni.

May 08 2026
Altro

Malware nei repository AI: Hugging Face sotto attacco, rischio per la supply chain

I principali repository di modelli e agenti AI sono stati sistematicamente compromessi da malware. Hugging Face, una piattaforma cruciale che ospita oltre un milione di modelli di machine learning, è stata trovata contenere centinaia di modelli malevoli. Questi modelli sono in grado di eseguire codice arbitrario sulle macchine degli utenti, trasformando l'infrastruttura di sviluppo AI in un vettore di attacco e sollevando gravi preoccupazioni per la sicurezza della supply chain software.

May 08 2026
Altro

DS4: un motore di inference ottimizzato per DeepSeek 4 su MacBook da 128GB

Il progetto DS4 introduce un motore di inference specifico per il modello DeepSeek 4, progettato per operare in modo efficiente sui MacBook dotati di 128GB di RAM. Questa iniziativa, guidata da antirez, si concentra sull'ottimizzazione per la memoria flash, evidenziando il crescente interesse verso l'esecuzione di Large Language Models direttamente su dispositivi client. Rappresenta un passo significativo per chi cerca soluzioni di AI on-device, garantendo controllo e sovranità dei dati.

May 08 2026
Altro

Linux 7.2 introduce dm-inlinecrypt per la crittografia on-premise dei dati

Il prossimo kernel Linux 7.2 integrerà `dm-inlinecrypt`, una nuova funzionalità del DeviceMapper che abilita la crittografia inline dei dispositivi a blocchi. Questa innovazione è cruciale per le aziende che gestiscono carichi di lavoro sensibili, inclusi gli LLM, in ambienti self-hosted, migliorando la sicurezza dei dati e l'efficienza operativa. La crittografia inline offre vantaggi in termini di performance e compliance, aspetti fondamentali per la sovranità dei dati.

May 08 2026
Altro

Strategie di comunicazione tech: spunti dal Summit EU-Startups 2026

Il Summit EU-Startups 2026 a Valletta ha ospitato un panel dedicato alle strategie di PR per le startup. La discussione ha offerto spunti pratici su come ottenere copertura mediatica, dalla verifica interna delle notizie alla scelta di un'agenzia. Questi principi sono cruciali anche per le aziende tech che sviluppano soluzioni complesse, come i deployment on-premise di LLM, dove la chiarezza comunicativa è fondamentale per CTO e decision-makers che valutano TCO e sovranità dei dati.

May 08 2026
Altro

USA: 69 giurisdizioni bloccano nuovi data center AI, 4 divieti permanenti

Negli Stati Uniti, un numero crescente di giurisdizioni sta imponendo moratorie o divieti permanenti sulla costruzione di nuovi data center dedicati all'intelligenza artificiale. Attualmente, 69 località hanno bloccato nuove edificazioni, con quattro di questi provvedimenti che sono stati resi definitivi. Questa tendenza evidenzia le crescenti preoccupazioni legate all'impatto ambientale e infrastrutturale delle strutture AI ad alta densità.

← Precedente Page 65 / 160 Successiva →