🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15955

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

May 08 2026
Altro

DS4: un motore di inference ottimizzato per DeepSeek 4 su MacBook da 128GB

Il progetto DS4 introduce un motore di inference specifico per il modello DeepSeek 4, progettato per operare in modo efficiente sui MacBook dotati di 128GB di RAM. Questa iniziativa, guidata da antirez, si concentra sull'ottimizzazione per la memoria flash, evidenziando il crescente interesse verso l'esecuzione di Large Language Models direttamente su dispositivi client. Rappresenta un passo significativo per chi cerca soluzioni di AI on-device, garantendo controllo e sovranità dei dati.

May 08 2026
Altro

Linux 7.2 introduce dm-inlinecrypt per la crittografia on-premise dei dati

Il prossimo kernel Linux 7.2 integrerà `dm-inlinecrypt`, una nuova funzionalità del DeviceMapper che abilita la crittografia inline dei dispositivi a blocchi. Questa innovazione è cruciale per le aziende che gestiscono carichi di lavoro sensibili, inclusi gli LLM, in ambienti self-hosted, migliorando la sicurezza dei dati e l'efficienza operativa. La crittografia inline offre vantaggi in termini di performance e compliance, aspetti fondamentali per la sovranità dei dati.

May 08 2026
Altro

Strategie di comunicazione tech: spunti dal Summit EU-Startups 2026

Il Summit EU-Startups 2026 a Valletta ha ospitato un panel dedicato alle strategie di PR per le startup. La discussione ha offerto spunti pratici su come ottenere copertura mediatica, dalla verifica interna delle notizie alla scelta di un'agenzia. Questi principi sono cruciali anche per le aziende tech che sviluppano soluzioni complesse, come i deployment on-premise di LLM, dove la chiarezza comunicativa è fondamentale per CTO e decision-makers che valutano TCO e sovranità dei dati.

May 08 2026
Altro

USA: 69 giurisdizioni bloccano nuovi data center AI, 4 divieti permanenti

Negli Stati Uniti, un numero crescente di giurisdizioni sta imponendo moratorie o divieti permanenti sulla costruzione di nuovi data center dedicati all'intelligenza artificiale. Attualmente, 69 località hanno bloccato nuove edificazioni, con quattro di questi provvedimenti che sono stati resi definitivi. Questa tendenza evidenzia le crescenti preoccupazioni legate all'impatto ambientale e infrastrutturale delle strutture AI ad alta densità.

May 08 2026
LLM

Spotify espande il suo AI DJ: nuove lingue per l'Europa e il Brasile

Spotify ha annunciato l'espansione della sua funzionalità premium AI DJ, introducendo il supporto per quattro nuove lingue: francese, tedesco, italiano e portoghese brasiliano. Questa mossa mira a migliorare l'esperienza utente in Europa e Brasile, rendendo il DJ virtuale interattivo accessibile a un pubblico più ampio. La tecnicia sottostante implica l'uso di Large Language Models per la generazione vocale e la selezione musicale personalizzata.

May 08 2026
Altro

Il 'Tiny Lab' per LLM: un approccio self-hosted alla sperimentazione AI

L'idea di un 'tiny lab' personale per Large Language Models evidenzia la crescente tendenza verso deployment self-hosted. Questa scelta offre controllo sui dati e costi operativi prevedibili, contrapponendosi alle soluzioni cloud e ponendo l'accento sull'hardware locale e la sovranità dei dati.

May 08 2026
Altro

L'Evoluzione del Software Enterprise: Dalla Compliance all'Framework Operativa Globale

Il software HR globale sta trascendendo il ruolo di mero strumento di compliance, trasformandosi in uno strato infrastrutturale operativo essenziale per le aziende distribuite. Questa evoluzione porta con sé nuove sfide nella gestione di team globali, evidenziando la crescente complessità e la necessità di decisioni strategiche sull'infrastruttura e la sovranità dei dati.

May 08 2026
Market

Lime punta al Nasdaq: la micromobilità alla prova del mercato

Lime, operatore di scooter e e-bike supportato da Uber, ha presentato la richiesta per una IPO al Nasdaq con il ticker LIME. Con 686 milioni di dollari di ricavi nel 2024 e due anni consecutivi di free cash flow, l'azienda si distingue nel settore della micromobilità, rappresentando il primo test significativo sul mercato pubblico in otto anni per la categoria.

May 08 2026
Market

G2A nomina Krzysztof Krawczyk alla guida del consiglio consultivo dopo l'ingresso di CVC

G2A, il marketplace digitale di origini polacche che ha raggiunto quasi 400 milioni di dollari di GMV annuo senza finanziamenti esterni, ha nominato Krzysztof Krawczyk, veterano di CVC, presidente del suo consiglio consultivo. L'ingresso di CVC con una quota di minoranza segna una nuova fase per G2A, che punta a espansione globale e M&A, affidandosi all'esperienza di Krawczyk nel private equity per guidare la crescita futura dopo 16 anni di sviluppo organico.

May 08 2026
Altro

Il data center AI Stargate in Texas e l'infrastruttura energetica on-site

Il data center AI Stargate ad Abilene, Texas, sta sviluppando un'infrastruttura energetica on-site. Durante un tour per la stampa, sono state mostrate le turbine a gas di GE Vernova, parte di un impianto a gas naturale in costruzione. Questa scelta evidenzia l'importanza della generazione di energia localizzata per i grandi carichi di lavoro AI, un fattore chiave per il TCO e la resilienza dei deployment on-premise.

May 08 2026
Frameworks

OpenZL 0.2 di Meta: l'evoluzione della compressione consapevole dei formati

Meta ha rilasciato OpenZL 0.2, la nuova versione del suo framework di compressione dati consapevole dei formati. Annunciato lo scorso ottobre, OpenZL punta a offrire velocità elevate e rapporti di compressione superiori, rappresentando il successore di Zstandard (Zstd). Questa tecnicia è cruciale per ottimizzare lo storage e il trasferimento di grandi volumi di dati, con implicazioni dirette per le infrastrutture on-premise.

May 08 2026
LLM

DeepMind addestra l'AI su Eve Online: Google investe in Fenris Creations

Google DeepMind avvia un progetto per addestrare l'intelligenza artificiale sulle complesse interazioni dei giocatori nel MMORPG Eve Online. L'iniziativa è supportata da un investimento di Google in Fenris Creations, la società dietro il gioco. L'obiettivo è sfruttare la vasta mole di dati generati da centinaia di migliaia di giocatori per sviluppare modelli AI più sofisticati, con implicazioni che vanno oltre il gaming e toccano le sfide infrastrutturali per il training di modelli su larga scala.

May 08 2026
Market

CarCollect ottiene finanziamenti per espandere il remarketing automobilistico B2B

La piattaforma olandese CarCollect, specializzata nel software B2B per il remarketing automobilistico, ha ricevuto un finanziamento da Main Capital Partners. La soluzione SaaS, basata su un'architettura cloud-native, digitalizza l'intero flusso di lavoro per i veicoli usati e mira a rafforzare la sua posizione nel mercato europeo, accelerare l'espansione internazionale e lanciare nuove funzionalità, inclusa la gestione dello stock.

May 08 2026
LLM

OpenAI introduce GPT-Realtime-2 e nuovi modelli vocali per API

OpenAI ha ampliato la sua offerta di modelli vocali tramite API, introducendo GPT-Realtime-2 con capacità di ragionamento di classe GPT-5 per l'audio in tempo reale. L'azienda ha inoltre rilasciato un modello di traduzione che supporta oltre 70 lingue e una variante di Whisper per la trascrizione in streaming. La strategia di prezzo aggressiva mira a rendere queste soluzioni competitive per gli sviluppatori.

May 08 2026
Market

SoftBank riduce il target del prestito garantito da azioni OpenAI a 6 miliardi di dollari

SoftBank Group ha tagliato del 40% l'obiettivo per un prestito garantito da azioni OpenAI, portandolo a 6 miliardi di dollari. La decisione, maturata a due settimane dalla richiesta iniziale di 10 miliardi, riflette la riluttanza dei creditori a valutare le azioni OpenAI come garanzia. Questo evidenzia una discrepanza tra la valutazione percepita di OpenAI e la disponibilità delle banche a concedere finanziamenti, un segnale per il mercato dell'AI.

May 08 2026
Frameworks

AMD spinge l'AI locale open source: integrazione con Gmail per GAIA

AMD continua a rafforzare il suo impegno nell'intelligenza artificiale locale e open source, focalizzandosi sull'hardware consumer Radeon e Ryzen. La recente versione 0.17.6 del software AMD GAIA introduce miglioramenti significativi per l'elaborazione AI su Windows, Linux e macOS, aggiungendo una nuova funzionalità che permette l'interazione con gli account Gmail, sottolineando la crescente fiducia nelle pipeline LLM eseguite in locale.

May 08 2026
Market

Il finanziamento tech europeo rallenta ad aprile: investitori più selettivi

Ad aprile 2026, le startup europee hanno raccolto 5,1 miliardi di euro attraverso 290 accordi, segnando un rallentamento nei finanziamenti. Il settore cleantech ha guidato gli investimenti, mentre il Regno Unito è rimasto il principale beneficiario, nonostante una diminuzione complessiva del capitale. Gli investitori mostrano una crescente selettività.

May 08 2026
Altro

I giocattoli AI per bambini: tra innovazione, privacy e sfide normative

I nuovi giocattoli connessi basati sull'intelligenza artificiale stanno ridefinendo il gioco e le interazioni quotidiane dei bambini. Tuttavia, la loro capacità di elaborare e interagire con i dati solleva significative preoccupazioni in termini di privacy e sicurezza, spingendo alcuni legislatori a considerare misure restrittive. Questo scenario evidenzia la crescente necessità di bilanciare l'innovazione tecnicica con la protezione dei dati sensibili, specialmente in contesti vulnerabili.

May 08 2026
Altro

Nvidia e Corning: un'alleanza strategica per l'infrastruttura AI negli USA

Nvidia e Corning hanno siglato una partnership per potenziare l'infrastruttura e le catene di approvvigionamento dell'intelligenza artificiale negli Stati Uniti. L'iniziativa prevede l'espansione della produzione di fibra ottica, elemento cruciale per la connettività ad alta velocità richiesta dai carichi di lavoro AI. L'annuncio, fatto dal CEO di Nvidia Jensen Huang, sottolinea l'importanza di rafforzare le capacità tecniciche nazionali.

May 08 2026
Market

TSMC e la filiera dei chip AI: l'influenza asiatica sui deployment on-premise

L'aumento dei ricavi di TSMC sottolinea il ruolo cruciale dell'Asia nella fornitura di chip per l'intelligenza artificiale. Questo scenario ha implicazioni significative per le aziende che pianificano deployment di Large Language Models (LLM) on-premise, influenzando la disponibilità e i costi dell'hardware essenziale.

May 08 2026
Market

Colloqui USA-Cina: Nvidia e i CEO tech al centro delle discussioni commerciali

Il presidente degli Stati Uniti sta valutando di invitare i vertici di aziende tecniciche chiave, inclusa Nvidia, a prossimi colloqui commerciali con la Cina. Questa mossa sottolinea la crescente importanza strategica del settore tecnicico, in particolare del silicio e delle GPU, nel contesto delle relazioni internazionali e delle catene di approvvigionamento globali, con potenziali ripercussioni significative per i deployment di Large Language Models.

May 08 2026
Market

Contrabbando di chip Nvidia: OBON Corp. al centro di un'indagine USA

I procuratori statunitensi stanno indagando su OBON Corp., un'azienda thailandese di infrastrutture AI, accusata di aver facilitato il contrabbando di server Supermicro equipaggiati con GPU Nvidia verso la Cina. La società, partner della strategia nazionale AI della Thailandia, avrebbe movimentato miliardi di dollari in hardware, con Alibaba tra i destinatari finali. La vicenda solleva interrogativi sulla catena di approvvigionamento globale per l'AI e la sovranità dei dati.

May 08 2026
Hardware

La scommessa di Nvidia sul raffreddamento di nuova generazione per l'AI

Nvidia sta investendo in soluzioni di raffreddamento avanzate per l'intelligenza artificiale, un passo cruciale per gestire il calore generato dai potenti acceleratori GPU. Questa strategia è fondamentale per sostenere le crescenti esigenze di calcolo degli LLM e dei carichi di lavoro AI, influenzando direttamente la progettazione dei data center e il TCO per i deployment on-premise.

May 08 2026
Market

Novatek: prospettive di margine in crescita per mix prodotti e consegne accelerate

Novatek ha annunciato un miglioramento delle proprie prospettive di margine, attribuendolo a un mix di prodotti più solido e a consegne anticipate. Questa notizia, sebbene focalizzata su un singolo fornitore di semiconduttori, evidenzia l'importanza della stabilità della supply chain per le aziende che pianificano deployment di Large Language Models (LLM) on-premise. La disponibilità e i tempi di consegna dell'hardware sono fattori critici per il TCO e la fattibilità dei progetti AI self-hosted.

May 08 2026
LLM

Ottimizzazione e costi: la sfida dell'addestramento per LLM di piccole dimensioni

Un'iniziativa accademica evidenzia le sfide e i costi associati all'addestramento di Large Language Models (LLM) di dimensioni contenute, con l'obiettivo di migliorarne la coerenza e ridurre le allucinazioni. L'impegno, finanziato da una docente universitaria, sottolinea l'importanza di investire in cicli di training mirati per modelli che vanno da 1.5 a 35 miliardi di parametri, anche con tecniche di Quantization come Q8_0, per renderli più affidabili in contesti applicativi critici.

May 08 2026
Market

La domanda di AI mette sotto pressione la catena di fornitura dei materiali PCB

L'esplosione della domanda di intelligenza artificiale sta generando una crescente tensione nella catena di fornitura di materiali chiave per i circuiti stampati (PCB). Questo fenomeno, alimentato dalla necessità di hardware sempre più potente per l'Inference e il training di LLM, ha implicazioni dirette sui costi e i tempi di consegna per le aziende che pianificano deployment AI, in particolare in ambienti self-hosted.

May 08 2026
Hardware

Coherent: ordini per ottiche 1.6T e semiconduttori fino al 2030

Coherent Corp. ha annunciato che il suo portafoglio ordini si estende fino al 2030, con una forte domanda per ottiche 1.6T e capacità produttiva di semiconduttori InP da 6 pollici. Questo indica una crescita sostenuta nelle infrastrutture di rete e di calcolo, cruciali per i carichi di lavoro AI e LLM, e suggerisce tempi di consegna prolungati per componenti chiave.

May 08 2026
Market

Big Tech finanzia SK Hynix: la corsa alla memoria AI si intensifica

Le maggiori aziende tecniciche starebbero offrendo finanziamenti a SK Hynix per la costruzione di nuove fabbriche e l'acquisto di strumenti EUV. Questa mossa evidenzia l'intensificarsi della competizione nel settore delle memorie dedicate all'intelligenza artificiale, cruciali per lo sviluppo e il deployment di Large Language Models e altre applicazioni AI. L'investimento mira a garantire la fornitura di componenti essenziali in un mercato in rapida crescita.

May 08 2026
Market

TSMC: ricavi in crescita del 30% nei primi quattro mesi del 2026 grazie al boom dell'AI

TSMC, leader nella produzione di semiconduttori, ha registrato un aumento del 30% nei ricavi nei primi quattro mesi del 2026. Questo incremento è attribuito al crescente "boom dell'AI", che sta alimentando una domanda senza precedenti di silicio avanzato. L'andamento evidenzia la centralità dei produttori di chip nell'ecosistema dell'intelligenza artificiale e le implicazioni per le strategie di deployment on-premise.

May 08 2026
Market

Investimenti taiwanesi negli USA: 50 miliardi per l'ecosistema tech

Gli investimenti delle aziende taiwanesi negli Stati Uniti hanno superato le previsioni, con il governo di Taipei che ha stanziato un finanziamento di 50 miliardi di dollari. Questa mossa strategica rafforza l'interdipendenza tecnicica tra le due nazioni, con implicazioni significative per settori chiave come i semiconduttori e l'intelligenza artificiale, influenzando la disponibilità e il costo dell'hardware essenziale per i deployment di LLM.

May 08 2026
Altro

Compal e Verda: server GPU a liquido per la sovranità dei dati nell'AI

Compal e Verda hanno stretto una partnership strategica per fornire server GPU con raffreddamento a liquido. Questa collaborazione mira a supportare i deployment di intelligenza artificiale che richiedono sovranità dei dati e controllo infrastrutturale. L'adozione di soluzioni a liquido per i server GPU è cruciale per gestire l'elevato calore generato dai carichi di lavoro AI più intensivi, garantendo efficienza e prestazioni ottimali in ambienti on-premise.

May 08 2026
Altro

Automazione AI nel back office: tra aumento di produttività e sovraccarico

Basata, un'azienda di intelligenza artificiale, si confronta con il dilemma dell'automazione nel back office. Mentre il settore discute l'impatto degli LLM sulla forza lavoro, il personale amministrativo di Basata è più preoccupato dal sovraccarico di lavoro che dalla sostituzione, evidenziando le sfide operative immediate dell'integrazione AI.

May 08 2026
LLM

L'IA Generativa Valuta il Pensiero Critico: Uno Studio sui Contro-Argomenti

Uno studio esplora l'uso di LLM per valutare il pensiero critico negli studenti, in particolare la capacità di formulare contro-argomenti. La ricerca ha coinvolto 36 studenti e ha confrontato le valutazioni umane con quelle di sei LLM di frontiera, usando rubriche standardizzate. I risultati indicano che gli studenti mantengono capacità logiche anche con l'IA generativa, e che gli LLM possono valutare efficacemente i lavori scritti su larga scala, con un allineamento generale alle valutazioni umane. Questo apre a nuove prospettive per l'adozione dell'IA nell'istruzione, pur riconoscendo i rischi di abuso.

May 08 2026
LLM

AdaGATE: RAG multi-hop più robusta con selezione di evidenze token-efficiente

AdaGATE è un nuovo controller per la Retrieval-Augmented Generation (RAG) multi-hop, progettato per affrontare la fragilità dei sistemi attuali con evidenze rumorose o ridondanti e contesti limitati. Senza richiedere training, AdaGATE ottimizza la selezione delle evidenze risolvendo un problema di "riparazione" vincolato dai token. Il sistema bilancia copertura delle lacune, corroborazione, novità e rilevanza. I test su HotpotQA mostrano un miglioramento dell'F1 e un'efficienza 2.6 volte superiore nell'uso dei token rispetto ad approcci esistenti, rendendo la RAG più robusta.

May 08 2026
Frameworks

Previsione della rinosinusite cronica con dati EHR nazionali e modelli stratificati

Un nuovo studio sfrutta i dati longitudinali delle cartelle cliniche elettroniche (EHR) del programma *All of Us* per prevedere la rinosinusite cronica (CRS). Il team ha sviluppato una pipeline ibrida per selezionare 100 caratteristiche da oltre 110.000 codici e ha addestrato modelli stratificati per sesso ed età. Il framework ha raggiunto un'AUC di 0.8461, migliorando la discriminazione e supportando una stratificazione del rischio più efficace nella cura primaria.

May 08 2026
LLM

Minimi piatti: un'illusione nella generalizzazione dei modelli AI?

Una nuova ricerca mette in discussione il ruolo dei "minimi piatti" nella generalizzazione delle reti neurali. Lo studio suggerisce che la "debolezza" (weakness), definita dal comportamento del modello, sia un predittore più robusto e invariante rispetto alla riparametrizzazione. Le implicazioni sono significative per la comprensione e l'ottimizzazione dell'addestramento dei Large Language Models, spostando il focus dalla geometria dello spazio dei pesi alle capacità funzionali del modello, con potenziali benefici per il TCO e l'affidabilità nei deployment on-premise.

May 08 2026
LLM

ZAYA1-8B: L'LLM MoE di Zyphra Affina il Ragionamento su Piattaforma AMD

Zyphra ha presentato ZAYA1-8B, un Large Language Model (LLM) Mixture-of-Experts (MoE) focalizzato sul ragionamento, con 700 milioni di parametri attivi e 8 miliardi totali. Addestrato su una piattaforma AMD completa, il modello dimostra performance competitive in matematica e coding, eguagliando o superando modelli più grandi. L'introduzione di Markovian RSA, un metodo di calcolo innovativo per l'inference, ne potenzia ulteriormente le capacità, riducendo il divario con LLM di dimensioni superiori e offrendo nuove prospettive per i deployment on-premise.

May 08 2026
LLM

APM: Decifrare le Politiche di Sicurezza degli LLM per Deployment Più Trasparenti

Un nuovo approccio, gli Annotator Policy Models (APM), promette di migliorare la comprensione delle politiche di sicurezza degli LLM. Analizzando il comportamento degli annotatori, sia umani che basati su LLM, gli APM identificano ambiguità e differenze di prospettiva, senza richiedere sforzi aggiuntivi. Questo supporta la creazione di sistemi AI più robusti e allineati con le aspettative di sicurezza, cruciale per le aziende che implementano soluzioni AI.

May 08 2026
Market

Shenmao e il boom dell'infrastruttura AI: crescita record dei ricavi

Shenmao registra una crescita record dei ricavi, spinta dalla crescente domanda di infrastrutture per l'intelligenza artificiale. Questo trend riflette l'espansione del mercato, dove le aziende cercano soluzioni robuste per il deployment di LLM, bilanciando controllo, sovranità dei dati e TCO, in particolare per carichi di lavoro on-premise e ibridi.

May 08 2026
Altro

Accton e gli investimenti AI: il segnale degli hyperscaler sull'infrastruttura

Il recente trimestre record di Accton indica che i grandi fornitori di servizi cloud, gli hyperscaler, stanno mantenendo un elevato livello di investimenti nelle infrastrutture dedicate all'intelligenza artificiale. Questo trend sottolinea la crescente domanda di capacità di calcolo e storage per i carichi di lavoro AI, influenzando le strategie di deployment sia cloud che on-premise e la valutazione del TCO per le aziende.

May 08 2026
Market

La geopolitica dei chip: Taiwan al centro delle strategie AI on-premise

Il ruolo cruciale dell'industria taiwanese dei semiconduttori emerge come fattore chiave nelle dinamiche geopolitiche globali, con implicazioni dirette per le strategie di deployment di Large Language Models (LLM). Le tensioni internazionali evidenziano i rischi della catena di approvvigionamento, influenzando la disponibilità di hardware essenziale per infrastrutture AI self-hosted e la sovranità dei dati.

May 08 2026
Market

Profitti AI: i lavoratori Samsung chiedono una quota maggiore, sciopero in vista

I dipendenti di Samsung Electronics stanno chiedendo una maggiore partecipazione ai profitti generati dall'intelligenza artificiale, con la minaccia di uno sciopero che si profila all'orizzonte. Questa situazione evidenzia le crescenti tensioni sulla distribuzione del valore nell'era dell'AI, con potenziali ripercussioni sull'intera filiera tecnicica, inclusa la fornitura di componenti cruciali per i deployment on-premise.

May 08 2026
Market

L'infrastruttura AI spinge i ricavi dei distributori di componenti: un anno di crescita record

Un recente report evidenzia come la spesa per l'infrastruttura dedicata all'intelligenza artificiale abbia raddoppiato i ricavi di un distributore di circuiti integrati in un solo anno. Questo dato sottolinea la crescente domanda di hardware specializzato per supportare carichi di lavoro AI, in particolare per i Large Language Models (LLM). La tendenza riflette l'accelerazione degli investimenti in soluzioni on-premise e ibride, dove il controllo sui dati e l'ottimizzazione del TCO diventano prioritari per le aziende.

May 08 2026
LLM

Decifrare il Pensiero degli LLM: Anthropic Rilascia i Pesi NLA per Gemma 3

Anthropic ha svelato una nuova ricerca che permette di comprendere i processi interni degli LLM durante la generazione di testo. Utilizzando i Natural Language Autoencoders (NLA), è ora possibile visualizzare i "pensieri" di un modello come Gemma 3 27b instruct. Questa innovazione, con i pesi NLA resi pubblici, offre strumenti preziosi per la trasparenza, il debugging e il controllo dei modelli, aspetti cruciali per i deployment on-premise.

May 08 2026
Hardware

Skymizer lancia la HTX301: una scheda PCIe da 384GB per l'inference AI on-prem

La taiwanese Skymizer ha annunciato la HTX301, una scheda PCIe progettata per l'inference AI on-premise. Il dispositivo si distingue per i suoi 384GB di memoria e un consumo energetico di circa 240 Watt, posizionandosi come una soluzione mirata a soddisfare le esigenze di sovranità dei dati e controllo infrastrutturale per i carichi di lavoro LLM.

May 08 2026
Altro

LLMSearchIndex: Ricerca Web Locale Open Source con oltre 200 milioni di pagine per RAG

LLMSearchIndex è una nuova libreria Python open source che offre una soluzione di ricerca web completamente locale, progettata per i sistemi RAG basati su LLM. Con un indice altamente compresso di circa 2 GB, che include oltre 200 milioni di pagine web da FineWeb e Wikipedia, il progetto mira a superare la dipendenza da API a pagamento o scraper, consentendo retrieval rapidi su hardware comune e rafforzando la sovranità dei dati nei deployment on-premise.

May 08 2026
LLM

Horus: L'LLM Open Source Egiziano che Punta a Ridefinire il Panorama AI Regionale

Il progetto Horus, sviluppato da Assem Sabry e TokenAI, segna un traguardo significativo come il primo Large Language Model (LLM) interamente creato da zero in Egitto. Open source e disponibile su piattaforme come Hugging Face e GitHub, Horus si prepara al rilascio della versione 1.5 Instruct, che promette un aumento di 5 volte nelle prestazioni e una lunghezza del contesto di 64K token. L'iniziativa sottolinea l'emergere di capacità AI locali e la spinta verso la sovranità dei dati nella regione.

May 08 2026
Market

Retroscena Microsoft-OpenAI: I dubbi del 2018 e la strategia anti-Amazon

Documenti interni di Microsoft risalenti al 2018 rivelano lo scetticismo dei dirigenti verso OpenAI. Allo stesso tempo, emerge una chiara preoccupazione strategica: evitare che la nascente entità finisse per allearsi con Amazon, un rivale chiave nel settore cloud e AI. Queste rivelazioni offrono uno sguardo sulle dinamiche competitive che hanno plasmato il panorama dell'intelligenza artificiale.

May 08 2026
Frameworks

Ottimizzazione LLaMA.cpp: Multi-Token Prediction accelera Gemma 4 su hardware locale

Un'implementazione di Multi-Token Prediction (MTP) per LLaMA.cpp ha dimostrato un aumento del 40% nella velocità di generazione di token per il modello Gemma 26B, quantizzato in formato GGUF. I test, condotti su un MacBook Pro M5Max, evidenziano il potenziale per migliorare l'efficienza dell'inference LLM su hardware self-hosted, un aspetto cruciale per i deployment on-premise.

May 08 2026
Hardware

M3 da 512GB introvabile: sfide per gli LLM on-premise e l'inference locale

La scarsità di hardware con elevata memoria unificata, come i chip M3 di Apple da 512GB o 256GB, sta creando difficoltà per chi intende eseguire Large Language Models (LLM) in locale. Questa situazione spinge sviluppatori e aziende a riconsiderare le strategie di deployment on-premise, valutando alternative come l'inference su CPU e i relativi compromessi in termini di performance e latenza. La dipendenza da specifici componenti hardware evidenzia l'importanza di una pianificazione resiliente per la sovranità dei dati e il TCO.

May 08 2026
Altro

Qwen 3.6 27B su iGPU AMD: un test di Inference locale con LLAMA CPP

Un utente ha testato il modello Qwen 3.6 27B, in formato GGUF e con Quantization Q4.0, su una iGPU AMD dotata di 64GB di memoria unificata, utilizzando il Framework LLAMA CPP. I risultati indicano una performance sorprendente, paragonabile a quella di modelli più piccoli come Qwen 3.5 9B. Questo esperimento sottolinea il potenziale delle soluzioni on-premise per l'Inference di Large Language Models, anche su hardware non specialistico, promuovendo sovranità dei dati e controllo.

May 08 2026
LLM

K2.6 eccelle in un benchmark di coding indipendente, superando modelli noti

Un benchmark di coding indipendente, akitaonrails, ha posizionato il modello K2.6 nella fascia A con un punteggio di 87, superando concorrenti come Qwen 3.6 plus e Deepseek v4 flash. Questo risultato, basato su una metodologia fissa, evidenzia le capacità di K2.6 e sottolinea le sfide legate alla catena di strumenti per i deployment on-premise di LLM open source.

May 08 2026
Hardware

LLM on-premise: Qwen 27B vs 35B MoE su RTX 5080 con 16GB VRAM

Un professionista sta valutando due versioni del modello Qwen3.6, una dense da 27 miliardi di parametri e una MoE da 35 miliardi, per carichi di lavoro di coding e agenti su una GPU RTX 5080 con 16GB di VRAM. La sfida è ottimizzare le performance, la gestione del contesto esteso e la qualità dell'output in un ambiente self-hosted, considerando i trade-off tra efficienza dei parametri attivi e consistenza dei modelli dense, il tutto con vincoli di spazio su disco.

May 08 2026
Altro

Google lancia Fitbit Air: un tracker senza schermo per il mercato di massa

Google, parte di Alphabet, ha introdotto Fitbit Air, un nuovo tracker di attività senza schermo progettato per il mercato di massa. Con un prezzo di 99 dollari, il dispositivo mira a rendere il monitoraggio della salute più accessibile, sollevando discussioni sulle implicazioni per la gestione dei dati e le infrastrutture di elaborazione, temi centrali per le decisioni di deployment on-premise.

May 08 2026
Market

Zhen Ding Tech: vendite record per server e substrati IC spinti dalla domanda AI

Zhen Ding Tech ha registrato un'impennata nelle vendite di server e substrati per circuiti integrati (IC), raggiungendo cifre record grazie alla crescente domanda di infrastrutture per l'intelligenza artificiale. Questo trend evidenzia la corsa globale alla costruzione di capacità computazionali dedicate agli LLM e ad altre applicazioni di AI, con implicazioni significative per i deployment on-premise e la catena di approvvigionamento hardware.

May 08 2026
Altro

L'energia per l'AI on-premise: la prospettiva di Pegatron sull'approvvigionamento

La richiesta del presidente di Pegatron di preordinare combustibile nucleare evidenzia le crescenti preoccupazioni per la stabilità energetica a Taiwan. Questo scenario ha implicazioni dirette per l'industria tecnicica globale e, in particolare, per le aziende che valutano il deployment di infrastrutture AI on-premise, dove il fabbisogno energetico è un fattore critico per il TCO e la sovranità operativa.

May 08 2026
Market

Chenbro Micom: forte domanda di server AI prevista per il 2026

Chenbro Micom, un attore chiave nel settore server, anticipa un'impennata nella domanda di server nella seconda metà del 2026. Questa previsione è legata alla continua espansione delle infrastrutture AI, suggerendo un trend di crescita sostenuta per i deployment di Large Language Models e altri carichi di lavoro intensivi. Le aziende si preparano a investire in soluzioni hardware robuste, con un focus crescente sulle opzioni self-hosted.

May 08 2026
Market

Gli investimenti AI degli hyperscaler ridefiniscono il mercato e le strategie di supply chain

I massicci investimenti in intelligenza artificiale da parte dei principali hyperscaler stanno profondamente alterando il panorama competitivo dei servizi di produzione elettronica (EMS) e le strategie globali di supply chain. Questa dinamica crea nuove sfide e opportunità, influenzando la disponibilità e i costi dell'hardware, con ripercussioni significative anche per le aziende che valutano deployment di LLM on-premise, dove la pianificazione del TCO e la sovranità dei dati sono prioritarie.

May 08 2026
Altro

Syncmold punta sull'internet satellitare per la prossima fase di crescita

L'azienda taiwanese Syncmold sta orientando la propria strategia verso il crescente mercato dell'internet satellitare. Questa mossa riflette un'attenzione alle nuove infrastrutture di connettività, cruciali per l'elaborazione dati distribuita e le applicazioni di intelligenza artificiale all'edge, con implicazioni significative per le decisioni di deployment on-premise e la sovranità dei dati in ambienti remoti.

May 08 2026
Altro

Dirty Frag: exploit Linux dal 2017 offre accesso root immediato, nessuna patch

Un nuovo exploit critico, denominato "Dirty Frag", è emerso, garantendo accesso root immediato sulla maggior parte delle macchine Linux sin dal 2017. La vulnerabilità, descritta come simile a "Copy Fail", non dispone ancora di patch e la sua divulgazione è avvenuta nonostante un embargo. Questo solleva serie preoccupazioni per la sicurezza dei deployment on-premise e la sovranità dei dati, evidenziando le sfide nella gestione delle infrastrutture self-hosted.

May 08 2026
Altro

Dirty Frag: Nuova vulnerabilità Linux concede privilegi di root, senza patch

Una nuova vulnerabilità di escalation dei privilegi locali, denominata "Dirty Frag", è stata resa pubblica per i sistemi Linux. La falla consente di ottenere privilegi di root su tutte le distribuzioni, ma al momento non sono disponibili patch o identificativi CVE. La divulgazione anticipata da parte del ricercatore di sicurezza ha preceduto il rilascio delle correzioni, lasciando gli amministratori di sistema in una situazione critica.

May 08 2026
Altro

Il 'sim-to-real problem': perché i modelli AI faticano a passare dalla simulazione alla realtà

Il 'sim-to-real problem' evidenzia una delle sfide più complesse nello sviluppo dell'intelligenza artificiale: la difficoltà per i sistemi addestrati in ambienti simulati di replicare le prestazioni nel mondo reale. Questo divario è cruciale per il deployment di Large Language Models (LLM) e altri modelli AI in contesti operativi, specialmente in scenari on-premise o edge, dove la fedeltà all'ambiente fisico è determinante per il successo e la sicurezza.

May 08 2026
Market

Taiwan rafforza i parchi scientifici: impatto sulla supply chain AI e i deployment on-premise

Il governo di Taiwan espande i propri parchi scientifici in risposta alle tensioni tecniciche tra Stati Uniti e Cina. Questa mossa strategica sottolinea l'importanza cruciale dell'isola nella produzione di semiconduttori avanzati, fondamentali per l'infrastruttura AI. Per le aziende che considerano deployment on-premise di Large Language Models, la stabilità della supply chain del silicio diventa un fattore determinante per il TCO e la sovranità dei dati.

May 08 2026
Market

Il boom dell'AI ridefinisce la supply chain EMS: Taiwan consolida la leadership

L'esplosione dell'intelligenza artificiale sta profondamente trasformando la catena di fornitura globale dei servizi di produzione elettronica (EMS). Le aziende taiwanesi stanno estendendo la loro posizione dominante, un fenomeno che riflette le crescenti e specifiche esigenze hardware dettate dai Large Language Models (LLM) e da altre applicazioni AI. Questa dinamica ha implicazioni significative per le strategie di deployment on-premise e la disponibilità di infrastrutture critiche.

May 07 2026
Altro

Chrome scarica un LLM da 4GB in locale: un caso di controllo e privacy

Google Chrome ha iniziato a scaricare silenziosamente un modello Large Language Model (LLM) da 4GB sui PC degli utenti, senza alcun consenso esplicito. Questa pratica solleva interrogativi significativi sulla privacy dei dati, il controllo delle risorse locali e la trasparenza delle operazioni software. L'episodio evidenzia le sfide emergenti nel deployment di intelligenza artificiale direttamente sui dispositivi degli utenti e le implicazioni per chi gestisce infrastrutture on-premise.

May 07 2026
Altro

LLM locali: la soglia di 'sufficienza' si alza, cambiano le architetture AI

Una tendenza emergente mostra che i Large Language Models (LLM) locali stanno diventando sufficientemente performanti per molti carichi di lavoro quotidiani, riducendo la dipendenza dai modelli cloud di punta. Questo sposta il focus verso architetture ibride e 'workload-aware', ottimizzate per latenza e costo, piuttosto che per i soli benchmark. Le implicazioni per i deployment on-premise sono significative, offrendo maggiore controllo e sovranità dei dati.

May 07 2026
LLM

OpenAI introduce nuove funzionalità vocali nella sua API

OpenAI ha rilasciato nuove funzionalità di intelligenza vocale accessibili tramite la sua API. Queste innovazioni mirano a migliorare i sistemi di assistenza clienti e trovano applicazione in settori diversi come l'istruzione e le piattaforme per creatori di contenuti. L'integrazione di tali capacità solleva considerazioni tecniche per i deployment on-premise, specialmente in termini di latenza e sovranità dei dati.

May 07 2026
Altro

Regolamentazione AI: L'Amministrazione Trump Valuta un Ordine Esecutivo

Recenti report indicano che l'amministrazione Trump sta considerando un ordine esecutivo per stabilire una supervisione federale sui nuovi modelli di intelligenza artificiale. Questa mossa potrebbe avere implicazioni significative per le aziende che sviluppano e implementano LLM, in particolare per quelle che privilegiano deployment on-premise per ragioni di sovranità dei dati e compliance.

May 07 2026
Altro

ARC-AGI-2: Un Modello Ricorsivo Sfida i Giganti con una Sola RTX 4090

Un team ha sviluppato TOPAS, un modello ricorsivo da 100 milioni di parametri, dimostrando che l'innovazione architetturale può superare la pura potenza di calcolo. Valutato localmente al 36% e sulla leaderboard pubblica al 11.67% a causa di vincoli di tempo, il progetto mira a ridefinire le capacità dell'AI su hardware consumer, offrendo spunti cruciali per i deployment on-premise.

May 07 2026
Altro

OpenAI potenzia la cybersecurity con GPT-5.5 e accesso controllato

OpenAI sta ampliando il suo programma "Trusted Access for Cyber" con i nuovi modelli GPT-5.5 e GPT-5.5-Cyber. L'iniziativa mira a supportare i difensori verificati nell'accelerare la ricerca di vulnerabilità e nella protezione delle infrastrutture critiche. Questo solleva questioni cruciali sulla sovranità dei dati e sul deployment on-premise per settori sensibili, evidenziando il bilanciamento tra accessibilità e controllo.

May 07 2026
Market

Slate Auto: la rappresentante di Bezos lascia il board, nessun camion prodotto

Melinda Lewison, che gestisce l'ufficio di famiglia di Jeff Bezos, ha lasciato il consiglio di amministrazione di Slate Auto, una startup di veicoli elettrici che ha raccolto 1,4 miliardi di dollari. La sua partenza avviene mesi prima del previsto rilascio del primo camion, sollevando interrogativi sulla governance e sulla capacità dell'azienda di trasformare i cospicui investimenti in prodotti tangibili. La vicenda evidenzia le sfide nel portare innovazioni complesse sul mercato.

May 07 2026
Market

Pit, la nuova startup AI dai fondatori di Voi, raccoglie 16 milioni di dollari

Pit, una nuova startup nel settore dell'intelligenza artificiale, ha annunciato un round di finanziamento seed da 16 milioni di dollari. L'iniziativa, guidata dai cofondatori del gigante europeo degli scooter Voi, ha visto la partecipazione di a16z come investitore principale. Con sede a Stoccolma, Pit si posiziona come un nuovo attore nel panorama AI, attirando l'attenzione per il suo team di fondatori esperti e il significativo supporto finanziario.

May 07 2026
Altro

OpenAI rafforza la sicurezza di ChatGPT con la funzione 'Contatto Fidato'

OpenAI ha introdotto una nuova funzionalità, denominata 'Contatto Fidato', per migliorare la protezione degli utenti di ChatGPT. L'iniziativa mira a gestire situazioni delicate in cui le conversazioni potrebbero indicare un rischio di autolesionismo, ampliando gli sforzi dell'azienda per garantire un ambiente digitale più sicuro e responsabile.

May 07 2026
Altro

Perplexity porta gli agenti AI su Mac: implicazioni per il deployment locale

Perplexity ha reso disponibile a tutti la sua soluzione "Personal Computer" per Mac, introducendo agenti AI direttamente sui dispositivi degli utenti. Questa mossa evidenzia una crescente tendenza verso l'esecuzione locale di carichi di lavoro AI, sollevando considerazioni cruciali per le aziende riguardo sovranità dei dati, controllo e TCO rispetto alle architetture cloud.

May 07 2026
LLM

Mozilla e Mythos: 271 vulnerabilità Firefox con "quasi zero falsi positivi"

Mozilla ha rivelato dettagli sull'uso di Anthropic Mythos, un modello AI per la rilevazione di vulnerabilità. In due mesi, sono state identificate 271 falle di sicurezza in Firefox, con un tasso di falsi positivi "quasi nullo". Questo successo, che sfida lo scetticismo iniziale, è attribuito ai miglioramenti del modello e a un "harness" personalizzato sviluppato da Mozilla per l'analisi del codice sorgente, segnando un passo avanti rispetto ai precedenti tentativi AI afflitti da "allucinazioni".

May 07 2026
Altro

La causa di Elon Musk mette sotto esame la sicurezza di OpenAI e la governance dell'AI

La recente azione legale di Elon Musk contro OpenAI solleva interrogativi cruciali sulla sicurezza dei Large Language Models avanzati e sulla fiducia riposta nei leader tecnicici. Il dibattito si concentra sulla governance dell'intelligenza artificiale e sulle implicazioni per il controllo e la sovranità dei dati in contesti di deployment on-premise.

May 07 2026
Hardware

AMD Instinct MI350P: 144GB HBM3E e +40% in FP16/FP8 per l'AI PCIe

AMD ha annunciato la scheda acceleratrice AI Instinct MI350P in formato PCIe. Dotata di 144GB di memoria HBM3E, questa nuova soluzione promette un incremento prestazionale teorico di circa il 40% nelle operazioni FP16 e FP8 rispetto al concorrente Nvidia H200 NVL. L'introduzione della MI350P rafforza l'offerta di AMD nel segmento degli acceleratori per carichi di lavoro di intelligenza artificiale, mirando a soddisfare le esigenze di deployment on-premise e cloud.

May 07 2026
Market

Bumble dice addio allo "swipe": un cambio di paradigma nell'interazione utente

La CEO Whitney Wolfe Herd ha annunciato che l'app di incontri Bumble eliminerà la celebre funzionalità dello "swipe", un gesto iconico che ha definito l'interazione in molte piattaforme sociali. La mossa segnala un'evoluzione nel design delle interfacce utente, con implicazioni per le future strategie di engagement digitale.

May 07 2026
Altro

Allerta Malware su Hugging Face: Un Falso LLM Minaccia la Sicurezza dei Sistemi

È stata lanciata un'allerta critica riguardo a un modello fraudolento su Hugging Face, denominato `Open-OSS/privacy-filter`. Questo falso LLM è stato identificato come veicolo per il download e l'esecuzione di malware sui sistemi degli utenti. L'attacco sfrutta uno script `loader.py` per scaricare file eseguibili e batch malevoli. La comunità è invitata a prestare la massima attenzione e a utilizzare esclusivamente il modello legittimo `openai/privacy-filter` per evitare rischi di sicurezza.

May 07 2026
Hardware

AMD e le GPU PCIe: una nuova opzione per i deployment LLM locali

AMD si prepara a introdurre una nuova GPU con fattore di forma PCIe, potenzialmente ampliando le opzioni hardware per le implementazioni di Large Language Models (LLM) in ambienti self-hosted. L'attenzione del mercato si concentra sul posizionamento di prezzo e sulle specifiche tecniche che potrebbero renderla una soluzione competitiva per l'inference LLM on-premise, offrendo alternative ai professionisti che gestiscono infrastrutture locali.

May 07 2026
Altro

La Casa Bianca valuta il controllo governativo sui modelli AI prima del rilascio

La Casa Bianca starebbe valutando l'introduzione di un controllo governativo obbligatorio sui modelli di intelligenza artificiale prima del loro rilascio. Un ordine esecutivo è in fase di discussione per definire i meccanismi di questa supervisione. La notizia emerge mentre il CEO di OpenAI, Sam Altman, ha partecipato a un incontro della Task Force della Casa Bianca sull'educazione all'intelligenza artificiale, evidenziando il crescente interesse dell'amministrazione per la governance dell'AI.

May 07 2026
Altro

ChatGPT introduce 'Trusted Contact': una nuova funzione di sicurezza per il benessere degli utenti

OpenAI ha lanciato 'Trusted Contact' per ChatGPT, una funzione di sicurezza opzionale che notifica un contatto fidato se il sistema rileva preoccupazioni serie legate all'autolesionismo. Questa novità sottolinea l'impegno verso il benessere degli utenti, ma solleva anche interrogativi importanti sulla gestione dei dati sensibili e sulla privacy, temi cruciali per le aziende che valutano deployment di Large Language Models (LLM) on-premise.

May 07 2026
LLM

L'evoluzione dell'intelligenza vocale: nuovi modelli in tempo reale via API

OpenAI introduce nuovi modelli vocali in tempo reale accessibili tramite API, capaci di ragionare, tradurre e trascrivere il parlato. Questa innovazione mira a rendere le interazioni vocali più naturali e intelligenti, ponendo nuove sfide e opportunità per le aziende che valutano strategie di deployment on-premise o basate su cloud per le proprie applicazioni AI.

May 07 2026
LLM

ZAYA1-8B: Zyphra punta sull'efficienza per i Large Language Models on-premise

Zyphra ha introdotto ZAYA1-8B, un Large Language Model da 8 miliardi di parametri. Il modello è progettato per offrire un'elevata 'densità di intelligenza', rendendolo particolarmente adatto per deployment on-premise e in ambienti con risorse hardware limitate. Questa soluzione risponde alla crescente domanda di LLM efficienti che garantiscano controllo sui dati e ottimizzazione del TCO.

May 07 2026
Altro

Allerta Malware: Un Falso Filtro Privacy LLM Minaccia gli Ambienti Windows su Hugging Face

È stato scoperto un malware infostealer camuffato da "filtro privacy" per LLM, distribuito su Hugging Face. Il virus, che prende di mira esclusivamente sistemi Windows, utilizza un dropper Python per installare un eseguibile malevolo, compromettendo la sicurezza dei dati in ambienti di deployment AI. L'incidente sottolinea l'importanza della vigilanza e della sicurezza della supply chain per i deployment on-premise.

May 07 2026
LLM

ChatGPT e le sue peculiarità linguistiche: un caso di studio tra USA e Cina

Il chatbot di OpenAI, ChatGPT, mostra curiose peculiarità linguistiche quando utilizzato in cinese, generando frustrazione tra gli utenti. Questo fenomeno evidenzia le complesse sfide legate alla localizzazione dei Large Language Models e alla loro capacità di adattarsi a contesti culturali e idiomatici diversi. La comprensione di tali "tic" è cruciale per le aziende che valutano il deployment di LLM in ambienti multilingue e per garantire la fedeltà del messaggio.

May 07 2026
Hardware

Supporto nativo per Realtek RTL8159 10GbE USB Ethernet nel kernel Linux 7.2

Il kernel Linux 7.2 introdurrà il supporto nativo per il controller Realtek RTL8159, un componente chiave per gli adattatori di rete USB 10GbE. Questa integrazione eliminerà la necessità di driver esterni, semplificando l'adozione di soluzioni di connettività ad alta velocità, disponibili anche a costi contenuti, per server e workstation. L'aggiornamento è atteso per l'estate, migliorando stabilità e gestione per i deployment on-premise.

May 07 2026
Altro

Mythos di Anthropic: un LLM che ridefinisce la sicurezza di Firefox

I ricercatori di Mozilla hanno scoperto numerose vulnerabilità di elevata gravità in Firefox, grazie all'impiego di Mythos, un Large Language Model sviluppato da Anthropic. Questo episodio evidenzia il crescente ruolo degli LLM nell'analisi della sicurezza software, sollevando questioni cruciali su deployment, sovranità dei dati e TCO per le aziende che adottano queste tecnicie per la protezione delle proprie infrastrutture.

May 07 2026
Hardware

Riorganizzazione del driver AMD RadeonSI: verso build multimediali dedicate

Una riorganizzazione del codice del driver AMD RadeonSI Gallium3D è stata integrata in Mesa 26.2-devel. L'obiettivo è separare le funzionalità grafiche da quelle di accelerazione multimediale, consentendo la creazione di driver specifici per carichi di lavoro multimediali. Questa mossa ottimizza le risorse e riduce il footprint software, con implicazioni positive per deployment on-premise e sistemi embedded, dove l'efficienza è cruciale.

May 07 2026
Hardware

Lian Li DK07 Wood: la scrivania motorizzata che ospita due PC E-ATX

Lian Li presenta la DK07 Wood, una scrivania motorizzata che integra un chassis per due sistemi PC completi, compatibile con schede madri E-ATX e configurazioni di raffreddamento avanzate. Questa soluzione offre un ambiente di lavoro ergonomico e una potente piattaforma hardware in un unico elemento d'arredo, ideale per professionisti e sviluppatori che necessitano di elevate capacità di calcolo on-premise.

May 07 2026
Market

Google lancia Fitbit Air: un dispositivo essenziale per un servizio AI di coaching

Google ha presentato Fitbit Air, un dispositivo da 100 dollari privo di schermo e funzionalità autonome. L'hardware, una fascia in tessuto con un sensore da cinque grammi, traccia battito cardiaco e passi. Il vero focus dell'offerta è un servizio di coaching sanitario basato su intelligenza artificiale, disponibile tramite abbonamento mensile da 10 dollari. Questa strategia evidenzia il passaggio da hardware a servizi AI.

May 07 2026
Market

Startup Battlefield 200: un trampolino per l'innovazione AI e le soluzioni on-premise

La scadenza per le candidature a Startup Battlefield 200 si avvicina, offrendo a fondatori pre-Series A l'accesso a capitali, visibilità globale e un premio di 100.000 dollari. Per le startup che operano nel settore dell'intelligenza artificiale, in particolare quelle focalizzate su soluzioni on-premise, questa rappresenta un'opportunità cruciale per accelerare lo sviluppo e il deployment di stack locali, hardware per inference e training, e architetture che privilegiano la sovranità dei dati e il controllo infrastrutturale.

May 07 2026
Market

Crollo delle vendite di schede madri: il mercato AI devia la produzione di chip

Il mercato delle schede madri per PC enthusiast sta subendo un calo significativo, con vendite previste in diminuzione di oltre il 25%. La causa principale è la decisione dei produttori di chip di dirottare risorse e capacità produttiva verso i semiconduttori per l'intelligenza artificiale. Aziende come Asus, Gigabyte, MSI e ASRock si aspettano una riduzione delle consegne, con Asus che prevede 5 milioni di schede in meno nel 2025. Questo scenario evidenzia le priorità attuali dell'industria del silicio.

May 07 2026
Altro

Incendio ad Almere: il data center offline e le lezioni per l'on-premise

Un incendio in un data center ad Almere ha causato interruzioni significative, mettendo offline un'università e disabilitando il sistema di comunicazione di emergenza per il trasporto pubblico in un'intera provincia. L'evento ha richiesto l'intervento di mezzi speciali e ha evidenziato la vulnerabilità delle infrastrutture fisiche, sollevando interrogativi cruciali sulla resilienza e il controllo nei deployment tecnicici.

May 07 2026
Altro

La specifica FIT 1.0 finalizzata: un nuovo standard per i sistemi embedded Linux

La specifica Flattened Image Tree (FIT) 1.0 è stata ufficialmente finalizzata, introducendo un formato container standardizzato per i sistemi embedded Linux. Utilizzata da U-Boot, FIT consolida componenti essenziali come le immagini del kernel Linux e i Device Tree Blob (DTB) in un singolo file, semplificando il processo di boot e migliorando l'integrità e la sicurezza dei deployment su dispositivi edge.

May 07 2026
Hardware

AMD presenta l'acceleratore Instinct MI350P: CDNA 4 arriva sulle schede PCIe

AMD ha annunciato il nuovo acceleratore Instinct MI350P, basato sull'architettura CDNA 4 e disponibile in formato PCIe. Questa introduzione è significativa per le aziende che considerano il deployment di Large Language Models (LLM) on-premise, offrendo nuove opzioni hardware per l'inference e il training. Sebbene i dettagli su prezzi e disponibilità non siano ancora stati rivelati, l'arrivo di nuove soluzioni PCIe rafforza il panorama delle infrastrutture locali, cruciale per la sovranità dei dati e il controllo sui carichi di lavoro AI.

May 07 2026
Hardware

Google presenta Fitbit Air: il wearable senza schermo che punta sui dati e l'AI

Google ha svelato Fitbit Air, un nuovo wearable privo di schermo che si integra con l'app Google Health. Il dispositivo, un piccolo "puck" di plastica, si concentra sulla raccolta continua di dati biometrici, offrendo un'autonomia di circa una settimana e la capacità di memorizzare informazioni offline. L'app complementare introduce anche un coach per la salute basato su AI, segnando un ritorno alla filosofia dei tracker essenziali.

May 07 2026
Altro

Violazione dati record nell'istruzione: il bersaglio era un fornitore, non una scuola

Una vulnerabilità nei sistemi di Instructure, fornitore del sistema di gestione dell'apprendimento Canvas, ha portato alla più grande violazione di dati nel settore dell'istruzione. L'attacco, avvenuto il 30 aprile, ha colpito un'azienda che serve il 41% delle istituzioni di istruzione superiore in Nord America, evidenziando i rischi legati alla dipendenza da terze parti per servizi critici e sollevando questioni sulla sovranità dei dati.

May 07 2026
LLM

Spotify punta sull'audio personalizzato generato da AI

Spotify intende posizionarsi come piattaforma centrale per l'audio personalizzato generato tramite intelligenza artificiale. Gli utenti potranno creare podcast utilizzando modelli AI come Codex o Claude Code e importarli direttamente nel servizio, aprendo nuove frontiere per la creazione di contenuti audio su larga scala e su misura.

May 07 2026
Market

Moonshot AI: 2 miliardi di dollari di finanziamento e 20 miliardi di valutazione, spinta dall'AI Open Source

Moonshot AI, azienda cinese, ha ottenuto un finanziamento significativo, raggiungendo una valutazione di 20 miliardi di dollari. Questo traguardo è alimentato dalla crescente domanda di soluzioni AI Open Source e da un'impressionante crescita dei ricavi annualizzati, che hanno superato i 200 milioni di dollari ad aprile, grazie all'espansione delle sottoscrizioni a pagamento e all'utilizzo delle API. Il contesto evidenzia l'attrattiva degli LLM Open Source per le aziende che cercano controllo e flessibilità.

← Precedente Page 66 / 160 Successiva →