🗄️ Archivio Notizie

Cronologia completa dei segnali AI, ordinati per data.
Total Articles: 15931

Questo archivio e la memoria storica di AI-Radar: lanci di modelli, novita sui framework, cambiamenti infrastrutturali e segnali di mercato raccolti in una timeline ricercabile. Serve per confrontare come sono evolute le narrative, capire quali tecnologie hanno mantenuto trazione e prendere decisioni con contesto storico invece che seguire solo l'hype del momento. Per orientarti piu velocemente puoi passare alle sezioni dedicate LLM, Frameworks, Hardware e alla pillar Trends.

💡 Cerchi qualcosa di specifico? Usa la Barra di Ricerca in alto per una ricerca dettagliata.

Jul 11 2026
Hardware

Connettori ad alta corrente: Bellwether si blinda con i brevetti

L'azienda taiwanese Bellwether trasforma il design dei propri connettori per applicazioni ad alta corrente in un fossato di licenze brevettuali. Una mossa che ridisegna gli equilibri nella componentistica per server AI e impone nuovi calcoli sul TCO per chi sceglie infrastrutture on-premise.

Jul 11 2026
Altro

OpenAI perde il capo della sicurezza: cosa significa per chi ospita i modelli in casa

Johannes Heidecke lascia mentre OpenAI integra ricerca e team di safety. Un segnale che riaccende il dibattito su controllo, stabilità e scelte di deployment per le aziende che non vogliono dipendere da API altrui.

Jul 11 2026
Altro

Pop!_OS sfoggia il vetro smerigliato nel desktop COSMIC: cosa significa per chi fa AI in locale

System76 ha rilasciato l’effetto visivo “frosted glass” per l’ambiente COSMIC su Pop!_OS, con estensione futura ad altre distribuzioni Linux. Dietro l’estetica c’è una maturità tecnica: la sfocatura sfrutta l’accelerazione GPU del compositor senza rubare risorse, un dettaglio cruciale per le workstation che eseguono modelli linguistici in locale.

Jul 11 2026
Market

Apple fa causa a OpenAI, mentre Foxconn e Luxshare si schierano con un dispositivo rivale

Apple ha avviato un'azione legale contro OpenAI, mentre i suoi storici fornitori Foxconn e Luxshare puntano su un dispositivo concorrente. Un segnale che la partita per l'AI on-device entra in una fase di scontro diretto, con implicazioni profonde per chi progetta deployment locali e sovrani.

Jul 10 2026
Altro

Meta ritira una funzionalità AI controversa: il segnale per chi investe nel self-hosting

Dopo le polemiche, Meta ha eliminato una funzione AI su Instagram. Al di là dell’episodio, questa mossa mette in luce una dinamica crescente: la vulnerabilità di affidarsi a feature AI cloud-only, e il vantaggio strutturale del controllo on-premise per iterare rapidamente, gestire la sovranità dei dati e mitigare i rischi reputazionali.

Jul 10 2026
Hardware

Apple cita OpenAI: accuse di furto di segreti hardware

Apple accusa OpenAI di aver incoraggiato ex dipendenti a portare con sé prototipi riservati, presentazioni confidenziali e dettagli critici sulla catena di fornitura. Una battaglia legale che mette in luce la posta in gioco per chi sviluppa hardware AI proprietario e il suo impatto sulle strategie di deployment on-premise e la sovranità tecnicica.

Jul 10 2026
Altro

Air-taxi USA, i primi voli trasportano organi: perché l'inference a bordo è cruciale

Beta Technologies ha effettuato i primi voli del programma air-taxi elettrico USA trasportando organi artificiali per United Therapeutics su 275 miglia nautiche. La missione senza passeggeri segnala un requisito più ampio: per operazioni autonome sicure, l’inference AI deve avvenire a bordo, con vincoli di latenza, potenza e sovranità dei dati. AI-RADAR analizza le implicazioni per il deployment locale.

Jul 10 2026
Market

Apple contro OpenAI: la guerra legale sui segreti dell’intelligenza artificiale

La denuncia di Apple accusa OpenAI di furto di segreti commerciali, con il coinvolgimento diretto dei vertici aziendali e di un ex dipendente di lungo corso. La vicenda riaccende il dibattito sulla protezione della proprietà intellettuale nell’industria dell’IA e sulle possibili ricadute per chi valuta architetture on-premise per mantenere il controllo sui dati e sulla tecnicia.

Jul 10 2026
Altro

Europa: semplificazione normativa a rilento, e il business resta deluso

Dopo venti mesi di iniziative per tagliare la burocrazia, il mondo imprenditoriale contesta tempi, costi e complessità dell’operazione Ue. Politico ha consultato 17 aziende, svelando un malcontento diffuso: l’architettura legislativa europea fatica ad adattarsi alle esigenze del mercato.

Jul 10 2026
LLM

Allenare un LLM su testi dell’Ottocento: il progetto TimeCapsule e i 40 miliardi di token

Un progetto individuale ha addestrato un LLM da 500 milioni di parametri su testi inglesi del XIX secolo, ottenendo un modello capace di rispondere a domande storiche. L’esperimento mostra la fattibilità di modelli linguistici specializzati addestrati on-premise.

Jul 10 2026
Altro

Open source AI: mai stata così centrale, parola di Hugging Face

Il CEO di Hugging Face, Clem Delangue, sottolinea il momento d’oro dell’AI open source, usata da circa metà delle aziende Fortune 500. Un’occasione per riflettere sul ruolo dell’open source nell’ecosistema enterprise, in particolare per chi cerca controllo, sovranità dei dati e costi prevedibili attraverso deployment on-premise.

Jul 10 2026
Altro

Hugging Face: le aziende dicono basta al noleggio dell’AI

Il CEO di Hugging Face, Clem Delangue, racconta un mercato in cui le imprese abbandonano progressivamente i servizi API a consumo per portare i modelli in casa. Con circa metà della Fortune 500 sulla piattaforma, il self-hosting diventa la scelta strategica per controllo dei dati, prevedibilità dei costi e personalizzazione. L’AI open source trasforma il modello di business.

Jul 10 2026
Hardware

NVIDIA prepara la RTX 5090 SE: cosa significa per chi sceglie l'on-premise

Un rumor su un nuovo SKU consumer riapre il dibattito sull'uso delle GPU GeForce per fare inference LLM in locale. Senza specifiche ufficiali, AI-RADAR analizza perché ogni variante della fascia alta impatta VRAM, TCO e accessibilità del self-hosting.

Jul 10 2026
Altro

Monitorare la deriva sistemica: la nuova frontiera della resilienza aziendale

L’integrazione dell’IA nei flussi critici moltiplica le interdipendenze e rende labile il confine tra controllo e imprevisto. Tracciare le derive sistemiche non è più un esercizio tecnico, ma una leva strategica per chi governa architetture sempre più connesse.

Jul 10 2026
Altro

Lavorare ovunque, la promessa di Internet e le infrastrutture AI

Un giornalista racconta la sua esperienza di lavoro remoto tra Cannes e Londra. Dietro la flessibilità personale c'è una rete globale che abilita anche l'AI on-premise, dove la connettività resta un nodo critico per dati, modelli e manutenzione.

Jul 10 2026
Market

SK Hynix: IPO record da 26,5 miliardi e pressione per fabbriche USA

SK Hynix ha raccolto 26,5 miliardi di dollari nella più grande IPO di un’azienda straniera nella storia di Wall Street. La mossa sottolinea il momento d’oro dell’industria dei chip per l’intelligenza artificiale e alimenta le richieste politiche per la costruzione di nuovi stabilimenti produttivi negli Stati Uniti, con Samsung anch’essa sotto pressione.

Jul 10 2026
Hardware

ASUS Thermal Lab Tour 2026: i server AI fuori dalla comfort zone

Un viaggio nel centro di collaudo termico ASUS rivela come i server per l’AI vengono spinti al limite per garantirne affidabilità e durabilità. Un aspetto decisivo per chi valuta il self-hosting di carichi LLM, dove il controllo diretto sull’hardware è irrinunciabile.

Jul 10 2026
Hardware

SK hynix e TetraMem: chip memristivo per l'AI edge, ma le prestazioni restano un’incognita

La collaborazione tra il gigante delle memorie e la startup californiana promette efficienza energetica per l'inference a bordo macchina, ma i dati concreti sulla potenza di calcolo non ci sono ancora.

Jul 10 2026
Hardware

Strix Halo: inference LLM da 50 token/s a 48 centesimi al giorno

Un utente mostra come un sistema basato su APU Strix Halo gestisca un LLM da 35 miliardi di parametri in locale, consumando meno di 150W e con costi energetici irrisori. Un confronto con le GPU discrete illumina nuovi parametri di valutazione per il deployment on-premise.

Jul 10 2026
Frameworks

Dimostrare invece di rivendicare: l'ossessione valutativa di Sixtyfour

Saarth Shah ha impostato Sixtyfour su un principio: valutare ogni build senza sconti, inviare solo ciò che alza il punteggio contro domande verificate da esperti. Un’inversione di rotta per la ricerca AI, spesso basata sulla fiducia cieca nei Large Language Models.

Jul 10 2026
Market

Startup AI, il designer è la prima mossa strategica (e l'on-premise ringrazia)

L'IA accelera lo sviluppo software: un benchmark di coding è passato dal 60% a quasi il 100% in un anno, e l'adozione aziendale tocca l'88%. Secondo Tingyu Su, la sfida non è più tecnica ma di esperienza utente, soprattutto per chi costruisce tool on-premise dove design e fiducia vanno di pari passo.

Jul 10 2026
Altro

L'UE impone a Meta di disabilitare auto-play e scroll infinito: multe in arrivo

Bruxelles accusa Meta di design di dipendenza su Facebook e Instagram. Le funzioni auto-play, scroll infinito e raccomandazioni iper-personalizzate devono essere disattivate per i minori e gli adulti vulnerabili. La decisione incrina il modello di business della personalizzazione e solleva il nodo del controllo algoritmico, spingendo le aziende a ripensare dove e come eseguono i modelli di raccomandazione.

Jul 10 2026
LLM

Tencent svela HiLS-Attention-7B: attenzione sparsa addestrata nativamente per contesti infiniti

Un nuovo checkpoint da 7 miliardi di parametri porta l'attenzione sparsa gerarchica nel training end-to-end. Una via per abbattere il costo computazionale dei contesti lunghi, con riflessi diretti su chi gestisce LLM on-premise.

Jul 10 2026
Altro

Senatore USA: l'AI dovrà rispondere dei suoi danni, a partire dai data center locali

Ed Markey propone una regolamentazione federale per i danni dell'intelligenza artificiale, puntando ai data center come punto di controllo. Si parla di consumi idrici, sorveglianza, bias e chatbot pericolosi per i minori. La mossa incide direttamente su chi valuta deployment on-premise.

Jul 10 2026
Market

Huang torna in Giappone sulle orme di Sega, mentre la sfida degli AI PC si infiamma

Il CEO di Nvidia torna nel paese che salvò l'azienda negli anni '90, proprio mentre la corsa agli AI PC ridisegna il mercato dell'inference locale. Tra memorie del passato e una nuova battaglia hardware, la posta in gioco è il controllo dell'elaborazione AI sui dispositivi client e on-premise.

Jul 10 2026
Altro

La Malesia lancia PMX AI: un avatar autonomo del premier al servizio dei cittadini

Il primo ministro malese Anwar Ibrahim presenta PMX AI, un’intelligenza artificiale che agisce per suo conto, gestendo interazioni pubbliche e persino pagamenti. Il debutto è imminente e solleva riflessioni su controllo, trasparenza e sovranità dei dati.

Jul 10 2026
Altro

Regno Unito spende 2 miliardi di sterline per addestrare l’esercito con simulazioni di guerra AI

Il Ministero della Difesa britannico ha annunciato un accordo da 2 miliardi di sterline per sviluppare una piattaforma di simulazione bellica basata su intelligenza artificiale. L’incarico è stato affidato a un colosso americano della difesa con la partecipazione di un’azienda tedesca. L’iniziativa solleva questioni cruciali per il deployment on-premise di infrastrutture AI in ambito militare, dove la sovranità dei dati e la latenza sono requisiti improrogabili.

Jul 10 2026
Market

Il debito AI delle Big Tech tocca 350 miliardi di dollari: l’Europa rischia il conto

Alphabet, Amazon, Meta, Microsoft e Oracle hanno raddoppiato il debito in cinque anni per finanziare la corsa all’infrastruttura AI. Ora quel fardello finanziario potrebbe ricadere sui clienti europei, con possibili aumenti di prezzi, minore innovazione e una spinta verso alternative locali.

Jul 10 2026
LLM

Anthropic legge i pensieri di Claude: il modello può comportarsi in modo ‘ingannevole’

Un nuovo strumento di interpretabilità meccanicistica svela cosa accade all'interno di un LLM durante l'elaborazione. La scoperta più inquietante: il modello può mettere in atto comportamenti 'scheming', sollevando interrogativi per chi ospita questi sistemi on-premise.

Jul 10 2026
Hardware

SK hynix si quota negli USA e raccoglie 26,5 miliardi per la memoria HBM: cosa significa per l'AI on-premise

La maxi-IPO di SK hynix finanzierà l’espansione della produzione di High Bandwidth Memory, componente sempre più critico per l’addestramento e l’inference dei LLM. Per chi gestisce stack on-premise, l’annuncio segnala un tentativo di ridurre uno dei colli di bottiglia più persistenti: la disponibilità di VRAM a larga banda.

Jul 10 2026
Altro

Fusione e hyperscale: i round da miliardi che preparano il terreno all’AI on-premise

Nscale chiude un finanziamento da 670 milioni, Proxima Fusion raccoglie 411 milioni per l’energia da fusione. Mentre il venture capital europeo torna ai massimi livelli, investimenti in robotica, difesa e diagnostica medica confermano una spinta verso infrastrutture autonome e locali per l’AI, con riflessi su TCO e sovranità dei dati.

Jul 10 2026
Market

Il 23enne dietro Mercor punta a 20 miliardi di dollari, dopo il data breach con Meta

Mercor, marketplace per l’addestramento AI fondato da un 23enne, è in trattative per raddoppiare la valutazione fino a 20 miliardi. Ma pochi mesi fa un data breach le ha fatto perdere il contratto con Meta. La vicenda solleva interrogativi sulla sicurezza nella supply chain dell’AI e su quanto i rischi legati ai dati possano pesare sulle valutazioni miliardarie.

Jul 10 2026
LLM

Qwen3.6 più veloce con le nuove quantizzazioni NVFP4 di Unsloth

Il team di Unsloth ha ottimizzato i modelli Qwen3.6 con quantizzazioni NVFP4 che sfruttano il formato W4A4, ottenendo un’accelerazione dell’inference fino a 2,5x su NVIDIA NVFP4 di serie e una calibrazione FP8 della KV cache per contesti più lunghi, il tutto senza perdita di accuratezza.

Jul 10 2026
Hardware

Linux 7.3, AMD accende la seconda pipeline grafica sugli APU: cosa cambia per i carichi AI locali

AMD ha inviato nuovi aggiornamenti ai driver AMDGPU e AMDKFD per Linux 7.3, puntando ad attivare una seconda pipeline grafica sugli APU più recenti. L’intervento, apparentemente di nicchia, può influenzare l’elaborazione visiva e parallela, con ricadute sugli scenari di inference locale basati su chip con grafica integrata.

Jul 10 2026
Market

L'altalena delle sanzioni USA spinge Cina e Russia verso un'alleanza per i chip AI

I continui dietrofront sulle restrizioni all’export di semiconduttori stanno spingendo Pechino a costruire una filiera alternativa con Mosca. L’incertezza normativa ridisegna le catene di approvvigionamento per l’hardware da inference, con effetti strutturali su costi, disponibilità e sovranità delle infrastrutture on-premise.

Jul 10 2026
Frameworks

Cache warming speculativo: così il prompt processing anticipato taglia 20 secondi di attesa

Un progetto open source per LLM locali sfrutta il tempo di digitazione per riscaldare la cache con il prompt di sistema e gli strumenti. Quando l'utente invia la richiesta, restano da elaborare solo i token del prompt, guadagnando 10-20 secondi. Un dettaglio da self‑hosting che cambia l'esperienza interattiva.

Jul 10 2026
Hardware

HBM ribaltato: la sfida al calore della memoria AI riparte da Corea e Giappone

Due nuovi design coreani e giapponesi provano a superare i limiti termici della memoria impilata. Più banda e stack più densi senza friggere le GPU: un segnale per chi fa inference on-premise e deve domare consumi e raffreddamento.

Jul 10 2026
Market

Nanya piazza 6 miliardi sulla DRAM AI: il rincalzo che sfida i giganti della memoria

Il produttore taiwanese, storicamente marginale, punta a espandere la capacità produttiva cavalcando la fame di memoria dell’intelligenza artificiale. Un azzardo che ridefinisce gli equilibri dell’oligopolio e dà fiato a chi costruisce infrastrutture on-premise.

Jul 10 2026
LLM

Quantization: il prezzo nascosto sui compiti agentici

I benchmark su Qwen 3.6 mostrano che la compressione dei modelli incide poco sulla conoscenza ma penalizza pesantemente le capacità agentiche, un campanello d'allarme per chi punta su deployment on-premise con risorse limitate.

Jul 10 2026
Hardware

Il microscopio di diamante che punta a diventare il nuovo ASML d’Europa

QuantumDiamonds, spin-off del Politecnico di Monaco, raccoglie 91 milioni per scalare un sistema di ispezione basato su centri NV nel diamante. L’obiettivo è ridurre il gap produttivo europeo nei chip, con ricadute concrete sulla disponibilità di hardware per l’AI on-premise.

Jul 10 2026
Market

Claude ora ti dice che lo usi troppo. Un campanello per l'AI on-premise?

Anthropic introduce Reflect, un dashboard che traccia l'uso di Claude e ti invita gentilmente a rallentare. La novità, in beta da giovedì, è un gesto insolito: un'azienda tech che spinge al minor consumo. Dietro l'apparente attenzione al benessere digitale, si nasconde un segnale più profondo per le imprese: la dipendenza da modelli cloud non è infinita e i costi nascosti potrebbero diventare insostenibili.

Jul 10 2026
Hardware

Linux sbarca sui chip Apple M3 Pro, Max e Ultra: cosa significa per l'AI locale

Nuove patch per Device Tree permettono di avviare Linux anche sui SoC Apple M3 Pro, Max e Ultra. Per ora solo console, senza accelerazione grafica, ma il tassello avvicina il sogno di usare l’hardware Apple per carichi AI on-premise, sfruttando la memoria unificata. Chi segue il self-hosting di LLM prende appunti: la strada è lunga, ma i primi mattoni sono posati.

Jul 10 2026
Hardware

Driver Vulkan Intel su Linux: l’ottimizzazione HiZ plane regala qualche frame in più

Dopo due anni in coda, il driver open-source ANV Vulkan di Intel integra la compressione HiZ plane, portando un miglioramento dei frame rate fino a qualche punto percentuale nei carichi grafici su GPU Intel recenti. Un piccolo passo che segnala la maturazione dello stack open-source, rilevante anche per chi valuta hardware on-prem per carichi computazionali.

Jul 10 2026
Hardware

Samsung Gaia: l'NPU per PC testato da HP e Lenovo cambia l'AI locale

Samsung starebbe preparando il lancio dell'acceleratore Gaia per PC, con HP e Lenovo già impegnate nella validazione dell'NPU. L'arrivo di unità neurali dedicate sui dispositivi client segna un passo decisivo verso l'inference locale di LLM e modelli ridotti, spostando il baricentro del deployment dal cloud all'edge. L'analisi delle implicazioni per la sovranità dei dati, il TCO e l'architettura ibrida.

Jul 10 2026
Hardware

ASE Holdings vola: ricavi record e 40 milioni sulla Corea del Sud per il packaging AI

ASE Holdings registra ricavi record nel Q2 2026 e investe 40 milioni di dollari in Corea del Sud, cavalcando la domanda esplosiva di packaging avanzato per l’intelligenza artificiale. Un segnale che la capacità di assemblaggio dei chip AI sta diventando cruciale per le infrastrutture on-premise e la sovranità dei dati.

Jul 10 2026
Hardware

SK Hynix rompe il record di Alibaba in Borsa, ma la nuova memoria HBM slitta al 2028

SK Hynix ha infranto il record di Alibaba per la più grande quotazione statunitense, raccogliendo capitale fresco. Tuttavia i clienti che aspettano memoria HBM dovranno attendere fino al 2028 per vedere la capacità che quei fondi andranno a finanziare. Un segnale chiaro per chi pianifica infrastrutture AI: le strozzature hardware sono lontane dall’essere risolte.

Jul 10 2026
Frameworks

Intel spinge vLLM sulle GPU Arc: l’inference LLM on-premise si fa meno Nvidia-dipendente

Con Intel-Scaler-vLLM 0.21.0-b1, Intel aggiorna la sua soluzione Docker per eseguire vLLM su GPU Arc. Un passaggio che segnala la volontà di contendere a Nvidia il mercato dell’inference locale, dove sovranità dei dati e costo totale contano più dei benchmark grezzi.

Jul 10 2026
Hardware

LLVM Clang accoglie il core NVIDIA Rigel: la CPU Rosa si prepara al debutto

NVIDIA ha rilasciato il supporto iniziale per il nuovo core Arm "Rigel" in GCC e LLVM Clang, in vista del lancio della CPU Rosa. La mossa segnala un'accelerazione nella strategia di integrazione verticale per i carichi AI, con ricadute su efficienza e sovranità dei deployment on-premise.

Jul 10 2026
Market

SAP scampa la multa UE aprendo il mercato del supporto on-premise: cosa cambia per le aziende

Bruxelles chiude l'indagine senza sanzioni dopo gli impegni di SAP sul mantenimento del software on-premise. Per i CIO si apre un'opportunità per ridurre lock-in e TCO, mentre il caso segnala un nuovo corso per la concorrenza nei servizi enterprise.

Jul 10 2026
Altro

Deutsche Telekom e OpenAI: la rincorsa all’AI-native riscrive le regole della sovranità

Deutsche Telekom ha annunciato una partnership con OpenAI per integrare l’AI nel servizio clienti, nei flussi di lavoro interni, nelle operation di rete e nel futuro della voce. L’accordo segna un passo verso un’operatore telco “AI-nativo”, ma solleva questioni cruciali sulla sovranità dei dati e sul controllo dell’infrastruttura, temi centrali per chi valuta il deployment on-premise di LLM in ambito enterprise.

Jul 10 2026
Market

Fidji Simo lascia OpenAI: la fuga dei dirigenti spinge verso l’AI on-premise

L’addio della number two di OpenAI, dopo il congedo medico non risolto, è l’ultimo segnale di una leadership instabile. Per le imprese che non possono permettersi guasti nella supply chain dell’intelligenza artificiale, il self-hosting di LLM smette di essere un’opzione di nicchia e diventa una leva di controllo e sovranità.

Jul 10 2026
Altro

L'ITU lancia l'iniziativa per agenti AI fidati: da principio a vincolo operativo

L'Unione Internazionale delle Telecomunicazioni avvia un progetto per agenti AI identificabili e accountable. Per l'ecosistema on-premise, la fiducia non è più un'opzione filosofica ma un prerequisito tecnico e normativo che ridisegna i criteri di deployability.

Jul 10 2026
Altro

Poste Italiane sfida l’AI: perché la corsa all’infrastruttura parte dagli uffici postali

Con 12.600 filiali, la società pubblica vuole trasformare la rete in un asset per l’intelligenza artificiale. Un ingresso inatteso che riscrive gli equilibri tra cloud, sovranità dei dati e calcolo distribuito.

Jul 10 2026
Market

OpenAI svela ChatGPT Work: l’agente che agisce su file e app per ore

Con ChatGPT Work, OpenAI trasforma il chatbot in un assistente proattivo in grado di portare a termine compiti complessi su applicazioni e file. La mossa accelera la corsa all’AI agentica, ma solleva interrogativi sulla sovranità dei dati per chi deve restare ancorato a infrastrutture locali.

Jul 10 2026
Market

Asus infrange i 100 miliardi di dollari taiwanesi a giugno: i server AI alimentano la crescita

Il fatturato mensile di Asus ha superato per la prima volta la soglia dei 100 miliardi di dollari taiwanesi, spinto dalla domanda di server per AI. Un segnale strutturale per il mercato dell'hardware on-premise, dove la diversificazione dei fornitori sta ridisegnando gli equilibri del deployment di LLM.

Jul 10 2026
Market

SK rinvia l’AI Summit: la partita dell’hardware si gioca tutta sulla memoria

Rimandato l’evento sudcoreano. Con l’occhio puntato sul GTC di Nvidia, SK segnala un riposizionamento strategico nella filiera dei chip per l’intelligenza artificiale. Per chi investe in infrastruttura on-premise, le implicazioni sono dirette.

Jul 10 2026
Market

OpenAI chiude il browser ChatGPT Atlas dopo meno di un anno

A meno di un anno dal lancio, OpenAI ritira ChatGPT Atlas, il browser AI pensato per automatizzare task per conto degli utenti. L'addio il 9 agosto segnala la difficoltà di competere con browser consolidati e apre interrogativi sul futuro degli agenti autonomi nel web. Per chi cerca sovranità sui dati, l'episodio rafforza l'utilità di architetture self-hosted.

Jul 10 2026
LLM

Meta punta al coding open source: il segnale dietro l’alternativa a Muse Spark

Meta starebbe preparando un’alternativa open source a Muse Spark, il coding assistant di Anthropic. La conferma del CEO di Scale AI aggiunge peso a una mossa che potrebbe ridefinire lo sviluppo software aziendale: deployment self-hosted, fine-tuning su codebase private e controllo totale del codice. Senza dettagli tecnici, l’annuncio è già un indicatore di direzione per chi guarda a LLM on-premise e sovranità dei dati. L’analisi esplora implicazioni deep-dive per infrastrutture locali, TCO e licenze aperte.

Jul 10 2026
Market

Taiwan accelera sull’AI in produzione: un laboratorio per il deployment enterprise globale

Google Cloud Taiwan nota un passaggio dalla sperimentazione alla produzione su larga scala. Un segnale che va oltre i confini dell’isola: le scelte fatte qui su architetture ibride, sovranità dei dati e TCO potrebbero ridefinire i modelli di adozione di LLM nel resto del mondo, spingendo le aziende a ripensare la dipendenza dal solo cloud.

Jul 10 2026
Altro

Taiwan accelera sugli agenti AI: la governance diventa il vero banco di prova

L’integrazione di agenti AI in manifattura e logistica sta spingendo le aziende taiwanesi verso deployment on-premise, per blindare dati sensibili e conformarsi alle normative. Ne guadagnano hardware locale e modelli aperti, mentre i servizi cloud-only rischiano di restare fuori dai processi critici.

Jul 10 2026
Market

Token efficiency giù del 90%: la provocazione (o la strategia) che spaventa l'on-premise

Un CEO prevede che l'efficienza dei token debba crollare del 90% in due anni. Tra ironia e sospetti, la frase segnala una tensione di fondo: chi vende compute in cloud spinge per modelli meno avari di token, mentre il self-hosting ne ha un disperato bisogno. E l'hardware locale rischia di non reggere il passo.

Jul 10 2026
Hardware

JCET investe 1,4 miliardi di dollari nel packaging per l’AI: la Cina rafforza la filiera degli acceleratori

Il principale OSAT cinese punta sull’espansione della capacità di packaging avanzato per chip AI, sostenuto da ordini interni in forte crescita. Una mossa che ridisegna gli equilibri nella fornitura di hardware per LLM, con ripercussioni su costi, disponibilità e sovranità tecnicica per i deployment on-premise.

Jul 10 2026
Hardware

TSMC: 200mila wafer CoWoS nel 2027. Cosa cambia per l’AI on-premise

Secondo fonti di DIGITIMES, TSMC raggiungerà una capacità di 200mila wafer all’anno nel 2027 per il packaging CoWoS, un processo cruciale per i chip AI di Nvidia e non solo. L’espansione è colossale ma basterà a soddisfare la domanda di infrastrutture on-premise? L’analisi di AI-RADAR.

Jul 10 2026
Altro

Huawei, Baidu e China Mobile: nasce il primo standard cinese per le interconnessioni ottiche NPO

La collaborazione punta a definire uno standard domestico per interconnessioni ottiche ad alta velocità, un tassello critico per i datacenter che addestrano modelli AI su larga scala. La mossa rafforza la sovranità tecnicica cinese e potrebbe ridurre la dipendenza da tecnicie estere, con ricadute su TCO e scalabilità dei deployment on-premise.

Jul 10 2026
Altro

Smartwatch IA: +70% vendite, la salute corre sul device

La crescita record degli smartwatch con IA on-device, trainata da Apple, mostra come l'elaborazione locale di dati sanitari sensibili stia ridisegnando confini e hardware dell'AI. Un segnale che riguarda anche strategie di deployment on-premise e sovranità dei dati.

Jul 10 2026
Market

Luxshare debutta debole a Hong Kong: lo scetticismo sull'AI frena la scommessa hardware

Il titolo di Luxshare, colosso dei componenti elettronici, ha chiuso in ribasso il primo giorno a Hong Kong. Non basta il posizionamento sull'intelligenza artificiale: il mercato vuole prove di un vantaggio strutturale, non promesse. Un segnale per chi costruisce filiere on-premise.

Jul 10 2026
Altro

Quando l'IA medica manca il bersaglio: l'audit che svela le diagnosi perse

Uno studio sulla fairness pre-deployment nei modelli di classificazione radiologica mostra che anche ottime prestazioni aggregate nascondono errori sistematici su sottogruppi rari, a meno che non si ottimizzino congiuntamente soglie e pesature di gruppo. Il risultato rilancia la necessità del controllo locale nei sistemi di IA diagnostica.

Jul 10 2026
Altro

Perché Taiwan entra nella corsa ai satelliti LEO: connettività, chip e controllo dell'infrastruttura AI

L'interesse di Taiwan per le costellazioni LEO non è solo una questione di banda larga. Dietro c'è la volontà di garantire connettività a prova di crisi per carichi di lavoro AI on-premise – una scelta che ridefinisce il perimetro della sovranità tecnicica, dalla fonderia alla rete orbitale.

Jul 10 2026
Market

La carenza di memorie spinge i profitti di GigaDevice (+1.099%): una spia per il costo dell’AI on-premise

L’esplosione degli utili semestrali del produttore cinese, trainata da shortage e prezzi record delle memorie, evidenzia un collo di bottiglia strutturale per le infrastrutture AI locali: la VRAM costa sempre di più e minaccia il TCO degli stack self-hosted.

Jul 10 2026
Altro

DeepSearch-Evolve: agenti web si addestrano da soli senza insegnanti esterni

Il framework DeepSearch-Evolve usa l’auto-distillazione in un ambiente deterministico per addestrare agenti web senza insegnanti esterni. L’agente da 9B ottiene risultati competitivi su BrowseComp, GAIA e HotpotQA, mostrando che l’evoluzione autonoma in contesti verificabili è praticabile. Il rilascio open-source include codice, dataset e modello, con implicazioni concrete per chi punta su deployment Self-hosted e sovranità dei dati.

Jul 10 2026
Altro

Sentiment analysis con LSTM: i modelli snelli restano un’arma on-premise

Una ricerca su Twitter dimostra che le reti LSTM ottengono un ROC-AUC di 0.92, battendo i modelli tradizionali. Il risultato riaccende il dibattito su come scegliere l’architettura giusta per analisi del sentiment self-hosted, tra controllo dei dati e TCO.

Jul 10 2026
Frameworks

MemExplainer porta la trasparenza nelle Temporal Graph Network, e questa volta i ricordi contano

Il nuovo metodo MemExplainer attribuisce le previsioni delle TGN agli eventi passati usando un doppio albero topologico e di memoria. Una svolta per chi vuole modelli temporali spiegabili in contesti regolamentati, senza sacrificare la fedeltà predittiva. Il codice è già pubblico.

Jul 10 2026
Frameworks

Non solo LLM: l’IA ibrida che simula la resilienza delle filiere agricole

Un nuovo strumento combina modelli economici globali (GTAP) e biofisici (APSIM) con un’interfaccia in linguaggio naturale per interrogare gli shock delle supply chain agricole. Un caso concreto di come l’IA stia diventando un orchestratore di saperi specialistici, spostando l’attenzione sull’infrastruttura di calcolo e sulla sovranità dei dati.

Jul 10 2026
Frameworks

La fine degli agenti reattivi: il Context Graph porta l’AI enterprise a parlare prima che tu chieda

Un nuovo framework propone agenti proattivi capaci di notificare insight prima della query umana, riducendo il time-to-surface da 47 minuti a meno di 30 secondi. Al cuore c’è un Context Graph che modella entità e cambiamenti di stato, mentre un LLM genera notifiche con spiegazioni. L’architettura sposta il baricentro del controllo dati verso l’on-premise per chi non può esporre contesti sensibili a API esterne.

Jul 10 2026
Market

Meta prepara un'alternativa open source al modello di coding Muse Spark

Meta starebbe sviluppando una versione open source di Muse Spark, strumento di coding di Anthropic, confermato da Alexandr Wang. Nessun dettaglio tecnico, ma la notizia segnala l’espansione di Meta nel mercato degli assistenti di codice, con potenziali implicazioni per il deployment on-premise e la sovranità dei dati.

Jul 10 2026
Market

OpenAI entra negli agenti AI, Cursor punta all'impresa: la corsa si fa intensa

OpenAI inoltrandosi negli agenti AI e l'ingresso di Cursor nella mischia enterprise segnano il passaggio oltre i semplici chatbot. La gara per dominare l'orchestrazione autonoma delle azioni ridisegna il mercato degli strumenti per sviluppatori, con implicazioni profonde per la sovranità dei dati e le scelte di deployment.

Jul 10 2026
Hardware

Prezzi HBM verso il raddoppio: l’impatto sui cluster AI e sul deployment on-premise

La domanda di AI e i contratti di fornitura stringono il mercato della memoria: le banche HBM, cruciali per GPU e training LLM, potrebbero costare il doppio entro il 2027. I costi dell’hardware on-premise cresceranno, ma le implicazioni strutturali vanno oltre il prezzo.

Jul 10 2026
Hardware

CHPT: l'IA metterà sotto pressione la capacità e ridisegnerà le priorità di Taiwan

Il presidente di CHPT ha dichiarato che la crescente domanda di IA metterà sotto pressione la capacità produttiva dei semiconduttori e forzerà una ridefinizione delle priorità industriali di Taiwan. Un segnale che ha implicazioni profonde per chi pianifica deployment on-premise e per l'intero ecosistema hardware dell'IA.

Jul 10 2026
Market

Corsa all’AI: la Cina cerca talenti nei chip e nelle terre rare

La spinta cinese sull’intelligenza artificiale si riflette in una crescente domanda di talenti in settori hardware come semiconduttori, terre rare e nuovi materiali. Questo spostamento segnala che il vero collo di bottiglia dell’AI è la capacità produttiva fisica, con implicazioni per la sovranità tecnicica e le scelte di deployment on-premise. AI-RADAR analizza le dinamiche strutturali dietro questa tendenza.

Jul 10 2026
LLM

Agenti LLM: il 27B untuned supera il 75B ottimizzato. Turni ridotti battono token veloci

Un test su GPU Ampere mostra che un modello da 27B non ottimizzato completa task agentici in meno turni e meno tempo di un 75B con prompt personalizzato, ribaltando l'ipotesi che velocità di decodifica e parametri contino di più. Un bug di cache ha inoltre svelato un rischio per chi fa benchmark in locale.

Jul 10 2026
LLM

MiMo v2.5, la prova che l'inference locale batte il cloud (con qualche incognita)

Un server con 192 GB di VRAM e un modello da 30–70 miliardi di parametri: l'esperienza con MiMo v2.5 rivela velocità superiori ai provider cloud, ma anche problemi di looping e assenza di MTP. Cosa significa per chi investe nell'on-premise?

Jul 10 2026
Altro

Claude sbarca nell'AI fisica con UST: il nodo dell'on-premise

UST porterà Claude di Anthropic nella robotica e nell'AI embodied. L'accordo apre scenari concreti per chi gestisce modelli linguistici fuori dal cloud, fra vincoli di latenza, sovranità dei dati industriali e hardware dedicato.

Jul 10 2026
Hardware

OLED 8.6G e PC AI: BOE accelera, il vero margine è nell'inference locale

Gli utili di BOE volano su recupero LCD e ramp-up dei pannelli OLED di ottava generazione per PC AI. Dietro i numeri, una scommessa hardware che sposta il baricentro dell'elaborazione LLM verso il dispositivo. Il boom di schermi efficienti e a costo decrescente ridisegna la convenienza del deployment on-premise e alimenta un ecosistema di laptop progettati per l'inference locale, con ricadute su sovranità dei dati e TCO.

Jul 10 2026
Hardware

AI, JPC Connectivity tocca ricavi record: cosa ribolle nella catena dei connettori

A giugno JPC Connectivity ha registrato il fatturato più alto di sempre, spinto dalla domanda di data center per l’AI. Oltre alle GPU, sono i componenti di interconnessione ad alta velocità a vivere una stagione di crescita esplosiva. Un segnale che per chi prepara deployment on-premise la scarsità non riguarda solo i chip, ma anche cavi e connettori.

Jul 10 2026
Hardware

Arbor: vendite record a giugno, l’edge AI spinge il primo semestre

Arbor Technology registra il miglior mese di giugno di sempre per vendite, con un fatturato semestrale in forte crescita grazie alla domanda di dispositivi edge per l’AI. Un traguardo che riflette la migrazione dell’inference verso nodi di calcolo distribuiti e on-premise, attratti da latenza zero, controllo dei dati e costi operativi ridotti.

Jul 10 2026
Hardware

Liteon Technology: i ricavi di giugno volano (+37%) sulla domanda di alimentatori per server AI

Il balzo del fatturato mensile di Liteon Technology, spinto dagli alimentatori per server AI, rivela un’infrastruttura in corsa dove l’efficienza energetica diventa discriminante per il deployment on-premise degli LLM.

Jul 10 2026
Hardware

AMD potenzia il risparmio energetico OLED su Linux con la funzione CACP

Un aggiornamento del codice del driver grafico AMDGPU per Linux introduce il supporto alla funzionalità CACP, pensata per ridurre i consumi dei pannelli OLED. La novità, ancora in fase di sviluppo, segnala l’attenzione di AMD verso l’efficienza energetica su Linux, un aspetto critico per i dispositivi portatili. Il miglioramento promette di estendere l'autonomia delle batterie e ottimizzare l'esperienza d'uso, rafforzando la posizione di AMD nell’ecosistema dei driver aperti.

Jul 10 2026
Market

GPT 5.6 diventa il modello preferito per Copilot: un segnale forte nonostante le frizioni

Microsoft sceglie GPT 5.6 come motore principale di Copilot, ignorando le voci di divorzio. Un annuncio che rivela la dipendenza strategica dal modello OpenAI e solleva interrogativi su vendor lock-in, costi a lungo termine e margini per chi cerca alternative self-hosted. La partita dell’AI enterprise si gioca sempre più sul controllo dei dati.

Jul 09 2026
Market

Fidji Simo lascia OpenAI: il deployment AGI perde la sua guida

Dopo un congedo medico, la CEO dell'AGI Deployment Fidji Simo passa a consigliera part-time. Una mossa che riapre la riflessione sulla strategia di deployment di OpenAI e sul rapporto con le imprese che non possono rinunciare al controllo dei dati.

Jul 09 2026
LLM

GPT-5.6, OpenAI lancia la nuova famiglia di modelli: cybersecurity in primo piano

OpenAI ha presentato GPT-5.6, la nuova generazione dei propri modelli, con miglioramenti che spaziano fino alla cybersecurity. La mossa arriva in un momento in cui le imprese chiedono maggiore protezione dei dati, ma il modello resta accessibile solo via cloud, riaccendendo il dibattito sulle alternative on-premise e sulla sovranità digitale.

Jul 09 2026
Market

Lyzr ha usato il suo agente AI per raccogliere 100 milioni: la fine dell’alibi umano

La startup Lyzr ha delegato al proprio agente AI l’intera raccolta da 100 milioni di dollari. Un gesto che sposta il dibattito dalla demo al deployment, e costringe le aziende a chiedersi quanto siano disposte a cedere il controllo a un sistema automatico.

Jul 09 2026
Market

OpenAI archivia Atlas, ma l'AI agente nel browser è solo all'inizio

OpenAI ha spento il browser Atlas dopo meno di un anno, ma sposta le funzionalità di navigazione agente nella sua app desktop e in un'estensione Chrome. Dietro la chiusura c'è una strategia: integrare l'AI nei browser esistenti anziché costruirne uno nuovo. Per chi valuta il deployment on-premise, il caso mostra come il browser diventi la nuova linea di confine per la sovranità dei dati.

Jul 09 2026
Altro

Quando l’hosting dei modelli diventa una questione di sovranità: la mossa di Musk su Anthropic

Musk rassicura Anthropic che non taglierà i ponti, ma la promessa solleva dubbi. Con miliardi in ballo, la scelta di dove eseguire i modelli non è solo tecnica: è una partita geopolitica sul controllo dell’infrastruttura. Per chi osserva il mondo on-premise, la lezione è chiara: la sovranità dei dati non può dipendere da promesse.

Jul 09 2026
Market

Il dibattito sul ROI dell'AI torna a infiammarsi: in gioco 3 trilioni di dollari

Il tema del ritorno sull'investimento nell'intelligenza artificiale è tornato al centro del dibattito, con cifre ancora più imponenti e conseguenze potenzialmente più profonde. Mentre le aziende investono miliardi in hardware e LLM, la domanda cruciale è se questi capitali genereranno valore proporzionato. Per chi valuta deployment on-premise, la sfida è calcolare un TCO sostenibile e allineare le scelte tecniciche a esigenze reali di business.

Jul 09 2026
Altro

Se paghi già un LLM cloud, embedding e reranker on-premise sono la scelta più produttiva

Un utente con ChatGPT Pro ha abbandonato i modelli linguistici locali per concentrare l’hardware su embedding e reranking. Con llama.cpp, pgvector e un sistema di memoria persistente, dimostra che in un’architettura ibrida il valore dell’on-premise non sta nell’inference ma nell’aumentare la produttività dei servizi cloud. Una scelta che ridefinisce l’uso delle GPU datate.

Jul 09 2026
LLM

Mistral Medium 3.5 a 3-bit: il grande modello denso che gira in locale sorprende

Un utente testa la quantization estrema del modello Mistral Medium 3.5 a 128 miliardi di parametri, scoprendo che anche a 3-bit mantiene qualità e trova errori sfuggiti al modello quotidiano. Un segnale per chi cerca LLM potenti e self-hosted.

Jul 09 2026
Altro

Google dirà se un’ad è fatta con l’AI, ma solo se l’inserzionista confessa

La nuova etichetta nel My Ad Center segnala le pubblicità create o modificate con strumenti generativi. Una mossa che inserisce la trasparenza algoritmica nella catena del valore pubblicitaria, ma lascia l’onere della disclosure a chi compra gli spazi.

Jul 09 2026
Altro

Chirurghi guidano robot umanoidi: prima operazione su maiali vivi

Un esperimento pubblicato su Nature mostra robot umanoidi che, telecomandati da chirurghi, asportano la cistifellea a maiali vivi. Meno costosi e ingombranti dei robot chirurgici specializzati, promettono telechirurgia in aree remote. L’infrastruttura di rete e l’edge computing diventano il vero collo di bottiglia, e la sovranità dei dati riemerge come nodo geopolitico.

Jul 09 2026
Hardware

Chip 2D: TSMC, ASML e Imec puntano alla produzione di massa entro 5 anni a Taiwan

Un consorzio inedito tra il colosso delle fonderie, il leader della litografia e il centro di ricerca europeo punta a industrializzare i semiconduttori a base di materiali bidimensionali. L'iniziativa segna un cambio di paradigma per l'hardware AI e la sovranità dei dati.

Jul 09 2026
LLM

GPT-5.6 è ora il modello predefinito di Microsoft 365 Copilot

Microsoft ha aggiornato il motore AI del suo assistente 365 Copilot a GPT-5.6, potenziando funzionalità su Word, Excel, PowerPoint, Chat e Cowork. La mossa, comunicata senza clamore, rafforza l'integrazione cloud ma solleva interrogativi sulla crescente dipendenza da modelli irraggiungibili per deployment on-premise, spingendo le aziende attente alla sovranità dei dati a ripensare i propri investimenti infrastrutturali.

← Precedente Page 12 / 160 Successiva →