Risultati per: "RAG"

Trovati 100 articoli

✕ Reset
📁 LLM AI generated

RIMS: aggregazione morbida per piccoli LLM più precisi nel RAG rumoroso

Un nuovo framework chiamato RIMS migliora la robustezza dei piccoli LLM nel question answering con RAG. Invece di scartare le coppie di preferenze meno difficili, RIMS le aggrega con un operatore morbido, sfruttando tutti i segnali di addestramento. I dati sintetici vengono generati localmente senza modelli proprietari, e il metodo si applica a diversi algoritmi di allineamento. Su quattro benchmark multi-hop, RIMS supera le soluzioni esistenti con guadagni costanti in Exact Match e F1 in presenza di recupero rumoroso. Codice open source.

2026-07-21 Fonte
📁 Altro AI generated

Facebook e Instagram down: il crollo di Meta e la fragilità dell’AI on-premise

Domenica 19 luglio, un guasto ha bloccato l’accesso a Facebook e Instagram per molti utenti. L’incidente svela la complessità delle pipeline di inference che alimentano i social e diventa un caso di studio per chi valuta il deployment on-premise di Large Language Models: il controllo si paga con la responsabilità totale sulla resilienza.

2026-07-20 Fonte
📁 Market AI generated

ASML verso il trilione? La vera scommessa è la fragilità della filiera on-premise

La capitalizzazione record di ASML non è solo un traguardo finanziario: è il riflesso di un collo di bottiglia hardware che condiziona ogni strategia di deployment locale degli LLM. Mentre l’intelligenza artificiale spinge la domanda di chip all’estremo, la dipendenza da pochi macchinari litografici solleva interrogativi strutturali per chi punta sulla sovranità dei dati.

2026-07-20 Fonte
📁 Altro AI generated

Causal-Audit: quando il ragionamento dei LLM diventa verificabile (e perché l’on-premise ci guadagna)

Un nuovo framework rende esplicito e verificabile il ragionamento causale degli LLM, fornendo tracce di audit per settori regolamentati. L’approccio, che costruisce grafi causali vincolati alla variabile target e aggrega evidenze da cammini multipli, supera i metodi correnti in precisione e trasparenza, segnando un punto a favore del deployment on-premise dove sovranità e controllo sono irrinunciabili.

2026-07-20 Fonte
📁 Hardware AI generated

Il pragmatico playbook che ha fatto decollare Agility Robotics

La strategia di Agility Robotics punta tutto sul calcolo a bordo e su scelte hardware sobrie, ridefinendo le regole dell’edge AI industriale. Mentre la corsa ai modelli sempre più grandi riempie i data center, il caso Digit mostra perché il vero valore della robotica si gioca lontano dal cloud.

2026-07-19 Fonte
📁 Frameworks AI generated

HG-RAG: il retrieval che scala i rami del sapere per un LLM più lucido

HG-RAG sostituisce i classici store documentali con un grafo di conoscenza gerarchico: il framework recupera contesto strutturato navigando nodi padre, vicini e figli. I test mostrano meno allucinazioni e maggiore coerenza, specialmente su query multi-hop e relazionali.

2026-07-17 Fonte
📁 Hardware AI generated

Open weight, ma solo sulla carta: il miraggio dei modelli locali da 700 miliardi di parametri

Il rilascio di modelli ‘aperti’ come GLM-5.2 con 753 miliardi di parametri e licenza MIT sta creando entusiasmo, ma per chi fa self-hosting restano irraggiungibili. La community storica che lottava con quantizzazioni e trick di compilazione oggi si trova di fronte a colossi che richiedono rack aziendali, rendendo l’open weight una promessa vuota per chi vuole davvero eseguire in locale.

2026-07-17 Fonte
📁 Altro AI generated

Hugging Face irraggiungibile: la fragilità nascosta nei deployment on-premise

Un'interruzione del servizio di Hugging Face ha bloccato sviluppatori e aziende che fanno affidamento sulla piattaforma per scaricare modelli. L'episodio riaccende i riflettori sui rischi di dipendenza da un hub centralizzato, in particolare per chi investe in architetture locali e sovranità dei dati.

2026-07-16 Fonte
📁 LLM AI generated

RxBrain: Tencent lancia un modello embodied che ragiona e genera immagini in un'unica sequenza

Tencent ha rilasciato Hy-Embodied-RxBrain-1.0, un modello unificato per la cognizione embodied. Combina ragionamento multimodale, previsione dello stato del mondo e pianificazione a sottobiettivi, alternando testo e frame immaginati in un’unica sequenza autoregressiva. Con 6,2 miliardi di parametri e un’architettura Mixture-of-Transformers, accoppia piani simbolici e obiettivi visivi senza bisogno di moduli separati.

2026-07-15 Fonte
📁 LLM AI generated

CANDI-QA smaschera i limiti degli LLM nei settori critici: serve ragionamento simbolico

Il benchmark CANDI-QA mostra che gli LLM, anche i più avanzati, falliscono quando devono rispondere a domande che richiedono allineamento contestuale in domini come sanità e finanza. Il dataset distingue tra estrazione fattuale e inference applicata, e un approccio neuro-simbolico (MTSS-Net) offre una baseline più solida. Per l’adozione on-premise, dove la sovranità dei dati è irrinunciabile, la ricerca segnala che il solo LLM non è sufficiente.

2026-07-15 Fonte
📁 Altro AI generated

Meta: l’AI che ha tagliato i posti puniva i dipendenti fragili. Una lezione per chi porta i modelli in casa

Ventisei dipendenti citano Meta in tribunale: i sistemi AI usati per i licenziamenti di massa avrebbero discriminato chi era in congedo medico o aveva disabilità, secondo la causa depositata in California. Al cuore dell’accusa l’uso di metriche di produttività e dati sul consumo di token. Una vicenda che interroga non solo i giganti tech, ma ogni organizzazione che oggi valuta di affidare decisioni sensibili a modelli self-hosted.

2026-07-14 Fonte
📁 Frameworks AI generated

Il traguardo di llama.cpp segna la maturità dell’inference locale

Un ringraziamento della community per un traguardo simbolico di llama.cpp racconta molto più di un semplice aggiornamento software: è il segnale che l'inference locale su hardware comune è ormai una realtà produttiva, capace di ridefinire strategie di deployment, privacy e costi per le imprese.

2026-07-14 Fonte
📁 LLM AI generated

La fragilità dei benchmark LLM: quando il formato conta più dell’accuratezza

Un esperimento su 140.000 generazioni mostra che minime variazioni nel formato dei prompt possono ribaltare le classifiche LLM, a causa di fallimenti nella conformità dell’output. I ricercatori propongono due nuovi indici, FSI e PSI, rivelando oscillazioni fino a 30x tra modelli. Senza misurare la sensibilità al formato, i benchmark sono statisticamente fragili: un segnale d’allarme per chi usa LLM in produzione.

2026-07-14 Fonte
📁 LLM AI generated

Emergent Misalignment: la fragilità dell’allineamento su misura

Un nuovo studio riproduce l’Emergent Misalignment, ma mostra che disallineamento e riallineamento sono sensibili a dettagli superficiali del dataset. Il riallineamento rapido svanisce controllando la lunghezza delle risposte. Le firme meccanicistiche non correlano con il comportamento. Un campanello d’allarme per chi fa fine-tuning on-premise.

2026-07-13 Fonte
📁 LLM AI generated

Il miraggio della distillazione: perché addestrare su CoT filtrate peggiora gli LLM

Addestrare modelli open sui tracciati di ragionamento delle API commerciali sembra una scorciatoia, ma quei tracciati sono censurati o riassunti, non la catena di pensiero reale. Il risultato è garantito peggiore del modello originale. L'illusione mina la qualità dei fine-tuning e crea rischi concreti per chi sceglie deployment sovrani basati su questi dati.

2026-07-13 Fonte
📁 LLM AI generated

J-space su Qwen3-8B: il ragionamento silenzioso diventa guardiano on‑prem

Un ricercatore ha replicato localmente la “lente Jacobiana” che Anthropic aveva usato per svelare il pensiero nascosto di Claude. Su Qwen3-8B, la sonda intercetta derive prima delle tool call e aziona guardie che bloccano, annullano o recuperano l’output. Uno scenario concreto per la sicurezza agentica senza dipendere da API cloud.

2026-07-12 Fonte
📁 Altro AI generated

Due ragazzi, un taxi senza pilota e una chiamata al 911: chi controlla i controllori?

Un incidente a bordo di una Waymo a San Mateo riaccende il dibattito sul monitoraggio remoto: due quindicenni ripresi mentre bevevano e sparavano pallini, l’auto chiama la polizia. L’episodio svela la tensione tra sorveglianza centralizzata e autonomia locale, e spinge a ripensare l’architettura delle decisioni critiche nei sistemi autonomi.

2026-07-09 Fonte
📁 Altro AI generated

Meta CTO: i dati del monitoraggio dei dipendenti sono finiti dove non dovevano

Il chief technology officer Andrew Bosworth spiega come il più controverso progetto AI di Meta, il Model Capability Initiative basato sul keylogging, sia stato bloccato dopo che i dati sensibili dei dipendenti sono stati spostati in un archivio non previsto. L’episodio solleva questioni urgenti sulla governance dei dati interni nelle aziende che sviluppano modelli on-premise.

2026-07-09 Fonte
📁 Altro AI generated

LLM locali, senza RAG non c'è accuratezza: i numeri di uno sviluppatore

Un developer ha verificato se i modelli linguistici locali rispondono correttamente a domande tecniche: senza RAG le performance crollano, con un knowledge base diventano affidabili. Il thinking non incide quasi per niente. Apple Intelligence, limitato a 4K di contesto, raggiunge l'86%: un segnale forte per l'on-premise e la sovranità dei dati.

2026-07-08 Fonte
📁 Hardware AI generated

Samsung porta gli eSSD PCIe 6.0 nel memory play di Nvidia Vera Rubin: perché non è solo storage

L'arrivo dei primi eSSD PCIe 6.0 di Samsung per la piattaforma Vera Rubin segnala un cambio di gerarchia: lo storage non è più un collo di bottiglia secondario, ma un ingranaggio attivo della memoria per l'inference on-premise. La mossa svela come il prossimo anello della catena dell'AI sarà la velocità con cui i dati raggiungono i core di calcolo, ridisegnando i vincoli hardware per chi non vuole mollare il controllo dei propri modelli.

2026-07-08 Fonte
📁 Altro AI generated

Audit di sicurezza: la fragilità nascosta che inganna i benchmark degli LLM

Uno studio smaschera cinque classi di fallimento negli audit di validità basati su perturbazioni, spesso usati come prova nei framework di governance. I risultati diventano inaffidabili per dettagli implementativi invisibili, un problema critico per chi esegue modelli on-premise e punta sulla sovranità dei dati.

2026-07-07 Fonte
📁 Hardware AI generated

Qualcomm Dragonfly alza la posta, MediaTek risponde con TPU e ASIC

La sfida tra Qualcomm e MediaTek per l'AI on-device si sposta sull'inference locale: Dragonfly punta a portare gli LLM sull'edge, mentre MediaTek sfrutta TPU e ASIC personalizzati. Per chi valuta deployment on-premise, si aprono scenari di privacy, latenza e TCO che vale la pena decifrare.

2026-07-02 Fonte
📁 Altro AI generated

L'illusione dei guardrail: i browser AI possono essere raggirati con un sito web

Nuova ricerca mostra come un sito malevolo possa spingere i browser basati su LLM in uno stato onirico dove le restrizioni di sicurezza vengono disattivate. L'attaccante ottiene così accesso a repository privati e gestori di credenziali. Un campanello d'allarme per chiunque integri agenti IA con dati sensibili.

2026-06-30 Fonte
📁 Altro AI generated

Panasonic punta sulle batterie per data center: focus su storage AI in USA

Panasonic, colosso giapponese, intende avviare la produzione di massa di celle per batterie destinate ai data center in Kansas entro l'anno fiscale 2028. Questa mossa strategica reindirizza una parte significativa degli investimenti in infrastrutture AI verso lo storage energetico, evidenziando come i data center stiano diventando un mercato cruciale per i produttori di batterie, tradizionalmente legati al settore automotive.

2026-06-30 Fonte
📁 Market AI generated

Arena, la leaderboard AI raggiunge 100 milioni di dollari: cosa significa per chi sceglie l’on-premise

Partito come progetto di ricerca a UC Berkeley nel 2023, il servizio di valutazione crowdsourced ha monetizzato in otto mesi, toccando un fatturato annualizzato di 100 milioni di dollari. Mentre Arena diventa il punto di riferimento per confrontare LLM, restano fuori i parametri decisivi per i deployment locali: latenza, quantization, sovranità dei dati e costo reale dell’inference su hardware aziendale.

2026-06-29 Fonte
📁 Altro AI generated

Cina raggiunge Anthropic nella cybersecurity: la corsa all’AI si riavvia

La notizia che la Cina ha eguagliato le capacità di cybersecurity di Anthropic ridisegna gli equilibri della competizione globale sull’intelligenza artificiale. Per chi gestisce LLM on-premise, dove sovranità dei dati e controllo degli accessi sono imprescindibili, l’avanzata cinese impone una riflessione urgente sulla robustezza delle difese, sulle architetture air-gapped e sul rischio di escalation asimmetrica.

2026-06-28 Fonte
📁 Altro AI generated

Startup asiatiche lanciano modelli AI 'Mythos-like' sfidando l'export ban USA

Nell'ombra delle restrizioni all'esportazione di tecnicie AI imposte dagli Stati Uniti, startup asiatiche stanno rilasciando modelli con capacità paragonabili a Mythos. Il divieto, che coinvolge Anthropic, sta spingendo lo sviluppo di alternative locali. Per il mercato enterprise, questo segnala un'accelerazione verso la sovranità dei dati e apre scenari inediti per deployment on-premise. AI-RADAR analizza le implicazioni strategiche.

2026-06-27 Fonte
📁 Market AI generated

Qualcomm punta al cloud AI con Dragonfly: non più solo chip per smartphone

Con il progetto Dragonfly, Qualcomm rilancia la propria strategia nel cloud AI, segnando un’evoluzione che va oltre i processori per dispositivi mobili. L’iniziativa apre scenari di competizione nel mercato degli acceleratori per data center, con possibili ricadute per chi cerca alternative a NVIDIA e valuta deployment on-premise.

2026-06-26 Fonte
📁 Hardware AI generated

GlobalFoundries punta su Singapore per cavalcare l’ondata dell’hardware AI fisico

Il produttore di semiconduttori rafforza la presenza nella città-stato per soddisfare la domanda crescente di chip progettati per l’intelligenza artificiale. Una mossa che segnala la centralità della capacità produttiva nella corsa all’infrastruttura per AI, con implicazioni concrete per chi sviluppa o acquista hardware destinato a deployment on-premise.

2026-06-26 Fonte
📁 Hardware AI generated

Qualcomm: chip data center per la Cina, Dragonfly acceleratori AI depotenziata

Qualcomm pianifica una nuova linea di chip per data center, Dragonfly, specifica per il mercato cinese. Gli acceleratori AI saranno intenzionalmente depotenziate per rispettare le soglie di prestazione imposte dai controlli all'esportazione statunitensi. Una mossa che segnala l'adattamento dell'industria dei semiconduttori alla crescente frammentazione tecnicica tra USA e Cina, con implicazioni dirette per chi gestisce infrastrutture on-premise nel paese asiatico.

2026-06-25 Fonte
📁 Hardware AI generated

Qualcomm Investor Day 2026: CPU Dragonfly C1000, memorie HBM alternative e acceleratori AI

Al suo Investor Day 2026 Qualcomm ha presentato la CPU Dragonfly C1000, una soluzione di memoria ad alta larghezza di banda proprietaria come alternativa all’HBM e nuovi acceleratori AI. L’incursione nei rack dei data center segnala un cambio di passo che potrebbe ridefinire gli equilibri per chi cerca stack on-premise ad alte prestazioni e maggiore sovranità sui carichi di inference.

2026-06-24 Fonte
📁 LLM AI generated

Neuro-Symbolic Drive: il ragionamento simbolico rafforza i VLA per la guida autonoma

I ricercatori hanno usato tracce di ragionamento da planner classici per supervisionare un piccolo VLA (Qwen3.5-4B), ottenendo una riduzione significativa degli errori di traiettoria e dei falsi negativi. Il metodo garantisce che il ragionamento sia causalmente legato alla pianificazione del moto, un aspetto cruciale per chi valuta modelli compatti in contesti on-premise.

2026-06-24 Fonte
📁 Altro AI generated

Skill AI fasulla ha ingannato ogni scanner e ha raggiunto 26.000 agenti, anche aziendali

Un esperimento di sicurezza dimostra la fragilità dell'ecosistema degli agenti AI: una skill fittizia, promossa con un annuncio Instagram, ha superato tutti gli scanner e ha raggiunto oltre 26.000 agenti, inclusi account aziendali. Il caso solleva interrogativi sulla catena di fornitura software per AI e sui rischi per chi adotta agenti senza un controllo diretto dell'infrastruttura.

2026-06-23 Fonte
📁 Altro AI generated

Germania a Trump: senza di noi, la Luna è irraggiungibile

Il ministro dello spazio tedesco rivendica il ruolo indispensabile dell’Europa nelle missioni lunari americane. Al VivaTech di Parigi, Dorothee Bär ha ricordato che il Modulo di Servizio Europeo è un componente critico per la NASA. Una dichiarazione che mette in luce l’interdipendenza tecnicica tra alleati, un tema sempre più centrale anche per chi sviluppa infrastrutture di intelligenza artificiale on-premise, dove la sovranità dei dati e il controllo della supply chain hardware diventano fattori strategici.

2026-06-22 Fonte
📁 Market AI generated

Samsung System LSI in rosso: i chip Exynos frenano la divisione, quali effetti sull'AI on-device?

Il presidente Park Yong-In conferma le continue perdite dei SoC System LSI, con impatti visibili fino al 2026. La divisione arranca nella competizione mobile, mettendo a rischio innovazioni chiave per l'AI edge: Exynos e i chip affini vedranno meno investimenti, mentre la domanda di inference LLM locale cresce. Uno scenario che ridefinisce il panorama hardware per deployment on-premise di modelli linguistici su dispositivi mobili e gateway.

2026-06-22 Fonte
📁 Market AI generated

General Intuition raccoglie 300 milioni di dollari per l'AI di ragionamento spazio-temporale

General Intuition, una startup focalizzata sullo sviluppo di agenti AI per il ragionamento spazio-temporale, è in trattative avanzate per un round di finanziamento da 300 milioni di dollari. L'operazione, che include il coinvolgimento di investitori come Jeff Bezos, valuta l'azienda circa 2 miliardi di dollari, evidenziando l'interesse del mercato per soluzioni AI complesse e ad alta intensità computazionale.

2026-06-18 Fonte
📁 Altro AI generated

Un modello di ragionamento OpenAI supporta la diagnosi di malattie genetiche rare

Ricercatori hanno impiegato un modello di ragionamento sviluppato da OpenAI per assistere i medici nella diagnosi di malattie genetiche rare che colpiscono i bambini. Questa applicazione ha permesso di identificare 18 nuove diagnosi in casi precedentemente irrisolti, evidenziando il potenziale dell'intelligenza artificiale nel migliorare l'accuratezza e la tempestività diagnostica in contesti complessi e sensibili come la medicina pediatrica.

2026-06-18 Fonte
📁 Frameworks AI generated

SproutRAG: RAG Gerarchico e Attenzione per la Gestione Efficiente di Documenti Lunghi

SproutRAG introduce un nuovo framework RAG gerarchico che ottimizza la gestione di documenti lunghi. Superando i limiti dei metodi esistenti, che spesso richiedono costose chiamate a LLM o sacrificano la coerenza contestuale, SproutRAG utilizza un approccio basato sull'attenzione per costruire unità semantiche progressive. Questo consente un retrieval a granularità multipla senza dipendere da LLM esterni per l'indicizzazione o la sintesi, migliorando l'efficienza informativa del 6,1% in media su vari benchmark.

2026-06-18 Fonte
📁 Frameworks AI generated

Extend.ai presenta un UI kit open source per agenti e RAG documentali

Extend.ai ha rilasciato un UI kit open source, con licenza MIT, progettato per lo sviluppo di applicazioni che gestiscono documenti. Il kit include 15 componenti per visualizzatori di PDF, DOCX e XLSX, oltre a funzionalità per l'upload, la firma elettronica e le citazioni. Nato da un'esigenza interna dell'azienda, che processa milioni di pagine al giorno, mira a semplificare la creazione di agenti di elaborazione documentale e flussi di acquisizione dati.

2026-06-17 Fonte
📁 LLM AI generated

Gemma 4 E2B: L'inference in-browser raggiunge 255 tok/s su M4 Max con WebGPU

Una recente demo mostra il modello Gemma 4 E2B di Google operare direttamente nel browser, raggiungendo prestazioni di 255 token al secondo su hardware Apple M4 Max. Questo risultato è stato ottenuto grazie all'ottimizzazione dei kernel WebGPU, sviluppati con il supporto di Fable 5, e offre nuove prospettive per l'inference LLM su dispositivi edge, rafforzando il controllo sui dati e riducendo la dipendenza dal cloud.

2026-06-17 Fonte
📁 Altro AI generated

Una startup di "cyber warfare" raggiunge lo status di unicorno con un round da 100 milioni

Twenty, una startup che si descrive come la prima azienda americana di cyber warfare finanziata da venture capital, ha ottenuto un finanziamento di Serie B da 100 milioni di dollari, guidato da Accel. La valutazione dell'azienda ha raggiunto il miliardo di dollari, evidenziando l'interesse degli investitori nel settore delle capacità offensive nel panorama della sicurezza informatica e le sue implicazioni per la protezione delle infrastrutture critiche.

2026-06-17 Fonte
📁 Frameworks AI generated

FPP a lungo raggio: come l'architettura risolve le 'scorciatoie' dei modelli AI

Uno studio approfondisce le sfide della profilometria a proiezione di frange (FPP) a lungo raggio, dove i modelli AI tendono a prendere scorciatoie. Utilizzando interpretabilità meccanicistica e quantificazione dell'incertezza, i ricercatori hanno diagnosticato un problema architetturale in un modello UNet. La soluzione, PhiCalNet, ha migliorato l'accuratezza di 3,3 volte, dimostrando l'importanza di un design robusto per applicazioni critiche.

2026-06-17 Fonte
📁 LLM AI generated

VibeThinker-3B: Ragionamento Avanzato in Modelli di Piccola Scala

Un nuovo studio presenta VibeThinker-3B, un Large Language Model da 3 miliardi di parametri che dimostra capacità di ragionamento avanzato in matematica e coding. Nonostante le dimensioni contenute, il modello raggiunge performance di alto livello su benchmark specifici, suggerendo che i Small Language Models possono offrire capacità di frontiera in contesti mirati, con implicazioni significative per i deployment on-premise e la sovranità dei dati.

2026-06-16 Fonte
📁 Altro AI generated

Apple e l'AI: una svolta pragmatica con Google Cloud e GPU Nvidia

Apple sta adottando un approccio pragmatico per lo sviluppo della sua intelligenza artificiale, scegliendo di integrare servizi esterni. L'azienda si affida a Google Cloud e alle GPU Nvidia per supportare i propri carichi di lavoro AI. Questa mossa evidenzia la complessità e le risorse computazionali richieste dall'addestramento e dall'Inference dei Large Language Models, spingendo anche giganti tecnicici a valutare soluzioni ibride o completamente cloud per accelerare lo sviluppo e la scalabilità.

2026-06-15 Fonte
📁 Market AI generated

La corsa indiana ai chip: tra frammentazione e ambizioni di sovranità tecnicica

L'India sta intensificando gli sforzi per costruire un'industria dei semiconduttori, affrontando la frammentazione del settore. Questa ambizione nazionale è cruciale per la sovranità tecnicica e ha implicazioni dirette per i deployment di Large Language Models (LLM) on-premise. La capacità di produrre chip localmente può ridurre il Total Cost of Ownership (TCO), migliorare la resilienza della supply chain e garantire un maggiore controllo sui dati, aspetti fondamentali per le aziende che valutano soluzioni self-hosted e air-gapped per i carichi di lavoro AI.

2026-06-15 Fonte
📁 Altro AI generated

Incidente Tesla a Redmond: Autopilot sotto indagine dopo l'impatto con un garage

Un veicolo Tesla in modalità Autopilot è stato coinvolto in un incidente a Redmond, Washington, impattando contro un garage residenziale. Il conducente ha dichiarato un malfunzionamento del sistema di guida autonoma. Le autorità hanno avviato un'indagine, mentre non sono stati segnalati feriti. L'episodio solleva interrogativi sulla validazione dei sistemi AI nel mondo reale e le implicazioni per i deployment on-premise.

2026-06-13 Fonte
📁 Market AI generated

Transsion: dai telefoni africani allo storage energetico, una nuova sfida infrastrutturale

Transsion, noto produttore di telefoni in Africa, sta diversificando le proprie attività, puntando ora sul settore dello storage energetico. Questa mossa strategica segna l'inizio di una competizione più ardua, che richiederà investimenti significativi in ricerca, sviluppo e infrastrutture robuste. La transizione evidenzia le sfide intrinseche nell'entrare in mercati ad alta intensità tecnicica, dove la gestione dei dati e l'efficienza operativa sono cruciali per il successo.

2026-06-11 Fonte
📁 LLM AI generated

Addestrare gli LLM al Ragionamento Induttivo: Un Nuovo Approccio con Programmi Probabilistici

La formazione dei Large Language Models per il ragionamento si è tradizionalmente concentrata su compiti deduttivi. Tuttavia, le sfide del mondo reale spesso richiedono ragionamento induttivo, che implica l'inference di credenze incerte da dati ambigui. Un nuovo approccio, denominato Program-based Posterior Training (PPT), affronta queste limitazioni. Utilizzando LLM per generare scenari come programmi probabilistici e applicando l'inference per produrre risposte target distribuzionali, il PPT permette un fine-tuning efficace su "soft labels". Questo metodo migliora significativamente l'accuratezza e l'allineamento con i giudizi umani.

2026-06-10 Fonte
📁 LLM AI generated

Come Nextdoor sfrutta Codex e GPT-5.5 per l'ingegneria del software

Gli ingegneri di Nextdoor impiegano Codex, in combinazione con GPT-5.5, per ottimizzare i processi di sviluppo. L'obiettivo è affrontare problematiche complesse e difficili da replicare, facilitare la creazione di soluzioni multi-piattaforma e permettere ai team di concentrarsi maggiormente sui risultati di prodotto. L'adozione di questi strumenti mira a migliorare l'efficienza operativa interna.

2026-06-09 Fonte
📁 LLM AI generated

OmniMem: Ottimizzare la Memoria per LLM Audio-Visivi a Lungo Raggio

OmniMem è un nuovo framework di streaming progettato per migliorare l'efficienza della memoria negli LLM audio-visivi. Affronta le limitazioni causate dalla crescita lineare dei token video e delle KV caches, introducendo una gestione della memoria consapevole della modalità e una selezione degli stati KV basata sulle perturbazioni. Questo approccio consente una compressione efficace senza compromettere la comprensione a lungo raggio, offrendo miglioramenti significativi in termini di accuratezza e rilevanza per i deployment on-premise.

2026-06-09 Fonte
📁 LLM AI generated

Apple: un LLM da 20 miliardi di parametri esegue l'inference dalla flash dell'iPhone

La conferenza sviluppatori di Apple ha messo in evidenza una Siri rinnovata. Tuttavia, la vera innovazione risiede in un modello AI da 20 miliardi di parametri che, pur essendo troppo grande per la RAM di un iPhone, riesce a eseguire l'inference direttamente dalla memoria flash del dispositivo. Questa soluzione tecnica, dettagliata in un post dedicato, apre nuove prospettive per l'esecuzione di Large Language Models on-device, con implicazioni significative per la sovranità dei dati e l'efficienza computazionale.

2026-06-09 Fonte
📁 Hardware AI generated

Schede di espansione AMD B650: più storage e connettività per PC on-premise

Le nuove schede di espansione AMD B650 arrivano sul mercato a partire da 199 dollari, offrendo quattro slot M.2 PCIe 4.0 e undici porte USB. Questa soluzione permette di potenziare i PC esistenti con capacità di storage ad alta velocità e maggiore connettività, rivelandosi strategica per chi gestisce carichi di lavoro AI/LLM on-premise e cerca flessibilità e controllo sull'infrastruttura locale.

2026-06-06 Fonte
📁 LLM AI generated

Qwen3.6-35B GGUF: Un LLM per deployment on-premise con ragionamento Claude Opus

Il modello Qwen3.6-35B, disponibile in formato GGUF, si propone come soluzione robusta per il deployment on-premise di Large Language Models. Basato su una fusione delta e arricchito dal ragionamento di Claude 4.6 Opus, offre stabilità per la programmazione, capacità di roleplay complesse e funzionalità di chiamata di funzioni migliorate. La sua ottimizzazione per l'inference locale, anche con quantization Q4_K_M, lo rende particolarmente interessante per aziende che privilegiano sovranità dei dati e controllo infrastrutturale.

2026-06-06 Fonte
📁 LLM AI generated

SupraLabs Rilascia Supra-50M-Reasoning: Un LLM Aperto per il Ragionamento On-Premise

SupraLabs ha annunciato il rilascio di Supra-50M-Reasoning, un Large Language Model (LLM) sperimentale e "fully open" progettato per generare catene di pensiero esplicite. Fine-tuned con un dataset sintetico e operante in bfloat16, il modello si propone come una risorsa interessante per le organizzazioni che valutano deployment self-hosted, offrendo controllo sui dati e potenziale ottimizzazione del TCO, nonostante la sua natura ancora in fase di sviluppo e la propensione alle allucinazioni.

2026-06-05 Fonte
📁 Hardware AI generated

Qualcomm e Snapdragon C: un nuovo attore nel segmento AI PC entry-level

Qualcomm ha annunciato il posizionamento della sua piattaforma Snapdragon C, progettata per colmare il vuoto nel mercato dei PC con capacità AI di fascia entry-level. L'azienda sottolinea che questa offerta non è legata all'ecosistema Apple, mirando a un'ampia adozione in altri segmenti di mercato. Questo posizionamento strategico evidenzia l'espansione dell'hardware dedicato all'intelligenza artificiale direttamente sui dispositivi.

2026-06-04 Fonte
📁 Hardware AI generated

Qualcomm lancia Dragonfly: il nuovo brand per i prodotti data center

Qualcomm ha svelato "Dragonfly", il suo nuovo brand dedicato ai prodotti per il data center. L'iniziativa segna un'espansione strategica nel settore, con ulteriori dettagli attesi per il 24 giugno, in occasione dell'Investor's Day 2026 dell'azienda. Questa mossa suggerisce un impegno crescente di Qualcomm nel fornire soluzioni hardware per carichi di lavoro AI e LLM, potenzialmente rilevanti per deployment on-premise e per chi cerca alternative nel mercato.

2026-06-03 Fonte
📁 LLM AI generated

Microsoft lancia Aion: LLM on-device per efficienza e ragionamento locale

Microsoft ha presentato Aion 1.0 Instruct e Aion 1.0 Plan, due nuovi LLM progettati per carichi di lavoro on-device. Aion 1.0 Instruct è un Small Language Model con pesi aperti per intelligenza testuale quotidiana, mentre Aion 1.0 Plan, con 14 miliardi di parametri e 32K di contesto, abilita workflow agentici e tool-calling direttamente sui dispositivi Windows compatibili, enfatizzando il controllo locale e la sovranità dei dati.

2026-06-03 Fonte
📁 LLM AI generated

LLM: i grafici visivi come impalcatura interna per un ragionamento più efficace

Una nuova ricerca esplora il potenziale dei grafici non solo come fonti di conoscenza esterne, ma come strumenti interni per organizzare il ragionamento degli LLM. Gli esperimenti su compiti di risposta a domande multi-hop rivelano un "modality gap": la guida visiva tramite grafici supera nettamente l'approccio testuale, migliorando l'efficienza e la qualità del ragionamento. Questo suggerisce un nuovo paradigma per lo sviluppo di LLM più robusti e autonomi.

2026-06-03 Fonte
📁 Altro AI generated

DAStatFormer: Efficienza e Precisione per il Monitoraggio Acustico Distribuito

DAStatFormer introduce un approccio innovativo per l'analisi dei dati Distributed Acoustic Sensing (DAS). Questo Transformer ibrido elabora attributi statistici compatti anziché segnali grezzi, riducendo drasticamente la dimensione dei dati. Il modello raggiunge un'accuratezza elevata e un costo di Inference significativamente inferiore rispetto alle alternative, rendendolo ideale per applicazioni di monitoraggio scalabili e in tempo reale, con implicazioni positive per il Total Cost of Ownership (TCO) in contesti on-premise.

2026-06-02 Fonte
📁 Hardware AI generated

L'espansione degli SSD YMTC in APAC: considerazioni per lo storage AI on-premise

YMTC sta rafforzando la sua presenza nel mercato consumer degli SSD in Asia-Pacifico, con Taiwan come hub distributivo. Questa mossa evidenzia le dinamiche del settore NAND flash, fondamentali per l'infrastruttura AI. Per le aziende che valutano deployment on-premise di Large Language Models, la disponibilità e le performance delle soluzioni di storage sono cruciali per la sovranità dei dati, il TCO e l'efficienza delle operazioni di training e Inference.

2026-06-02 Fonte
📁 LLM AI generated

OpenAI e la Congettura di Erdős: un Traguardo per l'AI in Matematica

OpenAI ha annunciato che un suo modello di intelligenza artificiale ha risolto la Congettura di Erdős sulla distanza unitaria, un problema di geometria discreta che ha eluso i matematici per 80 anni. L'evento, definito una "pietra miliare" da esperti come il medaglia Fields Tim Gowers, segna un progresso significativo nelle capacità autonome dell'AI nella ricerca scientifica.

2026-06-01 Fonte
📁 LLM AI generated

Valutazione di ChatGPT: un protocollo RAG con LLM open source contro le allucinazioni

Un nuovo protocollo propone un metodo rigoroso per valutare la capacità di ChatGPT di generare associazioni biomediche. Il processo include la validazione delle entità tramite ontologie e la verifica con la letteratura scientifica. Per migliorare l'affidabilità, il protocollo introduce una strategia di auto-consistenza e un workflow di verifica semantica basato su Retrieval-Augmented Generation (RAG). Quest'ultimo sfrutta Large Language Models (LLM) open source per stabilire la veridicità dei contenuti generati da altri LLM, offrendo uno strumento efficace per identificare le allucinazioni.

2026-06-01 Fonte
📁 LLM AI generated

Previsione Semantica dei Passi: Nuovi Orizzonti per il Ragionamento degli LLM

Un recente studio introduce la "Previsione Semantica dei Passi", una metodologia innovativa per migliorare il ragionamento multi-step nei Large Language Models (LLM). Attraverso il campionamento dei passi e la previsione latente, il sistema mira a rendere le traiettorie di ragionamento più robuste e accurate. Questo approccio ha implicazioni significative per l'efficienza e l'affidabilità dei deployment LLM on-premise, dove l'ottimizzazione delle risorse e il controllo sui processi sono cruciali per il Total Cost of Ownership (TCO) e la sovranità dei dati.

2026-06-01 Fonte
📁 Altro AI generated

SoftBank investe fino a 87 miliardi in data center AI in Francia, puntando sull'energia nucleare

SoftBank ha annunciato un piano di investimento fino a 87 miliardi di dollari per la costruzione di data center dedicati all'intelligenza artificiale in Francia. La scelta strategica del paese è motivata dalla disponibilità di una robusta rete elettrica basata sull'energia nucleare, un fattore critico per l'alimentazione di infrastrutture AI ad alta intensità energetica, che rappresenta un vantaggio competitivo rispetto ad altre regioni, come gli Stati Uniti.

2026-05-31 Fonte
📁 Hardware AI generated

Snapdragon X Elite: Il Ruolo dei Processori Client nell'AI On-Device

L'emergere di processori come lo Snapdragon X Elite segna un punto di svolta per l'AI on-device, spostando l'elaborazione dei Large Language Models e altre funzionalità AI direttamente sui dispositivi client. Questa evoluzione offre nuove opportunità per la sovranità dei dati e la riduzione della latenza, ponendo le basi per un'architettura AI più distribuita e meno dipendente dalle infrastrutture cloud centralizzate.

2026-05-31 Fonte
📁 Hardware AI generated

Linux 7.1-rc6: La documentazione su "clearcpuid" sarà rimossa per scoraggiarne l'uso

Il kernel Linux 7.1-rc6 vedrà la rimozione della documentazione relativa al parametro `clearcpuid`. Questo strumento, utile per disabilitare specifiche funzionalità CPUID e in passato impiegato per benchmark comparativi di AVX-512, non sarà più documentato per scoraggiarne l'utilizzo. La decisione mira a limitare l'impiego di una funzionalità che permetteva di alterare il comportamento della CPU a livello di sistema operativo, promuovendo configurazioni hardware più trasparenti e prevedibili, cruciali per i deployment on-premise di carichi di lavoro AI.

2026-05-31 Fonte
📁 Altro AI generated

Microsoft e la controversia sulle vulnerabilità: minacce legali a un ricercatore scatenano l'ira della community

Microsoft ha generato una forte reazione nella comunità della cybersecurity dopo aver criticato pubblicamente il ricercatore "Nightmare Eclipse" per aver rivelato vulnerabilità non patchate in Windows Defender e BitLocker. L'azienda ha poi coinvolto la sua Digital Crimes Unit, un'unità che gestisce segnalazioni penali e coordinamento con le forze dell'ordine, provocando indignazione per le implicazioni sulla divulgazione responsabile delle falle di sicurezza e sul ruolo dei ricercatori.

2026-05-30 Fonte
📁 LLM AI generated

Gryphe lancia Pantheon-Reasoning-27B: Ragionamento Avanzato per LLM On-Premise

Gryphe ha rilasciato Pantheon-Reasoning-27B, un LLM da 27 miliardi di parametri basato su Qwen 3.6, progettato per migliorare le capacità di ragionamento nei contesti di roleplay. Il modello integra "thinking traces" estese e dati diversificati, offrendo una soluzione promettente per chi cerca deployment on-premise grazie alla disponibilità di quantizzazioni GGUF. Si pone come un'alternativa interessante per scenari che richiedono controllo e sovranità dei dati.

2026-05-30 Fonte
📁 Market AI generated

Pegatron: il boom dell'AI a Taiwan non ha ancora raggiunto l'apice

Il Presidente di Pegatron, uno dei principali produttori di elettronica, ha dichiarato che l'attuale crescita del settore AI a Taiwan è ancora lontana dal suo picco. Questa osservazione sottolinea la robusta e continua domanda di hardware e componenti essenziali per l'intelligenza artificiale, con implicazioni significative per la supply chain globale e per le aziende che pianificano deployment di Large Language Models (LLM) on-premise.

2026-05-29 Fonte
📁 Hardware AI generated

Qualcomm presenta la serie Snapdragon C per laptop entry-level

Qualcomm ha annunciato la nuova serie di System-on-Chip (SoC) Snapdragon C, progettata per alimentare laptop di fascia entry-level con un prezzo di partenza di circa 300 dollari. Questa iniziativa mira a rafforzare la posizione dell'azienda nel segmento dei dispositivi portatili accessibili, ponendosi in diretta competizione con soluzioni esistenti sul mercato.

2026-05-28 Fonte
📁 Hardware AI generated

Qualcomm lancia Snapdragon C: NPU e Windows on Arm per l'AI su laptop accessibili

Qualcomm ha annunciato la piattaforma Snapdragon C, progettata per portare capacità di intelligenza artificiale sui laptop Windows on Arm a partire da 300 dollari. Integrando le NPU (Neural Processing Units), questa iniziativa mira a democratizzare l'accesso all'AI on-device, abilitando l'esecuzione locale di carichi di lavoro e offrendo nuove opportunità per la sovranità dei dati e l'ottimizzazione del TCO in scenari edge.

2026-05-28 Fonte
📁 LLM AI generated

LLM: la corsa al ragionamento si intensifica, tra nuovi modelli e benchmark

Il panorama dei Large Language Models (LLM) sta vivendo un'accelerazione senza precedenti, con l'emergere di nuovi modelli come GPT-5.4 xhigh, Gemini 3.1Pro e Hy3 preview. Quest'ultimo ha recentemente scalato le classifiche, ottenendo un punteggio di 87.8 nel benchmark CHSBO 2025, superando i concorrenti. Questo solleva interrogativi sulla reale applicabilità di tali performance nel mondo reale, al di là dei test sintetici, un aspetto cruciale per chi valuta deployment on-premise.

2026-05-28 Fonte
📁 Altro AI generated

Atacama: il deserto cileno ospita il più grande impianto di accumulo energetico

ContourGlobal, supportata da KKR, ha inaugurato in Cile un impianto ibrido solare-batteria da quasi 500 milioni di dollari. La struttura, situata nel deserto di Atacama, combina 231 MWp di capacità fotovoltaica con 1,3 GWh di storage, erogando 200 MW di potenza dopo il tramonto. Questo progetto evidenzia l'importanza delle soluzioni di accumulo per la stabilità della rete e l'integrazione delle rinnovabili, un aspetto cruciale anche per le infrastrutture AI on-premise.

2026-05-27 Fonte
📁 Altro AI generated

China Electric punta sulla trasformazione digitale con l'AI per incrementare i profitti entro il 2026

China Electric ha annunciato un piano strategico di trasformazione digitale basato sull'intelligenza artificiale, con l'obiettivo di migliorare significativamente la propria redditività entro il 2026. Questa iniziativa riflette la crescente adozione dell'AI nel settore industriale, evidenziando l'importanza di decisioni infrastrutturali ponderate, come i deployment on-premise, per garantire sovranità dei dati e controllo sui costi operativi.

2026-05-27 Fonte
📁 LLM AI generated

QASC: Il Chunking Adattivo alle Query che Potenzia i Sistemi RAG

Una nuova ricerca introduce Query-Adaptive Semantic Chunking (QASC), una strategia dinamica per il chunking dei documenti nei sistemi Retrieval-Augmented Generation (RAG). Integrando le query utente nella fase di segmentazione, QASC migliora significativamente la pertinenza e la coerenza dei contesti recuperati. I benchmark mostrano un incremento delle performance fino al 27% rispetto ai metodi tradizionali, offrendo un approccio più efficace per l'ottimizzazione dei Large Language Models in contesti aziendali.

2026-05-25 Fonte
📁 Altro AI generated

Stellantis e Qualcomm: l'espansione globale di Snapdragon Digital Chassis

Stellantis e Qualcomm hanno annunciato un'espansione significativa del deployment della piattaforma Snapdragon Digital Chassis. Questa mossa strategica mira a integrare ulteriormente le capacità di calcolo avanzate e la connettività nelle linee di veicoli globali di Stellantis. L'iniziativa sottolinea l'importanza crescente dell'elettronica e del software nell'industria automobilistica, con implicazioni per l'elaborazione dati a bordo e la gestione delle funzionalità AI.

2026-05-25 Fonte
📁 Market AI generated

La visibilità dei brand nell'era degli LLM: una sfida per il monitoraggio SEO

L'emergere di Large Language Models come ChatGPT e Gemini sta creando un divario significativo nella capacità delle aziende di monitorare la propria visibilità online. Mentre i motori di ricerca tradizionali offrono metriche chiare sul posizionamento, le raccomandazioni generate dagli LLM rimangono un "punto cieco" per i team SEO, rendendo obsoleti molti strumenti di tracking attuali.

2026-05-23 Fonte