🏷️ RAG

60 articoli con questo tag · tutti i tag

NVIDIA Nemotron Parse 2.0: il parsing che legge anche i grafici
LLM NVIDIA Nemotron Parse 2.0: il parsing che legge anche i grafici 2026-08-06
Xberg v1: il framework Rust per un’intelligence documentale davvero locale
Frameworks Xberg v1: il framework Rust per un’intelligence documentale davvero locale 2026-08-02
Da una 5090 a un mini datacenter: la parabola di chi voleva sfuggire alle API
Altro Da una 5090 a un mini datacenter: la parabola di chi voleva sfuggire alle API 2026-07-30
La memoria degli LLM: un pattern wiki per non dimenticare i vicoli ciechi
Frameworks La memoria degli LLM: un pattern wiki per non dimenticare i vicoli ciechi 2026-07-29
Piccoli LLM, la vera frontiera on-premise: la comunità tech si interroga sugli usi concreti
LLM Piccoli LLM, la vera frontiera on-premise: la comunità tech si interroga sugli usi concreti 2026-07-25
Solar-Open2: l'LLM MoE a 15B attivi che punta ai carichi agentivi on-premise
LLM Solar-Open2: l'LLM MoE a 15B attivi che punta ai carichi agentivi on-premise 2026-07-22
RIMS: aggregazione morbida per piccoli LLM più precisi nel RAG rumoroso
LLM RIMS: aggregazione morbida per piccoli LLM più precisi nel RAG rumoroso 2026-07-21
Microsoft: screenshot bloccati per i PDF riservati, ma solo in Edge
Altro Microsoft: screenshot bloccati per i PDF riservati, ma solo in Edge 2026-07-20
Cache KV byte-exact su Gemma 4: la conoscenza verificata diventa uno stato ricaricabile
LLM Cache KV byte-exact su Gemma 4: la conoscenza verificata diventa uno stato ricaricabile 2026-07-19
Bonsai 27B su iPhone: LLM da 27B in 3,9GB con quantization a 1 bit
LLM Bonsai 27B su iPhone: LLM da 27B in 3,9GB con quantization a 1 bit 2026-07-17
HG-RAG: il retrieval che scala i rami del sapere per un LLM più lucido
Frameworks HG-RAG: il retrieval che scala i rami del sapere per un LLM più lucido 2026-07-17
TSMC potenzia le fabbriche USA, i progettisti taiwanesi frenano
Hardware TSMC potenzia le fabbriche USA, i progettisti taiwanesi frenano 2026-07-17
Luciole-23B: la Francia accende un LLM aperto per chi non manda dati fuori casa
LLM Luciole-23B: la Francia accende un LLM aperto per chi non manda dati fuori casa 2026-07-16
CANDI-QA smaschera i limiti degli LLM nei settori critici: serve ragionamento simbolico
LLM CANDI-QA smaschera i limiti degli LLM nei settori critici: serve ragionamento simbolico 2026-07-15
AI a token limitati: Mosseri (Meta) profetizza budget capati per ogni sviluppatore
Market AI a token limitati: Mosseri (Meta) profetizza budget capati per ogni sviluppatore 2026-07-14
Index-1.9B di Bilibili: il piccolo LLM open che insidia i modelli enormi
LLM Index-1.9B di Bilibili: il piccolo LLM open che insidia i modelli enormi 2026-07-14
AuditWeave: il registro immodificabile per tracciare le decisioni dell’AI
Altro AuditWeave: il registro immodificabile per tracciare le decisioni dell’AI 2026-07-14
Domanda IA quadruplica i ricavi delle memorie a Taiwan: campanello d’allarme per l’on-premise
Market Domanda IA quadruplica i ricavi delle memorie a Taiwan: campanello d’allarme per l’on-premise 2026-07-14
Cloudflare blocca i crawler AI: fine del web aperto anche per i modelli locali
Altro Cloudflare blocca i crawler AI: fine del web aperto anche per i modelli locali 2026-07-13
Linux 7.2 abilita UltraRISC nel kernel: un tassello concreto per l'hardware AI aperta
Hardware Linux 7.2 abilita UltraRISC nel kernel: un tassello concreto per l'hardware AI aperta 2026-07-12
La fine degli agenti reattivi: il Context Graph porta l’AI enterprise a parlare prima che tu chieda
Frameworks La fine degli agenti reattivi: il Context Graph porta l’AI enterprise a parlare prima che tu chieda 2026-07-10
Se paghi già un LLM cloud, embedding e reranker on-premise sono la scelta più produttiva
Altro Se paghi già un LLM cloud, embedding e reranker on-premise sono la scelta più produttiva 2026-07-09
Perplexity prepara un tool di coding AI per sfidare Cursor e Claude Code
Altro Perplexity prepara un tool di coding AI per sfidare Cursor e Claude Code 2026-07-08
LLM locali, senza RAG non c'è accuratezza: i numeri di uno sviluppatore
Altro LLM locali, senza RAG non c'è accuratezza: i numeri di uno sviluppatore 2026-07-08
Prompt injection: quando i tool AI di massa diventano arsenali per botnet
Altro Prompt injection: quando i tool AI di massa diventano arsenali per botnet 2026-07-08
Longsys: utili in crescita esplosiva nel 1H26 grazie alla domanda AI di memoria
Market Longsys: utili in crescita esplosiva nel 1H26 grazie alla domanda AI di memoria 2026-07-06
Phison: l'AI potrebbe mettere fine ai cicli di boom-bust della NAND
Hardware Phison: l'AI potrebbe mettere fine ai cicli di boom-bust della NAND 2026-07-06
Un LLM da 270 milioni di parametri nato dal nulla e pensato per l'inference locale
LLM Un LLM da 270 milioni di parametri nato dal nulla e pensato per l'inference locale 2026-07-05
LLM locali e carichi agentici: il prefill è tutto, i KV head battono i parametri
LLM LLM locali e carichi agentici: il prefill è tutto, i KV head battono i parametri 2026-07-05
Gemma 4 31B addestrata per il copywriting: +290 Elo e niente più frasi fatte
LLM Gemma 4 31B addestrata per il copywriting: +290 Elo e niente più frasi fatte 2026-07-02
Intel avvia il supporto GCC per ACE, le estensioni AI condivise con AMD su x86
Hardware Intel avvia il supporto GCC per ACE, le estensioni AI condivise con AMD su x86 2026-07-02
SK Hynix mette 51 miliardi sul tavolo per la memoria NAND: la nuova fab M17 è targata AI
Hardware SK Hynix mette 51 miliardi sul tavolo per la memoria NAND: la nuova fab M17 è targata AI 2026-07-02
Memora: la memoria scalabile per agenti AI che riduce i token del 98%
Frameworks Memora: la memoria scalabile per agenti AI che riduce i token del 98% 2026-06-29
La NASA porta l'inference LLM a bordo: l'assistente medico per lo spazio profondo
Altro La NASA porta l'inference LLM a bordo: l'assistente medico per lo spazio profondo 2026-06-29
Motore NPC locale con LLM leggeri: la scommessa on-premise per gli RPG del futuro
Altro Motore NPC locale con LLM leggeri: la scommessa on-premise per gli RPG del futuro 2026-06-28
L’AI del futuro non sarà guidata solo da modelli migliori
Altro L’AI del futuro non sarà guidata solo da modelli migliori 2026-06-27
LLM on-premise: il workflow che vorresti aver scoperto prima
Altro LLM on-premise: il workflow che vorresti aver scoperto prima 2026-06-26
Se non hai una GPU da data center: strategie per LLM locali senza supercomputer
Hardware Se non hai una GPU da data center: strategie per LLM locali senza supercomputer 2026-06-26
Scaled Cognition raccoglie 100 milioni per un’AI che non allucina
LLM Scaled Cognition raccoglie 100 milioni per un’AI che non allucina 2026-06-25
Ornith-1.0: nuova famiglia di LLM su Hugging Face, dal dense 9B al MoE 397B
LLM Ornith-1.0: nuova famiglia di LLM su Hugging Face, dal dense 9B al MoE 397B 2026-06-25
NAND, carenza fino al 2027: Phison avverte, ordini già pieni per il Q2
Hardware NAND, carenza fino al 2027: Phison avverte, ordini già pieni per il Q2 2026-06-25
Linux 7.2: la miglioria MGLRU spinge MongoDB fino al +100% di throughput
Altro Linux 7.2: la miglioria MGLRU spinge MongoDB fino al +100% di throughput 2026-06-24
AMD espone le curve Gamma 2.4 e 2.6 nel driver Linux: più precisione cromatica per le GPU open source
Hardware AMD espone le curve Gamma 2.4 e 2.6 nel driver Linux: più precisione cromatica per le GPU open source 2026-06-24
Lo strato dati web: la nuova frontiera dell'infrastruttura AI
Altro Lo strato dati web: la nuova frontiera dell'infrastruttura AI 2026-06-24
Compri raccoglie 3,2 milioni per l'AI procurement: il nodo del deployment on-premise
Market Compri raccoglie 3,2 milioni per l'AI procurement: il nodo del deployment on-premise 2026-06-24
LineShine cinese in vetta al TOP500: petaflop tradizionali, ma l’AI resta fuori classifica
Altro LineShine cinese in vetta al TOP500: petaflop tradizionali, ma l’AI resta fuori classifica 2026-06-24
L’AI Visibility Index di Baden Bower: come l’IA riscrive le regole della visibilità digitale
Market L’AI Visibility Index di Baden Bower: come l’IA riscrive le regole della visibilità digitale 2026-06-22
IEEE lancia un corso virtuale per dominare gli LLM
LLM IEEE lancia un corso virtuale per dominare gli LLM 2026-06-19
Google AI scambia la fan-fiction horror per realtà
LLM Google AI scambia la fan-fiction horror per realtà 2026-06-19
Liquid AI lancia due modelli di embedding multilingue ottimizzati per il retrieval on-premise
LLM Liquid AI lancia due modelli di embedding multilingue ottimizzati per il retrieval on-premise 2026-06-18
Cosa fare con 192 GB di VRAM inattiva: il caso del nodo multi-GPU da riconvertire
Hardware Cosa fare con 192 GB di VRAM inattiva: il caso del nodo multi-GPU da riconvertire 2026-06-18
Distillation di LLM: la sfida del compute per dataset da GLM 5.2
LLM Distillation di LLM: la sfida del compute per dataset da GLM 5.2 2026-06-18
SproutRAG: RAG Gerarchico e Attenzione per la Gestione Efficiente di Documenti Lunghi
Frameworks SproutRAG: RAG Gerarchico e Attenzione per la Gestione Efficiente di Documenti Lunghi 2026-06-18
CaVe-VLM-CoT: Un Framework per VLM Affidabili e Interpretatili
Frameworks CaVe-VLM-CoT: Un Framework per VLM Affidabili e Interpretatili 2026-06-18
Extend.ai presenta un UI kit open source per agenti e RAG documentali
Frameworks Extend.ai presenta un UI kit open source per agenti e RAG documentali 2026-06-17
L'Ascesa dei Large Language Models Locali: Da "Giocattoli" a Strumenti Essenziali
LLM L'Ascesa dei Large Language Models Locali: Da "Giocattoli" a Strumenti Essenziali 2026-06-17
KPMG ritira un rapporto sull'AI: le 'allucinazioni' mettono in discussione l'affidabilità
LLM KPMG ritira un rapporto sull'AI: le 'allucinazioni' mettono in discussione l'affidabilità 2026-06-13
ToolSense: Il framework open source per valutare la comprensione degli LLM sugli strumenti
Frameworks ToolSense: Il framework open source per valutare la comprensione degli LLM sugli strumenti 2026-06-12
OpenAI acquisisce Ona per potenziare Codex e gli agenti persistenti
LLM OpenAI acquisisce Ona per potenziare Codex e gli agenti persistenti 2026-06-12
Deezer introduce un tool per identificare musica generata da AI su piattaforme di streaming
Market Deezer introduce un tool per identificare musica generata da AI su piattaforme di streaming 2026-06-11