🏷️ RAG
60 articoli con questo tag · tutti i tag
LLM
NVIDIA Nemotron Parse 2.0: il parsing che legge anche i grafici
2026-08-06
Frameworks
Xberg v1: il framework Rust per un’intelligence documentale davvero locale
2026-08-02
Altro
Da una 5090 a un mini datacenter: la parabola di chi voleva sfuggire alle API
2026-07-30
Frameworks
La memoria degli LLM: un pattern wiki per non dimenticare i vicoli ciechi
2026-07-29
LLM
Piccoli LLM, la vera frontiera on-premise: la comunità tech si interroga sugli usi concreti
2026-07-25
LLM
Solar-Open2: l'LLM MoE a 15B attivi che punta ai carichi agentivi on-premise
2026-07-22
LLM
RIMS: aggregazione morbida per piccoli LLM più precisi nel RAG rumoroso
2026-07-21
Altro
Microsoft: screenshot bloccati per i PDF riservati, ma solo in Edge
2026-07-20
LLM
Cache KV byte-exact su Gemma 4: la conoscenza verificata diventa uno stato ricaricabile
2026-07-19
LLM
Bonsai 27B su iPhone: LLM da 27B in 3,9GB con quantization a 1 bit
2026-07-17
Frameworks
HG-RAG: il retrieval che scala i rami del sapere per un LLM più lucido
2026-07-17
Hardware
TSMC potenzia le fabbriche USA, i progettisti taiwanesi frenano
2026-07-17
LLM
Luciole-23B: la Francia accende un LLM aperto per chi non manda dati fuori casa
2026-07-16
LLM
CANDI-QA smaschera i limiti degli LLM nei settori critici: serve ragionamento simbolico
2026-07-15
Market
AI a token limitati: Mosseri (Meta) profetizza budget capati per ogni sviluppatore
2026-07-14
LLM
Index-1.9B di Bilibili: il piccolo LLM open che insidia i modelli enormi
2026-07-14
Altro
AuditWeave: il registro immodificabile per tracciare le decisioni dell’AI
2026-07-14
Market
Domanda IA quadruplica i ricavi delle memorie a Taiwan: campanello d’allarme per l’on-premise
2026-07-14
Altro
Cloudflare blocca i crawler AI: fine del web aperto anche per i modelli locali
2026-07-13
Hardware
Linux 7.2 abilita UltraRISC nel kernel: un tassello concreto per l'hardware AI aperta
2026-07-12
Frameworks
La fine degli agenti reattivi: il Context Graph porta l’AI enterprise a parlare prima che tu chieda
2026-07-10
Altro
Se paghi già un LLM cloud, embedding e reranker on-premise sono la scelta più produttiva
2026-07-09
Altro
Perplexity prepara un tool di coding AI per sfidare Cursor e Claude Code
2026-07-08
Altro
LLM locali, senza RAG non c'è accuratezza: i numeri di uno sviluppatore
2026-07-08
Altro
Prompt injection: quando i tool AI di massa diventano arsenali per botnet
2026-07-08
Market
Longsys: utili in crescita esplosiva nel 1H26 grazie alla domanda AI di memoria
2026-07-06
Hardware
Phison: l'AI potrebbe mettere fine ai cicli di boom-bust della NAND
2026-07-06
LLM
Un LLM da 270 milioni di parametri nato dal nulla e pensato per l'inference locale
2026-07-05
LLM
LLM locali e carichi agentici: il prefill è tutto, i KV head battono i parametri
2026-07-05
LLM
Gemma 4 31B addestrata per il copywriting: +290 Elo e niente più frasi fatte
2026-07-02
Hardware
Intel avvia il supporto GCC per ACE, le estensioni AI condivise con AMD su x86
2026-07-02
Hardware
SK Hynix mette 51 miliardi sul tavolo per la memoria NAND: la nuova fab M17 è targata AI
2026-07-02
Frameworks
Memora: la memoria scalabile per agenti AI che riduce i token del 98%
2026-06-29
Altro
La NASA porta l'inference LLM a bordo: l'assistente medico per lo spazio profondo
2026-06-29
Altro
Motore NPC locale con LLM leggeri: la scommessa on-premise per gli RPG del futuro
2026-06-28
Altro
L’AI del futuro non sarà guidata solo da modelli migliori
2026-06-27
Altro
LLM on-premise: il workflow che vorresti aver scoperto prima
2026-06-26
Hardware
Se non hai una GPU da data center: strategie per LLM locali senza supercomputer
2026-06-26
LLM
Scaled Cognition raccoglie 100 milioni per un’AI che non allucina
2026-06-25
LLM
Ornith-1.0: nuova famiglia di LLM su Hugging Face, dal dense 9B al MoE 397B
2026-06-25
Hardware
NAND, carenza fino al 2027: Phison avverte, ordini già pieni per il Q2
2026-06-25
Altro
Linux 7.2: la miglioria MGLRU spinge MongoDB fino al +100% di throughput
2026-06-24
Hardware
AMD espone le curve Gamma 2.4 e 2.6 nel driver Linux: più precisione cromatica per le GPU open source
2026-06-24
Altro
Lo strato dati web: la nuova frontiera dell'infrastruttura AI
2026-06-24
Market
Compri raccoglie 3,2 milioni per l'AI procurement: il nodo del deployment on-premise
2026-06-24
Altro
LineShine cinese in vetta al TOP500: petaflop tradizionali, ma l’AI resta fuori classifica
2026-06-24
Market
L’AI Visibility Index di Baden Bower: come l’IA riscrive le regole della visibilità digitale
2026-06-22
LLM
IEEE lancia un corso virtuale per dominare gli LLM
2026-06-19
LLM
Google AI scambia la fan-fiction horror per realtà
2026-06-19
LLM
Liquid AI lancia due modelli di embedding multilingue ottimizzati per il retrieval on-premise
2026-06-18
Hardware
Cosa fare con 192 GB di VRAM inattiva: il caso del nodo multi-GPU da riconvertire
2026-06-18
LLM
Distillation di LLM: la sfida del compute per dataset da GLM 5.2
2026-06-18
Frameworks
SproutRAG: RAG Gerarchico e Attenzione per la Gestione Efficiente di Documenti Lunghi
2026-06-18
Frameworks
CaVe-VLM-CoT: Un Framework per VLM Affidabili e Interpretatili
2026-06-18
Frameworks
Extend.ai presenta un UI kit open source per agenti e RAG documentali
2026-06-17
LLM
L'Ascesa dei Large Language Models Locali: Da "Giocattoli" a Strumenti Essenziali
2026-06-17
LLM
KPMG ritira un rapporto sull'AI: le 'allucinazioni' mettono in discussione l'affidabilità
2026-06-13
Frameworks
ToolSense: Il framework open source per valutare la comprensione degli LLM sugli strumenti
2026-06-12
LLM
OpenAI acquisisce Ona per potenziare Codex e gli agenti persistenti
2026-06-12
Market
Deezer introduce un tool per identificare musica generata da AI su piattaforme di streaming
2026-06-11