Topic / Trend Stable

Retrieval, RAG ed embedding di dominio

Il retrieval resta un fronte strategico: BM25 supera ancora il dense retrieval su alcune lingue, mentre embedding giuridici specializzati e valutazioni della memoria in stile RENDER affinano le pipeline RAG. L'attenzione si sposta dai benchmark grezzi sugli embedding al formato della memoria, all'adattamento di dominio e al deployment locale.

Detected: 2026-08-28 · Updated: 2026-08-28

Articoli Correlati

2026-08-28 ArXiv cs.LG

Un router semantico nei grafi a proprietà

Un'architettura combina una GNN topologica con un piccolo modello linguistico parametro-efficiente per selezionare e instradare i messaggi nei grafi a proprietà etichettate. L'aggiornamento residuo limitato all'ancora strutturale preserva l'interpret...

#DevOps
2026-08-27 ArXiv cs.LG

GreenLeaf Law Embed Tiny, il retrieval giuridico si fa locale

Un embedding giuridico da 0,6 miliardi di parametri mostra che distillazione, hard negative mining e quantization binaria possono spostare il retrieval legale verso deployment self-hosted. Il dato strutturale non è solo il benchmark, ma la possibilit...

2026-08-27 ArXiv cs.LG

GreenLeaf Law Embed Tiny: un embedding compatto per il retrieval giuridico

GreenLeaf Law Embed Tiny è un modello di embedding da 0,6 miliardi di parametri per il retrieval giuridico. Ottiene il 75,11% su MLEB e il 64,38% su MTEB Law. La pipeline unisce distillazione e fine-tuning con hard negative mining su 3,4 milioni di c...

#LLM On-Premise #Fine-Tuning #DevOps
2026-08-26 ArXiv cs.AI

RENDER: nel RAG, il formato della memoria non è un dettaglio

RENDER introduce un controllo per la valutazione della memoria negli LLM: fissa la conversazione e varia l'artefatto letto dal modello. Su 500 domande LongMemEval e nove modelli, i pacchetti risolti battono il dialogo grezzo troncato di 42,4–72,6 pun...

#LLM On-Premise #Fine-Tuning #DevOps
2026-08-25 ArXiv cs.CL

Khmer, il retrieval semantico premia ancora il vecchio BM25

Uno studio su 3.000 documenti khmer mostra che BM25 supera dense retrieval e query expansion con Qwen2.5. Il modello più grande produce espansioni migliori, ma introduce comunque rumore. Un segnale per chi costruisce ricerca locale a basso costo.

#Hardware #LLM On-Premise #Fine-Tuning
← Torna ai Topic