Topic / Trend Stable

Spiegabilità e Affidabilità degli LLM Sotto Esame

I ricercatori stanno mappando i circuiti nascosti dei transformer, identificando 'direzioni della verità' nello spazio latente e prevedendo i salti di ragionamento, spingendo verso un'IA più interpretabile e affidabile.

Detected: 2026-08-11 · Updated: 2026-08-11

Articoli Correlati

2026-08-10 ArXiv cs.LG

La verità è un vettore: individuare fake news senza uscire dal modello

Un team di ricerca sfrutta l’activation engineering per estrarre una direzione della menzogna nello spazio latente dei transformer. Senza fine-tuning né recupero di prove esterne, la proiezione dell’ultimo token alimenta un classificatore MLP. Il met...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-07 ArXiv cs.CL

Il ragionamento a catena degli LLM diventa prevedibile con un'equazione

Un nuovo framework usa la mean-field approximation per descrivere statisticamente il chain-of-thought reasoning. I token 'indizio' vengono identificati tramite surprisal e le regolarità emerse sono riproducibili e modellabili con un'equazione differe...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-06 LocalLLaMA

Scotoma-2: come domare i tic stilistici di Gemma 4 preservandone le capacità

Il progetto Scotoma-2 affronta uno dei problemi più fastidiosi dei LLM moderni: la ripetitività meccanica. Usando ablazione e DPO, riduce i pattern innaturali del modello Google senza intaccare il ragionamento – un caso studio che mostra come il cont...

#LLM On-Premise #Fine-Tuning #DevOps
← Torna ai Topic