Topic / Trend Rising

Personalizzazione, interpretabilità e fedeltà comportamentale degli LLM

Gli studi mostrano che i profili comportamentali reali superano le personas sintetiche nel fine-tuning, mentre nuovi lavori esaminano controllo dell'empatia, coerenza semantica e interpretabilità meccanicistica.

Detected: 2026-09-02 · Updated: 2026-09-02

Articoli Correlati

2026-08-27 ArXiv cs.CL

Empatia negli LLM: decodificare una direzione non equivale a controllarla

Uno studio su tre LLM instruction-tuned mostra che una direzione di empatia decodabile produce solo spostamenti parziali negli score automatici. Il controllo positivo passa per l’aspetto affettivo, ma lo strumento cognitivo è troppo grossolano. La ri...

#LLM On-Premise #Fine-Tuning
2026-08-26 IEEE Spectrum

Goodfire apre la scatola nera degli LLM: interpretabilità per tutti

La piattaforma Silico porta a ricercatori e startup gli strumenti di mechanistic interpretability prima riservati a pochi laboratori. Dietro la democratizzazione c’è una scommessa: capire i modelli dall’interno per renderli più sicuri, controllabili ...

#LLM On-Premise #DevOps
← Torna ai Topic