Topic / Trend Rising

Sicurezza e affidabilità degli agenti AI

Le nuove integrazioni agentiche e basate su MCP ampliano la superficie d'attacco, mentre i giudici LLM non rilevano i guasti silenziosi e i modelli richiedono confini espliciti per l'evidenza. Sicurezza e valutazione diventano centrali nel passaggio dalla chat ad azioni autonome e decisioni critiche.

Detected: 2026-09-07 · Updated: 2026-09-07

Articoli Correlati

2026-09-03 ArXiv cs.CL

Quando tacere è la risposta giusta: addestrare il confine dell'evidenza

Un framework di training insegna ai modelli di QA grounded a rispondere solo quando l'evidenza diventa sufficiente, localizzando il punto esatto in cui l'astensione lascia spazio alla risposta. Su HotpotQA, 2WikiMultiHopQA e MuSiQue, con Qwen2.5-3B-I...

#LLM On-Premise #Fine-Tuning #DevOps
2026-09-02 ArXiv cs.CL

I giudici LLM a esito unico non vedono i guasti silenziosi degli agenti

Uno studio su 400 traiettorie mostra che i giudici LLM basati solo sull'esito rilevano l'84% dei guasti visibili ma solo il 45% di quelli silenziosi e segnalano come errate un terzo delle traiettorie corrette. Un giudice con rubrica per passi arriva ...

#LLM On-Premise #DevOps
2026-09-01 ArXiv cs.AI

DS-Lighting: un harness esplicito per gli agenti data science

DS-Lighting è un toolkit open-source che rende esplicito il harness nell'automazione della data science. Scompone il harness in quattro strati: dati, workflow, esecuzione e valutazione, e rappresenta gli agenti come programmi operatori eseguibili. In...

#Hardware #LLM On-Premise #DevOps
← Torna ai Topic