Topic / Trend Rising

Vulnerabilità della sicurezza AI e ricerca sulla robustezza dei modelli

I ricercatori stanno scoprendo nuove superfici di attacco: jailbreak visivi, rischi cumulativi nei dialoghi, allucinazioni indotte da watermark in medicina e limiti strutturali dei Transformer. Questi risultati mettono in discussione l'affidabilità degli LLM in applicazioni critiche.

Detected: 2026-07-29 · Updated: 2026-07-29

Articoli Correlati

2026-07-24 ArXiv cs.AI

LLM watermarking in medicina: quando la tracciabilità degrada le diagnosi

Uno studio rivela che i watermark su LLM usati in medicina causano allucinazioni, corruzione lessicale ed errori diagnostici. I benchmark standard non rilevano questi guasti, creando un falso senso di sicurezza. Il problema è centrale per chi gestisc...

#LLM On-Premise #Fine-Tuning #DevOps
2026-07-23 ArXiv cs.CL

Rischio cumulativo nei dialoghi LLM: la sicurezza diventa stateful

I guardrail attuali valutano ogni scambio in isolamento, ma i rischi emergono nell’arco di conversazioni multi-turno. Un nuovo framework traccia la deriva semantica e l’accumulo di informazioni sensibili, con implicazioni dirette per il deployment on...

#LLM On-Premise #DevOps
← Torna ai Topic