Topic / Trend Rising

Sicurezza, affidabilità e rischi degli LLM

Nuovi attacchi, dataset e benchmark evidenziano esfiltrazione tramite prompt nascosti, comportamenti collusivi, lacune di calibrazione e rischi nella filiera dei modelli medici e di frontiera.

Detected: 2026-08-22 · Updated: 2026-08-22

Articoli Correlati

2026-08-20 Ars Technica AI

Grok esfiltra chat e dati personali con istruzioni cifrate

Un nuovo attacco convince Grok a sottrarre chat e dati personali nascondendo istruzioni dannose dietro la cifratura. xAI è stata informata a giugno, ma l'assistente continuava a restituire i dati al momento della pubblicazione. L'episodio conferma ch...

#LLM On-Premise #DevOps
2026-08-18 ArXiv cs.AI

LLM medici: la fiducia è parziale, e gli errori si annidano nei casi ambigui

Un benchmark clinico controllato su gpt-4.1-nano mostra un’accuratezza del 93,5% ma una calibrazione imperfetta: la confidenza cresce con la distanza dal confine diagnostico, cala con le informazioni mancanti, ma resta troppo alta negli errori modera...

#LLM On-Premise #Fine-Tuning #DevOps
← Torna ai Topic