Topic / Trend Rising

Sicurezza e affidabilità dell'IA sotto esame

Dagli errori diagnostici al ragionamento distorto, gli incidenti in cui l'IA fallisce o causa danni alimentano il dibattito su guardrail, trasparenza e limiti delle attuali misure di sicurezza.

Detected: 2026-07-24 · Updated: 2026-07-24

Articoli Correlati

2026-07-24 ArXiv cs.AI

LLM watermarking in medicina: quando la tracciabilità degrada le diagnosi

Uno studio rivela che i watermark su LLM usati in medicina causano allucinazioni, corruzione lessicale ed errori diagnostici. I benchmark standard non rilevano questi guasti, creando un falso senso di sicurezza. Il problema è centrale per chi gestisc...

#LLM On-Premise #Fine-Tuning #DevOps
2026-07-23 ArXiv cs.CL

Rischio cumulativo nei dialoghi LLM: la sicurezza diventa stateful

I guardrail attuali valutano ogni scambio in isolamento, ma i rischi emergono nell’arco di conversazioni multi-turno. Un nuovo framework traccia la deriva semantica e l’accumulo di informazioni sensibili, con implicazioni dirette per il deployment on...

#LLM On-Premise #DevOps
2026-07-20 MIT Technology Review

Gli LLM non ereditano solo i nostri pregiudizi: ora li inventano da soli

Nuovi esperimenti mostrano che modelli come o3 e R1 sviluppano stereotipi occupazionali più forti degli umani già dopo poche assunzioni simulate. Il paradosso è che i modelli più potenti sono anche i più faziosi, e insegnargli a essere “giusti” non b...

#LLM On-Premise #Fine-Tuning #DevOps
2026-07-19 The Next Web

I consigli dell'IA rendono tre volte meno precisi ma due volte più sicuri

Uno studio congiunto di atenei francesi e italiani rivela che avere accesso ai suggerimenti dell'IA riduce la disponibilità ad ammettere l'incertezza dal 44% al 3%, fa crollare l'accuratezza dal 27% al 9% e gonfia la fiducia nelle proprie risposte da...

#Hardware #LLM On-Premise #Fine-Tuning
2026-07-18 LocalLLaMA

catmind-1.2b: quando l'LLM pensa ai gatti e ignora i tuoi prompt

Un esperimento trasforma un modello di reasoning in un narratore di storie feline, facendo crollare l'accuratezza di oltre 50 punti percentuali. Un apparente gioco che però solleva interrogativi concreti sulla stabilità del fine-tuning, sull'uso dei ...

#Hardware #LLM On-Premise #Fine-Tuning
2026-07-17 The Next Web

Meta avviserà i genitori se l'adolescente parla di suicidio con la sua IA

Meta introduce notifiche per i genitori quando un adolescente discute di suicidio o autolesionismo con il suo chatbot AI. Disponibile in USA, UK, Australia e Canada, la funzione sfrutta gli strumenti di supervisione di Instagram. L’iniziativa solleva...

#LLM On-Premise #DevOps
← Torna ai Topic