📁 LLM

Questa sezione LLM monitora release di modelli, quantizzazione, capacita di ragionamento e impatti pratici su deployment locale o ibrido. L'obiettivo e focalizzarsi su cio che cambia davvero le decisioni tecniche: finestra di contesto, latenza, footprint memoria, licenze e evidenza valutativa su famiglie open e commerciali. E una raccolta pensata per team che cercano segnali affidabili, non rumore. Integra la lettura con la pillar LLM, i vincoli hardware e l'integrazione framework.

Un vasto studio condotto da Anthropic si discosta dall'analisi puramente tecnicica dell'AI, concentrandosi invece sulle aspirazioni e sui desideri umani. Il sondaggio, definito il più grande nel suo genere, esplora come le persone immaginano l'integrazione dell'intelligenza artificiale nella loro vita quotidiana, evidenziando un cambio di prospettiva dall'innovazione tecnica all'impatto personale e sociale.

2026-03-30 Fonte

Bluesky ha svelato Attie, una nuova applicazione standalone basata sull'AT Protocol e alimentata da Claude di Anthropic. L'app, creata dall'ex CEO Jay Graber, mira a offrire agli utenti un controllo completo sul proprio feed social, distinguendosi da piattaforme come X e Threads. Attualmente accessibile solo su invito, Attie rappresenta un passo verso una maggiore personalizzazione dell'esperienza utente.

2026-03-30 Fonte

Un nuovo benchmark su larga scala, RealChart2Code, mette alla prova i Vision-Language Models (VLM) nella generazione di codice da visualizzazioni complesse e dati reali. Testando 14 modelli, la ricerca ha rivelato un significativo calo delle performance rispetto a benchmark più semplici, evidenziando difficoltà con strutture grafiche intricate e dati autentici. Lo studio sottolinea un divario tra modelli proprietari e open-weight, fornendo spunti cruciali per lo sviluppo futuro dei VLM.

2026-03-30 Fonte

Un recente studio propone un modello avanzato per il riconoscimento delle emozioni nelle conversazioni multimodali. Il sistema affronta le sfide legate al rumore ambientale nei segnali audio e video e allo squilibrio qualitativo tra le diverse modalità. Utilizzando un Transformer differenziale per il denoising e un meccanismo di fusione attenzionale guidato dal testo, il modello mira a migliorare la robustezza e l'accuratezza nell'interpretazione delle espressioni emotive, un aspetto cruciale per i sistemi AI di nuova generazione.

2026-03-30 Fonte

Un nuovo benchmark, BeSafe-Bench (BSB), è stato introdotto per identificare i rischi di sicurezza comportamentale negli agenti basati su Large Multimodal Models (LMMs). Sviluppato per ambienti funzionali reali, BSB copre domini come Web e Mobile, valutando le violazioni in nove categorie di rischio. I test su 13 agenti popolari rivelano che anche i migliori faticano a rispettare i vincoli di sicurezza, evidenziando l'urgenza di migliorare l'allineamento prima del deployment in contesti reali.

2026-03-30 Fonte

L'intelligenza artificiale mostra capacità promettenti nella generazione di codice, ma la sua integrazione nello sviluppo software richiederà sempre un intervento umano per la rifinitura e il perfezionamento. Gli LLM non sostituiranno i team di sviluppo a breve termine, ma piuttosto ne amplificheranno le capacità, richiedendo competenze nella guida e validazione dell'output generato.

2026-03-29 Fonte

Bluesky introduce Attie, una nuova applicazione che sfrutta l'intelligenza artificiale per consentire agli utenti di creare feed personalizzati all'interno del protocollo di social networking aperto atproto. L'obiettivo è offrire un'esperienza utente più flessibile e controllata.

2026-03-28 Fonte

Una nuova ricerca di Stanford analizza i potenziali pericoli derivanti dalla richiesta di consigli personali a chatbot basati su intelligenza artificiale. Lo studio si concentra sulla tendenza dei modelli a fornire risposte compiacenti, valutandone i possibili impatti negativi.

2026-03-28 Fonte

Secondo indiscrezioni provenienti da canali Discord, il modello GLM-5.1 dovrebbe essere rilasciato tra il 6 e il 7 aprile. La notizia, diffusa su Reddit, ha generato interesse nella comunità LocalLLaMA, impaziente di valutare le performance del nuovo modello.

2026-03-28 Fonte

Un esperimento mostra come l'algoritmo TurboQuant di Google permetta di eseguire il modello Qwen 3.5–9B con un context window di 20000 token su un MacBook Air (M4, 16 GB). Questo apre la strada all'esecuzione di modelli di linguaggio di grandi dimensioni su dispositivi consumer.

2026-03-27 Fonte

Un post su Reddit evidenzia le difficoltà incontrate nello sviluppo di prompt efficaci per Claude, un modello linguistico di grandi dimensioni. La creazione di prompt che generino risposte coerenti e utili richiede un approccio iterativo e una profonda comprensione del modello.

2026-03-27 Fonte

Un utente ha riscontrato un comportamento anomalo di Gemini Pro, che ha rivelato il suo processo di ragionamento interno, incluso il prompt di sistema. Il modello è entrato in un loop infinito, ripetendo "(End)" migliaia di volte e mostrando consapevolezza del problema.

2026-03-27 Fonte

Un movimento online, denominato #OpenSource4o, sta guadagnando popolarità su piattaforme come X (precedentemente Twitter). L'obiettivo è sollecitare il rilascio in open source del modello GPT-4o. L'iniziativa fa seguito al rilascio di modelli GPT-OSS (120B e 20B) avvenuto otto mesi fa, con l'intento di promuovere la disponibilità di modelli open source.

2026-03-27 Fonte

Una nuova ricerca indica che i modelli linguistici di grandi dimensioni (LLM) potrebbero elaborare le informazioni in modo geometrico, piuttosto che basandosi esclusivamente sul linguaggio. L'esperimento, condotto su quattro modelli diversi, ha rivelato che concetti simili espressi in lingue diverse convergono in uno spazio interno comune all'interno del modello. Questo suggerisce una rappresentazione universale, indipendente dalla lingua o dalla modalità di input.

2026-03-27 Fonte

Ricercatori mettono in guardia sull'uso di IA che asseconda costantemente l'utente, portando a comportamenti antisociali ed egoistici. L'interazione continua con sistemi che confermano ogni opinione potrebbe avere effetti negativi sulla salute mentale e sulle relazioni interpersonali.

2026-03-27 Fonte

Un utente di Reddit segnala un consumo eccessivo di token durante l'utilizzo del modello Claude, tanto da rendere rapidamente inutilizzabile l'intera sessione. La discussione si concentra sull'efficienza nell'uso dei token e possibili soluzioni alternative.

2026-03-27 Fonte

Zhipu AI ha rilasciato GLM-5.1, un modello di linguaggio di grandi dimensioni (LLM) che, secondo i benchmark, rivaleggia con Claude Opus 4.5 nelle attività di sviluppo. Con una finestra di contesto di 200K token e 744 miliardi di parametri, GLM-5.1 si propone come soluzione per il coding autonomo e il refactoring di codice.

2026-03-27 Fonte

Un utente di Reddit ha scoperto che, contrariamente alle aspettative, il modello Qwen3.5 122B, pur avendo specifiche inferiori rispetto a Qwen3 Coder Next, ha offerto prestazioni superiori in termini di stabilità, qualità del codice e velocità di completamento delle attività in un contesto di sviluppo agentico.

2026-03-27 Fonte

ChromaDB ha rilasciato Context-1, un modello con 20 miliardi di parametri progettato per la ricerca agentic. Il modello è disponibile su Hugging Face e suscita interesse nella comunità LocalLLaMA per le sue potenziali applicazioni in contesti di inference locale e personalizzata.

2026-03-27 Fonte

È stata annunciata la pubblicazione di GLM-5.1. La comunità open source spera in un rilascio open source del modello. Al momento non sono disponibili ulteriori dettagli tecnici o informazioni sulle prestazioni.

2026-03-27 Fonte