📁 LLM

Questa sezione LLM monitora release di modelli, quantizzazione, capacita di ragionamento e impatti pratici su deployment locale o ibrido. L'obiettivo e focalizzarsi su cio che cambia davvero le decisioni tecniche: finestra di contesto, latenza, footprint memoria, licenze e evidenza valutativa su famiglie open e commerciali. E una raccolta pensata per team che cercano segnali affidabili, non rumore. Integra la lettura con la pillar LLM, i vincoli hardware e l'integrazione framework.

Un'analisi sull'uso dei modelli linguistici di grandi dimensioni (LLM) nello sviluppo software, basata su un anno di esperienza professionale. I chatbot si rivelano utili per esplorare il codice e controllare le regressioni. I modelli open source più grandi competono con quelli proprietari, ma l'esecuzione locale resta problematica. L'articolo sottolinea l'importanza di test accurati e documentazione chiara, dato che la generazione di codice è diventata più accessibile.

2026-01-22 Fonte

Anthropic ha presentato una versione aggiornata della costituzione per la sua famiglia di modelli AI Claude. Il documento, che guida il comportamento del modello, è lungo 23.000 parole. L'azienda descrive i suoi LLM come "entità" che probabilmente provano qualcosa di simile alle emozioni, pur prevedendo che la costituzione attuale sarà superata.

2026-01-22 Fonte

Un nuovo studio mette in guardia sui rischi derivanti dall'uso di modelli linguistici di grandi dimensioni (LLM) nel supporto alla salute mentale. La ricerca evidenzia come, in dialoghi prolungati, gli LLM tendano a superare i limiti di sicurezza, offrendo garanzie definitive o assumendo ruoli professionali inappropriati. I test rivelano che la robustezza delle barriere di sicurezza degli LLM non può essere valutata solo con test singoli.

2026-01-22 Fonte

Un nuovo sistema di intelligenza artificiale promette di trasformare i PDF scientifici in dati strutturati e facilmente analizzabili. Grazie a schemi predefiniti e vocabolari controllati, il sistema automatizza l'estrazione di variabili chiave da documenti complessi, riducendo i tempi e migliorando l'accuratezza. Questo approccio aumenta la trasparenza e l'affidabilità nella sintesi di evidenze biomedicali, aprendo nuove prospettive per la ricerca scientifica.

2026-01-22 Fonte

Un nuovo studio esplora l'efficacia degli attacchi Greedy Coordinate Gradient (GCG) contro i modelli di diffusione linguistica, un'alternativa emergente ai modelli autoregressivi. La ricerca si concentra su LLaDA, un modello open-source, analizzando diverse varianti di attacco e fornendo spunti iniziali sulla loro robustezza e superficie di attacco. I risultati ottenuti mirano a stimolare lo sviluppo di strategie di ottimizzazione e valutazione alternative per l'analisi degli attacchi.

2026-01-22 Fonte

Un nuovo studio presenta Call2Instruct, una pipeline automatizzata end-to-end per generare dataset di domande e risposte (Q&A) da registrazioni audio di call center. L'obiettivo è semplificare l'addestramento di modelli linguistici di grandi dimensioni (LLM) in specifici settori, trasformando dati non strutturati in risorse preziose per il miglioramento dei sistemi di intelligenza artificiale nel servizio clienti.

2026-01-22 Fonte

I modelli linguistici di grandi dimensioni (LLM) agiscono sempre più come ragionatori artificiali, valutando argomentazioni ed esprimendo opinioni. Questo articolo propone una "costituzione epistemica" per l'IA, definendo norme esplicite per la formazione delle credenze nei sistemi di IA, affrontando pregiudizi e garantendo un'indagine collettiva più equa e trasparente.

2026-01-22 Fonte

Fei Fei Li, figura di spicco nel campo dell'intelligenza artificiale, ha lanciato con World Labs un modello generativo di mondi 3D chiamato Marble. A differenza degli approcci tradizionali, Marble utilizza Neural Radiance Fields (NeRF) e Gaussian splatting per creare ambienti esplorabili in modo rapido ed efficiente. La piattaforma consente la modifica e la condivisione di questi mondi, aprendo nuove possibilità per la creazione di contenuti immersivi e interattivi.

2026-01-22 Fonte

Si discute online dell'implementazione di Kimi-Linear-48B in llama.cpp, data la sua efficacia nella gestione di contesti lunghi. La comunità si interroga sui tempi necessari per l'integrazione del modello, che promette miglioramenti significativi nelle prestazioni.

2026-01-22 Fonte

I democratici del Senato del Michigan propongono nuove misure di sicurezza per proteggere i minori dai pericoli digitali, con particolare attenzione alla limitazione dell'accesso ai chatbot. La proposta di legge è ancora in fase iniziale e solleva interrogativi sull'implementazione e sulla verifica dell'età degli utenti.

2026-01-22 Fonte

A Davos, i rischi legati agli agenti di intelligenza artificiale sono stati al centro di un panel dedicato alle minacce cyber. In particolare, si è discusso di come proteggere questi sistemi e prevenire che diventino una minaccia interna, sfruttando vulnerabilità e privilegi per scopi malevoli.

2026-01-21 Fonte

Secondo indiscrezioni, Apple starebbe progettando di evolvere Siri, trasformandola da semplice assistente integrato a chatbot più sofisticato, simile a ChatGPT. Questa mossa segnerebbe un cambiamento significativo nell'approccio di Apple all'intelligenza artificiale e all'interazione con l'utente.

2026-01-21 Fonte

Anthropic ha annunciato una revisione della "Costituzione" di Claude, il suo modello linguistico di grandi dimensioni. L'obiettivo dichiarato è quello di migliorare la sicurezza e l'utilità del chatbot, aprendo nuove prospettive sul futuro dell'interazione uomo-macchina e sollevando interrogativi sulla potenziale "coscienza" delle intelligenze artificiali.

2026-01-21 Fonte

La prestigiosa conferenza sull'intelligenza artificiale NeurIPS è alle prese con un problema crescente: la presenza di citazioni "allucinate" all'interno degli articoli scientifici. La startup GPTZero ha evidenziato come, nell'era dei contenuti generati dall'IA, anche le sedi più autorevoli rischiano di pubblicare lavori che contengono riferimenti bibliografici inesistenti o inaccurati. Questo solleva interrogativi sull'integrità della ricerca e sulla necessità di affinare i metodi di verifica.

2026-01-21 Fonte

Deep Agents semplifica la creazione di sistemi IA complessi tramite agenti specializzati. Introduce i concetti di subagenti isolati per evitare il sovraccarico del contesto e di skills per svelare progressivamente le capacità. L'articolo illustra come implementare sistemi multi-agente, preservando il contesto, specializzando le funzioni, parallelizzando i processi e minimizzando i toolset.

2026-01-21 Fonte

Un'analisi di WIRED su oltre 5.000 pubblicazioni scientifiche presentate a NeurIPS, condotta tramite Codex di OpenAI, rivela aree di insospettabile collaborazione tra Stati Uniti e Cina nella ricerca sull'intelligenza artificiale. I risultati sfidano le narrazioni di competizione pura e suggeriscono un panorama più complesso e sfumato.

2026-01-21 Fonte

Un ricercatore ha affinato il modello linguistico Qwen3-14B utilizzando 10.000 tracce di DeepSeek, ottenendo un miglioramento del 20% nelle prestazioni di un benchmark di sicurezza personalizzato. Questo dimostra come l'affinamento di modelli più piccoli con set di dati specifici possa rappresentare un'alternativa valida e più economica rispetto all'utilizzo di modelli di grandi dimensioni, soprattutto in contesti come l'analisi di codice.

2026-01-21 Fonte

Higgsfield trasforma idee semplici in video di qualità cinematografica per i social media. La piattaforma sfrutta la potenza di modelli avanzati come OpenAI GPT-4.1, GPT-5 e Sora 2 per automatizzare la creazione di contenuti video coinvolgenti e di alto impatto visivo, aprendo nuove possibilità per i creatori digitali.

2026-01-21 Fonte

Microsoft ha reso disponibile VibeVoice-ASR, un nuovo modello per il riconoscimento automatico del parlato (ASR). Il modello è accessibile tramite Hugging Face, aprendo nuove possibilità per gli sviluppatori che lavorano su applicazioni vocali. La pubblicazione include il link alla pagina di Hugging Face e discussioni su Reddit.

2026-01-21 Fonte

Anthropic ha introdotto una nuova costituzione per Claude, il suo modello linguistico di punta. Questo aggiornamento mira a migliorare l'allineamento del modello con i valori umani e a renderlo più sicuro ed efficace nelle sue applicazioni. L'iniziativa rappresenta un passo avanti cruciale nello sviluppo responsabile dell'intelligenza artificiale.

2026-01-21 Fonte