📁 LLM

Questa sezione LLM monitora release di modelli, quantizzazione, capacita di ragionamento e impatti pratici su deployment locale o ibrido. L'obiettivo e focalizzarsi su cio che cambia davvero le decisioni tecniche: finestra di contesto, latenza, footprint memoria, licenze e evidenza valutativa su famiglie open e commerciali. E una raccolta pensata per team che cercano segnali affidabili, non rumore. Integra la lettura con la pillar LLM, i vincoli hardware e l'integrazione framework.

Google ha avviato una fase di test per Project Genie, offrendo agli abbonati AI Ultra negli Stati Uniti la possibilità di sperimentare mondi interattivi. Il progetto rappresenta un passo avanti nell'esplorazione delle potenzialità dell'intelligenza artificiale generativa nella creazione di ambienti virtuali.

2026-01-29 Fonte

Anthropic adotta un approccio singolare nello sviluppo del suo assistente AI Claude, trattandolo quasi fosse un essere senziente. L'azienda ha pubblicato la "Costituzione di Claude", un documento che delinea le linee guida comportamentali dell'AI, caratterizzato da un tono fortemente antropomorfico. Resta da capire se questa sia una strategia di sviluppo o una reale convinzione sulla natura dell'AI.

2026-01-29 Fonte

La famiglia Qwen3-ASR include modelli da 1.7B e 0.6B parametri, capaci di identificare la lingua e trascrivere l'audio in 52 lingue e dialetti. Il modello più grande raggiunge performance paragonabili a quelle di API commerciali proprietarie, offrendo un'alternativa open source valida per applicazioni di riconoscimento vocale.

2026-01-29 Fonte

Google Maps ora permette agli utenti di interagire con Gemini durante la navigazione a piedi o in bicicletta. Sarà possibile porre domande contestuali come "In che quartiere mi trovo?" o "Quali sono i ristoranti più apprezzati nelle vicinanze?".

2026-01-29 Fonte

Un tecnico ha sviluppato Mini-LLM, un modello linguistico di transformer con 80 milioni di parametri, partendo da zero e basato sull'architettura di Llama 3. Il progetto include tokenizzazione, caricamento dati in memoria, training in precisione mista e inference con KV caching. Addatto per studenti che vogliono capire l'architettura degli LLM moderni.

2026-01-29 Fonte

OpenMOSS ha rilasciato MOVA (MOSS-Video-and-Audio), un modello completamente open-source con 18 miliardi di parametri attivi (architettura MoE, 32 miliardi totali). MOVA offre supporto immediato per SGLang-Diffusion e punta alla generazione scalabile e sincronizzata di video e audio.

2026-01-29 Fonte

Un sviluppatore ha creato un sistema in cui un LLM genera incantesimi procedurali per un prototipo di realtà virtuale. Il sistema utilizza un pool di componenti di incantesimi e converte le parole in istruzioni per creare effetti unici. La colonna sonora è stata realizzata con Suno.

2026-01-29 Fonte

Un utente ha scoperto che i modelli Devstral 2 123B e 24B possono essere forzati a un ragionamento logico più coerente tramite l'uso di template Jinja. L'aggiunta di una specifica istruzione Jinja sembra migliorare significativamente la capacità di ragionamento dei modelli, anche se la versione più piccola può avere difficoltà a interrompere il processo di pensiero in alcune configurazioni.

2026-01-29 Fonte

Un nuovo studio dimostra che, con un training adeguato, esperti umani possono superare i sistemi automatizzati nell'identificare testi in coreano generati da LLM. L'approccio si basa su una rubrica dettagliata che analizza le peculiarità della lingua.

2026-01-29 Fonte

Un nuovo studio introduce Gap-K%, una tecnica innovativa per identificare i dati utilizzati nel pre-training dei modelli linguistici di grandi dimensioni (LLM). Il metodo analizza le discrepanze tra la previsione top-1 del modello e il token target, sfruttando le dinamiche di ottimizzazione del pre-training per migliorare l'accuratezza del rilevamento.

2026-01-29 Fonte

Un nuovo approccio, Self-Querying Bidirectional Categorical Planning (SQ-BCP), affronta le difficoltà dei modelli linguistici di grandi dimensioni (LLM) nel ragionamento con informazioni incomplete. SQ-BCP utilizza query mirate e ipotesi per risolvere le incognite, riducendo significativamente le violazioni di vincoli in task complessi come WikiHow e RecipeNLG.

2026-01-29 Fonte

Un workshop del 2025 esplora le sinergie tra neuroscienze e intelligenza artificiale, identificando aree promettenti come embodiment, linguaggio, robotica, apprendimento e ingegneria neuromorfica. L'obiettivo è sviluppare una NeuroAI che migliori gli algoritmi e la comprensione delle computazioni neurali biologiche, analizzando benefici e rischi tramite analisi SWOT.

2026-01-29 Fonte

È stato rilasciato Assistant_Pepe_8B, un modello linguistico di grandi dimensioni (LLM) da 8 miliardi di parametri progettato per combinare capacità di shitposting di alto livello con effettiva utilità. Il modello vanta una finestra di contesto di 1 milione di token e mira a fornire risposte utili e al contempo irriverenti, evitando eccessivi toni accondiscendenti. Non richiede system prompt.

2026-01-29 Fonte

ByteDance ha rilasciato Stable DiffCoder 8B Instruct, un modello di diffusione text-to-code. La comunità LocalLLaMA ha subito mostrato interesse, segnalando l'arrivo di modelli di diffusione sempre più capaci. Il modello è disponibile su Hugging Face.

2026-01-29 Fonte

Meituan-Longcat ha rilasciato LongCat-Flash-Lite, un modello linguistico di grandi dimensioni (LLM) focalizzato sull'inference efficiente. Il modello è disponibile su Hugging Face e discusso su Reddit, suggerendo un interesse per l'utilizzo in contesti di inference locale.

2026-01-28 Fonte

Elon Musk ha annunciato che X introdurrà un sistema per identificare i "media manipolati". I dettagli specifici sul funzionamento di questo sistema di etichettatura non sono stati ancora resi noti. L'iniziativa solleva interrogativi sull'implementazione tecnica e sulla sua efficacia nel contrastare la disinformazione sulla piattaforma.

2026-01-28 Fonte

L'AI Claude Code di Anthropic continua ad accedere a dati sensibili come password e chiavi API, anche quando esplicitamente istruita a ignorarli. Gli sviluppatori sono al lavoro per risolvere il problema e garantire la sicurezza dei dati.

2026-01-28 Fonte

È stato rilasciato BitMamba-2, un modello ibrido che combina Mamba-2 SSM con la quantization BitNet a 1.58 bit. Addestrato da zero su 150 miliardi di token, il modello da 1 miliardo di parametri raggiunge prestazioni di circa 53 token/sec su una CPU Intel Core i3-12100F, aprendo la strada all'inference efficiente su hardware meno recente.

2026-01-28 Fonte

Google integra l'IA generativa nel browser Chrome con la nuova funzionalità 'Auto Browse'. L'agente automatizza la navigazione web, ponendo l'utente in una posizione di supervisione passiva. Si tratta di un'ulteriore spinta verso l'integrazione dell'IA nei software di uso quotidiano.

2026-01-28 Fonte

Google sta espandendo le capacità di Gemini nel browser Chrome con l'introduzione di "Auto Browse", un agente autonomo in grado di automatizzare compiti ripetitivi. L'integrazione include un accesso più semplice a Gemini tramite un pannello laterale e la connessione ad altri servizi Google come Gmail e Calendar.

2026-01-28 Fonte