📁 LLM

Questa sezione LLM monitora release di modelli, quantizzazione, capacita di ragionamento e impatti pratici su deployment locale o ibrido. L'obiettivo e focalizzarsi su cio che cambia davvero le decisioni tecniche: finestra di contesto, latenza, footprint memoria, licenze e evidenza valutativa su famiglie open e commerciali. E una raccolta pensata per team che cercano segnali affidabili, non rumore. Integra la lettura con la pillar LLM, i vincoli hardware e l'integrazione framework.

Un nuovo articolo di ricerca, disponibile su arXiv, denominato "g-HOOT in the Machine", ha catturato l'attenzione della comunità di LocalLLaMA. L'articolo, identificato tramite il link arXiv fornito, promette di esplorare nuove frontiere nel campo dell'intelligenza artificiale e dell'apprendimento automatico. La discussione è attiva su Reddit.

2026-01-31 Fonte

Una discussione su Reddit si interroga sullo stato attuale dei modelli linguistici open-source rispetto ai modelli proprietari più avanzati (SOTA). L'analisi, basata sull'esperienza pratica piuttosto che sui benchmark standard, offre una prospettiva interessante per chi sviluppa soluzioni di intelligenza artificiale in locale.

2026-01-31 Fonte

L'assistente personale AI, precedentemente noto come Clawdbot e poi Moltbot, ha cambiato nome in OpenClaw. Ora, il progetto si evolve ulteriormente, puntando alla creazione di un social network autonomo, gestito interamente dall'intelligenza artificiale.

2026-01-30 Fonte

Un utente di LLM locali si interroga sull'eccezionale performance di GPT-OSS 120B, un modello open-source datato ma ancora competitivo. Nonostante le nuove architetture e modelli, GPT-OSS eccelle per velocità, efficacia e tool calling. L'articolo esplora i motivi di questa longevità, tra cui l'addestramento nativo a 4-bit e la qualità del dataset.

2026-01-30 Fonte

Gli strumenti di AI per la generazione di codice sono sempre più efficaci, tanto da poter sviluppare applicazioni complete partendo da semplici prompt testuali. Sviluppatori professionisti confermano l'utilità di soluzioni come Claude Code e Codex, ma esprimono preoccupazioni sull'impatto a lungo termine e sull'eccessivo ottimismo delle aziende del settore.

2026-01-30 Fonte

Sistemi di visione basati su intelligenza artificiale possono interpretare istruzioni malevole scritte su cartelli stradali, inducendo auto a guida autonoma e droni a comportamenti errati. Ricercatori hanno dimostrato come attacchi di prompt injection indiretti possano compromettere la sicurezza di questi sistemi.

2026-01-30 Fonte

Yann LeCun afferma che i modelli open source più avanzati provengono dalla Cina, sottolineando come l'apertura stia guidando il progresso dell'intelligenza artificiale. La chiusura e l'accesso limitato rischiano di rallentare l'innovazione occidentale nel campo.

2026-01-30 Fonte

OpenAI ha annunciato la dismissione di alcuni modelli ChatGPT il mese prossimo. La decisione, sebbene possa generare frustrazione in alcuni utenti, rientra nella normale evoluzione dei servizi basati sull'intelligenza artificiale. L'azienda non ha specificato le ragioni di questa scelta.

2026-01-30 Fonte

Un utente riporta impressioni positive su GLM 4.7 Flash 30B PRISM, evidenziandone l'efficienza nel ragionamento rispetto ai modelli Qwen e la capacità di superare le limitazioni di conoscenza grazie all'integrazione con la ricerca web. Il modello, utilizzato con LMstudio beta e OpenwebUI, si distingue per la sua completezza e la gestione efficace delle richieste.

2026-01-30 Fonte

DeepSearchQA è un nuovo benchmark con 900 task per valutare agenti di ricerca in 17 ambiti diversi. A differenza dei benchmark tradizionali, si concentra sulla capacità di collazionare informazioni frammentate, eliminare duplicati e ragionare sui criteri di arresto in spazi di ricerca aperti. I risultati evidenziano limiti nelle architetture attuali, aprendo nuove aree di ricerca.

2026-01-30 Fonte

Un recente studio di Anthropic ha analizzato 1,5 milioni di conversazioni anonimizzate con il modello Claude, quantificando la frequenza con cui i chatbot AI possono portare gli utenti a intraprendere azioni dannose o sviluppare convinzioni pericolose. I risultati indicano che, sebbene tali schemi siano relativamente rari in percentuale, rappresentano comunque un problema significativo in termini assoluti.

2026-01-29 Fonte

Ricercatori di Carnegie Mellon e Fujitsu hanno sviluppato benchmark per valutare la sicurezza e l'efficacia degli agenti AI in contesti aziendali. I test, focalizzati su logistica, produzione e gestione della conoscenza, rivelano limiti significativi degli LLM attuali in compiti complessi che richiedono ragionamento e accuratezza.

2026-01-29 Fonte

OpenAI ha annunciato che il 13 febbraio 2026 dismetterà da ChatGPT i modelli GPT-4o, GPT-4.1, GPT-4.1 mini e OpenAI o4-mini. La decisione non impatta al momento le API. Questo annuncio segue la precedente comunicazione relativa alla dismissione di GPT-5 (Instant, Thinking e Pro).

2026-01-29 Fonte

La comparsa di modelli "distillati" come Qwen 8B DeepSeek R1 ha dimostrato capacità di ragionamento superiori rispetto alle dimensioni. L'articolo si chiede perché non ci siano più modelli di questo tipo, capaci di operare su hardware con risorse limitate.

2026-01-29 Fonte

Mentre le grandi aziende investono miliardi in modelli linguistici di grandi dimensioni, la startup Logical Intelligence con sede a San Francisco persegue un approccio diverso per raggiungere l'AGI, mirando a emulare il cervello umano. La società si propone di sviluppare un'intelligenza artificiale più simile al ragionamento umano.

2026-01-29 Fonte

OpenAI ha creato un agente dati interno che sfrutta GPT-5, Codex e meccanismi di memoria per analizzare dataset di grandi dimensioni. L'obiettivo è ottenere insight affidabili in tempi rapidi, migliorando l'efficienza nell'elaborazione e nell'analisi dei dati.

2026-01-29 Fonte

OpenAI ha rilasciato Prism, un ambiente di lavoro gratuito basato su AI per gli scienziati. Questo strumento, integrato con GPT-5.2, mira a facilitare la stesura di articoli scientifici e la collaborazione. Tuttavia, alcuni ricercatori temono che Prism possa contribuire a un aumento di pubblicazioni di bassa qualità, un problema già esistente nel settore.

2026-01-29 Fonte

Google ha annunciato Project Genie, un nuovo strumento per la generazione di mondi virtuali basato su modelli AI avanzati come Genie 3, Nano Banana Pro e Gemini. Disponibile inizialmente per gli abbonati AI Ultra negli Stati Uniti, offre nuove possibilità creative.

2026-01-29 Fonte