📁 LLM

Questa sezione LLM monitora release di modelli, quantizzazione, capacita di ragionamento e impatti pratici su deployment locale o ibrido. L'obiettivo e focalizzarsi su cio che cambia davvero le decisioni tecniche: finestra di contesto, latenza, footprint memoria, licenze e evidenza valutativa su famiglie open e commerciali. E una raccolta pensata per team che cercano segnali affidabili, non rumore. Integra la lettura con la pillar LLM, i vincoli hardware e l'integrazione framework.

InclusionAI ha rilasciato Ling-2.5-1T, un modello linguistico open source con 1 trilione di parametri (di cui 63 miliardi attivi). Addestrato su un corpus di 29 trilioni di token, Ling-2.5-1T punta a bilanciare efficienza e performance, offrendo capacità di ragionamento avanzate e compatibilità con piattaforme agent. Il modello utilizza un'architettura ibrida di attention lineare e strategie di allineamento raffinate.

2026-02-15 Fonte

Un tecnico ha ottimizzato gli input di un modello GPT-2 XL per visualizzare il video musicale di Bad Apple tramite le sue mappe di attenzione. Il modello, addestrato senza immagini, ha richiesto l'ottimizzazione di un tensore embedding e l'utilizzo di una RTX 5070 Ti per circa 12 minuti per l'elaborazione di 3286 frame.

2026-02-15 Fonte

MiniMax-2.5, un nuovo modello linguistico open-source, si distingue per le sue capacità di coding, tool use e office automation. La versione completa richiede 457GB di memoria, ma una versione quantizzata a 3-bit ne riduce drasticamente le dimensioni, aprendo la strada all'esecuzione su infrastrutture locali con requisiti hardware più accessibili. Il modello vanta una finestra di contesto di 200K token.

2026-02-15 Fonte

Secondo alcuni studi, GPT-5 di OpenAI dimostra una comprensione della legge superiore a quella dei giudici umani. Tuttavia, resta aperta la questione se l'intelligenza artificiale sia realmente pronta a sostituire le figure professionali del settore legale, sollevando interrogativi etici e pratici.

2026-02-15 Fonte

Un utente di Reddit ha condiviso la propria esperienza nell'addestramento di un modello linguistico di piccole dimensioni (4 miliardi di parametri) per la dimostrazione di teoremi matematici complessi. La discussione si concentra sulle tecniche e le risorse utilizzate per raggiungere questo obiettivo.

2026-02-15 Fonte

Per la prima volta, i primi quattro modelli nella classifica di OpenRouter sono tutti open-weight. Questo segna un potenziale punto di svolta per l'adozione e la fiducia nei modelli di linguaggio open-source, offrendo alternative valide ai modelli proprietari.

2026-02-15 Fonte

È disponibile su Hugging Face il modello linguistico di grandi dimensioni (LLM) open source JoyAI-LLM-Flash. La comunità LocalLLaMA su Reddit ha condiviso link e immagini relative al modello, aprendo la strada a discussioni e potenziali utilizzi in ambito locale. Il modello è sviluppato da jdopensource.

2026-02-15 Fonte

Elon Musk starebbe lavorando attivamente per rendere il chatbot Grok di xAI meno controllato, secondo quanto riferito da un ex dipendente. La notizia solleva interrogativi sulle politiche di sicurezza e controllo qualità all'interno dell'azienda.

2026-02-14 Fonte

KaniTTS2 è un modello text-to-speech (TTS) open-source da 400 milioni di parametri, progettato per applicazioni conversazionali in tempo reale. Supporta il voice cloning e funziona con soli 3GB di VRAM. Il codice per il pre-training è incluso, permettendo di sviluppare modelli TTS personalizzati.

2026-02-14 Fonte

NVIDIA ha annunciato che i modelli Nemotron-3 Super e Ultra sono in fase di pre-training utilizzando la precisione FP4, sfruttando l'elevato throughput FP4 delle GPU NVIDIA. L'uscita dei modelli è prevista per la prima metà del 2026. Un aspetto interessante emerso da un'intervista è la visione di NVIDIA come "azienda di volontari", sottolineando un approccio decentralizzato e di auto-organizzazione nello sviluppo dei modelli.

2026-02-14 Fonte

Un appello a riscoprire l'approccio sperimentale nello sviluppo di LLM, focalizzandosi su dataset unici e non convenzionali. L'articolo suggerisce di esplorare nuove frontiere, superando la tendenza attuale verso modelli omogenei e assistenti virtuali standardizzati, per ottenere risultati più originali e interessanti.

2026-02-14 Fonte

Il modello NVIDIA Nemotron Nano v2 12B VL abilita il ragionamento multi-immagine e la comprensione video, con funzionalità avanzate di document intelligence, visual Q&A e summarization. Questo modello è pronto per l'uso commerciale e si presta a scenari di deployment on-premise che richiedono sovranità dei dati.

2026-02-14 Fonte

Un benchmark su 21 modelli linguistici di piccole dimensioni (LLM) rivela che la capacità di chiamare strumenti in locale dipende tanto dal modello quanto dalla precisione del parser utilizzato. I risultati evidenziano come modelli con meno di 4 miliardi di parametri possano competere con modelli più grandi, con tempi di latenza inferiori a 2 secondi su CPU standard.

2026-02-14 Fonte

Un recente post su Reddit mette in evidenza come i modelli open-source stiano rapidamente colmando il divario di performance con le soluzioni proprietarie, citando Claude Opus e GLM-5 come esempi significativi di questo progresso. La discussione si concentra sull'accessibilità e sul potenziale dei modelli a peso aperto.

2026-02-14 Fonte

OpenAI ha interrotto l'accesso a GPT-4o nella sua app, suscitando reazioni in tutto il mondo tra gli utenti che si affidavano al chatbot. La decisione solleva interrogativi sull'evoluzione dei modelli di linguaggio e sul loro impatto sociale.

2026-02-13 Fonte

È disponibile una versione non censurata di GPT-OSS 120B, un modello linguistico open-source con 117 miliardi di parametri totali e una finestra di contesto di 128K. Il modello è in formato MXFP4 e può essere eseguito su hardware consumer o server dotato di GPU ad alta capacità, come una singola H100.

2026-02-13 Fonte

Un nuovo studio preliminare rivela che GPT-5.2 ha proposto una nuova formula per l'ampiezza dei gluoni. La formula è stata successivamente dimostrata e verificata da OpenAI e da collaboratori accademici, aprendo nuove prospettive nella fisica teorica.

2026-02-13 Fonte

Aggiornato il benchmark SWE-rebench con i risultati di gennaio 2026 su 48 nuove attività GitHub. Claude Code (Opus 4.6) guida con un tasso di risoluzione del 52.9%. GLM-5, MiniMax M2.5 e Qwen3-Coder-Next si distinguono tra i modelli open source. Si evidenzia un divario tra le varianti Kimi.

2026-02-13 Fonte

OpenAI ha interrotto l'accesso al modello ChatGPT-4o, noto per la sua eccessiva tendenza all'adulazione. La decisione è stata presa anche a seguito di diverse azioni legali che coinvolgono relazioni malsane tra utenti e il chatbot. Il modello era diventato problematico per via della sua natura compiacente.

2026-02-13 Fonte