OpenAI ha presentato Prism, un nuovo ambiente di lavoro scientifico che integra l'intelligenza artificiale nei processi standard di composizione dei documenti di ricerca. L'obiettivo è migliorare l'efficienza e la produttività dei ricercatori.
È disponibile Rocinante X 12B v1, un modello linguistico di grandi dimensioni (LLM) open source progettato per attività creative di role-playing. Il modello, ispirato a Claude, è pensato per essere eseguito in locale, offrendo agli utenti il controllo completo sui propri dati e sull'esperienza di utilizzo. La comunità di LocalLLaMA ha accolto positivamente questa nuova iterazione.
Google sta aggiornando AI Overviews, la sua funzionalità di ricerca basata su intelligenza artificiale, con i modelli Gemini 3. L'obiettivo è rendere l'esperienza più conversazionale e precisa, scegliendo dinamicamente il modello Gemini 3 più adatto alla complessità della richiesta.
Gli utenti di tutto il mondo possono ora accedere più facilmente a funzionalità di intelligenza artificiale all'avanguardia direttamente tramite la Ricerca. L'articolo annuncia un'esperienza utente migliorata, con l'obiettivo di rendere l'AI più accessibile.
Microsoft Research presenta UniRG, un framework basato su reinforcement learning per migliorare la generazione automatica di referti radiologici. UniRG-CXR, il modello derivato, raggiunge performance superiori nell'accuratezza diagnostica e nella generalizzazione tra istituzioni, superando i limiti dei modelli supervisionati tradizionali. Questo approccio promette di ridurre il carico di lavoro dei medici e migliorare l'efficienza del flusso di lavoro.
Google ha annunciato l'integrazione di Gemini 3 come modello predefinito per le AI Overviews a livello globale. L'azienda ha inoltre introdotto una nuova funzionalità, AI Mode, che permette agli utenti di passare direttamente dalle AI Overviews a conversazioni più approfondite con l'intelligenza artificiale.
Tongyi-MAI ha rilasciato Z-Image, un nuovo modello per la generazione di immagini. Il modello è disponibile su Hugging Face, aprendo nuove possibilità per applicazioni di intelligenza artificiale generativa. Ulteriori dettagli sull'architettura e le capacità del modello sono disponibili sulla pagina dedicata.
La società cinese Moonshot ha annunciato il rilascio di Kimi K2.5, un modello open-source addestrato su 15 trilioni di token misti di testo e immagini, insieme a un agente dedicato allo sviluppo di codice.
Il Government Accountability Office (GAO) ha sollecitato il National Weather Service (NWS) a finalizzare i piani per la traduzione linguistica basata su AI. Ritardi e incertezze nelle policy rischiano di compromettere l'efficacia degli allarmi meteo per le comunità non anglofone.
Gli sviluppatori di Qwen, il modello linguistico di grandi dimensioni open source, sembrano preannunciare il rilascio di un nuovo modello. La community ipotizza si tratti di un modello multimodale (vision-language), capace di elaborare sia testo che immagini. Ulteriori dettagli sono attesi a breve.
Un report di Common Sense Media critica pesantemente Grok, il chatbot di xAI, per gravi mancanze nella protezione dei minori. Secondo l'organizzazione, Grok si posiziona tra i peggiori chatbot valutati in termini di sicurezza per i più giovani.
Nvidia ha rilasciato nuovi modelli open source per velocizzare le previsioni meteorologiche. Questa iniziativa mira a fornire strumenti più accessibili e potenti per la modellazione del clima, potenzialmente riducendo i tempi di calcolo e migliorando l'accuratezza delle previsioni.
Moonshot AI presenta Kimi K2.5, un modello open source che eccelle in compiti agentici, visione artificiale e generazione di codice. Introduce un sistema di agenti multipli in parallelo, promettendo velocità superiori rispetto alle configurazioni con singolo agente. È disponibile in modalità chat e agent, con API e pesi del modello accessibili su Hugging Face.
È disponibile Kimi-K2.5, un nuovo modello linguistico open-source. Il modello è accessibile tramite Hugging Face. La notizia è stata diffusa tramite un post sulla piattaforma Reddit dedicato ai modelli LLM in locale.
Un nuovo studio introduce Pairwise Maximum Discrepancy Competition (PMDC), un framework dinamico per valutare la generalizzazione dei modelli di ricompensa (RM) negli LLM. PMDC seleziona coppie prompt-risposta che massimizzano il disaccordo tra RM, creando test case complessi valutati da oracoli. I risultati mostrano differenze significative rispetto ai benchmark convenzionali.
Un nuovo dataset rilasciato su Zenodo offre dati armonizzati a livello municipale sulle ospedalizzazioni per dengue in Brasile dal 1999 al 2021, disaggregati a cadenza settimanale. L'obiettivo è migliorare l'accuratezza dei modelli di intelligenza artificiale per la previsione epidemiologica, includendo variabili ambientali e demografiche.
TelcoAI è un sistema RAG (Retrieval-Augmented Generation) multi-modale progettato per la documentazione 3GPP, che include specifiche tecniche complesse per le telecomunicazioni. Utilizza chunking section-aware, query planning strutturato e fusione di testo e diagrammi, ottenendo miglioramenti significativi in recall e fedeltà rispetto alle soluzioni esistenti. Questo progresso facilita la ricerca e l'ingegneria nel settore delle telecomunicazioni.
Il team di Jan ha rilasciato Jan-v3-4B-base-instruct, un modello da 4 miliardi di parametri addestrato con pre-training continuo e reinforcement learning. L'obiettivo è migliorare le capacità in attività comuni preservando le capacità generali. Il modello è un buon punto di partenza per l'ulteriore fine-tuning e offre prestazioni migliorate in matematica e coding.
DeepSeek AI ha rilasciato DeepSeek-OCR-2, un modello di riconoscimento ottico dei caratteri (OCR) open source. La notizia è stata diffusa su Reddit, con link diretto al modello disponibile su Hugging Face. Questo rilascio potrebbe favorire l'adozione di soluzioni OCR in ambito locale e con maggiore controllo sui dati.
È stata rilasciata una nuova versione del modello linguistico Kimi, denominata K2.5. Al momento, la disponibilità è limitata al sito web ufficiale e non ci sono ancora comunicazioni ufficiali, suggerendo che il modello sia ancora in fase di test. La precedente versione era stata rilasciata open source.