Topic / Trend Rising

Modelli e benchmark AI per domini specifici

L'IA sta entrando in domini specializzati come patologia, meteorologia, agricoltura e benchmark clinici o ambientali. Riproducibilità e valutazione di dominio stanno diventando centrali man mano che i modelli generalisti mostrano limiti su compiti reali complessi.

Detected: 2026-08-13 · Updated: 2026-08-13

Articoli Correlati

2026-08-13 ArXiv cs.AI

Distribird porta la calibrazione bayesiana su LLM locali e open-weight

Distribird è un'applicazione agentica che automatizza la costruzione di prior bayesiani dalla letteratura, girando interamente in locale con modelli open-weight. Valutata su 24 parametri in 10 domini, la pipeline multi-agente eguaglia una baseline LL...

#Hardware #LLM On-Premise #DevOps
2026-08-12 ArXiv cs.AI

Guida autonoma per serre: l’LLM riduce energia e tempi del 35–68%

Un sistema a ciclo chiuso, basato su un LLM che elabora i dati di 49 sensori fitotecnicici e comanda luci e microclima, ha ottimizzato in autonomia una vertical farm. Il modello ha ridotto il ciclo produttivo del 35% e scoperto una strategia improbab...

#Hardware #DevOps
2026-08-11 ArXiv cs.CL

LLM e gestione rifiuti: WuYuEval svela i limiti dell'AI generalista

Un benchmark dedicato mette alla prova 33 Large Language Model su compiti di gestione dei rifiuti solidi. Il migliore sfiora il 95% di accuratezza nelle domande semplici, ma in quelle complesse la media crolla al 42,5%. Calcolo, progettazione sperime...

#LLM On-Premise #Fine-Tuning #DevOps
2026-08-07 AI News

PRISM2: l'AI che interpreta i vetrini parlando. Ma la pipeline resta chiusa

Paige e Microsoft rilasciano PRISM2: un'architettura a due fasi che interpreta immagini istopatologiche intere usando il dialogo clinico. Addestrato su oltre 2 milioni di vetrini, raggiunge performance vicine ai prodotti clinici per cancro a prostata...

#LLM On-Premise #Fine-Tuning #DevOps
← Torna ai Topic