Un benchmark su 25 pasti mostra che per le calorie non vince il modello più grande
Un test su 25 pasti tratti da Nutrition5k mette a confronto sette LLM multimodali nella stima calorica, con soglia di errore al 20%. Muse Spark 1.3, con pesi aperti, raggiunge il 48%, mentre Qwen 3.8 27B si ferma al 16%. La classifica non segue la ta...