🏷️ Fine-Tuning

60 articoli con questo tag · tutti i tag

Doom dentro un LLM: 34 GB di checkpoint e rendering via token
Hardware Doom dentro un LLM: 34 GB di checkpoint e rendering via token 2026-08-13
Writer punta sul contenimento dei costi token con un nuovo LLM basato su GLM-5.2
LLM Writer punta sul contenimento dei costi token con un nuovo LLM basato su GLM-5.2 2026-08-13
Qwen apre il countdown ufficiale per Qwen3.8-27B su Hugging Face
LLM Qwen apre il countdown ufficiale per Qwen3.8-27B su Hugging Face 2026-08-13
Nvidia raddoppia la RTX PRO 6000 Blackwell: on-premise più caro
Hardware Nvidia raddoppia la RTX PRO 6000 Blackwell: on-premise più caro 2026-08-13
Retrofit ricorrente nei LLM: pensiero latente più veloce, ma con confini netti
LLM Retrofit ricorrente nei LLM: pensiero latente più veloce, ma con confini netti 2026-08-13
Backtrader-Bench: il benchmark che costringe gli LLM a eseguire codice
Frameworks Backtrader-Bench: il benchmark che costringe gli LLM a eseguire codice 2026-08-13
Allarme sicurezza IA: ad Ai4 Hinton, Li e Ng discutono il valore dell'apertura
Altro Allarme sicurezza IA: ad Ai4 Hinton, Li e Ng discutono il valore dell'apertura 2026-08-12
Linux sblocca la grafica ibrida sui MacBook Pro 2018-19: un vantaggio (anche) per chi fa inference locale
Hardware Linux sblocca la grafica ibrida sui MacBook Pro 2018-19: un vantaggio (anche) per chi fa inference locale 2026-08-12
Decifrati i ragionamenti segreti di Claude e GPT: cosa cambia
Altro Decifrati i ragionamenti segreti di Claude e GPT: cosa cambia 2026-08-12
LACT 0.10: overclock NVIDIA e sensori Blackwell per chi spinge le GPU Linux
Hardware LACT 0.10: overclock NVIDIA e sensori Blackwell per chi spinge le GPU Linux 2026-08-12
L’UE impone la filigrana anche ai modelli locali: cosa cambia per l’AI open source
Altro L’UE impone la filigrana anche ai modelli locali: cosa cambia per l’AI open source 2026-08-12
LLM Agents Factory: la fabbrica di agenti che riduce i costi di inference
Frameworks LLM Agents Factory: la fabbrica di agenti che riduce i costi di inference 2026-08-12
Reti neurali random più robuste: il fuzzy intuitionistico contro dati rumorosi
Frameworks Reti neurali random più robuste: il fuzzy intuitionistico contro dati rumorosi 2026-08-12
Come la topologia svela l'evoluzione interna dei Transformer
LLM Come la topologia svela l'evoluzione interna dei Transformer 2026-08-12
Unsloth Desktop porta il training in locale: 2× più veloce, 70% VRAM in meno
Altro Unsloth Desktop porta il training in locale: 2× più veloce, 70% VRAM in meno 2026-08-11
Luth-2, i piccoli LLM francesi che surclassano modelli tre volte più grandi
LLM Luth-2, i piccoli LLM francesi che surclassano modelli tre volte più grandi 2026-08-11
LLM e gestione rifiuti: WuYuEval svela i limiti dell'AI generalista
LLM LLM e gestione rifiuti: WuYuEval svela i limiti dell'AI generalista 2026-08-11
Fuzzing adattivo svela le crepe delle MLLM: perché l’allucinazione resiste ai benchmark statici
Frameworks Fuzzing adattivo svela le crepe delle MLLM: perché l’allucinazione resiste ai benchmark statici 2026-08-11
Addestrare un LLM da 1B con 200$: la frontiera del self-hosted accessibile
LLM Addestrare un LLM da 1B con 200$: la frontiera del self-hosted accessibile 2026-08-11
Linux: il driver open-source NVIDIA ‘Nova’ guadagna funzionalità con Rust
Hardware Linux: il driver open-source NVIDIA ‘Nova’ guadagna funzionalità con Rust 2026-08-11
Ling-3.0-tiny: 8B parametri, 1.3B attivi e inference a 100 token/s sul MacBook
Altro Ling-3.0-tiny: 8B parametri, 1.3B attivi e inference a 100 token/s sul MacBook 2026-08-10
Muse-Glimmer-30B in GGUF: l'ultimo tassello di un ecosistema locale sempre più maturo
LLM Muse-Glimmer-30B in GGUF: l'ultimo tassello di un ecosistema locale sempre più maturo 2026-08-10
Meta Muse Glimmer: agenti AI locali su GPU consumer, il nuovo modello da 30 miliardi di parametri
LLM Meta Muse Glimmer: agenti AI locali su GPU consumer, il nuovo modello da 30 miliardi di parametri 2026-08-10
Muse Glimmer di Meta: l'agente locale open-weight da 30B che sfida il cloud
LLM Muse Glimmer di Meta: l'agente locale open-weight da 30B che sfida il cloud 2026-08-10
Niente cloud, solo edge: Edgify alza 9 milioni per l’AI che impara sui dispositivi
Altro Niente cloud, solo edge: Edgify alza 9 milioni per l’AI che impara sui dispositivi 2026-08-10
TEXAS usa il routing nativo dei MoE per un fine-tuning più chirurgico
LLM TEXAS usa il routing nativo dei MoE per un fine-tuning più chirurgico 2026-08-10
La verità è un vettore: individuare fake news senza uscire dal modello
LLM La verità è un vettore: individuare fake news senza uscire dal modello 2026-08-10
WeatherNext 2: DeepMind porta le previsioni dei cicloni su una singola GPU H100
Hardware WeatherNext 2: DeepMind porta le previsioni dei cicloni su una singola GPU H100 2026-08-09
BDH: scalabilità GPT-2 su GPU normali, la sfida post-transformer di Pathway
LLM BDH: scalabilità GPT-2 su GPU normali, la sfida post-transformer di Pathway 2026-08-09
Kimi K3 scende a 478 GB: la sforbiciata multilingua che cambia i conti dell’on-premise
LLM Kimi K3 scende a 478 GB: la sforbiciata multilingua che cambia i conti dell’on-premise 2026-08-09
PRISM2: l'AI che interpreta i vetrini parlando. Ma la pipeline resta chiusa
LLM PRISM2: l'AI che interpreta i vetrini parlando. Ma la pipeline resta chiusa 2026-08-07
AMD lancia Spur: scheduling Rust-native per GPU cluster ROCm
Altro AMD lancia Spur: scheduling Rust-native per GPU cluster ROCm 2026-08-07
Il ragionamento a catena degli LLM diventa prevedibile con un'equazione
LLM Il ragionamento a catena degli LLM diventa prevedibile con un'equazione 2026-08-07
CRAFTER: l'agente che raddoppia i miglioramenti senza toccare il modello
Frameworks CRAFTER: l'agente che raddoppia i miglioramenti senza toccare il modello 2026-08-07
MS-MLB, un benchmark aperto per la sclerosi multipla che sfida la riproducibilità
Frameworks MS-MLB, un benchmark aperto per la sclerosi multipla che sfida la riproducibilità 2026-08-07
NVIDIA porta lo stack vocale in locale: ASR, TTS e codec ora girano on-device
Altro NVIDIA porta lo stack vocale in locale: ASR, TTS e codec ora girano on-device 2026-08-06
Scotoma-2: come domare i tic stilistici di Gemma 4 preservandone le capacità
LLM Scotoma-2: come domare i tic stilistici di Gemma 4 preservandone le capacità 2026-08-06
Nscale e Pure Data Centres guidano la concentrazione: il 66% del capitale UK vola sull'infrastruttura AI
Market Nscale e Pure Data Centres guidano la concentrazione: il 66% del capitale UK vola sull'infrastruttura AI 2026-08-06
Modal Labs apre ufficio a Londra: l’inference AI si avvicina all’Europa
Market Modal Labs apre ufficio a Londra: l’inference AI si avvicina all’Europa 2026-08-06
RTX 5090 e AI fai-da-te: addestramento locale, il nuovo laboratorio dei pionieri digitali
Hardware RTX 5090 e AI fai-da-te: addestramento locale, il nuovo laboratorio dei pionieri digitali 2026-08-06
Il latino parla ai LLM: trionfo nel transfer learning, ma la sovranità dei dati resta muta
LLM Il latino parla ai LLM: trionfo nel transfer learning, ma la sovranità dei dati resta muta 2026-08-06
Denial WM: Flutter e Wayland si incontrano in un compositor Rust per Arch Linux
Frameworks Denial WM: Flutter e Wayland si incontrano in un compositor Rust per Arch Linux 2026-08-05
Frore: il LiquidJet raffredda del 10% le GPU Nvidia Rubin, prestazioni +15%
Hardware Frore: il LiquidJet raffredda del 10% le GPU Nvidia Rubin, prestazioni +15% 2026-08-05
Maple-Preview: LLM da 20B con pesi ternari e ragionamento open-weight
LLM Maple-Preview: LLM da 20B con pesi ternari e ragionamento open-weight 2026-08-05
BBOWP-Bench: LLM e progettazione dello spazio di ricerca nell'ottimizzazione black-box
LLM BBOWP-Bench: LLM e progettazione dello spazio di ricerca nell'ottimizzazione black-box 2026-08-05
Circuiti digitali che si auto-riparano: la lezione della biologia per l'hardware IA on-premise
Hardware Circuiti digitali che si auto-riparano: la lezione della biologia per l'hardware IA on-premise 2026-08-05
Nvidia RTX 50, costi in salita: TSMC e memorie spingono i prezzi verso l’alto
Market Nvidia RTX 50, costi in salita: TSMC e memorie spingono i prezzi verso l’alto 2026-08-04
MemoryForge dota gli LLM di memoria autobiografica: la persona nasce dai dati, non dai prompt
LLM MemoryForge dota gli LLM di memoria autobiografica: la persona nasce dai dati, non dai prompt 2026-08-04
GPU AMD Kaveri e Hawaii: Linux 7.3 le rende più affidabili per i carichi on-prem
Hardware GPU AMD Kaveri e Hawaii: Linux 7.3 le rende più affidabili per i carichi on-prem 2026-08-04
RTX 5090 oltre 5.100 dollari: il costo dell’hardware AI sale e l’on-premise trema
Hardware RTX 5090 oltre 5.100 dollari: il costo dell’hardware AI sale e l’on-premise trema 2026-08-03
Orchard: il framework open dove l’infrastruttura fa la differenza (e i modelli da 3B sfiorano i big)
Frameworks Orchard: il framework open dove l’infrastruttura fa la differenza (e i modelli da 3B sfiorano i big) 2026-08-03
zlib-rs 0.6.7 porta sicurezza Rust e supporto LoongArch alla compressione
Altro zlib-rs 0.6.7 porta sicurezza Rust e supporto LoongArch alla compressione 2026-08-03
Dati sbilanciati? GMM e LLM fanno clustering senza perdere i pezzi
LLM Dati sbilanciati? GMM e LLM fanno clustering senza perdere i pezzi 2026-08-03
Guida autonoma: il jitter temporale è il vero nemico dei classificatori
Altro Guida autonoma: il jitter temporale è il vero nemico dei classificatori 2026-08-03
OpenClaw e Ollama: architettura a strati per agenti AI autonomi e scalabili
Frameworks OpenClaw e Ollama: architettura a strati per agenti AI autonomi e scalabili 2026-08-03
Pronti per l’LLM da 26 trilioni di parametri? L’alternativa allo spreco di GPU è negli SSD
Hardware Pronti per l’LLM da 26 trilioni di parametri? L’alternativa allo spreco di GPU è negli SSD 2026-08-02
llama.cpp abbraccia MTP/DSpark: l’inference on-premise accelera su DeepSeek V4 Flash
Frameworks llama.cpp abbraccia MTP/DSpark: l’inference on-premise accelera su DeepSeek V4 Flash 2026-08-02
DeepSeek-V4-Flash: attenti ai messaggi di sistema a metà conversazione, uccidono il prompt caching
Frameworks DeepSeek-V4-Flash: attenti ai messaggi di sistema a metà conversazione, uccidono il prompt caching 2026-08-02
KDE Plasma 6.8: il compositing multi-GPU diventa un alleato per l’AI locale
Hardware KDE Plasma 6.8: il compositing multi-GPU diventa un alleato per l’AI locale 2026-08-01
Unsloth porta Deepseek V4 in locale con i nuovi GGUF
Frameworks Unsloth porta Deepseek V4 in locale con i nuovi GGUF 2026-07-31