Topic / Trend Rising

Progressi in fine-tuning efficiente e architetture

Metodi come FPO, BCMT, retrofit ricorrenti e SELR stanno riducendo i requisiti di memoria e calcolo, migliorando al contempo le architetture di ragionamento. Questi progressi sono particolarmente rilevanti per l'adattamento locale e i deployment con risorse limitate.

Detected: 2026-08-19 · Updated: 2026-08-19

Articoli Correlati

2026-08-18 ArXiv cs.LG

FPO accelera il fine-tuning dei LLM senza backpropagation tra i layer

FPO adatta i LLM senza un backward pass attraverso il corpo del modello, raggiungendo un throughput da 2,7 a 3,2 volte superiore al fine-tuning standard e circa il 40% in meno di memoria di picco. Nei test su OLMo-2-7B, Qwen3-8B e Falcon3-7B migliora...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-17 ArXiv cs.CL

BCMT: la memoria causale a blocchi riduce il peso dell'attenzione globale

BCMT separa l'interazione locale tra token dalla propagazione globale del contesto. Nei test fino a 1024 token, offre prestazioni di validazione paragonabili ai Dense Transformer, con throughput di training più alto e minor consumo di memoria. Il mec...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-17 ArXiv cs.AI

MoE: la tolleranza al mascheramento dipende dalla profondità

Uno studio su Qwen3.6-35B-A3B mostra che nei modelli MoE la tolleranza al mascheramento degli esperti non è uniforme: i layer iniziali e intermedi sono fragili, quelli finali reggono tagli aggressivi. Su tre server H100, politiche mirate agli ultimi ...

#Hardware #LLM On-Premise #Fine-Tuning
← Torna ai Topic