Topic / Trend Rising

Specializzazione hardware AI e banda di memoria

Hot Chips 2026 rivela uno spostamento verso acceleratori AI specializzati, dalle TPU 8t/8i di Google e Intel Crescent Island fino a AMD Instinct MI450 e ai compromessi di capacità HBM di Micron. Le modifiche a compilatori e piattaforme puntano sempre più a questi nuovi percorsi hardware.

Detected: 2026-08-29 · Updated: 2026-08-29

Articoli Correlati

2026-08-28 LocalLLaMA

Micron: HBM occupa tre volte l'area wafer della DDR5 a parità di capacità

Micron ha spiegato a Hot Chips 2026 che l'HBM richiede circa tre volte l'area wafer della DDR5 per la stessa capacità. Il rapporto non migliorerà nelle prossime generazioni. Ogni gigabyte di HBM in una GPU da datacenter sottrae tre gigabyte di DRAM c...

#Hardware #LLM On-Premise #DevOps
2026-08-26 ServeTheHome

Google porta a Hot Chips 2026 le TPU 8t e 8i

Google ha presentato a Hot Chips 2026 la famiglia TPU di ottava generazione, con TPU 8t per il training e TPU 8i per l'inference. È un segnale della crescente specializzazione dell'hardware AI e della volontà dei hyperscaler di ridurre la dipendenza ...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-25 Phoronix

LLVM 23.1: Zen 6 e Rigel nel compilatore, C++26 parziale

La prima release stabile della serie LLVM 23 introduce il supporto per AMD Zen 6, NVIDIA Rigel e una copertura parziale del C++26. Per chi gestisce stack AI on-premise, il compilatore è il punto in cui l'hardware diventa utilizzabile. L'aggiornamento...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-25 ServeTheHome

Intel Crescent Island, da 160 a 480 GB di LPDDR5X per l'AI

A Hot Chips 2026 emergono dettagli su Intel Crescent Island, acceleratore AI con configurazioni LPDDR5X da 160 a 480 GB. La scelta privilegia la capacità di memoria rispetto alla potenza pura: per l'inference di LLM di grandi dimensioni, meno GPU pos...

#Hardware #LLM On-Premise #Fine-Tuning
2026-08-23 LocalLLaMA

Kimi K3 su 8 B300: 92 token/s e 190 dollari per milione di token

Un test di hosting su Modal con 8 B300 mostra 92 token/s in decode e 190 dollari per milione di token di output. La variante 1-bit su 8 A100 costa meno all'ora ma triplica il costo per token. L'analisi della prova rivela perché il prezzo orario è una...

#Hardware #LLM On-Premise #DevOps
← Torna ai Topic