Una configurazione con otto GPU AMD MI50 da 32GB offre prestazioni notevoli nell'inferenza di modelli linguistici di grandi dimensioni (LLM). Con MiniMax-M2.1 raggiunge i 26 token al secondo, mentre con GLM 4.7 arriva a 15 token al secondo. Il sistema, dal costo di circa 880 dollari per le GPU, consuma 1200W in inferenza, proponendosi come soluzione efficiente e accessibile per l'inferenza locale.
Le V-Color Manta XFinity RGB DDR5-6400 si posizionano tra i kit di memoria da 128GB più veloci sul mercato. La domanda chiave è se mantengano le promesse in termini di prestazioni e se giustifichino l'investimento per gli utenti che necessitano di una tale capacità di memoria.
L'affermazione di Elon Musk riguardo alla capacità di 1 GW per il supercomputer Colossus 2 di xAI è stata messa in discussione. Analisi satellitari suggeriscono che la capacità di raffreddamento del sito indichi una potenza significativamente inferiore, pari a circa 350 megawatt.
Intel ha annunciato la fine del ciclo di vita (EOL) per i processori Alder Lake di 12a generazione e Xeon Sapphire Rapids di 4a generazione. I clienti avranno tempo limitato per effettuare gli ultimi ordini di queste CPU ibride, segnando un passaggio importante nella roadmap dei prodotti Intel.
Jensen Huang, CEO di Nvidia, ha confermato che la sua azienda ha superato Apple come principale cliente di TSMC. Nvidia torna così ad essere il cliente numero uno del produttore di chip, dopo oltre vent'anni. Questo sorpasso evidenzia la crescente importanza di Nvidia nel settore dei semiconduttori.
Il superchip NVIDIA GB10, progettato per l'intelligenza artificiale, è stato testato in scenari Linux tradizionali per valutare le prestazioni della sua CPU. I benchmark di Phoronix mettono a confronto il GB10 con l'AMD Ryzen AI Max+ "Strix Halo" all'interno del Framework Desktop, offrendo uno sguardo sulle capacità del chip in carichi di lavoro diversi dall'AI.
OpenAI potrebbe lanciare il suo primo dispositivo hardware, forse degli auricolari, già nel 2026. Chris Lehane, Chief Global Affairs Officer di OpenAI, ha annunciato che l'azienda prevede di presentare il suo primo hardware nella seconda metà di quest'anno. Questa mossa segna un'espansione significativa per OpenAI, tradizionalmente focalizzata sullo sviluppo di modelli di linguaggio e software.
Il CEO di Nvidia, Jensen Huang, si recherà in Cina a fine gennaio per celebrare il Capodanno Lunare. La visita assume particolare importanza, poiché coincide con le trattative sul volume di GPU H200 che Pechino potrà importare, sullo sfondo delle restrizioni statunitensi all'export di chip avanzati verso la Cina.
Un acquirente su Amazon ha subito una truffa: al posto di una scheda video RTX 5080, ha ricevuto una RTX 5060 Ti con etichette contraffatte. Il pacco era venduto e spedito da Amazon, suggerendo una possibile sostituzione del prodotto dopo un reso. L'inganno è stato smascherato dal connettore di alimentazione a 8 pin, tipico delle schede inferiori, anziché quello a 16 pin delle RTX 5080.
Una patch per il kernel Linux promette di ridurre drasticamente la latenza di riattivazione (wakeup latency) sui moderni server Intel Xeon. La modifica, che coinvolge una singola riga di codice, mira a ottimizzare le prestazioni in scenari dove la reattività è fondamentale, specialmente con configurazioni NOHZ_FULL e il governor menu di Linux.
Le esportazioni di Taiwan hanno raggiunto livelli record a dicembre, trainate dalla forte domanda di server e chip per l'intelligenza artificiale. Questo dato sottolinea il ruolo chiave dell'isola nell'industria globale dei semiconduttori e la sua crescente importanza nel settore dell'AI.
Intel ha reclutato un ex dirigente di Qualcomm, specializzato in GPU, per guidare le iniziative future nel campo dell'intelligenza artificiale sui PC. Questa mossa strategica mira a rafforzare la posizione di Intel nel mercato in rapida crescita dei PC dotati di capacità di AI avanzate, sfruttando l'esperienza del nuovo responsabile nello sviluppo di GPU ad alte prestazioni.
Secondo indiscrezioni, OpenAI starebbe pianificando l'ingresso nel mercato hardware con una serie di dispositivi. Il primo della lista sarebbe 'Sweetpea', un prodotto audio. L'azienda sembra intenzionata a diversificare le proprie attività, espandendosi oltre il software e i modelli di linguaggio.
Il settore dell'intelligenza artificiale in Cina sta subendo una profonda trasformazione, con le GPU che assumono un ruolo sempre più centrale come risorse strategiche. Questo cambiamento è guidato dalla crescente domanda di potenza di calcolo per l'addestramento di modelli di IA sempre più complessi e per applicazioni avanzate come la guida autonoma e il riconoscimento facciale. Aziende come Cambricon si trovano in prima linea in questa evoluzione.
Nvidia ha annunciato Alpamayo, una nuova piattaforma pensata per lo sviluppo di veicoli a guida autonoma di livello 4. La piattaforma mira a fornire ai produttori di automobili e ai fornitori di tecnicia gli strumenti necessari per accelerare la realizzazione di sistemi di guida completamente autonomi, migliorando la sicurezza e l'efficienza dei trasporti. Ulteriori dettagli sulle specifiche tecniche e sulla disponibilità della piattaforma saranno rilasciati nei prossimi mesi.
Nvidia punta a scalzare Apple come cliente prioritario di TSMC, il colosso taiwanese della produzione di semiconduttori. La competizione per accaparrarsi le capacità produttive di TSMC si fa sempre più intensa, con importanti implicazioni per il futuro dell'hardware.
Il Ministero della Difesa taiwanese ha annunciato un importante ordine di approvvigionamento di droni, incrementando parallelamente gli investimenti nel settore della progettazione di circuiti integrati (IC) a livello nazionale. La mossa strategica mira a rafforzare le capacità di difesa dell'isola e a promuovere l'autosufficienza tecnicica nel campo dei semiconduttori.
Taiwan introduce tariffe elettriche differenziate per i data center, in risposta al crescente consumo energetico legato all'intelligenza artificiale. La mossa mira a incentivare l'efficienza energetica e a gestire meglio la domanda di elettricità, in un contesto di potenziale crisi energetica dovuta all'espansione dell'IA.
Il CEO di Anthropic, Dario Amodei, ha espresso forte preoccupazione riguardo alla decisione degli Stati Uniti di permettere a Nvidia di vendere GPU alle aziende cinesi. Amodei ha paragonato questa scelta alla fornitura di armi nucleari a potenze avversarie, sottolineando i potenziali rischi strategici e geopolitici derivanti da tale mossa.
Elon Musk ha annunciato che Tesla riprenderà lo sviluppo di Dojo3, il chip di intelligenza artificiale di terza generazione precedentemente abbandonato. A differenza dei piani originali, Dojo3 sarà ora dedicato all'elaborazione di intelligenza artificiale nello spazio, aprendo nuove frontiere per le applicazioni spaziali di Tesla.