🏷️ DevOps

60 articoli con questo tag · tutti i tag

Hugging Face supera 3 milioni di modelli: l'abbondanza diventa un problema di curation
LLM Hugging Face supera 3 milioni di modelli: l'abbondanza diventa un problema di curation 2026-08-18
Qwen3.8-27B su RTX PRO 6000: 8 ore e 650 dollari di API evitati
Altro Qwen3.8-27B su RTX PRO 6000: 8 ore e 650 dollari di API evitati 2026-08-18
RTX 50, Hydra ora controlla VRAM e limiti di potenza fino a +3000 MHz
Hardware RTX 50, Hydra ora controlla VRAM e limiti di potenza fino a +3000 MHz 2026-08-18
L'AI che si migliora da sola? Prima deve imparare a fare ricerca
LLM L'AI che si migliora da sola? Prima deve imparare a fare ricerca 2026-08-18
Microsoft ribattezza i suoi prodotti 158 volte: il registro che svela i costi nascosti
Market Microsoft ribattezza i suoi prodotti 158 volte: il registro che svela i costi nascosti 2026-08-18
HarmProfile: il rischio dei LLM di frontiera è una distribuzione, non un fallimento
LLM HarmProfile: il rischio dei LLM di frontiera è una distribuzione, non un fallimento 2026-08-18
FPO accelera il fine-tuning dei LLM senza backpropagation tra i layer
LLM FPO accelera il fine-tuning dei LLM senza backpropagation tra i layer 2026-08-18
LLM medici: la fiducia è parziale, e gli errori si annidano nei casi ambigui
LLM LLM medici: la fiducia è parziale, e gli errori si annidano nei casi ambigui 2026-08-18
CDW porta la RTX Pro 6000 a 19.999 dollari: possibile anticipazione di listino
Market CDW porta la RTX Pro 6000 a 19.999 dollari: possibile anticipazione di listino 2026-08-18
Rust sulle GPU: memoria sicura oltre CUDA e HIP
Frameworks Rust sulle GPU: memoria sicura oltre CUDA e HIP 2026-08-17
llama.cpp v0.1.0 segna il passaggio al versioning semantico
Frameworks llama.cpp v0.1.0 segna il passaggio al versioning semantico 2026-08-17
AMD lavora a un backend ROCm per il calcolo GPU virtualizzato in QEMU
Altro AMD lavora a un backend ROCm per il calcolo GPU virtualizzato in QEMU 2026-08-17
KTransformers 0.7 espande AVX-512 e premia i server AMD EPYC
Frameworks KTransformers 0.7 espande AVX-512 e premia i server AMD EPYC 2026-08-17
GPU in salita: PC Partner avverte su prezzi e scarsità di schede economiche
Hardware GPU in salita: PC Partner avverte su prezzi e scarsità di schede economiche 2026-08-17
Linux 7.3 riscatta ARM64: workaround NVIDIA Olympus e fine del caos patch AI
Hardware Linux 7.3 riscatta ARM64: workaround NVIDIA Olympus e fine del caos patch AI 2026-08-17
BCMT: la memoria causale a blocchi riduce il peso dell'attenzione globale
LLM BCMT: la memoria causale a blocchi riduce il peso dell'attenzione globale 2026-08-17
SELR: ragionamento latente auto-spiegabile per LLM e modelli visione-linguaggio
LLM SELR: ragionamento latente auto-spiegabile per LLM e modelli visione-linguaggio 2026-08-17
I benchmark di coding non bastano: l'ottimizzazione non crea capacità generale
LLM I benchmark di coding non bastano: l'ottimizzazione non crea capacità generale 2026-08-17
MoE: la tolleranza al mascheramento dipende dalla profondità
LLM MoE: la tolleranza al mascheramento dipende dalla profondità 2026-08-17
Linux 7.2 stabile: I/O più rapido e driver AMD/Intel aggiornati
Altro Linux 7.2 stabile: I/O più rapido e driver AMD/Intel aggiornati 2026-08-16
Il debito dell'AI locale verso Georgi Gerganov e llama.cpp
Frameworks Il debito dell'AI locale verso Georgi Gerganov e llama.cpp 2026-08-16
Google potrebbe affidare ad AMD il design del prossimo TPU ibrido
Hardware Google potrebbe affidare ad AMD il design del prossimo TPU ibrido 2026-08-16
Qwen3.8-27B batte Qwen3.6-27B nell'iterazione autonoma su ray tracer BASIC
LLM Qwen3.8-27B batte Qwen3.6-27B nell'iterazione autonoma su ray tracer BASIC 2026-08-16
Qwen3.8-27B in ufficio genera un clone di Super Mario in un colpo solo
Altro Qwen3.8-27B in ufficio genera un clone di Super Mario in un colpo solo 2026-08-15
RustConn 0.20 rifinisce il client GTK4: la gestione remota on-premise diventa meno ruvida
Altro RustConn 0.20 rifinisce il client GTK4: la gestione remota on-premise diventa meno ruvida 2026-08-15
KDE Plasma 6.8 aggiunge la regolazione fine della velocità di mouse e touchpad
Frameworks KDE Plasma 6.8 aggiunge la regolazione fine della velocità di mouse e touchpad 2026-08-15
Debian al voto sull'uso dei LLM: il bivio tra automazione e fiducia
LLM Debian al voto sull'uso dei LLM: il bivio tra automazione e fiducia 2026-08-15
Qwen 3.8 35BA3B spunta in un commit: il segnale prima del lancio
LLM Qwen 3.8 35BA3B spunta in un commit: il segnale prima del lancio 2026-08-15
Qwen 3.8 27B: il giorno del rilascio e la corsa dei formati locali
LLM Qwen 3.8 27B: il giorno del rilascio e la corsa dei formati locali 2026-08-15
Lemonade 11.6 integra Muse-Glimmer 30B e la generazione immagini ROCm sperimentale
Frameworks Lemonade 11.6 integra Muse-Glimmer 30B e la generazione immagini ROCm sperimentale 2026-08-14
Auto-riflessione LLM: contano le azioni, non le domande o le tassonomie
LLM Auto-riflessione LLM: contano le azioni, non le domande o le tassonomie 2026-08-14
Doom dentro un LLM: 34 GB di checkpoint e rendering via token
Hardware Doom dentro un LLM: 34 GB di checkpoint e rendering via token 2026-08-13
Writer punta sul contenimento dei costi token con un nuovo LLM basato su GLM-5.2
LLM Writer punta sul contenimento dei costi token con un nuovo LLM basato su GLM-5.2 2026-08-13
DeepSeek V4 Pro 0813 su Hugging Face: un nome non basta
LLM DeepSeek V4 Pro 0813 su Hugging Face: un nome non basta 2026-08-13
Qwen apre il countdown ufficiale per Qwen3.8-27B su Hugging Face
LLM Qwen apre il countdown ufficiale per Qwen3.8-27B su Hugging Face 2026-08-13
Nvidia raddoppia la RTX PRO 6000 Blackwell: on-premise più caro
Hardware Nvidia raddoppia la RTX PRO 6000 Blackwell: on-premise più caro 2026-08-13
Retrofit ricorrente nei LLM: pensiero latente più veloce, ma con confini netti
LLM Retrofit ricorrente nei LLM: pensiero latente più veloce, ma con confini netti 2026-08-13
Rilevatori AI e integrità accademica: il paradosso che punisce l’uso trasparente
Altro Rilevatori AI e integrità accademica: il paradosso che punisce l’uso trasparente 2026-08-13
Distribird porta la calibrazione bayesiana su LLM locali e open-weight
Altro Distribird porta la calibrazione bayesiana su LLM locali e open-weight 2026-08-13
Governare LLM in conflitto: il controllo che evita il collasso del dialogo
Frameworks Governare LLM in conflitto: il controllo che evita il collasso del dialogo 2026-08-13
Comma.ai lancia il dock Chestnut con GPU AMD e firmware open source
Hardware Comma.ai lancia il dock Chestnut con GPU AMD e firmware open source 2026-08-13
Attacco supply-chain a LiteLLM: terabyte di credenziali esposte
Altro Attacco supply-chain a LiteLLM: terabyte di credenziali esposte 2026-08-12
Allarme sicurezza IA: ad Ai4 Hinton, Li e Ng discutono il valore dell'apertura
Altro Allarme sicurezza IA: ad Ai4 Hinton, Li e Ng discutono il valore dell'apertura 2026-08-12
Linux sblocca la grafica ibrida sui MacBook Pro 2018-19: un vantaggio (anche) per chi fa inference locale
Hardware Linux sblocca la grafica ibrida sui MacBook Pro 2018-19: un vantaggio (anche) per chi fa inference locale 2026-08-12
Decifrati i ragionamenti segreti di Claude e GPT: cosa cambia
Altro Decifrati i ragionamenti segreti di Claude e GPT: cosa cambia 2026-08-12
LACT 0.10: overclock NVIDIA e sensori Blackwell per chi spinge le GPU Linux
Hardware LACT 0.10: overclock NVIDIA e sensori Blackwell per chi spinge le GPU Linux 2026-08-12
Intel LLM-Scaler e Muse Glimmer: inference locale su GPU Arc (Pro) B si semplifica
Frameworks Intel LLM-Scaler e Muse Glimmer: inference locale su GPU Arc (Pro) B si semplifica 2026-08-12
AMD: gli agenti IA spingeranno il rapporto CPU-GPU verso l'1:1
Hardware AMD: gli agenti IA spingeranno il rapporto CPU-GPU verso l'1:1 2026-08-12
L’UE impone la filigrana anche ai modelli locali: cosa cambia per l’AI open source
Altro L’UE impone la filigrana anche ai modelli locali: cosa cambia per l’AI open source 2026-08-12
Robuste per il conflitto, deboli per la morale: le pipeline LLM alla prova dei titoli francesi
LLM Robuste per il conflitto, deboli per la morale: le pipeline LLM alla prova dei titoli francesi 2026-08-12
LLM Agents Factory: la fabbrica di agenti che riduce i costi di inference
Frameworks LLM Agents Factory: la fabbrica di agenti che riduce i costi di inference 2026-08-12
Come la topologia svela l'evoluzione interna dei Transformer
LLM Come la topologia svela l'evoluzione interna dei Transformer 2026-08-12
Guida autonoma per serre: l’LLM riduce energia e tempi del 35–68%
Altro Guida autonoma per serre: l’LLM riduce energia e tempi del 35–68% 2026-08-12
Nemotron-3.5 Lightning: la scommessa di NVIDIA sull'efficienza per l'inference locale
LLM Nemotron-3.5 Lightning: la scommessa di NVIDIA sull'efficienza per l'inference locale 2026-08-11
FastFlowLM 1.0: AMD unifica l’AI su NPU sotto l’ombrello ROCm
Frameworks FastFlowLM 1.0: AMD unifica l’AI su NPU sotto l’ombrello ROCm 2026-08-11
Luth-2, i piccoli LLM francesi che surclassano modelli tre volte più grandi
LLM Luth-2, i piccoli LLM francesi che surclassano modelli tre volte più grandi 2026-08-11
LLM e gestione rifiuti: WuYuEval svela i limiti dell'AI generalista
LLM LLM e gestione rifiuti: WuYuEval svela i limiti dell'AI generalista 2026-08-11
Fuzzing adattivo svela le crepe delle MLLM: perché l’allucinazione resiste ai benchmark statici
Frameworks Fuzzing adattivo svela le crepe delle MLLM: perché l’allucinazione resiste ai benchmark statici 2026-08-11
Addestrare un LLM da 1B con 200$: la frontiera del self-hosted accessibile
LLM Addestrare un LLM da 1B con 200$: la frontiera del self-hosted accessibile 2026-08-11
Linux: il driver open-source NVIDIA ‘Nova’ guadagna funzionalità con Rust
Hardware Linux: il driver open-source NVIDIA ‘Nova’ guadagna funzionalità con Rust 2026-08-11