🏷️ DevOps
60 articoli con questo tag · tutti i tag
LLM
Hugging Face supera 3 milioni di modelli: l'abbondanza diventa un problema di curation
2026-08-18
Altro
Qwen3.8-27B su RTX PRO 6000: 8 ore e 650 dollari di API evitati
2026-08-18
Hardware
RTX 50, Hydra ora controlla VRAM e limiti di potenza fino a +3000 MHz
2026-08-18
LLM
L'AI che si migliora da sola? Prima deve imparare a fare ricerca
2026-08-18
Market
Microsoft ribattezza i suoi prodotti 158 volte: il registro che svela i costi nascosti
2026-08-18
LLM
HarmProfile: il rischio dei LLM di frontiera è una distribuzione, non un fallimento
2026-08-18
LLM
FPO accelera il fine-tuning dei LLM senza backpropagation tra i layer
2026-08-18
LLM
LLM medici: la fiducia è parziale, e gli errori si annidano nei casi ambigui
2026-08-18
Market
CDW porta la RTX Pro 6000 a 19.999 dollari: possibile anticipazione di listino
2026-08-18
Frameworks
Rust sulle GPU: memoria sicura oltre CUDA e HIP
2026-08-17
Frameworks
llama.cpp v0.1.0 segna il passaggio al versioning semantico
2026-08-17
Altro
AMD lavora a un backend ROCm per il calcolo GPU virtualizzato in QEMU
2026-08-17
Frameworks
KTransformers 0.7 espande AVX-512 e premia i server AMD EPYC
2026-08-17
Hardware
GPU in salita: PC Partner avverte su prezzi e scarsità di schede economiche
2026-08-17
Hardware
Linux 7.3 riscatta ARM64: workaround NVIDIA Olympus e fine del caos patch AI
2026-08-17
LLM
BCMT: la memoria causale a blocchi riduce il peso dell'attenzione globale
2026-08-17
LLM
SELR: ragionamento latente auto-spiegabile per LLM e modelli visione-linguaggio
2026-08-17
LLM
I benchmark di coding non bastano: l'ottimizzazione non crea capacità generale
2026-08-17
LLM
MoE: la tolleranza al mascheramento dipende dalla profondità
2026-08-17
Altro
Linux 7.2 stabile: I/O più rapido e driver AMD/Intel aggiornati
2026-08-16
Frameworks
Il debito dell'AI locale verso Georgi Gerganov e llama.cpp
2026-08-16
Hardware
Google potrebbe affidare ad AMD il design del prossimo TPU ibrido
2026-08-16
LLM
Qwen3.8-27B batte Qwen3.6-27B nell'iterazione autonoma su ray tracer BASIC
2026-08-16
Altro
Qwen3.8-27B in ufficio genera un clone di Super Mario in un colpo solo
2026-08-15
Altro
RustConn 0.20 rifinisce il client GTK4: la gestione remota on-premise diventa meno ruvida
2026-08-15
Frameworks
KDE Plasma 6.8 aggiunge la regolazione fine della velocità di mouse e touchpad
2026-08-15
LLM
Debian al voto sull'uso dei LLM: il bivio tra automazione e fiducia
2026-08-15
LLM
Qwen 3.8 35BA3B spunta in un commit: il segnale prima del lancio
2026-08-15
LLM
Qwen 3.8 27B: il giorno del rilascio e la corsa dei formati locali
2026-08-15
Frameworks
Lemonade 11.6 integra Muse-Glimmer 30B e la generazione immagini ROCm sperimentale
2026-08-14
LLM
Auto-riflessione LLM: contano le azioni, non le domande o le tassonomie
2026-08-14
Hardware
Doom dentro un LLM: 34 GB di checkpoint e rendering via token
2026-08-13
LLM
Writer punta sul contenimento dei costi token con un nuovo LLM basato su GLM-5.2
2026-08-13
LLM
DeepSeek V4 Pro 0813 su Hugging Face: un nome non basta
2026-08-13
LLM
Qwen apre il countdown ufficiale per Qwen3.8-27B su Hugging Face
2026-08-13
Hardware
Nvidia raddoppia la RTX PRO 6000 Blackwell: on-premise più caro
2026-08-13
LLM
Retrofit ricorrente nei LLM: pensiero latente più veloce, ma con confini netti
2026-08-13
Altro
Rilevatori AI e integrità accademica: il paradosso che punisce l’uso trasparente
2026-08-13
Altro
Distribird porta la calibrazione bayesiana su LLM locali e open-weight
2026-08-13
Frameworks
Governare LLM in conflitto: il controllo che evita il collasso del dialogo
2026-08-13
Hardware
Comma.ai lancia il dock Chestnut con GPU AMD e firmware open source
2026-08-13
Altro
Attacco supply-chain a LiteLLM: terabyte di credenziali esposte
2026-08-12
Altro
Allarme sicurezza IA: ad Ai4 Hinton, Li e Ng discutono il valore dell'apertura
2026-08-12
Hardware
Linux sblocca la grafica ibrida sui MacBook Pro 2018-19: un vantaggio (anche) per chi fa inference locale
2026-08-12
Altro
Decifrati i ragionamenti segreti di Claude e GPT: cosa cambia
2026-08-12
Hardware
LACT 0.10: overclock NVIDIA e sensori Blackwell per chi spinge le GPU Linux
2026-08-12
Frameworks
Intel LLM-Scaler e Muse Glimmer: inference locale su GPU Arc (Pro) B si semplifica
2026-08-12
Hardware
AMD: gli agenti IA spingeranno il rapporto CPU-GPU verso l'1:1
2026-08-12
Altro
L’UE impone la filigrana anche ai modelli locali: cosa cambia per l’AI open source
2026-08-12
LLM
Robuste per il conflitto, deboli per la morale: le pipeline LLM alla prova dei titoli francesi
2026-08-12
Frameworks
LLM Agents Factory: la fabbrica di agenti che riduce i costi di inference
2026-08-12
LLM
Come la topologia svela l'evoluzione interna dei Transformer
2026-08-12
Altro
Guida autonoma per serre: l’LLM riduce energia e tempi del 35–68%
2026-08-12
LLM
Nemotron-3.5 Lightning: la scommessa di NVIDIA sull'efficienza per l'inference locale
2026-08-11
Frameworks
FastFlowLM 1.0: AMD unifica l’AI su NPU sotto l’ombrello ROCm
2026-08-11
LLM
Luth-2, i piccoli LLM francesi che surclassano modelli tre volte più grandi
2026-08-11
LLM
LLM e gestione rifiuti: WuYuEval svela i limiti dell'AI generalista
2026-08-11
Frameworks
Fuzzing adattivo svela le crepe delle MLLM: perché l’allucinazione resiste ai benchmark statici
2026-08-11
LLM
Addestrare un LLM da 1B con 200$: la frontiera del self-hosted accessibile
2026-08-11
Hardware
Linux: il driver open-source NVIDIA ‘Nova’ guadagna funzionalità con Rust
2026-08-11