Inferenza e Prestazioni AI
10 articoliBenchmark, test e analisi confrontano hardware, provider, quantizzazione, batching e diverse dimensioni di modello, distinguendo risultati di laboratorio da prestazioni osservabili in produzione. Gli aggiornamenti seguono nuove GPU, acceleratori, runtime e modelli più efficienti, traducendo i miglioramenti tecnici in costi operativi e qualità percepita.
Claude fuori servizio: grave interruzione per Anthropic
Dal 16 agosto 2026, Claude e diversi servizi Anthropic sono stati colpiti da un'importante interruzione che ha impedito l'accesso e rallentato le prestazioni per numerosi utenti. L'azienda ha confermato il problema e sta indagando sulle cause.
Google lancia Gemini 3.7 Flash con miglioramenti rapidi
A soli tre settimane dal debutto di Gemini 3.6 Flash, Google presenta la versione 3.7 Flash, che promette significativi passi avanti in coding, automazione e gestione documentale, puntando anche su un prezzo introduttivo più competitivo.
OpenAI aggiorna ChatGPT: risposte più affidabili anche per gli utenti gratis
OpenAI introduce GPT-5.6 Sol per abbonati e GPT-5.6 Luna per tutti, con maggiore accuratezza, controllo sul ragionamento e chat testuali illimitate per gli utenti gratuiti. Cambiano limiti e protezioni, ma non i costi
Amazon limita l’uso interno di EC2 per gestire la domanda di CPU
Amazon Web Services ha chiesto ai propri ingegneri di ridurre l’utilizzo delle istanze EC2 a bassa occupazione per liberare capacità di calcolo destinata ai clienti esterni, in risposta alla crescente pressione delle applicazioni AI
ByteDance sviluppa un modello AI da 10 trilioni di parametri
ByteDance sta addestrando un modello di intelligenza artificiale che punta a raggiungere i 10 trilioni di parametri, superando di gran lunga le dimensioni dei principali modelli cinesi e avvicinandosi ai leader statunitensi come Anthropic
Processori e chip dedicati spingono l'intelligenza artificiale oltre i limiti
L'intelligenza artificiale non si limita più ai laboratori: CPU, GPU, ASIC e FPGA sono ormai il motore di modelli linguistici e carichi di inferenza che stanno trasformando il panorama tecnologico. Ecco come l'hardware AI sta cambiando le regole del gioco.
DLSS 5 transforms NBA 2K27 visuals with a heavy performance toll
NVIDIA DLSS 5 lands in NBA 2K27 with 3D-Guided Neural Rendering, delivering photorealistic lighting and materials but slashing frame rates by over 60 percent unless Multi Frame Generation is enabled. The technology sets a new bar for realism but demands top-tier hardware and power.
Nvidia svela Groq 3 LPX: rivoluzione nell'inferenza AI e prime prove indipendenti
Nvidia ha presentato l'architettura Groq 3 LPX e pubblicato il primo benchmark indipendente: il nuovo rack, basato sul chip LP30 acquisito da Groq, supera di quattro volte i rivali nell'inferenza AI, ma la strategia solleva interrogativi su capacità, trasparenza e concorrenza.
Blackout Claude: Anthropic in crisi, modelli AI bloccati
Un blackout improvviso ha messo fuori uso i modelli Claude di Anthropic, tra cui Mythos, Fable e Opus, causando errori e richieste fallite per migliaia di utenti dal 3 settembre 2026. L'azienda è al lavoro per ripristinare il servizio, ma l'interruzione persiste.
5G ultrabroadband, l'AI cambia le regole delle reti mobili
Il nuovo report di Ookla rivela che le reti 5G non sono ancora pronte per i carichi di lavoro generati dall'intelligenza artificiale: limiti evidenti emergono soprattutto nell'upload e nella latenza sotto carico, ridefinendo i parametri di valutazione delle infrastrutture mobili.