Inferenza e Prestazioni AI

15 articoli

NVIDIA RTX PRO 4500 Blackwell Server Edition shakes up edge AI performance

NVIDIA's RTX PRO 4500 Blackwell Server Edition brings a 2.7x jump in throughput and slashes latency compared to the L4 in the same HPE ProLiant DL145 Gen11 edge server. Edge AI workloads just got a new benchmark.

Leggi di più

Mac Studio M5 Ultra: la scrivania diventa una centrale AI

Il Mac Studio M5 Ultra di Apple porta la potenza dell'AI locale a livelli mai visti, ma con rincari fino al 25% resta un prodotto per pochi sviluppatori e creativi disposti a spendere cifre a cinque zeri.

Leggi di più

ASUS ExpertCenter Pro ET900N G3 raises the bar for AI workstations

ASUS ExpertCenter Pro ET900N G3 shakes up the AI desktop market with its Grace Blackwell Superchip, titanium-grade power supply, and smart cooling, matching the MSI WS300 on speed but adding real-world improvements.

Leggi di più

Amazon SageMaker accelera l'inferenza AI: 13 novità chiave nel 2026

Amazon SageMaker introduce 13 nuove funzionalità nel 2026, puntando su velocità di deployment, scalabilità e controllo per aziende, startup e settore pubblico nell'inferenza AI generativa.

Leggi di più

Claude fuori servizio: grave interruzione per Anthropic

Dal 16 agosto 2026, Claude e diversi servizi Anthropic sono stati colpiti da un'importante interruzione che ha impedito l'accesso e rallentato le prestazioni per numerosi utenti. L'azienda ha confermato il problema e sta indagando sulle cause.

Leggi di più

Apple Mac mini M5 Pro resets the bar for compact workstations

Apple's Mac mini M5 Pro blows past the limits for mini desktops. It packs serious speed and AI muscle into a small box, forcing rivals to rethink both price and performance.

Leggi di più

Processori e chip dedicati spingono l'intelligenza artificiale oltre i limiti

L'intelligenza artificiale non si limita più ai laboratori: CPU, GPU, ASIC e FPGA sono ormai il motore di modelli linguistici e carichi di inferenza che stanno trasformando il panorama tecnologico. Ecco come l'hardware AI sta cambiando le regole del gioco.

Leggi di più

DLSS 5 transforms NBA 2K27 visuals with a heavy performance toll

NVIDIA DLSS 5 lands in NBA 2K27 with 3D-Guided Neural Rendering, delivering photorealistic lighting and materials but slashing frame rates by over 60 percent unless Multi Frame Generation is enabled. The technology sets a new bar for realism but demands top-tier hardware and power.

Leggi di più

Nvidia svela Groq 3 LPX: rivoluzione nell'inferenza AI e prime prove indipendenti

Nvidia ha presentato l'architettura Groq 3 LPX e pubblicato il primo benchmark indipendente: il nuovo rack, basato sul chip LP30 acquisito da Groq, supera di quattro volte i rivali nell'inferenza AI, ma la strategia solleva interrogativi su capacità, trasparenza e concorrenza.

Leggi di più

Blackout Claude: Anthropic in crisi, modelli AI bloccati

Un blackout improvviso ha messo fuori uso i modelli Claude di Anthropic, tra cui Mythos, Fable e Opus, causando errori e richieste fallite per migliaia di utenti dal 3 settembre 2026. L'azienda è al lavoro per ripristinare il servizio, ma l'interruzione persiste.

Leggi di più

5G ultrabroadband, l'AI cambia le regole delle reti mobili

Il nuovo report di Ookla rivela che le reti 5G non sono ancora pronte per i carichi di lavoro generati dall'intelligenza artificiale: limiti evidenti emergono soprattutto nell'upload e nella latenza sotto carico, ridefinendo i parametri di valutazione delle infrastrutture mobili.

Leggi di più

Google lancia Gemini 3.7 Flash con miglioramenti rapidi

A soli tre settimane dal debutto di Gemini 3.6 Flash, Google presenta la versione 3.7 Flash, che promette significativi passi avanti in coding, automazione e gestione documentale, puntando anche su un prezzo introduttivo più competitivo.

Leggi di più

OpenAI aggiorna ChatGPT: risposte più affidabili anche per gli utenti gratis

OpenAI introduce GPT-5.6 Sol per abbonati e GPT-5.6 Luna per tutti, con maggiore accuratezza, controllo sul ragionamento e chat testuali illimitate per gli utenti gratuiti. Cambiano limiti e protezioni, ma non i costi

Leggi di più

Amazon limita l’uso interno di EC2 per gestire la domanda di CPU

Amazon Web Services ha chiesto ai propri ingegneri di ridurre l’utilizzo delle istanze EC2 a bassa occupazione per liberare capacità di calcolo destinata ai clienti esterni, in risposta alla crescente pressione delle applicazioni AI

Leggi di più

ByteDance sviluppa un modello AI da 10 trilioni di parametri

ByteDance sta addestrando un modello di intelligenza artificiale che punta a raggiungere i 10 trilioni di parametri, superando di gran lunga le dimensioni dei principali modelli cinesi e avvicinandosi ai leader statunitensi come Anthropic

Leggi di più