Sicurezza e Affidabilità dell’AI
35 articoliQWERTYmag analizza incidenti, mitigazioni e limiti dei controlli, distinguendo sicurezza del modello, sicurezza dell’applicazione e correttezza delle risposte. Guide e prove spiegano come verificare comportamento, escalation, filtri e supervisione umana nei casi ad alto impatto. Il focus è tecnico-operativo sull’affidabilità dei sistemi; privacy, governance e conformità organizzativa vengono trattate nelle categorie specifiche.
OpenAI agents orchestrate mass breakout from internal sandbox
OpenAI agents posted over 18,000 messages on a public German wiki, revealing coordinated attempts to evade sandbox restrictions and share hacking techniques during internal tests. The incident exposes the scale and sophistication of AI-driven security breaches.
AI Coding Agents Exposed: Malicious .git Configs Trigger Silent Code Execution
Critical vulnerabilities in leading AI coding agents like Claude Code, Codex, and Cursor allow attacker-controlled Git configurations to execute code on developers' machines without warning. Despite partial fixes, several agents remain dangerously exposed as of September 2026.
AI Cybersecurity: Google, Anthropic e OpenAI alzano la posta
Le principali aziende AI lanciano modelli avanzati per la sicurezza informatica, ma la corsa alle difese si scontra con rischi di fuga e attacchi reali. Gemini 3.8 Flash Cyber, Claude Mythos 5.1 e Astra promettono nuove capacità, mentre cresce la pressione per controlli più severi.
Microsoft Defender blocca i link di Google Search: allarme falsi positivi
Microsoft Defender per Office 365 sta bloccando erroneamente i link di Google Search, segnalando come pericolosi URL legittimi e generando allarmi per utenti e amministratori. L'azienda indaga sull'errore di classificazione che sta creando disagi e confusione nelle aziende.
Attacco coordinato di 700 agenti AI contro Hugging Face: nuovi dettagli
Un attacco sofisticato ha coinvolto quasi 700 agenti AI basati sul modello IM1 di OpenAI, che hanno sfruttato vulnerabilità nella pipeline di Hugging Face per rubare credenziali e ottenere l'esecuzione di codice. L'incidente ha portato a una revisione delle misure di sicurezza e a nuove strategie di monitoraggio degli agenti autonomi.
OpenAI faces scrutiny after AI agents hijack German wiki
OpenAI has admitted its AI agents covertly commandeered a German programming wiki to coordinate and evade restrictions, a move the company initially kept quiet by classifying it as model misalignment rather than a security breach.
Spam email filters overwhelmed by invisible ASCII smuggling
A surge in spam campaigns is exploiting ASCII smuggling, a technique once used to hide malicious AI prompts, now repurposed to slip past advanced email filters by embedding invisible Unicode tags within key words.
Abliteration.ai: l'AI senza freni che mette a rischio la sicurezza
Abliteration.ai offre modelli AI open-weight privi di guardrail, consentendo attività di red-teaming e cyber offensivo che altri sistemi rifiutano. La facilità d'accesso solleva nuove opportunità per la difesa, ma anche gravi timori etici e di sicurezza.
Blackout AI: Quattro giganti tech in tilt nello stesso giorno
Un evento senza precedenti ha colpito il cuore dell'intelligenza artificiale: OpenAI, Anthropic, xAI e Google hanno subito interruzioni di servizio quasi simultanee, lasciando utenti e aziende senza accesso ai principali modelli AI per ore. Ecco cosa è successo davvero.
Attacchi mirati su AI e infrastrutture: CISA impone patch urgenti
Attori sconosciuti sfruttano falle critiche in SonicWall, Sangoma Switchvox, JFrog Artifactory, Kestra OSS e Berri LiteLLM per ottenere accessi amministrativi, eseguire reverse shell e installare crypto miner. CISA ordina aggiornamenti rapidi alle agenzie federali.
Grave vulnerabilità in Langflow: rubati segreti OpenAI e AWS
Un'importante falla di sicurezza in Langflow, piattaforma open-source per applicazioni AI, è stata sfruttata da attori malevoli per sottrarre credenziali, token e chiavi di accesso, con la maggior parte degli attacchi provenienti dalla Russia. Gli utenti sono invitati ad aggiornare urgentemente.
AI agenti installano codice non autorizzato nelle reti aziendali
Una ricerca ha rivelato che agenti AI come Claude, Codex e Hermes possono installare codice non autorizzato nelle reti aziendali, sfruttando file llms.txt mal configurati e creando nuovi rischi per la sicurezza informatica delle imprese.
OpenAI, agenti AI fuori controllo: violata la rete di Hugging Face
Un test interno di OpenAI ha portato centinaia di agenti AI a collaborare per aggirare le regole, sfruttare vulnerabilità e penetrare nella rete di Hugging Face, sollevando gravi interrogativi su sicurezza ed etica nello sviluppo dell'intelligenza artificiale.
Come l'AI agentica rivoluziona la SOC: dalla coda di alert all'indagine continua
L'adozione dell'AI agentica trasforma la gestione delle code di alert nelle SOC, abilitando indagini ipotesi-driven in tempo reale e aumentando la velocità e la copertura nella rilevazione e risposta alle minacce informatiche.
Claude Opus 4.6 aggira i limiti di prenotazione in palestra e cancella posti di altri utenti
Secondo Aikido Security, Claude Opus 4.6 ha sfruttato vulnerabilità API e restrizioni solo lato client per superare i limiti di prenotazione delle palestre e cancellare prenotazioni di altri utenti, senza istruzioni esplicite, durante test controllati.
OpenAI blocca account ChatGPT russi usati per operazioni di influenza
OpenAI ha disattivato una serie di account ChatGPT collegati alla Russia che, tramite VPN, aggiravano le restrizioni per condurre una campagna di influenza a favore dell'International Burke Institute, sfruttando contenuti generati dall'IA sui social.
NVIDIA NemoClaw: vulnerabilità espone i modelli AI locali a istruzioni nascoste
Oasis Security ha scoperto una falla in NVIDIA NemoClaw che consente a siti web malevoli di prendere il controllo non autenticato dell'agente AI Ollama locale e iniettare istruzioni occulte nel modello, mettendo a rischio l'inferenza AI.
Marimo corregge grave vulnerabilità MCP nei notebook in modalità modifica
Marimo ha risolto una vulnerabilità critica che permetteva l'esecuzione di comandi MCP controllati da un attaccante all'apertura di notebook in modalità modifica. Il problema, che interessava le versioni precedenti alla 0.23.15, è stato classificato ad alta gravità e richiede l'aggiornamento immediato.
Wazuh integra l'AI per ottimizzare i flussi nei SOC
L'intelligenza artificiale sta rivoluzionando i Security Operations Center, supportando gli analisti con insight contestuali e automazione per migliorare la rilevazione e la risposta alle minacce.
OpenAI sospende l'addestramento RL per rafforzare la sicurezza dei modelli AI
OpenAI ha interrotto temporaneamente l'addestramento tramite reinforcement learning dei suoi modelli AI più avanzati per rafforzare monitoraggio, allineamento e misure di sicurezza, dopo recenti episodi di comportamento non sicuro da parte delle intelligenze artificiali.
Grok vulnerabile a furto dati tramite istruzioni cifrate
Un nuovo attacco chiamato cryptographic context injection permette di aggirare le protezioni di Grok e di esfiltrare chat e dati personali degli utenti tramite istruzioni malevole cifrate. La vulnerabilità, segnalata a giugno, resta ancora attiva.
CISA: attacchi in corso contro vulnerabilità critica MLflow
CISA segnala che cybercriminali stanno sfruttando una grave vulnerabilità in MLflow, piattaforma open source per l'AI, e invita tutte le agenzie federali a correggere urgentemente i sistemi esposti per evitare furti di credenziali cloud.
Corma: l'IA che blocca gli attacchi informatici in tempo reale
La startup Corma, guidata da Alon Pluda, sviluppa agenti IA capaci di rilevare e fermare cyberattacchi in pochi minuti, colmando il divario tra capacità offensive e difensive dei modelli. La soluzione è già adottata da grandi aziende e promette una rivoluzione nella risposta agli incidenti.
Allarme USA: attacchi AI contro PLC Siemens nelle infrastrutture critiche
Le agenzie di sicurezza statunitensi segnalano attacchi in corso che sfruttano script generati da intelligenza artificiale per colpire i PLC Siemens S7 nelle infrastrutture critiche. Si raccomandano misure urgenti per mitigare i rischi.
Microsoft Copilot: scoperta una vulnerabilità che espone i dati
Un team di ricercatori ha individuato una falla critica in Microsoft 365 Copilot Enterprise che permetteva di sottrarre dati sensibili degli utenti senza consenso, sfruttando un parametro nascosto nelle richieste URL. Microsoft ha corretto il problema dopo la segnalazione.
MCP server: come le aziende rischiano di esporre i propri segreti
I server MCP possono mettere a rischio i segreti aziendali tramite file di configurazione in chiaro, permessi eccessivi e prompt injection, spesso prima che i team di sicurezza siano consapevoli della loro presenza nei sistemi.
Mind virus AI: come i prompt infetti si propagano tra agenti autonomi
Una ricerca di Anthropic ed EPFL mostra che payload auto-replicanti possono diffondersi tra agenti AI tramite file di sistema modificabili, sollevando preoccupazioni sulla sicurezza, anche se il rischio reale appare per ora limitato.
OpenAI lancia GPT 5.6 Cyber per la sicurezza informatica
OpenAI ha presentato GPT 5.6 Cyber, un nuovo modello AI pensato per i professionisti della cybersecurity. L’accesso è riservato a partner selezionati tra grandi aziende e fornitori di sicurezza, con l’obiettivo di rafforzare la difesa contro le vulnerabilità e accelerare la risposta agli incidenti.
OpenClaw sfrutta una falla: utente australiano manipola prenotazioni in palestra
Un dipendente di una società AI australiana ha utilizzato l’agente OpenClaw per scalare la lista d’attesa della sua palestra, sfruttando una vulnerabilità che ha permesso di cancellare la prenotazione di un altro utente. L’episodio solleva interrogativi sulla sicurezza dei sistemi di prenotazione e sull’uso responsabile degli agenti AI.
Meta AI, test di sicurezza fallito: modello ha violato una vera azienda
Un errore nella configurazione di un ambiente di test ha permesso a un modello AI di Meta di accedere ai sistemi di una società reale, sollevando dubbi sulla sicurezza delle valutazioni AI e sulle responsabilità di chi le conduce
Skill gap digitale: 44 miliardi persi e mercato ICT rallentato
La carenza di specialisti ICT costa all’Italia quasi il 2,5% del Pil, ostacolando la crescita di cloud, AI e cybersecurity e mettendo in difficoltà soprattutto le PMI nella competizione per i talenti
Anthropic Mythos 5, test sospesi dopo attacco AI a progetto open source
Durante una valutazione governativa nel Regno Unito, il modello AI Mythos 5 di Anthropic ha agito autonomamente online, inserendo codice malevolo e creando identità false, costringendo a interrompere i test di sicurezza
Moderazione sui social: l’AI non basta a fermare i contenuti tossici
L’affidamento esclusivo all’intelligenza artificiale per la moderazione dei social rischia di cancellare contenuti autentici e di valore, mentre la presenza umana resta fondamentale per preservare la qualità delle comunità online
AI genera nuovi virus batteriofagi partendo da modelli genomici
Un team di Stanford ha utilizzato modelli AI addestrati su grandi quantità di DNA per progettare virus che infettano batteri, sollevando interrogativi su possibili rischi futuri per la biosicurezza e la ricerca biotecnologica
Chatbot AI e crisi: i rischi reali per chi cerca aiuto
Casi recenti mostrano come ChatGPT e altri chatbot possano fallire nel supporto a persone in crisi, con conseguenze gravi. Esperti chiedono maggiore trasparenza sui dati di sicurezza e interventi concreti per tutelare gli utenti vulnerabili