Sicurezza e Affidabilità dell’AI

8 articoli
Un sistema AI utile deve restare affidabile anche quando riceve input imprevisti, ambigui o intenzionalmente ostili. Questa categoria segue allucinazioni, prompt injection, abusi dei modelli, test avversariali, red teaming, robustezza e procedure per rilasciare e monitorare applicazioni AI in modo più sicuro.

QWERTYmag analizza incidenti, mitigazioni e limiti dei controlli, distinguendo sicurezza del modello, sicurezza dell’applicazione e correttezza delle risposte. Guide e prove spiegano come verificare comportamento, escalation, filtri e supervisione umana nei casi ad alto impatto. Il focus è tecnico-operativo sull’affidabilità dei sistemi; privacy, governance e conformità organizzativa vengono trattate nelle categorie specifiche.

OpenAI lancia GPT 5.6 Cyber per la sicurezza informatica

OpenAI ha presentato GPT 5.6 Cyber, un nuovo modello AI pensato per i professionisti della cybersecurity. L’accesso è riservato a partner selezionati tra grandi aziende e fornitori di sicurezza, con l’obiettivo di rafforzare la difesa contro le vulnerabilità e accelerare la risposta agli incidenti.

Leggi di più

Meta AI, test di sicurezza fallito: modello ha violato una vera azienda

Un errore nella configurazione di un ambiente di test ha permesso a un modello AI di Meta di accedere ai sistemi di una società reale, sollevando dubbi sulla sicurezza delle valutazioni AI e sulle responsabilità di chi le conduce

Leggi di più

Anthropic Mythos 5, test sospesi dopo attacco AI a progetto open source

Durante una valutazione governativa nel Regno Unito, il modello AI Mythos 5 di Anthropic ha agito autonomamente online, inserendo codice malevolo e creando identità false, costringendo a interrompere i test di sicurezza

Leggi di più

AI genera nuovi virus batteriofagi partendo da modelli genomici

Un team di Stanford ha utilizzato modelli AI addestrati su grandi quantità di DNA per progettare virus che infettano batteri, sollevando interrogativi su possibili rischi futuri per la biosicurezza e la ricerca biotecnologica

Leggi di più

OpenClaw sfrutta una falla: utente australiano manipola prenotazioni in palestra

Un dipendente di una società AI australiana ha utilizzato l’agente OpenClaw per scalare la lista d’attesa della sua palestra, sfruttando una vulnerabilità che ha permesso di cancellare la prenotazione di un altro utente. L’episodio solleva interrogativi sulla sicurezza dei sistemi di prenotazione e sull’uso responsabile degli agenti AI.

Leggi di più

Skill gap digitale: 44 miliardi persi e mercato ICT rallentato

La carenza di specialisti ICT costa all’Italia quasi il 2,5% del Pil, ostacolando la crescita di cloud, AI e cybersecurity e mettendo in difficoltà soprattutto le PMI nella competizione per i talenti

Leggi di più

Moderazione sui social: l’AI non basta a fermare i contenuti tossici

L’affidamento esclusivo all’intelligenza artificiale per la moderazione dei social rischia di cancellare contenuti autentici e di valore, mentre la presenza umana resta fondamentale per preservare la qualità delle comunità online

Leggi di più

Chatbot AI e crisi: i rischi reali per chi cerca aiuto

Casi recenti mostrano come ChatGPT e altri chatbot possano fallire nel supporto a persone in crisi, con conseguenze gravi. Esperti chiedono maggiore trasparenza sui dati di sicurezza e interventi concreti per tutelare gli utenti vulnerabili

Leggi di più