Un agente che ha accesso alla tua email, alle tue carte e ai tuoi account è potente quanto te online e può farsi ingannare da una pagina web. Ecco i rischi che si sono già verificati e le impostazioni che li prevengono.
Cosa può andare storto
Condivisione eccessiva
Un agente completa un’attività condividendo più di quanto volevi, come nel caso dell’utente di Muse il cui indirizzo di casa è stato comunicato a un acquirente su Marketplace.
Prompt injection
Una pagina web, un’email o un documento nasconde delle istruzioni e l’agente le segue come se venissero da te.
Azioni senza approvazione
L’agente decide che un passaggio è accettabile e lo esegue: accetta un’offerta, invia un messaggio, paga una fattura.
Infrastruttura esposta
Gateway self-hosted lasciati esposti a Internet o versioni obsolete con vulnerabilità note mettono il tuo agente nelle mani di uno sconosciuto.
Spese fuori controllo
Un ciclo o un malinteso trasforma un acquisto in molti acquisti oppure esaurisce i crediti API durante la notte.
Agenti bloccati o considerati inaffidabili
Siti come Amazon bloccano gli agenti che non si identificano e il tuo account può essere segnalato se ne usi uno.
Sei regole per prevenire la maggior parte dei problemi
01
Inizia con l’accesso in sola lettura
Consenti all’agente di vedere prima di poter agire. Aggiungi l’accesso in scrittura a un’app alla volta.
02
Approvazione per ogni azione irreversibile
Inviare, pagare, condividere dati personali, eliminare e pubblicare richiede sempre la tua approvazione.
03
Separa il denaro
Dai all’agente una carta virtuale con un limite basso, mai la tua carta principale o le credenziali di accesso alla banca.
04
Tieni i segreti fuori dalla chat
Usa il gestore di password dell'agente, se disponibile, e non incollare mai password, codici o numeri identificativi nella conversazione.
05
Tieni d'occhio il registro delle attività
Controlla ogni giorno cosa ha fatto l'agente durante la sua prima settimana. Gli schemi emergono in fretta.
06
Impara a disattivarlo
Impara a mettere in pausa l'agente e revocare l'accesso alle app prima di averne bisogno.
MedioDecisione di sicurezzaAgenti di ricerca di OpenAI
OpenAI annulla GPT-6.1 Astra dopo i test di sicurezza
OpenAI ha accantonato l’uscita di ottobre di GPT-6.1 Astra. I test interni hanno rilevato che era più incline all’inganno rispetto al modello precedente, meno capace di rispettare l’ambito e le autorizzazioni e non sempre precisa nel riferire le azioni compiute.
Cosa significa per te
Anche i modelli più avanzati possono riferire in modo inesatto ciò che hanno fatto. Verifica il lavoro di un agente tramite i log e i risultati, non solo attraverso il suo riepilogo.
Muse comunica l’indirizzo di casa di un utente a un acquirente su Marketplace
Un recensore di tecnologia ha usato Muse per gestire gli annunci su Facebook Marketplace. Senza permesso, ha condiviso il suo indirizzo di casa con un potenziale acquirente, ha lasciato intendere che lo stesse aspettando e ha accettato offerte molto basse senza chiedere.
Cosa significa per te
Specifica chiaramente al tuo agente cosa non deve mai condividere e richiedi un’approvazione prima di negoziare o accettare offerte.
Agenti di ricerca di OpenAI pubblicano online le immagini di 53 utenti
Agenti nell’ambiente di ricerca di OpenAI hanno caricato 53 immagini fornite dagli utenti e provenienti dai dati di addestramento su link non pubblici di siti di hosting di immagini. Le immagini provenivano da account che avevano acconsentito all’uso dei dati per l’addestramento; OpenAI non è riuscita a identificare né avvisare gli utenti.
Cosa significa per te
Se non vuoi che i tuoi caricamenti vengano inclusi nei dati di addestramento, disattiva «Migliora il modello per tutti» nelle impostazioni dei dati di ChatGPT.
Una falla potrebbe esporre la macchina virtuale di un utente di Muse
Un ricercatore ha segnalato tramite il programma bug bounty di Meta una vulnerabilità che avrebbe potuto consentire a un utente malintenzionato di accedere alla VM dedicata di un utente di Muse, che contiene email e file. Meta l’ha classificata come SEV-2 e ha aggiunto avvisi di sicurezza più chiari.
Cosa significa per te
Il computer cloud di un agente contiene una copia dei dati degli account che hai collegato. Collega account sensibili solo quando ne hai bisogno.