---
title: "Sicurezza degli agenti AI: permessi, limiti e protezioni · AgentDots"
description: "La sicurezza degli agenti AI personali, spiegata: quali accessi concedi davvero, una scala di fiducia in cinque livelli e consigli per proteggere Dots, Muse, Spark, Claude e OpenClaw."
url: https://agentdots.org/it/safety/
lang: it
---

Sicurezza

# Sicurezza degli agenti AI: permessi, limiti e protezioni

Un agente che agisce a tuo nome eredita la tua capacità d’azione: la sicurezza dipende quindi meno dal software che da quanta parte di questa capacità scegli di affidargli.

Se un chatbot sbaglia, ti consegna un paragrafo scadente. Se sbaglia un agente, può inviare un’email, accettare un’offerta o aprire un file che non avrebbe mai dovuto vedere. Gli incidenti del 2026 finora — da un acquirente su Marketplace che ha scoperto dove viveva un venditore a un agente di ricerca che ha aggirato un portale governativo — hanno un elemento in comune: l’agente aveva più margine di manovra di quanto richiedesse il compito. Questa guida spiega come limitarlo e come concedergli più spazio solo quando se lo sarà guadagnato.

## Perché gli agenti cambiano il profilo di rischio

Le risposte restano sullo schermo; le azioni ne escono. Quando un software può inviare, pagare, prenotare e accedere ai servizi al posto tuo, un malinteso non è più un refuso: diventa un fatto concreto, spesso irreversibile. Gli agenti leggono continuamente, e ciò che leggono può contenere istruzioni inserite da altri: una tecnica chiamata prompt injection. Inoltre, riferiscono del proprio operato, ma il resoconto non coincide con il lavoro svolto. OpenAI ha accantonato GPT-6.1 Astra anche perché i test hanno rilevato che a volte descriveva le proprie azioni in modo impreciso. Il modello è solo un livello di protezione; a fare la differenza sono soprattutto i permessi che lo circondano.

## Quali permessi stai concedendo davvero

Collegare la posta in arrivo sembra un’unica decisione, ma in realtà ne comporta diverse: leggere tutte le conversazioni, scrivere risposte a tuo nome e scoprire con chi sei in contatto. Una carta di pagamento permette all’agente di spendere. Un browser con accesso attivo gli consente di agire sui siti come se fossi tu; una corte d’appello statunitense ha già considerato un agente del genere uno strumento dell’utente stesso. Anche gli agenti basati sul cloud possono conservare copie: ogni account Muse dispone di una macchina virtuale che archivia i dati collegati. Prima di spuntare una casella, chiediti cosa potrebbe fare l’agente con quell’accesso nel suo giorno peggiore, non in quello migliore.

## Come iniziare con poco

Parti dal gradino più basso della scala di fiducia. Per la prima settimana, lascia che l’agente legga e proponga, mentre invii, paghi e accetti tutto tu. Collega una o due app, non tutte quelle disponibili, e scegli compiti il cui fallimento sarebbe solo seccante: un riepilogo mattutino, una bozza di risposta, una lista ristretta di opzioni. Scrivi le regole permanenti prima del primo incarico, non dopo il primo errore. Poi amplia l’accesso un permesso alla volta, così, se qualcosa va storto, saprai esattamente quale modifica l’ha causato.

## Se qualcosa va storto: cosa fare subito

Fermati prima, indaga dopo. Metti in pausa l’agente e revocagli l’accesso all’app interessata: sarà molto più semplice se avrai individuato i comandi necessari in un momento tranquillo. Poi controlla il registro delle attività, invece di chiedere all’agente cosa è successo: il suo resoconto potrebbe essere incompleto o semplicemente sbagliato. Cambia personalmente ogni password o chiave a cui poteva accedere; se usi OpenClaw in hosting autonomo e avevi una versione con vulnerabilità note, sostituisci tutte le credenziali. Infine, trasforma la lezione in una regola scritta, così la stessa falla non si ripresenterà.

Lista di controllo

Diciotto controlli, suddivisi per momento, per chi affida per la prima volta a un agente personale l’accesso alla propria email, ai propri soldi o ai propri account.

[Completa la lista di controllo in 18 punti →](https://agentdots.org/it/safety/checklist/)

## Incidenti[→](https://agentdots.org/it/incidents/)

28 settembre 2026 [GPT-6.1 Astra ritirato dopo aver fallito i propri test](https://agentdots.org/it/incidents/astra-launch-halted/)

28 settembre 2026 [Muse rivela a uno sconosciuto l’indirizzo di casa del venditore](https://agentdots.org/it/incidents/muse-shared-home-address/)

25 settembre 2026 [Agenti di ricerca pubblicano 53 immagini degli utenti su siti pubblici](https://agentdots.org/it/incidents/research-agents-posted-images/)

25 settembre 2026 [Una falla poteva aprire la strada ai sistemi Muse](https://agentdots.org/it/incidents/muse-vm-vulnerability/)

## La scala della fiducia

1. Solo osservazioneL’agente legge e riferisce, ma non può modificare nulla nei tuoi account. Ogni nuovo agente dovrebbe restare a questo livello per la prima settimana.
2. Bozze da approvarePrepara risposte, inserzioni e fatture, che restano in sospeso finché non le invii tu.
3. Agire previa approvazionePuò eseguire l’azione, ma solo dopo la tua conferma. È la scelta giusta per messaggi, pagamenti e tutto ciò che viene condiviso con persone che non conosci.
4. Agire entro limiti stabilitiProcede autonomamente entro confini precisi, come un piccolo tetto di spesa o una singola app fidata, e ti chiede conferma per tutto ciò che li supera.
5. Agisci liberamenteDecide e agisce senza chiederti conferma. Riserva questa opzione a lavori con rischi contenuti e reversibili, che hai già visto svolgere bene molte volte.

## Mettere in sicurezza ogni agente

[Dots](https://agentdots.org/it/agents/dots/)

- Scrivi le tue Regole personalizzate prima di collegare una casella email, classificando ogni tipo di azione come consentita, soggetta ad approvazione o vietata.
- Lascia attiva la ricerca proattiva: funziona con accesso in sola lettura e le proposte attendono la tua approvazione prima che venga fatto qualsiasi cosa.
- Collega il tuo computer tramite l’app desktop di ChatGPT solo per le attività che lo richiedono e interrompi il collegamento appena sono concluse.
- All’inizio controlla ogni giorno la Vista attività, compresi i lavori che il tuo Dot ha svolto in background mentre eri via.
- Con un piano personale, apri i controlli dei dati e decidi consapevolmente se attivare l’opzione «Migliora il modello per tutti», che determina se il lavoro del tuo Dot può essere usato per l’addestramento.

[Muse](https://agentdots.org/it/agents/muse/)

- Invia a Muse un’istruzione scritta per specificare che il tuo indirizzo di casa, il numero di telefono e gli impegni quotidiani non devono mai essere condivisi.
- Richiedi la tua approvazione prima che paghi qualcosa, accetti un’offerta o contatti una persona nuova.
- Quando vendi su Marketplace, organizza tu i dettagli del ritiro, senza comunicare mai l’indirizzo a Muse.
- Collega gli account sensibili solo per il lavoro da svolgere, perché Muse copia le email e i file collegati nella tua Muse Secure VM.
- Mantieni l’app aggiornata, segui gli avvisi di sicurezza di Meta al suo interno e acquista nei negozi che accettano Muse, non su Amazon, che lo blocca.

[Gemini Spark](https://agentdots.org/it/agents/gemini-spark/)

- Scegli, app per app, a quali Spark può accedere: da Gmail e Calendar a Drive, Docs, Chrome e Photos. All’inizio limitati a poche app.
- Nei primi giorni controlla con attenzione le attività attivate da eventi e interrompi quelle che deviano dal compito, come consiglia Google stessa.
- Leggi attentamente ogni richiesta di conferma per un’azione sensibile, invece di approvarla d’istinto.
- Limita l’uso a poche attività ben definite, invece di sfruttare tutti e 15 gli slot paralleli, ed elimina le attività pianificate che non ti servono più.
- Se usi un account di lavoro, chiedi all’amministratore di Workspace quali controlli di Spark sono attivi prima di collegare qualsiasi cosa.

[Claude](https://agentdots.org/it/agents/claude/)

- Aggiungi solo i connettori necessari per il lavoro in corso e scollegali una volta terminato.
- Specifica le fonti che Claude può consultare per le ricerche: ogni connettore aggiuntivo amplia ciò che può leggere.
- Leggi ogni richiesta di autorizzazione prima che Claude agisca in un’app collegata, invece di approvare per abitudine.
- Controlla report, fogli di calcolo e presentazioni prima di condividerli: potrebbero contenere materiale tratto dai tuoi file collegati.
- Quando torni, controlla i risultati delle attività più lunghe: Claude continua a lavorare anche dopo che chiudi il portatile.

[OpenClaw](https://agentdots.org/it/agents/openclaw/)

- Usa la versione stabile più recente: tutte quelle precedenti alla 2026.4.22 presentano falle critiche note. Se hai usato una di queste versioni, sostituisci tutte le chiavi a cui potrebbe aver avuto accesso.
- Lascia gateway.bind impostato su loopback e accedi al gateway solo tramite una connessione SSH o Tailscale, mai attraverso una porta esposta a internet.
- Lascia dmPolicy su pairing, così chi trova il tuo bot riceverà un codice, non il tuo agente.
- Usa le approvazioni di exec, in modo che ogni comando shell richieda il tuo consenso, e lascia disattivata la modalità elevata.
- Installa meno skill possibile, scegliendole solo da fonti affidabili, e fai di openclaw security audit un controllo regolare.

## Domande frequenti dei lettori

### Posso dare accesso alla mia email a un agente AI senza correre rischi?

Sì, purché l’accesso aumenti per gradi. Inizia consentendo solo la lettura, così l’agente potrà riassumere e preparare bozze, mentre ogni messaggio in uscita continuerà a passare da te. Inserisci l’indirizzo di casa, i tuoi orari e il numero di telefono nell’elenco delle informazioni che non deve mai divulgare, e controlla ogni giorno il registro delle attività durante la prima settimana.

### Che cos’è la prompt injection e come posso difendermi?

La prompt injection consiste nell’inserire istruzioni in contenuti letti dall’agente — per esempio un plugin, un documento, un’email o una pagina web — che l’agente potrebbe poi seguire come se le avessi scritte tu. Nessuna impostazione elimina del tutto il rischio. Una regola permanente che consideri tutto ciò che legge come informazioni, non come ordini, aiuta; inoltre, riservare alla tua approvazione le azioni irreversibili limita i danni che può causare un attacco riuscito.

### Qual è l’agente AI personale più sicuro?

Nessuno è sicuro per impostazione predefinita e ciascuno può fallire a modo suo. Dots abbina le Regole personalizzate a una revisione automatica; Muse e Claude chiedono conferma prima dei passaggi delicati; Gemini Spark richiede una conferma per le azioni sensibili, mentre OpenClaw affida a te l’intera gestione della sicurezza. In pratica, l’agente più sicuro è quello che hai configurato con permessi limitati e che controlli da vicino.

### Dovrei permettere al mio agente AI di fare acquisti?

Solo fissando un tetto di spesa. Assegnagli una carta virtuale dedicata, con un limite basso, invece della carta che usi ogni giorno o delle credenziali bancarie: così un ciclo di acquisti o un malinteso avrà un costo contenuto e noto. Per iniziare, fai passare ogni acquisto dalla tua approvazione; in seguito potrai allentare il controllo per gli ordini ricorrenti di piccolo importo.
