1. Accueil
  2. Sécurité
Sécurité

Sécurité des agents IA : accès, limites et protection

Un agent qui agit en votre nom hérite de votre pouvoir d’action. La sécurité dépend donc moins du logiciel que de la part de ce pouvoir que vous choisissez de lui déléguer.

Une réponse erronée d’un chatbot vous laisse avec un paragraphe médiocre. Une erreur d’un agent peut envoyer un e-mail, accepter une offre ou ouvrir un fichier qu’il n’aurait jamais dû voir. Les incidents survenus depuis le début de 2026, qu’il s’agisse d’un acheteur sur Marketplace qui a découvert l’adresse d’un vendeur ou d’un agent de recherche qui a contourné un portail gouvernemental, ont un point commun : l’agent avait plus de latitude que ne l’exigeait la tâche. Ce guide explique comment la réduire et ne l’élargir qu’une fois la confiance acquise.

Pourquoi les agents changent la donne en matière de risques

Les réponses restent à l’écran ; les actions, elles, en sortent. Dès qu’un logiciel peut envoyer, payer, réserver et se connecter à votre place, un malentendu n’est plus une simple faute de frappe : il devient un événement réel, souvent irréversible. Les agents lisent aussi en permanence, et tout ce qu’ils lisent peut contenir des instructions insérées par quelqu’un d’autre : c’est ce qu’on appelle l’injection de prompt. Ils rendent également compte de leur travail, mais le compte rendu n’est pas le travail lui-même : OpenAI a notamment mis GPT-6.1 Astra de côté après que des tests ont révélé que le modèle décrivait parfois ses actions de façon inexacte. Le modèle n’est qu’une couche de protection ; ce sont surtout les autorisations qui l’entourent qui assurent votre sécurité.

Les autorisations que vous accordez vraiment

Connecter une boîte de réception semble être une seule décision, mais cela en implique plusieurs : lire tous les échanges, rédiger des réponses en votre nom et découvrir vos contacts. Une carte de paiement permet à l’agent de dépenser. Un navigateur connecté lui permet d’agir sur un site comme s’il était vous ; une cour d’appel américaine a déjà considéré qu’un tel agent était l’instrument de l’utilisateur. Les agents dans le cloud peuvent aussi conserver des copies : chaque compte Muse dispose de sa propre machine virtuelle, qui stocke les données que vous connectez. Avant de cocher une case, demandez-vous ce que l’agent pourrait faire avec cet accès dans le pire des cas, et non dans le meilleur.

Comment commencer progressivement

Commencez au premier échelon de l’échelle de confiance. Pendant la première semaine, laissez l’agent lire et faire des suggestions, mais envoyez, payez et acceptez vous-même. Connectez une ou deux applications plutôt que tout ce qui est proposé, et choisissez des tâches dont l’échec serait simplement agaçant : un résumé matinal, un brouillon de réponse, une sélection d’options. Établissez vos règles permanentes avant la première tâche, pas après la première erreur. Élargissez ensuite les accès une autorisation à la fois : si un problème survient, vous saurez exactement quel changement l’a provoqué.

En cas de problème : les premières mesures

Arrêtez tout d’abord, enquêtez ensuite. Mettez l’agent en pause et révoquez son accès à l’application concernée ; ce sera bien plus simple si vous avez repéré les commandes nécessaires au préalable, par temps calme. Consultez ensuite le journal d’activité au lieu de demander à l’agent ce qui s’est passé : son récit peut être incomplet ou tout simplement erroné. Modifiez vous-même tout mot de passe ou toute clé auxquels il pouvait accéder. Si vous hébergez OpenClaw vous-même et utilisiez une version présentant des failles connues, renouvelez tous les identifiants. Enfin, transformez la leçon en règle écrite, pour éviter que la même faille ne se reproduise.

Les niveaux de confiance

  1. Observer uniquement

    L’agent lit et rend compte, sans pouvoir modifier vos comptes. Tout nouvel agent devrait passer sa première semaine à ce niveau.

  2. Rédiger pour approbation

    Il prépare des réponses, des annonces et des factures, qui restent en attente jusqu’à ce que vous les envoyiez vous-même.

  3. Agir après approbation

    Il peut effectuer une action, mais seulement après votre confirmation. Ce niveau convient aux messages, aux paiements et à tout ce qui est partagé avec des inconnus.

  4. Agir dans les limites fixées

    Il agit seul dans un cadre défini — un petit plafond de dépenses ou une seule application de confiance, par exemple — et vous demande votre avis dès qu’il faut aller au-delà.

  5. Agir librement

    Il décide et agit sans vous consulter. Réservez cette option aux tâches à faible enjeu et réversibles, que vous l’avez vu réussir de nombreuses fois.

Sécuriser chaque agent

  • Rédigez vos règles personnalisées avant de connecter une boîte de réception, en classant chaque type d’action parmi celles qui sont autorisées, soumises à approbation ou interdites.
  • Laissez la recherche proactive activée : elle fonctionne avec un accès en lecture seule, et ses suggestions attendent votre approbation avant toute action.
  • Connectez votre ordinateur via l’application de bureau ChatGPT uniquement pour les tâches qui le nécessitent, puis coupez la connexion dès qu’elles sont terminées.
  • Au début, consultez chaque jour la vue Activité, y compris les tâches exécutées en arrière-plan par votre Dot pendant votre absence.
  • Avec une formule personnelle, ouvrez les contrôles des données et choisissez délibérément si vous souhaitez activer le paramètre « Améliorer le modèle pour tous », qui détermine si le travail de votre Dot peut servir à l’entraînement.
  • Envoyez à Muse une consigne écrite précisant que votre adresse personnelle, votre numéro de téléphone et votre emploi du temps quotidien ne doivent jamais être communiqués.
  • Exigez votre approbation avant qu’il ne paie quoi que ce soit, n’accepte une offre ou ne prenne contact avec une nouvelle personne.
  • Pour vendre sur Marketplace, organisez vous-même les modalités de retrait au lieu de communiquer votre adresse à Muse.
  • Ne connectez des comptes sensibles que pour la tâche en cours, car Muse copie les e-mails et fichiers connectés dans votre Muse Secure VM.
  • Gardez l’application à jour, tenez compte des avertissements de sécurité dans l’application de Meta et faites vos achats auprès de magasins qui acceptent Muse plutôt que sur Amazon, qui le bloque.
  • Choisissez application par application ce que Spark peut ouvrir — de Gmail et Google Calendar à Drive, Docs, Chrome et Photos — et commencez par en autoriser le moins possible.
  • Surveillez de près les tâches déclenchées par des événements au début et interrompez celles qui s’écartent de leur objectif, comme Google le recommande lui-même.
  • Lisez attentivement chaque demande de confirmation concernant une action sensible, au lieu de l’approuver machinalement.
  • Limitez-vous à quelques tâches bien définies au lieu d’utiliser les 15 créneaux parallèles, et supprimez les tâches planifiées dont vous n’avez plus besoin.
  • Avec un compte professionnel, demandez à l’administrateur de votre Workspace quels contrôles Spark sont appliqués avant de connecter quoi que ce soit.
  • N’ajoutez que les connecteurs nécessaires à la tâche en cours et déconnectez-les une fois celle-ci terminée.
  • Indiquez les sources que Claude peut consulter pour ses recherches, car chaque connecteur supplémentaire élargit l’ensemble des contenus auxquels il peut accéder.
  • Lisez chaque demande d’autorisation avant que Claude n’agisse dans une application connectée, au lieu de l’approuver par habitude.
  • Vérifiez les rapports, feuilles de calcul et présentations avant de les partager : ils peuvent contenir des éléments issus de vos fichiers connectés.
  • Examinez les résultats des tâches longues à votre retour : Claude continue de travailler après la fermeture de votre ordinateur portable.
  • Utilisez la dernière version stable : toute version antérieure à 2026.4.22 comporte des failles critiques connues. Si vous avez déjà utilisé une telle version, remplacez toutes les clés auxquelles elle a pu accéder.
  • Laissez gateway.bind défini sur loopback et accédez à la passerelle uniquement via une connexion SSH ou Tailscale, jamais par un port exposé à Internet.
  • Laissez dmPolicy sur pairing afin qu’un inconnu qui trouve votre bot reçoive un code, et non votre agent.
  • Utilisez les validations d’exécution pour que chaque commande shell nécessite votre accord, et laissez le mode élevé désactivé.
  • Installez le moins de compétences possible, chacune provenant d’une source fiable, et prenez l’habitude d’exécuter régulièrement openclaw security audit.

Questions fréquentes des lecteurs

Puis-je confier l’accès à mes e-mails à un agent IA sans risque ?

Oui, à condition d’élargir les accès progressivement. Commencez par la lecture seule : l’agent pourra résumer les messages et en rédiger des brouillons, mais tout e-mail envoyé depuis votre compte devra toujours passer par vous. Dressez la liste des informations qu’il ne doit jamais divulguer — votre adresse personnelle, votre emploi du temps et votre numéro de téléphone, par exemple — et consultez le journal d’activité chaque jour pendant la première semaine.

Qu’est-ce que l’injection de prompt et comment s’en protéger ?

L’injection de prompt consiste à insérer des instructions dans des contenus lus par l’agent — un plug-in, un document, un e-mail ou une page web, par exemple — qu’il peut ensuite suivre comme si vous les aviez écrites. Aucun réglage ne supprime entièrement le risque. Une règle permanente précisant que tout ce qu’il lit est une source d’information, et non un ordre, peut aider. En réservant les actions irréversibles à votre approbation, vous limitez aussi les dégâts qu’une injection réussie pourrait causer.

Quel est l’agent IA personnel le plus sûr ?

Aucun n’est sûr par défaut, et chacun a ses propres failles. Dots associe les règles personnalisées à une vérification automatique ; Muse et Claude demandent votre accord avant les étapes sensibles ; Gemini Spark réclame une confirmation pour les actions sensibles. Avec OpenClaw, toute la sécurité repose sur vous. En pratique, l’agent le plus sûr est celui que vous avez configuré de façon restrictive et que vous surveillez de près.

Dois-je laisser mon agent IA effectuer des achats ?

Seulement en fixant une limite. Donnez-lui sa propre carte virtuelle, plafonnée à un petit montant, plutôt que votre carte habituelle ou vos identifiants bancaires. Ainsi, une boucle ou un malentendu ne vous coûtera qu’une somme modeste et connue. Pour commencer, exigez votre approbation pour chaque achat ; vous pourrez ensuite assouplir la règle pour les petites commandes récurrentes.