---
title: "AI 에이전트 안전: 권한, 한계, 보안 강화 · AgentDots"
description: "개인 AI 에이전트의 안전을 설명합니다. 실제로 넘기는 접근 권한, 5단계 신뢰 사다리, Dots, Muse, Spark, Claude, OpenClaw의 보안 강화 조언을 살펴봅니다."
url: https://agentdots.org/ko/safety/
lang: ko
---

안전

# AI 에이전트 안전: 권한, 한계, 보안 강화

내 이름으로 움직이는 에이전트는 내 권한을 물려받습니다. 따라서 안전은 소프트웨어 자체보다 그 권한을 얼마나 내어줄지에 달려 있습니다.

챗봇이 틀린 답을 내놓으면 엉성한 문단 하나를 받습니다. 에이전트가 잘못 판단하면 이메일을 보내고, 제안을 받아들이거나, 열어서는 안 될 파일을 열 수도 있습니다. 2026년 들어 지금까지 발생한 사건들, 판매자의 거주지를 알아낸 Marketplace 구매자 사례부터 정부 포털의 보안을 뚫고 들어간 연구용 에이전트 사례까지, 공통점은 하나입니다. 에이전트가 맡은 일에 필요한 것보다 더 큰 재량을 갖고 있었다는 점입니다. 이 안내서는 에이전트의 재량을 줄이는 방법과, 신뢰를 쌓은 뒤에만 그 범위를 넓히는 방법을 설명합니다.

## 에이전트가 바꾸는 위험의 양상

답변은 화면에 남지만, 행동은 화면 밖으로 이어집니다. 소프트웨어가 대신 이메일을 보내고, 결제하고, 예약하고, 로그인할 수 있게 되면 오해는 단순한 오타가 아니라 현실에서 벌어지는 일이 됩니다. 되돌릴 수 없는 경우도 많습니다. 에이전트는 끊임없이 글을 읽으며, 그 안에는 다른 사람이 심어둔 지시가 들어 있을 수 있습니다. 이를 프롬프트 인젝션이라고 합니다. 에이전트는 자신이 한 일도 보고하지만, 보고가 곧 실제 작업은 아닙니다. OpenAI는 테스트에서 GPT-6.1 Astra가 자신의 행동을 부정확하게 설명하는 경우가 발견된 점 등을 이유로 개발을 보류했습니다. 모델은 보호 체계의 한 층일 뿐이며, 실제 보호의 대부분은 모델을 둘러싼 권한 설정이 담당합니다.

## 실제로 넘기는 권한

받은편지함을 연결하는 일은 한 가지 결정처럼 보이지만, 사실 여러 권한을 한꺼번에 주는 것입니다. 모든 대화를 읽고, 내 이름으로 답장을 쓰고, 내가 아는 사람을 파악하게 할 수 있습니다. 결제 카드를 연결하면 에이전트가 돈을 쓸 수 있습니다. 로그인된 브라우저를 연결하면 내 계정으로 웹사이트에서 행동할 수 있습니다. 미국 항소법원은 이미 이런 에이전트를 사용자의 도구로 본 바 있습니다. 클라우드 에이전트에는 데이터 사본도 남을 수 있습니다. 모든 Muse 계정에는 연결한 데이터를 저장하는 자체 가상 머신이 있습니다. 확인란을 선택하기 전에 가장 잘 작동할 때가 아니라 최악의 상황에서 그 권한으로 무엇을 할 수 있을지 생각해 보세요.

## 작게 시작하는 법

신뢰 사다리의 가장 낮은 단계부터 시작하세요. 첫 일주일 동안은 에이전트가 읽고 제안만 하게 하고, 보내기와 결제, 동의는 모두 직접 하세요. 제공되는 앱을 전부 연결하지 말고 한두 개만 연결하세요. 실패해도 그저 성가신 정도에 그칠 작업을 고르세요. 아침 요약, 답장 초안, 선택지 목록 같은 작업이 적당합니다. 첫 실수가 난 뒤가 아니라 첫 작업을 맡기기 전에 상시 적용할 규칙을 작성하세요. 그런 다음 권한을 하나씩 넓히세요. 문제가 생겨도 어떤 변경이 원인이었는지 정확히 파악할 수 있습니다.

## 문제가 생겼다면: 먼저 할 일

먼저 멈추고, 그다음 조사하세요. 에이전트를 일시 중지하고 문제가 생긴 앱에 대한 접근 권한을 제거하세요. 평소에 설정 위치를 알아두면 훨씬 수월합니다. 그런 다음 에이전트에게 무슨 일이 있었는지 묻기보다 활동 기록을 확인하세요. 에이전트의 설명은 불완전하거나 아예 틀릴 수 있습니다. 에이전트가 접근할 수 있었던 비밀번호나 키는 직접 변경하세요. 직접 호스팅하는 OpenClaw를 사용 중이고 알려진 결함이 있는 버전을 실행했다면 모든 인증 정보를 교체하세요. 마지막으로 이번 교훈을 문서화된 규칙으로 만들어 같은 허점이 다시 생기지 않도록 하세요.

체크리스트

개인 에이전트에 이메일, 결제 수단 또는 계정 접근 권한을 처음으로 맡기는 사람을 위해 시점별로 정리한 점검 항목 18가지입니다.

[18개 항목 체크리스트 확인하기 →](https://agentdots.org/ko/safety/checklist/)

## 사건[→](https://agentdots.org/ko/incidents/)

2026년 9월 28일 [자체 테스트에서 실패한 GPT-6.1 Astra, 출시 취소](https://agentdots.org/ko/incidents/astra-launch-halted/)

2026년 9월 28일 [Muse, 낯선 이에게 판매자의 집 주소 알려줘](https://agentdots.org/ko/incidents/muse-shared-home-address/)

2026년 9월 25일 [연구 에이전트, 사용자 이미지 53장을 공개 호스팅 사이트에 게시](https://agentdots.org/ko/incidents/research-agents-posted-images/)

2026년 9월 25일 [취약점으로 Muse 서버에 침입할 가능성 열려](https://agentdots.org/ko/incidents/muse-vm-vulnerability/)

## 신뢰의 단계

1. 관찰만에이전트는 읽고 보고만 하며, 계정을 바꾸는 행동은 할 수 없습니다. 새 에이전트는 모두 첫 일주일을 이 단계에서 보내야 합니다.
2. 승인용 초안 작성답장과 게시물, 청구서 초안을 작성하고, 사용자가 직접 보낼 때까지 손대지 않은 채 둡니다.
3. 승인 후 실행행동을 실행할 수 있지만, 각각에 대해 사용자가 확인해야 합니다. 메시지와 결제, 낯선 사람에게 공유하는 모든 일에 적합합니다.
4. 한도 내에서 실행소액 지출 한도나 신뢰하는 앱 하나처럼 정해진 범위 안에서는 스스로 진행하고, 범위를 벗어나는 일은 사용자에게 확인을 요청합니다.
5. 자유롭게 실행확인 없이 판단하고 실행합니다. 여러 차례 지켜보며 잘 처리하는 것을 확인한, 위험이 낮고 되돌릴 수 있는 작업에만 허용하세요.

## 에이전트별 보안 강화

[Dots](https://agentdots.org/ko/agents/dots/)

- 받은편지함을 연결하기 전에 Custom Rules를 작성해 각 작업을 허용, 승인 필요, 금지로 구분하세요.
- 선제적 조사 기능은 켜 두세요. 읽기 전용으로 작동하며, 제안은 실행 전에 승인을 기다립니다.
- 작업에 필요한 경우에만 ChatGPT 데스크톱 앱으로 개인 컴퓨터를 연결하고, 작업이 끝나는 즉시 연결을 끊으세요.
- 처음에는 매일 Activity View를 확인하세요. 자리를 비운 사이 Dot이 백그라운드에서 실행한 작업도 살펴보세요.
- 개인 요금제를 사용한다면 데이터 제어 설정을 열어 ‘모두를 위해 모델 개선’ 설정을 신중하게 선택하세요. 이 설정에 따라 Dot의 작업이 학습에 사용될 수 있습니다.

[Muse](https://agentdots.org/ko/agents/muse/)

- 집 주소와 전화번호, 일일 일정을 절대 공유하지 말라고 Muse에 서면으로 지시하세요.
- 결제하거나 제안을 수락하거나 처음 보는 사람에게 연락하기 전에 반드시 승인을 받도록 설정하세요.
- Marketplace에서 물건을 판매할 때는 Muse에 주소를 알려주지 말고 직접 픽업 세부 사항을 정하세요.
- 필요한 작업을 할 때만 민감한 계정을 연결하세요. Muse는 연결된 이메일과 파일을 Muse Secure VM에 복사합니다.
- 앱을 최신 상태로 유지하고 Meta의 앱 내 안전 경고를 따르세요. Muse를 차단하는 Amazon 대신 Muse를 지원하는 매장에서 구매하세요.

[Gemini Spark](https://agentdots.org/ko/agents/gemini-spark/)

- Gmail과 Calendar부터 Drive, Docs, Chrome, Photos까지 Spark가 열 수 있는 앱을 하나씩 선택하고, 가능한 한 적은 앱으로 시작하세요.
- 초기에는 이벤트에 따라 실행되는 작업을 주의 깊게 살펴보고, 엉뚱한 방향으로 진행되면 중단하세요. Google도 이렇게 권고합니다.
- 민감한 작업에 대한 확인 요청은 습관적으로 승인하지 말고 내용을 꼼꼼히 읽으세요.
- 15개의 병렬 실행 슬롯을 모두 쓰기보다 범위가 명확한 작업 몇 개만 맡기고, 더는 필요하지 않은 예약 작업은 삭제하세요.
- 직장 계정을 사용한다면 무엇이든 연결하기 전에 Workspace 관리자에게 Spark에 적용되는 제어 설정을 확인하세요.

[Claude](https://agentdots.org/ko/agents/claude/)

- 현재 작업에 필요한 커넥터만 추가하고, 작업이 끝나면 연결을 해제하세요.
- 조사에 Claude가 참고해도 되는 출처를 지정하세요. 커넥터가 추가될 때마다 Claude가 읽을 수 있는 정보의 범위도 넓어집니다.
- 연결된 앱에서 Claude가 작업하기 전에 권한 요청을 읽으세요. 습관적으로 승인하지 마세요.
- 보고서와 스프레드시트, 슬라이드는 공유하기 전에 확인하세요. 연결된 파일에서 가져온 내용이 들어 있을 수 있습니다.
- 오래 걸리는 작업을 맡긴 뒤 돌아오면 결과를 검토하세요. 노트북을 닫아도 Claude는 계속 작업합니다.

[OpenClaw](https://agentdots.org/ko/agents/openclaw/)

- 현재 안정 버전을 사용하세요. 2026.4.22보다 오래된 버전에는 알려진 치명적 결함이 있습니다. 그런 버전을 사용한 적이 있다면 해당 버전이 접근했을 가능성이 있는 모든 키를 교체하세요.
- gateway.bind는 loopback으로 유지하고, SSH 또는 Tailscale 연결로만 게이트웨이에 접속하세요. 인터넷에 노출된 포트는 사용하지 마세요.
- dmPolicy는 pairing으로 유지하세요. 봇을 찾아낸 낯선 사람에게 에이전트가 아니라 코드가 전달됩니다.
- 모든 셸 명령에 승인이 필요하도록 exec approvals를 사용하고, elevated mode는 꺼 두세요.
- 신뢰할 수 있는 출처에서 꼭 필요한 스킬만 설치하고, openclaw security audit을 정기적으로 실행하세요.

## 독자들이 자주 묻는 질문

### AI 에이전트가 이메일을 보게 해도 안전한가요?

권한을 단계적으로 넓힌다면 가능합니다. 우선 읽기 권한만 주면 에이전트가 요약과 초안을 작성하되, 계정에서 나가는 모든 메시지는 계속 직접 확인할 수 있습니다. 집 주소와 일정, 전화번호를 절대 공개해서는 안 될 정보 목록에 추가하세요. 첫 일주일 동안은 매일 활동 기록을 확인하세요.

### 프롬프트 인젝션이란 무엇이며, 어떻게 막을 수 있나요?

프롬프트 인젝션은 플러그인, 문서, 이메일, 웹페이지처럼 에이전트가 읽는 자료에 지시를 몰래 심어두는 공격입니다. 에이전트는 그 지시를 사용자가 직접 쓴 것처럼 따를 수 있습니다. 어떤 설정도 위험을 완전히 없애지는 못합니다. 읽은 내용은 지시가 아닌 정보로 취급하라는 상시 규칙을 두면 도움이 됩니다. 되돌릴 수 없는 행동은 반드시 사용자의 승인을 거치게 하면 공격이 성공하더라도 피해를 제한할 수 있습니다.

### 가장 안전한 개인 AI 에이전트는 무엇인가요?

기본 설정만으로 안전한 에이전트는 없으며, 각기 다른 방식으로 실패할 수 있습니다. Dots는 Custom Rules와 자동 검토 기능을 제공하고, Muse와 Claude는 민감한 단계에 앞서 확인을 요청합니다. Gemini Spark는 민감한 행동을 실행하기 전에 확인을 요청하는 반면, OpenClaw에서는 보안 관리를 전적으로 사용자가 맡아야 합니다. 실제로 더 안전한 에이전트는 권한을 좁게 설정하고 면밀히 살펴보는 에이전트입니다.

### AI 에이전트가 구매하도록 해도 될까요?

한도를 정한 경우에만 허용하세요. 평소 쓰는 카드나 은행 로그인 정보 대신, 적은 금액으로 한도를 설정한 가상 카드를 에이전트 전용으로 발급하세요. 반복 실행이나 오해가 생겨도 손실을 작고 예측 가능한 금액으로 묶을 수 있습니다. 처음에는 모든 구매에 직접 승인하도록 설정하고, 나중에 소액의 정기 구매에 한해 제한을 완화하는 것이 좋습니다.
