라벨이 간접프롬프트인젝션인 게시물 표시

AI 프롬프트 인젝션이란 사용자가 조심할 점

이미지
AI 프롬프트 인젝션이란 사용자가 조심할 점 웹페이지와 파일 속 문장이 AI의 지시처럼 처리될 수 있는 위험을 이해하고 실행 전 확인 습관을 정리합니다. NIST 프롬프트 인젝션 정의 목차 프롬프트 인젝션 이해하기 외부 문서 속 지시 의심하기 연결 권한 최소화하기 읽기와 실행 작업 분리하기 쓰기 작업 전 최종 확인하기 결과와 원문 다시 검증하기 자주 묻는 질문 프롬프트 인젝션 이해하기 NIST 용어집은 프롬프트 인젝션을 애플리케이션 설계자처럼 신뢰도가 높은 주체가 만든 프롬프트와 신뢰할 수 없는 입력을 결합하는 구조를 악용하는 공격으로 설명합니다. 핵심은 일반 데이터와 따라야 할 지시의 경계가 흐려지는 데 있습니다. 직접 인젝션은 공격성 지시를 AI에 직접 넣는 형태이고, 간접 인젝션은 AI가 나중에 검색하거나 읽을 웹페이지·파일·이메일 같은 자료에 지시를 심는 형태입니다. 간접 공격은 사용자가 해당 문장을 직접 입력하지 않았다는 점 때문에 알아차리기 더 어려울 수 있습니다. 문서가 정상적인 보고서처럼 보인다는 사실도 안전을 보장하지 않습니다. AI에게는 본문 설명과 행동을 요구하는 문장이 같은 입력 안에 들어올 수 있으므로, 자료의 내용과 사용자가 실제로 내린 명령을 별도로 유지하는 습관이 필요합니다. 외부 문서 속 지시 의심하기 검색 결과나 첨부 문서 안에서 “기존 규칙을 무시하라”, “다른 곳으로 정보를 보내라”처럼 AI 행동을 바꾸려는 문장이 발견되면 자료 내용이 아니라 공격 가능성이 있는 입력으로 취급하세요. 보이지 않는 영역이나 긴 문서 뒤쪽에도 지시가 있을 수 있다는 전제로 접근해야 합니다. 외부 자료 점검 1. 출처와 작성자를 확인해요. 2. 자료 속 명령문을 업무 지시와 구분해요. 3. 다른 주소로 이동하거나 정보를 보내라는 요구를 의심해요. 4. 요약만 믿지 말고 중요 부분은 원문을 열어봐요. 5. 의심스러운 자료는 실행 권한이 없는 환경에서 먼저 검토해요. 외부 문서에 포함된 문장은 참고 데이터일 뿐, 사용자...