보안 필터가 읽지 못하는 암호문을
AI가 직접 해독한다면 어떻게 될까요?

최근 AI 보안기업 Adversa AI는
xAI의 생성형 AI 서비스 Grok을 대상으로
새로운 프롬프트 인젝션 기법을 실증했습니다
연구진은 이를 ‘암호화 컨텍스트 인젝션(Cryptographic Context Injection)’이라고 명명했습니다
이번 사례에서는 악성 지시문을 그대로 입력하는 대신,
암호화된 상태로 웹페이지에 숨겨 보안 필터의 탐지를 우회했습니다
이후 Grok이 암호문을 직접 해독하면서
숨겨진 명령이 AI의 실행 과정에 포함됐습니다
프롬프트 인젝션이란?

프롬프트 인젝션은 AI가 공격자가 심어놓은
지시를 정상적인 데이터로 오인해
수행하도록 유도하는 공격 방식입니다.
특히 웹페이지나 문서, 이메일 등에 악성 지시문을 숨기는
‘간접 프롬프트 인젝션’은 사용자가 공격 문구를
직접 입력하지 않아도 발생할 수 있습니다.
예를 들어 사용자가 AI에 특정 웹페이지를 요약해달라고 요청했을 때,
해당 페이지에 숨겨진 명령까지 AI가 읽고 수행할 가능성이 있습니다.
암호화된 명령은 어떻게 보안 필터를 통과했을까?
이번 실증은 다음과 같은 흐름으로 진행됐습니다.

1.공격자가 웹페이지에 암호화된 악성 지시문과 복호화에 필요한 정보를 삽입합니다.
2.사용자가 Grok에 해당 웹페이지의 내용 요약을 요청합니다.
3.보안 필터에는 암호화된 의미 없는 문자열만 보이기 때문에 악성 명령으로 탐지하지 못합니다.
4.Grok이 코드 실행 환경에서 암호문을 직접 복호화합니다.
5.복호화된 악성 지시문이 AI가 수행해야 할 정상적인 명령처럼 처리됩니다.
6.사용자 정보와 대화 내용이 공격자 서버로 전송되는 흐름이 실행됩니다.
연구진의 시연에서는 사용자의 이름, 대략적인 위치, 구독 정보와
현재 대화에 포함된 프롬프트가 외부 URL의 매개변수에 포함되는 방식으로 전송됐습니다.
기존 보안 필터가 사용자의 최초 입력값을 검사하더라도,
AI가 도구나 코드 실행을 통해 새롭게 생성한 중간 결과까지
검사하지 못하면 보안 공백이 발생할 수 있다는 점을 보여줍니다.
실제 해킹 사고가 발생한 것은 아닙니다
이번 사례는 실제 공격으로 인한 피해가 확인된 보안 사고가 아니라,
보안 연구진이 수행한 개념증명(PoC)입니다.
연구진은 2026년 6월 3일 관련 내용을
xAI와 버그바운티 플랫폼에 신고했으며,
8월 19일 기준 해당 방식이 Grok 웹 환경에서 재현됐다고 밝혔습니다.
현재 공개된 CVE 번호는 없으며,
실제 공격에 악용됐다는 증거도 보고되지 않았습니다.
따라서 ‘Grok 사용자 정보가 대규모로 유출됐다’고
표현하는 것은 사실과 다릅니다.
정확하게는 ‘특정 조건에서 정보 유출로 이어질 수 있는
공격 방식이 보안 연구를 통해 실증됐다’고 보는 것이 적절합니다.
기업의 생성형 AI 보안에 필요한 것은 무엇일까?

이번 사례의 핵심은 단순히 Grok이라는 특정 서비스의 문제가 아닙니다.
생성형 AI가 웹페이지와 문서를 읽고, 코드를 실행하고, 외부 서비스와 연결되는
에이전트 형태로 발전하면서 AI가 처리하는 정보의 범위와 권한도 함께 확대되고 있습니다.
기업은 생성형 AI 자체의 보안 기능에만 의존하지 않고
다음과 같은 관리 체계를 함께 마련해야 합니다.
-웹페이지·문서·이메일 등 외부 콘텐츠를 신뢰할 수 없는 입력값으로 관리
-AI의 코드 실행과 외부 네트워크 접근 권한 최소화
-중요 작업 및 외부 전송 전 사용자 승인 절차 적용
-사용자·그룹별 생성형 AI 사용 정책 설정
-프롬프트와 첨부파일에 포함된 개인정보·기밀정보 사전 점검
-AI 사용 및 차단 이력에 대한 지속적인 모니터링
특히 AI가 유출할 수 있는 정보 자체가
입력되지 않도록 관리하는 것이 중요합니다.
개인정보나 기업 기밀이 AI 대화에 포함되지 않았다면
공격이 성공하더라도 외부로 전달될 수 있는 중요정보의 범위를 줄일 수 있기 때문입니다.
생성형 AI를 차단하는 대신, 안전하게 통제해야 합니다

Sphinx AI는 ChatGPT, Claude, Gemini 등 생성형 AI 서비스에
프롬프트와 첨부파일이 전달되기 전에
개인정보·민감정보·기업 기밀정보 포함 여부를 분석합니다.
탐지된 정보는 기업의 보안 정책에 따라 입력을 차단하거나 마스킹·치환할 수 있으며,
사용자와 그룹별 정책 설정 및 사용 이력 관리도 지원합니다.
이번 Grok 사례처럼 AI의 실행 환경에서 발생하는
모든 공격을 하나의 솔루션만으로 방어할 수는 없습니다.
그러나 중요정보가 외부 AI 서비스의 대화 맥락에 포함되기 전에 통제하면,
프롬프트 인젝션이나 계정 오용 등의 문제가 발생했을 때
정보 유출 피해를 줄이는 중요한 보호 계층이 될 수 있습니다.
생성형 AI의 편리함은 유지하면서
기업의 중요정보는 안전하게 보호해야 합니다.
업무 생산성과 데이터 보안, 모두 놓칠 수 없으니까.
생성형 AI 데이터 보안 솔루션 Sphinx AI로
기업의 AI 사용 환경을 안전하게 관리해보세요!
서비스 문의
02-396-7005 (503~505)
ask@comtrue.com
Posted by. ComTrue Technologies, Inc.
AI PLATFORM – COMETRUE.AI

