안녕하세요. 박재화 전문가입니다.
생성형 AI 보안은 단순하게 금지어를 막는 방식보다는 여러 단계로 나눠서 방어하는 것이 아무래도 중요합니다. 프롬프트 인젝션이나 우회명령은 완전히 차단하기는 어렵기 때문에 될 수 있으면 AI가 외부 시스템을 실행할 수 있는 권한 자체를 최소화하고 중요한 작업은 추가 확인을 거치게 하는 것이 좋습니다.
회사에서 사내 문서나 개인정보처럼 민감한 데이터들은 AI가 꼭 필요한 범위에서만 접근할 수 있도록 하고, 출력 과정에서도 정보가 노출되지 않는지를 별도로 점검해야 합니다. AI가 생성한 코드나 명령을 곧바로 실행하지 마시고 샌드박스 같은 격리된 환경에서 검사한 뒤 사용하는 것도 중요한 대응 방법이구요.
제 생각에는 생성형 AI 보안의 핵심은 AI를 무조건 믿지 마시고 실수하거나 속을 수 있다는 전제 아래에서 권환과 데이터 접근을 제한하는 구조를 만드는 곳에 있다고 봅니다.