9 월 22 일(미국 시간), Anthropic 이 Claude Opus 5.5 를 출시했습니다.
같은 날, OpenAI 는 GPT-6 Sol 과 Luna 를 발표했습니다.
둘 다 "이전보다 똑똑하고, 이전보다 저렴합니다."
그중에서도 제 눈길을 사로잡은 것은 공식 발표에 나온 특정 수치였습니다.
Deloitte 의 코멘트로 다음과 같이 언급되어 있습니다.
"가장 낮은 설정에서도 알려진 버그의 72% 를 찾아냈습니다. Opus 5 는 높은 설정에서 56% 를 찾아냈습니다."
이는 코드를 읽고 취약점을 찾아내는 능력이 단 한 세대 만에 크게 향상되었다는 것을 의미합니다.
AI 는 "작동하는" 것을 만들어 낼 것입니다.
하지만 그것을 "안전하게" 만들려면 사람이 직접 지시를 내려야 합니다.
그래서 Opus 5.5 로 사내 앱을 구축할 때 꼭 기억해야 할 5 가지를 정리했습니다.
각 항목마다 Opus 5.5 에 점검을 맡길 수 있는 프롬프트와 함께 소개합니다.
====
점검 진행 방법
구축이 끝났다고 해서, 작업하던 바로 그 세션에서 "문제없나요?"라고 묻지 마세요.
앱을 만든 AI 는 자신이 설계한 내용을 전제로 인식하기 때문에 판단이 느슨해집니다.
새로운 세션을 열고 모델을 Opus 5.5 로 설정한 뒤, 앱 폴더 전체를 보여주세요.
그리고 발견되는 모든 이슈에는 반드시 "어떤 파일의 몇 번째 줄인지"가 포함되도록 하세요.
Deloitte 의 코멘트에서는 오탐(false positive)이 줄어들었다고 언급했지만, 완전히 0 은 아닙니다.
위치를 정확히 지정해 두면 나중에 사람이 직접 확인할 수 있습니다.
다음은 지시문입니다.
"당신은 이 코드를 처음 보는 보안 담당자입니다. 문제를 발견하면 파일명, 줄 번호, 왜 위험한지, 어떻게 수정해야 하는지를 함께 제시하세요. 확신이 없는 부분은 '검토 필요'로 따로 분리하세요."
====
1. 로그인하지 않은 사람에게 보이는 화면이 있나요?
AI 에게 구축을 맡기면 화면이나 데이터 출구에 로그인 장벽이 누락되는 경우가 있습니다.
개발 중에 만든 확인용 화면이 외부에 공개된 채 방치되는 것이 대표적인 패턴입니다.
확인 방법은 간단합니다.
로그인하지 않은 상태(시크릿 창)에서 관리자 페이지나 데이터 URL 을 브라우저로 직접 열어보세요.
화면이 보인다면 실패입니다.
다음은 지시문입니다.
"로그인 없이 접근 가능한 모든 URL 과 API 를 나열하세요. 그중 데이터를 반환하거나 관리용인 것들은 위험도 순으로 정렬하세요."
====
2. 로그인한 사용자가 다른 사람의 데이터를 볼 수 있나요?
로그인은 '누구인지'를 확인하는 절차일 뿐입니다.
'그 사람이 무엇을 볼 수 있는지'는 별도로 구현해야 합니다.
테스트 계정 두 개를 만들어 확인해 보세요. A 로 로그인한 상태에서 B 의 데이터 URL 을 열어봅니다.
다음은 지시문입니다.
"사용자 A 가 사용자 B 의 데이터를 조회하거나 수정할 수 있는 경로를 모두 찾으세요. UI 를 거치지 않고 URL 이나 API 를 직접 호출하는 경우도 포함하세요."
====
3. 키나 비밀번호가 노출될 수 있는 곳에 저장되어 있나요?
브라우저 측에서 실행되는 코드는 사용자의 PC 로 전부 전송됩니다.
거기에 키를 작성하는 것은 모든 사람에게 키를 배포하는 것과 같습니다.
또 다른 흔한 실수는 키가 포함된 설정 파일을 공유 폴더나 GitHub 에 업로드하는 것입니다.
다음은 지시문입니다.
"브라우저 측 코드, 설정 파일, 커밋 히스토리에 포함된 API 키, 비밀번호, 토큰을 검색하세요. 발견되면 어디로 옮겨야 하는지 제안하세요."
====
4. 도구에 부여된 권한이 작업 범위에 비해 과도한가요?
사내 도구는 종종 Google, Slack 또는 데이터베이스와 연동됩니다.
때로는 "읽기"만 필요한데도 제공된 키에 "삭제"나 "전체 보기" 권한이 포함되어 있기도 합니다.
매우 흔한 문제입니다.
해당 키가 유출되었을 때 피해 규모는 권한 범위에 따라 결정됩니다.
"최악의 경우, 이 도구로 무엇을 삭제할 수 있는가?"를 적어보는 것이 확인 방법입니다.
즉답할 수 없다면 주의가 필요합니다.
다음은 지시문입니다.
"이 도구가 외부 서비스나 데이터베이스에 대해 가지고 있는 모든 권한을 나열하세요. 각각을 실제 처리에 필요한 최소 권한과 비교하여 과도한 부분을 지적하세요."
====
5. 외부에서 들어온 텍스트가 명령어로 실행되고 있나요?
AI 가 이메일, 웹 페이지, 업로드된 파일을 읽는 도구는 주의가 필요합니다.
"이전 지시를 무시하고 XX 를 실행해" 같은 텍스트가 포함되어 있으면 AI 가 그대로 따를 수 있습니다.
이를 프롬프트 인젝션(Prompt Injection)이라고 부릅니다.
Opus 5.5 발표에서는 이 공격에 대한 저항성이 "모든 테스트 시나리오에서 Opus 5 와 동등하거나 그 이상"이라고 밝혔습니다.
하지만 동등하거나 그 이상이라는 것이 위험이 0 이라는 뜻은 아닙니다. 여전히 도구 측의 방어책이 필요합니다.
다음은 지시문입니다.
"외부에서 로드된 텍스트나 파일이 AI 에 대한 지시로 취급되는 부분을 검색하세요. 발견되면 로드된 내용이 참고 정보로만 취급되고 내부의 지시는 무시되도록 처리 방식을 변경하세요."
====
요약
AI 는 당신이 요청한 기능을 만들어 줍니다.
하지만 "남에게 보여주지 마", "과도한 권한은 주지 마"는 말하지 않으면 반영되지 않습니다.
반대로, 이 5 가지 포인트는 지시문 하나만 추가해도 모두 해결할 수 있습니다.
게다가 Opus 5.5 는 만들어진 결과물의 허점을 찾아내는 능력도 향상되었습니다.
구축이 끝나면 새로운 대화창에서 Opus 5.5 에게 보여주세요.
그 과정까지 개발의 일부로 생각하세요.
이미 운영 중인 사내 앱이 있다면, "점검 진행 방법" 섹션의 점검 지시문을 붙여넣는 것부터 시작해 보세요.
또한 매번 지시문을 붙여넣는 것이 번거롭다면 security-review 라는 플러그인이 있으니 사용해 보시길 추천합니다.
세밀한 부분까지 꼼꼼하게 짚어주기 때문에 저도 평소 애용하고 있습니다.
====
마지막으로 작은 안내 말씀드립니다.
저희 회사는 귀사를 위해 비즈니스 특화 AI 에이전트를 처음부터 개발해 드리는 서비스를 제공하고 있습니다.
단순한 교육이나 도구 소개가 아니라, 실제 업무 흐름을 듣고 "내일부터 바로 쓸 수 있는" 결과물을 전달합니다. 연동 및 유지보수까지 함께 지원합니다.





