Design · Development · Thoughts

안녕하세요,
Practical AI Lab 입니다.

AI·에이전트·LLM 실전 연구

Claude Mythos 5 보안 스캔, 누가 어떻게 쓸 수 있나?


반응형

Claude Mythos 5 보안 스캔은 2026년 8월 21일 기준 누구나 직접 모델을 호출하는 일반 API가 아닙니다. 현재는 Claude Enterprise 고객이 공개 베타인 Claude Security에서 자신이 소유한 저장소를 검사할 때 사용할 수 있으며, 관리자가 기능을 켜고 사람이 모든 패치를 검토·승인해야 합니다. 별도 부가상품 요금이 아니라 기존 Enterprise 플랜의 표준 토큰 사용량으로 과금되지만, Mythos 5의 원시 모델 접근 권한까지 생기는 것은 아닙니다.

이번 발표의 핵심은 성능이 강한 사이버 모델을 널리 풀었다는 데 있지 않습니다. 위험한 이중용도 능력은 모델 뒤에 남겨 두고, 취약점 목록과 수정안처럼 방어 목적에 맞춘 결과물만 제품 화면으로 전달하는 접근 제어 구조를 택했다는 데 의미가 있습니다. 이 글은 신청 홍보보다 실제 도입 담당자가 확인해야 할 이용 조건, 스캔 흐름, 결과 해석, 비용, 데이터 경계와 실패 조건을 차례로 정리합니다.

Claude Mythos 5 보안 스캔은 누가 사용할 수 있나?

현재 확인된 직접 이용 대상은 Claude Enterprise 고객입니다. 조직 관리자는 관리자 콘솔에서 Claude Security를 활성화하고, 사용자는 claude.ai/security 화면에서 조직이 권한을 가진 코드 저장소를 선택해 스캔을 시작합니다. Anthropic은 이 기능을 공개 베타라고 명시했습니다. 따라서 일반 Claude 무료·Pro·Max 사용자에게 동일한 메뉴가 보인다고 가정하면 안 되고, 개인 개발자가 API 키 하나로 Mythos 5를 선택하는 방식도 아닙니다.

Anthropic의 제품 설계는 ‘모델 접근’과 ‘모델이 만든 방어 결과 접근’을 분리합니다. 사용자는 Mythos 5와 자유롭게 대화하거나 임의의 공격 절차를 요청하지 않습니다. 제품이 미리 정의한 저장소 취약점 분석 작업을 백그라운드에서 수행하고, 화면에는 발견 항목과 분류, 신뢰도, 심각도, 제안 수정안이 나타납니다. 공격 능력이 강한 모델일수록 입력과 출력의 통로를 좁혀 오용 가능성을 낮추려는 구조입니다.

보안 제품이나 서비스 사업자가 자기 고객에게 같은 능력을 제공하는 경로도 발표됐지만, 이 역시 즉시 개방된 범용 API와 다릅니다. Anthropic은 파트너 도구 통합을 추진하며 관심 등록을 받고 있습니다. 파트너 제품의 최종 사용자는 백그라운드 모델에 직접 프롬프트를 보내지 않고, 패치 제안이나 보안 경보처럼 해당 제품이 정의한 결과만 받게 됩니다. ‘곧 파트너 도구에서 제공’이라는 표현은 출시일과 지원 제품이 모두 확정됐다는 뜻이 아니므로 실제 구매 전에 공급사 공지를 다시 확인해야 합니다.

Claude Security에서 Mythos 5 스캔은 어떻게 진행되나?

공식 설명에 따르면 기본 흐름은 저장소 선택, 자동 분석, 발견 항목 검토, 수정 구현, 사람의 승인 순서입니다. 먼저 조직이 소유하거나 검사 권한을 가진 저장소를 연결합니다. Mythos 5는 코드베이스를 읽고 취약점 후보를 찾은 뒤 각 항목에 CWE 분류, 신뢰도와 심각도 평가, 제안 수정안을 붙입니다. CWE는 소프트웨어 약점 유형을 공통 언어로 표현하는 체계이므로 개발팀과 보안팀이 같은 기준으로 결함을 논의하는 데 유용합니다.

그러나 CWE 번호가 붙었다고 곧 확정 취약점이 되는 것은 아닙니다. 정적 코드 맥락만으로는 실제 배포 설정, 런타임 권한, 네트워크 경계, 보완 통제를 모두 알기 어렵습니다. 신뢰도는 모델이 자기 판단에 부여한 확신이고, 심각도는 잠재 영향에 대한 우선순위 신호입니다. 재현 가능한 입력, 도달 가능한 코드 경로, 필요한 권한, 영향 범위를 사람이 확인해야 실제 위험으로 승격할 수 있습니다.

수정 단계에서는 Claude Code 웹을 열어 제안 패치를 구현할 수 있습니다. 여기서 중요한 경계가 하나 더 생깁니다. Mythos 5가 스캔했다는 이유로 Claude Code의 대화형 작업도 자동으로 Mythos 5가 담당하는 것은 아닙니다. Anthropic은 대화형 패치에 조직이 Claude Code에서 접근할 수 있는 모델이 사용되며, Mythos 스캔이 다른 화면의 Mythos 접근 권한으로 확장되지 않는다고 설명했습니다.

마지막 단계는 사람의 검토와 승인입니다. 자동 생성 패치는 테스트를 통과해도 기능 의미를 바꾸거나 예외 처리를 누락할 수 있습니다. 보안 패치가 인증 흐름, 캐시, 직렬화 형식, 외부 API 계약을 건드리면 취약점은 닫혔지만 서비스 장애가 생길 수도 있습니다. 그래서 수정안은 별도 브랜치와 풀 리퀘스트로 관리하고, 단위·통합·회귀 테스트와 보안 재현 테스트를 함께 통과시킨 뒤 병합하는 편이 안전합니다.

Claude Mythos 5와 Fable 5의 차이는 무엇인가?

Anthropic의 공식 제품 설명에 따르면 Claude Mythos 5는 사이버보안과 생물학 연구에서 가장 강한 능력을 제공하는 제한 접근 모델입니다. Claude Fable 5는 같은 기반 모델을 일반 용도에 제공하면서 사이버보안과 생물학의 고위험 요청을 강하게 제한한 버전입니다. 일부 위험 영역 요청은 분류기에 의해 차단되거나 다른 Opus 계열 모델로 라우팅될 수 있습니다.

이 구분 때문에 일반 사용자가 Fable 5를 쓰는 경험과 보안팀이 Mythos 5 기반 Claude Security 스캔을 쓰는 경험은 같지 않습니다. 전자는 폭넓은 지식 작업과 코딩을 위한 대화형 모델에 안전장치를 적용한 형태이고, 후자는 소유한 코드의 취약점을 찾고 수정안을 받는 제한된 방어 작업입니다. 제품 이름이 비슷해도 권한, 데이터 흐름, 허용되는 요청, 결과 형식이 다릅니다.

Anthropic은 Mythos 5 가격을 입력 백만 토큰당 10달러, 출력 백만 토큰당 50달러부터라고 제품 페이지에 표시합니다. 하지만 Claude Security 발표에서는 Enterprise 고객의 스캔이 기존 플랜의 표준 토큰 사용량으로 청구되고 별도 애드온은 아니라고 설명합니다. 두 문구는 서로 충돌하지 않습니다. 제한 파트너가 모델에 접근하는 가격 정보와 Enterprise 제품 화면에서 소비량을 청구하는 방식이 서로 다른 맥락이기 때문입니다. 실제 계약 단가, 포함량, 한도는 조직 계약과 청구 화면을 기준으로 확인해야 합니다.

검사 결과에서 CWE·신뢰도·심각도를 어떻게 읽나?

CWE는 버그의 이름표가 아니라 약점의 유형입니다. 예를 들어 입력 검증 누락, 권한 확인 오류, 경로 처리 실수, 메모리 안전성 문제처럼 원인이 비슷한 결함을 묶습니다. 운영팀은 CWE를 이용해 같은 유형이 다른 저장소에도 반복되는지 찾고, 코딩 표준이나 공통 라이브러리 수준의 예방책을 설계할 수 있습니다. 반면 특정 제품과 버전에 공개된 실제 취약점 식별자인 CVE와는 역할이 다릅니다.

신뢰도가 높다는 표시는 먼저 볼 가치가 있다는 뜻이지 자동 병합의 근거가 아닙니다. 모델은 존재하지 않는 데이터 흐름을 가정하거나, 이미 상위 계층에서 검증되는 값을 다시 위험하다고 판단할 수 있습니다. 반대로 여러 모듈을 거쳐 형성되는 취약 경로를 놓칠 수도 있습니다. 가장 좋은 검증 방법은 모델에게 더 긴 설명만 요구하는 것이 아니라 최소 재현 사례와 테스트를 만드는 것입니다. 취약 동작이 패치 전에는 재현되고 패치 후에는 차단되는지 확인하면 판단 근거가 코드로 남습니다.

심각도 역시 실제 환경에 맞춰 조정해야 합니다. 인터넷에서 직접 접근 가능한 인증 전 엔드포인트의 원격 코드 실행과, 관리자 권한이 있어야 실행되는 내부 개발 도구의 정보 노출은 같은 코드 패턴이라도 위험이 다릅니다. 자산 중요도, 공격 표면, 필요한 권한, 악용 난이도, 탐지 가능성, 데이터 민감도와 복구 비용을 함께 봐야 합니다. 기존 CVSS나 조직 위험 매트릭스가 있다면 Mythos 결과를 그 체계로 변환해 비교하는 것이 좋습니다.

제안 수정안은 가장 작은 안전한 변경인지 검토해야 합니다. 입력을 무조건 거부해 기능을 깨뜨리거나, 오류를 숨겨 관찰 가능성을 떨어뜨리거나, 성능을 급격히 악화시키는 패치도 기술적으로는 취약 경로를 닫을 수 있습니다. 보안팀은 악용 방지 여부를, 서비스 담당자는 정상 시나리오와 호환성을, 플랫폼 담당자는 공통 정책과 배포 영향을 확인하는 삼각 검토가 필요합니다.

도입 전에 준비할 저장소 권한과 데이터 경계

첫 번째 준비는 검사 범위를 명확히 하는 일입니다. 회사가 소유하지 않은 고객 저장소, 계약상 외부 처리 금지 코드, 비밀정보가 섞인 덤프를 승인 없이 연결하면 안 됩니다. 모노레포라면 전체를 한 번에 넣기보다 서비스 경계와 책임자를 기준으로 우선순위를 나눕니다. 저장소 연결 계정에는 가능한 읽기 중심의 최소 권한을 부여하고, 조직에서 요구하는 감사 로그와 접근 철회 절차를 확인해야 합니다.

두 번째는 비밀정보 정리입니다. API 키, 개인키, 운영 데이터 샘플, 고객 개인정보가 코드에 커밋돼 있다면 AI 도구 도입보다 먼저 비밀 폐기와 재발급이 필요합니다. 비밀 스캐너로 사전 점검하고, 생성물과 빌드 캐시처럼 분석 가치가 낮지만 민감할 수 있는 경로는 제외합니다. 모델 제공사의 보존 정책만 믿고 저장소 위생 문제를 방치하면 위험의 원인이 그대로 남습니다.

세 번째는 결과 저장과 공유 범위입니다. 발견 보고서에는 아직 공개되지 않은 제로데이 후보, 공격 가능 경로, 패치 전 코드가 포함될 수 있습니다. 일반 업무 채널에 그대로 붙이지 말고 기존 취약점 관리 시스템의 접근 정책을 적용합니다. 공개 오픈소스에서 결함을 찾았을 때도 즉시 이슈를 공개하기보다 유지관리자의 보안 연락처와 조정 공개 절차를 따라야 합니다.

네 번째는 Anthropic의 최신 약관과 조직 계약을 확인하는 일입니다. 공식 Mythos 제품 페이지에는 제한된 직접 접근에 30일 데이터 보존 정책 수락이 필요하다고 안내되어 있습니다. Claude Security Enterprise의 구체적인 데이터 처리 조건이 조직 계약에서 어떻게 적용되는지는 관리자와 법무·보안 담당자가 실제 계약 문서를 확인해야 합니다. 서로 다른 제품 화면의 정책을 하나로 추정해서는 안 됩니다.

DevSecOps 파이프라인에는 어떻게 연결해야 하나?

공개 베타 초기에 가장 안전한 방식은 차단 없는 관찰 모드입니다. 몇 개의 대표 저장소를 정해 스캔하고, 기존 SAST·의존성 스캐너·침투 테스트 결과와 비교합니다. 발견 수보다 진짜 양성 비율, 중복률, 검증 시간, 패치 채택률, 회귀 발생률을 측정해야 합니다. 모델이 많은 경고를 만들더라도 담당자가 확인하지 못하면 보안 부채만 늘어납니다.

두 번째 단계에서는 높은 신뢰도와 높은 영향의 항목만 티켓으로 자동 변환할 수 있습니다. 티켓에는 저장소와 커밋, 코드 위치, CWE, 모델 설명, 재현 여부, 담당자, 공개 제한 등 최소 메타데이터를 넣습니다. 동일 원인의 중복 발견은 하나의 근본 원인 작업으로 묶습니다. 모델이 매번 다른 표현을 쓰더라도 코드 위치와 데이터 흐름을 기준으로 중복을 판정해야 합니다.

세 번째 단계에서도 자동 병합은 신중해야 합니다. 사람 검토가 공식 사용 조건에 포함되어 있고, 보안 수정은 영향 반경이 큽니다. 제안 패치는 초안 풀 리퀘스트로 만들고 보호 브랜치, 코드 소유자 승인, 테스트 통과, 보안 담당자 확인을 유지합니다. 긴급 패치라면 속도를 높이되 사후 검토와 재발 방지 작업을 별도로 등록합니다.

운영 지표는 모델 성능과 팀 성과를 구분해 봐야 합니다. ‘찾은 취약점 수’만 목표로 잡으면 낮은 품질의 경고가 늘어날 수 있습니다. 확인된 고위험 결함의 평균 수정 시간, 오래 방치된 항목 수, 같은 CWE의 재발률, 패치로 인한 장애율, 사람이 검증하는 데 든 시간을 함께 측정하면 실제 방어 효과를 볼 수 있습니다.

오픈소스 3,500만 달러 지원은 무엇을 의미하나?

Anthropic은 Defender Advantage Fund, 줄여서 0xDAF를 통해 오픈소스 보안 활동에 3,500만 달러 상당의 Claude 크레딧을 제공하겠다고 발표했습니다. 지원 초점은 널리 쓰이는 프로젝트의 실제 취약점 패치, 다른 프로젝트가 재사용할 수 있는 스캔·패치 자동화, 취약점 종류 자체를 구조적으로 줄이는 더 큰 보안 접근입니다. 현금 3,500만 달러를 모든 유지관리자에게 즉시 배분한다는 뜻이 아니라 크레딧 기반 프로그램입니다.

초기에는 소수의 큰 파일럿 보조금으로 무엇이 효과적으로 확장되는지 학습하고, 수혜 조직은 추후 공개할 예정입니다. 따라서 현재 시점에 특정 프로젝트가 지원 대상으로 선정됐다고 단정할 수 없습니다. 오픈소스 유지관리자는 신청 조건과 공개 일정이 발표될 때까지 공식 채널을 확인해야 합니다.

이 기금은 Project Glasswing의 연장선에 있습니다. Anthropic은 2026년 4월부터 중요한 소프트웨어를 지키는 제한된 조직에 Mythos 계열 모델을 제공했고, 6월에는 약 150개 조직으로 확대한다고 밝혔습니다. 공식 발표에 따르면 초기 파트너들은 1만 건이 넘는 고위험 또는 치명적 보안 결함을 찾았습니다. 다만 이 수치는 독립적인 전체 재현율이나 패치 완료율을 의미하지 않습니다. 발견의 품질, 중복, 실제 영향과 수정 상태는 개별 검증이 필요합니다.

Cyber Verification Program과 일반 Enterprise 이용의 차이

Cyber Verification Program은 합법적인 이중용도 보안 업무를 수행하는 검증된 조직을 위한 접근 프로그램입니다. 지금까지 승인 조직은 Opus와 Sonnet 모델에서 보안 요청이 불필요하게 차단되는 일을 줄이기 위해 완화된 안전장치를 적용받았습니다. Anthropic은 앞으로 몇 주 안에 Opus와 Sonnet의 더 넓은 이중용도 능력, 이후 Mythos급 접근까지 단계적으로 확대할 계획이라고 밝혔습니다.

일반 Enterprise Claude Security 이용은 소유한 저장소를 제품 화면에서 검사하고 결과를 받는 제한된 경로입니다. 반면 검증 프로그램은 권한 있는 보안팀이 더 폭넓은 연구와 방어 작업을 수행할 수 있도록 신원을 확인하고 접근 수준을 조정하는 제도입니다. Enterprise 계약이 있다고 자동으로 검증 프로그램에 승인되는 것도 아니고, 기존 승인 조직이 별도 조치 없이 즉시 Mythos 직접 접근을 얻는 것도 아닙니다. Anthropic은 기존 승인 조직에 업데이트를 따로 안내하겠다고 했습니다.

중요 기반시설을 다루는 일부 조직은 미국 정부 파트너와 함께 운영되는 Project Glasswing 경로도 있습니다. 이 프로그램은 엄격한 보안 통제 요건을 충족하는 보호 기관을 중심으로 합니다. 일반 기업은 자신의 목적이 코드 스캔인지, 폭넓은 이중용도 연구인지, 중요 기반시설 보호인지 구분한 다음 알맞은 경로를 선택해야 합니다.

Claude Mythos 5 보안 스캔의 한계와 실패 조건

첫째, 공개 베타이므로 기능과 인터페이스, 지원 저장소, 처리 한도가 바뀔 수 있습니다. 현재 발표만으로 온프레미스 실행, 모든 코드 호스트 지원, 확정된 서비스 수준을 가정하면 안 됩니다. 도입 계획에는 기능 변경과 일시 중단을 견딜 수 있는 수동 대체 절차가 필요합니다.

둘째, 소스 코드 분석만으로 운영 환경 전체를 증명할 수 없습니다. 인프라 설정, 비밀 관리, 네트워크 정책, 사용자 권한, 서드파티 서비스와 데이터 흐름은 별도 점검이 필요합니다. SAST, SCA, DAST, 클라우드 설정 점검, 침투 테스트와 사고 대응 훈련을 대체하는 만능 도구가 아닙니다.

셋째, 사람의 검토가 병목이 될 수 있습니다. 결과가 정확해도 담당자가 재현하고 우선순위를 정할 시간이 없다면 수정으로 이어지지 않습니다. 처음부터 전 저장소를 스캔하기보다 인터넷 노출, 데이터 민감도, 변경 빈도와 사업 중요도를 기준으로 범위를 좁혀야 합니다.

넷째, 강한 모델의 제안에는 권위 편향이 생길 수 있습니다. 상세한 설명과 CWE 번호가 붙으면 검토자가 사실로 받아들이기 쉽습니다. 패치 전후 테스트, 독립 도구 비교, 코드 소유자 승인 같은 절차를 생략하지 않아야 합니다. 모델 이름이 검증 증거를 대신하지 않습니다.

다섯째, 보안 발견의 공개 방식이 잘못되면 방어 도구가 오히려 공격 정보를 확산할 수 있습니다. 미패치 취약점은 최소 인원에게만 공유하고, 유지관리자와 공급사에 조정 공개 시간을 줍니다. 패치가 배포된 뒤에도 영향을 받는 버전, 완화책과 업데이트 방법을 정확히 안내해야 합니다.

파일럿 결과는 어떤 기준으로 종료 판단할까?

파일럿은 스캔을 한 번 실행했다고 끝내면 안 됩니다. 보안팀은 발견 후보를 표본 추출해 진짜 양성·오탐·판단 불가로 분류하고, 개발팀은 수정안을 적용하는 데 든 시간과 테스트 실패를 기록해야 합니다. 기존 도구가 이미 찾던 항목과 Mythos만 추가로 찾은 항목도 나눠야 순증 효과를 알 수 있습니다.

도입 확대 기준은 단순 발견 건수가 아니라 검증 가능한 고위험 결함을 얼마나 빨리 수정했는지입니다. 반대로 오탐 검토 시간이 절약 시간보다 크거나, 민감 저장소의 계약 조건을 충족하지 못하거나, 담당 조직이 조정 공개 절차를 운영할 수 없다면 범위를 확대하지 않는 편이 맞습니다. 공개 베타 기간에는 월별로 기능 변경과 데이터 처리 조건을 재확인하고, 도구를 중단해도 기존 취약점 티켓과 증거가 남도록 내보내기 절차를 마련해야 합니다.

도입 담당자를 위한 실무 체크리스트

  • Claude Enterprise 계약과 Claude Security 공개 베타 이용 가능 지역·조직 조건을 확인합니다.
  • 관리자 콘솔에서 기능을 켜기 전에 저장소 소유권과 연결 계정의 최소 권한을 검토합니다.
  • 코드에 남은 비밀, 고객 데이터, 대형 산출물과 불필요한 경로를 먼저 정리합니다.
  • 대표 저장소 소수로 파일럿을 진행하고 기존 보안 도구의 결과와 비교합니다.
  • CWE, 신뢰도와 심각도를 조직의 위험 평가 기준으로 다시 분류합니다.
  • 모든 취약점 후보에 재현 가능성, 실제 도달 경로와 영향 범위를 기록합니다.
  • 제안 패치는 별도 브랜치에서 테스트하고 코드 소유자와 보안 담당자의 승인을 받습니다.
  • 발견 보고서와 제로데이 후보는 제한된 취약점 관리 시스템에 보관합니다.
  • 진짜 양성 비율, 검증 시간, 수정 완료 시간, 재발률과 패치 장애율을 측정합니다.
  • 계약상 데이터 처리와 보존 조건은 실제 Enterprise 계약 문서에서 확인합니다.

결론: 모델 접근보다 방어 결과 전달 구조가 핵심

Claude Mythos 5 보안 스캔의 현재 답은 명확합니다. Claude Enterprise 고객이 관리자 승인 아래 Claude Security 공개 베타에서 소유한 저장소를 검사할 수 있고, 결과는 CWE·신뢰도·심각도·수정안 형태로 제공됩니다. Mythos 5를 자유롭게 호출하는 권한은 아니며, Claude Code의 대화형 패치도 조직이 기존에 접근 가능한 별도 모델로 진행됩니다. 모든 수정은 사람이 검토하고 승인해야 합니다.

이 발표가 보여 주는 더 큰 변화는 강한 사이버 능력을 배포하는 방식입니다. 범용 대화창을 열기보다 정해진 방어 작업과 결과물만 노출하고, 검증된 조직에는 별도 프로그램으로 접근을 확대합니다. 도입 조직은 모델의 명성보다 저장소 권한, 데이터 경계, 검증 절차와 측정 지표를 먼저 설계해야 실제 보안 개선으로 연결할 수 있습니다.

참고 자료

반응형