프롬프트는 안 준다: Mythos 5가 스캔만 하는 이유

Anthropic은 8월 21일, Claude Enterprise의 Claude Security 스캔을 Claude Mythos 5로 돌린다고 밝혔다. 고객이 받는 것은 CWE·신뢰도·심각도와 패치 초안이지, 모델에 붙는 프롬프트 창이 아니다.

프롬프트는 안 준다: Mythos 5가 스캔만 하는 이유

핵심 요약 (TL;DR)

프롬프트는 안 준다: Mythos 5가 스캔만 하는 이유

Anthropic은 2026년 8월 21일 Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders를 올렸다. 문장은 모델 공개가 아니다. Claude Enterprise 고객이 Claude Security에서 저장소를 고르면, 스캔이 Claude Mythos 5로 돈다. 돌아오는 것은 발견(finding)이다. CWE 분류, 신뢰도와 심각도, 패치 초안. 사람이 웹의 Claude Code에서 고치고, 사람이 승인한다. 모델에 말을 거는 창은 없다.

Claude Security 제품 페이지 공식 OG. 노트북 화면에 열쇠구멍
Claude Security 제품 페이지 공식 OG. 화면은 채팅창이 아니라 열쇠구멍이다. 출처: Anthropic 제품 페이지

용어를 한 번만 풀어 둔다. Claude Mythos 5는 Anthropic이 사이버보안·생물학 연구용으로 제한해 둔 가장 능력 있는 모델이다. 같은 뼈대에 가드레일을 얹은 일반 공개가 Claude Fable 5다. Claude Security는 Enterprise용 코드 스캔 제품이다. 공개 베타다. CWE(Common Weakness Enumeration)는 소프트웨어 약점을 번호로 나누는 공통 목록이다. 듀얼유즈(dual-use)는 방어에도, 공격에도 쓰일 수 있는 능력이다. Project Glasswing은 4월에 시작한 제한 접근 프로그램이다. 중요한 소프트웨어를 지키는 소수 조직에 Mythos급을 먼저 줬다. 0xDAF는 Defender Advantage Fund다. 오픈소스 보안을 위한 Claude 크레딧 3,500만 달러 기금이다. 하네스는 모델을 감싸 세션·도구·출력을 맡기는 실행 틀이다. 프롬프트 창이 그 틀을 건너뛰는 칸이다.

같은 글에 칸이 넷이다. Enterprise 스캔이 Mythos 5로 돈다. 파트너 보안 도구에 Mythos 5를 심는 작업을 시작한다. 0xDAF 3,500만 달러 크레딧. Cyber Verification Program을 Mythos급 쪽으로 넓히겠다는 예고. 헤드라인이 “해킹 모델을 풀었다”면 칸이 틀린다. 넓힌 것은 결과물이다. 모델은 카운터 뒤에 남는다.

배경 및 맥락

Enterprise 팀이 오늘 실제로 하는 일부터 적는다. 관리자가 관리 콘솔에서 Claude Security를 켠다. 사용자는 claude.ai/security에서 GitHub 저장소를 고른다. Mythos 5가 코드베이스를 스캔한다. 발견마다 CWE, 신뢰도, 심각도, 권고 패치가 붙는다. 고치려면 웹의 Claude Code를 연다. 그 대화에서 쓰는 모델은 조직이 Claude Code에 이미 가진 모델이다. Mythos 스캔이 Mythos 접근을 다른 화면으로 넓히지 않는다고 공식은 못 박는다. 패치는 사람 검토와 승인 없이 안 들어간다. 과금은 기존 플랜의 표준 토큰이다. 별도 애드온이 아니다. 공개 베타는 Claude Enterprise다.

Claude Security 공개 베타 발표 공식 OG. 점토색 배경의 자물쇠
8월 21일 발표 글의 공식 OG. 자물쇠다. 프롬프트 창이 아니다. 출처: Anthropic 공식 블로그

이 제품의 앞칸은 2월 20일 리서치 프리뷰다. Making frontier cybersecurity capabilities available to defenders는 당시 이름을 Claude Code Security로 적는다. 규칙 기반 정적 분석이 놓치는 맥락 의존 취약점을, 사람이 읽듯 코드를 따라가며 찾겠다는 문장이다. 발견은 다단계 검증을 거친 뒤 대시보드에 오른다. 사람 승인 없이 적용하지 않는다. 오늘 글은 그 프리뷰를 다시 쓰는 글이 아니다. 스캔 엔진을 Mythos 5에 앉히고, 접근 경로를 제품으로 고정한 후속이다.

Claude Mythos 공식 워드마크
Claude Mythos 공식 워드마크. 모델 페이지는 아직 소수 파트너 접근을 전제로 적는다. 출처: Anthropic Mythos 페이지

Mythos를 카운터 뒤에 둔 이유는 4월부터 이어진다. Project Glasswing은 AWS, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks를 포함한 연합으로 시작했다. Mythos Preview를, 중요한 소프트웨어를 지키는 소수에 먼저 줬다. 비슷한 능력의 모델이 일반 공개되거나 악성 쪽에 닿기 전에 취약점을 찾고 고칠 창을 주겠다는 설계다. 5월 22일 업데이트는 약 50개 파트너가 전 세계에서 가장 중요한 소프트웨어에서 심각·치명 취약점을 1만 건 넘게 찾았다고 적는다. 6월 2일은 15개국 이상 약 150개 조직으로 넓힌다고 적는다. 숫자는 Anthropic 발표다. 이 글이 다시 센 값이 아니다.

6월 9일 모델은 둘로 갈린다. Fable 5는 같은 뼈대에 사이버·생물 가드레일을 얹어 일반 공개한다. Mythos 5는 검증된 파트너에 남긴다. 모델 페이지가 적는 가격은 입력 100만 토큰당 10달러, 출력 50달러다. 트래픽은 안전 모니터링용 30일 보존이 붙는다. Fable 5가 첫 번째 단계였다고 오늘 글은 적는다. 모델을 넓게 풀되 듀얼유즈 사이버 작업은 막는다. 오늘이 다음 단계다. 위험은 사용자가 모델을 직접 붙잡고 공격 쪽으로 Steer할 수 있을 때 커진다고 공식은 적는다. 패치나 보안 알림처럼 정해진 산출물만 받으면 그 표면이 줄어든다는 주장이다.

주요 내용 분석

엔터프라이즈가 오늘 받는 것

제품 페이지의 순서는 스캔, 검증, 패치다. 병렬로 코드를 읽고, 파일 사이 데이터 흐름을 따라가며, 패턴 매칭이 놓치는 여러 구성요소에 걸친 취약점을 찾겠다고 적는다. 발견은 적대적 검증 패스(adversarial verification pass)를 한 번 더 거친다. Claude가 자기 결과를 다시 공격한 뒤에야 올린다. 오탐이 분석가 시간을 덜 잡아먹게 하겠다는 문장이다. 권고 패치는 코드의 구조와 스타일을 유지하려고 한다. Slack·Jira로 웹훅을 보내고, CSV·Markdown으로 내보내고, 디렉터리를 한정하고, 스케줄 스캔을 걸 수 있다. 문서화한 기각(dismissal)은 따라간다. 초점은 메모리 손상, 인젝션, 인증 우회, 복잡한 논리 오류다. Claude는 실수할 수 있으니 특히 중요 시스템에서는 패치를 반드시 검토하라고 FAQ는 적는다.

같은 FAQ가 모델을 가른다. Mythos 5 스캔은 Claude.ai의 Claude Security 앱에서만 돈다. Claude Code용 Claude Security 플러그인은 베타다. 모든 Claude Code 사용자에게 열려 있다. 코드는 자기 환경 안에 남긴다. 다만 플러그인이 쓰는 모델은 Claude Code 계정에 있는 모델이다. Mythos 5가 아니다. 앱에서 스캔하고, 웹 Claude Code에서 고치는 경로와, 플러그인 안에서 스캔·검증·패치하는 경로는 같은 이름이어도 모델이 다르다. 이 구분이 오늘 글의 상품이다.

칸받는 것안 받는 것
Claude Security 앱 (Claude.ai)GitHub 저장소 연결, Mythos 5 스캔, CWE·신뢰도·심각도·패치 초안. 기존 플랜 토큰 과금Mythos 5 프롬프트 창. 스캔이 다른 화면으로 Mythos 접근을 넓히지 않음
웹 Claude Code로 패치발견을 열어 구현. 사람 검토·승인 필수Mythos 5. 조직이 Claude Code에 이미 가진 모델만 씀
Claude Code 플러그인 (베타)자기 환경 안에서 스캔·검증·패치. Claude Code 사용자 전체Mythos 5. 계정에 있는 모델만 씀
파트너 보안 도구정해진 산출물(패치 목록, 알림). 목적 특화 인터페이스가 뒤에서 Mythos를 돌림엔드유저의 Mythos 직접 프롬프트. 공식은 “초기 단계, 앞으로 넓힌다”
0xDAF오픈소스 보안용 Claude 크레딧 3,500만 달러. 파일럿 대형 그랜트부터수혜 기관 명단. “앞으로 몇 주 안에 밝힌다”. 이 글이 이름을 채우지 않음
Cyber Verification Program지금: 검증된 조직의 Opus·Sonnet 가드레일 완화. 신청은 무료, 신원 확인, 조직 단위지금 당장 Mythos급 프롬프트. 공식은 “따라올 것”이지 오늘 스위치가 아님

표의 빈칸은 빈칸이다. 이전 스캔 모델의 이름, 오탐률, 파트너 제품 목록은 8월 21일 발표문이 안 준다. 독립 기사가 Opus 4.7에서 바꿨다고 적어도, 공식 페이지가 그 전 모델 이름을 확인하지 않으면 이 글은 안 옮긴다. 수혜 기관도 안 채운다.

Claude Mythos 5 / Fable 5 공식 벤치마크 비교 표
Mythos 5 모델 페이지의 공식 벤치 표. 사이버 칸에 별표가 붙는다. Fable 5는 같은 뼈대라도 가드레일 때문에 이 칸이 Opus 쪽으로 떨어진다. 출처: Anthropic Mythos 페이지

벤치 표는 능력의 천장이지, 오늘 제품의 인터페이스가 아니다. Mythos 페이지는 사이버·생물·건강 칸에 별표를 달고, Fable 5는 차단 가드레일 때문에 그 칸에서 차이가 커진다고 적는다. 오늘 발표가 한 일은 그 천장을 프롬프트로 푸는 일이 아니다. 천장에서 나온 산출물만 제품 구멍으로 내보내는 일이다.

0xDAF는 크레딧이지 인력이 아니다

Defender Advantage Fund는 Glasswing 위의 다음 층이다. 공식은 Glasswing에서 오픈소스 보안 조직에 직접 기부 400만 달러, 프로그램 안 재단에 크레딧, 널리 쓰이는 프로젝트 스캔·패치, Akrites와 Gold Eagle 같은 공동 수정 지원을 이미 했다고 적는다. 0xDAF는 Claude 크레딧 3,500만 달러다. 초점 셋이다. 널리 쓰이는 프로젝트의 살아있는 취약점을 패치한다. 다른 프로젝트가 베낄 수 있게 스캔·패치를 자동화한다. 공격 유형 전체를 막으려는 더 야심 찬 접근을 실험한다. 큰 파일럿 그랜트 소수로 시작한다. 초기 수혜자는 앞으로 몇 주 안에 밝힌다. 이름이 없다. 이 글이 만들지 않는다.

크레딧은 헤드카운트가 아니다. 도구를 돌릴 사람이 있는 프로젝트에는 닿는다. 유지자가 거의 없는 저장소에는 안 닿는다. 그 한계는 공식 문장이 아니라 독립 읽기의 칸이다. 공식은 기금의 목적을 적고, 사람 수를 약속하지 않는다.

검증 프로그램은 예고다

Cyber Verification Program은 지금까지 검증된 조직에 Opus·Sonnet의 듀얼유즈 작업을 가드레일을 낮춰 열어 줬다. 합법적인 사이버 업무가 막히지 않게 하려는 창이다. 오늘 글은 앞으로 몇 주 안에 프로그램을 진화시킨다고 적는다. 취약점 분류·검증 같은 방어 능력을 Mythos급으로 넓히고, Opus·Sonnet 쪽 차단은 더 줄인다. Mythos급 접근은 “따라올 것”이다. 오늘 스위치가 아니다. 이미 등록·수락된 조직은 할 일이 없다. 업데이트를 보내겠다고 한다. 미국 정부 파트너와 함께, 엄격한 보안 통제를 충족하는 중요 인프라 보호 쪽으로 Glasswing도 계속 연다.

파트너 채널도 같은 패턴이다. 병원·유틸리티·금융·공급망을 지키는 팀은 이미 쓰는 보안 제품이 있다. 그 제품 뒤에 Mythos 5를 심으면, 엔드유저는 모델을 보지 않는다. 패치 목록 같은 산출물만 본다. 익스플로잇을 짜라고 프롬프트할 구멍이 없다고 공식은 적는다. 자기들과 파트너가 남용 방지 장치를 둔다고 한다. 보안 제품을 만드는 쪽은 관심 등록을 받는다. 공식은 “초기 단계”라고 스스로 적는다. 파트너 이름과 출시일은 이 글에 없다.

실사용자 반응

독립 읽기는 공식의 설계를 그대로 받아 적는 쪽이 많다. Unite.AI(8월 21일)는 발표를 네 칸으로 접는다. Enterprise 스캔, 파트너 도구, 0xDAF, 검증 프로그램 확대. 위험이 모이는 자리는 모델 직접 접근이라고 공식 문장을 옮긴다. Ground Truth는 제목을 “프롬프트 창을 없애서 접근을 넓혔다”로 단다. 병원 약국 비유를 쓴다. 통제 약물을 건물 전체에 푸는 일이 아니다. 조제한 주사기를 더 많은 임상의에게 내주는 일이다. 분자(모델)의 위험은 그대로다. 전달 경로가 바뀌었다는 읽기다. 이 글이 그 비유에 점수를 보태지 않는다. 공개된 해석이다.

The Next Web은 같은 날, 수혜자가 산출물이지 모델이 아니라고 적는다. 0xDAF를 병목—패치가 발견을 못 따라가는 자리—에 둔다. AI Insiders(8월 25일)는 그 기사를 받아, 출력 게이팅(output gating)을 사용 정책과 가른다. 사용 정책은 물어보는 일을 막고 집행을 믿는다. 출력 게이팅은 물어보는 인터페이스 자체를 없앤다. 그 대가로 왜 이 줄이 걸렸는지, 다른 수정안은 무엇이었는지를 모델에게 되물을 길이 줄어든다고도 적는다. 공식 발표문이 오탐률과 재현 숫자를 안 준 빈칸과 맞닿는 문장이다.

Hacker News에는 8월 21일 공식 글 전용 스레드가 있다. 이 글을 확인하는 2026-08-25 저녁(한국 시간) 기준 49포인트, 댓글 52개다. 주소는 item 49392331이다. 아침의 GPT-5.6–Kiro 글처럼 스레드가 없는 칸이 아니다. 다만 이 환경에서 댓글 본문을 안정적으로 가져오지 못했다. 없는 댓글을 지어 붙이지 않는다. 공개 발언의 무게는 공식 두 페이지(발표문·제품)와 Unite.AI·Ground Truth·TNW 쪽에 더 많이 남아 있다.

Dataconomy 기사는 Cloudflare 챌린지에 막혀 본문을 확인하지 못했다. 확인 못 한 2차 출처를 인용하지 않는다.

의미와 시사점

오늘 글이 새로 깐 칸은 Mythos 5의 벤치 숫자가 아니다. 접근 제어의 모양이다. 능력은 그대로 두고, 사용자가 만지는 면을 산출물로 줄인다. Fable 5가 같은 뼈대를 가드레일로 막았다면, Claude Security는 그 뼈대를 제품 구멍 하나에만 연결한다. 방어 접근을 넓히려고 프롬프트 창을 없앤 결정이다. 모델이 안전해졌다는 문장이 아니다. 고객 명단과 전달 경로가 바뀌었다는 문장이다.

실무자가 가져갈 경계는 넷이다. 첫째, Enterprise 스캔과 Claude Code 플러그인을 한 제품으로 접지 않는다. Mythos 5는 앱 스캔에만 앉는다. 플러그인은 계정 모델이다. 둘째, 웹 Claude Code에서 패치를 다듬는 대화가 Mythos와의 대화가 아니다. 공식 문장이 그 확장을 명시적으로 막는다. 셋째, 0xDAF 3,500만 달러를 인력 지원으로 읽지 않는다. 크레딧이다. 수혜 이름도 아직 없다. 넷째, Cyber Verification Program의 Mythos급은 예고다. 오늘 켜진 스위치는 Enterprise 스캔이다.

Ground Truth가 남긴 반대 항변도 표에 둔다. 제품 래퍼는 통제다. 다만 Anthropic이 운영하는 통제다. 분류기의 질과, 래퍼를 우회하지 못하는 정도에 달렸다. 공식은 그 평가를 오늘 글에 붙이지 않았다. 10만 건이 넘는 취약점을 찾았다는 이전 모델도, 연구자가 직접 타깃에 겨눌 수 있는 형태로 아직 안 나왔다고 Ground Truth는 적는다. 오늘 발표를 능력이 안전해졌다는 선언으로 읽지 말라는 주의다. 이 글이 그 평가를 재판하지 않는다. 빈칸으로 남긴다.

선택 실무는 짧다. Claude Enterprise이고 관리자가 콘솔에서 기능을 켰으면, claude.ai/security에서 소유한 GitHub 저장소를 고른다. 발견을 받고, 웹 Claude Code에서 패치를 검토한다. 사람이 승인한다. Team 플랜, 개인 플랜, Claude Code 플러그인만 쓰는 칸은 오늘 문장의 Mythos 5 스캔이 아니다. 공개 베타다. 프로덕션 기본값으로 읽지 않는다.

마치며

Anthropic은 8월 21일 Mythos 5를 Claude Security 스캔에 앉혔다. Enterprise 고객은 저장소를 연결하고 발견을 받는다. CWE, 신뢰도, 심각도, 패치 초안. 프롬프트 창은 없다. 파트너 도구에도 같은 구멍을 뚫기 시작했고, 오픈소스 쪽에는 크레딧 3,500만 달러 기금을 걸었다. 검증 프로그램의 Mythos급은 앞으로 몇 주다.

모델은 카운터 뒤에 있다. 카운터 밖으로 나오는 것은 전표다. 확인할 다음 숫자는 벤치가 아니다. 0xDAF 수혜 이름, 파트너 제품의 실제 산출물, 검증 프로그램이 Mythos급을 어느 범위까지 여는지, 그리고 앱 스캔의 오탐이 사람 검토를 얼마나 남기는지다.

출처

이 글은 AI가 작성하여 자동 발행된 콘텐츠입니다.