Claude Opus 5 시스템 프롬프트 유출 분석: 기억, 도구, 저작권 및 제품 라우팅

Claude Opus 5가 공개적으로 출시된 지 약 하루 후, GitHub 저장소에 해당 모델의 Claude Web 및 모바일 인터페이스 전체 시스템 프롬프트를 재현했다고 주장하는 파일이 유포되기 시작했습니다.

发布于 2026年7月29日generalGEO 评分: 012 次阅读
Claude Opus 5 시스템 프롬프트 유출 분석: 기억, 도구, 저작권 및 제품 라우팅

Claude Opus 5 시스템 프롬프트 유출 분석: 기억, 도구, 저작권 및 제품 라우팅

서론

Claude Opus 5가 공개적으로 출시된 지 약 하루 후, GitHub 저장소에 해당 모델의 Claude Web 및 모바일 인터페이스 전체 시스템 프롬프트를 재현했다고 주장하는 파일이 유포되기 시작했습니다.

해당 파일은 GitHub 사용자 Eversmile12가 게시했으며, 소비자 대상 Claude 구성의 축어적 또는 거의 축어적인 스크랩 내용이라고 설명되었습니다.

그 규모는 즉시 주목을 받았습니다:

파일 세부 정보 공개 저장소에서 확인
표시된 줄 수 1,511
원본 문자 수 135,027
영어 단어 수 19,370
GitHub 표시 파일 크기 132 KB
대략적인 토큰 수 토큰당 4자 기준 약 34,000
저장소가 주장한 스크랩 날짜 2026년 7월 24일
주장된 인터페이스 Claude Web 및 모바일 채팅

이 문서는 일반적인 애플리케이션 소스 코드를 포함하지 않습니다. 주로 행동 지침, 도구 설명, JSON 스키마, 기억 전략, 보안 제한, 검색 규칙, 제품 정보 및 인터페이스 라우팅 로직으로 구성되어 있습니다.

따라서 이 파일은 Anthropic의 공식 발행물이 아니더라도 연구 가치가 상당합니다.

그러나 한 가지 중요한 전제 조건을 먼저 밝혀야 합니다:

Anthropic은 해당 GitHub 파일이 Claude Opus 5 프로덕션 환경 시스템 프롬프트의 완전하거나 정확한 복사본인지 아직 확인하지 않았습니다.

타사 스크랩 내용에는 정확한 자료, 재구성된 텍스트, 누락된 섹션, 특정 인터페이스 지침 또는 스크랩 이후 변경된 내용이 포함될 수 있습니다. 이는 권위 있는 내부 문서가 아닌 공개된 주장으로 분석해야 합니다.

Claude Opus 5, 2026년 7월 24일 공식 출시

공개 파일이 주장하는 스크랩 날짜는 Claude Opus 5의 공식 출시일과 일치합니다.

Anthropic은 Opus 5를 장기 실행 에이전트, 소프트웨어 엔지니어링, 전문 작업, 과학 연구, 컴퓨터 사용 및 복잡한 다단계 작업을 위해 설계된 능동형 모델이라고 설명합니다.

공식 사양은 다음과 같습니다:

공식 Opus 5 세부 정보 현재 정보
API 모델 이름 claude-opus-5
출시일 2026년 7월 24일
컨텍스트 창 100만 토큰
최대 출력 128,000 토큰
기본 입력 가격 백만 토큰당 5달러
기본 출력 가격 백만 토큰당 25달러
추론 기능 기본 활성화
노력 제어 낮음, 중간, 높음, xhigh, max
빠른 모드 기본 속도의 약 2.5배, 기본 가격의 2배
사용 가능 Claude 앱, Claude Code, Claude API, Bedrock, Google Cloud, Microsoft Foundry

Anthropic은 이 모델의 API 가격이 Opus 4.8과 동일하며 Fable 5의 절반이라고 밝혔습니다.

또한 Opus 5가 일부 작업에서 Fable 5에 근접한 성능을 보이면서 작업당 비용이 더 낮다고 보고했습니다.

이는 공식 출시 발표와 벤치마크 결과입니다. 타사 시스템 프롬프트 저장소의 내용과 구분해야 합니다.

이미지는 Anthropic의 Claude Opus 5 홍보 내용을 보여줍니다. 왼쪽 텍스트 "Opus 5 is here. Stop rationing."은 Opus 5가 출시되었고 할당량 제한을 중단했음을 나타내며, 가격이 Fable의 절반이고 일부 작업에서 Fable 5보다 우수한 성능을 보인다고 밝히고, 현재 이루어지고 있는 4가지 변화에 대해 언급합니다. 오른쪽은 모델 선택기로 Sonnet 5, Opus 5, Opus 4.8, Fable 5의 네 가지 모델을 나열하며, Opus 5는 주황색으로 강조되어 있으며 가격 범위는 $5 - $25로 "Opus 4.8과 동일한 가격, Fable 가격의 절반"이라고 표시되어 왼쪽 텍스트 내용과 일치합니다.

GitHub 파일은 단순한 전통적 프롬프트가 아니다

"시스템 프롬프트"라는 용어는 챗봇의 행동 방식을 알려주는 짧은 텍스트를 연상시킬 수 있습니다.

하지만 업로드된 이 파일은 전체 소비자용 AI 제품의 구성 레이어에 더 가깝습니다.

그 제목은 여러 광범위한 시스템을 포괄합니다:

  • 클로드의 기본 행동과 어조
  • 현재 제품 및 모델 정보
  • 안전 및 거부 규칙
  • 사용자 복지
  • 정치적 중립성
  • 지식 업데이트 정도
  • 지속적 기억
  • 이전 채팅 검색
  • 웹 검색
  • 이미지 검색
  • 파일 처리
  • 컴퓨터 사용
  • 시각적 출력
  • 도구 아키텍처
  • 제품 추천
  • 타사 커넥터 선택
  • 저작권 준수
  • 인용 행동

따라서 이 문서는 세 가지 유형의 지침을 결합한 것으로 보입니다:

  1. 제품 행동 사양
  2. 정책 및 안전 레이어
  3. 인터페이스 및 도구 라우팅 매뉴얼

이러한 조합이 파일이 이렇게 긴 이유를 설명합니다.

제대로 작동하는 소비자용 어시스턴트는 단순히 텍스트를 생성하는 것 이상을 수행합니다. 웹 검색 여부, 기억 파일 읽기, 앱 추천, 아티팩트 생성, 날씨 위젯 표시, 이전 채팅 검색, 연결된 서비스 호출 또는 안전하지 않은 요청 거부 등을 결정해야 할 수 있습니다.

각 동작에는 고유한 조건과 매개변수가 필요합니다.

이미지는 GitHub의 Claude Opus 5 시스템 프롬프트 파일을 보여줍니다. 파일 제목은 "System Prompt - Claude Opus 5 (claude.ai chat interface)"이며 캡처 시간은 2026년 7월 24일, 인터페이스는 Anthropic web/mobile chat으로 표시되어 있습니다. 파일에는 1511줄의 코드(1076줄의 논리적 라인)가 포함되어 있으며 크기는 132KB입니다. 이 이미지는 업로드된 파일이 Claude Opus 5 시스템 프롬프트 구성 레이어임을 설명하는 문서와 관련이 있으며, 파일의 제목과 일부 정보를 시각적으로 보여줍니다.

약 30개의 도구 정의가 제품 인터페이스를 설명

공개 파일에는 약 30개의 명명된 도구 섹션이 포함되어 있습니다.

이들이 다루는 기능은 다음과 같습니다:

  • 구조화된 후속 질문 제안
  • 통제된 환경에서 명령 실행
  • 이전 대화 검색
  • 파일 생성 및 표시
  • 스포츠 정보 획득
  • 이미지 검색
  • 기억 읽기 및 업데이트
  • 지도 및 장소 결과 표시
  • 레시피 렌더링
  • 날씨 정보 획득
  • 웹 페이지 검색 및 열기
  • 시각적 위젯 생성
  • Claude 앱 추천
  • MCP 커넥터 레지스트리 검색
  • 연결된 서비스 제안
  • 파일 보기 및 편집

많은 도구에는 완전한 JSON 스타일 매개변수 정의가 포함되어 있습니다.

이는 현대 어시스턴트 설계에 대해 몇 가지를 알려줍니다.

언어 모델은 각 제품 기능의 구현 세부 사항을 기억할 필요가 없습니다. 다음과 같은 구조화된 설명을 제공받습니다:

  • 도구의 기능

  • 도구를 사용해야 하는 시기

  • 필요한 매개변수

  • 화면에 무엇이 표시될지

  • 도구 호출 전후에 모델이 무엇을 말해야 하는지

  • 사용자의 확인이 필요한 시점

모델은 일련의 기능 모듈 위에서 작동하는 의사결정 계층 역할을 하게 된다.

전용 시스템.

따라서, 도구 아키텍처는 모델의 원래 지능만큼이나 중요할 수 있다. 잘못된 도구 명령어는 모델이 부적절한 능력을 선택하게 하거나, 관련 없는 인터페이스를 노출시키거나, 사용자가 선택을 내리기도 전에 행동을 취하게 만들 수 있다.

가장 긴 장은 지속적 기억(memory)에 관한 내용

파일에서 가장 많이 논의된 부분 중 하나는 memory_filesystem 장이다.

해당 부분은 약 230줄에 걸쳐 있으며, 기억을 세션 간에 맥락을 전달할 수 있는 지속적인 파일 시스템으로 설명한다.

설명된 디렉터리 구조는 다음과 같다:

/profile.md
/preferences.md
/topics/
/areas/
/people/

각 위치는 서로 다른 역할을 수행한다.

기억 위치 공개 파일에서의 예상 용도
/profile.md 사용자의 기본적인 지속 정보
/preferences.md 사용자가 Claude와 소통하거나 작업하기를 원하는 방식
/topics/ 관심사, 습관 및 반복되는 주제
/areas/ 지속적인 책임 또는 생활 영역
/people/ 사용자와 관련된 사람 및 관계

나열된 기억 작업에는 읽기, 쓰기, 추가, 특정 부분 교체, 파일 목록 보기, 파일 삭제가 포함된다.

삭제 작업은 Claude가 사용자가 명시적으로 요청할 때만 사용할 수 있는 것으로 설명되어 있다.

Anthropic의 공식 도움말 센터는 Claude가 이제 기억 및 이전 채팅 검색 기능을 가지고 있음을 확인한다. 그러나 공식적으로 이 정확한 숨겨진 파일 시스템의 구현을 문서화하지는 않았다.

따라서 사용자 대상 기억 기능의 존재는 확인되었다. 구체적인 내부 디렉터리 이름과 규칙은 인증되지 않은 GitHub 캡처 내용에서 비롯된 것이다.

기억은 사용자가 실제로 말한 내용을 기록하도록 설계됨

공개 파일은 지속적 기억에 쓸 수 있는 내용에 대한 명확한 경계를 설정한다.

저장되는 각 내용 줄에는 정보가 사용자로부터 직접 왔음을 나타내는 [stated] 태그가 함께 첨부되어야 한다.

파일은 Claude가 다음을 저장해서는 안 된다고 명시한다:

  • 사용자에 대한 자체 추론
  • 스스로 고안한 계획
  • 웹 검색을 통해 찾은 정보
  • 선택되지 않은 자체 대안 제안
  • 사용자가 말한 내용을 다듬거나 확장한 버전
  • 사용자가 단지 수락했기 때문에 제공된 추천

이 차이는 미묘하지만 중요하다.

Claude가 다섯 가지 도구를 추천했고 사용자가 그중 하나만 선택했다고 가정해 보자.

사용자의 선택은 저장될 수 있다. 그러나 Claude가 거절당한 네 가지 제안과 그 이면의 추론은 사용자의 지속적인 프로필의 일부가 되어서는 안 된다.

이는 기억이 모델 자체의 해석으로 점차 채워지는 것을 방지한다.

이러한 규칙이 없다면, 어시스턴트는 자기 강화적인 프로필을 생성할 수 있다:

  1. 사용자에 대해 어떤 정보를 추론한다.
  2. 그 추론을 저장한다.
  3. 이후 세션은 저장된 추론을 사실로 취급한다.
  4. 모델은 그 '사실'에 기반하여 더 많은 결정을 내린다.
  5. 프로필은 사용자가 실제로 말한 내용에서 점점 더 멀어진다.

엄격한 출처 태그는 이러한 위험을 줄인다.

민감한 정보는 기억에서 제외됨

기억 부분에는 대화에 나타나더라도 저장해서는 안 되는 긴 정보 목록이 포함되어 있다.

범주는 다음과 같다:

  • 인종 및 민족
  • 종교적 신념
  • 정치적 신념
  • 성생활 또는 성적 지향성 세부 정보
  • 의료 상태 및 진단
  • 정신 건강 및 치료 정보
  • 유전자 또는 검사실 검사 결과
  • 범죄 기록
  • 재정 및 사회경제적 세부 정보
  • 성격 평가
  • 정확한 신원 식별 정보
  • 미성년자 관련 정보
  • 타인의 고도로 민감한 정보

해당 파일은 간단한 개인정보 보호 테스트를 제안한다: 동료가 설정 페이지에서 해당 기억을 본다면 사용자가 불편함을 느낄까?

대답이 '예'라면, 해당 정보는 저장되어서는 안 된다.

파일은 또한 민감한 건강 정보와 일반적인 건강 선호도를 구분한다.

예를 들어, 운동에 대한 관심은 적절한 기억이 될 수 있지만, 특정 날 운동 계획을 변경하게 만든 병원 방문 이유는 제외되어야 한다.

이는 개인정보를 보호하는 추상화 방식이다: 적절한 경우 지속적인 선호도는 유지하되, 민감한 설명은 버리는 것이다.

Anthropic이 공개적으로 발표한 기억 기능 문서는 사용자가 기억을 제어하고, 비공개 대화를 사용하며, Claude가 이전 대화 내용을 바탕으로 확장할지 관리할 수 있음을 확인한다. 위의 구체적인 제외 규칙은 인증된 구현 문서가 아닌 공개 프롬프트 파일에서 비롯된 것이다.

기억은 허위 관계를 만들어서는 안 됨

해당 프롬프트 파일의 또 다른 이례적인 점은 감정적 연속성을 처리하는 방식이다.

파일은 Claude에게 저장된 맥락을 깊은 인간 관계로 오해해서는 안 된다고 경고한다.

인간은 제한된 주의력과 직접적인 경험을 통해 다른 사람을 기억한다. 반면 인공지능 시스템은 저장소에서 수백만 사용자의 정보를 검색할 수 있지만, 인간의 방식으로 이러한 기억을 경험할 수는 없다.

따라서 이 프롬프트는 연속성을 과장하는 표현을 피하도록 요구한다.

또한 향후 버전의 Claude는 다음 선호도를 저장해서는 안 된다고 명시한다:

  • 사용자를 무조건 칭찬하기
  • 의견 차이를 억누르기
  • 위험한 결정에 의문을 제기하지 않기
  • 대화 간에 낭만적인 역할을 유지하기
  • 정서적 의존을 조장하기
  • 진정성이나 비판적 사고를 낮추기

기본 원칙은 다음과 같다: 한 번의 대화가 이후 대화를 더 조종적이거나, 의존적이거나, 부정직하게 만드는 영구적인 설정이 되어서는 안 된다.

파일은 또한 기억 검색 과정을 직접적으로 드러내는 용어(예: 시스템이 사용자 프로필에 접근했다는 내용을 반복적으로 언급하는 것)를 피하도록 요구한다.

Claude는 저장된 맥락을 사용할 수 있지만, 모든 응답을 사용자에게 "개인 정보가 저장되었습니다"라고 상기시키는 형태로 만들어서는 안 된다.

세 가지 평범한 단어를 피하라는 명확한 제안

공개된 시스템 프롬프트는 Claude가 세 가지 영어 수식어를 피하도록 요구한다:

  • "genuinely" (진정으로)
  • "honestly" (솔직히)
  • "straightforward" (직접적인)

그 이유는 스타일적인 고려 사항이다.

어시스턴트가 기본적으로 정직해야 한다면, 솔직함을 반복해서 강조하는 것은 오히려 의도적이거나 지나치게 방어적으로 보일 수 있다.

기억 및 안전 관련 조항에 비하면 이 규칙은 사소하지만, 프로덕션 프롬프트가 얼마나 세밀해질 수 있는지 보여준다.

모델의 최종 성격은 수백 개의 작은 지시 사항에 의해 형성될 수 있다. 예:

  • 선호하는 문장 길이
  • 후속 질문을 할지 여부
  • 몇 개의 후속 질문을 할지
  • 비판에 대응하는 방식
  • 어색하게 들리는 용어
  • 목록을 사용하는 시기
  • 대화를 마무리하는 방식

최종 경험은 바로 이러한 지시 사항들이 함께 구성된다.

모델 훈련과 방대한 제품 설명 계층

저작권 규칙은 강력한 제약 조건으로 설정됨

저장소에는 상세한 저작권 장이 포함되어 있다.

가장 두드러지는 규칙은 웹 출처의 축어적 인용에 대한 엄격한 제한이다: 각 인용문은 15단어를 초과할 수 없다.

해당 장은 또한 어시스턴트가 다음을 수행해야 한다고 명시한다:

  • 의역을 우선시할 것
  • 동일한 출처에 대한 여러 번의 짧은 인용을 피할 것
  • 원문의 문장 구조를 모방하지 말 것
  • 기사의 제목과 서술 순서를 재현하지 말 것
  • 가사와 시를 복사하지 말 것
  • 인용 출처를 위조하지 말 것
  • 원작을 읽는 것을 대체할 수 있는 상세한 대안을 제공하지 말 것

이 프롬프트는 저작권을 부차적인 글쓰기 선호도가 아닌 제품 수준의 제약 조건으로 간주한다.

이는 중요한 결과를 초래한다: 시스템은 저작권이 있는 출처의 정확한 구조를 따르지 않고 사용자의 주제를 따라갈 수 있다.

이것이 이 Markdown 파일이 중국어 원문을 줄 단위로 번역한 것이 아니라 독립적으로 편집된 각색 버전인 이유이기도 하다.

Claude 제품이 적극적으로 추천됨

이 공개 파일에는 recommend_claude_apps라는 도구가 포함되어 있다.

그 용도는 사용자의 현재 작업과 일치할 때 관련 Anthropic 제품을 추천하는 것이다.

나열된 매핑에는 다음 예시가 포함된다:

사용자 작업 파일에서 제안하는 Claude 제품
코드 작성 또는 디버깅 Claude Code
길고 여러 단계의 연구 또는 지식 작업 Claude Cowork
프로토타입, 모형, 랜딩 페이지 또는 시각적 작업 Claude Design
스프레드시트 수식 또는 모델 Claude for Excel
슬라이드 프레젠테이션 Claude for PowerPoint
문서 처리 Claude for Word
받은 편지함 작업 Claude for Outlook
브라우저 관련 작업 Claude in Chrome

이 추천은 채팅 내에서 작업을 완료하는 것을 대체해서는 안 된다.

대신, 제품 카드는 미래 또는 확장 작업을 위한 제안으로 답변과 함께 제공된다.

Anthropic의 공개 제품 문서는 이러한 제품과 플러그인이 실제로 존재함을 확인한다. 또한 회사는 Claude 내에서의 맥락 기반 애플리케이션 제안에 대해서도 문서화했다.

GitHub 파일은 더 나아가 소비자 프롬프트가 Anthropic 자체 제품 생태계를 보여주도록 얼마나 강력하게 유도될 수 있는지 보여준다.

제3자 커넥터는 다른 규칙을 따릅니다

동일한 파일이라도 외부 파트너에 대해서는 더 신중한 태도를 취합니다.

제3자 커넥터의 경우, 사용자가 일반적인 의도만 표현할 때 어시스턴트는 임의로 공급업체를 선택하지 않도록 지시받습니다.

예를 들어:

  • 차량 호출을 요청하면서 특정 택시 서비스를 지정하지 않는 경우
  • 음악 감상을 요청하면서 특정 음악 앱을 지정하지 않는 경우
  • 레스토랑 예약을 요청하면서 특정 예약 플랫폼을 지정하지 않는 경우

워크플로우는 사용 가능한 옵션을 제시하여 사용자가 직접 선택하도록 해야 합니다.

Anthropic의 공식 도움말 센터는 이러한 동작을 확인했습니다. 여러 연결된 앱이 도움을 줄 수 있을 때 Claude는 특정 앱을 자동으로 기본값으로 설정하지 않고 옵션을 표시합니다. 또한 Anthropic은 연결된 앱의 추천이 유료 프로모션이 아니라고 밝혔습니다.

이는 흥미로운 대조를 형성합니다:

  • Anthropic 제품은 작업과 일치할 때 능동적으로 추천될 수 있음
  • 제3자 공급업체는 사용자의 더 명확한 승인이 필요함

선택 전의 결정.

공개 프롬프트는 상업적 발견과 사용자 통제를 동일한 라우팅 계층에 배치합니다.

제품 홍보와 절제가 동일한 구성에 공존합니다

원문은 앱 추천 규칙을 시스템 프롬프트에 내장된 판매 채널로 해석합니다.

이러한 해석은 이해할 수 있지만, 전체적인 그림은 더 미묘합니다.

추천 기능은 여러 목적을 달성할 수 있습니다:

  • 사용자가 이미 비용을 지불한 도구를 발견하도록 도움
  • 작업을 더 강력한 인터페이스로 전환
  • Anthropic 제품 사용률 향상
  • 채팅, 코드, 디자인, 업무 간 마찰 감소
  • Anthropic에 상업적 가치 창출

이러한 모든 목적은 동시에 성립될 수 있습니다.

핵심 문제는 다음과 같습니다:

  • 추천이 관련성이 있는가
  • 현재 요청이 여전히 완료될 수 있는가
  • 제안이 명확하게 식별 가능한가
  • 사용자가 거절할 자유를 유지하는가
  • 제3자 순위가 유료 영향을 받지 않는가
  • 모델이 다른 제품에 대한 수요를 창출하지 않는가

프롬프트 자체의 지침은 일부 위험을 인식하고 있는 것으로 보이며, 추천 수를 제한하고 각 추천을 현재 작업에 바인딩합니다.

공식 메모리 및 연결된 앱 문서가 일부 내용을 입증합니다

Anthropic이 GitHub 프롬프트를 검증하지는 않았지만, 그 설명 중 일부는 공개 문서의 제품 동작과 일치합니다.

Anthropic은 Claude가 다음을 수행할 수 있다고 공식적으로 밝혔습니다:

  • 과거 대화 기록 검색
  • 채팅 메모리 기능 활용
  • 메모리에서 제외된 시크릿 대화 지원
  • 대화 맥락에 따라 연결된 앱 추천
  • 사용자가 여러 연결된 서비스 중에서 직접 선택하도록 함
  • Excel, Word, PowerPoint 및 Outlook과 호환
  • Claude 코드, 협업 및 디자인 기능을 통해 전문 워크플로우 처리

이는 저장소의 진위를 증명하지 않습니다.

공개 제품 동작과 문서를 통해 설득력 있는 버전을 재구성하는 것이 완전히 가능합니다.

그러나 겹치는 부분은 파일의 많은 제품에 대한 광범위한 설명이 사용자가 독립적으로 검증할 수 있는 Claude 기능 특성과 일치함을 시사합니다.

파일이 알려주지 않는 정보

유출 또는 재구성된 시스템 프롬프트는 증거로서 한계가 있습니다.

모델 가중치를 밝힐 수 없음

이 문서는 다음을 보여주지 않습니다:

  • 훈련 데이터
  • 모델 가중치
  • 아키텍처 설계
  • 강화 학습 과정
  • 안전 분류기 가중치
  • 내부 평가 데이터
  • 숨겨진 인프라

프롬프트는 시스템의 한 계층일 뿐입니다.

모든 런타임 지침을 표시할 수 없음

AI 제품은 다음에 따라 동적으로 지침을 추가할 수 있습니다:

  • 선택된 도구
  • 계정 요금제
  • 지리적 위치
  • 안전 분류기
  • 대화 상태
  • 실험 설정
  • 연결된 앱
  • 사용자 설정
  • 기업 정책

캡처된 프롬프트는 특정 순간의 단일 계정만을 대표할 수 있습니다.

자주 변경될 수 있음

소비자용 AI 제품은 빠르게 업데이트됩니다.

도구 이름, 모델 설명, 안전 규칙, 앱 추천 및 메모리 동작은 변경될 수 있으며, 공개 저장소가 반드시 동기화되어 업데이트되지는 않습니다.

공식적인 보안 공개가 아님

해당 저장소는 Anthropic 서버가 침해되었음을 증명하지 않습니다.

시스템 프롬프트는 때때로 다음과 같은 방법으로 재구성될 수 있습니다:

프롬프트 인젝션 기술, 인터페이스 관찰, 모델 응답, 클라이언트 동작 또는 여러 소스의 조합.

'유출'이라는 용어는 주장된 내부 지침이 공개적으로 나타났음을 설명합니다. 그것 자체로는 이러한 지침이 어떻게 획득되었는지를 나타내지 않습니다.

공개일 데모는 Opus 5의 시각적 코딩 능력을 보여줍니다

원래 보고서의 후반부는 Opus 5 출시 직후 개발자가 발표한 실험에 초점을 맞춥니다.

한 개발자는 Opus 5가 단 한 번의 시도로 약 1.5시간 만에 멀티플레이어 모드의 봇을 포함한 1인칭 슈팅 게임 프로토타입을 만들었다고 말했습니다.

또한 해당 제작자는 비행 메커니즘을 개선해야 한다고 지적했습니다.

이미지는 Cengiz가 Twitter에 게시한 Opus 5 테스트 내용입니다. 그는 1인칭 슈팅 게임 프로토타입으로 Opus 5를 테스트했으며, 한 번에 생성하는 데 약 1.5시간이 걸렸다고 말합니다. 전체 게임을 만들었을 뿐만 아니라 멀티플레이어 모드에서 플레이할 수 있는 봇도 생성했습니다. 비행 메커니즘은 조정이 덜 되었을 수 있지만, 이것이 역사상 가장 강력한 모델이라고 생각합니다. 이미지는 컨텍스트와 밀접하게 관련되어 있으며, 컨텍스트에서 언급된 개발자 실험에서 Opus 5가 1.5시간 만에 완성한 1인칭 슈팅 게임 프로토타입의 내용을 시각적으로 보여줍니다.

다른 공개 데모는 다음과 같습니다:

  • 하나의 프롬프트로 만든 3D 슈팅 게임.
  • 물리 시뮬레이션이 포함된 Rocket League 스타일 게임.
  • 단일 HTML 파일로 구축된 프로그래매틱 풍경화.
  • 한 번에 완성되었다고 알려진 스노보드 프로토타입.

이 이미지는 만화 스타일의 스키 장면을 보여줍니다: 주황색 보호 장비를 착용한 만화 캐릭터가 스노보드를 타고 눈 덮인 경사면에 서서 멀리 눈 덮인 통나무집, 침엽수림, 그리고 끝없이 펼쳐진 설산을 바라보고 있습니다. 이 이미지에 해당하는 컨텍스트는 Claude Opus 5 출시 후 공개적으로 시연된 결과물 중 하나로, 개발자가 한 번에 완성했다고 말한 스노보드 프로토타입의 시각적 표현이며, 이러한 데모는 Claude Opus 5의 시각 및 코딩 능력을 보여주는 사례로, 개발자가 이 모델을 사용해 빠르게 생성한 디지털 창작 콘텐츠입니다.

이러한 예는 유용한 설명이지만, 통제된 벤치마크는 아닙니다.

소셜 미디어의 데모는 종종 중요한 세부 정보를 생략합니다. 예를 들어:

  • 전체 프롬프트.
  • 숨겨진 후속 지침.
  • 도구 구성.
  • 실패한 시도.
  • 수동 편집.
  • 모델 노력 수준 설정.
  • 토큰 사용량.
  • 실행 시간.
  • 프레임워크 및 리소스.
  • 최종 결과가 여러 출력 중에서 선택되었는지 여부.

Anthropic의 공식 발표는 Opus 5의 시각 및 코딩 능력 향상이라는 더 광범위한 주장을 독립적으로 뒷받침합니다. 대화형 시각 제품, 3D 모델링, 프론트엔드 작업, 더 강력한 장기 코딩 성능을 강조했습니다.

가장 가치 있는 부분은 제약 계층입니다

수만 개의 토큰을 포함하는 시스템 프롬프트는 비효율적으로 보일 수 있습니다.

그러나 소비자용 AI 제품은 이상적인 경로만 처리해야 하는 것이 아닙니다.

다음과 같은 상황과 관련된 지침이 필요합니다:

  • 민감한 개인 정보.
  • 파일 누락.
  • 충돌하는 정보 출처.
  • 시사 뉴스.
  • 저작권 요청.
  • 위기 언어.
  • 도구 권한 부여.
  • 연결된 서비스.
  • 구매 및 예약.
  • 영구 메모리.
  • 제품 추천.
  • 예상치 못한 삭제.
  • 긴 대화.
  • 사용자 비판.
  • 입증되지 않은 주장.

짧은 프롬프트는 어시스턴트가 이상적인 상황에서 무엇을 해야 하는지 설명할 수 있습니다.

긴 프롬프트는 종종 상황이 복잡해졌을 때 어시스턴트가 무엇을 해서는 안 되는지를 정의하기 위한 것입니다.

이것이 유출된 프롬프트 논의의 핵심 통찰력입니다.

해당 모델의 분석

눈에 보이는 능력이 관심을 끌지만, 어시스턴트를 만드는 것은 그 능력의 경계에 의해 동등하게 제약을 받습니다.

개발자가 프롬프트 구조에서 배울 수 있는 점

해당 파일을 공식 문서로 취급하지 않더라도, AI 제품을 구축하는 팀에게 유용한 설계 경험을 제공합니다.

1.

지속적 기억과 대화 컨텍스트 분리

대화 중 언급된 모든 내용을 영구적으로 저장할 필요는 없습니다.

지속성, 민감성, 출처 및 삭제에 대해 명확한 기준을 사용하세요.

2. 저장된 사실의 출처 표시

모델의 추론은 사용자의 진술과 구분하기 어려워서는 안 됩니다.

출처 레이블은 사용자 프로필 표류를 줄일 수 있습니다.

3. 도구 권한 명확화

모델은 직접 작업을 수행해야 하는 시점, 사용자에게 물어봐야 하는 시점, 사용자에게 선택권을 제공해야 하는 시점을 알아야 합니다.

4. 추천을 제품 행동으로 간주

내부 제품 및 타사 서비스 추천에는 별도의 규칙, 투명성 및 관련성 제한이 필요합니다.

5. 중단 조건 작성

강력한 에이전트는 언제 계속해서는 안 되는지에 대한 지침이 필요합니다.

6. 동적 컨텍스트를 위한 설계

메인 프롬프트는 도구, 안전 분류기, 계정 설정 및 제품 실험으로부터의 추가 지침을 예상해야 합니다.

7. 프롬프트에만 의존하지 마세요

권한, 샌드박스, 확인, 개인정보 제어 및 서버 측 정책 실행은 모델이 수행할 수 있는 작업을 제한해야 합니다.

프롬프트는 지침입니다. 안전한 격리 경계가 아닙니다.

자주 묻는 질문

Claude Opus 5의 시스템 프롬프트가 공식적으로 유출되었나요?

공개 GitHub 저장소가 Claude 웹 및 모바일 버전의 시스템 프롬프트를 재현했다고 주장합니다. Anthropic은 해당 파일이 완전하거나 정확한 프로덕션 프롬프트인지 확인하지 않았으므로, 이는 타사 검증을 거치지 않은 캡처 내용으로 간주해야 합니다.

주장된 Opus 5 시스템 프롬프트의 크기는 얼마인가요?

GitHub 인터페이스에는 1,511줄, 파일 크기는 132KB로 표시됩니다. 원본 텍스트는 135,027자와 19,370개의 공백으로 구분된 단어를 포함하며, 소스 기사는 대략 약 34,000개의 토큰으로 추정합니다.

해당 파일에는 무엇이 포함되어 있나요?

행동 규칙, 제품 정보, 메모리 지침, 안전 정책, 약 30개의 도구 정의, JSON 스키마, 검색 규칙, 저작권 요구사항, 앱 추천, 커넥터 선택 및 파일 처리 지침이 포함되어 있습니다.

Claude에게 정말 지속적 기억이 있나요?

네. Anthropic은 공식적으로 채팅 기록 및 과거 채팅 검색으로부터의 기억을 문서화했습니다. GitHub 파일에 설명된 정확한 파일 시스템 경로와 구현 세부 사항은 아직 Anthropic에 의해 공개적으로 검증되지 않았습니다.

Claude가 적극적으로 Anthropic 제품을 홍보하나요?

공개 파일에는 Claude가 특정 작업을 위해 관련 Anthropic 앱을 추천하도록 지시하는 도구가 포함되어 있습니다. Anthropic의 공식 문서에 따르면 Claude는 컨텍스트에 맞는 앱 제안을 할 수 있으며, Claude Code, Cowork, Design 및 Microsoft 365 플러그인은 사용 가능한 제품입니다.

Claude가 자동으로 타사 앱을 선택하나요?

Anthropic의 현재 문서에 따르면 여러 연결된 서비스가 작업을 처리할 수 있는 경우 사용자가 선택할 수 있습니다. 주장된 프롬프트는 또한 Claude가 이름이 지정되지 않은 타사 파트너를 묵묵히 선택하지 않도록 지시합니다.

공식 Claude Opus 5 가격은 얼마인가요?

Anthropic은 Opus 5의 가격을 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 25달러로 책정했습니다. 빠른 모드는 기본 모드보다 약 2.5배 빠르게 실행되며, 기본 요금의 두 배로 책정됩니다.

게임 데모를 신뢰할 수 있는 벤치마크로 사용할 수 있나요?

아니요. 이는 개발자들이 온라인에서 공유한 데모 콘텐츠로, 표준화된 평가가 아닙니다. 잠재적 능력을 보여주지만, 재현 가능한 모델 비교 정보를 제공하기에는 충분하지 않습니다.

관련 도구

  • Claude: Anthropic이 Claude 모델과 상호작용하기 위한 주요 채팅 인터페이스입니다.
  • Claude Code: 터미널, 통합 개발 환경, 코드 저장소 및 개발 작업을 위한 Anthropic의 자율 코딩 환경입니다.
  • Claude Cowork: 파일, 애플리케이션 및 연결된 서비스를 대상으로 다단계 지식 작업을 처리하는 자율 작업 공간입니다.
  • Claude Design: 프로토타입, 데모 슬라이드, 랜딩 페이지 및 브랜드 디자인 작업을 위한 시각적 작업 공간입니다.
  • 모델 컨텍스트 프로토콜: 많은 Claude 커넥터 및 상호작용 도구 통합을 뒷받침하는 개방형 프로토콜입니다.
  • GitHub: 시스템 프롬프트 파일로 주장되는 게시 플랫폼인 코드 호스팅 웹사이트입니다.

관련 링크

요약

공개 GitHub 저장소가 Anthropic 소비자 채팅 인터페이스에서 Claude Opus 5가 사용하는 1511줄의 시스템 프롬프트를 재현했다고 주장합니다. 이 파일은 비정상적으로 상세하며, 지속적 기억, 약 30개의 도구, 저작권 규칙, 제품 추천, 연결된 앱, 검색 행동, 파일 처리 및 안전 정책을 다룹니다.

기억, 대화 기록 검색, Claude 앱, Microsoft 365 통합 및 상황별 커넥터 제안을 포함한 여러 광범위한 요소가 Anthropic의 공식 제품 문서와 일치합니다. 그러나 이러한 일관성이 파일의 진위를 증명하지는 않습니다.

아카이브 완료.

이 파일에서 가장 주목할 만한 부분은 숨겨진 지침이 아니라, 강력한 기반 모델을 기억하고, 검색하고, 파일을 생성하고, 도구를 사용하며 외부 서비스와 상호작용할 수 있는 소비자용 제품으로 전환하는 데 필요한 제약 계층의 규모입니다.

Claude Opus 5의 공개 데모는 모델이 무엇을 구축할 수 있는지 보여줍니다. 주장된 시스템 프롬프트는 모델이 무엇을 기억하고, 인용하고, 추천하고, 수행할 수 있는지 결정하는 데 얼마나 많은 제품 엔지니어링이 투입되었는지 드러냅니다.

Claude Opus 5 系统提示泄露解析:记忆、工具、版权与产品路由