Anthropic이 Claude Fable 5 와 Claude Mythos 5 를 출시하며 전용 프롬프팅 가이드를 공개했습니다. 이번 모델은 사람이 며칠씩 처리하는 복잡한 작업을 스스로 수행할 정도로 변화가 큽니다. 프롬프트 가이드의 핵심은 기존의 촘촘한 가드레일을 대폭 줄이라는 권고입니다.

모델 변화에 맞춘 실행 구조 재설계

Fable 5 를 도입할 때 가장 먼저 조정할 부분은 대기 시간입니다. 어려운 작업을 해결하느라 모델이 고민하는 시간이 길어졌기에 조율이 중요합니다. 몇 분씩 걸리는 자율 실행을 버티려면 클라이언트 타임아웃을 늘리거나 비동기 작업 방식으로 설계해야 합니다.

모호한 상황에서 계획만 세우는 현상을 방지하는 지시문이 유용하며 효과적입니다. Anthropic은 다음과 같은 시스템 지시를 권장합니다.

When you have enough information to act, act. Do not re-derive facts already established in the conversation, re-litigate a decision the user has already made, or narrate options you will not pursue in user-facing messages. If you are weighing a choice, give a recommendation, not an exhaustive survey. This does not apply to thinking blocks.

행동할 근거가 있다면 바로 실행하라는 의미로 매우 명확합니다. 불필요한 나열을 막는 일은 효율성을 높이는 데 기여합니다.

노력 수준 조절과 과도한 작업 제어

effort 옵션은 지능과 비용의 균형을 맞추는 핵심 도구입니다. 보통은 high 를 기본으로 사용하고 가벼운 작업에는 medium 이나 low 를 설정합니다. Fable 5 는 낮은 수준에서도 이전 모델의 높은 성능을 넘어서므로 작업에 맞는 적절한 선택이 중요합니다.

높은 노력 수준을 쓰면 요청하지 않은 리팩터링이나 기능 추가까지 진행하므로 주의해야 합니다. 이를 제어하고자 다음 지시문을 프롬프트에 추가합니다.

Don't add features, refactor, or introduce abstractions beyond what the task requires. A bug fix doesn't need surrounding cleanup and a one-shot operation usually doesn't need a helper. Don't design for hypothetical future requirements: do the simplest thing that works well. Avoid premature abstraction and half-finished implementations. Don't add error handling, fallbacks, or validation for scenarios that cannot happen. Trust internal code and framework guarantees. Only validate at system boundaries (user input, external APIs). Don't use feature flags or backwards-compatibility shims when you can just change the code.

불필요한 에러 처리나 추상화를 막는 것만으로도 실행 비용을 크게 아끼기에 효율적입니다. 시스템 경계에서만 검증을 수행하게 제어하는 방식이 효과적입니다.

장기 자율 실행의 신뢰성 확보

장기 실행을 믿고 맡기려면 모델이 수행한 작업 결과를 스스로 검증하게 만드는 검증 과정이 필수적입니다. 행동 결과와 보고 내용이 어긋나는 현상을 방지하고자 도구 실행 결과를 대조하도록 강제합니다. 다음 검증 지시문이 유용합니다.

Before reporting progress, audit each claim against a tool result from this session. Only report work you can point to evidence for; if something is not yet verified, say so explicitly. Report outcomes faithfully: if tests fail, say so with the output; if a step was skipped, say that; when something is done and verified, state it plainly without hedging.

확실한 증거가 있는 내용만 보고하게 강제하는 규칙으로 매우 정확합니다. 이 지시문은 허위 보고를 막는 데 탁월한 효과를 냅니다.

안전 분류기 작동으로 인해 stop_reason: ‘refusal’ 이 반환되는 제약이 존재합니다. 보안 연구나 생명과학 분야의 정상적인 요청도 차단될 위험이 있으므로, 이럴 때는 Claude Opus 4.8 로 우회하는 클라이언트 설정을 구성해 둡니다.

에이전트 시스템의 신뢰성을 높이고자 새로운 가이드라인을 바로 적용해 보시길 권장합니다.

요약

  • Claude Fable 5의 고도화된 지능에 맞춰 기존의 촘촘한 프롬프트 가이드라인과 가드레일을 대폭 덜어내는 역설적인 접근이 필요합니다.
  • 장기 자율 실행 시 발생할 수 있는 허위 보고를 막기 위해 보고 전에 실제 도구 실행 결과와 대조하도록 검증 지시를 강제해야 합니다.
  • 보안 및 생명과학 분야의 정상적인 요청이 안전 분류기에 걸려 거부될 경우를 대비해 Claude Opus 4.8로 우회하는 폴백 시스템을 마련하는 것이 안전합니다.