증상을 먼저 찾고 그 절로 가라 - Claude Fable 5.1 프롬프팅 공식 문서의 열다섯 가지 처방
기존 Fable 5 프롬프트가 그대로 잘 작동한다고 전제하면서도 알아둘 만한 행동 차이 열다섯 가지를 증상 기준으로 정리한 공식 문서. 노력 수준 재측정, 진행 상황 갱신 요청, 대화 이력 추가 전용 유지, 문장 밀도, 전체 작업 완수 등 각 절이 관측 증상과 그에 대응하는 프롬프트 문구를 짝지어 제시한다.
증상을 먼저 찾고 그 절로 가라
TL;DR
- 문서의 전제가 안심시키면서 시작하는데 기존 Claude Fable 5 프롬프트는 변경 없이도 Claude Fable 5.1에서 잘 작동할 것이지만, 알아둘 만한 소수의 행동 차이가 있다는 것이다. 그리고 사용법이 지시된다. 관측한 것과 일치하는 절에서 시작하라는 것이며, 열다섯 개 증상과 그에 대응하는 절이 목록으로 짝지어 제시된다.
- 첫 통제 수단이 노력 수준인데 기본값인 high에서 시작해 low와 medium, xhigh, max를 자신의 평가에 대고 시험하라는 것이고 노력은 Fable 5.1에서 지능과 지연, 비용을 맞바꾸는 주된 통제 수단이라는 것이다. 재측정도 요구된다. Fable 5에서 이미 한 번 훑었더라도 다시 훑으라는 것인데 노력 수준 이름이 모델 간에 같은 양의 사고에 대응하지 않기 때문이다.
- 이력 관리가 하드 제약이 됐는데 2026년 8월 31일 이후 생성된 새 계정에서 Fable 5.1의 사고 블록은 그것을 만든 정확히 그 대화에서만 유효하며, 접두부가 바뀐 뒤 사고 블록을 재생하는 요청은 400을 반환한다는 것이다. 그래서 권고가 선행된다. 향후 모델은 이 검사를 모든 계정에 적용할 것으로 예상되므로 지금 적용되지 않더라도 지금 그 패턴을 채택하라는 것이다.
- 문체 처방이 구체적인데 Fable 5.1의 글은 이전 모델보다 대체로 나아졌지만 어떤 경우에는 Fable 5보다 산문이 더 조밀해 문장이 길어지고 문단 나눔이 적다는 것이다. 그리고 안티패턴을 정의해 주는 방식이 제시된다. 겉멋 든 산문은 직접적 진술 대신 은유와 장식을 쓰는 것이며 그 표현들은 생각을 전달하기 위해서가 아니라 필자를 과시하기 위해 존재하는데, 짧은 버전인 겉멋 든 산문을 모두 제거해 주세요도 통하는 편이다.
- 자율 실행 처방의 첫 문장이 핵심으로 지목되는데 사용자가 실시간으로 보고 있지 않으며 작업 중간에 질문에 답할 수 없다고 알려 주는 첫 문장이 효과의 많은 부분을 담당하므로 쓰인 대로 유지하라는 것이다. 그리고 자기 점검이 요구된다. 턴을 끝내기 전 마지막 문단이 계획이나 분석, 질문, 다음 단계 목록, 하지 않은 일에 대한 약속이라면 지금 도구 호출로 그 일을 하라는 것이다.
Source
Prompting Claude Fable 5.1 — Anthropic 공식 문서, Claude Platform Docs
Knowledge
증상 기준으로 찾아 읽는 문서
문서는 참조 경로를 먼저 안내한다. 모델의 능력과 API 변경, 가격, 이용 가능성은 Claude Fable 5.1의 새로운 점 문서를 보라는 것이고 Claude 모델 전반에 적용되는 기법은 프롬프팅 모범 사례를 보라는 것이다.
그리고 전제가 제시된다. 기존 Claude Fable 5 프롬프트는 변경 없이도 Claude Fable 5.1에서 잘 작동할 것이지만 알아둘 만한 소수의 행동 차이가 있다는 것이다. 그래서 읽는 방식이 지시된다. 관측한 것과 일치하는 절에서 시작하라는 것이다.
증상과 절이 짝지어 열거된다. 어떤 노력 수준으로 돌릴지 확실하지 않거나 지연과 비용이 작업에 걸맞지 않게 높으면 모든 노력 수준을 고려하라는 절이다. 도구 호출 사이에 텍스트가 거의 또는 전혀 없으면 사용자 대상 진행 상황 갱신을 요청하라는 절이다. 에이전트 루프에서 턴마다 도구 호출이 하나면 독립적인 도구 호출을 묶으라는 절이다. 요청이 다른 대화에 묶여 있다는 오류로 실패하거나 하네스가 요청 사이에 이전 턴을 편집하면 대화 이력을 추가 전용으로 유지하라는 절이다. 산문이 길고 조밀하면 문장 밀도 절이다. 채팅 답변이 내용에 필요한 만큼의 구조를 갖추지 못하면 채팅에서의 서식 절이다. 요약이 출처 표현을 인용으로 표시하지 않고 재현하면 검색된 출처 인용 절이다. 작업이 끝나기 전에 턴이 끝나거나 모델이 이미 요청한 작업에 대해 허락을 구하면 전체 작업을 완수하라는 절이다. 클라이언트 측 압축 요약이 제약이나 결정, 정확한 세부를 빠뜨리면 압축 요약에서 무엇을 보존할지 모델에게 알려주라는 절이다. 요청하지 않은 수정이나 확장, 또는 작업이 요구한 것보다 많은 테스트 파일 커밋이 있으면 변경과 테스트를 작업이 요구한 범위로 유지하라는 절이다. 낮은 노력에서 검색하지 않고 기억으로 답하면 낮은 노력에서의 검색 촉발 절이다. 무해한 코딩 요청이 거부 사유를 반환하면 안전장치 오탐을 줄이라는 절이다. 작은 변경에 파일 전체를 다시 쓰면 파일 전체 재작성보다 표적 편집을 선호하라는 절이다. xhigh나 max 노력에서 긴 산출물이 오래 걸리거나 최대 토큰에 걸리면 긴 출력을 위한 여유를 남기라는 절이다. 서브에이전트가 돌아가는 동안 리드 에이전트가 놀고 있으면 리드 에이전트가 계속 작업하게 하라는 절이다. 차트와 조밀한 이미지에 대한 답이 세부를 놓치면 시각 작업에 잘라내기와 확대 도구를 주라는 절이다.
안전 관련 사항도 미리 밝혀진다. Claude Fable 5.1은 안전 분류기를 돌리며 거부 사유를 반환할 수 있다는 것이다.
노력 수준을 다시 측정하라
시작점이 제시된다. 기본 노력 수준인 high에서 시작한 뒤 나머지 수준들인 low와 medium, xhigh, max를 자신의 평가에 대고 시험하라는 것이다. 그리고 노력의 위치가 규정된다. 노력은 Claude Fable 5.1에서 지능과 지연, 비용을 맞바꾸는 주된 통제 수단이라는 것이다.
재측정이 요구되는데 이유가 명확하다. Claude Fable 5에서 이미 한 번 훑었더라도 그 훑기를 다시 돌리라는 것이며 노력 수준 이름이 모델 간에 같은 양의 사고에 대응하지 않기 때문이라는 것이다.
성능 분포도 서술된다. Claude Fable 5.1의 Claude Fable 5 대비 능력 향상은 모든 노력 수준에서 나타나며 높은 설정에서 가장 크다는 것이다. 그래서 비용 조정 지침이 나온다. medium에서는 결과가 대략 Claude Fable 5와 맞먹으면서 비용은 더 낮으므로, 자신의 평가가 품질이 유지된다고 보여주는 곳에서는 medium이나 low로 내리라는 것이다.
low의 위치가 흥미롭게 제시된다. low에서 Claude Fable 5.1은 작업당 비용에서 Claude Opus와 Claude Sonnet 모델들과 자주 경쟁력이 있으면서 점수는 더 높다는 것이다. 그래서 권고가 나온다. 그렇지 않으면 더 작은 모델을 더 높은 노력 수준으로 돌리게 될 곳이라면 어디든 비교에 포함하라는 것이다.
노력별 특이 행동 두 가지도 예고된다. low에서는 검색과 검색 도구를 덜 자주 호출하고 xhigh와 max에서는 긴 산출물을 쓰기 전에 더 오래 생각할 수 있다는 것이다.
진행 상황 갱신은 요청해야 나온다
기본 행동이 규정된다. Claude Fable 5.1의 기본 행동은 긴 도구 호출 턴 동안 Claude Fable 5보다 사용자 대상 갱신을 더 적게 쓴다는 것이다. 그리고 조건이 붙는다. 높은 노력과 더 긴 도구 연쇄에서 더 두드러진다는 것이다. 그래서 사용자가 겪는 것이 서술된다. 에이전트가 몇 분씩 조용해지거나 전체 작업이 아니라 마지막 단계만 다루는 최종 메시지를 본다는 것이다.
첫 번째 점검이 지시된다. 클라이언트가 진행 상황 갱신을 아예 받고 있는지 확인하라는 것이다. 구조가 설명된다. 도구 호출 사이 모델의 짧은 메모, 즉 방금 무엇을 찾았고 다음에 무엇을 하는지는 진행 상황 갱신 사고 블록으로 돌아오는데, 기본 설정인 생략 상태에서 그 블록들은 비어 있다는 것이다. 그래서 설정이 안내된다. 갱신 표시로 설정하고 비어 있지 않은 각 사고 블록을 상태 줄로 렌더링하거나 요약 설정으로 해서 요약된 추론과 함께 받으라는 것이다. 그리고 진단이 붙는다. 요청하지 않고 있다면 모델의 갱신이 그저 사용자에게 도달하지 않는 것일 수 있다는 것이다.
두 번째 점검도 지시된다. 서술을 억제하는 지시가 프롬프트에 있는지 감사하라는 것이다. 배경이 설명된다. 일부 이전 모델들은 작업 중 갱신을 주는 데 열성적이어서 모든 발견은 최종 응답을 위해 보류하라 같은 시스템 프롬프트 줄로 이어졌다는 것이다. 그래서 순서가 지정된다. 무언가를 추가하기 전에 그런 줄들을 제거하라는 것이다.
그래도 더 많은 갱신을 원한다면, 예컨대 페어 프로그래밍이나 다른 휴먼 인 더 루프 작업에서라면 짧은 시스템 프롬프트 줄을 추가하라고 한다. 언제 사용자 대상 텍스트를 원하는지와 각 갱신이 무엇을 담아야 하는지를 말하는 줄이라는 것이다. 제시된 문구의 핵심은 마지막 메시지만 보는 독자가 전체 그림을 갖도록 스스로 성립하는 짧은 요약으로 닫으라는 것이다.
UI 관련 주의도 있다. 제품이 도구 출력을 접거나 숨긴다면 모델에게 알려주라는 것이다. 그러지 않으면 UI가 결코 표시하지 않는 출력을 사용자에게 보여주려고 명령을 실행할 수 있다는 것이다. 전달 방식도 지정된다. 턴 범위 시스템 메시지로 전달하라는 것이다.
독립적인 도구 호출을 묶으라
기본 동작은 문제없다고 밝혀진다. Claude Fable 5.1은 보통 기대대로 병렬 도구 호출을 발행하며 요청이 가져올 것 여럿을 지명하면 그 호출들을 병렬로 발행한다는 것이다.
예외가 특정된다. 다음 독립적 호출들이 명시적으로 요청된 것이 아니라 작업에 의해 함축되는 코딩과 컴퓨터 사용 루프, 즉 맞춤 코딩 에이전트와 배시 및 편집기 하네스, 컴퓨터 사용이라는 것이다. 거기서는 턴마다 하나씩 발행할 수 있다는 것이다. 그리고 영향이 정리된다. 답변 품질에는 영향이 없지만 추가 턴마다 토큰과 왕복, 실제 시간이 든다는 것이다.
처방은 한 문장이다. 현재 요청 끝에 붙이는 한 문장 자극인데, 먼저 다음에 필요한 것을 속으로 나열한 다음 다른 것의 결과에 의존하지 않는 모든 항목을 이 한 응답에서 요청하라는 것이다.
배치 방법이 상세히 규정된다. 도구 결과를 돌려보낼 때마다 그 사용자 메시지 뒤에 턴 범위 시스템 메시지로 붙이라는 것이다. 동작이 설명된다. 나중의 사용자 메시지가 존재하면 API가 이전 사본들을 비우므로 모델은 가장 새것만 읽는다는 것이다.
그리고 중요한 금지가 나온다. 매 턴 새 사본을 붙이고 이전 사본들은 바이트 단위로 그대로 있는 자리에 두라는 것이다. 이유가 명시된다. 배열에 남아 있지만 한번 비워지면 모델이 보지 않으며 입력 토큰도 들지 않는다는 것이다. 그래서 위험이 지목된다. 그것들을 삭제하거나 다시 쓰는 것은 이전 턴에 대한 편집이며 그 지점부터 프롬프트 캐시를 다시 시작시키고 그 뒤에 온 사고 블록들을 무효화한다는 것이다.
대화 이력을 추가 전용으로 유지하라
원칙이 제시된다. 각 어시스턴트 턴을 API가 반환한 그대로, 사고 블록까지 포함해 이력에 붙이고 요청 사이에 이전 턴을 편집하지 말라는 것이다.
하드 제약이 밝혀진다. 2026년 8월 31일 이후 생성된 새 계정에 대해서는 Claude Fable 5.1의 사고 블록이 그것을 만든 정확히 그 대화에서만 유효하다는 것이다. 결과도 구체적이다. 접두부, 즉 시스템 프롬프트나 도구 목록, 또는 앞선 어떤 메시지가 바뀐 뒤 사고 블록을 재생하는 요청은 400을 반환하거나 블록 버리기 설정을 했다면 영향받은 블록들을 버린다는 것이다.
그래서 선제 적용이 권고된다. 향후 모델들은 이 검사를 모든 계정에 적용할 것으로 예상되므로, 자기 계정이 오늘 적용되지 않더라도 지금 그 패턴을 채택하라는 것이다.
문제를 일으키는 편집들이 열거된다. 이 검사에 걸리는 이력 편집들은 프롬프트 캐시를 다시 시작시키는 것들과 같은데, 턴별 알림을 주입하고 제거하는 것, 오래된 턴을 제자리에서 요약하는 것, 세션 중간에 시스템 프롬프트를 바꾸는 것이라는 것이다.
대안이 제시된다. 턴별 알림은 턴 범위 시스템 메시지로 보내고 지시나 도구는 시스템이나 도구를 다시 쓰는 대신 대화 중간 시스템 메시지로 바꾸고 다듬는 일은 서버 측 압축이나 컨텍스트 편집이 하게 하라는 것이다. 클라이언트에서 압축한다면 가장 단순한 형태도 제시된다. 이력 전체를 하나의 요약 메시지와 새 사용자 턴으로 교체하고 다른 것은 아무것도 재생하지 않는 것인데, 사고 블록이 전혀 이월되지 않으므로 아무것도 실패하지 않고 모델은 압축된 대화에 대해 새로 생각한다는 것이다.
비용 균형의 변화도 언급된다. 캐시 읽기가 이제 더 싸졌으므로 비용을 아끼려고 일찍 압축하는 것이 Claude Fable 5.1에서는 더 이상 옳은 비용 대 지능 절충이 아닐 수 있다는 것이다. 그래서 실험이 권장된다. 더 늦은 압축 지점을 실험해 보라는 것이다.
진단 방법도 안내된다. 하네스가 이미 하고 있는 편집을 찾으려면 블록 버리기 설정으로 세션을 돌리고 입력 변환을 로깅하라는 것이다. 또는 몇 번의 정상 턴에 걸쳐 보내는 정확한 요청들을 포착해, 연속된 요청들이 붙인 턴까지 바이트 단위로 동일한지 확인하라는 것이다.
문장 밀도와 겉멋 든 산문
먼저 개선이 인정된다. Claude Fable 5.1의 글은 이전 Claude 모델들보다 대체로 한 단계 나아졌으며 상투적 표현이 더 적고 설명 없는 전문용어도 더 적다는 것이다. 그런데 부작용이 지목된다. 어떤 경우에는 산문이 Claude Fable 5의 것보다 더 조밀해서 문장이 더 길게 이어지고 문단 나눔이 더 적다는 것이다.
처방이 제시된다. 안티패턴, 즉 겉멋 든 산문을 정의하는 지시가 도움이 된다는 것이며 사용자 메시지에 넣는 것이 선호되고 시스템 프롬프트에 넣어도 된다는 것이다.
제시된 정의가 구체적이다. 겉멋 든 산문은 직접적 진술 대신 은유와 장식을 쓰는 것이라는 것이다. 예시도 대비로 나온다. 변화시켜 볼 가치가 있는 매개변수 대신 겉멋 든 필자는 돌려볼 가치가 있는 다이얼을 만들어 내고 이 점은 여전히 중요하다 대신 이 점은 자기 밥값을 한다고 쓴다는 것이다.
그리고 왜 나쁜지가 설명된다. 그 표현들은 생각을 전달하기 위해서가 아니라 필자를 과시하기 위해 존재하며 독자는 알아챈다는 것이다. 그래서 짜증의 원인이 지목된다. 필자가 수행할 수 있도록 독자를 더 힘들게 만들기 때문이라는 것이다. 부정확함도 지적된다. 은유는 필자가 선택하지 않았고 통제할 수 없는 함의를 끌어들인다는 것이다. 해법은 단순하다. 뜻하는 바를 말하라는 것이며 문자적 표현이 있으면 그것을 쓰라는 것이다.
그리고 실용적 대안이 붙는다. 짧은 버전도 통하는 편인데 겉멋 든 산문을 모두 제거해 주세요라는 것이다.
채팅 서식은 반대 방향으로 기울었다
과거 상황이 먼저 서술된다. 이전 모델들은 채팅에서 불릿과 굵은 글씨를 과용했고 많은 프롬프트가 그것을 억누르려고 쓴 서식 반대 규칙을 지니고 있다는 것이다.
그런데 방향이 뒤집혔다고 지목된다. Claude Fable 5.1은 반대쪽으로 기울어 굵은 글씨를 덜 쓰고 헤더와 목록, 인용부호에 손을 뻗을 가능성이 더 낮다는 것이다.
그래서 처방이 나온다. 프롬프트에 서식 반대 표현이 있으면 제거하거나 특정 서식이 언제 적절한지를 말하는 규칙으로 교체하라는 것이다. 제시된 규칙의 요지는 요청받았을 때나 내용이 명확성에 도움이 될 만큼 다면적일 때 목록과 불릿을 쓰라는 것이고 최소한의 서식을 명시적으로 요청하면 요청대로 불릿과 헤더, 목록, 굵은 강조 없이 서식을 잡으라는 것이다. 그리고 예외가 지정된다. 대화적이거나 개인적, 감정적인 교환에서는 평범한 산문을 유지하라는 것이다.
인용 표시와 예시 한 개
문제가 제시된다. 문서를 요약할 때 Claude Fable 5.1은 Claude Fable 5보다 출처 텍스트의 구절을 인용으로 표시하지 않고 재현할 가능성이 더 높다는 것이다.
처방이 구체적이다. 이를 해결하려면 올바른 응답의 완전한 예시 한 개를 시스템 프롬프트에 추가하라는 것이며 사용자의 요청과 응답, 그리고 그 응답이 왜 올바른지 설명하는 문장이라는 것이다.
문서가 제시한 예시의 근거 문장이 판별 기준을 드러낸다. 응답이 어느 한쪽 기사를 훑는 방식이 아니라 두 매체가 어디서 일치하고 어디서 다른지를 중심으로 조직되어 있다는 것이다. 그리고 각 매체의 보도가 어시스턴트 자신의 간접 화법 한두 문장으로 전달된다는 것이다. 인용 처리도 명시된다. 한 출처에서 표시된 짧은 구절 하나뿐이고 다른 모든 주장은 다시 표현되었다는 것이다. 그러면서도 응답은 여전히 구체적이고 완전하다는 것이다.
실무 주의도 붙는다. 예시 안의 웹 검색 두 줄을 자기 도구 이름으로 교체하라는 것인데, 모델이 그것들을 그대로 내보낼 문자 텍스트가 아니라 템플릿화된 도구 출력으로 읽게 하기 위해서라는 것이다.
전체 작업을 완수하라
능력이 먼저 인정된다. Claude Fable 5.1은 방법론에 대한 안내가 많지 않아도 아주 긴 작업을 실행할 수 있으며 특히 목표가 분명할 때 그렇다는 것이다. 그런데 복잡한 비동기 워크로드에서는 자극이 필요하다고 한다. 작업이 끝나기 전에 턴을 끝내지 않도록 자극하라는 것이다.
자극이 없을 때의 증상이 서술된다. 모델이 때때로 다음에 무엇을 할지 서술하는 대신, 다음으로 저는 하겠습니다 같은 식으로 말한다는 것이다. 또는 원래 요청이 이미 다룬 단계에 대해 허락을 구하려고 멈춘다는 것이며 이것을 적용할까요 같은 식이라는 것이다. 그래서 사용자가 계속하라거나 진행하라고 답해야 하는데, 페어 프로그래밍과 다른 휴먼 인 더 루프 작업에는 맞지만 모델의 완전한 장기 지평 능력을 쓰지는 못한다는 것이다.
시스템 프롬프트 추가 두 개가 함께 완화한다고 한다. 둘 다 적용하라는 것이고 프롬프트 길이를 제한해야 한다면 첫 번째만 쓰라는 것인데 효과의 대부분을 유지한다는 것이다.
첫 번째의 요지가 제시된다. 자율적으로 작동하고 있으며 사용자가 실시간으로 보고 있지 않고 작업 중간에 질문에 답할 수 없으므로, 해드릴까요 같은 질문은 작업을 막는다는 것이다. 그리고 기준이 나온다. 원래 요청에서 따라 나오는 되돌릴 수 있는 행동은 묻지 않고 진행하고 파괴적 행동이나 사용자가 결정해야 하는 진짜 범위 변경에만 멈추라는 것이다. 구분도 명확하다. 작업이 끝난 뒤 후속을 제안하는 것은 괜찮지만 작업 전에 허락을 구하는 것은 아니라는 것이다.
예외도 지정된다. 사용자가 문제를 서술하거나 질문하거나 소리 내어 생각하고 있고 변경을 요청하는 것이 아닐 때는 산출물이 당신의 평가라는 것이다. 그래서 발견을 보고하고 멈추며 그들이 요청하기 전에는 수정을 적용하지 말라는 것이다.
자기 점검도 요구된다. 턴을 끝내기 전에 마지막 문단을 확인하라는 것이다. 판정 기준이 열거된다. 그것이 계획이나 분석, 질문, 다음 단계 목록, 또는 하지 않은 작업에 대한 약속이라면 지금 도구 호출로 그 작업을 하라는 것이다. 포함 범위도 명시된다. 오류 후 재시도와 빠진 정보를 스스로 모으는 것도 포함된다는 것이다. 그리고 금지가 붙는다. 컨텍스트나 세션이 길다는 이유로 멈추지 말라는 것이며 작업이 완료되었거나 사용자만 제공할 수 있는 입력에 막혔을 때만 턴을 끝내라는 것이다.
안전 점검도 하나 들어간다. 재시작이나 삭제, 설정 편집처럼 시스템 상태를 바꾸는 명령을 실행하기 전에, 근거가 실제로 그 특정 행동을 지지하는지 확인하라는 것이다. 이유도 붙는다. 알려진 실패와 패턴이 맞아 보이는 신호가 다른 원인을 가질 수 있다는 것이다.
첫 문장의 중요성이 강조된다. 사용자가 보고 있지 않다고 모델에게 알려 주는 첫 문장이 효과의 많은 부분을 담당하므로 쓰인 대로 유지하라는 것이다. 그리고 절충이 고지된다. 이 블록은 모호한 요청에 대해 모델이 질문할 가능성을 낮출 수도 있으므로 자기 작업에서 그 절충을 확인하라는 것이다.
두 번째는 사용자의 요청을 산출물의 범위로 정의한다고 한다. 요지가 제시된다. 사용자의 요청, 또는 그들이 승인한 계획이 범위를 정하고 그 범위가 산출물이므로 조용히 좁히거나 넓히거나 바꾸지 말라는 것이다. 모호함 처리도 지정된다. 신중한 동료가 하듯 읽어서 일상적 판단은 스스로 내리고 다른 해석이 실질적으로 다른 작업으로 이어질 때만 확인하라는 것이다. 이견 처리도 있다. 명세된 작업에 진짜 문제가 보이면 한두 문장으로 말하고 명시된 가정 아래 계속 만들라는 것이며 사용자가 그 우려를 듣고도 재확인하면 그것이 그들의 결정이므로 요청 전부를 전달하라는 것이다.
부분 차단 처리도 규정된다. 한 부분이 막히면 다른 모든 부분을 완전히 완료하고 무엇을 빼놓았으며 왜인지 정확히 말하라는 것이다. 원칙이 못 박힌다. 전체 작업이 산출물이며 그것을 축소하는 것은 사용자의 결정이지 당신의 것이 아니라는 것이다. 그리고 실행 원칙이 붙는다. 결정한 단계는 실행할 것이지 알릴 것이 아니며 다음 단계를 서술하고 턴을 끝내는 것은 사용자가 답할 때까지 그것을 하지 않은 상태로 남긴다는 것이다.
범위 유지도 다시 강조된다. 변경을 요청이 필요로 하는 것으로 유지하라는 것이다. 구분이 제시된다. 눈에 띈 다른 할 만한 것, 즉 작업이 요구하지 않은 정리나 문서화, 작업이 요구하지 않은 파일에 대한 변경은 끝에 할 제안이지 지금 할 변경이 아니라는 것이다.
압축 요약에서 보존할 것
특성이 제시된다. Claude Fable 5.1은 긴 대화가 압축될 때 요약이 무엇을 유지해야 하는지 명시적으로 들었을 때 잘 반응한다는 것이다. 그리고 서버 측 압축은 이미 그렇게 한다고 한다.
클라이언트에서 압축한다면 쓰라는 지시의 여섯 항목이 열거된다. 첫째 생긴 어려움이나 문제, 그리고 그것들이 어떻게 처리되거나 해결되었는지다. 둘째 제기되거나 시도되거나 접어둔 가능성과 선택지, 접근법, 그리고 그 이유다. 셋째 요청되거나 결정되거나 합의되거나 배제되거나 선호나 제약, 경계로 확립된 것이며 정확히 진술된 형태다. 넷째 지금 상황이 정확히 어디인지, 즉 지금까지 무엇이 다뤄지고 정리되고 완료되었는지다. 다섯째 아직 열려 있거나 미해결이거나 약속되었거나 다음에 일어날 것으로 예상되는 것이다. 여섯째 재구성하기 어려운 구체적 세부, 즉 이름과 숫자, 날짜, 정확한 표현, 링크나 참조이며 정확히 유지된 형태다.
그리고 우선순위가 지정된다. 이 항목들에 대해서는 길어지는 대가를 치르더라도 완전하게 하고 다른 모든 것은 간결하게 유지하라는 것이다.
두 목소리를 다르게 다루라는 지시가 특히 눈에 띈다. 사용자가 말하거나 요청하거나 공유하거나 확립한 것은 신중하게, 그들 자신의 표현에 가깝게 유지하라는 것이다. 반면 자기 자신의 설명과 추론은 훨씬 더 압축해도 되며 그들이 결론 내린 것이나 만들어낸 것으로 줄여도 된다는 것이다. 단 조건이 붙는다. 위 여섯 항목의 어떤 것도 빠지지 않는 한이라는 것이다.
요청한 범위로만 변경하라
증상이 서술된다. 개방형 기능을 구현하라고 요청받으면 Claude Fable 5.1은 요청받은 것을 전달하면서 때때로 그 이상을 한다는 것이다. 구체적으로는 근처 코드를 수정하거나 작업이 언급하지 않은 동작을 확장하거나 변경이 정당화하는 것보다 많은 테스트 파일을 커밋할 수 있다는 것이다.
그런데 반응이 좋다고 한다. 무엇을 빼야 하는지에 대한 명시적 지시에 잘 반응한다는 것이다. 그리고 성과가 제시된다. 제시된 지시로 요청하지 않은 추가와 커밋된 테스트 코드가 상당히 줄어들며 작업 성공률에는 측정 가능한 변화가 없다는 것이다.
지시의 요지가 열거된다. 작업하거나 테스트하면서 기존 버그나 성능 우려, 작업이 언급하지 않은 동작을 발견하면, 요청된 동작이 그것 없이 작동할 수 없는 경우가 아니면 이 변경에서 수정하거나 최적화하거나 확장하지 말고 요약에서 후속으로 보고하라는 것이다. 모호함 처리도 있다. 작업이 모호한 곳에서는 그 표현과 주변 코드가 가장 직접적으로 지지하는 해석을 구현하고 그 가정을 요약에 진술하며 다른 해석들을 위해서도 만들지는 말라는 것이다. 검증 방식은 자유롭게 하되 임시 스크립트와 빠른 확인은 보관할 필요가 없다는 것이다. 테스트 커밋 기준도 구체적이다. 작업이 요구하는 곳이나 이 저장소가 이런 종류의 변경에 대해 이미 테스트를 유지하는 곳에만, 이웃 테스트 파일들과 비슷한 크기로, 대략 진술된 동작당 하나의 집중된 테스트로 커밋하라는 것이다.
그리고 오해를 막는 문장이 마지막에 붙는다. 이것은 추가분에 대한 것일 뿐이며 작업이 요구하는 모든 동작은 완전하게 구현하라는 것이다.
낮은 노력에서의 검색과 안전장치 오탐
검색 문제가 제시된다. 낮은 노력에서 Claude Fable 5.1은 Claude Fable 5보다 검색이나 검색 도구를 호출할 가능성이 더 낮고 기억으로 답할 가능성이 더 높다는 것이다. 그래서 가장 단순한 해법이 먼저 제시된다. 어떤 경우에는 대화 전체가 아니라 영향받는 턴들에 대해 노력을 올리는 것이라는 것이다.
프롬프트 자극도 제시된다. 이름을 알아본다는 것이 그 현재 상태를 안다는 것과 같지 않다고 시스템 프롬프트에서 말하고 그런 이름들은 사용자가 쓴 대로 검색되어야 한다고 말하라는 것이다. 제시된 문구의 핵심이 날카롭다. 부분적 배경 지식이야말로 시대에 뒤진 답을 권위 있게 들리게 만드는 것이므로, 친숙함은 검색을 건너뛸 이유가 아니라는 것이다.
안전장치 오탐도 다뤄진다. Claude Fable 5.1의 안전 분류기는 출시 당시 Claude Fable 5의 것보다 오탐을 더 적게 내며 소스 코드에서 취약점을 찾는 것은 허용된다는 것이다. 그래도 오탐은 여전히 발생하고 막힌 요청은 거부 사유를 반환한다고 한다.
가능성을 높이는 세 상황이 열거된다. 컴파일 확인 표현인데, 이 프로그램이 오류 없이 컴파일되나요 대신 이 프로그램에 버그가 있나요라고 물으라는 것이다. 덜 알려진 프로그래밍 언어인데, 그 언어가 무엇이고 어떻게 작동하는지 맥락을 주라는 것이며 예컨대 그 언어의 문서에 접근시키는 방식이라는 것이다. 도구 출력의 base64인데, base64로 인코딩된 데이터를 모델의 컨텍스트로 돌려주는 도구들이 오탐을 촉발할 수 있으므로 그것들을 제거하는 것이 권장 해법이라는 것이다.
표적 편집과 긴 출력을 위한 여유
파일 재작성 문제가 제시된다. Claude Fable 5.1은 Claude Fable 5보다 표적 편집을 하는 대신 텍스트 파일 전체를 다시 쓸 가능성이 더 높다는 것이다. 그리고 비용이 지적된다. 결과 파일은 보통 같지만 파일이 짧거나 대부분이 바뀌는 경우가 아니라면 재작성은 더 많은 출력 토큰과 시간이 든다는 것이다. 처방의 효과도 명시된다. 그 지시가 작고 중간 규모 변경에 대해 Claude Fable 5.1을 Claude Fable 5 수준으로 되돌린다는 것이다. 지시 자체는 다른 조건이 같다면 파일 편집에 쓰는 토큰 수를 최소화하는 것이 최선이므로, 최종 결과에 영향을 주지 않을 때는 파일 전체를 다시 쓰기보다 수술적으로 편집하려고 하라는 것이다.
긴 출력 문제도 서술된다. xhigh와 특히 max 노력에서 Claude Fable 5.1은 답을 쓰기 시작하기 전에 더 오래 생각할 수 있다는 것이다. 그래서 벌어지는 일이 구체적이다. 하나의 요청이 긴 산출물을 요구할 때, 예컨대 긴 문서의 전체 재작성이라면, 그 산출물의 상당 부분을 사고 안에서 초안 잡은 다음 답으로 다시 써낼 수 있다는 것이며 이는 더 긴 대기와 더 많은 출력 토큰을 뜻한다는 것이다.
가장 단순한 접근이 권고된다. 이런 요청들은 권장 시작점인 high에서 돌리고 품질 향상을 측정한 곳에서만 xhigh나 max로 옮기라는 것이다. 그래도 xhigh나 max로 돌린다면 두 가지가 지시된다. 최대 토큰을 기대하는 답 길이만이 아니라 사고와 답 모두를 위한 여유를 두도록 설정하라는 것이다. 그리고 사용자 메시지 끝에 메모를 붙이라는 것인데, 산문과 코드 요청에서 사고를 훨씬 짧게 만든다는 것이다.
그 메모의 논리가 명확하다. 한 답에서 만들어진 모든 것, 답 전에 한 추론이나 초안까지 포함해서 약 최대 토큰이라는 하나의 한도에 들어간다는 것이다. 그래서 결과가 지적된다. 답이 끝나기 전에 그 한도에 도달하면 사람은 잘린 응답을 받고 처음부터 다시 시작해야 한다는 것이다. 그리고 금지가 나온다. 전체 산출물을 추론으로 한 번 완성하고 답으로 다시 하는 것은 결과를 개선하지 않고 턴의 길이를 두 배로 만들 것이므로 그러지 말라는 것이다. 대안이 제시된다. 요청을 이해하는 데, 답이 의존하는 입력을 확인하는 데, 구조와 다른 어려운 결정들을 정하는 데 추가 노력을 쓰고 그 밖에는 추론 공간은 추론하는 데 출력 공간은 출력을 쓰는 데 쓰라는 것이다.
리드 에이전트와 시각 작업
서브에이전트 대기 문제가 제시된다. 코딩 에이전트가 Claude Fable 5.1에게 서브에이전트로 작업을 위임하게 한다면, 리드 에이전트가 멈춰서 각각을 기다리도록 강제하지 말라는 것이다. 근거가 제시된다. 코딩 작업에서 서브에이전트가 돌아가는 동안 리드가 계속하게 하면 비슷한 품질과 토큰 사용, 비용에서 평균 완료 시간이 낮아진다는 것이다.
설정 방법이 세 가지로 제시된다. 서브에이전트를 시작하는 도구가 즉시 반환하게 하라는 것이다. 각 서브에이전트의 결과는 준비되면 나중의 사용자 메시지로 리드에게 돌려주라는 것이다. 리드가 결과를 기다리고 싶을 때 호출할 수 있는 별도 도구를 주라는 것이다.
그리고 정직한 유보가 붙는다. 모델은 여전히 자주 기다리기를 선택하며 시간 절약은 다른 작업을 계속하는 실행들에서 나온다는 것이다.
시각 작업도 다뤄진다. Claude Fable 5.1은 기본적으로 더 나은 시각 능력을 갖췄으며 조밀한 차트 같은 복잡한 시각 입력에서는 반복적으로 분석하고 잘라내고 시각적으로 확인할 수 있을 때 최선의 작업을 한다는 것이다.
완전한 이득을 얻는 방법이 제시된다. 원본 이미지나 영상을 담고 PIL과 OpenCV 같은 기본 이미지 처리 라이브러리가 미리 설치된 컨테이너에 접근할 수 있는 에이전트로 모델을 돌리라는 것이다. 그리고 간소한 대안도 제시된다. 컨테이너 실행이 부담이라면 이미지 잘라내기 도구만으로도 상승분의 대부분을 얻는다는 것이며 이미지의 선택된 영역을 잘라내고 확대해 돌려주는 도구가 모델이 특정 세부를 더 깊이 검토하게 하고 이미지 토큰에 따라 테스트 시점 연산을 확장시킨다는 것이다.
더 생각해보기
- 기존 프롬프트가 변경 없이 잘 작동한다고 하면서 열다섯 개 절을 제시하는 구성은 어느 쪽이 실제 상태에 가까운가.
- 노력 수준 이름이 모델 간에 같은 사고량을 뜻하지 않는다면, 이름을 유지하는 것이 사용자에게 도움이 되는가.
- low에서 더 작은 모델보다 싸고 점수가 높다는 주장은 어떤 작업군에서 뒤집히는가.
- 사고 블록을 대화에 묶는 제약은 하네스 설계의 자유도를 얼마나 좁히는가.
- 캐시 읽기가 싸져서 늦게 압축하는 것이 유리해졌다면, 컨텍스트 관리 전략은 어떻게 바뀌어야 하는가.
- 겉멋 든 산문의 정의를 프롬프트로 주는 방식은 모델의 문체 개선과 어떻게 다른 층위에서 작동하는가.
- 서식 반대 규칙을 제거하라는 권고는 이전 모델용 프롬프트를 물려받은 조직에서 얼마나 실행되는가.
- 사용자가 보고 있지 않다는 문장 하나가 효과의 대부분을 담당한다면, 그것은 모델의 어떤 성향을 건드리는가.
- 압축 요약에서 사용자의 말은 원문에 가깝게 남기고 모델 자신의 추론은 압축하라는 비대칭은 무엇을 전제하는가.
- 리드 에이전트가 여전히 자주 기다리기를 선택한다면, 병렬화 이득은 어떻게 측정해야 하는가.