643 / 643
Claude Fable 5.1 프롬프팅 가이드: 모델 행동 최적화 전략
Anthropic의 최신 모델 Claude Fable 5.1은 이전 모델인 Fable 5와 비교할 때 몇 가지 중요한 행동 변화를 보인다. 이 변화를 이해하고 적절하게 프롬프팅하는 것은 모델의 성능과 효율성을 극대화하는 데 필수적이다. 본 문서는 Fable 5.1의 주요 행동 변화와 각 상황에 맞는 최적화 전략을 다룬다.
추론 노력 수준 조절
effort 수준은 Claude Fable 5.1에서 지능, 지연 시간, 비용 간의 균형을 조절하는 핵심 제어 수단이다. 기본값인 high에서 시작하여 low, medium, xhigh, max를 포함한 모든 수준을 자체 평가 지표에 맞춰 테스트하는 것이 중요하다. Fable 5에서 이미 테스트했더라도 Fable 5.1에서 다시 테스트해야 한다. 모델마다 노력 수준의 의미가 다르기 때문이다.
Claude Fable 5.1의 능력 향상은 모든 effort 수준에서 나타나며, 특히 높은 설정에서 가장 크다.
medium수준은 Fable 5와 비슷한 결과를 더 낮은 비용으로 제공한다. 품질 저하가 없다면medium또는low로 낮추는 것을 고려한다.low수준에서는 Fable 5.1이 Claude Opus 및 Claude Sonnet 모델에 비해 작업당 비용 효율성이 높고 더 높은 점수를 기록하기도 한다. 따라서 더 작은 모델을 높은 effort로 실행하던 경우low수준을 비교 대상에 포함한다.
두 가지 effort 수준별 특징은 별도 섹션에서 다룬다. low 수준에서는 검색 및 정보 검색 도구를 덜 자주 호출하며(하단 ‘낮은 노력 수준에서 검색 도구 사용’ 참조), xhigh와 max 수준에서는 긴 결과물을 작성하기 전에 더 오래 생각할 수 있다(하단 ‘높은 노력 수준에서 긴 결과물을 위한 공간 확보’ 참조).
사용자 대상 진행 상황 업데이트 요청
Claude Fable 5.1은 긴 tool-calling 턴 동안 사용자 대상 업데이트를 Fable 5보다 적게 작성하는 경향이 있다. 이는 높은 effort 수준과 긴 도구 체인에서 더욱 두드러진다. 사용자는 에이전트가 몇 분 동안 조용하거나, 전체 작업이 아닌 마지막 단계만 다루는 최종 메시지를 볼 수 있다.
이 문제를 해결하는 방법은 다음과 같다.
- 진행 상황 업데이트 수신 확인: 클라이언트가 업데이트를 제대로 수신하는지 확인한다. 모델이 도구 호출 사이에 생성하는 짧은 메모는
progress-update유형의thinking블록으로 반환된다. 기본thinking.display값이"omitted"인 경우 이 블록은 비어 있다.thinking.display를"updates"로 설정하고 비어 있지 않은thinking블록을 상태 메시지로 렌더링한다. (베타 기능:thinking-display-updates-2026-08-18헤더 필요)thinking.display를"summarized"로 설정하면 요약된 추론과 함께 업데이트를 수신한다.
- 프롬프트 감사: 내러티브를 억제하는 지시어를 프롬프트에서 제거한다. 이전 모델들은 작업 중에 업데이트를 제공하려는 경향이 있어 “모든 결과는 최종 응답으로 보류한다”와 같은 시스템 프롬프트 지시어를 사용하기도 했다. 이러한 지시어가 있다면 제거한다.
- 명시적인 업데이트 요청 추가: 더 많은 업데이트가 필요하다면(예: 페어 프로그래밍 또는 Human-in-the-loop 작업) 모델이 사용자 대상 텍스트를 언제, 어떤 내용으로 업데이트해야 하는지 명시하는 짧은 시스템 프롬프트 라인을 추가한다.
시작하기 전에, 앞으로 할 일을 한 줄로 말한다. 작업 중에 짧은 업데이트는 사용자가 따라가는 데 도움이 된다. 최종 응답은 발견한 내용, 수행한 작업, 다음 단계에 대한 간결한 요약으로 마무리하여 마지막 메시지만 보는 독자도 전체 내용을 파악할 수 있게 한다.
- 도구 출력 표시에 대한 모델 알림: 제품이 도구 출력을 축소하거나 숨긴다면 모델에 알려야 한다. 그렇지 않으면 모델은 사용자에게 표시되지 않을 “출력 표시” 명령을 실행할 수 있다. 이 알림은
turn-scoped system message로 전달한다. (베타 기능:mid-conversation-system-clear-at-2026-08-21헤더 필요)
오직 당신만 이 명령의 출력을 본다. 사용자의 터미널에는 최대 몇 줄만 표시된다. 사용자가 어떤 내용을 읽어야 한다면, 당신의 답변에 포함한다.
에이전트 루프에서 독립적인 도구 호출 일괄 처리
Claude Fable 5.1은 일반적으로 여러 정보를 가져와야 할 때 예상대로 병렬 도구 호출을 수행한다. 그러나 코딩 및 컴퓨터 사용 루프에서는 다음 독립적인 호출이 작업에 의해 암시될 때 한 번에 하나씩 호출하는 예외가 발생할 수 있다. 이는 답변 품질에 영향을 미치지 않지만, 각 추가 턴은 토큰, 왕복 시간, 실제 시간을 증가시킨다.
이 문제를 해결하려면 현재 요청의 마지막에 한 문장으로 지시어를 추가한다.
먼저 필요한 다음 단계를 비공개로 나열한다. 그런 다음 다른 결과에 의존하지 않는 모든 항목을 이번 응답에서 요청한다.
도구 결과를 다시 보낼 때마다 사용자 메시지 뒤에 turn-scoped system message로 추가한다. role: "system" 엔트리를 messages에 clear_at: "next_user_message"와 함께 넣는다. 이후 사용자 메시지가 존재하면 API는 이전 사본을 삭제하여 모델이 가장 최신 내용만 읽도록 한다. (mid-conversation-system-clear-at-2026-08-21 베타 헤더 필요)
대화 기록은 추가 전용으로 유지
각 어시스턴트 턴을 API가 반환한 그대로, thinking 블록을 포함하여 기록에 추가해야 한다. 요청 사이에 이전 턴을 편집하지 않는다. Claude Fable 5.1의 thinking 블록은 해당 블록을 생성한 대화에서만 유효하다. 이전 메시지가 변경된 후 thinking 블록을 재생하는 요청은 400 오류를 반환하거나, thinking.block_binding.prefix_mismatch_behavior: "drop_block"을 설정한 경우 영향을 받는 블록을 삭제한다. 향후 모델들은 모든 계정에 대해 이 검사를 강제할 예정이다.
검사를 유발하는 기록 편집 유형은 prompt cache를 다시 시작하는 것과 동일하다.
- 턴별 알림 주입 및 제거
- 이전 턴을 인라인으로 요약
- 세션 중간에 시스템 프롬프트 변경
이러한 편집을 피하는 방법은 다음과 같다.
- 턴별 알림은
turn-scoped system messages로 보낸다. - 지시어나 도구 변경은
mid-conversation system message를 사용한다. - 콘텍스트 트리밍은 서버 측 compaction 또는 context editing에 맡긴다.
- 클라이언트 측에서 압축하는 경우, 전체 기록을 하나의 요약 메시지와 새 사용자 턴으로 교체하고 다른 것은 재생하지 않는 것이 가장 간단한 방법이다. 이렇게 하면
thinking블록이 전달되지 않아 오류가 발생하지 않으며, 모델은 압축된 대화에 대해 새로 생각한다.
글쓰기 밀도 개선
Claude Fable 5.1의 글쓰기는 일반적으로 이전 Claude 모델보다 수준이 높으며, 상투적인 문구와 불필요한 전문 용어가 줄었다. 하지만 경우에 따라 Fable 5보다 산문이 더 밀도가 높다. 문장이 더 길어지고 단락 구분이 적어진다. “꾸밈이 많은 산문(mannered prose)”과 같은 반대 패턴을 정의하는 지시어를 추가하는 것이 도움이 된다. 이 지시어는 사용자 메시지(권장)나 시스템 프롬프트에 추가한다.
꾸밈이 많은 산문은 직접적인 진술 대신 은유와 수사를 사용한다. "변화시킬 가치가 있는 매개변수" 대신 "돌릴 가치가 있는 다이얼"과 같이 쓴다. "이 점은 여전히 중요하다" 대신 "이 점은 제 역할을 다한다"라고 쓴다. 이런 문구는 아이디어를 전달하기 위함이 아니라 작가를 과시하기 위함이며, 독자는 이를 알아챈다. 꾸밈이 많은 산문이 짜증 나는 이유이다. 독자가 더 힘들게 작업하게 만들면서 작가는 공연한다. 또한, 부정확하다. 은유는 작가가 선택하지 않고 통제할 수 없는 함축적인 의미를 끌어들인다. 해결책은 의미하는 바를 직접 말하는 것이다. 직설적인 표현이 가능하다면 그것을 사용한다.
짧은 버전도 효과적이다.
모든 꾸밈이 많은 산문을 제거한다.
채팅에서의 서식 지정
이전 모델들은 채팅에서 글머리 기호와 볼드체를 과도하게 사용했으며, 많은 프롬프트에는 이를 억제하기 위한 서식 규칙이 포함되어 있다. Claude Fable 5.1은 그 반대 경향을 보인다. 볼드체 사용이 줄고 헤더, 목록, 인용 부호를 덜 사용하는 편이다. 프롬프트에 서식 억제 언어가 포함되어 있다면 제거하거나, 다음과 같이 특정 서식이 적절한 시기를 명시하는 규칙으로 교체한다.
요청받거나 내용이 명확성을 높일 만큼 다면적일 때 목록과 글머리 기호를 사용한다. 사용자가 명시적으로 최소한의 서식을 요청하면, 항상 글머리 기호, 헤더, 목록, 볼드체 강조 없이 응답을 서식 지정한다. 대화, 개인적 또는 감정적인 교환에서는 평이한 산문을 유지한다.
검색된 출처 인용
문서 요약 시 Claude Fable 5.1은 Fable 5보다 원문 텍스트를 인용 표시 없이 그대로 재현할 가능성이 높다. 이를 해결하려면 시스템 프롬프트에 올바른 응답의 완전한 예시 하나를 추가한다. 사용자 요청, 응답, 응답이 올바른 이유를 설명하는 문장이 포함되어야 한다.
예시:
- 사용자 요청: Harbor Bridge 폐쇄를 Riverton Ledger와 Coast Dispatch가 어떻게 보도했는지 찾아보고 그 보도를 비교한다.
- 모델 응답:
- 두 언론사 모두 기본 사항에 동의한다. 3월 3일 검사관들이 균열 용접부를 발견한 후 다리가 폐쇄되었으며, 주 정부는 약 8개월의 수리 기간을 예상한다.
- 차이점은 강조하는 부분에 있다. Riverton Ledger는 이를 지역 경제 이야기로 다룬다. Coast Dispatch는 이를 재정 실패로 구성하며, 사설에서는 폐쇄를 “전적으로 예상 가능한 일”이라고 부른다.
- 함께 읽으면 Ledger는 현재 누가 영향을 받는지 설명하고 Dispatch는 어떻게 이런 상황에 이르렀는지 설명한다. 어떤 기사만으로는 전체 그림을 얻을 수 없다.
- 근거: 응답은 두 언론사가 동의하고 다른 점을 중심으로 구성되어 있다. 각 언론사의 보도는 어시스턴트 자신의 간접 화법으로 한두 문장으로 전달된다. 한 출처에서 짧은 인용구가 사용되었지만, 다른 모든 내용은 다시 작성되었다. 응답은 여전히 구체적이고 완전하다.
[web_search: ...] 줄은 모델이 도구 출력으로 인식하도록 자신의 도구 이름으로 대체해야 한다.
전체 작업 완료
Claude Fable 5.1은 특히 목표가 명확할 때 방법론에 대한 많은 지침 없이도 매우 긴 작업을 실행할 수 있다. 그러나 복잡한 비동기 워크로드에서는 작업이 완료되기 전에 턴을 끝내지 않도록 유도해야 한다. 이러한 유도 없이는 모델이 다음 작업(“다음으로, ~하겠습니다”)을 설명하거나 원래 요청에 이미 포함된 단계에 대한 허가를 요청(“이것을 적용할까요?”)하는 경우가 있다. 사용자는 “계속” 또는 “진행”이라고 응답해야 하는데, 이는 페어 프로그래밍이나 Human-in-the-loop 작업에는 적합하지만, 모델의 긴 지평 능력을 완전히 활용하지 못한다.
두 가지 시스템 프롬프트 추가가 이를 완화한다. 둘 다 적용하는 것이 좋지만, 프롬프트 길이를 제한해야 한다면 첫 번째만 사용해도 대부분의 효과를 얻는다.
- 자율 운영 지시: 모델에게 이미 요청된 작업에 대해 묻지 말고, 자신이 명시한 다음 단계를 실행하도록 지시한다.
- 핵심 메시지: 사용자는 실시간으로 지켜보지 않으며 작업 중간에 질문에 답할 수 없으므로, ‘~할까요?’ 또는 ‘~할까요?’라고 묻는 것은 작업을 방해한다. 원래 요청에서 파생된 가역적인 행동은 묻지 않고 진행한다. 파괴적인 행동이나 사용자가 결정해야 하는 실제 범위 변경에만 중단한다.
- 핵심 메시지: 턴을 마치기 전에 마지막 단락을 확인한다. 만약 계획, 분석, 질문, 다음 단계 목록, 또는 아직 하지 않은 작업에 대한 약속(‘~할게요’, ‘언제 알려주세요’)이라면, 도구 호출을 사용하여 지금 그 작업을 수행한다.
- 핵심 메시지: 컨텍스트나 세션이 길다고 해서 멈추지 않는다. 작업이 완료되었거나 사용자만 제공할 수 있는 입력에 막혔을 때만 턴을 마친다.
- 작업 범위 정의: 사용자 요청을 결과물의 범위로 정의한다.
- 핵심 메시지: 사용자 요청 또는 승인된 계획이 범위를 설정하며, 이 범위가 결과물이다. 조용히 범위를 좁히거나, 넓히거나, 바꾸지 않는다.
- 핵심 메시지: 애매모호함은 신중한 동료가 해석하는 방식으로 읽는다. 일상적인 판단은 스스로 내리고, 다른 해석이 실질적으로 다른 작업으로 이어질 때만 확인한다.
- 핵심 메시지: 작업 도중 질문이 생기면, 먼저 답변에 의존하지 않는 모든 작업을 수행한다. 그런 다음 자신이 내린 가정을 명시하거나, 잘못된 추측으로 진행하는 것이 안전하지 않거나 작업을 무용지물로 만들 때에는 진행 상황을 전달하는 턴의 마지막에 질문을 넣는다.
압축 요약 시 보존할 내용 명시
Claude Fable 5.1은 긴 대화가 압축될 때 요약에 무엇을 유지해야 하는지 명시적으로 지시받으면 잘 반응한다. 서버 측 compaction은 이미 이를 수행한다. 클라이언트 측에서 압축하는 경우 다음 요약 지시어를 사용한다.
대화록을 <summary></summary> 태그 안에 요약한다. 이 요약에는 새 컨텍스트 창에서 작업을 다시 하거나 관련 제약 조건 또는 컨텍스트를 다시 제공할 필요 없이 이 대화를 계속할 수 있도록 관련 정보를 포함한다. 다음 사항을 반드시 보존한다.
(1) 발생한 어려움이나 문제점, 그리고 어떻게 처리되었거나 해결되었는지
(2) 제시되거나, 시도되거나, 보류된 가능성, 옵션 또는 접근 방식, 그리고 그 이유
(3) 요청되었거나, 결정되었거나, 동의되었거나, 배제되었거나, 선호 사항, 제약 조건 또는 경계로 확립된 모든 사항 — 정확히 명시한다
(4) 현재 상황 — 지금까지 다루어졌거나, 해결되었거나, 완료된 사항
(5) 아직 열려 있거나, 해결되지 않았거나, 약속되었거나, 다음으로 예상되는 모든 사항
(6) 재구성하기 어려운 특정 세부 정보 — 이름, 숫자, 날짜, 정확한 문구, 링크 또는 참조 — 정확하게 유지한다
길이가 길어지더라도 이 부분에서는 완전하게 작성한다. 다른 모든 내용은 간결하게 유지한다. 두 목소리의 비중을 다르게 둔다. 사용자가 말한 내용, 요청한 내용, 공유한 내용 또는 확립한 내용은 사용자 자신의 말에 가깝게 신중하게 유지한다. 당신의 설명과 추론은 훨씬 더 압축하여 결론이나 결과물만 남긴다. 단, 위 6개 항목 중 어떤 것도 빠뜨리지 않는다.
작업이 요청하는 변경 사항과 테스트만 유지
개방형 기능 구현을 요청받을 때, Claude Fable 5.1은 요청된 것 이상을 제공하는 경우가 있다. 관련 코드를 수정하거나, 작업에서 언급되지 않은 동작을 확장하거나, 변경 사항에 비해 더 많은 테스트 파일을 커밋할 수 있다. 모델은 무엇을 생략해야 하는지에 대한 명시적인 지침에 잘 반응한다. 다음 지시어를 사용하면, 요청되지 않은 추가 사항과 커밋된 테스트 코드가 작업 성공률에 측정 가능한 변화 없이 상당히 줄어든다.
작업 또는 테스트 중에 기존 버그, 성능 문제 또는 작업에서 언급되지 않은 동작을 발견하더라도, 요청된 동작이 없이는 작동할 수 없는 경우가 아니라면 이 변경에서 수정, 최적화 또는 확장하지 않는다. 요약에 후속 조치로 보고한다. 작업이 모호하다면, 해당 문구와 주변 코드가 가장 직접적으로 지지하는 해석을 구현하고, 그 가정을 요약에 명시하며, 다른 해석을 위한 빌드를 하지 않는다. 원하는 대로 작업을 확인한다. 스크래치 스크립트와 빠른 확인은 보관할 필요가 없다. 작업에서 요청하거나 이 저장소가 이미 해당 유형의 변경에 대한 테스트를 유지하는 경우에만 테스트를 커밋한다. 테스트는 인접한 테스트 파일과 비슷한 크기로, 즉 명시된 동작당 대략 하나의 집중된 테스트를 작성한다. 스크래치 확인을 추가적인 영구 테스트 파일로 전환하지 않는다. 이는 추가 사항에 관한 것이다. 작업이 요청하는 모든 동작을 완전히 구현한다.
낮은 노력 수준에서 검색 도구 사용
low effort 수준에서 Claude Fable 5.1은 Fable 5보다 검색 또는 정보 검색 도구를 덜 자주 호출하며, 기억에서 답변을 도출할 가능성이 더 높다. 경우에 따라 가장 간단한 해결책은 대화 전체가 아닌 해당 턴의 effort 수준을 높이는 것이다.
다른 경우에는 검증을 유도하는 프롬프트 지침이 도움이 된다. 시스템 프롬프트에서 이름 인식과 현재 상태를 아는 것이 같지 않으며, 그러한 이름은 사용자가 작성한 대로 검색해야 한다고 명시한다.
자신 있게 인식하지 못하거나, AI 모델 및 개발자 도구와 같이 몇 달 내에 상황이 변화하는 빠르게 움직이는 분야에서 인식하는 이름에 대한 쿼리가 중심을 이룰 때, 이름 자체가 검증해야 할 대상이다. 답변하기 전에 검색하고, 사용자가 작성한 이름을 적어도 하나의 쿼리에 재구성된 내용과 함께 포함한다. 이는 해당 내용에 대한 배경 지식이 일부 있더라도 마찬가지이다. 부분적인 배경 지식은 오래된 답변을 권위 있는 것처럼 들리게 만드는 요인이므로, 익숙함이 검색을 건너뛸 이유가 아니다.
안전 장치 오탐 감소
Claude Fable 5.1의 안전 분류기는 출시 당시 Fable 5보다 오탐(false positives)이 적다. 소스 코드에서 취약점을 찾는 것은 허용된다. 그러나 오탐은 여전히 발생할 수 있으며, 차단된 요청은 stop_reason: "refusal"을 반환한다. 세 가지 상황에서 오탐이 발생할 가능성이 더 높다.
- 컴파일 확인 구문: “이 프로그램이 오류 없이 컴파일되나요?” 대신 “이 프로그램에 버그가 있나요?”라고 묻는다.
- 덜 알려진 프로그래밍 언어: 모델에 언어가 무엇이며 어떻게 작동하는지에 대한 컨텍스트를 제공한다. 예를 들어, 언어의 문서를 제공한다.
- 도구 출력의 Base64: Base64로 인코딩된 데이터를 모델의 컨텍스트로 반환하는 도구는 오탐을 유발할 수 있으므로, 이를 제거하는 것이 권장되는 해결책이다.
전체 파일 재작성 대신 대상 편집 선호
Claude Fable 5.1이 작은 변경 사항에 대해 전체 파일을 재작성하는 경우, 다음 지시어를 시스템 프롬프트 또는 첫 번째 사용자 메시지에 추가한다. Fable 5.1은 Fable 5보다 전체 텍스트 파일을 재작성할 가능성이 높다. 결과 파일은 일반적으로 동일하지만, 파일이 짧거나 대부분이 변경되는 경우가 아니라면 재작성은 더 많은 출력 토큰과 시간을 소모한다. 이 지시어는 Fable 5.1을 작은 및 중간 변경 사항에 대해 Fable 5와 비슷한 행동으로 되돌린다.
다른 모든 조건이 동일하다면, 파일을 편집하는 데 사용되는 토큰 수를 최소화하는 것이 가장 좋다. 따라서 최종 결과에 영향을 미치지 않을 때는 전체 파일을 재작성하는 대신 파일을 정밀하게 편집하도록 노력한다.
높은 노력 수준에서 긴 결과물을 위한 공간 확보
xhigh 및 특히 max effort 수준에서 Claude Fable 5.1은 응답을 작성하기 전에 더 오래 생각할 수 있다. 단일 요청이 긴 결과물(예: 긴 문서의 전체 재작성)을 요청하면, 모델이 생각하는 과정에서 해당 결과물의 상당 부분을 초안으로 작성한 다음 이를 다시 응답으로 작성할 수 있다. 이는 더 긴 대기와 더 많은 출력 토큰을 의미한다.
가장 간단한 접근 방식은 high 수준에서 이러한 요청을 실행하고, 품질 향상이 측정된 경우에만 xhigh 또는 max로 이동하는 것이다. xhigh 또는 max에서 실행하는 경우 다음을 수행한다.
max_tokens를 응답 길이뿐만 아니라 생각하는 과정과 응답 모두를 위한 충분한 공간을 남겨두도록 설정한다.- 다음 메모를 사용자 메시지 끝에 추가한다. 이 메모는 산문 및 코드 요청에서 생각하는 과정을 훨씬 짧게 만든다.
[max_tokens]를 요청의 실제max_tokens값(예: 64,000)으로 대체한다.
하나의 응답에서 생성되는 모든 내용(응답 전에 수행된 추론이나 초안 작성 포함)은 약 [max_tokens] 토큰의 단일 제한에 포함된다. 이 제한에 도달하면 응답이 완료되기 전에 잘린 응답을 수신하며, 사용자는 다시 시작해야 한다. 전체 출력이나 결과물을 추론으로 완전히 작성한 다음 응답으로 다시 작성하는 것은 결과를 개선하지 않고 턴 길이를 두 배로 늘릴 것이다. 따라서 그렇게 하지 않는다.
대신, 사용자가 여러 섹션 문서, 대형 테이블 또는 데이터셋, 완전한 코드 파일과 같이 길거나 많은 노력이 필요한 결과물을 요청했을 때, 요청을 이해하고, 답변에 의존하는 입력을 확인하고, 구조 및 기타 어려운 결정을 내리고, 그렇지 않으면 추론 공간을 추론하고 출력 공간을 출력 작성에 사용하는 데 추가적인 노력을 기울인다. 일반적으로 출력을 여러 번 초안 작성할 필요는 없다.
하위 에이전트 실행 중 리드 에이전트 작업 유지
코딩 에이전트가 Claude Fable 5.1이 작업을 하위 에이전트에 위임하도록 허용하는 경우, 리드 에이전트가 각 하위 에이전트를 기다리도록 강제하지 않는다. 코딩 작업에서 하위 에이전트가 실행되는 동안 리드 에이전트가 계속 작업하도록 허용하면 비슷한 품질, 토큰 사용량 및 비용으로 평균 완료 시간이 단축된다. 이를 설정하는 방법은 다음과 같다.
- 하위 에이전트를 시작하는 도구가 즉시 반환되도록 한다.
- 각 하위 에이전트의 결과가 준비되면 나중에
user메시지에서 리드 에이전트에게 전달한다. - 리드 에이전트가 결과를 기다리고 싶을 때 호출할 수 있는 별도의 도구를 제공한다.
모델은 여전히 종종 기다리기를 선택한다. 시간 절약은 다른 작업을 계속하는 실행에서 발생한다.
시각 작업 도구에 자르기 및 확대/축소 기능 제공
Claude Fable 5.1은 기본적으로 더 나은 시각 능력을 지닌다. 밀집된 차트와 같은 복잡한 시각적 입력에서 반복적으로 분석하고, 자르고, 시각적으로 확인하는 과정을 통해 최상의 성능을 보인다. 이러한 이점을 최대한 활용하려면, 모델을 원시 이미지나 비디오를 보유하고 기본적인 이미지 처리 라이브러리(예: PIL 및 OpenCV)가 미리 설치된 컨테이너에 접근할 수 있는 에이전트로 실행한다. 컨테이너 실행 오버헤드가 너무 크다면, 이미지 자르기 도구만으로도 대부분의 향상을 얻을 수 있다. 선택한 이미지 영역을 자르고 확대하여 반환하는 도구를 통해 모델은 특정 세부 정보를 더 깊이 검토하고, 테스트 시간 컴퓨팅을 이미지 토큰과 함께 확장할 수 있다.
정보이론·엔트로피의 시선으로 보면
Claude Fable 5.1의 프롬프팅 최적화 전략은 정보이론의 관점에서 보면 ‘정보 엔트로피 최소화’와 유사하다. 모델이 불필요한 추측이나 중복된 작업을 줄이고, 필요한 정보만을 효율적으로 처리하도록 유도하는 것은 시스템의 전체 정보 엔트로피를 낮추는 과정과 같다. 즉, 명확한 지시와 구조화된 입력은 모델의 불확실성을 감소시키고, 결과적으로 더 예측 가능하고 정확하며 효율적인 정보 생성을 가능하게 한다.









