요약이 아니라 판단을 시키는 페이블 5.1 자료 작업법
AI 기초부터 나만의
서비스까지 완성
/model fable. Cowork 와 claude.ai 에서는 그냥 페이블 5.1 을 고르면 됩니다.
사고량 기본값이 다릅니다 — 클로드 코드는 높게, Cowork·claude.ai 는 중간입니다.먼저 알아둘 것
아래 사례는 2026-09-02 에 실사용 기록을 직접 열어 확인한 것입니다. 벤치마크 점수가 아니라 사람이 실제로 시켜 본 결과입니다.
출시 이틀째라 표본이 적습니다. 여기 적은 건 대부분 Every 팀의 실사용 기록이고, 시간 수치가 붙은 건 몇 건뿐입니다. 없는 건 없다고 적었습니다.
1 · 뭐가 실제로 달라졌나
요약 대신 판단을 내놓기 시작했다
설문 원자료를 넣었더니, 점수 분포를 정리한 게 아니라 이런 걸 잡아냈습니다.
우리를 «흥미롭다» 고 표현한 고객은 추천자가 아니고, «쓸모 있다 · 훌륭하다 · 똑똑하다» 고 한 고객이 추천자다
이걸 한 문장으로 정리해 왔습니다. 시킨 사람 말로는 «구 페이블은 절대 안 하던 것» 입니다.
이게 이 모델의 핵심입니다. 자료를 넣고 정리시키면 여전히 요약이 나옵니다. 가정을 깨보라고 시켜야 이게 나옵니다. 아래 지시문들이 전부 그 구조입니다.
문서를 슬라이드로 바꾸면 손댈 게 거의 없다
기존 문서를 발표자료로 바꾸게 했더니 슬라이드당 아이디어 하나, 노란 하이라이트, 흐름을 나타내는 화살표가 깨지지 않고 나왔습니다. 같은 과제에서 다른 모델은 화살표가 깨지고 레이아웃이 빈약했습니다.
시킨 사람 평은 «사람 개입 최소» 입니다. 1차 결과물이 그냥 쓸 만한 수준을 넘었다는 뜻입니다.
실습용 자료를 통째로 만들어 온다
임원 대상 AI 실습 과제를 만들라고 시켰습니다. 결과물은 이랬습니다.
- 「4개 기업 인수 추적 대시보드」 과제
- 거기 딸린 스프레드시트
- 상태 보고 이메일
- 슬랙 대화 기록
- 그 안에 «아직 트래커에 반영 안 된 프로젝트 지연 경고» 를 심어놨습니다 — 실습자가 찾아내야 할 함정을 스스로 설계했습니다
23분 걸렸고, 평가는 «거의 완벽» 이었습니다.
긴 글의 빈 구간을 채우는 데는 지금까지 중 최고
에세이의 빠진 문단을 채우게 했더니, 주변 문단의 구체적인 디테일을 실제로 끌어썼고, 문단마다 논지를 하나씩 쌓았고, 원문에 없는 걸 추론해서 넣지 않았습니다.
「AI 가 쓴 티」가 지금까지 돌린 모든 모델 중 가장 적었습니다. 읽기 난이도도 가장 낮게 나왔습니다.
두 모델 연속으로 실망해서 «AI 글쓰기는 내 것이 아니다» 라고 접었던 사람이 글쓰기를 전부 옮겼습니다.
같은 일을 절반 값에 한다
도구를 부르며 긴 업무를 처리하는 사내 어시스턴트를, 프롬프트를 한 줄도 안 고치고 모델만 바꿔 봤습니다.
| 이전 | 페이블 5.1 | |
|---|---|---|
| 요청당 토큰 | 약 2,000 | 766 |
| 걸린 시간 | 37초 | 22초 |
결과물 품질은 동등했고 글쓰기 점수는 오히려 올랐습니다.
문단이 왜 밋밋한지 짚는다
다시 써주는 게 아니라 이렇게 말합니다.
가장 큰 문제는 이 문단이 하필 결정타를 날려야 할 자리에서 힘이 빠진다는 것이다
억지 연결도 안 받아줍니다. 아무 상관없는 둘을 놓고 «이거 완전 똑같지 않아?» 라고 던지면 약한 모델은 맞장구를 칩니다. 5.1은 실제로 흥미로울 때만 흥미롭다고 합니다.
2 · 복붙할 지시문 다섯 개
전부 실무자가 실제로 쓴 것입니다. 대괄호만 채우면 됩니다.
① 자료 뭉치 → 순위 매긴 실행안
«계획 세워줘» 라고 하면 이미 다들 동의하는 내용을 요약해 옵니다. 그래서 가정을 깨보라고 시킵니다.
첨부한 자료로 [사업 영역 / 런칭 / 고객군 / 퍼널] 을 분석해 주세요. 자료: [설문 결과, 고객 인터뷰, 분석 대시보드, 기획 문서, 회의록, 슬랙 대화, 내부 목표] 목표는 [구체적인 사업 목표] 이고 대상은 [고객군] 입니다. 내부에서 이미 합의된 내용을 요약하지 마세요. 자료를 근거로 우리 가정을 검증하고, 무엇을 바꿔야 하는지 찾아 주세요. 이렇게 내주세요. 1. 우리 일하는 방식을 바꿀 만한 인사이트 열 개 2. 실행할 것 · 시도할 것 · 그만둘 것을 순위 매긴 열 개 3. 각 권고의 근거 4. 자료끼리 어긋나는 곳, 낡은 기준, 애매한 정의, 내가 먼저 확인해야 할 가정 결론이 특정 자료 하나에 크게 기대고 있으면 표시하고, 그게 사실인지 어떻게 확인하면 되는지 알려 주세요.
② 흩어진 피드백 → 테마와 판단 대기 목록
문의·리뷰·회의록이 여기저기 흩어져 있을 때입니다.
[제품 / 기능 / 업무] 에 대한 피드백을 이 자료들에서 모아 주세요. [슬랙 채널, 문의 티켓, 화면 녹화, 스크린샷, 로그, 고객 통화, 회의록] 주제별로 묶고 이렇게 나눠 주세요. 1. 바로 실행 가능한 것 2. 내 판단이 필요한 것 3. 우리 방향과 충돌하는 것 4. 각각의 근거 실행 가능한 것은 하나의 실행 계획으로 묶어 주세요. 서로 충돌하지 않게 해 주세요. 끝나면 무엇이 바뀌었고, 무엇을 건너뛰었고, 무엇이 아직 내 검토를 기다리고, 작업을 어떻게 검증했는지 보여 주세요.
③ 전략 컨설턴트로 고용하기
이건 채팅창에서 쓰는 게 아닙니다. 자료를 다 넣어 두고 돌린 다음 커피 마시고 오는 용도입니다.
당신을 시니어 전략 컨설턴트로 고용합니다. 우리 팀이 못 주는 외부 시각이 필요합니다. 시작 전에, 최고 수준의 컨설턴트가 킥오프에서 하듯 저를 인터뷰해 주세요. 그다음 혼자 진행하세요. 전부 읽고, 서브에이전트로 나눠 분석하고, 서로의 결과를 교차 검증하세요. 우리가 미처 생각 못 했을 권고 3~5개를 가져오세요. 각각 제 자료에서 나온 구체적인 숫자·날짜·인용으로 뒷받침해 주세요. 확정하기 전에 당신의 결론을 스스로 공격해서, 뻔하거나 일반론이거나 근거 없는 건 버리세요. 자료가 제 말과 어긋나면 그렇다고 말해 주세요. 경영진과 공유할 수 있는 브리핑 문서 하나로 주세요. 사업의 실제 상태, 기회, 우리가 값을 안 매기고 있는 리스크, 90일 계획, 그리고 당신이 세운 모든 가정과 저만 답할 수 있는 열린 질문까지.
④ 방법론을 뽑아내 싼 모델에 넘기기
매달 하는 일이면 이걸 꼭 하세요. 비싼 모델로 한 번 제대로 해낸 뒤, 그 방법을 파일로 뽑아 다음부터는 싼 모델에게 시킵니다.
작업이 끝난 다음에 이어서 붙입니다.
방금 쓴 방법을, 다른 예제에도 적용할 수 있는 지시문으로 만들어 주세요. 규칙으로 정해지는 반복 단계는 스크립트로 빼고, 판단이 들어가는 부분은 예시를 붙여 스킬로 만들어 주세요. 입력·출력·품질 검사 기준을 정의해 주세요. 한 번 테스트해 보고, 그래도 비싼 모델이 필요한 부분이 뭔지 알려 주세요.
요령이 하나 있습니다 — 일만 주지 말고 「전에 실패했던 시도들」을 같이 주세요. 무슨 에러가 났고 뭐가 안 됐는지까지요.
⑤ 자리를 비울 때
오래 걸리는 일을 맡기고 나갔는데 «이렇게 할까요?» 를 물어놓고 멈춰 있는 문제입니다. 앤트로픽 공식 문장입니다.
You are operating autonomously. The user is not watching in real time and cannot answer questions mid-task, so asking 'Want me to...?' or 'Shall I...?' will block the work. For reversible actions that follow from the original request, proceed without asking. Stop only for destructive actions or genuine scope changes the user must decide.
첫 문장이 효과의 대부분을 냅니다.
이걸 넣으면 애매한 요청에도 안 물어봅니다. 그래도 확인받고 싶은 건 한 줄로 덧붙이세요 — 예를 들면 «파일을 지우기 전에는 묻는다».
3 · ★ 절대 그냥 믿으면 안 되는 것
여기부터가 자료 작업하는 사람에게 제일 중요합니다.
인용을 지어냅니다
한 과제에서 나온 인용문 27개 중 5개가 원문에 없었습니다.
보고서·제안서·기사에 그대로 넣으면 사고가 납니다. 인용과 숫자는 반드시 원문에서 확인하세요. 이건 5.1이 특별히 나쁜 게 아니라 여전히 남아 있는 문제입니다.
분량과 개수 제한을 지키지 않습니다
같은 과제에서 실측된 값입니다.
| 시킨 것 | 나온 것 |
|---|---|
| 1,000단어 | 1,288단어 |
| 테마 3~6개 | 8개 |
| 인용 8~12개 | 43개 |
| 마크다운으로 | HTML 로 |
같은 과제에서 다른 모델은 모든 한도를 지켰습니다. 분량이 중요한 일이면 받은 다음에 세어 보세요.
자기 결과를 스스로 버립니다
과거 원고 20편을 편집장 스타일로 고치게 했더니, 편집장이 실제로 했던 수정을 찾아내기는 잘 찾았는데 찾은 것의 절반을 스스로 버렸습니다.
평가는 «볼 줄은 아는데 보여줄 자신이 없음» 이었습니다. 그래서 그 팀은 편집 작업만은 이전 모델을 그대로 씁니다.
세게 돌리면 폭주합니다
사고량을 최고로 두면 하루 종일 돕니다. 필요 없는 하위 작업을 계속 띄우고, «지금 뭐 하는 중인지 설명해줘» 라고 끊어도 무시하고 계속 갑니다. 한 사람은 하루에 18억 토큰을 태웠습니다.
평소 작업은 기본값으로 두세요. 정말 어려운 문제 하나에만 올리고, 올렸으면 지켜보세요.
4 · 글이 빽빽하게 나오면
5.1은 문장이 길고 문단이 잘 안 나뉘는 경향이 있습니다. 한 줄이면 됩니다.
Please remove all mannered prose.
반대로 «불릿 쓰지 마 · 볼드 쓰지 마» 같은 옛 규칙은 지우세요. 5.1은 원래 서식을 덜 씁니다. 억제 규칙이 남아 있으면 필요한 구조까지 죽습니다.
이 자료가 안 해주는 것
시간이 몇 배 줄었다는 약속을 못 합니다. 사람 기준 시간 비교가 붙은 사례는 위의 「23분」 하나뿐입니다. 나머지는 전부 모델끼리의 비교입니다.
모든 작업에 5.1을 쓰라는 말이 아닙니다. 편집처럼 이전 모델이 나은 작업이 확인됐습니다.
표본이 적습니다. 출시 이틀째고, 여기 사례는 대부분 한 팀의 기록입니다. 한국어 실사용기는 아직 없습니다.
출처
- Every — Fable 5.1 사용기 — 위 사례 대부분의 원문
- Every — 뭘 물을지 모를 때 페이블부터 — ④번 지시문
- 앤트로픽 프롬프팅 가이드 — ⑤번 지시문 원문
- Cowork 에서 일 맡기는 법 — 절차·접근법·타이밍을 위임하라
- 출시 발표문