every._ai
GUIDE · 자료 작업

요약이 아니라 판단을 시키는 페이블 5.1 자료 작업법

읽는 데 9분2026-09-02 공개
추석 AI 부트캠프Claude 하루 6시간 만에
AI 기초부터 나만의
서비스까지 완성
이번 연휴를 기회로 삼으세요일정 보기 ↗
자료를 넣고 정리시키면 이미 다들 아는 내용이 요약돼 돌아옵니다. 모델이 모자라서가 아니라 요약을 시켰기 때문입니다. 페이블 5.1은 가정을 깨보라고 시켰을 때 달라지는 모델입니다. 이 자료는 무엇이 실제로 나아졌는지와 복붙할 지시문 다섯 개, 그리고 절대 믿으면 안 되는 것을 담았습니다.
어디서 쓰나 — 클로드 코드는 /model fable. Cowork 와 claude.ai 에서는 그냥 페이블 5.1 을 고르면 됩니다. 사고량 기본값이 다릅니다 — 클로드 코드는 높게, Cowork·claude.ai 는 중간입니다.

먼저 알아둘 것

아래 사례는 2026-09-02 에 실사용 기록을 직접 열어 확인한 것입니다. 벤치마크 점수가 아니라 사람이 실제로 시켜 본 결과입니다.

출시 이틀째라 표본이 적습니다. 여기 적은 건 대부분 Every 팀의 실사용 기록이고, 시간 수치가 붙은 건 몇 건뿐입니다. 없는 건 없다고 적었습니다.

1 · 뭐가 실제로 달라졌나

요약 대신 판단을 내놓기 시작했다

설문 원자료를 넣었더니, 점수 분포를 정리한 게 아니라 이런 걸 잡아냈습니다.

실제 결과
우리를 «흥미롭다» 고 표현한 고객은 추천자가 아니고, «쓸모 있다 · 훌륭하다 · 똑똑하다» 고 한 고객이 추천자다

이걸 한 문장으로 정리해 왔습니다. 시킨 사람 말로는 «구 페이블은 절대 안 하던 것» 입니다.

이게 이 모델의 핵심입니다. 자료를 넣고 정리시키면 여전히 요약이 나옵니다. 가정을 깨보라고 시켜야 이게 나옵니다. 아래 지시문들이 전부 그 구조입니다.

문서를 슬라이드로 바꾸면 손댈 게 거의 없다

기존 문서를 발표자료로 바꾸게 했더니 슬라이드당 아이디어 하나, 노란 하이라이트, 흐름을 나타내는 화살표가 깨지지 않고 나왔습니다. 같은 과제에서 다른 모델은 화살표가 깨지고 레이아웃이 빈약했습니다.

시킨 사람 평은 «사람 개입 최소» 입니다. 1차 결과물이 그냥 쓸 만한 수준을 넘었다는 뜻입니다.

실습용 자료를 통째로 만들어 온다

임원 대상 AI 실습 과제를 만들라고 시켰습니다. 결과물은 이랬습니다.

23분 걸렸고, 평가는 «거의 완벽» 이었습니다.

긴 글의 빈 구간을 채우는 데는 지금까지 중 최고

에세이의 빠진 문단을 채우게 했더니, 주변 문단의 구체적인 디테일을 실제로 끌어썼고, 문단마다 논지를 하나씩 쌓았고, 원문에 없는 걸 추론해서 넣지 않았습니다.

「AI 가 쓴 티」가 지금까지 돌린 모든 모델 중 가장 적었습니다. 읽기 난이도도 가장 낮게 나왔습니다.

두 모델 연속으로 실망해서 «AI 글쓰기는 내 것이 아니다» 라고 접었던 사람이 글쓰기를 전부 옮겼습니다.

같은 일을 절반 값에 한다

도구를 부르며 긴 업무를 처리하는 사내 어시스턴트를, 프롬프트를 한 줄도 안 고치고 모델만 바꿔 봤습니다.

이전페이블 5.1
요청당 토큰약 2,000766
걸린 시간37초22초

결과물 품질은 동등했고 글쓰기 점수는 오히려 올랐습니다.

문단이 왜 밋밋한지 짚는다

다시 써주는 게 아니라 이렇게 말합니다.

실제 지적
가장 큰 문제는 이 문단이 하필 결정타를 날려야 할 자리에서 힘이 빠진다는 것이다

억지 연결도 안 받아줍니다. 아무 상관없는 둘을 놓고 «이거 완전 똑같지 않아?» 라고 던지면 약한 모델은 맞장구를 칩니다. 5.1은 실제로 흥미로울 때만 흥미롭다고 합니다.

2 · 복붙할 지시문 다섯 개

전부 실무자가 실제로 쓴 것입니다. 대괄호만 채우면 됩니다.

① 자료 뭉치 → 순위 매긴 실행안

«계획 세워줘» 라고 하면 이미 다들 동의하는 내용을 요약해 옵니다. 그래서 가정을 깨보라고 시킵니다.

⚡ 기획서 · 전략 문서
첨부한 자료로 [사업 영역 / 런칭 / 고객군 / 퍼널] 을 분석해 주세요.
자료: [설문 결과, 고객 인터뷰, 분석 대시보드, 기획 문서, 회의록, 슬랙 대화, 내부 목표]

목표는 [구체적인 사업 목표] 이고 대상은 [고객군] 입니다.

내부에서 이미 합의된 내용을 요약하지 마세요. 자료를 근거로 우리 가정을 검증하고,
무엇을 바꿔야 하는지 찾아 주세요.

이렇게 내주세요.
1. 우리 일하는 방식을 바꿀 만한 인사이트 열 개
2. 실행할 것 · 시도할 것 · 그만둘 것을 순위 매긴 열 개
3. 각 권고의 근거
4. 자료끼리 어긋나는 곳, 낡은 기준, 애매한 정의, 내가 먼저 확인해야 할 가정

결론이 특정 자료 하나에 크게 기대고 있으면 표시하고, 그게 사실인지 어떻게
확인하면 되는지 알려 주세요.

② 흩어진 피드백 → 테마와 판단 대기 목록

문의·리뷰·회의록이 여기저기 흩어져 있을 때입니다.

⚡ 정리 · 회의록 · 고객 의견
[제품 / 기능 / 업무] 에 대한 피드백을 이 자료들에서 모아 주세요.
[슬랙 채널, 문의 티켓, 화면 녹화, 스크린샷, 로그, 고객 통화, 회의록]

주제별로 묶고 이렇게 나눠 주세요.
1. 바로 실행 가능한 것
2. 내 판단이 필요한 것
3. 우리 방향과 충돌하는 것
4. 각각의 근거

실행 가능한 것은 하나의 실행 계획으로 묶어 주세요. 서로 충돌하지 않게 해 주세요.

끝나면 무엇이 바뀌었고, 무엇을 건너뛰었고, 무엇이 아직 내 검토를 기다리고,
작업을 어떻게 검증했는지 보여 주세요.

③ 전략 컨설턴트로 고용하기

이건 채팅창에서 쓰는 게 아닙니다. 자료를 다 넣어 두고 돌린 다음 커피 마시고 오는 용도입니다.

⚡ 진단 · 컨설팅
당신을 시니어 전략 컨설턴트로 고용합니다. 우리 팀이 못 주는 외부 시각이 필요합니다.

시작 전에, 최고 수준의 컨설턴트가 킥오프에서 하듯 저를 인터뷰해 주세요.
그다음 혼자 진행하세요. 전부 읽고, 서브에이전트로 나눠 분석하고, 서로의 결과를
교차 검증하세요.

우리가 미처 생각 못 했을 권고 3~5개를 가져오세요. 각각 제 자료에서 나온 구체적인
숫자·날짜·인용으로 뒷받침해 주세요.

확정하기 전에 당신의 결론을 스스로 공격해서, 뻔하거나 일반론이거나 근거 없는 건
버리세요. 자료가 제 말과 어긋나면 그렇다고 말해 주세요.

경영진과 공유할 수 있는 브리핑 문서 하나로 주세요. 사업의 실제 상태, 기회,
우리가 값을 안 매기고 있는 리스크, 90일 계획, 그리고 당신이 세운 모든 가정과
저만 답할 수 있는 열린 질문까지.
품질 기준선 — 결과물에 불편한 게 하나도 없으면 넣은 자료가 부실한 것입니다. 원자료를 더 넣고 다시 돌리세요. 재무 자료, 전략 메모(폐기된 것까지 — 여기가 금맥입니다), 이사회 자료, 회의록, 수주·실주 기록.

④ 방법론을 뽑아내 싼 모델에 넘기기

매달 하는 일이면 이걸 꼭 하세요. 비싼 모델로 한 번 제대로 해낸 뒤, 그 방법을 파일로 뽑아 다음부터는 싼 모델에게 시킵니다.

작업이 끝난 다음에 이어서 붙입니다.

⚡ 반복 업무 자동화
방금 쓴 방법을, 다른 예제에도 적용할 수 있는 지시문으로 만들어 주세요.

규칙으로 정해지는 반복 단계는 스크립트로 빼고, 판단이 들어가는 부분은 예시를 붙여
스킬로 만들어 주세요. 입력·출력·품질 검사 기준을 정의해 주세요.

한 번 테스트해 보고, 그래도 비싼 모델이 필요한 부분이 뭔지 알려 주세요.

요령이 하나 있습니다 — 일만 주지 말고 「전에 실패했던 시도들」을 같이 주세요. 무슨 에러가 났고 뭐가 안 됐는지까지요.

⑤ 자리를 비울 때

오래 걸리는 일을 맡기고 나갔는데 «이렇게 할까요?» 를 물어놓고 멈춰 있는 문제입니다. 앤트로픽 공식 문장입니다.

⚡ 자율 실행
You are operating autonomously. The user is not watching in real time and cannot answer questions mid-task, so asking 'Want me to...?' or 'Shall I...?' will block the work. For reversible actions that follow from the original request, proceed without asking. Stop only for destructive actions or genuine scope changes the user must decide.

첫 문장이 효과의 대부분을 냅니다.

이걸 넣으면 애매한 요청에도 안 물어봅니다. 그래도 확인받고 싶은 건 한 줄로 덧붙이세요 — 예를 들면 «파일을 지우기 전에는 묻는다».

3 · ★ 절대 그냥 믿으면 안 되는 것

여기부터가 자료 작업하는 사람에게 제일 중요합니다.

인용을 지어냅니다

한 과제에서 나온 인용문 27개 중 5개가 원문에 없었습니다.

보고서·제안서·기사에 그대로 넣으면 사고가 납니다. 인용과 숫자는 반드시 원문에서 확인하세요. 이건 5.1이 특별히 나쁜 게 아니라 여전히 남아 있는 문제입니다.

분량과 개수 제한을 지키지 않습니다

같은 과제에서 실측된 값입니다.

시킨 것나온 것
1,000단어1,288단어
테마 3~6개8개
인용 8~12개43개
마크다운으로HTML 로

같은 과제에서 다른 모델은 모든 한도를 지켰습니다. 분량이 중요한 일이면 받은 다음에 세어 보세요.

자기 결과를 스스로 버립니다

과거 원고 20편을 편집장 스타일로 고치게 했더니, 편집장이 실제로 했던 수정을 찾아내기는 잘 찾았는데 찾은 것의 절반을 스스로 버렸습니다.

평가는 «볼 줄은 아는데 보여줄 자신이 없음» 이었습니다. 그래서 그 팀은 편집 작업만은 이전 모델을 그대로 씁니다.

세게 돌리면 폭주합니다

사고량을 최고로 두면 하루 종일 돕니다. 필요 없는 하위 작업을 계속 띄우고, «지금 뭐 하는 중인지 설명해줘» 라고 끊어도 무시하고 계속 갑니다. 한 사람은 하루에 18억 토큰을 태웠습니다.

평소 작업은 기본값으로 두세요. 정말 어려운 문제 하나에만 올리고, 올렸으면 지켜보세요.

4 · 글이 빽빽하게 나오면

5.1은 문장이 길고 문단이 잘 안 나뉘는 경향이 있습니다. 한 줄이면 됩니다.

terminal
Please remove all mannered prose.

반대로 «불릿 쓰지 마 · 볼드 쓰지 마» 같은 옛 규칙은 지우세요. 5.1은 원래 서식을 덜 씁니다. 억제 규칙이 남아 있으면 필요한 구조까지 죽습니다.

이 자료가 안 해주는 것

시간이 몇 배 줄었다는 약속을 못 합니다. 사람 기준 시간 비교가 붙은 사례는 위의 「23분」 하나뿐입니다. 나머지는 전부 모델끼리의 비교입니다.

모든 작업에 5.1을 쓰라는 말이 아닙니다. 편집처럼 이전 모델이 나은 작업이 확인됐습니다.

표본이 적습니다. 출시 이틀째고, 여기 사례는 대부분 한 팀의 기록입니다. 한국어 실사용기는 아직 없습니다.

출처

AI 수익화 정보는 카톡방에 먼저 올립니다 새 자료도 카톡방에 먼저 풀고, 막히는 부분은 거기서 바로 물어보실 수 있습니다. 카톡방 들어가기 →

Every AI · 챌린지 모집 알림

AI 활용 능력은 이제
선택이 아닌 필수입니다

어렵지 않습니다. AI 모델이 발전하는 만큼,
당신의 역량과 전문성을 살릴 기회도 늘어나고 있습니다.

함께 그 가능성을 펼칠 분들을 모십니다.
이메일을 남겨주시면 챌린지 모집이 시작될 때 안내해 드립니다.

모집 알림 신청이며 참가 확정은 아닙니다.