every._ai
GUIDE · 한도·비용

설정을 뒤지지 않고 토큰 줄이는 caveman 가이드

읽는 데 10분2026-08-30 공개
추석 AI 부트캠프Claude 하루 6시간 만에
AI 기초부터 나만의
서비스까지 완성
이번 연휴를 기회로 삼으세요일정 보기 ↗
안 쓰는 것을 다 껐는데도 같은 요금제에서 한도가 먼저 차는 사람이 있습니다. 질문이 길어서가 아니라 오가는 양 자체를 한 번도 재 본 적이 없어서 생기는 일입니다. caveman 은 그 양을 대신 재고 줄여 주는 도구인데, 만든 사람이 "짧게 주고받는 작업에서는 오히려 손해"라고 저장소에 직접 적어 두었습니다. 이 자료는 두 갈래 중 내 쪽을 고르고, 켠 뒤에 이득인지 손해인지 내 화면에서 판정하는 순서를 담았습니다.
⚡ 복사해서 바로 시작하는 프롬프트 — 켜기 전에 내가 이득인지 먼저 재기
역할: caveman 설치 여부를 판정하고, 맞을 때만 설치 명령을 찾아 주는 담당

맥락: 같은 요금제인데 한도가 빨리 찹니다. caveman 이라는 도구가 토큰을 줄여 준다고 하는데,
이 도구는 갈래가 둘이라 어느 쪽이 제 상황에 맞는지 저는 판단할 방법이 없는 상태입니다

입력: <운영체제와 터미널, 예: macOS zsh>, <주로 시키는 일, 예: 코드 고치기와 문서 쓰기>,
<주고받는 길이, 예: 짧은 질문을 여러 번 던지는 편>

작업: 아래 네 단계를 순서대로 진행하세요.
1. github.com/JuliusBrussee/caveman 의 README 와 docs/HONEST-NUMBERS.md 를 읽고,
   이 도구가 줄이는 것이 AI 가 말하는 양인지 읽는 양인지 갈라서 알려 주세요.
2. 그 문서에 적힌 "손해가 나는 경우" 목록을 그대로 옮기고,
   제 작업 방식이 그중 어디에 해당하는지 판단해 주세요.
3. 손해 쪽에 해당하면 설치하지 말라고 말해 주세요. 이득 쪽이면 둘 중 하나만 먼저
   고르고, 그 설치 명령을 README 에서 찾아 문장을 바꾸지 말고 그대로 보여 주세요.
4. 켠 뒤 무엇을 보면 이득인지 알 수 있는지, 명령과 확인할 값을 알려 주세요.

제약: 절감률을 추측해서 말하지 마세요. 문서에 숫자가 없으면 "저장소가 공개하지 않았다"고 적으세요.
지금은 아무것도 설치하지 마세요. 판단과 명령만 주세요.
비밀키와 자격 증명 파일은 읽거나 출력하지 마세요.

출력: ①이 도구가 줄이는 것 ②손해가 나는 경우와 제 해당 여부 ③먼저 깔 한쪽과 그 명령
④켠 뒤 확인 방법. 항목마다 근거로 삼은 문서 이름을 한 줄씩 붙여 주세요.

검증: 네 항목 전부에 출처 문서 이름이 붙어 있어야 하고, 절감률을 말했다면 그 숫자가
어느 문서 어느 표에서 나온 것인지 같이 적혀 있어야 합니다.
하나라도 없으면 완료로 보고하지 말고 어디서 막혔는지 알려 주세요.

이 글은 앞 글의 다음 칸입니다

한도가 빨리 찬다고 하면 보통 설정부터 뒤집니다. 무엇이 창을 채우는지 보고, 안 쓰는 것을 하나씩 끄는 방식입니다. 그 절차는 같은 한도로 두 배 쓰는 Claude Code 토큰 다이어트에 따로 정리해 두었습니다.

이 글은 그다음 칸입니다. 끌 것을 다 껐는데도 한도가 먼저 찬다면, 남은 일은 끄는 게 아니라 오가는 양 자체를 줄이는 것입니다. 앞 글이 짐을 덜 싣는 법이라면, 이 글은 실린 짐을 눌러 담는 도구입니다.

토큰 — AI 가 글자를 세는 단위입니다. 요금제 한도도, 대화가 길어질수록 답이 흐려지는 것도 전부 이 숫자로 정해집니다. 내가 친 질문뿐 아니라 AI 가 읽은 것과 뱉은 말이 전부 여기 들어갑니다.

이걸 깔면 무엇이 달라지나

caveman 은 하나가 아니라 갈래가 둘입니다. 이름이 같아서 하나로 보이지만, 줄이는 대상이 다릅니다.

갈래무엇을 줄이나어떻게
스킬AI 가 말하는 양짧게 답하라는 규칙을 얹습니다. 코드·명령·에러 문구는 손대지 않습니다
프록시AI 가 읽는 양도구가 뱉은 긴 출력을 지나가는 길에 눌러서 넘깁니다. 원본은 내 컴퓨터에 남습니다

사람으로 바꾸면 이렇습니다. 스킬은 말수가 적은 사람을 앉히는 것이고, 프록시는 그 사람 책상에 올라오는 서류를 미리 추려 주는 것입니다. 둘은 따로 굴러가고, 하나만 깔아도 됩니다.

프록시 — 내 컴퓨터 안에서 AI 도구와 서버 사이에 끼어 있는 중계 프로그램입니다. 쓰던 도구를 바꾸는 게 아니라 오가는 길만 갈아 끼웁니다. 눌러 놓기 전 원본은 내 디스크에 남고 caveman 쪽 서버를 거치지 않으며, 계정도 필요 없다고 저장소가 적어 두었습니다.

만든 사람이 먼저 적어 둔 경고

이 도구를 고르는 기준은 홍보 문구가 아니라 저장소 README 에 붙어 있는 경고문입니다. 원문을 옮깁니다.

> 스킬은 출력 토큰만 줄입니다. 입력과 추론 토큰은 건드리지 않고, 스킬 자체가 매 턴 1~1.5k 입력 토큰을 더합니다. 대화 하나를 통째로 놓고 보면 절감폭은 출력 숫자보다 작고, 원래 짧게 주고받는 작업에서는 마이너스가 될 수 있습니다.

여기서 「출력」은 AI 가 하는 말, 「입력」은 AI 가 읽는 것, 「추론」은 AI 가 속으로 생각하는 몫입니다. 즉 말 줄이는 쪽은 읽는 양을 하나도 안 줄이고, 도리어 자기 규칙만큼을 매번 더합니다. 대답이 원래 긴 작업이면 이득이고, 한 줄짜리 질문을 여러 번 던지는 작업이면 손해입니다.

그리고 하나 더 짚을 것이 있습니다. README 앞쪽에는 평균 65% 를 아꼈다는 표가 있습니다. 그런데 같은 저장소의 한계 문서는 그 항목을 「공개하지 않음」 으로 적어 두었습니다. 시험 장치는 있지만 검토를 거친 원자료가 저장소에 올라와 있지 않다는 뜻입니다. 그래서 이 글은 65% 를 근거로 쓰지 않습니다.

Quick Start

공식 저장소: caveman 공식 저장소 · 스킬은 MIT 무료

말 줄이는 쪽은 한 줄입니다. README 에 적힌 명령을 그대로 옮겼습니다.

terminal
npx skills add JuliusBrussee/caveman
성공하면 설치한 스킬 목록에 caveman 이 들어옵니다. 다음에 새로 연 대화창부터 /caveman 이 잡힙니다.

읽는 양까지 줄이려면 본체를 깝니다. 두 줄입니다.

terminal
npm install -g @caveman-ai/cli && caveman setup --install
caveman claude
성공하면 두 번째 줄에서 클로드 코드가 평소처럼 뜹니다. 다른 점은 오가는 내용이 중계 프로그램을 지난다는 것뿐입니다.

클로드 코드 하나만 쓸 거면 클로드 코드 자체에 얹는 길도 있습니다.

terminal
claude plugin marketplace add JuliusBrussee/caveman && claude plugin install caveman@caveman
성공하면 caveman@caveman 이 설치되고, 다음에 새로 연 대화창부터 /caveman 이 잡힙니다.

진짜 켜졌는지 확인

설치가 끝나면 대화창을 새로 여세요. 켜 주는 장치가 대화가 시작될 때만 돌기 때문에, 이미 열려 있던 창에서는 아무 일도 일어나지 않습니다.

terminal
cat "${CLAUDE_CONFIG_DIR:-$HOME/.claude}/.caveman-active"
성공하면 화면에 full 한 단어가 찍힙니다. 아무것도 안 나오면 켜 주는 장치가 안 돈 것이니 클로드 코드를 껐다 켜고 다시 치세요.

화면 아래 상태줄에는 [CAVEMAN] 이 주황색으로 붙습니다. 저장소는 첫 /caveman-stats 실행 뒤부터 [CAVEMAN] ⛏ 12.4k 처럼 절약분이 뒤에 붙는다고 적어 두었습니다.


STEP 1 · 3분두 갈래 중 내 쪽 고르기

이 단계에서는 명령을 치기 전에 내가 손해 보는 쪽인지부터 갈라냅니다. 이 도구는 켜기만 하면 이득인 종류가 아니기 때문입니다.

아래는 2026년 8월 30일에 깃허브가 공개하는 숫자와 저장소 문서를 직접 읽어 확인한 값입니다.

항목값
깃허브 스타101,719
포크5,913
최신 배포v2.3.1 · 2026-08-23
라이선스스킬과 caveman 명령은 MIT · 엔진과 프록시는 BSL-1.1
말 줄이는 쪽이 줄이는 것출력 토큰만
말 줄이는 쪽이 더하는 것매 턴 입력 1~1.5k

고르는 기준은 한 줄입니다.


STEP 2 · 2분말 줄이는 쪽을 켜고 눈으로 확인

이 단계에서는 답이 실제로 짧아지는지 봅니다. 설치됐는지가 아니라 걸리는지를 봐야 하기 때문입니다.

새 대화창에서 아래를 칩니다. 저장소는 자동으로 안 걸릴 때 이 명령으로 켠다고 적었습니다.

claude code
/caveman
성공하면 Got it. Caveman mode on. 같은 짧은 문장이 돌아옵니다. 긴 설명이 돌아오면 아직 안 걸린 것이니 창을 새로 여세요.

이어서 아무 질문이나 던져 보면 차이가 바로 보입니다. README 에 실린 예시는 이렇습니다.

같은 답, 켜기 전과 뒤
켜기 전 · 69 토큰
  리액트 컴포넌트가 다시 그려지는 이유는 매 렌더마다 새 객체를 만들고 있기
  때문일 가능성이 높습니다. 인라인 객체를 속성으로 넘기면 리액트의 얕은 비교가
  매번 다른 객체로 보고 다시 그리게 됩니다. useMemo 로 감싸기를 권합니다.

켜기 뒤 · 19 토큰
  매 렌더마다 새 객체. 인라인 객체 속성 = 새 참조 = 재렌더. `useMemo` 로 감쌀 것.

세기는 lite · full · ultra 로 바꿉니다. 답이 너무 잘려서 못 알아보겠으면 한 칸 내리고, 아예 끄려면 off 를 씁니다.

claude code
/caveman lite
/caveman off
성공하면 다음 답부터 길이가 달라집니다. off 를 치면 평소 길이로 돌아옵니다.

STEP 3 · 5분내 기록에서 토큰이 어디로 새는지 재기

이 단계에서는 이 도구에서 가장 값이 나가는 기능 하나를 씁니다. 무엇을 줄일지 사람이 고르지 않고, 내가 지금까지 쓴 기록을 도구가 읽어서 순위를 매겨 주기 때문입니다.

저장소는 이 명령이 내 컴퓨터 안에서만 돌고, 읽기만 하며, 계정이 필요 없다고 적어 두었습니다.

terminal
caveman learn
성공하면 점수와 함께 「토큰이 새는 자리」가 큰 것부터 순위로 나옵니다. 줄마다 한 줄짜리 조치가 붙어 있습니다.

여기서 나오는 것이 앞 글에서 손으로 찾던 항목들입니다. 차이는 순서입니다. 앞 글은 무엇이 창을 채우는지 보고 사람이 골라 껐고, 이쪽은 몇 달치 기록을 훑어 큰 것부터 줄을 세웁니다.

찾은 것을 바로 고치게 시킬 수도 있습니다. 저장소 설명으로는, 이 명령이 내 AI 도구를 열어 고칠 거리를 하나씩 제안하고 내가 예라고 할 때만 적용한 뒤 다시 재고, 토큰이 안 줄었으면 되돌립니다.

terminal
caveman learn implement
성공하면 클로드 코드나 코덱스가 계획을 들고 열리고, 고칠 것을 하나씩 물어봅니다.

STEP 4 · 3분깔아 둔 스킬의 무게 줄이기

이 단계에서는 앞 글에서 「껐던」 항목을 이번에는 끄지 않고 줄입니다. 자주 쓰는 스킬은 끌 수가 없는데, 걸릴 때마다 본문이 통째로 다시 실려서 매번 값을 내기 때문입니다.

caveman 은 스킬 본문을 그림 페이지로 바꿔 끼웁니다. 맨 위 설정 줄은 글자로 남기 때문에 언제 걸릴지는 그대로고, 본문만 그림으로 읽힙니다. 먼저 계산만 시켜 봅니다.

terminal
caveman convert --dry-run
성공하면 깔려 있는 스킬마다 「글자일 때 몇, 그림일 때 몇」이 나옵니다. 파일은 하나도 안 바뀝니다.

이득이 나는 것만 바꾸고, 아니다 싶으면 되돌립니다. 저장소는 그림이 글자를 못 이기면 아예 바꾸지 않고, 실패해도 파일을 한 글자도 안 건드린 채 남긴다고 적었습니다.

terminal
caveman convert --agent claude
caveman convert --revert
성공하면 이득이 나는 스킬만 바뀌고, 거른 스킬은 무엇 때문에 걸렀는지 같이 뜹니다. 둘째 줄은 백업 파일에서 원래 글자로 되돌립니다.

저장소가 자기네 스킬로 직접 재 본 값은 1,069 → 415 토큰(-61%) 입니다. 다만 이건 스킬 하나의 값이고 스킬마다 다릅니다. 그래서 --dry-run 이 먼저입니다.


STEP 5 · 5분읽는 양을 줄이는 쪽 켜기

이 단계에서는 본체를 씁니다. 답을 짧게 만드는 것으로는 AI 가 읽는 쪽이 전혀 안 줄기 때문입니다.

terminal
caveman claude
성공하면 클로드 코드가 평소처럼 뜹니다. 로그인 정보는 그대로 통과한다고 저장소가 적어 두었습니다.

저장소는 정해진 문제로 54번을 돌린 자체 시험 결과를 공개했습니다. 여섯 가지 중 다섯은 줄었고 하나는 오히려 늘었습니다.

저장소가 공개한 자체 시험 (docs/WRAP-BENCHMARK.md · 입력 토큰)
로그에서 한 줄 찾기      148,807 →  74,068     50.2% 줄었다
배포 설정 JSON 대조      147,975 → 108,939     26.4% 줄었다
이상 거래 CSV 찾기       165,823 →  74,484     55.1% 줄었다
테스트 실패 출력 읽기     150,377 → 108,514     27.8% 줄었다
설정 YAML 대조           132,124 →  71,027     46.2% 줄었다
대시보드 HTML 읽기       140,687 → 154,641      9.9% 늘었다  ←
────────────────────────────────────────────────────────
합계                     885,793 → 591,673     33.2% 줄었다

늘어난 줄을 지우지 않고 합계에 그대로 넣은 점이 이 표의 신뢰도입니다. 저장소는 HTML 에서는 누를 수 있는 게 없었는데 스킬 몫은 그대로 붙어서 늘었다고 적었습니다. 그리고 이 값은 「정해진 여섯 문제」의 값이지 실제 청구서가 아니라고 같은 문서에 못 박았습니다.


STEP 6 · 3분이득인지 손해인지 내 화면에서 판정

이 단계에서는 남의 숫자를 내 숫자로 바꿉니다. 저장소가 스스로 "켜고 끄고 비교해서 손해면 끄라" 고 적어 두었기 때문입니다.

claude code
/caveman-stats
성공하면 이번 대화에서 실제로 쓴 출력·캐시 토큰 수가 나옵니다. 저장소는 여기에 「얼마를 아꼈다」는 값은 넣지 않는다고 적었습니다.
terminal
caveman status
성공하면 지금 켜져 있는지, 어느 단계로 돌고 있는지가 한 화면에 나옵니다.

판정 방법은 저장소가 적어 둔 그대로입니다. 같은 일을 켜고 한 번, 끄고 한 번 시킨 뒤 요금제 사용량 화면을 비교합니다. 도구가 보여 주는 추정치보다 실제 청구 쪽이 우선이라고 저장소가 직접 적었습니다.


STEP 7 · 2분안 맞으면 끄고 지우기

이 단계에서는 되돌리는 법을 미리 봅니다. 손해가 나는 경우가 문서에 적혀 있는 도구라면, 지우는 법을 알고 켜는 것이 맞기 때문입니다.

claude code
/caveman off
성공하면 다음 답부터 평소 길이로 돌아옵니다.
terminal
npx -y github:JuliusBrussee/caveman -- --uninstall
npx skills remove caveman
성공하면 설정 파일에서 caveman 항목이 빠지고 상태줄의 [CAVEMAN] 이 사라집니다. 첫 줄은 스킬을 안 지우니 둘째 줄까지 치세요.

하나 더 있습니다. 이 도구는 어떤 명령을 돌렸는지 익명 통계를 기본으로 보냅니다. 프롬프트와 코드와 파일 경로는 보내지 않는다고 저장소가 적어 두었지만, 그래도 싫으면 한 줄로 끕니다.

terminal
caveman telemetry off
성공하면 이후 실행부터 통계를 보내지 않습니다. 이 명령이 안 먹으면 DO_NOT_TRACK=1 을 환경 변수로 두는 길도 저장소에 적혀 있습니다.

자주 막히는 곳

증상원인해결
깔았는데 답이 안 짧아진다켜 주는 장치가 대화 시작 때만 돈다클로드 코드를 껐다 켠다
.caveman-active 가 비어 있다그 장치가 조용히 실패했다다시 설치하거나 /caveman 을 직접 친다
답이 너무 잘려서 못 알아보겠다세기가 세게 잡혀 있다/caveman lite 로 한 칸 내린다
켰더니 오히려 더 나갔다짧게 주고받는 작업이라 규칙 몫이 더 크다저장소가 적어 둔 손해 경우다. 끈다
윈도우에서 안 걸린다설치 파일이 다르다install.ps1 을 쓴다. PowerShell 5.1 이상이 필요하다

FAQ

둘 다 깔아야 하나요

아닙니다. 저장소는 "하나만 고르거나 둘 다"라고 적었습니다. 답이 긴 게 불만이면 스킬만, 긴 로그나 파일을 자주 물리면 본체만 깔아도 됩니다.

클로드 코드 말고 다른 도구에도 되나요

스킬 쪽은 코덱스·커서·제미나이 등 30곳 넘는 도구에 붙는다고 저장소가 적었습니다. 본체가 감싸 주는 도구는 그보다 적고, 목록이 저장소의 공식 설치 문서에 있습니다. 도구마다 명령이 다르니 그 문서의 해당 줄을 그대로 쓰세요.

스타가 10만 개면 안전한가요

아닙니다. 스타는 관심의 크기일 뿐 내 컴퓨터에서의 안전을 보장하지 않습니다. 이 도구는 클로드 코드 설정 파일을 고치고, 대화가 시작될 때 끼어들고, 켜면 오가는 내용이 중계 프로그램을 지납니다. 무엇이 어디까지 가는지는 저장소의 보안 문서에 적혀 있으니 켜기 전에 한 번 보세요.

답이 이상해질까 봐 걱정됩니다

코드·명령·에러 문구는 그대로 둔다고 저장소가 적었고, 자체 시험에서도 정답 검사 18개를 모두 통과했다고 밝혔습니다. 다만 그 시험은 정해진 여섯 문제의 결과입니다. 내 일에서도 그런지는 /caveman off 로 껐다 켜 가며 직접 비교하세요.

무료인가요

말 줄이는 쪽(스킬과 터미널에서 치는 caveman 명령)은 MIT 라 무료입니다. 읽는 양을 줄이는 엔진과 프록시는 BSL-1.1 이라 오픈소스가 아닙니다. 내가 쓰는 용도로는 무료지만, 이걸 얹어 남에게 서비스로 파는 것은 따로 계약이 필요하다고 저장소가 적어 두었습니다.

앞 글의 방법과 뭐가 다른가요

앞 글은 덜 담는 법이고 이 글은 담긴 걸 눌러 담는 도구입니다. 앞 글의 정리를 안 하고 이것부터 깔면, 안 쓰는 설정이 매번 압축돼서 실려 갈 뿐입니다. 순서는 정리가 먼저입니다.

알아 둘 한계

말 줄이는 쪽은 읽는 양을 안 줄입니다. 오히려 자기 규칙만큼 매 턴 1~1.5k 를 더합니다. 짧게 주고받는 작업이면 켤수록 손해입니다.

요청 건수로 요금을 매기는 도구에서는 효과가 없습니다. 대답이 짧아져도 요청 한 번은 한 번입니다. 저장소는 깃허브 코파일럿을 그 예로 들었습니다.

반대로 나온 보고도 저장소에 남아 있습니다. 커서에서 켜고 끄고 비교했더니 켠 쪽이 4.3M, 끈 쪽이 1M 이었고 시간도 두 배였다는 사례입니다. 저장소는 그 실행을 다시 재현하지 못했다고 적으면서도 그 줄을 지우지 않았습니다.

33.2% 는 실제 청구서가 아닙니다. 정해진 여섯 문제를 54번 돌린 자체 시험 값이고, 95% 구간이 14.6%에서 48.5%로 넓습니다. 저장소는 원자료가 올라와 있지 않아 이 저장소만 받아서는 재현할 수 없다고 직접 적었습니다.

저희가 직접 설치해 돌려본 글이 아닙니다. 이 글의 숫자와 명령은 2026년 8월 30일에 깃허브가 공개하는 숫자와 저장소 문서를 직접 읽어 옮긴 것입니다. 그래서 켠 뒤 효과를 우리 값으로 단언하지 않고, 대신 직접 재는 명령을 STEP 6 에 넣었습니다.

공식 자료

AI 수익화 정보는 카톡방에 먼저 올립니다 새 자료도 카톡방에 먼저 풀고, 막히는 부분은 거기서 바로 물어보실 수 있습니다. 카톡방 들어가기 →

Every AI · 챌린지 모집 알림

AI 활용 능력은 이제
선택이 아닌 필수입니다

어렵지 않습니다. AI 모델이 발전하는 만큼,
당신의 역량과 전문성을 살릴 기회도 늘어나고 있습니다.

함께 그 가능성을 펼칠 분들을 모십니다.
이메일을 남겨주시면 챌린지 모집이 시작될 때 안내해 드립니다.

모집 알림 신청이며 참가 확정은 아닙니다.