설정을 뒤지지 않고 토큰 줄이는 caveman 가이드
AI 기초부터 나만의
서비스까지 완성
역할: caveman 설치 여부를 판정하고, 맞을 때만 설치 명령을 찾아 주는 담당 맥락: 같은 요금제인데 한도가 빨리 찹니다. caveman 이라는 도구가 토큰을 줄여 준다고 하는데, 이 도구는 갈래가 둘이라 어느 쪽이 제 상황에 맞는지 저는 판단할 방법이 없는 상태입니다 입력: <운영체제와 터미널, 예: macOS zsh>, <주로 시키는 일, 예: 코드 고치기와 문서 쓰기>, <주고받는 길이, 예: 짧은 질문을 여러 번 던지는 편> 작업: 아래 네 단계를 순서대로 진행하세요. 1. github.com/JuliusBrussee/caveman 의 README 와 docs/HONEST-NUMBERS.md 를 읽고, 이 도구가 줄이는 것이 AI 가 말하는 양인지 읽는 양인지 갈라서 알려 주세요. 2. 그 문서에 적힌 "손해가 나는 경우" 목록을 그대로 옮기고, 제 작업 방식이 그중 어디에 해당하는지 판단해 주세요. 3. 손해 쪽에 해당하면 설치하지 말라고 말해 주세요. 이득 쪽이면 둘 중 하나만 먼저 고르고, 그 설치 명령을 README 에서 찾아 문장을 바꾸지 말고 그대로 보여 주세요. 4. 켠 뒤 무엇을 보면 이득인지 알 수 있는지, 명령과 확인할 값을 알려 주세요. 제약: 절감률을 추측해서 말하지 마세요. 문서에 숫자가 없으면 "저장소가 공개하지 않았다"고 적으세요. 지금은 아무것도 설치하지 마세요. 판단과 명령만 주세요. 비밀키와 자격 증명 파일은 읽거나 출력하지 마세요. 출력: ①이 도구가 줄이는 것 ②손해가 나는 경우와 제 해당 여부 ③먼저 깔 한쪽과 그 명령 ④켠 뒤 확인 방법. 항목마다 근거로 삼은 문서 이름을 한 줄씩 붙여 주세요. 검증: 네 항목 전부에 출처 문서 이름이 붙어 있어야 하고, 절감률을 말했다면 그 숫자가 어느 문서 어느 표에서 나온 것인지 같이 적혀 있어야 합니다. 하나라도 없으면 완료로 보고하지 말고 어디서 막혔는지 알려 주세요.
이 글은 앞 글의 다음 칸입니다
한도가 빨리 찬다고 하면 보통 설정부터 뒤집니다. 무엇이 창을 채우는지 보고, 안 쓰는 것을 하나씩 끄는 방식입니다. 그 절차는 같은 한도로 두 배 쓰는 Claude Code 토큰 다이어트에 따로 정리해 두었습니다.
이 글은 그다음 칸입니다. 끌 것을 다 껐는데도 한도가 먼저 찬다면, 남은 일은 끄는 게 아니라 오가는 양 자체를 줄이는 것입니다. 앞 글이 짐을 덜 싣는 법이라면, 이 글은 실린 짐을 눌러 담는 도구입니다.
이걸 깔면 무엇이 달라지나
caveman 은 하나가 아니라 갈래가 둘입니다. 이름이 같아서 하나로 보이지만, 줄이는 대상이 다릅니다.
| 갈래 | 무엇을 줄이나 | 어떻게 |
|---|---|---|
| 스킬 | AI 가 말하는 양 | 짧게 답하라는 규칙을 얹습니다. 코드·명령·에러 문구는 손대지 않습니다 |
| 프록시 | AI 가 읽는 양 | 도구가 뱉은 긴 출력을 지나가는 길에 눌러서 넘깁니다. 원본은 내 컴퓨터에 남습니다 |
사람으로 바꾸면 이렇습니다. 스킬은 말수가 적은 사람을 앉히는 것이고, 프록시는 그 사람 책상에 올라오는 서류를 미리 추려 주는 것입니다. 둘은 따로 굴러가고, 하나만 깔아도 됩니다.
만든 사람이 먼저 적어 둔 경고
이 도구를 고르는 기준은 홍보 문구가 아니라 저장소 README 에 붙어 있는 경고문입니다. 원문을 옮깁니다.
> 스킬은 출력 토큰만 줄입니다. 입력과 추론 토큰은 건드리지 않고, 스킬 자체가 매 턴 1~1.5k 입력 토큰을 더합니다. 대화 하나를 통째로 놓고 보면 절감폭은 출력 숫자보다 작고, 원래 짧게 주고받는 작업에서는 마이너스가 될 수 있습니다.
여기서 「출력」은 AI 가 하는 말, 「입력」은 AI 가 읽는 것, 「추론」은 AI 가 속으로 생각하는 몫입니다. 즉 말 줄이는 쪽은 읽는 양을 하나도 안 줄이고, 도리어 자기 규칙만큼을 매번 더합니다. 대답이 원래 긴 작업이면 이득이고, 한 줄짜리 질문을 여러 번 던지는 작업이면 손해입니다.
그리고 하나 더 짚을 것이 있습니다. README 앞쪽에는 평균 65% 를 아꼈다는 표가 있습니다. 그런데 같은 저장소의 한계 문서는 그 항목을 「공개하지 않음」 으로 적어 두었습니다. 시험 장치는 있지만 검토를 거친 원자료가 저장소에 올라와 있지 않다는 뜻입니다. 그래서 이 글은 65% 를 근거로 쓰지 않습니다.
Quick Start
공식 저장소: caveman 공식 저장소 · 스킬은 MIT 무료
말 줄이는 쪽은 한 줄입니다. README 에 적힌 명령을 그대로 옮겼습니다.
npx skills add JuliusBrussee/caveman
/caveman 이 잡힙니다.읽는 양까지 줄이려면 본체를 깝니다. 두 줄입니다.
npm install -g @caveman-ai/cli && caveman setup --install caveman claude
클로드 코드 하나만 쓸 거면 클로드 코드 자체에 얹는 길도 있습니다.
claude plugin marketplace add JuliusBrussee/caveman && claude plugin install caveman@caveman
caveman@caveman 이 설치되고, 다음에 새로 연 대화창부터 /caveman 이 잡힙니다.진짜 켜졌는지 확인
설치가 끝나면 대화창을 새로 여세요. 켜 주는 장치가 대화가 시작될 때만 돌기 때문에, 이미 열려 있던 창에서는 아무 일도 일어나지 않습니다.
cat "${CLAUDE_CONFIG_DIR:-$HOME/.claude}/.caveman-active"
full 한 단어가 찍힙니다. 아무것도 안 나오면 켜 주는 장치가 안 돈 것이니 클로드 코드를 껐다 켜고 다시 치세요.화면 아래 상태줄에는 [CAVEMAN] 이 주황색으로 붙습니다. 저장소는 첫 /caveman-stats 실행 뒤부터 [CAVEMAN] ⛏ 12.4k 처럼 절약분이 뒤에 붙는다고 적어 두었습니다.
STEP 1 · 3분두 갈래 중 내 쪽 고르기
이 단계에서는 명령을 치기 전에 내가 손해 보는 쪽인지부터 갈라냅니다. 이 도구는 켜기만 하면 이득인 종류가 아니기 때문입니다.
아래는 2026년 8월 30일에 깃허브가 공개하는 숫자와 저장소 문서를 직접 읽어 확인한 값입니다.
| 항목 | 값 |
|---|---|
| 깃허브 스타 | 101,719 |
| 포크 | 5,913 |
| 최신 배포 | v2.3.1 · 2026-08-23 |
| 라이선스 | 스킬과 caveman 명령은 MIT · 엔진과 프록시는 BSL-1.1 |
| 말 줄이는 쪽이 줄이는 것 | 출력 토큰만 |
| 말 줄이는 쪽이 더하는 것 | 매 턴 입력 1~1.5k |
고르는 기준은 한 줄입니다.
- 답이 길게 나오는 일이 많다 → 말 줄이는 쪽(스킬) 부터
- 로그·테스트 결과·긴 파일을 AI 에게 자주 물린다 → 읽는 양 줄이는 쪽(프록시) 부터
- 짧은 질문을 여러 번 던지는 편이다 → 아직 아무것도 깔지 마세요. 저장소가 이 경우를 손해로 적어 두었습니다
STEP 2 · 2분말 줄이는 쪽을 켜고 눈으로 확인
이 단계에서는 답이 실제로 짧아지는지 봅니다. 설치됐는지가 아니라 걸리는지를 봐야 하기 때문입니다.
새 대화창에서 아래를 칩니다. 저장소는 자동으로 안 걸릴 때 이 명령으로 켠다고 적었습니다.
/caveman
Got it. Caveman mode on. 같은 짧은 문장이 돌아옵니다. 긴 설명이 돌아오면 아직 안 걸린 것이니 창을 새로 여세요.이어서 아무 질문이나 던져 보면 차이가 바로 보입니다. README 에 실린 예시는 이렇습니다.
켜기 전 · 69 토큰 리액트 컴포넌트가 다시 그려지는 이유는 매 렌더마다 새 객체를 만들고 있기 때문일 가능성이 높습니다. 인라인 객체를 속성으로 넘기면 리액트의 얕은 비교가 매번 다른 객체로 보고 다시 그리게 됩니다. useMemo 로 감싸기를 권합니다. 켜기 뒤 · 19 토큰 매 렌더마다 새 객체. 인라인 객체 속성 = 새 참조 = 재렌더. `useMemo` 로 감쌀 것.
세기는 lite · full · ultra 로 바꿉니다. 답이 너무 잘려서 못 알아보겠으면 한 칸 내리고, 아예 끄려면 off 를 씁니다.
/caveman lite /caveman off
off 를 치면 평소 길이로 돌아옵니다.STEP 3 · 5분내 기록에서 토큰이 어디로 새는지 재기
이 단계에서는 이 도구에서 가장 값이 나가는 기능 하나를 씁니다. 무엇을 줄일지 사람이 고르지 않고, 내가 지금까지 쓴 기록을 도구가 읽어서 순위를 매겨 주기 때문입니다.
저장소는 이 명령이 내 컴퓨터 안에서만 돌고, 읽기만 하며, 계정이 필요 없다고 적어 두었습니다.
caveman learn
여기서 나오는 것이 앞 글에서 손으로 찾던 항목들입니다. 차이는 순서입니다. 앞 글은 무엇이 창을 채우는지 보고 사람이 골라 껐고, 이쪽은 몇 달치 기록을 훑어 큰 것부터 줄을 세웁니다.
찾은 것을 바로 고치게 시킬 수도 있습니다. 저장소 설명으로는, 이 명령이 내 AI 도구를 열어 고칠 거리를 하나씩 제안하고 내가 예라고 할 때만 적용한 뒤 다시 재고, 토큰이 안 줄었으면 되돌립니다.
caveman learn implement
STEP 4 · 3분깔아 둔 스킬의 무게 줄이기
이 단계에서는 앞 글에서 「껐던」 항목을 이번에는 끄지 않고 줄입니다. 자주 쓰는 스킬은 끌 수가 없는데, 걸릴 때마다 본문이 통째로 다시 실려서 매번 값을 내기 때문입니다.
caveman 은 스킬 본문을 그림 페이지로 바꿔 끼웁니다. 맨 위 설정 줄은 글자로 남기 때문에 언제 걸릴지는 그대로고, 본문만 그림으로 읽힙니다. 먼저 계산만 시켜 봅니다.
caveman convert --dry-run
이득이 나는 것만 바꾸고, 아니다 싶으면 되돌립니다. 저장소는 그림이 글자를 못 이기면 아예 바꾸지 않고, 실패해도 파일을 한 글자도 안 건드린 채 남긴다고 적었습니다.
caveman convert --agent claude caveman convert --revert
저장소가 자기네 스킬로 직접 재 본 값은 1,069 → 415 토큰(-61%) 입니다. 다만 이건 스킬 하나의 값이고 스킬마다 다릅니다. 그래서 --dry-run 이 먼저입니다.
STEP 5 · 5분읽는 양을 줄이는 쪽 켜기
이 단계에서는 본체를 씁니다. 답을 짧게 만드는 것으로는 AI 가 읽는 쪽이 전혀 안 줄기 때문입니다.
caveman claude
저장소는 정해진 문제로 54번을 돌린 자체 시험 결과를 공개했습니다. 여섯 가지 중 다섯은 줄었고 하나는 오히려 늘었습니다.
로그에서 한 줄 찾기 148,807 → 74,068 50.2% 줄었다 배포 설정 JSON 대조 147,975 → 108,939 26.4% 줄었다 이상 거래 CSV 찾기 165,823 → 74,484 55.1% 줄었다 테스트 실패 출력 읽기 150,377 → 108,514 27.8% 줄었다 설정 YAML 대조 132,124 → 71,027 46.2% 줄었다 대시보드 HTML 읽기 140,687 → 154,641 9.9% 늘었다 ← ──────────────────────────────────────────────────────── 합계 885,793 → 591,673 33.2% 줄었다
늘어난 줄을 지우지 않고 합계에 그대로 넣은 점이 이 표의 신뢰도입니다. 저장소는 HTML 에서는 누를 수 있는 게 없었는데 스킬 몫은 그대로 붙어서 늘었다고 적었습니다. 그리고 이 값은 「정해진 여섯 문제」의 값이지 실제 청구서가 아니라고 같은 문서에 못 박았습니다.
STEP 6 · 3분이득인지 손해인지 내 화면에서 판정
이 단계에서는 남의 숫자를 내 숫자로 바꿉니다. 저장소가 스스로 "켜고 끄고 비교해서 손해면 끄라" 고 적어 두었기 때문입니다.
/caveman-stats
caveman status
판정 방법은 저장소가 적어 둔 그대로입니다. 같은 일을 켜고 한 번, 끄고 한 번 시킨 뒤 요금제 사용량 화면을 비교합니다. 도구가 보여 주는 추정치보다 실제 청구 쪽이 우선이라고 저장소가 직접 적었습니다.
STEP 7 · 2분안 맞으면 끄고 지우기
이 단계에서는 되돌리는 법을 미리 봅니다. 손해가 나는 경우가 문서에 적혀 있는 도구라면, 지우는 법을 알고 켜는 것이 맞기 때문입니다.
/caveman off
npx -y github:JuliusBrussee/caveman -- --uninstall npx skills remove caveman
[CAVEMAN] 이 사라집니다. 첫 줄은 스킬을 안 지우니 둘째 줄까지 치세요.하나 더 있습니다. 이 도구는 어떤 명령을 돌렸는지 익명 통계를 기본으로 보냅니다. 프롬프트와 코드와 파일 경로는 보내지 않는다고 저장소가 적어 두었지만, 그래도 싫으면 한 줄로 끕니다.
caveman telemetry off
DO_NOT_TRACK=1 을 환경 변수로 두는 길도 저장소에 적혀 있습니다.자주 막히는 곳
| 증상 | 원인 | 해결 |
|---|---|---|
| 깔았는데 답이 안 짧아진다 | 켜 주는 장치가 대화 시작 때만 돈다 | 클로드 코드를 껐다 켠다 |
.caveman-active 가 비어 있다 | 그 장치가 조용히 실패했다 | 다시 설치하거나 /caveman 을 직접 친다 |
| 답이 너무 잘려서 못 알아보겠다 | 세기가 세게 잡혀 있다 | /caveman lite 로 한 칸 내린다 |
| 켰더니 오히려 더 나갔다 | 짧게 주고받는 작업이라 규칙 몫이 더 크다 | 저장소가 적어 둔 손해 경우다. 끈다 |
| 윈도우에서 안 걸린다 | 설치 파일이 다르다 | install.ps1 을 쓴다. PowerShell 5.1 이상이 필요하다 |
FAQ
둘 다 깔아야 하나요
아닙니다. 저장소는 "하나만 고르거나 둘 다"라고 적었습니다. 답이 긴 게 불만이면 스킬만, 긴 로그나 파일을 자주 물리면 본체만 깔아도 됩니다.
클로드 코드 말고 다른 도구에도 되나요
스킬 쪽은 코덱스·커서·제미나이 등 30곳 넘는 도구에 붙는다고 저장소가 적었습니다. 본체가 감싸 주는 도구는 그보다 적고, 목록이 저장소의 공식 설치 문서에 있습니다. 도구마다 명령이 다르니 그 문서의 해당 줄을 그대로 쓰세요.
스타가 10만 개면 안전한가요
아닙니다. 스타는 관심의 크기일 뿐 내 컴퓨터에서의 안전을 보장하지 않습니다. 이 도구는 클로드 코드 설정 파일을 고치고, 대화가 시작될 때 끼어들고, 켜면 오가는 내용이 중계 프로그램을 지납니다. 무엇이 어디까지 가는지는 저장소의 보안 문서에 적혀 있으니 켜기 전에 한 번 보세요.
답이 이상해질까 봐 걱정됩니다
코드·명령·에러 문구는 그대로 둔다고 저장소가 적었고, 자체 시험에서도 정답 검사 18개를 모두 통과했다고 밝혔습니다. 다만 그 시험은 정해진 여섯 문제의 결과입니다. 내 일에서도 그런지는 /caveman off 로 껐다 켜 가며 직접 비교하세요.
무료인가요
말 줄이는 쪽(스킬과 터미널에서 치는 caveman 명령)은 MIT 라 무료입니다. 읽는 양을 줄이는 엔진과 프록시는 BSL-1.1 이라 오픈소스가 아닙니다. 내가 쓰는 용도로는 무료지만, 이걸 얹어 남에게 서비스로 파는 것은 따로 계약이 필요하다고 저장소가 적어 두었습니다.
앞 글의 방법과 뭐가 다른가요
앞 글은 덜 담는 법이고 이 글은 담긴 걸 눌러 담는 도구입니다. 앞 글의 정리를 안 하고 이것부터 깔면, 안 쓰는 설정이 매번 압축돼서 실려 갈 뿐입니다. 순서는 정리가 먼저입니다.
알아 둘 한계
말 줄이는 쪽은 읽는 양을 안 줄입니다. 오히려 자기 규칙만큼 매 턴 1~1.5k 를 더합니다. 짧게 주고받는 작업이면 켤수록 손해입니다.
요청 건수로 요금을 매기는 도구에서는 효과가 없습니다. 대답이 짧아져도 요청 한 번은 한 번입니다. 저장소는 깃허브 코파일럿을 그 예로 들었습니다.
반대로 나온 보고도 저장소에 남아 있습니다. 커서에서 켜고 끄고 비교했더니 켠 쪽이 4.3M, 끈 쪽이 1M 이었고 시간도 두 배였다는 사례입니다. 저장소는 그 실행을 다시 재현하지 못했다고 적으면서도 그 줄을 지우지 않았습니다.
33.2% 는 실제 청구서가 아닙니다. 정해진 여섯 문제를 54번 돌린 자체 시험 값이고, 95% 구간이 14.6%에서 48.5%로 넓습니다. 저장소는 원자료가 올라와 있지 않아 이 저장소만 받아서는 재현할 수 없다고 직접 적었습니다.
저희가 직접 설치해 돌려본 글이 아닙니다. 이 글의 숫자와 명령은 2026년 8월 30일에 깃허브가 공개하는 숫자와 저장소 문서를 직접 읽어 옮긴 것입니다. 그래서 켠 뒤 효과를 우리 값으로 단언하지 않고, 대신 직접 재는 명령을 STEP 6 에 넣었습니다.
공식 자료
- 저장소 — caveman 공식 GitHub · 스킬 MIT · 엔진 BSL-1.1
- caveman 공식 문서 사이트 — 설치와 첫 실행
- 만든 사람이 적은 한계 문서 HONEST-NUMBERS.md — 손해가 나는 경우와 재는 법
- 자체 시험 결과 WRAP-BENCHMARK.md — 33.2% 의 근거와 경계
- Claude Code 공식 비용·사용량 문서 — 무엇이 토큰으로 잡히는지의 기준