케이브맨(caveman) 소개 글에는 65%가 적혀 있습니다. 같은 도구를 켜 놓고 제 클로드 코드 요금을 재 보니 2%가 줄었어요.
아래 셋 중 하나라도 내 얘기인 분이라면 이 글이 쓸모 있습니다.
- ☐ 토큰 아끼는 도구를 설치했지만 요금·한도는 그대로인 것 같다
- ☐ 광고에 적힌 %를 보고 무엇을 깔지 정하려던 참이다
- ☐ 도구 없이 설정만 바꿔서 되는 게 있는지 궁금하다
절약 도구 글은 대개 도구마다 내건 %를 나란히 세웁니다. 그런데 그 %는 AI가 쓴 말, 새로 짠 코드, 명령 결과처럼 각자 다른 것의 양이지 요금의 %가 아니에요. 단위가 다른 숫자끼리는 줄을 세울 수가 없죠.
그래서 도구 네 개와 클로드 코드의 기본 설정 하나를 한 물음으로만 봤습니다. 이게 내 요금의 어느 항목을 건드리는가. 켤 것, 조건부로 켤 것, 뺄 것도 그걸로 나눴어요.
108번 돌린 결과 - 두 자릿수로 줄인 건 도구가 아니었습니다
재는 법은 짧게만 적습니다. 빈 설정 폴더에서 작은 파이썬 저장소 과제 여섯 개를 경우마다 세 번씩, 모두 108번 시켰어요. 모델은 소넷, 금액은 할인 없는 정가입니다(2026년 9월 22일, 총 21.45달러).
| 켠 것 | 광고 문구(도구가 줄인다는 양) | 내 요금 변화 | 18번 중 제대로 푼 횟수 |
|---|---|---|---|
| 아무것도 안 켬 | 없음 | 과제당 0.153달러 | 17 |
| 케이브맨 | AI가 쓴 말 −65% | −2% | 17 |
| 포니테일(ponytail) | 코드 −54% | +8% | 17 |
| 알티케이(rtk) | 명령 결과 60~90% | +26% | 18 |
| 헤드룸(headroom) | 코딩 작업 20% | −3% | 18 |
| 생각 단계 낮춤(effort) | 광고 없음 | −15% | 18 |
볼 곳은 맨 아랫줄입니다. 깔 것도 돈 들 것도 없는 설정만 두 자릿수를 찍었어요. 푼 횟수는 어느 줄이든 17~18번이라 품질 탓도 아닙니다.
요금은 어디서 나가나 - 다시 읽기가 부피, 값은 열에 하나
AI는 대화가 이어질 때마다 앞의 내용을 통째로 다시 읽습니다. 제 108번 기록에서 전체 토큰의 89~95%가 이 다시 읽기였어요. 저장해 둔 걸 꺼내 읽는 몫이라 값은 처음 받는 글의 열에 하나입니다.
AI가 직접 써낸 말과 코드는 요금으로 치면 10~16%뿐이었어요. 도구가 광고한 %는 이 작은 몫 안에서 잰 값이라, 요금 전체로 옮기면 한 자릿수로 쪼그라듭니다.
그래서 동사 하나씩만 붙여 둡니다. 케이브맨은 말을 깎고, 포니테일은 짤 코드를 덜어 내고, 알티케이는 명령 결과를 바꿔치기하고, 헤드룸은 읽을 것을 눌러 담습니다.
케이브맨 - 답이 길어 읽기 지칠 때만 켤 물건
AI가 쓰는 말만 원시인 말투로 줄이고 코드와 명령은 그대로 둡니다. 설명이 장황해 스크롤하다 지치는 분이라면 켜 둘 만해요. 젯브레인스(JetBrains)가 코딩 과제 86개로 따로 잰 결과도 답 품질 차이가 없었거든요.
요금 때문이라면 기대를 접는 게 맞습니다. AI가 쓴 말이 23% 줄었는데 요금은 2%였거든요. 한 달에 200달러를 쓰는 사람이라면 4달러예요.
포니테일 - 큰 기능을 자주 짓는 사람에게만 값을 합니다
앞의 케이브맨이 말을 깎는다면, 이쪽은 코드를 짜기 전에 멈춰 세웁니다. 정말 필요한지, 이미 있는 건 아닌지, 기본 도구로 되는지를 차례로 묻게 하거든요.
넷 중 돈을 분명히 아낀 기록이 있는 건 이것 하나입니다. 젯브레인스가 80개 과제로 맞대 본 결과 요금이 10.3% 줄었고, 설계가 커지기 쉬운 큰 작업에서는 코드가 31%까지 줄었어요.
작은 수정 위주라면 깎아 낼 코드가 없어요. 제 과제가 그랬고 요금은 8% 올랐습니다. 게다가 젯브레인스 기록상 깔아만 두면 스스로 발동한 횟수가 0회라, 대화 시작 때 규칙이 들어가게 걸어 둘 사람에게만 권해요.
알티케이 - 이번 목록에서 뺍니다
명령창 결과를 짧게 바꿔 AI에게 넘기는 도구인데, 제 기록으로는 요금이 26% 뛰었습니다. AI가 쓴 말은 41% 늘었고, 주고받은 횟수도 가운데 값이 여덟 번에서 열두 번이 됐어요. 젯브레인스도 생각을 적게 하는 설정에서 7.6% 더 비싸게 나왔고요.
젯브레인스 실험에선 도구 화면에 9,600만 토큰 절약이 찍혔는데 요금은 올라 있었습니다. 도구가 스스로 세는 절약량은 추정이지 요금이 아니거든요.
헤드룸 - 긴 대화를 이어 가는 작업이면 손해 볼 수 있습니다
헤드룸은 AI가 읽을 것을 중간에서 받아 눌러 담아 넘깁니다. 제 실측에서 읽히는 토큰이 32만 8천에서 21만으로 36% 줄었는데, 요금은 3% 줄었어요. 없앤 몫이 원래 10분의 1 값짜리라 돈으로는 2.4센트였습니다.
거꾸로 요금이 오른 사례도 있습니다. 개발자 브랜든 바커가 공개한 실측에서는 읽는 토큰이 39% 줄었는데 스물두 과제 가운데 열세 개에서 요금이 더 나왔어요. 대화를 고쳐 쓰다 저장해 둔 앞부분이 123번 깨져 600만 토큰이 제값으로 넘어갔거든요. 헤드룸 계량기는 15.41달러를 아꼈다고 표시했는데 실제 요금은 8.98달러 늘었습니다.
저장본을 잘 쓰는 긴 대화라면 뺍니다. 짧게 끝나는 작업은 제가 따로 재지 않았어요.
도구 대신 설정 - 생각 단계를 낮추면 요금이 바로 줄었습니다
답을 내기 전 AI가 얼마나 궁리할지 정하는 생각 단계 설정(effort)이 클로드 코드에 처음부터 있습니다. 기본값은 다섯 단계의 한가운데인 '높음'이에요. 궁리하는 혼잣말에도 AI가 쓴 말과 같은 값이 붙으니, 이걸 낮추면 요금이 곧장 움직입니다.
맨 아래 단계로 내리자 요금이 15%, AI가 쓴 말이 32% 줄었고 18번 모두 제대로 풀었습니다. /effort에서 맨 아래를 골라 엔터로 저장하면 이후 대화에도 적용돼요.
조건은 둘입니다. 설정을 바꾸면 그 대화의 저장본이 한 차례 무너지니 새 대화를 열 때 미리 정해 두세요. 그리고 제 과제가 작은 일이라, 어려운 설계 문제에서도 품질이 버티는지는 이 실측으로 알 수 없어요.
/compact는 줄이려고 대화를 처음부터 다 읽는 큰 요청이에요. 새로 시작할 거면 비우는 /clear가 공짜입니다.내 요금에 대 보기 - 제 사흘치는 다시 읽기가 69%였습니다
위 숫자는 제 과제의 결과라, 켤지 말지는 내 요금 내역으로 정해야 해요. 제가 만든 토큰 계량기에 제 사흘치 기록(2026년 9월 20~22일)을 넣었더니 다시 읽기가 토큰의 98%, 금액의 69%를 차지했습니다. AI가 써낸 말은 토큰 비중이 0%인데 금액은 11%였고요.
제 방식이면 말을 깎는 도구가 손댈 수 있는 건 그 11%가 전부예요. 구독 요금제라면 금액은 신경 쓰지 말고, 한도가 어느 항목으로 새는지 비율만 보세요.
정리 - 켜는 것 하나, 조건부 둘, 빼는 것 둘
- 켠다. 생각 단계 낮춤. 어려운 설계를 붙잡은 대화만 단계를 올려 두세요.
- 조건부. 포니테일은 큰 기능을 자주 짓고 규칙 주입까지 걸어 둔 경우에만, 작은 수정 위주면 뺍니다. 케이브맨은 답이 길어 읽기 힘들 때만, 요금이 목적이면 뺍니다.
- 뺀다. 알티케이(내 요금 +26%), 그리고 긴 대화 위주 작업의 헤드룸(−3%, 요금이 오른 사례 있음).
도구끼리 섞은 조합은 재지 않았어요. 하나씩 켜고 전후를 맞대 보는 쪽이 안전합니다.
처음의 65%와 2%는 둘 다 맞는 숫자입니다. 65%는 AI가 쓴 말이라는 작은 몫 안에서, 2%는 요금 전체에서 잰 값이에요. 도구를 볼 때 물을 건 몇 %냐가 아니라 그 %가 내 요금의 어느 항목에서 나왔느냐입니다.
108번 돌린 과정은 영상에 담았고, 내 기록으로 같은 계산을 하는 토큰 계량기는 오픈톡 '방구석모각코'에서 받을 수 있어요. 도구를 깔기 전에 한 번 돌려 보면 어느 항목부터 손댈지 보입니다.


