Fable Week · Full-Day Audit · 2026-07-03

클로드 계정 8개,
Fable로 작업한 하루치 작업량

이날 하루, 한 사람이 개발자 수십 명 몫의 일을 뽑아냈다. 클로드(Claude)에서 가장 높은 등급의 AI 모델 'Fable'을 일주일 내내 몰아 쓴 'Fable Week' 시리즈의 한가운데 하루, 2026-07-03(KST)을 하나도 빠짐없이 되짚어 세어 봤다. 이날은 1일차 기록이 올라가고 D365 60단계가 완주된 날이다. 'D365'는 대기업이 쓰는 회계·업무 관리 시스템이고, 1년 걸릴 작업을 60단계로 쪼갠 계획을 이날 다 끝냈다. 이 하루는 클로드 계정 8개를 한 창구로 묶어 동시에 돌려 만든 결과다. 근거로 삼은 기록은 딱 두 가지 — 코드를 고칠 때마다 남긴 저장 흔적(커밋)과, AI가 읽고 쓴 글자량을 적어 둔 사용량 장부다. 이 둘만으로 하루를 되짚었다 — 코드 저장소 8곳 · 261커밋(00:05~23:58), 토큰 2.57B, API 정가 환산 $3,700, 세션 996개. 그래서 '이게 대체 몇 명 몫이냐'를 서로 다른 잣대 세 가지로 따로 계산했다. 각 잣대가 어떤 가정을 깔았고 어디까지 믿을 수 있는지도 그대로 적었다.

← Fable Week 2일차 · 1년 걸릴 60단계 계획을 한 번에 완주
261
Commits · 8 Repos
2.57B
토큰 총량(캐시 포함)
$3,700
API 정가로 환산한 비용
18~65
개발자 하루치로 환산 (§3)
무엇을 했나 — 코드 저장소 8곳, 저장 흔적(커밋) 기준

아래는 이날 코드가 바뀐 저장소를 하나도 빼지 않고 모은 것이다(내 컴퓨터의 모든 프로젝트를 훑었다). 각 설명은 저장 흔적에 붙은 제목을 그대로 옮겼고, 바뀐 줄 수는 git log --numstat 명령(코드에서 몇 줄이 더해지고 지워졌는지 세어 주는 도구)으로 합산했다. 첫 저장은 00:05, 마지막은 23:58이었다 — 한 사람이 키보드를 친 게 아니라 계정 8개 위에서 여러 작업이 하루 종일 동시에 돌아간 흔적이다.

00:00 06:00 12:00 18:00 24:00 cc-sync 36 claude-code-site 103 memory-bank-cloud 18 BIS-Docs 13 sophia 21 trader-hugh 38 memory-bank 16 teamclaude 16
저장소별 활동 구간(처음~마지막 저장, 한국시간) — 막대 안 숫자는 저장 횟수. 8줄이 자정부터 자정까지 겹쳐 돌아간다 — 한 사람이 순서대로 보낸 하루가 아니라, 여러 작업이 동시에 돈 하루다
claude-code-site 103 commits · +12,440/−3,058 · 00:12~23:58
대기업 업무 시스템(D365) 60단계 계획 완주(62커밋) — 분기별 점검 4개를 모두 통과하고, 진행 현황판과 연간 보고서를 냈다. 여러 페이지가 공유하는 뼈대 코드를 옮겨 심는 도구와 다음 버전(v2) 계획까지 확정했다. 그 위에 Fable Week 1·2일차 글 발행. 링크 미리보기 이미지(OG 이미지)를 검사하는 장치가 통과·차단을 오락가락하던 문제도 '한 번 쓴 이미지는 다시 쓰지 않는다'는 규칙으로 끝냈다.
trader-hugh 38 commits · +14,298/−402 · 05:16~22:08
분 단위 주가 반응 분석 + 생존편향(살아남은 종목만 봐서 생기는 착시) 수치화, 오를 신호를 걸러내는 탐지기, 망가진 시세 데이터 방어(무한대·오류값 배제, 잘못된 평가손익 차단)까지 했다. 다른 AI가 일부러 트집 잡는 검사(적대 리뷰)에서 나온 '심각' 등급 지적들을 회차마다 고쳐 없앴다.
cc-sync 36 commits · +91,025/−85,977 · 00:05~23:27
매 대화 시작 때 AI가 읽어 들이는 설정을 67KB 줄임(긴 규칙 파일 10개를 짧게 압축). AI 작업을 감시·통제하는 장치 묶음(하네스)을 한 번에 손보는 도구를 새로 만들고, 측정값이 실행 위치에 따라 흔들리지 않게 고정했으며, 자동 작업 루프가 실패하면 빨리 멈추도록 강화했다. 앞·뒤에서 도는 작업의 완료 보고 규칙도 세웠다. 여기 줄 수에는 규칙·지식 파일을 자리만 옮긴 양이 섞여 있어, 실제 새로 쓴 양보다 크다(§4 한계).
sophia 21 commits · +3,707/−487 · 04:33~19:41
말할 때 입자로 된 얼굴이 움직이고 입모양이 소리에 맞게 바뀌도록 만들었다. 지난 데이터를 다시 처리하지 않게 막는 기준선, 실행 명령에 몰래 값이 끼어드는 보안 구멍 차단도 넣었다. 다른 AI의 '심각' 지적들을 잇달아 고쳤다. 얼굴이 사람과 어설프게 닮아 섬뜩해지는 '불쾌한 골짜기'를 피하려 이목구비를 덜어내는 등 세밀한 연출도 손봤다.
memory-bank-cloud 18 commits · +2,828/−1,012 · 00:45~23:31
다른 AI 모델과 13번 주고받으며 약점을 메운 강화 작업 — 입력값을 검사만 하지 않고 아예 안전한 형태로 다시 조립했고, 어떤 입력이 와도 처리되는 검증기를 넣었다. 기록 이력을 실제 원인과 묶고, 프로그램 언어 엔진에 남는 찌꺼기 메모리도 막았다. 자동 테스트 163개가 전부 통과했다.
teamclaude 16 commits · +1,224/−155 · 11:27~19:16
계정별 사용 한도를 껐다 켜도 기억하게 + 계정 자동 정렬 — 준비 단계가 안정적으로 끝나도록 잠금장치를 넣고, 덜 측정된 값은 다시 확인하게 했다. 터미널 화면의 커서 떨림도 잡았다. 버전 1.1.0으로 배포했다.
memory-bank 16 commits · +3,646/−475 · 08:53~23:26
버전 1.2.0 배포 — 전체 대화 기록을 분석하는 기능과, 대화를 압축해 보관하는 처리 흐름을 넣었다. 압축을 풀 때 크기·경로를 제한하는 보안 구멍도 메웠고, 배포처(플러그인 장터)에 적힌 버전 번호까지 서로 맞췄다.
BIS-Docs 13 commits · +2,202/−23 · 01:16~18:18
기획안을 일 시작 전에 미리 검토하는 검문 기능 신설. 투자 검토 기능이 '이미지를 글자로 읽는 처리(OCR)를 반드시 거친다'고 본 잘못된 전제를 바로잡았고, 하루치 통합 테스트 결과물 52개 파일도 냈다.
합계 — 261커밋 · 코드 +131,370줄 / −91,589줄 · 세션 996개(사람과 대화한 것 + 사람 없이 자동으로 돈 것 포함) · 클로드 계정 8개 동시 가동 · 활동 시간 00:05~23:58(한국시간)
토큰과 비용 — 사용량 장부 그대로

먼저 토큰부터. 토큰은 AI가 글을 읽고 쓸 때 세는 최소 단위다(대략 단어 조각 하나). 그 사용량 장부는 ccusage라는 집계 도구(세션 기록 파일을 그대로 더해 줌)에서 뽑았다. 이날 하루 모두 2,573,320,071 토큰을 썼다 — 그런데 이 중 94.3%는 '캐시 읽기'(2.43B)다. 캐시 읽기란 앞서 읽은 내용을 그대로 다시 불러오는 것이라, 새로 계산하는 것보다 훨씬 싸고 빠르다. 표시된 비용은 API 정가로 환산한 값일 뿐, 실제로는 매달 정해진 금액만 내는 구독제로 썼다(§4 한계). 서로 다른 AI 모델 6종이 함께 일했고, 비용의 91.6%가 가장 센 두 모델(Fable 5 + Opus 4.8)에서 나왔다.

모델출력 토큰API 환산 비용비중역할
claude-fable-52,584,627$2,246.1160.7%주 작업 · 판단과 작업 지휘
claude-opus-4-81,948,701$1,143.4530.9%동시 작업 · 코드 구현과 보조 AI
gpt-5.5(외부 검증용 AI)695,822$213.635.8%트집 검사 · 독립 확인
claude-sonnet-5174,705$74.662.0%전문 작업 위임
claude-opus-4-518,880$16.110.4%보조
claude-haiku-4-545,085$6.060.2%가벼운 잡일
모델별 API 환산 비용 (2026-07-03 · 합계 $3,700) $2,246 claude-fable-5 · 60.7% $1,143 claude-opus-4-8 · 30.9% gpt-5.5 $214 · 5.8% sonnet-5 + opus-4.5 + haiku $97 · 2.6% 토큰 구성 — 합계 2.57B cache read 2.43B · 94.3% cache read 94.3% cache write 4.9% input 0.55% output 0.21%
막대 길이는 비용에 비례한다. 다른 회사 AI(gpt-5.5)는 트집 검사와 독립 확인 전용으로 전체의 5.8%다
입력 14,259,589 · 출력 5,467,820 · 캐시 저장 127,339,946 · 캐시 읽기 2,426,252,716 = 합계 2,573,320,071 토큰
몇 명 몫인가 — 잣대 3개로 재고, 가정도 공개

'몇 명 몫이냐'에는 딱 떨어지는 정답이 없다. 그래서 서로 겹치지 않는 잣대 3가지로 따로 계산했다. 자정부터 자정까지(00:05~23:58) 쉬지 않고 돌 수 있었던 건 계정 8개를 동시에 굴린 덕이다. 각 잣대가 무엇을 가정했는지도 그대로 밝힌다. 잣대에 따라 결과는 '개발자 18~65명의 하루치'로 갈린다 — 가장 박하게 잡아도 약 18명의 하루치, 다시 말해 한 사람이라면 근무일 3~4주치가 하루에 처리된 셈이다.

클로드 계정 묶음 — 등록 9 · 가동 8 대기 1 teamclaude 중계기 사용 한도 분배 · 세션 고정 · 토큰 자동 갱신 Claude Code 세션 996개 사람과 대화 + 무인 자동 실행(단계 실행기·자가개선·보조 AI) fable-5 opus-4.8 sonnet-5 haiku-4.5 검증 검문 단계 60/60 통과 · 실패 시 차단 트집검사 검문 올릴 때마다 가로챔 · 해결될 때까지 차단 gpt-5.5 외부 AI 트집검사 131회 · 독립 확인 8 repos · 261 commits +131,370 / −91,589 lines · 00:05~23:58
하루가 돌아간 구조 — 계정 묶음(등록 9 · 가동 8, 점선 1개는 안 씀) → 중계기 → 세션 996개 → 두 겹 검문 → 261커밋. 점선 화살표는 외부 AI가 검사하는 경로다
잣대추정계산한계
활동 시간(가장 박하게) ≈ 17.7명의 하루치 저장소별 처음~마지막 저장 사이 시간을 모두 더한 141.3시간 ÷ 하루 8시간 그 시간 내내 쉬지 않고 일했다고 본 건 아니다 — 노는 구간이 섞여 부풀 수도(과대), 동시에 여러 개가 돈 건 안 세어 줄 수도(과소) 있다
저장 횟수(커밋) ≈ 65명의 하루치 261커밋 ÷ 하루 4커밋(일하는 개발자의 하루 평균으로 가정) AI의 한 커밋은 사람 것보다 대체로 잘고 잦다
계획 단계(D365만) ≈ 60 작업일 1년짜리 계획으로 짠 60단계를 16시간 13분 만에 다 끝냄 '계획상 60단계'일 뿐 사람 60일과 똑같다는 뜻은 아니다 · 나머지 저장소 7곳은 뺐다
0 10 20 30 40 50 60 70 단위: 명(하루치 작업량) 활동시간 ≈17.7명 141.3시간 ÷ 8시간 · 가장 박한 값 계획단계 60명 (D365) 저장횟수 ≈65명 261 ÷ 하루 4
같은 하루를 세 잣대로 잰 위치 — 음영 띠가 추정 범위(17.7~65명)다. 가정과 한계는 위 표를 보라
"가장 박하게 잡아도, 하루가 한 사람의 3~4주치였다."
비용으로도 맞대어 보자 — API 정가로 환산한 $3,700은 숙련 개발자 하루 일당(하루 $800~1,200으로 가정) 3~4.6명분이다. 나온 결과(개발자 18~65명의 하루치)가 가장 박한 값만 맞더라도, 들인 돈 대비 나온 일은 4~5배 이상이라는 계산이 나온다. 게다가 실제로는 정액 구독이라, 한 번 더 쓸 때 드는 실제 비용은 이보다 훨씬 낮다.
숫자가 말해 주지 못하는 것 — 측정의 한계

이 페이지의 모든 수치는 언제든 다시 뽑아 볼 수 있다. 다만 아래 한계를 염두에 두고 읽어야 한다 — 좋아 보이려 감추지 않고 약점을 그대로 드러낸다.

L1
비용은 'API로 샀다면' 붙는 가격이다
집계 도구가 사용량 장부를 API 정가표로 환산한 값이다 — 실제로는 매달 정액 구독(Claude Max + Codex)으로 냈다. $3,700은 '같은 일을 API로 샀다면' 붙는 금액이다
L2
줄 수에는 옮긴 것·자동 생성물이 섞여 있다
cc-sync의 +91k/−86k줄은 대부분 규칙·지식 파일을 자리만 옮긴 것이다. 순수하게 새로 쓴 줄은 이보다 훨씬 적다 — 그래서 '코드 줄 수'를 성과 지표로 쓰지 않았다
L3
세션 996개에는 무인 자동 실행이 섞여 있다
단계 실행기·자가개선·보조 AI처럼 사람과 대화하지 않는 세션도 포함된다 — '사람이 996번 대화한' 게 아니라 'AI 통제 장치가 996개 작업 흐름을 돌린' 것이다
L4
'몇 명 몫' 환산은 어디까지나 추정이다
잣대 3개 모두 분명한 가정을 깔고 있다. 하나의 숫자로 못 박지 말고 범위(개발자 18~65명의 하루치)로 읽되, 굳이 한 값을 인용하려면 가장 낮은 값(약 18명)을 권한다
L5
품질은 이 페이지가 다루지 않는다
많이 했다고 잘한 건 아니다. 품질을 뒷받침하는 증거(검증 검문 통과·트집 검사 해소·독립 재확인)는 1·2일차 글에서 다룬다
L6
계정 수는 실제 가동 기준이다
중계기 명단에는 9개가 올라 있지만, 이날 실제로 돈 건 8개다(운영자 확인). 계정별로 토큰을 쪼갠 값은 장부에 없어 계산하지 않았다