이날 하루, 한 사람이 개발자 수십 명 몫의 일을 뽑아냈다. 문제는 그 '수십 명 몫'을 감으로 말하지 않고 숫자로 증명할 수 있느냐였다. 그래서 클로드(Claude)에서 가장 높은 등급의 AI 모델 'Fable'을 일주일 내내 몰아 쓴 'Fable Week' 시리즈의 한가운데 하루, 2026-07-03(KST)을 한국 표준시 기준으로 하나도 빠짐없이 되짚어 세어 봤다. 이날은 1일차 기록이 올라간 날이고, 1년치 작업 계획 D36560단계 완주를 이룬 날이기도 하다. 이 계획은 1년 동안 할 일을 60단계로 쪼갠 것이고, 이날 그 60단계를 다 끝냈다. 이 하루는 클로드 계정 8개를 중계기(proxy, 요청을 대신 받아 계정 여러 개로 나눠 보내는 프로그램) 하나로 묶어 동시에 돌려 만든 결과다. 근거로 삼은 기록은 딱 두 가지다. 하나는 코드를 고칠 때마다 남는 저장 기록인 커밋(commit)이고, 다른 하나는 AI가 읽고 쓴 글자량을 적어 둔 사용량 장부다. 이 둘만으로 하루를 되짚었다. 결과는 코드 저장소 8곳 · 261커밋(00:05~23:58), 토큰 2.57B, API 정가 환산 $3,700, 세션 996개다. 토큰(token)은 AI가 글을 읽고 쓸 때 세는 최소 단위이고, 2.57B는 약 25억 7천만 개라는 뜻이다. 세션(session)은 AI를 한 번 켜서 끝낼 때까지 이어진 작업 묶음 하나다. 그래서 '이게 대체 몇 명 몫이냐'를 서로 다른 잣대 세 가지로 따로 계산했다. 각 잣대가 어떤 가정을 깔았고 어디까지 믿을 수 있는지도 그대로 적었다.
아래는 이날 코드가 바뀐 저장소를 하나도 빼지 않고 모은 것이다. 내 컴퓨터의 모든 프로젝트를 훑었다. 각 설명은 커밋에 붙은 제목을 그대로 옮겼고, 바뀐 줄 수는 git log --numstat 명령으로 합산했다. 이 명령은 코드 이력 관리 도구인 git이 커밋마다 몇 줄이 더해지고 지워졌는지 세어 주는 기능이다. 첫 커밋은 00:05, 마지막은 23:58이었다. 한 사람이 키보드를 쳐서는 나올 수 없는 시간표다. 계정 8개 위에서 여러 작업이 하루 종일 동시에 돌아간 흔적이다.
저장소별 활동 구간(처음~마지막 커밋, 한국시간). 막대 안 숫자는 커밋 횟수다. 8줄이 자정부터 자정까지 겹쳐 돌아간다. 여러 작업이 동시에 돈 하루였다는 뜻이다
1년치 작업 계획 60단계 완주(62커밋). 앞에서 말한 그 1년 계획이다. 이 저장소는 지금 읽고 있는 이 웹사이트의 코드다. 분기별 점검 4개를 모두 통과하고, 진행 현황판과 연간 보고서를 냈다. 여러 페이지가 공유하는 뼈대 코드를 옮겨 심는 도구와 다음 버전(v2) 계획까지 확정했다. 그 위에 Fable Week 1·2일차 글 발행 · OG 이미지 검사 장치 수리. 링크를 SNS에 붙이면 뜨는 미리보기 이미지를 오픈 그래프(Open Graph) 이미지라 하는데, 이것을 검사하는 장치가 통과·차단을 오락가락하던 문제를 '한 번 쓴 이미지는 다시 쓰지 않는다'는 규칙으로 끝냈다.
분 단위 주가 반응 분석 + 생존편향(살아남은 종목만 봐서 생기는 착시) 수치화. 이 저장소는 주식·암호화폐 시세를 훑어 매매 신호를 보내는 서비스다. 여기에 오를 신호를 걸러내는 탐지기와, 망가진 시세 데이터 방어(무한대·오류값 배제, 잘못된 평가손익 차단)까지 넣었다. 적대 리뷰(adversarial review, 다른 AI가 일부러 트집을 잡아 결함을 찾는 검사)에서 나온 '심각' 등급 지적들을 회차마다 고쳐 없앴다.
cc-sync36 commits · +91,025/−85,977 · 00:05~23:27
매 대화 시작 때 AI가 읽어 들이는 설정을 67KB 줄임(긴 규칙 파일 10개를 짧게 압축). 이 저장소는 내 Claude Code 설정을 여러 컴퓨터에 똑같이 맞추는 동기화 도구다. 하네스(harness, AI 작업을 감시·통제하는 장치 묶음)를 한 번에 손보는 도구를 새로 만들고, 측정값이 실행 위치에 따라 흔들리지 않게 고정했으며, 자동 작업 루프가 실패하면 빨리 멈추도록 강화했다. 앞·뒤에서 도는 작업의 완료 보고 규칙도 세웠다. 여기 줄 수에는 규칙·지식 파일을 자리만 옮긴 양이 섞여 있어, 실제 새로 쓴 양보다 크다(§4 한계).
sophia21 commits · +3,707/−487 · 04:33~19:41
말할 때 입자로 된 얼굴이 움직이고 입모양이 소리에 맞게 바뀌도록 만들었다. 이 저장소는 AI 비서가 일하는 모습을 화면 속 입자(작은 점) 생명체로 그려 보여 주는 시각화 프로젝트다. 지난 데이터를 다시 처리하지 않게 막는 기준선, 실행 명령에 몰래 값이 끼어드는 보안 구멍(명령 주입, command injection) 차단도 넣었다. 다른 AI의 '심각' 지적들을 잇달아 고쳤다. 얼굴이 사람과 어설프게 닮아 섬뜩해지는 '불쾌한 골짜기'를 피하려 이목구비를 덜어내는 등 세밀한 연출도 손봤다.
다른 AI 모델과 13번 주고받으며 약점을 메운 강화 작업. 이 저장소는 AI와 나눈 대화 기억을 서버에 모아 두는 메모리 뱅크(memory bank)의 클라우드 판이다. 입력값을 검사만 하지 않고 아예 안전한 형태로 다시 조립했고, 어떤 입력이 와도 처리되는 검증기를 넣었다. 기록 이력을 실제 원인과 묶고, 프로그램 언어 엔진에 남는 찌꺼기 메모리(메모리 누수)도 막았다. 자동 테스트 163개가 전부 통과했다.
teamclaude16 commits · +1,224/−155 · 11:27~19:16
계정별 사용 한도를 껐다 켜도 기억하게 + 계정 자동 정렬. 이 저장소가 바로 이 글의 중계기(proxy)다. 클로드 계정 여러 개를 창구 하나로 묶어 요청을 나눠 보낸다. 준비 단계가 안정적으로 끝나도록 잠금장치를 넣고, 덜 측정된 값은 다시 확인하게 했다. 터미널 화면의 커서 떨림도 잡았다. 버전 1.1.0으로 배포했다.
memory-bank16 commits · +3,646/−475 · 08:53~23:26
버전 1.2.0 배포. 이 저장소는 메모리 뱅크(memory bank)라는 도구로, 지난 대화를 저장해 두었다가 다음 작업에서 꺼내 쓰게 해 주는 기억 저장소다. 이번 버전에 전체 대화 기록을 분석하는 기능과, 대화를 압축해 보관하는 처리 흐름을 넣었다. 압축을 풀 때 크기·경로를 제한하는 보안 구멍도 메웠고, 배포처(플러그인 장터)에 적힌 버전 번호까지 서로 맞췄다.
BIS-Docs13 commits · +2,202/−23 · 01:16~18:18
기획안을 일 시작 전에 미리 검토하는 검문 기능 신설 · OCR 전제 정정. 이 저장소는 회사 업무 시스템 프로젝트의 기획서와 참조 자료를 모아 둔 문서 저장소다. 투자 검토 기능이 이미지 속 글자를 읽어 내는 광학 문자 인식(Optical Character Recognition)을 반드시 거친다고 본 잘못된 전제를 바로잡았다. 하루치 통합 테스트 결과물 52개 파일도 냈다.
합계: 261커밋 · 코드 +131,370줄 / −91,589줄 · 세션 996개(사람과 대화한 것 + 사람 없이 자동으로 돈 것 포함) · 클로드 계정 8개 동시 가동 · 활동 시간 00:05~23:58(한국시간)
§2 · Tokens & Cost
토큰과 비용 — 사용량 장부 그대로
먼저 토큰부터 짚는다. 토큰(token)은 AI가 글을 읽고 쓸 때 세는 최소 단위로, 대략 단어 조각 하나다. 그 사용량 장부는 ccusage라는 집계 도구에서 뽑았다. Claude Code가 남기는 세션 기록 파일을 그대로 더해 주는 도구다. 이날 하루 모두 2,573,320,071 토큰을 썼다. 그런데 이 중 94.3%는 '캐시 읽기'(cache read, 2.43B)다. 캐시 읽기란 앞서 읽은 내용을 그대로 다시 불러오는 것이라, 새로 계산하는 것보다 훨씬 싸고 빠르다. 표시된 비용은 API 정가로 환산한 값일 뿐이다. 실제로는 매달 정해진 금액만 내는 구독제로 썼다(§4 한계). 서로 다른 AI 모델 6종이 함께 일했고, 비용의 91.6%가 가장 센 두 모델(Fable 5 + Opus 4.8)에서 나왔다.
모델
출력 토큰
API 환산 비용
비중
역할
claude-fable-5
2,584,627
$2,246.11
60.7%
주 작업 · 판단과 작업 지휘
claude-opus-4-8
1,948,701
$1,143.45
30.9%
동시 작업 · 코드 구현과 보조 AI
gpt-5.5(외부 검증용 AI)
695,822
$213.63
5.8%
적대 리뷰 · 독립 확인
claude-sonnet-5
174,705
$74.66
2.0%
전문 작업 위임
claude-opus-4-5
18,880
$16.11
0.4%
보조
claude-haiku-4-5
45,085
$6.06
0.2%
가벼운 잡일
막대 길이는 비용에 비례한다. 다른 회사의 AI(gpt-5.5)는 적대 리뷰와 독립 확인 전용으로만 썼고, 전체 비용의 5.8%다
입력 14,259,589 · 출력 5,467,820 · 캐시 저장 127,339,946 · 캐시 읽기 2,426,252,716 = 합계 2,573,320,071 토큰
§3 · Person-Day Estimate
몇 명 몫인가 — 잣대 3개로 재고, 가정도 공개
'몇 명 몫이냐'에는 딱 떨어지는 정답이 없다. 그래서 서로 겹치지 않는 잣대 3가지로 따로 계산했다. 자정부터 자정까지(00:05~23:58) 쉬지 않고 돌 수 있었던 건 계정 8개를 동시에 굴린 덕이다. 각 잣대가 무엇을 가정했는지도 그대로 밝힌다. 잣대에 따라 결과는 '개발자 18~65명의 하루치'로 갈린다. 가장 박하게 잡아도 약 18명의 하루치, 다시 말해 한 사람이라면 근무일 3~4주치가 하루에 처리된 셈이다.
하루가 돌아간 구조다. 계정 묶음(등록 9 · 가동 8, 점선 1개는 안 씀) → 중계기(teamclaude) → 세션 996개 → 두 겹 검문 → 261커밋. 점선 화살표는 외부 AI(gpt-5.5)가 검사하는 경로다
잣대
추정
계산
한계
활동 시간(가장 박하게)
≈ 17.7명의 하루치
저장소별 처음~마지막 저장 사이 시간을 모두 더한 141.3시간 ÷ 하루 8시간
그 시간 내내 쉬지 않고 일했다고 본 건 아니다. 노는 구간이 섞여 부풀 수도(과대), 동시에 여러 개가 돈 건 안 세어 줄 수도(과소) 있다
저장 횟수(커밋)
≈ 65명의 하루치
261커밋 ÷ 하루 4커밋(일하는 개발자의 하루 평균으로 가정)
AI의 한 커밋은 사람 것보다 대체로 잘고 잦다
계획 단계(1년 계획만)
≈ 60 작업일
1년짜리 계획으로 짠 60단계를 16시간 13분 만에 다 끝냄
'계획상 60단계'일 뿐 사람 60일과 똑같다는 뜻은 아니다 · 나머지 저장소 7곳은 뺐다
같은 하루를 세 잣대로 잰 위치다. 음영 띠가 추정 범위(17.7~65명)이고, 가정과 한계는 위 표에 있다
"가장 박하게 잡아도, 하루가 한 사람의 3~4주치였다."
비용으로도 맞대어 보자. API 정가로 환산한 $3,700은 숙련 개발자 하루 일당(하루 $800~1,200으로 가정) 3~4.6명분이다. 나온 결과(개발자 18~65명의 하루치)가 가장 박한 값만 맞더라도, 들인 돈 대비 나온 일은 4~5배 이상이라는 계산이 나온다. 게다가 실제로는 정액 구독이라, 한 번 더 쓸 때 드는 실제 비용은 이보다 훨씬 낮다.
§4 · Honest Limits
숫자가 말해 주지 못하는 것 — 측정의 한계
이 페이지의 모든 수치는 언제든 다시 뽑아 볼 수 있다. 다만 아래 한계를 염두에 두고 읽어야 한다. 좋아 보이려 감추지 않고 약점을 그대로 드러낸다. 항목 앞의 L 은 한계(Limit)라는 뜻이고, 여섯 개에 번호를 붙였다.
L1
비용은 'API로 샀다면' 붙는 가격이다
집계 도구가 사용량 장부를 API 정가표로 환산한 값이다. 실제로는 매달 정액 구독(Claude Max + Codex)으로 냈다. Claude Max는 클로드의 월정액 요금제이고, Codex는 gpt-5.5를 돌린 코딩 도구다. $3,700은 '같은 일을 API로 샀다면' 붙는 금액이다
L2
줄 수에는 옮긴 것·자동 생성물이 섞여 있다
cc-sync의 +91k/−86k줄은 대부분 규칙·지식 파일을 자리만 옮긴 것이다. 순수하게 새로 쓴 줄은 이보다 훨씬 적다. 그래서 '코드 줄 수'를 성과 지표로 쓰지 않았다
L3
세션 996개에는 무인 자동 실행이 섞여 있다
단계 실행기·자가개선·보조 AI처럼 사람과 대화하지 않는 세션도 포함된다. '사람이 996번 대화한' 게 아니라 'AI 통제 장치가 996개 작업 흐름을 돌린' 것이다
L4
'몇 명 몫' 환산은 어디까지나 추정이다
잣대 3개 모두 분명한 가정을 깔고 있다. 하나의 숫자로 못 박지 말고 범위(개발자 18~65명의 하루치)로 읽되, 굳이 한 값을 인용하려면 가장 낮은 값(약 18명)을 권한다
L5
품질은 이 페이지가 다루지 않는다
많이 했다고 잘한 건 아니다. 품질을 뒷받침하는 증거(검증 검문 통과·적대 리뷰 해소·독립 재확인)는 1·2일차 글에서 다룬다
L6
계정 수는 실제 가동 기준이다
중계기(teamclaude) 명단에는 9개가 올라 있지만, 이날 실제로 돈 건 8개다(운영자 확인). 계정별로 토큰을 쪼갠 값은 장부에 없어 계산하지 않았다