티스토리 뷰
목차
앤트로픽, 클로드로 클로드를 고쳤다는데 내 자동화도 대입해봤다(AI 개발 속도)
회사가 뭘 했다는 뉴스와, 내 자동화가 매일 하는 일
요 며칠 사이 앤트로픽 관련 기사 두 개가 소재 레이더에 나란히 걸렸다.
하나는 클로드 소넷 5.5를 공개했다는 소식이었고, 다른 하나는 앤트로픽이 자기 모델을 투입해 자기 서비스 속도를 2주 만에 끌어올렸다는 소식이었다.

소넷 5.5는 속도가 30% 이상 빨라지고 동일 작업 비용은 최대 30%까지 줄었는데, 가격표(입력 100만 토큰당 2달러·출력 100만 토큰당 10달러)는 그대로라고 보도됐다.
터미널 코딩 테스트(터미널벤치4.0) 점수는 70.6%로, 소넷 5(10.3%)나 오퍼스 5.5(66.4%)보다 높게 나왔다고 전해졌다.
출처: AI타임스(https://www.aitimes.com/news/articleView.html?idxno=215734)
다른 기사는 더 흥미로웠다.
앤트로픽이 자기 모델을 자율형 최적화 에이전트로 투입해서, claude.ai 웹·데스크톱의 체감 속도를 2주 만에 3배 개선했다고 전해졌다.
claude.ai 웹의 첫 로딩 시간이 3.1초에서 0.55초로 줄었고, 3,000건이 넘는 코드 변경을 적용하면서 장애나 롤백은 한 건도 없었다고 보도됐다.
출처: AI타임스(https://www.aitimes.com/news/articleView.html?idxno=215678)
그 과정에서 사람 엔지니어가 한 일은 목표를 정하고, 무엇을 포기할지 판단하고, 마지막에 승인 도장을 찍는 것뿐이었다고 한다.
기사를 읽다가 이거 어디서 많이 본 구조인데 싶었다.
언론사들은 이 소식을 전부 "앤트로픽이 뭘 했다"로만 전했다.
그런데 나는 그 구조를 매일 쓰고 있다.
오늘 이 글도 그 구조로 만들어진다
이 블로그도 사람이 전부 타이핑하는 곳이 아니다.
claude -p, 그러니까 클로드 코드가 반복 작업을 돌리고, 나는 승인 게이트에서만 개입한다.
오늘 이 글 한 편만 놓고 세어봐도 그렇다.
①소재를 고르고 검수·발행까지 총괄하는 오케스트레이터 세션, ②지금 이 글을 쓰고 있는 작성 세션, ③다 쓴 원고를 다시 검사하는 독립 검수 세션 — 최소 세 번이다.
이미지를 눈으로 한 번 더 확인하는 날은 네 번째 세션까지 붙는다.
| 세션 | 하는 일 | 등급 |
|---|---|---|
| ①오케스트레이터 | 소재 선정·검수 총괄·발행 판단 | 판단(소네트·오퍼스) |
| ②작성 세션(이 글) | 원고 작성 | 판단(소네트·오퍼스) |
| ③독립 검수 세션 | 사실 확인·게이트 판정 | 판단(소네트·오퍼스) |
| ④이미지 눈판정 (있는 날) |
이미지 적합성 확인 | 판단 |
네 자리 전부 하이쿠는 없다.
CLAUDE.md에 적힌 이 파이프라인의 운영 방침을 우리말로 옮기면 이렇다.
"VPS의 claude -p 호출은 전부 같은 구독 한도를 같이 쓴다.
반복되는 작업은 기본적으로 하이쿠를 쓰고, 한도를 넘기면 재시도 없이 그 자리에서 바로 멈춘다."(원문: "VPS claude -p calls draw from the SAME subscription limit — repetitive pipelines default to haiku; on limit-exceeded stop immediately (no retries).")
글쓰기·검수처럼 판단이 들어가는 자리는 하이쿠가 아니라 소네트·오퍼스를 쓴다.
오늘 이 네 자리가 전부 그쪽이다.
소넷 5.5 발표 수치를 내 세션에 대입해보면
속도가 30% 이상 빨라지고 동일 작업 비용이 최대 30% 줄어든다면, 이 네 자리에 뭐가 달라질까 궁금해졌다.
여기서부터는 직접 재본 숫자가 아니다.
뉴스에 나온 수치를 내 세션 구조에 그대로 대입해서 어림잡아 본 것뿐이다.

| 뉴스 발표 수치 | 내 세션 구조에 대입하면(어림) |
|---|---|
| 속도 30%↑ | 네 세션 각각의 처리 시간이 줄어드는 만큼, 같은 시간에 돌릴 수 있는 세션 수는 늘어나는 쪽 |
| 비용 최대 30%↓ | 이 서버는 API 종량제가 아니라 구독 정액제라, 줄어드는 건 달러가 아니라 한도 소진 속도 |
| 가격 그대로 (입력 $2·출력 $10) |
토큰 단가를 직접 내는 구조가 아니라서, 이 항목은 나한테 체감이 거의 없다 |
여기서 진짜 하고 싶은 얘기는 따로 있다.
"30% 싸졌다"는 API로 토큰을 사서 쓰는 사람한테 주로 해당되는 말이다.
나는 정액 구독으로 claude -p를 돌리니까, 내가 실제로 보게 될 변화는 요금이 아니라 한도가 얼마나 빨리 바닥나는가 쪽이다.
예전 진행기록부(docs/progress.md)를 보면 이 서버가 주간 사용량 한도에 걸려 아침 8시 크론이 통째로 불발된 기록이 있다("hit your weekly limit" 로그, 08-08).
같은 작업을 더 적은 토큰·도구 호출로 끝낸다면, 그 한도까지 걸리는 시간도 조금은 늘어날 거라고 추정한다.
그런데 이건 실측이 아니다
솔직히 말하면, 나는 아직 이 서버의 모델을 5.5로 바꿔서 다시 재본 게 아니다.
그냥 뉴스에 나온 숫자를 내 세션 구조에 대입해서 계산기만 두드려본 거다.
실제로 바꿔보면 위 표의 숫자는 얼마든지 달라질 수 있다.
체크

다음에 확인할 건 이거다 — 모델이 자동으로 갱신된 뒤에 진행기록부에 "한도 걸림" 기록이 줄어드는지.
오늘처럼 세션 서너 개가 붙는 글이 몇 번 더 쌓이면, 그때 실제 숫자로 다시 비교해볼 생각이다.
아직은 계산기 위의 숫자일 뿐이다.
참고한 자료
- AI타임스 — 앤트로픽, '클로드 소네트 5.5' 공개…오퍼스급 지능에 최강 가성비
- 뉴스핌 — 가격 내리고 속도 30% 올렸다...앤트로픽, 클로드 소넷 5.5 공개
- AI매터스 — 앤트로픽, 클로드 소넷 5.5 공개…가격은 그대로, 터미널 코딩 점수 10.3%에서 70.6%로
- AI타임스 — 앤트로픽, 클로드 최적화를 클로드에 맡겼더니… "2주 만에 속도 3배 빨라져"
- AI매터스 — 앤트로픽, 2주 만에 claude.ai 속도 3배 향상…코드 변경 3,000건∙장애는 0건