티스토리 뷰

카테고리 없음

앤트로픽, 클로드로 클로드를 고쳤다는데 내 자동화도 대입해봤다(AI 개발 속도)

ststst1255 2026. 9. 30. 04:17

목차


    앤트로픽, 클로드로 클로드를 고쳤다는데 내 자동화도 대입해봤다(AI 개발 속도)

    회사가 뭘 했다는 뉴스와, 내 자동화가 매일 하는 일

    요 며칠 사이 앤트로픽 관련 기사 두 개가 소재 레이더에 나란히 걸렸다.

    하나는 클로드 소넷 5.5를 공개했다는 소식이었고, 다른 하나는 앤트로픽이 자기 모델을 투입해 자기 서비스 속도를 2주 만에 끌어올렸다는 소식이었다.

    앤트로픽_1

    소넷 5.5는 속도가 30% 이상 빨라지고 동일 작업 비용은 최대 30%까지 줄었는데, 가격표(입력 100만 토큰당 2달러·출력 100만 토큰당 10달러)는 그대로라고 보도됐다.

    터미널 코딩 테스트(터미널벤치4.0) 점수는 70.6%로, 소넷 5(10.3%)나 오퍼스 5.5(66.4%)보다 높게 나왔다고 전해졌다.
    출처: AI타임스(https://www.aitimes.com/news/articleView.html?idxno=215734)

    다른 기사는 더 흥미로웠다.
    앤트로픽이 자기 모델을 자율형 최적화 에이전트로 투입해서, claude.ai 웹·데스크톱의 체감 속도를 2주 만에 3배 개선했다고 전해졌다.

    claude.ai 웹의 첫 로딩 시간이 3.1초에서 0.55초로 줄었고, 3,000건이 넘는 코드 변경을 적용하면서 장애나 롤백은 한 건도 없었다고 보도됐다.
    출처: AI타임스(https://www.aitimes.com/news/articleView.html?idxno=215678)

    그 과정에서 사람 엔지니어가 한 일은 목표를 정하고, 무엇을 포기할지 판단하고, 마지막에 승인 도장을 찍는 것뿐이었다고 한다.

    기사를 읽다가 이거 어디서 많이 본 구조인데 싶었다.

    언론사들은 이 소식을 전부 "앤트로픽이 뭘 했다"로만 전했다.
    그런데 나는 그 구조를 매일 쓰고 있다.

    오늘 이 글도 그 구조로 만들어진다

    이 블로그도 사람이 전부 타이핑하는 곳이 아니다.

    claude -p, 그러니까 클로드 코드가 반복 작업을 돌리고, 나는 승인 게이트에서만 개입한다.
    오늘 이 글 한 편만 놓고 세어봐도 그렇다.

    ①소재를 고르고 검수·발행까지 총괄하는 오케스트레이터 세션, ②지금 이 글을 쓰고 있는 작성 세션, ③다 쓴 원고를 다시 검사하는 독립 검수 세션 — 최소 세 번이다.
    이미지를 눈으로 한 번 더 확인하는 날은 네 번째 세션까지 붙는다.

    세션 하는 일 등급
    ①오케스트레이터 소재 선정·검수 총괄·발행 판단 판단(소네트·오퍼스)
    ②작성 세션(이 글) 원고 작성 판단(소네트·오퍼스)
    ③독립 검수 세션 사실 확인·게이트 판정 판단(소네트·오퍼스)
    ④이미지 눈판정
    (있는 날)
    이미지 적합성 확인 판단

    네 자리 전부 하이쿠는 없다.
    CLAUDE.md에 적힌 이 파이프라인의 운영 방침을 우리말로 옮기면 이렇다.

    "VPS의 claude -p 호출은 전부 같은 구독 한도를 같이 쓴다.
    반복되는 작업은 기본적으로 하이쿠를 쓰고, 한도를 넘기면 재시도 없이 그 자리에서 바로 멈춘다."

    (원문: "VPS claude -p calls draw from the SAME subscription limit — repetitive pipelines default to haiku; on limit-exceeded stop immediately (no retries).")

    글쓰기·검수처럼 판단이 들어가는 자리는 하이쿠가 아니라 소네트·오퍼스를 쓴다.
    오늘 이 네 자리가 전부 그쪽이다.

    소넷 5.5 발표 수치를 내 세션에 대입해보면

    속도가 30% 이상 빨라지고 동일 작업 비용이 최대 30% 줄어든다면, 이 네 자리에 뭐가 달라질까 궁금해졌다.

    여기서부터는 직접 재본 숫자가 아니다.
    뉴스에 나온 수치를 내 세션 구조에 그대로 대입해서 어림잡아 본 것뿐이다.

    앤트로픽_2

    뉴스 발표 수치 내 세션 구조에 대입하면(어림)
    속도 30%↑ 네 세션 각각의 처리 시간이 줄어드는 만큼, 같은 시간에 돌릴 수 있는 세션 수는 늘어나는 쪽
    비용 최대 30%↓ 이 서버는 API 종량제가 아니라 구독 정액제라, 줄어드는 건 달러가 아니라 한도 소진 속도
    가격 그대로
    (입력 $2·출력 $10)
    토큰 단가를 직접 내는 구조가 아니라서, 이 항목은 나한테 체감이 거의 없다

    여기서 진짜 하고 싶은 얘기는 따로 있다.
    "30% 싸졌다"는 API로 토큰을 사서 쓰는 사람한테 주로 해당되는 말이다.

    나는 정액 구독으로 claude -p를 돌리니까, 내가 실제로 보게 될 변화는 요금이 아니라 한도가 얼마나 빨리 바닥나는가 쪽이다.

    예전 진행기록부(docs/progress.md)를 보면 이 서버가 주간 사용량 한도에 걸려 아침 8시 크론이 통째로 불발된 기록이 있다("hit your weekly limit" 로그, 08-08).
    같은 작업을 더 적은 토큰·도구 호출로 끝낸다면, 그 한도까지 걸리는 시간도 조금은 늘어날 거라고 추정한다.

    그런데 이건 실측이 아니다

    솔직히 말하면, 나는 아직 이 서버의 모델을 5.5로 바꿔서 다시 재본 게 아니다.

    그냥 뉴스에 나온 숫자를 내 세션 구조에 대입해서 계산기만 두드려본 거다.
    실제로 바꿔보면 위 표의 숫자는 얼마든지 달라질 수 있다.

    체크

    앤트로픽_3

    다음에 확인할 건 이거다 — 모델이 자동으로 갱신된 뒤에 진행기록부에 "한도 걸림" 기록이 줄어드는지.

    오늘처럼 세션 서너 개가 붙는 글이 몇 번 더 쌓이면, 그때 실제 숫자로 다시 비교해볼 생각이다.

    아직은 계산기 위의 숫자일 뿐이다.

    참고한 자료

    함께 보면 좋은 글