자고 일어났더니 한 달 치 예산이 하룻밤 사이에 사라졌다는 이메일을 받는 상황을 상상해 보십시오. 한 레딧 사용자에게 실제로 일어난 일입니다. 무해해 보이던 자동화 스크립트가 통제 불능 상태가 되면서 무려 6,000달러라는 엄청난 청구서가 발생했습니다.

이 개발자는 루핑 명령어를 사용하여 30분마다 소프트웨어 업데이트를 확인하도록 Claude Code를 설정했습니다. 그는 스크립트가 백그라운드에서 일상적인 유지 관리를 처리할 것이라고 생각하고 잠자리에 들었습니다. 하지만 자동화는 걷잡을 수 없이 폭주했고, 아침이 밝기도 전에 괜찮은 중고차 한 대 가격에 맞먹는 비용을 소진해 버렸습니다.

관련 기사

6,000달러짜리 반전이 있는 취침 시간 이야기

멈추지 않는 루프

AI 코딩 어시스턴트가 어떻게 누군가의 예산을 순식간에 태워버릴 수 있는지 이해하려면, 이 시스템들이 컨텍스트를 처리하는 방식을 살펴봐야 합니다. 비개발자들에게 터미널의 진입 장벽을 낮춰준 것으로 널리 알려진 Claude Code와 같은 도구에 프롬프트를 보낼 때마다, 시스템은 모델이 상황을 기억할 수 있도록 이전 대화 기록을 포함하는 경우가 많습니다. 세션 초기에는 이 컨텍스트가 수백 토큰에 불과할 수 있지만, 몇 시간 동안 상호작용이 이어지면 기록이 수십만 토큰으로 불어나 모든 요청에 달라붙게 됩니다.

비용이 변질되기 시작하는 지점이 바로 여기입니다.

해당 레딧 사용자는 적절한 중단 조건 없이 30분마다 시스템이 실행되도록 루프를 구성했습니다. 공교롭게도 같은 시기에 XDA Developers는 Anthropic이 사전 공지나 변경 로그 기록 없이 Claude Code의 기본 프롬프트 캐시 유지 시간을 1시간에서 5분으로 단축했다고 보도했습니다. 자동화 스크립트는 30분마다 확인을 수행했기 때문에, 다음 주기가 시작되기 전에 캐시가 계속 만료되었습니다.

결과적으로 시스템은 기존 세션을 효율적으로 재개하는 대신, 깨어날 때마다 80만 토큰에 달하는 거대한 대화 기록을 매번 처음부터 다시 구축했습니다. Anthropic의 가격 구조상, 이미 활성화된 캐시를 읽는 것보다 새로운 데이터를 캐시에 쓰는 비용이 훨씬 비쌉니다(활성 캐시는 큰 할인을 받습니다). 개발자가 요청한 실제 코딩 작업은 비교적 저렴했습니다. 진짜 비용은 하루 48번씩 그 거대한 컨텍스트 창을 반복적으로 재업로드하고 재구성하는 과정에서 발생했습니다. 루프가 토큰을 모두 소진했을 때, 청구서는 감당하기 힘든 수준으로 치솟아 있었습니다.

이 글도 확인해 보세요:  AI 개발이 너무 빠르게 진행되고 있어 일시 중지해야 하는 5가지 징후

개발자에게 경고를 줄 실시간 지출 카운터도 없었습니다. Anthropic의 사용량 대시보드는 며칠의 지연 시간을 두고 업데이트됩니다. 문제가 발생했다는 첫 신호는 이미 피해가 발생했음을 알리는 이메일뿐이었습니다.

이 문제는 한 명의 불운한 개발자에게 국한되지 않습니다

남의 일이 아닌 청구서

6,000달러 이야기는 이 헤드라인의 일부일 뿐이며, 현재 개발자와 기업 모두에게 영향을 미치고 있는 AI 비용 충격이라는 더 큰 패턴 속에 자리 잡고 있습니다.

Forbes 보도에 따르면, 우버(Uber)의 CTO 프라빈 네팔리 나가(Praveen Neppalli Naga)는 올해 초 회사가 2026년 전체 AI 예산을 불과 4개월 만에 모두 소진했다고 밝혔습니다. 범인은 2025년 12월 엔지니어링 팀에 도입된 Claude Code였으며, 도입 속도는 예상보다 훨씬 빨랐습니다. 3월까지 엔지니어의 84%가 에이전트형 코딩 사용자로 분류되었고, 거의 95%의 엔지니어가 매달 AI 도구를 사용했습니다. 엔지니어 1인당 월평균 비용은 150~250달러였으나, 헤비 유저는 500~2,000달러 범위까지 올라갔다고 합니다. 나가 본인도 2시간짜리 데모 세션 한 번에 약 1,200달러를 소진했다고 말했습니다. 회사는 현재 AI 예산 책정을 "원점으로 되돌린" 상태인데, 이는 규모에 따른 실제 비용 모델이 전혀 없었다는 것을 완곡하게 표현한 것입니다. Claude를 사용하여 프로젝트 예산을 계산하는 것이 좌절스러운 재앙이 될 수 있는 반면, AI 자체에 대한 정확한 예산을 책정하려는 시도 또한 기업들에게 똑같이 고통스러운 과정이라는 점은 다소 아이러니합니다.

DEV Community의 또 다른 프로그래머는 Anthropic 결제 대시보드를 확인했다가 한 달이 채 지나기도 전에 847달러가 청구된 것을 보고 경악했다고 적었습니다. 그는 시스템을 스트레스 테스트하거나 특수한 작업을 수행한 것도 아니었습니다. 그저 일반적인 사용이었을 뿐입니다.

어떻게 대처해야 할까

값비싼 수업료보다 저렴한 방법

Anthropic의 자체 결제 구조는 눈에 띄게 변동하고 있습니다. 4월에는 OpenClaw와 같은 타사 에이전트 도구가 구독 할당량을 사용하는 것을 24시간 전 통보 없이 제한했습니다. 5월에는 6월 15일부터 Agent SDK, claude -p 명령어, Claude Code GitHub Actions 및 모든 타사 에이전트 도구가 기존 구독 한도와 완전히 분리된 별도의 API 요금제 크레딧 풀로 이전될 것이라고 발표했습니다.

이 글도 확인해 보세요:  정확한 계산을 위한 10가지 고급 Excel 함수

에이전트형 워크플로우를 위해 Anthropic은 작업 예산(task budgets) 기능을 도입하기 시작했습니다. 이 기능은 현재 Claude Opus 4.7에서 공개 베타 상태이며, 워크플로우가 여러 요청에 걸쳐 있더라도 전체 자율 워크플로우에 대한 소프트 지출 경계 역할을 합니다. 예산이 줄어들면 Claude는 점진적으로 추론 깊이를 줄이고, 작업 중간에 중단하는 대신 요약과 함께 우아하게 마무리하려고 시도합니다.

이러한 플랫폼 변경 사항 외에도 가장 빠른 안전장치는 지출 한도를 설정하는 것입니다. Claude 계정 설정의 ‘설정(Settings) -> 사용량(Usage)’에서 추가 사용량을 활성화한 다음, 한도를 조정하여 월간 지출 상한선을 설정할 수 있습니다. 이렇게 하면 무제한 청구서에 천장을 만들 수 있습니다. API를 직접 사용하는 경우, 팀 관리자가 구성할 수 있는 Anthropic 콘솔의 워크스페이스 지출 한도가 이에 해당합니다.

또 다른 유용한 팁은 루프를 짧게 유지하거나 상태를 저장하지 않는 것입니다. Claude Code에서 /loop 또는 /schedule 명령어를 실행하는 경우, 비교적 안전한 두 가지 접근 방식이 있습니다. 프롬프트 캐시가 요청 간에 유지되도록 간격을 5분 이하로 설정하거나, 매 주기마다 완전히 새로운 세션을 시작하여 이전 컨텍스트가 누적되지 않도록 하는 것입니다. 5분에서 몇 시간 사이의 간격은 매 주기마다 컨텍스트를 처음부터 다시 구축하기 위해 정가를 지불해야 하는 비싼 중간 지대입니다.

마지막으로 에이전트 작업에 사용할 모델을 신중하게 선택하십시오. Claude Opus는 Anthropic의 헤비급 모델이자 가장 비싼 모델입니다. Opus와 Haiku 간의 토큰당 비용 차이는 최대 50배에 달할 수 있습니다. 세션당 수백 번의 API 호출을 수행하는 코딩 에이전트의 경우, 단순한 하위 작업은 더 가벼운 모델로 라우팅하고 Opus는 실제 복잡한 추론 단계에만 예약하면 출력 품질을 크게 저하시키지 않으면서 세션 비용을 60~80% 절감할 수 있습니다.

또는 API 비용을 완전히 피하고 싶다면, Ollama를 통해 로컬 모델을 연결하여 Claude Code를 완전히 무료로 사용하는 방법도 있습니다. Sonnet이나 Opus만큼 뛰어나지는 않겠지만, 간단한 자동화 작업의 경우 예상치 못한 청구서 위험을 완전히 제거할 수 있습니다.

이 글도 확인해 보세요:  ChatGPT의 새로운 플러그인 기능에 가입하는 방법

터미널은 여전히 열려 있지 않나요?

이 이야기의 중심에 있는 개발자는 무모하게 행동하거나 시스템을 악용한 것이 아닙니다. 그는 Claude Code가 스스로 광고하는 방식 그대로, 즉 자율적으로, 밤새도록, 최소한의 감독하에 도구를 사용하고 있었습니다(결국 Claude, ChatGPT, Gemini의 기능적 코드 구축 능력을 비교할 때, Claude는 작업 수행을 위해 가장 적은 감독을 필요로 하는 경우가 많습니다). 교훈은 AI 에이전트가 위험하다는 것이 아닙니다. 토큰 기반 결제와 에이전트형 루프가 직관적이지 않은 방식으로 상호작용한다는 점, 안전장치가 아직 사용 사례를 따라잡지 못하고 있다는 점, 그리고 현재로서는 우발적인 4자리수 청구서를 피해야 할 책임이 전적으로 코드를 실행하는 사람에게 있다는 것입니다.

도구가 개선될 때까지는 자기 보호가 중요합니다. 즉, 캐시 메커니즘을 이해하고, 지출 한도를 설정하며, 5분 규칙을 엄격하게 준수해야 합니다. 왜냐하면 그 규칙에는 실제로 날카로운 이빨이 숨겨져 있기 때문입니다.

By 최은지

윈도우(Windows)와 웹 서비스에 대한 전문 지식을 갖춘 노련한 UX 디자이너인 최은지님은 효율적이고 매력적인 디지털 경험을 개발하는 데 탁월한 능력을 발휘합니다. 사용자의 입장에서 생각하며 누구나 쉽게 접근하고 즐길 수 있는 콘텐츠를 개발하는 데 주력하고 있습니다. 사용자 경험을 향상시키기 위해 연구를 거듭하는 은지님은 All Things N 팀의 핵심 구성원으로 활약하고 있습니다.