← News
By Leila Haddad
— Solutions Architect, Enterprise
·
· INSIGHT
Anthropic의 사용량 기반 가격 전환: 엔터프라이즈가 재협상해야 할 것
Anthropic은 Claude Enterprise를 낮은 기본 시트 수수료에 API 요율로 상한 없는 사용량을 더한 구조로 재구성했습니다. 150시트 이상 고객은 갱신 시 전환됩니다. 조달은 서명 전에 토큰, 캐싱, 배치 할인 중심으로 지출 모델을 재구축해야 합니다.
2026년 Anthropic 엔터프라이즈 가격에서 바뀐 것
2026년 4월 Anthropic은 The Information이 처음 보도한 내용을 확인했습니다. Claude Enterprise는 번들 토큰, 정액 시트당 가격에서 낮은 기본 시트 수수료에 표준 API 요율로 청구되는 사용량을 결합한 모델로 이동했습니다. Anthropic의 공개 구조에 따르면, 새 Enterprise 시트는 사용자당 월 약 $20에 위치하며 "사용량에 대한 청구를 비활성화할 수 없습니다". 이전 프리미엄과 표준 시트 티어(이전에는 번들 토큰 할당량이 있는 사용자당 월 약 $200와 $40)는 갱신 시 새 모델로 전환됩니다.
초기 변경은 150시트 이상의 배포를 대상으로 합니다. 소규모 고객은 현재 레거시 가격에 머물지만 방향성은 분명합니다. Anthropic은 Claude Code 도입과 에이전틱 워크로드에 의한 컴퓨트 부족을 인용합니다. PYMNTS, The Register, ITBrief의 업계 보도는 이를 프런티어 모델 엔터프라이즈 계약의 정액 시대 종말로 프레이밍합니다. 조달 팀에게 실용적 효과는 라인 항목이 예측 가능한 구독에서 변동 소비로 이동하고, 시트 수수료가 총비용의 작은 부분이 되는 것입니다.
시트당 vs 토큰당: 새 계산이 작동하는 방식
레거시 Premium 플랜에서 사용자당 $200의 200시트 배포는 번들 토큰 쿼터와 함께 예측 가능한 연 $480,000 약정을 산출했습니다. 새 모델에서는 동일한 200시트가 기본 수수료로 $48,000만 생성합니다. 나머지는 사용자가 실제로 API 정가에서 소비하는 것입니다. Sonnet 4.6은 100만 토큰당 입력 약 $3, 출력 $15, Opus 4.7은 실질적으로 더 높습니다.
implicator.ai와 The Register가 인용한 라이선싱 분석가는 헤비 사용자가 총 지출이 두 배 또는 세 배가 될 것으로 추정합니다. 에이전틱 루프를 실행하는 단일 Claude Code 엔지니어는 일일 수백만 토큰을 소진할 수 있으며, 플랫폼 팀 전반에 곱하면 변동 라인이 기본을 압도합니다. 이제 계산은 조달이 이전에 거의 추적하지 않던 세 숫자에 달려 있습니다. 일일 활성 사용자당 평균 토큰, 출력 대 입력 비율(출력이 5배 비쌈), Haiku, Sonnet, Opus 간의 모델 믹스. 이전에 AI 지출을 시트당 SaaS 라인으로 예측하던 재무 팀은 인원수가 아니라 소비 텔레메트리 중심으로 재구축해야 합니다.
캐시 할인과 Message Batches: 사용할 가치가 있는 비용 레버
두 가지 Anthropic 네이티브 할인이 새 계약 형태에서 "있으면 좋은"에서 핵심으로 이동합니다. Message Batches API는 표준 토큰 가격의 정확히 50%로 24시간 내에 비동기 요청을 처리하며, 모든 Claude 모델에 걸쳐 입력과 출력 모두에 적용됩니다. 하루의 지연을 견딜 수 있는 모든 것(야간 문서 분류, 평가 실행, 대량 요약, 임베딩 갱신)은 이를 통해 라우팅되어야 합니다.
프롬프트 캐싱은 두 번째 레버입니다. Anthropic의 공개 곱셈자는 5분 캐시 쓰기를 기본 입력 가격의 1.25배, 1시간 쓰기를 2배에 두고, 결정적으로 캐시 읽기를 0.1배 — 캐시된 입력 토큰에 대한 90% 할인 — 으로 둡니다. 두 할인은 누적됩니다. Batches를 통해 반복적으로 적중되는 긴 시스템 프롬프트나 문서 컨텍스트는 캐시된 부분에 대해 정가의 약 5%에 안착할 수 있습니다. RAG 파이프라인과 긴 컨텍스트 에이전트 워크플로의 경우, 안정된 접두사가 캐시 가능하도록 프롬프트를 의도적으로 구조화하는 것이 단순한 엔지니어링 최적화가 아니라 조달이 볼 수 있는 결정입니다.
새 티어 하에서 연간 지출 모델링
방어 가능한 2026년 지출 모델은 사용자 코호트당 세 가지 입력이 필요합니다. 월별 활성 일수, 활성 일당 소비 토큰, 캐싱 또는 배치 할인에 적합한 그 트래픽의 비중. 유용한 베이스라인: 일반적인 Claude-in-IDE 개발자는 활성 일당 100만-300만 토큰을 소비한다고 보고되고, Deep-Research 스타일 흐름을 실행하는 연구 분석가는 200-500k에 가까우며, Haiku의 고객 지원 에이전트는 100k 미만일 수 있습니다.
기본, 신축, 적대적 세 시나리오를 구축하고, 새 시트 + 사용량 공식에 대해 각각을 압박 테스트하십시오. 적대적 케이스는 0 캐싱 채택, 0 배치 라우팅, Opus 디폴트 선택, 토큰 30% 월별 증가(보고된 수요 곡선과 일치)를 가정해야 합니다. 그 천장이 갱신 대화에 가져갈 숫자입니다. Enterprise 시트에 포함된 Anthropic의 Compliance API와 감사 로그 접근은 월별로 이를 계측하는 데 필요한 것입니다. 서명 전에 최소 13개월의 토큰 수준 사용 데이터 보존 요구를 계약에 명시하십시오.
OpenAI의 대응 포지셔닝과 마이그레이션 인센티브
OpenAI는 지금까지 ChatGPT Enterprise에 대해 시트당 자세를 유지해왔습니다. 공개 요율은 시트당 월 약 $45-$75 범위에 안착하며, 150시트 최저와 연간 선불입니다. 2026년 4월 2일 OpenAI는 표준 시트와 Codex 전용 시트, 플러스 Deep Research, Thinking 모델, 이미지 생성, 시트당 상한 초과 Codex에 대한 추가 접근을 잠금 해제하는 크레딧 풀과 함께 유연한 가격을 도입했습니다. 구조는 진입 티어에서 여전히 SaaS 모양으로 느껴지지만, 크레딧 풀 메커니즘은 고급 기능에 대해 사용량 기반 동역학을 조용히 도입합니다.
이는 단기적 차익 거래를 만듭니다. 2026년 3분기와 4분기에 갱신 사이클을 운영하는 조달 팀은 OpenAI 영업이 Anthropic의 변동 모델에 대해 예측 가능성을 명시적으로 피칭하는 것을 보게 됩니다. 그 견적을 규율 있게 다루십시오. 정확히 어떤 기능이 시트당 봉투 안에 떨어지고, 어떤 기능이 크레딧 인출을 요구하며, 풀이 고갈된 후 초과 요율이 어떻게 보이는지 확인하십시오. 현실적 결과는 단일 벤더 마이그레이션이 아니라 양쪽에 강한 상한을 둔 이중 소싱 자세입니다.
헤지: 단일 벤더 계약 위에 BYOK 게이트웨이 계층화
어떤 단일 벤더의 가격 전환에 대한 가장 명확한 구조적 헤지는 모델 계약을 애플리케이션에서 분리하는 것입니다. API 키를 보유하고 프로바이더 전반에 걸쳐 요청을 라우팅하는 게이트웨이 계층은 모델 선택을 조달 약정이 아니라 런타임 결정으로 만듭니다. Anthropic이 요율을 올리거나, 할인 티어를 만료하거나, 계약 중간에 모델 SKU를 폐기할 때, 애플리케이션 코드를 건드리지 않고 Sonnet 클래스 트래픽을 비교 가능한 경쟁자로 재라우팅합니다.
운영 요구사항은 화려하지 않지만 구체적입니다. 요청당 프로바이더 선택, 재라우팅 시 90% 할인을 잃지 않도록 하는 프롬프트 캐시 인식, 워크스페이스 또는 비용 센터당 토큰 수준 사용 귀속, 게이트웨이 자체가 벤더 정가 위에 마진 계층을 추가하지 않는 순수 패스스루 청구. 이 범주의 플랫폼 — BYOK 패스스루와 시트당 수수료 없음을 중심으로 구축된 osFoundry가 한 예 — 는 Anthropic, OpenAI, 오픈웨이트 프로바이더 앞에 동시에 위치합니다. 핵심은 벤더 포기가 아니라, 전환 비용이 분기가 아니라 시간으로 측정되는 위치에서 재협상할 옵션을 보존하는 것입니다.
다음 갱신을 위한 액션 아이템
2026년 갱신에 서명하기 전에 테이블에 네 가지 아티팩트를 가져오십시오. 첫째, 사용자 코호트, 모델, 캐시 적중률로 분류된 13개월 토큰 소비 베이스라인. Anthropic의 Compliance API가 원시 데이터를 제공합니다. 갱신이 몇 달 후라도 지금 계측하십시오. 둘째, 가격 변경 통지 윈도우에 대한 Anthropic의 서면 약정. 2026년 시트에서 사용량으로의 전환은 고객을 놀라게 했고, 계약은 어떤 요율 또는 티어 수정에 대해 90일 통지를 요구해야 합니다.
셋째, 명시적인 Batch와 캐시 할인 생존성을 협상하십시오. 50% Batch 할인과 캐시 읽기 곱셈자가 일방적으로 폐기 가능한 서비스 약관이 아니라 계약 조건임을 확인하는 언어를 받으십시오. 넷째, 제3자 라우팅 계층과 BYOK 자세를 허용하는 게이트웨이 조항을 확보하십시오. 일부 엔터프라이즈 계약은 재판매 또는 프록시를 조용히 제한하며, 그 모호함을 서면으로 해결하기를 원합니다. Anthropic이 이 중 어떤 것에 저항한다면, 그 자체가 계약 기간 동안 행사할 것으로 예상되는 가격 유연성에 대한 유용한 데이터 포인트입니다.
Frequently asked questions
- 새 Anthropic Enterprise 가격이 모든 고객에게 영향을 미치나요?
- 즉시는 아닙니다. Anthropic은 새 구조가 150시트 이상 배포를 대상으로 하며, 기존 프리미엄과 표준 시트 티어가 계약 갱신 시 결합된 기본 수수료 + 사용량 모델로 전환된다고 확인했습니다. 소규모 배포는 현재 레거시 가격에 머물지만, 대부분 업계 분석가는 모델이 시간이 지남에 따라 아래로 확장될 것으로 예상합니다. 실용적 함의: 갱신이 향후 2-4분기 내이고 시트 한계점을 넘는다면, 영업 팀이 견적을 보낸 후가 아니라 지금 사용량 기반 지출 예측을 구축하십시오.
- 50% Batch 할인과 90% 캐시 읽기 할인은 실제로 영구적인가요?
- Anthropic은 현재 API 문서에 둘 다 공개합니다. Message Batches API는 24시간 내 반환되는 비동기 요청에 대해 표준 토큰 요율의 50%를 부과하고, 프롬프트 캐싱은 캐시된 입력 읽기에 0.1배 곱셈자를 사용하여 90% 할인에 해당합니다. 할인은 누적됩니다. 프로모션 가격이 아니라 문서화된 기능이지만, Anthropic이 수정할 수 있는 서비스 약관 수준 약정입니다. 다년 엔터프라이즈 계약을 협상하는 조달 팀은 계약 기간 동안 두 메커니즘을 보존하는 명시적 계약 언어를 요청해야 합니다.
- 과거 데이터 없이 사용자별 토큰 소비를 어떻게 예측하나요?
- 역할별로 분할된 Anthropic의 Compliance API 또는 게이트웨이 로그를 사용한 2-4주 계측 윈도우로 시작하십시오. 업계 보도의 유용한 대략 벤치마크: 에이전틱 IDE 워크플로에서 Claude를 사용하는 개발자는 종종 활성 일당 100만에서 300만 토큰을 소비하고, 연구 및 분석가 역할은 200,000에서 500,000에 가까우며, Haiku의 대용량 지원 자동화는 자주 100,000 미만입니다. 근무일로 곱하고, 성장 가정(분기별 15-30%가 일반적)을 적용하며, 예상 캐시와 배치 커버리지에 맞게 조정하십시오.
- 프로바이더 전환이 현실적 헤지인가요, 협상 위협일 뿐인가요?
- 아키텍처가 지원한다면 둘 다입니다. 실제 전환은 프로바이더별 SDK를 추상화하고, 재라우팅 전반에 걸쳐 프롬프트 캐시 적중률을 보존하며, 워크스페이스당 토큰 수준에서 사용량을 계측하는 게이트웨이 또는 라우팅 계층을 요구합니다. 그 계층 없이는, 멀티 프로바이더 이식성 주장이 실제 마이그레이션에서 살아남지 못합니다. 그 계층이 있으면, 모델 클래스별로 트래픽을 신뢰성 있게 라우팅하고, 사고 중 보조 프로바이더로 폴백하며, 갱신 대화에서 구두 위협이 아니라 측정 가능한 탄력성을 사용할 수 있습니다. 배포해야 할 때 전에 그 역량을 구축하십시오.
Sources