본문으로 건너뛰기
ToolPotion

AI 도구 요금제 완전 해부: 크레딧, 시트, 토큰, 그리고 몰래 찾아오는 청구 모델

벤더 문서에서 직접 뽑은 6가지 AI 청구 모델 해설: 크레딧, 토큰, 시트, 성과 기반 요금의 실제 비용과 요금 폭탄 실제 사례, 구매자…

···23분 분량

공유

AI 크레딧 하나의 가치는 GitHub Copilot에서 정확히 $0.01이고, 매월 1일 00:00:00 UTC에 만료되며, 어떤 모델을 사용하느냐에 따라 구매할 수 있는 작업량이 달라집니다(GitHub Copilot 문서). 이 한 문장 안에 청구서가 예상을 벗어날 수 있는 세 가지 방식이 담겨 있으며, Copilot은 그나마 비교적 투명한 편입니다.

AI 요금 페이지에 표시된 가격은 최저선일 뿐입니다.

이것은 설계대로 작동하는 것이며, 대규모로 작동하고 있습니다. IT 리더의 78%가 지난 12개월 동안 예상치 못한 AI 기능 또는 소비 요금을 맞았고, 61%는 계획되지 않은 SaaS 비용 증가로 인해 예정된 프로젝트를 취소했습니다(Zylo의 2026 SaaS 관리 지수). 아래에서 1차 벤더 문서에서 뽑은 6가지 청구 모델, $20 플랜을 $400 청구서로 바꾸는 각 모델의 구체적인 조항, 카드를 입력하기 전에 반드시 확인해야 할 질문들을 다룹니다.

AI 요금이 기존 SaaS 룰북을 깨뜨린 이유

요금 페이지의 숫자를 보증금이라고 생각하세요. 기존 SaaS 수학은 단순하게 좋은 편이었습니다. 시트 40개에 $15를 곱하면 매달 $600, 영원히. AI 도구는 청구서를 작업이 소비하는 컴퓨팅 양에 연결함으로써 이 공식을 깨버렸고, 컴퓨팅 양은 여러분이 점심을 먹는 동안에도 계속 작동하는 모델, 라우터, 또는 에이전트가 결정합니다.

시트 가격이 더 이상 진짜 가격이 아니다

벤더들이 스스로 어떻게 설명하는지 살펴보세요. Cursor의 요금 페이지는 Pro를 $20/월, Teams를 $40/사용자/월로 여전히 표시하면서, "모든 플랜에는 일정량의 모델 사용량이 포함되어 있으며" 그 이상의 온디맨드 사용량은 "후불로 청구된다"고 덧붙입니다(Cursor). 후불 청구는 사전 동의 없이 요금이 부과된다는 의미입니다. GitHub는 전환율에 대해 더 명확합니다. AI 크레딧 1개는 정확히 $0.01이고, $10/월짜리 Copilot Pro에는 1,500 크레딧이 포함되며, 해당 크레딧은 매월 1일 00:00:00 UTC에 이월 없이 만료됩니다(GitHub Docs).

시트는 여전히 존재합니다. 다만 플랜 이름만으로는 예측할 수 없는 미터 위에 얹혀 있을 뿐입니다.

종량제 요금은 이제 시장 표준입니다. AI 네이티브 애플리케이션 지출은 전년 대비 108% 성장했으며, 직원 수 10,000명 이상 조직에서는 393% 성장했습니다. 총 SaaS 지출 성장률 약 8%와 비교되는 수치로, 4천만 개 이상의 라이선스와 750억 달러 규모를 대상으로 측정되었습니다(Zylo). 그 돈의 대부분은 종량제 도구로 흘러가고 있습니다.

사업 부서가 카드를 쥐고 있다

Zylo가 조사한 218명의 IT 리더 중 78%가 지난 12개월 동안 예상치 못한 AI 기능 또는 소비 요금을 맞았고, 61%는 계획되지 않은 SaaS 비용 증가로 인해 예정된 프로젝트를 취소했습니다(Zylo). 이것을 지켜보는 것이 본업인 사람들조차 놀랐다는 얘기입니다.

구조적인 이유는 같은 보고서에 있습니다. 사업 부서가 SaaS 지출의 81%를 관리하는 반면 IT가 직접 관리하는 비율은 15%에 불과합니다(Zylo). $20 플랜을 경비로 처리하는 마케팅 팀장은 구매 절차를 거치지 않으며, 3주 후에 클릭하는 크레딧 충전도 누구의 승인도 받지 않습니다. 이것을 우리 디렉터리의 AI 앱 13,174개에 곱하면, 회사 내 누구도 파악하거나 승인할 수 없는 지출이 됩니다.

6가지 청구 모델 해부

2026년에 열어볼 AI 요금 페이지는 모두 6가지 미터 중 하나 또는 두 개를 겹쳐서 사용합니다. 각 유형의 특징을 알면 FAQ 링크를 찾기 전에 페이지를 분류할 수 있습니다.

청구서 하나가 시트 회전문, 크레딧 호퍼, 토큰 유량계, 사용량 티어, 성과 게이트, 하이브리드 접합부 등 6가지 청구 미터에서 공급되는 마인드맵.
모델측정 대상요금 페이지의 특징놀라움이 숨어 있는 곳
시트당월별 지명 사용자"$X/사용자/월"로 표시된 가격시트에 부여되는 권한 (벤더가 변경 가능)
크레딧벤더 발행 단위"N 크레딧 포함"과 별도의 전환 표만료 및 모델별 소진율
토큰입력 및 출력 단어백만 토큰당 가격으로 표시출력 비용이 입력의 수 배
사용량 티어볼륨 구간포함 할당량이 구간별로 달라지는 플랜 표구간 사이의 단계 상승
성과 기반정의된 결과"성공했을 때만 비용 청구""성공"의 정의를 누가 작성하는가
하이브리드시트 + 소비량시트 가격과 "포함 사용량" 문구온디맨드 초과분이 사후 청구됨

시트당: 예측 가능한 가격, 예측 불가능한 권한

지명 사용자당 월정액으로 비용을 지불합니다. 청구서 예측은 쉽습니다. 달라진 것은 시트 뒤에 있는 권한입니다. 시트는 이제 벤더가 규모를 정하고 조정하는 컴퓨팅 풀에 대한 접근을 제한합니다. Anthropic의 소비자 플랜이 가장 명확한 사례입니다. Claude는 5시간마다 리셋되는 세션 한도와 주간 한도로 운영되며, Claude Code, 채팅, Cowork이 모두 하나의 풀에서 사용량을 공유합니다. Max 티어는 명시적인 메시지 수가 아닌 Pro의 5배, 20배라는 상대적 배수로 판매됩니다(Claude 요금제). 가격은 고정입니다. 허용량은 비율입니다.

크레딧: 벤더가 발행하고 만료시키는 화폐

크레딧은 벤더가 정의하는 것이기 때문에, Flexera는 크레딧과 토큰을 기존 구독 방식에 덧붙인 소비 레이어로 함께 묶습니다(Flexera). GitHub은 전환율에 대해 이례적으로 솔직합니다. AI 크레딧 1개는 $0.01이고, $10/월짜리 Copilot Pro에는 1,500 크레딧, $39짜리 Pro+에는 7,000개, $100짜리 Max에는 20,000개가 포함됩니다. 해당 크레딧은 이월되지 않으며, 매월 1일 00:00:00 UTC에 리셋됩니다(GitHub Docs). 크레딧 페이지에서 반드시 확인할 두 가지: 크레딧 1개의 달러 가치, 그리고 미사용 크레딧이 월말에 소멸되는지 여부.

그다음에는 소진율을 확인하세요. 크레딧은 선택한 모델에 따라 구매하는 작업량이 달라지기 때문입니다(GitHub Docs).

토큰: 입출력 단어 수만큼 지불

토큰 요금제는 가장 원초적인 형태이며, 다른 모든 모델이 그 위에 조용히 구축되어 있습니다. 사람들을 놀라게 하는 것은 비대칭성입니다. Claude의 공시 요금은 Sonnet 5가 입력 100만 토큰당 $2, 출력 $10이고, Opus 5는 $5/$25, Fable 5.1은 $10/$50입니다(Claude 요금제). 출력 비용은 전 티어에서 입력의 5배입니다. 채팅 인터페이스에서는 소진되지 않던 허용량을 에이전트 방식 도구가 금방 소진해버리는 이유가 바로 여기 있습니다. 짧은 프롬프트 하나가 수다스러운 에이전트 실행을 시작시키면 입력 비용은 저렴하지만 청구서는 비쌉니다.

사용량 티어: 플랜으로 위장한 절벽

티어는 할당량이 붙은 시트당 요금제처럼 보이며, 구간을 넘기 직전까지 시트당 요금제처럼 작동합니다. Stripe의 AI 요금 구조 분류 자료는 벤더들에게 이런 형태들 중에서 선택하는 방법을 안내하는데, 이는 티어 경계가 비용이 아닌 수익 설계로 정해진다는 것을 알 수 있습니다(Stripe). Copilot의 사다리가 절벽을 잘 보여줍니다. 1,500 크레딧에서 7,000 크레딧으로 올라가면 월 $10에서 $39로 뛰어오릅니다(GitHub Docs). 사용량이 구간 바로 위에 있다면, 쓰지도 않을 여유분에 돈을 내고 있는 셈입니다.

성과 기반 요금: 타인이 정의하는 결과에 비용을 지불

AI가 성공했을 때만 비용을 낸다는 게 홍보 문구입니다. 함정은 벤더가 성공 기준을 작성한다는 것입니다. Intercom의 Fin은 성과당 $0.99를 청구하며, 그 아래 사다리는 두 가지 가격으로 4단계입니다. 해결은 $0.99, 담당자 이관은 $0.99, 잠재 고객 거절은 $0.99, 잠재 고객 자격 확인은 $9.99입니다. Intercom이 아닌 헬프데스크에서는 월 최소 50건의 성과 청구가 있습니다(Fin 요금제). Fin은 청구 가능한 해결을 "Fin의 마지막 답변 후 추가 도움 요청이 없음"으로 정의합니다(Fin 요금제). 고객의 침묵이 고객 만족과 동일하게 청구됩니다.

Zendesk는 2024년 8월 28일, AI 에이전트에 대한 성과 기반 요금제를 발표하며 "AI가 자율적으로 해결한 문제에 대해서만 비용이 발생한다"고 약속하고 무료 시작 허용량도 제공한다고 했지만, 요율도, 자격 요건을 갖춘 해결의 정의도, 허용량 크기도 공개하지 않았습니다(Zendesk). 이제 1년이 넘었으니 현재 약관을 서면으로 확인하세요.

하이브리드: 시트 + 미터, 이제는 기본값

달리 증명되기 전까지는 평가 중인 도구가 하이브리드라고 가정하세요. Cursor는 Hobby 무료, Pro $20/월, Teams $40/사용자/월로 판매하면서, 모든 플랜에 일정량의 모델 사용량이 포함되며 포함량 소진 후 온디맨드 사용량은 "후불로 청구된다"고 명시합니다(Cursor). 후불 청구는 사용 후에 요금이 부과된다는 의미입니다. 대부분의 AI 코딩 어시스턴트가 이제 이 방식으로 작동하며, 시트 가격은 실제 청구서의 더 작은 절반입니다.

AI 크레딧 vs 토큰: 크레딧 하나로 살 수 있는 것

크레딧은 작업 가치가 변동하는 화폐 단위입니다. GitHub이 가장 명확한 예시인데, 교환율을 그대로 공개하기 때문입니다. AI 크레딧 1개는 $0.01 USD이고, 플랜의 허용량은 해당 달러 금액을 1센트로 나눈 값입니다(GitHub Copilot 청구 문서).

GitHub의 계산법: 크레딧 1개 = $0.01, 그리고 만료됨

세 가지 개인 플랜의 수치를 살펴보면 패턴이 금방 드러납니다.

플랜월 가격포함 크레딧크레딧의 달러 가치
Copilot Pro$101,500 (기본 1,000 + 플렉스 500)$15.00
Copilot Pro+$397,000$70.00
Copilot Max$10020,000$200.00

모든 수치는 GitHub 청구 문서를 참고했습니다. Pro+와 Max 모두 구독 가격의 약 2배에 해당하는 크레딧 가치를 제공하는데, 만료 조항을 읽기 전까지는 후한 것처럼 보입니다. 포함된 AI 크레딧은 월 간 이월되지 않으며, 잔액은 매달 1일 00:00:00 UTC에 리셋됩니다. 9월에 무거운 작업을 예상하고 Max를 구매했다가 3분의 1만 사용하면, 나머지 $130 상당의 가치는 10월 1일 자정 UTC에 사라집니다. 만료 조항은 미리 계획하는 것에 대한 요금을 청구합니다.

크레딧을 사용하지 않으면 소멸되는 FSA처럼 예산을 세우세요. 소진율을 파악하기 위해 월 초에 비용이 많이 드는 작업을 앞당겨 처리하면 아직 모델을 바꿀 시간이 있을 때 상황을 파악할 수 있습니다.

동일한 크레딧이 작업량이 다른 이유

포함 허용량을 초과하면, Copilot은 모델에 따라 다른 토큰당 요율로 AI 크레딧을 통해 사용량을 청구합니다(GitHub Docs). 크레딧은 1센트로 고정되어 있지만, 그 아래의 토큰 가격은 변동합니다. 동일한 크레딧 잔액을 같은 주에 소진한 두 개발자가 모델 선택만으로 하나는 세 배의 아웃풋을 얻을 수 있습니다.

기존 요청 기반 시스템은 토큰 시스템이 숨기는 방식으로 이를 가시화했습니다. 초과분은 프리미엄 요청당 $0.04였지만, 모델 배수가 적용되어 고급 추론 모델은 표준 요청의 5배 또는 20배를 소비할 수 있어 "요청" 하나가 $0.20 또는 $0.80이 됩니다. Copilot 코드 리뷰는 13배 배수가 적용됩니다(GitHub Docs). 연간 Pro 또는 Pro+ 플랜을 해당 레거시 약관으로 사용 중이라면, 코드 리뷰 하나에 코드 한 줄 쓰기 전에 52센트가 청구됩니다.

한 달치 크레딧을 기본 모델 하나에 몰기 전에, 벤치마크 점수가 아니라 토큰당 요금으로 AI 모델을 비교해보세요.

아무도 예산에 포함하지 않는 출력 토큰 프리미엄

추정치를 망가뜨리는 배수가 여기 있습니다. Anthropic의 공시 API 요금은 Sonnet 5가 입력 100만 토큰당 $2, 출력 100만 토큰당 $10이고, Opus 5는 $5/$25, Fable 5.1은 $10/$50입니다(Claude 요금제). 출력 비용은 전 티어에서 입력의 5배입니다.

에이전트가 코드를 읽는 대신 작성하기 시작하는 순간 이 비율을 실감하게 됩니다. 6개 파일에 걸친 20,000 토큰짜리 리팩터를 생성하는 2,000 토큰 프롬프트는 입력 측면에서는 반올림 오차이고, 출력 측면에서는 전체 청구서입니다. 말이 많은 에이전트는 비용이 많이 드는 에이전트이며, 시스템 프롬프트의 "간결하게"는 실질적인 비용 통제입니다.

모니터에 붙여 두어야 할 변환 공식은 간단합니다. 달러에서 크레딧은 고정이고 공개되어 있습니다. 크레딧에서 토큰은 모델에 따라 다릅니다. 토큰에서 작업량은 모델이 얼마나 많이 응답하느냐에 따라 다릅니다.

광고 가격을 예상치 못한 청구서로 만드는 6가지 메커니즘

요금 폭탄은 6가지 특정 조항에서 발생하며, 각각 카드 번호를 입력하기 전에 요금 페이지에서 검색할 수 있는 문구가 있습니다.

모델 배수

동일한 작업이 어떤 모델이 처리하느냐에 따라 비용이 달라지며, 모델 선택기는 언제 바꿨는지 잊어버린 드롭다운인 경우가 많습니다. GitHub의 레거시 요청 기반 청구가 가장 명확한 예시입니다. 초과분은 프리미엄 요청당 $0.04였지만, 고급 추론 모델에는 5배 또는 20배 배수가 적용되어 요청 하나가 $0.20 또는 $0.80이 될 수 있고, Copilot 코드 리뷰는 13배 배수를 가집니다(GitHub Docs). 같은 버튼, 같은 클릭, 스무 배의 가격. 페이지에서 "배수"를 검색하고 단위당 금액을 신뢰하기 전에 표를 읽으세요.

이월 없는 만료

허용량은 사용하지 않으면 소멸되는 월간 지급이므로, 가벼운 1월이 무거운 2월을 보충해주지 않습니다. GitHub은 명확하게 밝힙니다. 포함된 AI 크레딧은 이월되지 않으며, 매달 1일 00:00:00 UTC에 리셋됩니다(GitHub Copilot Docs). 실질적인 효과는, 대부분의 실제 작업인 폭발적인 작업이 여전히 사용하지 않은 크레딧에 비용을 지불하면서 초과분으로 밀려난다는 것입니다.

기본적으로 초과 허용, 기본적으로 한도 없음

대부분의 도구는 허용량을 초과해도 미터가 계속 돌아가는 상태로 출시되고 지출 한도가 설정되어 있지 않습니다. 즉, 기본 설정이 비싼 것입니다. Cursor는 기본값을 명확히 밝힙니다. 온디맨드 사용량은 포함량이 소진된 후에도 모델을 계속 사용할 수 있게 하며, 후불로 청구됩니다(Cursor). 그 문장에는 상한선이 없습니다. 그 결과가 설문 데이터에 나타나는데, IT 리더 218명 중 78%가 지난 12개월 동안 예상치 못한 AI 기능 또는 소비 요금을 맞았습니다(Zylo).

첫날에 모든 도구에 하드 캡을 설정하세요. 절대 한도에 도달하지 않을 것 같더라도. 2분이면 충분하며, 이 목록에서 여러분이 단독으로 통제할 수 있는 유일한 메커니즘입니다.

실행 후에 공개되는 가격

일부 에이전트는 요청이 얼마나 많은 작업을 필요로 하는지 스스로 결정한 다음 비용이 얼마인지 알려줍니다. 2025년 6월 18일 발표된 Replit의 노력 기반 요금제는 그 판단을 에이전트에게 맡기고 작업이 완료된 후에 가격을 보여주며, 블로그 게시물에서는 단순한 변경이 "일반적으로" $0.25 미만이라고만 약속합니다(Replit). "일반적으로"는 요율을 정의하지 않습니다. 작업당 상한선이 없으면 모호한 프롬프트 하나가 무한 실행으로 이어질 수 있고, 영수증을 받은 후에야 알게 됩니다.

두 개의 미터가 동시에 돌아가다

플랜에는 한도가 두 개 이상 있을 수 있으며, 처리량이 필요한 날에는 더 엄격한 쪽이 이깁니다. Anthropic의 소비자 플랜은 5시간마다 리셋되는 세션 한도와 계정에 연결된 주간 한도를 동시에 운영하며, Claude Code, Claude.ai 채팅, Cowork이 모두 같은 풀에서 사용량을 공유합니다(Claude 요금제). Max 티어는 Pro의 5배, 20배로 설명되는데, 이는 공개된 메시지 수가 아닌 상대적 배수입니다(Claude 요금제). 주간 예산이 충분히 남아 있어도 화요일 오후에 차단될 수 있습니다.

후불 청구

사전 승인 단계가 없으므로, 사용량이 예상을 벗어났다는 첫 번째 신호는 청구서입니다. Cursor는 요금 페이지에 명시합니다. 모든 플랜에는 일정량의 모델 사용량이 포함되며, 그 이상의 온디맨드 사용량은 "후불로 청구됩니다"(Cursor). 후불 청구에 한도 없음과 스스로 노력량을 결정하는 에이전트가 합쳐지면 네 자리 수 요금 폭탄이 발생하는 완전한 조합이 되며, 많은 도구가 세 가지를 모두 갖추고 출시됩니다.

실제 요금 폭탄: 실제 수치로 보는 4가지 시나리오

실제 청구서에서 이런 메커니즘들이 발동했을 때의 비용입니다.

500개 요청이 '$20 사용량'이 된 코딩 구독자

2025년 6월 16일, Cursor는 Pro 플랜의 빠른 요청 500개를 기저 API 요율로 청구되는 "월 $20 상당의 사용량"으로 교체했습니다(Cursor). 동일한 $20 가격. 완전히 다른 수량. Cursor 자체 수치에 따르면 해당 허용량은 중앙값 사용 기준으로 약 225개의 Sonnet 4 요청, 550개의 Gemini 요청, 또는 650개의 GPT-4.1 요청에 해당합니다(Cursor). 가장 유능한 모델로 항상 해오던 방식으로 작업하던 개발자는 습관 하나 바꾸지 않고 월간 볼륨의 절반 이상을 잃었습니다.

후폭풍은 공개적이었습니다. CEO Michael Truell은 "이번 요금 개편을 잘 처리하지 못했음을 인정하며 사과드린다"고 밝혔고, 소통이 "충분히 명확하지 않았으며 많은 분들께 갑작스럽게 다가왔다"고 했습니다. Anysphere는 2025년 6월 16일부터 7월 4일 사이에 발생한 예상치 못한 요금을 환불했습니다(TechCrunch). 환불은 청구서가 실재했기 때문에 존재했습니다. 다음에 이런 방식으로 요금을 재편하는 벤더는 환불을 제공하지 않을 것이라고 가정하세요.

일주일에 $1,000을 쓴 바이브 코더

Replit의 노력 기반 요금제는 에이전트가 요청에 얼마나 많은 작업이 필요한지 결정하게 하고, 완료 후에 가격을 알게 됩니다(Replit). 그 후 Agent 3가 출시되어 요청당 노력이 증가했습니다. 한 사용자는 The Register에 일주일에 $1,000을 소진했다고 말하며 "노력 기반 요금이 이전에는 이렇게 많이 청구되지 않았는데 Agent 3는 유독 높다"고 했습니다(The Register). Replit은 출시 한 달 후 이미 구조적 문제를 인정했습니다. 해당 모델은 "프로젝트 전체 수명에 걸쳐 더 비쌀 수 있다"는 것입니다(The Register). 에이전트가 노력을 통제할 때 모델 업그레이드는 가격 변경이며, 누구도 가격 개편 이메일을 보내지 않습니다.

같은 '성과'에 10배를 지불한 지원 팀

Intercom의 Fin은 성과당 $0.99를 광고합니다. 그 아래 사다리는 두 가지 가격으로 운영됩니다. 해결은 $0.99, 담당자 이관은 $0.99, 잠재 고객 거절은 $0.99, 잠재 고객 자격 확인은 $9.99입니다(Fin). 환불 처리 봇과 같은 봇에 영업 트래픽을 연결하면 가장 원하는 성과에서 혼합 요율이 10배 상승합니다. Intercom이 아닌 헬프데스크에서 Fin을 실행하면 볼륨이 없어도 약 $49.50의 월 최소 50건 성과 요금이 청구됩니다(Fin). 성과 기반 요금으로 판매되는 고객 대면 AI 챗봇을 배포하기 전에, 실제 티켓 구성을 사다리의 각 단계별로 가격을 계산해보세요.

이상 경보가 발동할 수 없는 클라우드 계정

AWS와 Google Cloud 고객들이 보이지 않게 쌓이던 AI 청구서에 놀랐습니다(The Register). 이상 감지는 현재를 기준선과 비교하는 방식으로 작동하는데, 새로운 AI 워크로드에는 기준선이 없습니다. 첫 달 지출은 정의상 정상입니다. 임계값이 의미를 가질 만큼의 이력이 쌓일 때쯤에는 이미 새로운 요율로 두 번의 청구서를 지불한 상태입니다.

감지에 의존하여 급등을 잡는 것보다, 첫날에 하드 예산을 설정하세요.

성과 기반 요금제 안에 숨어 있는 정의 싸움

성과 기반 요금은 공정해 보입니다. AI가 성공했을 때만 비용을 내므로 벤더가 나쁜 모델 운이 빗나갈 위험을 감수합니다. 함정은 벤더가 "성공"의 정의도 작성하며, 그 정의가 헤드라인 요율보다 청구서를 더 크게 결정한다는 것입니다.

침묵이 성공으로 간주될 때

Intercom의 Fin은 규칙을 명확하게 공개하는데, 이는 대부분의 경쟁자보다 낫습니다. 청구 가능한 해결은 "Fin의 마지막 답변 후 추가 도움 요청이 없음"입니다(Fin AI 에이전트 요금제). 청구 트리거로 읽으면 이것은 침묵 감지기입니다. 포기하고, 탭을 닫고, 경쟁사 사이트로 간 고객은 문제가 해결된 고객과 완전히 동일해 보입니다.

요율도 "성과당 $0.99"가 함의하는 것보다 균일하지 않습니다. Fin은 해결에 $0.99, 담당자 이관에 $0.99, 잠재 고객 거절에 $0.99, 잠재 고객 자격 확인에 $9.99를 청구합니다(Fin AI 에이전트 요금제). 단일 성과당 가격 안에 10배의 스프레드가 있으며, 비싼 단계는 영업 팀이 원하는 상호작용에서 발동됩니다. Intercom이 아닌 헬프데스크는 추가로 월 최소 50건 성과 요금이 적용됩니다(Fin AI 에이전트 요금제).

가격 없이 발표된 요금제

Zendesk는 이 모델을 공개적으로 먼저 시도했습니다. 2024년 8월 28일, AI 에이전트에 대한 성과 기반 요금제를 발표하며 고객이 "AI에 의해 자율적으로 해결된 문제에 대해서만 비용이 발생하며" "추가 비용 없이 포함된 시작 사용량"이 있다고 약속했습니다(Zendesk 뉴스룸). 발표에는 해결당 요율도, 자격 요건을 갖춘 해결의 정의도, 시작 허용량의 크기도 없었습니다. 이제 1년이 넘었으니 보도 자료가 아닌 견적서에서 현재 약관을 확인하세요.

성과 기반 에이전트 플랫폼과 계약을 체결하기 전에 네 가지를 계약서에, 서면으로 받아 두세요. 요금이 발생하는 정확한 이벤트, 재개된 티켓이 환불되는지 재청구되는지 여부, 에이전트가 사람에게 에스컬레이션할 때 어떻게 되는지, 그리고 계산할 수 있는 단위로 표시된 포함 허용량의 크기.

담당자가 주문 양식에 해결 정의를 기재하기를 거부한다면, 그것이 요율에 대한 답변이기도 합니다.

구매 전 체크리스트: 카드를 입력하기 전 12가지 질문

먼저 요금 페이지에서 답을 찾으세요. 공개 문서에서 답할 수 없는 것은 영업 담당자에게 물어야 하며, 서면으로 답하기를 거부하면 계약이 어떻게 될지 알 수 있습니다.

미터에 관한 질문

  1. 단위 하나의 달러 가치를 파악하세요. 벤더가 GitHub처럼 교환율을 명시하지 않는다면(AI 크레딧 1개 = $0.01), 아무것도 가격 계산을 할 수 없습니다.
  2. 단위가 모델에 따라 가격이 달라지는지 확인하세요. 모델 배수는 저렴한 광고 요율이 비싼 실제 요율로 전환되는 가장 흔한 경로입니다.
  3. 요청당 단위 수를 누가 결정하는지, 여러분인지 에이전트인지 파악하세요. 에이전트가 결정한다면 가격은 작업이 실행된 후에 공개됩니다.
  4. 미사용 단위가 만료되는지 확인하세요. GitHub의 포함 크레딧은 이월되지 않으며 매달 1일 00:00:00 UTC에 리셋됩니다(GitHub Docs).
  5. 동시에 몇 개의 미터가 돌아가는지 세어보세요. Claude 소비자 플랜은 5시간 세션 한도와 주간 한도를 동시에 운영하며, Claude Code와 채팅이 같은 풀에서 사용합니다(Claude 요금제).

여섯 번째 질문은 구매자들이 건너뛰는 것입니다. 출력 토큰에 무슨 일이 일어나는가. Anthropic의 공시 API 요금에서 출력은 입력의 5배이며, Sonnet 5의 경우 MTok당 $2 대 $10, Opus 5의 경우 $5 대 $25입니다(Claude 요금제). 말이 많은 에이전트 실행은 작성한 내용에 청구됩니다.

상한선에 관한 질문

일곱 번째, 초과분이 기본으로 켜져 있는지, 첫 번째 청구서 전에 끌 수 있는지 여부. 여덟 번째, 하드 캡이 있는지, 소프트 캡인지, 아니면 경고 이메일만 있는지. 아홉 번째, 요금 청구 시점. Cursor는 "온디맨드 사용량은 포함량 소진 후에도 모델을 계속 사용할 수 있게 하며, 후불로 청구됩니다"라고 명시합니다(Cursor 요금제). 사용한 후에야 무엇을 썼는지 알게 된다는 뜻입니다.

열 번째, 팀 내 누군가가 한도를 일방적으로 올릴 권한이 있는지 여부. 사업 부서가 SaaS 지출의 81%를 관리하는 반면 IT는 15%를 직접 관리합니다(Zylo). "한도 증가"를 클릭하는 사람은 대개 청구서를 보는 사람이 아닙니다.

탈출에 관한 질문

열한 번째, 통지 기간, 그리고 중도 해지 시 미사용 크레딧이 환불되는지 무효화되는지 여부. 열두 번째, 청구서가 잘못되었을 때 분쟁 처리 경로와 이의를 제기할 수 있는 기간. Anysphere는 요금 개편이 잘못된 후 2025년 6월 16일부터 7월 4일 사이의 예상치 못한 요금을 환불했지만(TechCrunch), 그것은 선의였으며, 선의는 주문 양식에 나타나지 않습니다.

하나를 결정하기 전에 두세 개의 후보 벤더를 대상으로 12가지를 점검하세요. 18,982개의 리스팅을 요금제별로 검색하여 후보 목록을 만들 수 있으며, 공개 페이지에서 12가지 모두 답하는 도구가 청구서가 요금 페이지와 일치하는 경향이 있습니다.

이미 청구서가 도착했다면: 실제로 할 수 있는 것

카드사에 전화하기 전에 먼저 벤더에게 연락하세요. 대부분의 AI 요금 폭탄은 법적 압력 없이 환불 또는 크레딧으로 처리됩니다. 벤더는 청구 약관이 혼란스러웠음을 알고 있으며, 논쟁하는 것보다 고객을 유지하는 쪽을 선호하기 때문입니다. Cursor는 2025년 6월 16일 요금 변경 후 정확히 그렇게 했습니다. 2025년 6월 16일부터 7월 4일 사이에 발생한 예상치 못한 요금에 대해 환불을 제공하면서 CEO Michael Truell은 소통이 "충분히 명확하지 않았으며 많은 분들께 갑작스럽게 다가왔다"고 공개적으로 밝혔습니다(TechCrunch).

먼저 요청하되, 서면으로

채팅 위젯 대신 이메일로 지원팀에 문의하세요. 나중에 카드사나 주 AG 민원 양식에서 요청할 타임스탬프가 있는 서면 기록이 필요합니다.

첫 번째 메시지에는 네 가지가 포함되어야 합니다. 요금의 정확한 금액과 날짜, 잘못 적용되었다고 생각하는 구체적인 플랜 조항, 해당 금액을 산출한 사용 로그 요청, 그리고 회신 기한. 답을 알고 있다고 생각하더라도 로그를 요청하세요. 소비 기반으로 청구하는 벤더에게는 거의 항상 요청별 기록이 있으며, 공유를 거부하는 벤더는 미터에 대해 무언가를 알려주는 것입니다.

지원팀이 거절하면, 요금을 분쟁하기 전에 담당 영업 대표에게 에스컬레이션하세요. 분쟁은 계정을 정지시키며, 논쟁이 진행되는 동안에도 도구가 계속 실행되어야 할 수 있습니다.

클릭 취소 규정이 폐지된 후 법적 상황

FTC의 부정 옵션 규칙("클릭 취소" 규칙)은 사라졌습니다. 제8순회법원이 2025년 7월 절차적 이유로 전면 폐기했습니다(Cooley). 따라서 이 규칙이 부과했을 특정 취소 절차 요건은 귀사의 벤더에 적용되지 않습니다.

그래도 실질적인 근거는 있습니다. ROSCA, FTC법 제5조, 약 30개 주의 자동 갱신법이 판결의 영향을 받지 않고 살아남았으며, 연방 및 주 규제 당국은 공개되지 않거나 오해를 줄 수 있는 반복 요금에 대한 집행을 계속할 것으로 예상됩니다(WilmerHale). 주 AG 민원은 15분이면 제출할 수 있으며, 대부분의 사람이 예상하는 것보다 빠르게 벤더의 법무팀에 전달됩니다.

기다림이 진짜 전략이 될 수 있는 이유

단위 경제학이 여러분에게 유리하게 움직이고 있습니다. Epoch AI는 LLM 추론 가격 하락이 측정하는 능력 벤치마크에 따라 연간 9배에서 900배까지라고 추정했으며, GPT-4 수준의 과학 성능은 연간 약 40배 하락합니다(Epoch AI, 2025년 2월까지의 데이터). 즉, 2025년에 벤더가 판매한 크레딧 허용량은 지금 제공하는 데 훨씬 적은 비용이 든다는 뜻입니다. 갱신 시 이 점을 제시하고 같은 가격에 더 많은 포함 사용량을 요청하세요. 합리적인 요청이며, 시트를 잃는 것보다 벤더에게 더 저렴합니다.

자주 묻는 질문

AI 크레딧과 토큰의 차이는 무엇인가요?

토큰은 모델이 실제로 소비하는 단위이며, 벤더는 토큰 요금을 직접 공개합니다. Claude의 API에는 Sonnet 5가 입력 100만 토큰당 $2, 출력 100만 토큰당 $10, Opus 5는 $5/$25, Fable 5.1은 $10/$50로 나열되어 있으며, 출력은 전 라인업에서 입력의 5배입니다(Claude 요금제). 크레딧은 토큰 위에 겹쳐진 벤더 화폐로, 달러 가치는 고정될 수 있지만 작업 가치는 변동합니다. GitHub은 AI 크레딧 1개를 정확히 $0.01로 고정합니다(GitHub 청구 문서). 그러나 포함 허용량을 초과하면 해당 크레딧은 모델에 따라 다른 토큰당 요율로 소비됩니다(GitHub 모델 및 요금제). 같은 크레딧이어도 가리킨 모델에 따라 작업량이 크게 달라집니다.

미사용 AI 크레딧은 다음 달로 이월되나요?

보통은 이월되지 않습니다. GitHub은 포함된 AI 크레딧은 월 간 이월되지 않으며 매달 1일 00:00:00 UTC에 리셋된다고 명확히 밝힙니다(GitHub 청구 문서). 즉, Copilot Pro 구독자의 $10/월에 포함된 1,500 크레딧은 사용하지 않으면 소멸됩니다. 가끔 있는 무거운 주를 위해 더 큰 티어를 구매하기 전에 만료 조항을 확인하세요. 매달 정해진 일정에 증발하는 여유분에 매월 비용을 지불하는 것입니다. 플랜에 포함된 크레딧보다 선불 충전 크레딧이 더 긴 유효 기간을 가질 수 있으므로, 두 정책을 별도로 읽으세요.

AI 코딩 어시스턴트 청구서가 구독 가격보다 높은 이유는 무엇인가요?

구독이 허용량을 구매하는데, 그 허용량이 여러분이 통제할 수 없는 요율로 모델 작업으로 전환되는 달러 또는 요청으로 표시되기 때문입니다. Cursor가 2025년 6월 16일 $20/월 Pro 플랜을 빠른 요청 500개에서 "$20 상당의 사용량"으로 변경했을 때, 자체 게시물에서는 이를 중앙값 사용 기준 약 225개의 Sonnet 4 요청 또는 650개의 GPT-4.1 요청으로 산정했습니다(Cursor 블로그). 모델 배수도 GitHub의 레거시 요청 기반 청구에서 동일한 효과를 냅니다. 초과분은 프리미엄 요청당 $0.04였지만 고급 추론 모델은 5배 또는 20배를 소비하여 요청 하나가 $0.20 또는 $0.80이 되고, Copilot 코드 리뷰는 13배 배수가 적용됩니다(GitHub 배수 참고). AI 코딩 어시스턴트를 비교한다면, 실제로 사용할 모델의 가격을 계산하세요.

AI 요금 페이지의 '후불 청구'란 무엇을 의미하나요?

사전 승인 없이 사용 후에 요금이 부과된다는 의미입니다. Cursor의 요금 페이지는 명확하게 설명합니다. "모든 플랜에는 일정량의 모델 사용량이 포함됩니다. 온디맨드 사용량은 포함량 소진 후에도 모델을 계속 사용할 수 있게 하며, 후불로 청구됩니다"(Cursor 요금제). 사전 승인 단계도, 문구에 내포된 상한선도 없습니다. 처음 숫자를 보는 것은 청구서에서입니다. 218명의 IT 리더 조사에서 78%가 지난 12개월 동안 예상치 못한 AI 기능 또는 소비 요금을 맞았고, 61%는 계획되지 않은 SaaS 비용 증가로 인해 예정된 프로젝트를 취소했습니다(Zylo 2026 SaaS 관리 지수).

AI 도구 사용에 하드 지출 한도를 설정할 수 있나요?

드물게 가능하며, 기본값으로는 거의 불가능합니다. 2025년 6월 18일 발표되어 2025년 7월 1일 Core 및 Teams 구독자에게 출시된 Replit의 노력 기반 요금제는 에이전트가 요청에 필요한 노력을 결정하게 하고 작업이 완료된 후에만 가격을 보여주며, 블로그는 단순한 변경이 "일반적으로 $0.25 미만"이라고만 약속합니다(Replit 블로그). 2025년 9월 10일 Agent 3가 출시된 후, 한 사용자는 The Register에 일주일에 $1,000을 소진했다고 밝혔습니다(The Register). 끊김 없는 처리량보다 하드 상한선이 더 중요하다면, 초과 청구 대신 스로틀링하는 플랜이 더 안전한 형태입니다. Anthropic의 소비자 플랜은 5시간 세션 한도와 주간 한도를 동시에 운영하며, Claude Code, Claude.ai 채팅, Cowork이 하나의 풀에서 사용합니다(Claude 요금제). 그렇지 않다면, 예산 경보를 직접 설정하고 벤더 한도는 켜서 테스트하기 전까지 선택 사항으로 취급하세요.

성과 기반 AI 요금제가 시트당 요금제보다 저렴한가요?

낮은 볼륨에서만, 그리고 성과로 간주되는 것이 무엇인지 파악한 후에만 그렇습니다. Intercom의 Fin은 성과당 $0.99를 광고하지만, 사다리는 두 가지 가격으로 운영됩니다. 해결, 절차적 이관, 잠재 고객 거절은 각각 $0.99이고, 잠재 고객 자격 확인은 $9.99로 단일 헤드라인 가격 안에 10배의 스프레드가 있으며, Intercom이 아닌 헬프데스크에는 월 최소 50건 성과 요금이 적용됩니다(Fin 요금제). Fin은 또한 청구 가능한 해결을 "Fin의 마지막 답변 후 추가 도움 요청이 없음"으로 정의하므로, 확인된 문제 해결이 아닌 고객의 침묵에 비용을 지불하는 것입니다(Fin 요금제). Zendesk는 2024년 8월 28일 AI 에이전트 성과 기반 요금제를 발표하면서 해결당 요율, 자격 요건을 갖춘 해결의 정의, 포함 허용량의 크기를 공개하지 않았습니다(Zendesk 뉴스룸). 계약에 서명하기 전에 계약서에 정의와 요율을 받아 두어야 할 좋은 이유입니다.

광고 가격 $20/월이 모델 배수, 크레딧 만료, 기본 초과 허용, 후불 청구 게이트를 통과하여 최종 청구서에 도달하는 5단계 파이프라인.

이어서 읽기

2026년 오픈소스 AI vs SaaS총 비용, 제어권, 그리고 전환 손익 계산업계 인사이트2026년 셀프 호스팅 오픈소스 AI vs SaaS의 완전한 TCO: GPU 요율, 유지보수 시간, 4가지 모달리티별 손익분기점, 컴플라이언스 이점 및 마이그레이션 경로.2026년 9월 18일22분 분량글 읽기재무 및 회계에서의 AI2026년에 실제로 효과가 있는 것업계 인사이트조정, 예측, 경비 코딩, 감사 준비: 2026년에 실질적인 ROI를 창출하는 AI 재무 워크플로우, 벤더를 걸러내는 통제 기준, 그리고 주요…2026년 9월 10일19분 분량글 읽기2026년 법률 업무의 AI위험 없이 계약서, 조사, 컴플라이언스 처리하기업계 인사이트벤치마크가 AI가 변호사를 앞서는 부분과 뒤처지는 부분을 보여줍니다. 2026년 제재 사례, Rule 11 검증 워크플로, 특권을 보호하는 벤더 조항을 다룹니다.2026년 9월 9일18분 분량글 읽기무료 AI 툴의 진짜 비용프리미엄 함정, 데이터 비용, 그리고 언제 유료로 전환해야 하는가업계 인사이트하드 캡, 데이터 학습 기본값, 워터마크, 라이선스 잠금 — 무료 AI 툴의 진짜 제한과 유료 전환 시점을 알려주는 세 가지 신호.2026년 9월 7일19분 분량글 읽기AI 툴 스택 감사기능 손실 없이 구독 비용 절감하기업계 인사이트반복 가능한 AI 툴 스택 감사: 실제 결제 내역을 인벤토리화하고, 19가지 툴 유형과 비교하여 중복 구독을 기능 손실 없이 삭제하세요.2026년 9월 6일19분 분량글 읽기어떤 AI 도구를 믿을 수 있을까?실용적인 개인정보 보호 프레임워크업계 인사이트AI 개인정보 실무 체크리스트: 학습 옵트아웃, 실제 보존 기간, SOC 2 대 마케팅 주장, EU 거주지 예외, 4단계 신뢰 모델.2026년 9월 5일19분 분량글 읽기의료 분야의 AI2026년에 실제로 작동하는 것업계 인사이트2026년 의료 AI를 냉정하게 들여다본다 — 실제로 도입되어 작동하는 것(임상 기록 보조, 문헌 조사, 행정 자동화)과 여전히 과장 광고에 머무는 것.2026년 8월 24일8분 분량글 읽기이커머스를 위한 AI2026년 판매자 도구 모음업계 인사이트2026년 이커머스 AI를 판매자의 손익계산서에 대응시켜 정리한다 — 카탈로그 콘텐츠, 제품 이미지, 고객 지원, 광고 — 그리고 '천편일률'이 왜 진짜 위험이 되었는지.2026년 8월 14일10분 분량글 읽기