큐웬삼점팔맥스·키미케이쓰리·딥시크브이포 청구서 맞추기는 요금제 금액이나 토큰 단가를 나란히 놓는 방식으로 끝내면 안 됩니다. 이번 주에는 세 모델의 사용 기록을 같은 과제에 연결하고, 성공적으로 완료된 과제 하나당 실제 비용으로 다시 계산하는 것이 맞습니다.
이 글은 세 모델을 시험 중인 독립 개발자, 에이피아이 예산과 구매를 담당하는 기술 책임자, 프로그래밍 또는 자동화 에이전트를 운영하는 팀을 위한 글입니다. 단순한 모델 순위가 아니라, 서로 다른 청구 단위를 하나의 비용 기준으로 바꾸는 방법에 집중합니다.
마지막 업데이트: 2026년 8월 8일. 모델 상태와 청구 규칙은 큐웬 공식 토큰 요금제 문서, 키미 공식 에이피아이 요금 안내, 딥시크 공식 가격 문서에서 확인했습니다.
비교 기준을 성공 과제로 고정하기
월 구독료, 크레딧 소모량, 입력 토큰 단가는 각각 다른 사실을 말합니다. 구독료는 이용 권한의 가격이고, 크레딧은 특정 서비스 내부의 사용량 단위이며, 토큰 단가는 호출 단위의 가격입니다. 따라서 이 세 항목만 보고 어느 모델이 싸다고 결론 내리면 다음 문제가 생깁니다.
- 한 과제를 여러 번 호출했지만 마지막 성공 응답만 비용에 포함합니다.
- 긴 입력이 캐시 적중인지 미적중인지 구분하지 않습니다.
- 모델 출력 뒤에 발생한 도구 호출과 후속 검증을 제외합니다.
- 실패한 요청과 시간 초과 후 재시작된 요청을 별도 비용으로 기록하지 않습니다.
- 체험 가격이나 기간 한정 할인으로 장기 예산을 계산합니다.
공통 분모는 다음처럼 잡아야 합니다.
성공 과제당 유효 비용 = 해당 과제를 완료할 때 발생한 전체 비용 ÷ 성공 판정된 과제 수
여기서 전체 비용에는 입력, 캐시 입력, 출력, 검색이나 외부 도구 호출, 실패 요청, 재시도, 후속 검증 요청을 모두 포함합니다. 성공 판정은 모델이 답변을 반환했는지가 아니라, 팀이 정한 테스트를 통과했는지로 정해야 합니다.
비용 정합성 점수는 다음처럼 판단할 수 있습니다.
- 높음: 원본 사용량과 성공 여부가 한 기록에 연결됩니다.
- 중간: 사용량은 있지만 재시도나 도구 비용이 일부 빠져 있습니다.
- 낮음: 구독료나 표시 단가만 있고 완료 과제 수가 없습니다.
큐웬삼점팔맥스 크레딧의 해석 범위
큐웬삼점팔맥스가 포함된 큐웬 토큰 요금제는 여러 모델과 도구를 하나의 크레딧 체계로 묶습니다. 공식 문서는 개인 요금제가 5시간 단위와 7일 단위의 크레딧 한도를 사용하며, 팀 요금제는 월별 크레딧을 사용한다고 설명합니다. 미사용 한도는 다음 기간으로 이월되지 않습니다. (docs.qwencloud.com)
공식 문서에는 개인 요금제의 가격, 크레딧 한도, 동시 에이전트 수가 함께 표시되지만, 크레딧을 토큰 수로 환산하는 고정 비율은 제시되지 않습니다. 예를 들어 공식 페이지에 개인 요금제의 한시 가격과 크레딧 묶음이 표시되어도, 이를 곧바로 “백만 토큰당 비용”으로 바꾸면 안 됩니다. 크레딧이 텍스트 생성뿐 아니라 검색, 코드 해석, 이미지와 음성 기능에도 쓰일 수 있기 때문입니다. (docs.qwencloud.com)
큐웬삼점팔맥스 크레딧을 백만 토큰 비용으로 바꿀 수 있습니까?
공식 환산 비율이 공개되지 않았다면 장기 예산에서는 바꾸지 않는 것이 안전합니다. 대신 다음 세 값을 별도로 기록합니다.
- 결제한 요금제 또는 크레딧 묶음의 금액
- 해당 과제에서 실제로 줄어든 크레딧
- 같은 과제의 성공 여부와 완료까지 걸린 호출 수
계산식은 다음과 같이 둡니다.
크레딧 기준 성공 과제 비용 = 사용한 크레딧 ÷ 성공 과제 수
미리보기 모델과 정식 모델이 함께 표시된다면 모델 이름, 모델 식별자, 사용 기간, 크레딧 소모 기록을 분리해야 합니다. 미리보기 할인이나 특정 시간대 혜택을 정식 운영 비용에 섞지 않는 것도 중요합니다. 큐웬삼점팔맥스의 체험 기록은 큐웬 관련 사용 가이드처럼 별도 실험 기록으로 관리하는 편이 낫습니다.
키미케이쓰리와 딥시크브이포의 토큰 항목
키미 에이피아이는 입력 토큰과 출력 토큰을 따로 청구하고, 캐시 적중 입력에는 별도 할인 단가를 적용합니다. 키미 공식 안내는 키미케이쓰리가 백만 토큰 규모의 문맥을 지원하며, 문맥 길이에 따른 구간별 요금이 아니라 입력 적중, 입력 미적중, 출력 기준으로 계산된다고 설명합니다. 웹 검색 같은 부가 기능은 토큰 사용량과 별도로 청구될 수 있습니다. (kimi.com)
따라서 키미케이쓰리 기록에는 다음 항목을 넣어야 합니다.
- 모델 식별자
- 캐시 적중 입력 토큰
- 캐시 미적중 입력 토큰
- 출력 토큰
- 검색과 같은 추가 기능 호출
- 실패 요청과 재시도 횟수
- 최종 성공 여부
딥시크 공식 가격 문서는 딥시크브이포 플래시와 프로를 구분하고, 입력 캐시 적중, 입력 캐시 미적중, 출력 토큰을 각각 표시합니다. 현재 문서에 표시된 단가는 플래시가 백만 토큰당 캐시 적중 입력 0.0028달러, 미적중 입력 0.14달러, 출력 0.28달러이며, 프로는 각각 0.003625달러, 0.435달러, 0.87달러입니다. 가격 변경 가능성도 공식 문서에 명시되어 있으므로 예산 파일에는 확인 날짜를 함께 남겨야 합니다. (api-docs.deepseek.com)
딥시크브이포의 캐시 적중 여부는 추정값으로 만들면 안 됩니다. 응답 사용량에 포함된 prompt_cache_hit_tokens와 prompt_cache_miss_tokens를 기준으로 기록해야 합니다. 공식 캐시 문서는 앞부분이 완전히 재사용되는 경우에만 적중으로 계산될 수 있고, 캐시 적중이 항상 보장되는 것은 아니라고 설명합니다. (api-docs.deepseek.com)
키미케이쓰리와 딥시크브이포의 캐시 비용은 어떻게 맞춥니까?
두 모델의 가격표를 섞지 말고, 같은 입력을 다음 세 상태로 나누어 실행합니다.
- 처음 문서를 보내는 냉시작
- 같은 시스템 지침과 문서를 다시 보내는 연속 대화
- 문서 중간이나 앞부분이 바뀐 상태
그 뒤 캐시 적중 입력, 미적중 입력, 출력량을 각각 비교합니다. 캐시 적중률이 높은 모델이 항상 싸지는 않습니다. 출력이 길거나 검증 요청이 많으면 입력 비용 절감분을 쉽게 상쇄할 수 있습니다.
긴 문서와 코드 저장소의 비용 변화
긴 문서 작업에서는 입력 토큰만 세면 안 됩니다. 동일한 문서가 여러 요청에 반복되는지, 요청마다 앞부분이 동일한지, 답변이 길어져 다음 요청의 문맥에 다시 포함되는지를 함께 확인해야 합니다.
저장소 분석도 같은 방식입니다. 첫 요청에서 전체 파일 목록과 규칙을 보내고, 두 번째 요청에서 같은 내용을 재사용하면 캐시 기회가 생길 수 있습니다. 그러나 파일 순서, 시스템 지침, 앞부분의 주석이 달라지면 캐시가 깨질 수 있습니다. 딥시크 공식 문서 역시 캐시가 입력의 접두부를 기준으로 작동하며, 부분적으로만 겹치는 내용은 자동 적중으로 보지 않는다고 안내합니다. (api-docs.deepseek.com)
실무에서는 문서를 세 덩어리로 나누어 기록합니다.
- 거의 변하지 않는 시스템 지침과 프로젝트 규칙
- 자주 재사용되는 코드나 문서 본문
- 요청마다 달라지는 질문과 변경 파일
첫 번째와 두 번째 덩어리는 고정하고 세 번째만 바꾸면 캐시 성능을 관찰하기 쉽습니다. 반대로 질문마다 전체 문서를 다시 요약해 넣는다면 캐시 비용보다 출력 비용과 전처리 비용이 커질 수 있습니다.
에이전트 재시도와 도구 호출
프로그래밍 에이전트의 비용이 가격표보다 높아지는 가장 흔한 이유는 한 번의 답변을 한 번의 과제로 착각하기 때문입니다. 실제 과제는 계획 생성, 파일 탐색, 코드 수정, 테스트 실행, 오류 분석, 재수정, 최종 검증으로 이어집니다.
프로그래밍 에이전트의 비용이 가격표보다 높은 이유는 무엇입니까?
모델이 한 번 응답한 비용이 아니라, 성공 판정까지 연결된 전체 호출 묶음을 계산하기 때문입니다. 테스트 실패로 모델이 다시 호출되거나, 도구 시간 초과 후 같은 작업을 재실행하면 모두 같은 과제의 비용입니다.
다음 항목은 모델 비용과 도구 비용을 분리해 기록해야 합니다.
- 모델 입력과 출력 토큰
- 검색, 브라우저, 코드 실행 같은 도구 호출
- 도구 오류 뒤의 재시도
- 시간 초과 후 재개된 요청
- 사람이 승인한 뒤 발생한 추가 호출
- 최종 테스트 통과 여부
이렇게 기록하면 단일 호출 단가가 낮은 모델이 실제 에이전트 운영에서는 더 비싸지는 경우도 확인할 수 있습니다. 비교 대상은 “응답 하나의 가격”이 아니라 “완료된 작업 하나의 총 소모량”입니다.
조건별 모델 선택 기준
다음 결정 점검 목록을 사용하면 데이터가 충분하지 않은 상태에서 세 모델을 강제로 전체 순위로 배열하는 실수를 줄일 수 있습니다. 해당되는 항목을 모두 확인한 뒤, 마지막으로 비용 기록의 완성도를 판정합니다.
- [ ] 크레딧 사용량은 확인되지만 토큰 환산 비율이 없다면 큐웬삼점팔맥스는 크레딧 기준 성공 과제 비용으로만 비교합니다. 토큰 단가로 환산하지 않습니다.
- [ ] 입력 문서가 반복되고 캐시 사용량이 에이피아이 응답에 표시된다면 키미케이쓰리와 딥시크브이포를 냉시작, 연속 대화, 문서 변경 상태로 나누어 비교합니다.
- [ ] 캐시 적중 기록이 없거나 입력 접두부가 자주 바뀐다면 캐시 할인은 예산에서 제외하고 미적중 입력 기준으로 보수적으로 계산합니다.
- [ ] 프로그래밍 에이전트의 재시도와 도구 오류가 많다면 단일 호출 단가가 아니라 성공 과제당 총비용이 낮은 모델을 선택합니다.
- [ ] 도구가 별도 비용을 발생시킨다면 모델 토큰 비용과 도구 비용을 합치지 않고 두 항목으로 따로 관리합니다.
- [ ] 일주일치 동일 과제 기록이 10건 미만이라면 최종 구매 결정을 미루고 병렬 시험을 계속합니다.
- [ ] 비용 변동, 데이터 통제, 서비스 연속성이 팀의 허용 범위를 넘는다면 공개 가중치 모델의 자체 운영과 클라우드 맥 환경을 별도 평가합니다.
- [ ] 장기적으로 일정한 고부하나 물리 장치 연결이 필요하다면 맥 렌탈보다 자체 장비나 전용 서버가 더 적합할 수 있습니다.
점검 결과에서 첫 번째부터 다섯 번째 항목까지 충분히 기록되었다면 성공 과제당 비용을 구매 판단에 사용할 수 있습니다. 반대로 캐시 상태, 재시도, 성공 판정 중 하나라도 빠졌다면 해당 모델의 단가를 최종 순위에 사용하지 않고 추가 시험으로 되돌아가야 합니다.
일주일 사용 기록으로 구매 결정을 내리는 절차
다음 순서로 진행하면 체험 청구서를 구매 판단 자료로 바꿀 수 있습니다.
- 세 모델에 동일한 입력, 동일한 도구 권한, 동일한 완료 조건을 적용합니다.
- 요청마다 모델 식별자와 호출 시각을 저장합니다.
- 입력, 캐시 적중 입력, 캐시 미적중 입력, 출력을 별도 열로 기록합니다.
- 도구 호출, 실패, 시간 초과, 재시도 횟수를 추가합니다.
- 과제별로 성공 또는 실패를 판정하고, 실패한 과제의 누적 비용도 남깁니다.
- 모델별 총비용을 성공 과제 수로 나눕니다.
- 냉시작, 연속 대화, 코드 저장소, 에이전트 작업을 분리해 비용 분포를 확인합니다.
저빈도 체험이 중심이면 구독료보다 실제 크레딧 이용률을 먼저 봅니다. 이용률이 낮으면 더 비싼 요금제로 올리지 않습니다. 안정적인 고빈도 호출이면 입력 단가가 아니라 성공 과제당 비용을 선택 기준으로 둡니다. 긴 문서와 반복 대화가 많으면 캐시 적중률과 출력 길이를 함께 봅니다. 프로그래밍 에이전트가 중심이면 재시도와 도구 호출이 적은 모델을 우선 검토합니다.
자료가 부족하면 세 모델 중 하나를 미리 1위로 정하지 말고 같은 과제를 병렬 실행합니다. 비용 변동, 데이터 통제, 서비스 연속성이 허용 범위를 넘으면 공개 가중치 모델의 자체 운영과 클라우드 맥 환경을 별도 검토합니다.
자체 운영 여부를 검토할 때는 클라우드 맥 환경의 에이전트 배포 조건도 함께 확인할 수 있습니다. 다만 장기적으로 일정한 고부하를 처리하거나 물리 장치 연결이 필요한 팀이라면 맥 렌탈보다 자체 서버가 더 적합할 수 있습니다.
현재 방식인 단순 가격표 비교는 크레딧과 토큰의 기준이 다르고, 캐시와 재시도를 숨기며, 실제 성공률과 도구 비용을 반영하지 못한다는 단점이 있습니다. 반면 JexMac의 클라우드 맥 환경을 사용하면 같은 실행 환경에서 에이전트를 반복 검증하고, 일주일치 사용 기록과 작업 성공 로그를 한 흐름으로 모으기 쉽습니다. 특히 비용 자체보다 실행 환경의 연속성, 재현 가능한 테스트, 자체 운영 전 검증이 중요한 경우에는 먼저 JexMac 이용 조건을 확인한 뒤 실제 청구서 정규화를 진행하는 편이 더 현실적입니다.
이번 주에는 먼저 세 모델의 에이피아이 사용 내역과 성공 과제 기록을 일주일치 내보내십시오. 그 기록을 입력, 캐시, 출력, 도구, 재시도, 성공 여부로 나누어 한 번만 정리하면, 어떤 모델이 가장 싸다는 막연한 결론보다 현재 팀의 작업에서 어떤 비용이 반복되는지 먼저 확인할 수 있습니다.
인공지능 작업 비용을 직접 검증할 전용 맥을 JexMac으로 마련하세요
가상화와 자원 공유가 없는 맥 미니 엠포 전용 베어메탈에서 모델 비교와 반복 작업을 안정적으로 실행할 수 있습니다.