며칠 전 알리바바 클라우드에서 새로운 토큰 플랜을 봤습니다. 개인용 스탠더드가 월 18달러고, 최신 qwen3.8-max-preview까지 들어 있더라고요.
저는 최근 Claude Max와 Fable 5의 가격 정책을 보면서 마음이 많이 떠난 상태였습니다. “월 200달러를 계속 내는 대신, Qwen을 GPT와 병행하면 어떨까?“라는 생각이 자연스럽게 들었어요. 결국 스탠더드 플랜을 바로 결제했습니다.
첫인상은 꽤 좋았습니다. 응답이 빨랐고, Qwen 3.8 Preview의 코드 품질도 생각보다 나쁘지 않았어요. 그런데 한 세션을 계속 돌리니 속도가 점점 들쭉날쭉해졌고, 약 3시간 만에 5시간 한도인 3,000크레딧을 모두 소진했습니다.
모델은 기대 이상인데 상품 이름과 연동 구조는 예상보다 훨씬 복잡했습니다.
여기서 OMP는 오마이파이(Oh My Pi)를 줄여 부르는 이름입니다. Pi를 기반으로 여러 AI 모델과 개발 도구를 묶어 쓰는 터미널 코딩 에이전트인데, 이번에는 여기에 알리바바 Token Plan을 연결해보려 했습니다.

Qwen 3.8 코드 품질은 괜찮았지만 OMP 전용 연동은 없었고, 3,000크레딧은 약 3시간 만에 소진됐습니다.
먼저 핵심부터 정리하면
제가 직접 결제하고 연동을 시도하면서 확인한 핵심은 네 가지입니다.
- API 연동 기준으로 보면 Alibaba Cloud Token Plan과 QwenCloud Token Plan은 같은 상품에 가깝습니다.
- Alibaba Coding Plan은 다릅니다. 이름은 비슷해도 Token Plan과는 별도 구독입니다.
- Qwen 3.8 Preview의 코드 품질은 괜찮았습니다. 대신 응답 속도는 일정하지 않았어요.
- 제가 사용하는 OMP 17.0.8에는 아직 Token Plan 전용 로그인이 없습니다.
여기서 제일 헷갈렸던 건 첫 번째와 두 번째였습니다. 같은 회사와 같은 모델 이름이 계속 나오는데, 결제 통로와 API 주소는 따로 놀거든요.
Alibaba Cloud와 QwenCloud, 같은 토큰 플랜인가요?
공식 문서를 대조해보면 두 사이트의 개인용 토큰 플랜은 다음 항목이 같습니다.
- 라이트, 스탠더드, 프로의 가격과 크레딧
sk-sp-로 시작하는 전용 API 키- OpenAI 호환 API 주소
- Anthropic 호환 API 주소
qwen3.8-max-preview를 포함한 모델 구성- 5시간·7일 크레딧 제한
OpenAI 호환 주소도 정확히 같습니다.
https://token-plan.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1
QwenCloud는 이름과 구매·관리 화면을 따로 씁니다. 계정과 결제 관리까지 내부적으로 완전히 같은지는 제가 확인하지 못했습니다. 다만 코딩 에이전트에 API를 붙이는 입장에서는 엔드포인트와 키 형식, 플랜 구조가 모두 같습니다. 제가 써본 범위에서는 같은 Token Plan으로 봐도 무리가 없었습니다.

Alibaba Cloud 캠페인 페이지는 월간 예상 크레딧과 동시 실행 에이전트 수를 중심으로 설명합니다. (출처: Alibaba Cloud)

QwenCloud 페이지에서는 같은 가격과 함께 5시간·7일 고정 구간 한도를 더 직접적으로 보여줍니다. (출처: QwenCloud)
두 화면을 나란히 놓으면 가격과 한도가 그대로 겹칩니다. 상품 구조는 같고 브랜드만 다르게 보였습니다.
코딩 플랜과 토큰 플랜은 뭐가 다른가요?
이름 때문에 같은 구독의 등급 차이처럼 보이지만 실제로는 별도 상품입니다.
| 구분 | Alibaba Coding Plan | Alibaba·QwenCloud Token Plan |
|---|---|---|
| 주된 용도 | 대화형 코딩 도구 | 코딩 에이전트와 텍스트·이미지·영상 모델 |
| 사용량 단위 | 모델 호출 횟수 | 모델별 차감 계수가 적용된 크레딧 |
| 국제판 API 주소 | coding-intl.dashscope.aliyuncs.com | token-plan.ap-southeast-1.maas.aliyuncs.com |
| 모델 구성 | 정확한 허용 목록 | 플랜별 모델 목록 |
| Qwen 3.8 Preview | 지원 목록에 없음 | 지원함 |
현재 Coding Plan 공식 문서는 qwen3.7-plus, qwen3.6-plus, kimi-k2.5, glm-5, MiniMax-M2.5 등을 정확한 문자열 허용 목록으로 제시합니다. 목록에 없는 모델은 호환 버전으로 추정하지 말라고까지 적혀 있어요.
따라서 OMP의 기존 Alibaba Coding Plan 제공자에 Token Plan 키를 넣는다고 qwen3.8-max-preview가 열리지는 않습니다. 전용 키와 API 주소, 모델 목록이 모두 맞아야 구독 크레딧에서 정상 차감됩니다.
개인용 스탠더드 18달러를 직접 써봤습니다
실제 제한을 가르는 건 월간 예상치가 아니라 5시간과 7일 구간입니다.
| 플랜 | 월 요금 | 5시간 한도 | 7일 한도 | 권장 동시 에이전트 |
|---|---|---|---|---|
| 라이트 | 6달러 | 700크레딧 | 2,500크레딧 | 1~2개 |
| 스탠더드 | 18달러 | 3,000크레딧 | 10,000크레딧 | 3~4개 |
| 프로 | 68달러 | 12,000크레딧 | 40,000크레딧 | 6~8개 |
개인용 토큰 플랜은 첫 호출부터 5시간·7일 타이머가 같이 돕니다. 한도에 닿으면 각 구간이 초기화될 때까지 호출할 수 없고, 남은 크레딧도 다음 구간으로 넘어가지 않습니다.
저는 스탠더드의 3,000크레딧을 한 세션에서 약 3시간 만에 모두 썼습니다. 단순 환산하면 시간당 약 1,000크레딧입니다. 이 속도라면 스탠더드의 7일 한도는 약 10시간, 프로의 7일 한도는 약 40시간 분량이에요.
프로로 올릴지 꽤 고민했습니다. 주 5일 동안 하루 8시간씩 에이전트를 돌리면 프로도 딱 40시간입니다. 병렬 에이전트를 쓰거나 문맥이 길어져 차감량이 늘면 여유가 거의 없을 수 있어요.
Qwen 3.8 Preview의 코드 품질은 괜찮았습니다
벤치마크를 돌린 것은 아닙니다. 제가 하던 코드 작업에 직접 넣어본 체감만 말하면, Qwen 3.8 Preview의 코드 품질은 기대보다 괜찮았습니다.
지시를 크게 벗어나지 않았고, 수정 방향도 엉뚱하지 않았습니다. “싼 중국 모델이니 초벌 작업만 맡겨야겠다"는 느낌보다는, 주력 후보로 조금 더 써보고 싶다는 쪽에 가까웠어요.
다만 속도 평가는 바뀌었습니다. 처음 몇 번은 상당히 빨랐는데 같은 세션을 계속 쓰니 응답 지연이 커졌습니다. 긴 문맥 누적 때문인지, 프리뷰 모델의 서버 부하 때문인지는 아직 분리하지 못했어요. 새 세션과 장기 세션을 같은 시간대에 비교해봐야 알 수 있는 부분입니다.
코드 품질은 괜찮았지만, 낮은 지연시간이 계속 유지된다고 말하기에는 아직 이릅니다.
공식 문서에 따르면 Qwen 3.8 Preview는 현재 프로모션 기간에 일반 차감량의 10% 수준으로 크레딧을 사용할 수 있고, 특정 야간 시간에는 추가 할인도 적용됩니다. 이 혜택은 프리뷰 종료 후 바뀌거나 사라질 수 있으므로 현재 사용량을 장기 기준으로 그대로 환산하면 안 됩니다.
OMP에서는 왜 바로 연결되지 않을까요?
제가 사용하는 OMP 17.0.8의 로그인 목록에는 Alibaba Coding Plan과 Qwen Portal이 있지만 Alibaba Token Plan은 없습니다.
Qwen Portal도 대체 경로가 아닙니다. OMP 소스에서 Qwen Portal은 https://portal.qwen.ai/v1과 coder-model을 사용합니다. Token Plan의 API 주소와 모델 목록은 완전히 다릅니다.
커스텀 OpenAI 호환 제공자에 Token Plan 주소를 넣는 데까지는 됐습니다. 막힌 건 그다음이었어요. 제 구성에서는 qwen3.8-max-preview를 OMP 모델로 정상 선택해 쓰지 못했습니다. 결국 모델별 호환 설정과 카탈로그를 아는 전용 제공자가 필요했습니다.
OMP 저장소에는 Alibaba Cloud Token Plan 지원 요청이 열려 있습니다. 저도 국제판 개인용·팀용 플랜과 Qwen 3.8 Preview가 필요하다는 실사용 내용을 보탰습니다. 아직은 요청 단계입니다. 이 글을 쓰는 시점에는 내장 지원이 끝나지 않았습니다.
Claude Max에서 마음이 떠난 이유도 큽니다
저는 원래 Claude를 꽤 많이 썼습니다. 모델 품질만 놓고 보면 Fable 5도 할당량을 다 쓸 만큼 좋았어요.
문제는 가격과 정책이었습니다. Fable 5 구독 포함 기간이 두 번 연장됐던 과정에서 저는 월 100달러 요금제를 한 번 더 결제했고, 종료일이 다시 바뀌자 200달러 Max로 올리지 않기로 했습니다.
좋은 모델과 예측 가능한 구독 정책은 별개입니다.
지금은 Claude Max 200달러를 유지할 생각보다 Qwen Token Plan과 GPT를 나눠 쓸 생각이 더 큽니다. 대량 코딩은 Qwen에 맡기고, 속도가 흔들리거나 한도가 끝나면 GPT로 넘깁니다. 한 회사에 모든 작업을 걸지 않아도 된다는 점도 좋고요.
작년 GLM 블랙프라이데이를 놓친 게 더 아쉽습니다
2025년 10월에 월 3달러였던 GLM-4.6 Coding Plan을 정리한 적이 있습니다. 당시에도 가격이 충격적이라고 썼는데, 블랙프라이데이에는 연간 구독이 더 내려갔습니다.
당시 공유된 실제 결제 가격은 추천 할인을 중첩했을 때 라이트 연 22.68달러, 맥스 연 약 226.80달러였습니다. 맥스도 월로 환산하면 18.90달러 수준입니다.
모델 순위가 너무 빨리 바뀌어서 저는 연간 결제를 웬만하면 피했습니다. 그 원칙 때문에 당시에도 망설였어요. 하지만 저 가격은 1년 동안 최강 모델을 맞히는 베팅이라기보다, 몇 달만 써도 본전을 뽑는 선택권에 가까웠습니다.
지금 돌아보면 GLM은 그때 저점매수를 했어야 했습니다.
이제는 연간 결제를 무조건 피하지 않으려 합니다. 먼저 연간 총액이 대체 서비스 3개월치보다 싼지부터 볼 생각이에요. 그 정도 가격이면 모델이 중간에 뒤처져도 손실이 제한적이니까요.
이런 사람에게 맞고, 이런 사람에게는 애매합니다
잘 맞는 경우
- Qwen 3.8 Preview를 코딩 작업에 직접 써보고 싶다
- 하나의 구독으로 Qwen·GLM·DeepSeek와 멀티모달 모델을 나눠 쓰고 싶다
- 한도가 끝나도 작업을 이어갈 GPT 같은 주력 모델이 따로 있다
- API 주소와 커스텀 제공자 설정을 직접 다룰 수 있다
- Claude Max의 월 200달러와 잦은 정책 변화에 지쳤다
아직 애매한 경우
- 응답 속도가 늘 일정해야 한다
- OMP에서 로그인 한 번으로 모든 모델이 바로 열리길 바란다
- 여러 에이전트를 오래 병렬로 돌리며 사실상 무제한 사용을 기대한다
- 프리뷰 할인 종료나 모델 교체 위험을 감수하기 어렵다
- 연간 결제로 지금 프로모션 가격을 고정하려 한다
정리하면
API 연동 기준으로 Alibaba Cloud Token Plan과 QwenCloud Token Plan은 같은 상품에 가깝습니다. 이름이 비슷한 Alibaba Coding Plan과 OMP의 Qwen Portal은 둘 다 Token Plan을 대신하지 못합니다.
18달러 스탠더드로 Qwen 3.8 Preview의 코드 품질은 충분히 확인했습니다. 문제는 사용량과 속도였습니다. 5시간 크레딧은 약 3시간 만에 바닥났고, 장기 세션에서는 응답 속도도 흔들렸습니다. 주력으로 쓰려면 68달러 프로가 현실적입니다. 그래도 주간 40,000크레딧이 제 사용량에 넉넉할지는 모르겠습니다.
그래도 Claude Max로 돌아가고 싶은 마음은 크지 않습니다. 당분간은 Qwen과 GPT를 나눠 쓰면서 모델 품질, 속도 편차, 실제 주간 소비량을 더 확인해보려고 합니다.
이번에 가장 크게 느낀 건 모델만큼 결제 정책과 연결 방식도 중요하다는 점이었습니다. 좋은 모델은 계속 나오는데, 예측 가능한 가격으로 오래 쓸 상품을 찾기는 오히려 더 어려워졌습니다.
참고 자료
- Alibaba Cloud Token Plan 공식 소개
- Alibaba Cloud Token Plan 공식 설명
- Alibaba Cloud Coding Plan 공식 설명
- QwenCloud Token Plan 공식 설명
- QwenCloud Token Plan 개인용 연결 가이드
- OMP Qwen Portal 제공자 구현
- OMP Alibaba Cloud Token Plan 지원 요청
- 2025년 11월 Z.ai 구독 페이지 보관본
- 2025년 GLM Coding Plan 블랙프라이데이 가격 공유
- Claude Fable 5 사용기간 연장과 결제 판단 - CoderRed
- GLM-4.6 월 3달러 Coding Plan 분석 - CoderRed
댓글