| 서비스명 | 요금제 | 가격 (월) | 제공 모델 | 사용량 |
|---|---|---|---|---|
| GLM Coding Plan | Lite | $18 | GLM-5.1, GLM-5-Turbo, GLM-4.7, GLM-4.5-Air |
80회 / 5시간 (400회 / 주) |
| Pro | $72 | GLM-5.1, GLM-5-Turbo, GLM-4.7, GLM-4.5-Air |
400회 / 5시간 (2,000회 / 주) |
|
| Max | $160 | GLM-5.1, GLM-5-Turbo, GLM-4.7, GLM-4.5-Air |
1,600회 / 5시간 (8,000회 / 주) |
|
| Alibaba Cloud AI Coding Plan | Pro | $50 | qwen3.6-plus, kimi-k2.5, glm-5, MiniMax-M2.5 + qwen3.5-plus, glm-4.7 등 |
6,000회 / 5시간 90,000회 / 월 |
| Fireworks AI | Fire Pass (Early Access) |
$7 / 주 (≈$28 / 월) |
Kimi K2.5 Turbo, GLM-5.1† |
무제한 (개인 에이전트 코딩) |
| Nano-GPT | Pro | $8 | GLM-5, Kimi K2.5, GLM-4.7, MiniMax M2.5, Qwen3-235B, Devstral 2, GPT-OSS-120B 등 200+ 오픈소스 모델 |
6,000만 토큰 / 주 (이미지 생성 포함) |
| OpenCode Go | Standard | $10 (첫 달 $5) |
GLM-5.1, GLM-5, Kimi K2.5, Kimi K2.6, MiMo-V2-Pro, MiMo-V2-Omni, MiMo-V2.5, Qwen3.5 Plus, Qwen3.6 Plus, MiniMax M2.5, MiniMax M2.7 |
약 $60 크레딧 상당 (캐시 토큰 할인 적용 시 예상치 4~6배 더 사용) |
| Cerebras Code | Pro | $50 | ZAI-GLM 4.7 (메인) Qwen3 235B (2026/5/27 퇴역) |
2,400만 토큰 / 일 (~1,000 TPS) |
| Max | $200 | ZAI-GLM 4.7 (메인) Qwen3 235B (2026/5/27 퇴역) |
1억 2천만 토큰 / 일 (~1,000 TPS) |
|
| Chutes | Base | $3 | 오픈소스 모델 (프론티어 모델 미포함) |
월 $15 상당 / 4시간 $1.25 상당 (토큰 기반 과금) |
| Plus | $10 | GLM-5, GLM-5.1, Kimi K2.5, Kimi K2.6, Qwen 3.5, MiniMax M2.5 등 프론티어 모델 포함 |
월 $50 상당 / 4시간 약 $4.17 상당 (토큰 기반 과금) |
|
| Pro | $20 | Plus 전체 모델 + 10% PAYG 할인 |
월 $100 상당 / 4시간 약 $8.33 상당 (토큰 기반 과금) |
|
| Ollama Cloud | Pro | $20 ($200/년) |
클라우드 오픈소스 모델 (로컬+클라우드 하이브리드) |
GPU 시간 기반 클라우드 모델 3개 동시 실행 Free 대비 50x 사용량 |
| Max | $100 | 클라우드 오픈소스 모델 (로컬+클라우드 하이브리드) |
GPU 시간 기반 클라우드 모델 10개 동시 실행 Pro 대비 5x 사용량 |
GLM Coding Plan: 매우 저렴했던 10 / 30 / 80 이었던 가격이 떡-상했습니다. 이전 구독자는 아직 이전 가격으로 사용할 수 있어 보이지만 신규 진입은 추천하지 않음.
Fireworks: 추론 전문 업체입니다. 초당 100토큰 정도로 상당히 빠른 속도를 자랑합니다. 현재는 신규 가입이 막혀 있음.
Firepass-GLM-5.1: 공식 문서에는 없지만 호출하면 나옵니다.†
Chutes: 분산 컴퓨팅으로 단가를 극한까지 낮춘 게 특징입니다. 사용량이 많아 보이지만 속도가 끔-찍해서 추천하진 않습니다.
Alibaba Coding Plan: 중국의 황금방패 검열망을 직빵으로 맞습니다. 시진핑 욕이나 야한 거 싹다 검열되기 때문에 AI와의 질펀한 야스가 목적이라면 사용할 수 없습니다. 원래 10달러짜리 라이트 플랜이 있었는데 사용자가 몰리는 바람에 삭제됨.
Ollama Cloud: 사용량이 매우 모호합니다. 아직까진 다른 구독제보다 넉넉하게 나온다고 하는데 사용량 줄일지는 아무도 모름.
Cerebras Code: NPU 업체입니다. 모델 업데이트가 늦고 가성비도 좋아 보이지 않지만 초당 1,000~2,000토큰이라는 압도적인 속도를 자랑합니다.
댓글 1