| 서비스명 | 요금제 | 가격 (월) | 제공 모델 | 사용량 |
|---|---|---|---|---|
| GLM Coding Plan | Lite | $10 | GLM-4.7 (GLM-5 미지원) |
80회 / 5시간 |
| Pro | $30 | GLM-4.7, GLM-5 | 400회 / 5시간 | |
| Max | $80 | GLM-4.7, GLM-5 | 1,600회 / 5시간 | |
| Alibaba Cloud AI Coding Plan | Lite | $10 | Qwen3.5-Plus, GLM-5, Kimi K2.5, MiniMax M2.5 |
18,000회 / 월 |
| Pro | $50 | Qwen3.5-Plus, GLM-5, Kimi K2.5, MiniMax M2.5 |
90,000회 / 월 | |
| MiniMax Coding Plan | Starter | $10 | MiniMax-M2.5 | 100회 / 5시간 |
| Plus | $20 | MiniMax-M2.5 | 300회 / 5시간 | |
| Max | $50 | MiniMax-M2.5 | 1,000회 / 5시간 | |
| Plus-HighSpeed | $40 | MiniMax-M2.5 (고속 추론) |
300회 / 5시간 | |
| Max-HighSpeed | $80 | MiniMax-M2.5 (고속 추론) |
1,000회 / 5시간 | |
| Ultra-HighSpeed | $150 | MiniMax-M2.5 (고속 추론) |
2,000회 / 5시간 | |
| Nano-GPT | Pro | $8 | 200+ AI 모델 (오픈소스 모델 무제한, 이미지 생성 포함) |
60,000회 / 월 (주당 무료 토큰 제공, 다른 모델 5% 할인) |
| OpenCode Go | Standard | $10 (첫 달 $5) |
GLM-5, Kimi K2.5, MiniMax M2.5 |
약 $60 크레딧 상당 (MiniMax M2.5: 10만 회) |
| Cerebras Code | Pro | $50 | Qwen3 235B, GLM-4.7 | 2,400만 토큰 / 일 (~2,000 TPS) |
| Max | $200 | Qwen3 235B, GLM-4.7 | 1억 2천만 토큰 / 일 (~2,000 TPS) |
|
| Chutes | Base | $3 | 다양한 오픈소스 모델 | 300회 / 일 |
| Plus | $10 | 다양한 오픈소스 모델 | 2,000회 / 일 | |
| Pro | $20 | 다양한 오픈소스 모델 | 5,000회 / 일 | |
| Ollama Cloud | Pro | $20 | 클라우드 모델 (로컬+클라우드 하이브리드) |
135회 / 5시간 |
| Max | $100 | 클라우드 모델 (로컬+클라우드 하이브리드) |
더 높은 한도 |
특이사항
Chutes: 분산 컴퓨팅으로 단가를 극한까지 낮춘게 특징입니다. 사용량이 많아보이지만 속도가 끔-찍해서 추천하진 않습니다.
Alibaba Coding Plan: 중국의 황금방패 검열망을 직빵으로 맞습니다. 시진핑 욕이나 야한거 싹다 검열되기 때문에 AI와의 질펀한 야스가 목적이라면 사용할 수 없습니다.
Cerebras Code: NPU업체입니다. 모델 업데이트가 늦고 가성비도 좋아보이지 않지만 초당 1000~2000토큰이라는 압도적인 속도를 자랑합니다.
댓글 0