7ce48973b4816cf43be6e9e14f88256434a3bff1b36bb4c99e4d266cd4baaca99d01c28ec9e1caa31f6d2e7b0562b403e72262d8010784edd1daa276f6a481

서비스명 요금제 가격 (월) 제공 모델 사용량
GLM Coding Plan Lite $18 GLM-5.1, GLM-5-Turbo,
GLM-4.7, GLM-4.5-Air
80회 / 5시간
(400회 / 주)
  Pro $72 GLM-5.1, GLM-5-Turbo,
GLM-4.7, GLM-4.5-Air
400회 / 5시간
(2,000회 / 주)
  Max $160 GLM-5.1, GLM-5-Turbo,
GLM-4.7, GLM-4.5-Air
1,600회 / 5시간
(8,000회 / 주)
Alibaba Cloud AI Coding Plan Pro $50 qwen3.6-plus, kimi-k2.5,
glm-5, MiniMax-M2.5
+ qwen3.5-plus, glm-4.7 등
6,000회 / 5시간
90,000회 / 월
Fireworks AI Fire Pass
(Early Access)
$7 / 주
(≈$28 / 월)
Kimi K2.5 Turbo,
GLM-5.1†
무제한
(개인 에이전트 코딩)
Nano-GPT Pro $8 GLM-5, Kimi K2.5, GLM-4.7,
MiniMax M2.5, Qwen3-235B,
Devstral 2, GPT-OSS-120B 등
200+ 오픈소스 모델
6,000만 토큰 / 주
(이미지 생성 포함)
OpenCode Go Standard $10
(첫 달 $5)
GLM-5.1, GLM-5, Kimi K2.5,
Kimi K2.6, MiMo-V2-Pro,
MiMo-V2-Omni, MiMo-V2.5,
Qwen3.5 Plus, Qwen3.6 Plus,
MiniMax M2.5, MiniMax M2.7
약 $60 크레딧 상당
(캐시 토큰 할인 적용 시
예상치 4~6배 더 사용)
Cerebras Code Pro $50 ZAI-GLM 4.7 (메인)
Qwen3 235B (2026/5/27 퇴역)
2,400만 토큰 / 일
(~1,000 TPS)
  Max $200 ZAI-GLM 4.7 (메인)
Qwen3 235B (2026/5/27 퇴역)
1억 2천만 토큰 / 일
(~1,000 TPS)
Chutes Base $3 오픈소스 모델
(프론티어 모델 미포함)
월 $15 상당 /
4시간 $1.25 상당
(토큰 기반 과금)
  Plus $10 GLM-5, GLM-5.1, Kimi K2.5,
Kimi K2.6, Qwen 3.5,
MiniMax M2.5 등
프론티어 모델 포함
월 $50 상당 /
4시간 약 $4.17 상당
(토큰 기반 과금)
  Pro $20 Plus 전체 모델 +
10% PAYG 할인
월 $100 상당 /
4시간 약 $8.33 상당
(토큰 기반 과금)
Ollama Cloud Pro $20
($200/년)
클라우드 오픈소스 모델
(로컬+클라우드 하이브리드)
GPU 시간 기반
클라우드 모델 3개 동시 실행
Free 대비 50x 사용량
  Max $100 클라우드 오픈소스 모델
(로컬+클라우드 하이브리드)
GPU 시간 기반
클라우드 모델 10개 동시 실행
Pro 대비 5x 사용량

GLM Coding Plan: 매우 저렴했던 10 / 30 / 80 이었던 가격이 떡-상했습니다. 이전 구독자는 아직 이전 가격으로 사용할 수 있어 보이지만 신규 진입은 추천하지 않음.

Fireworks: 추론 전문 업체입니다. 초당 100토큰 정도로 상당히 빠른 속도를 자랑합니다. 현재는 신규 가입이 막혀 있음.

Firepass-GLM-5.1: 공식 문서에는 없지만 호출하면 나옵니다.†

Chutes: 분산 컴퓨팅으로 단가를 극한까지 낮춘 게 특징입니다. 사용량이 많아 보이지만 속도가 끔-찍해서 추천하진 않습니다.

Alibaba Coding Plan: 중국의 황금방패 검열망을 직빵으로 맞습니다. 시진핑 욕이나 야한 거 싹다 검열되기 때문에 AI와의 질펀한 야스가 목적이라면 사용할 수 없습니다. 원래 10달러짜리 라이트 플랜이 있었는데 사용자가 몰리는 바람에 삭제됨.

Ollama Cloud: 사용량이 매우 모호합니다. 아직까진 다른 구독제보다 넉넉하게 나온다고 하는데 사용량 줄일지는 아무도 모름.

Cerebras Code: NPU 업체입니다. 모델 업데이트가 늦고 가성비도 좋아 보이지 않지만 초당 1,000~2,000토큰이라는 압도적인 속도를 자랑합니다.