Velokey

GLM 5

智谱채팅입력 0.8 · 출력 2.56 크레딧 / 1M tokens≈$0.8 / $2.56사용 가능

GLM-5는 Zhipu(Z.ai)의 플래그십 744B 희소 MoE 모델로, 토큰당 40B 매개변수만 활성화하며 Claude Opus 4.5와 동등한 수준의 코딩 성능을 제공합니다. Velokey의 통합 엔드포인트를 통해 정가보다 낮은 가격으로 이용하세요.

Opus-4.5 수준 코딩SOTA 오픈 웨이트 에이전트744B / 40B 활성다중 사고 모드

활용 사례

풀스택 코드 생성 · 자율 에이전트 및 도구 사용

입력

텍스트

출력

텍스트

청구 방식

토큰당 과금

0.7
02
2048
2568192
glm-5

대화 시작하기

아래에 메시지를 입력해 시작하세요

가입하면 $0.5 무료 크레딧 — 이미지 약 20장을 무료로 생성

요금 상세

사용량 기반의 투명한 가격 정책으로 숨은 비용이 없습니다.

요금 상세

사용량 기반 요금 내역

사양가격공식 가격절감
Input/1M tokens0.8 크레딧≈$0.81 크레딧-20%
Output/1M tokens2.56 크레딧≈$2.563.2 크레딧-20%
Cache Read/1M tokens0.16 크레딧≈$0.160.2 크레딧-20%

청구 규칙

  • 출력 가격은 모델, 해상도, 품질, 길이 또는 토큰 사용량에 따라 달라집니다.
  • 업로드한 참조 파일은 지원되는 경우 별도로 과금될 수 있습니다.
  • 웹 검색, 이미지 검색 등 부가 기능은 요청당 과금될 수 있습니다.
  • 토큰 기반 모델은 입력 및 출력 토큰 기준으로 과금됩니다.
  • 기본 경로를 사용할 수 없는 경우 Velokey가 가능한 범위에서 안정적인 대체 경로로 자동 전환할 수 있습니다.
  • 사용량 기반 결제이며 크레딧이 투명하게 차감됩니다.

* 최종 비용은 생성된 결과에 따라 달라집니다.

합리적인 가격의 GLM-5 API

Velokey에서 Zhipu의 GLM-5에 액세스하세요 — Opus-4.5 수준 코딩, SOTA 오픈 웨이트 에이전트형 도구 사용, 효율적인 744B/40B 희소 아키텍처를 통합 엔드포인트와 프로덕션 앱을 위한 정가보다 낮은 가격으로 제공합니다.

GLM-5와 API 액세스 소개

GLM-5는 Zhipu(Z.ai)의 플래그십 모델로, 토큰당 40B 매개변수만 활성화하는 744B 매개변수 희소 전문가 혼합 아키텍처를 기반으로 하며, 대규모 효율성을 위해 DeepSeek Sparse Attention을 통합합니다. 28.5T 토큰으로 사전 학습되고 비동기 "Slime" 강화 학습 프레임워크로 개선되어 Claude Opus 4.5와 동등한 수준의 코딩 성능을 제공하고, 에이전트형 벤치마크에서 오픈 웨이트 모델 중 1위를 차지하며, 다중 사고 모드를 지원합니다. Velokey는 합리적인 가격으로 통합하기 쉬운 GLM-5 API를 제공합니다: 통합 채팅 엔드포인트, 명확한 요청 흐름, 프로덕션 시스템, 에이전트 파이프라인, 자동화 도구를 위한 정가보다 낮은 가격.

Opus-4.5 수준 코딩

프론트엔드, 백엔드, 데이터 처리 전반에서 자연어로부터 실행 가능한 코드를 생성하며, 소프트웨어 엔지니어링에서 Claude Opus 4.5와 동등한 성능을 달성합니다 — SWE-bench Verified에서 77.8, Terminal Bench 2.0에서 56.2.

문서 보기
Opus-4.5 수준 코딩

SOTA 오픈 웨이트 에이전트형 도구 사용

자율적 의사결정과 도구 호출을 통해 단일 문장을 다단계 실행을 거친 완성된 산출물로 전환하며, BrowseComp, MCP-Atlas, τ²-Bench에서 오픈 웨이트 모델 중 1위를 차지합니다.

문서 보기
SOTA 오픈 웨이트 에이전트형 도구 사용

효율적인 744B/40B 희소 아키텍처

총 744B 매개변수 중 토큰당 40B만 활성화하며, DeepSeek Sparse Attention (DSA) 및 28.5T 토큰 사전 학습과 결합해 더 낮은 서빙 비용으로 프런티어 품질을 제공합니다.

문서 보기
효율적인 744B/40B 희소 아키텍처

사고 모드와 풍부한 도구

비동기 "Slime" RL 프레임워크로 학습된 다중 사고 모드와 함수 호출, 구조화된 JSON 출력, 컨텍스트 캐싱, 스트리밍을 통해 안정적인 프로덕션 통합을 지원합니다.

문서 보기
사고 모드와 풍부한 도구

Velokey에서 GLM-5 API를 배포하는 방법

몇 가지 단계만으로 시작하세요.

1

가입하고 API Key 받기

Velokey 콘솔에 로그인해 GLM-5로 전송되는 모든 요청을 인증하는 API Key를 생성하세요.

2

요청 매개변수 구성

모델을 glm-5로 설정하고 메시지를 제출하세요. 더 깊은 추론을 위해 사고 모드를 선택하고, 함수 호출, 구조화된 JSON 출력, 컨텍스트 캐싱을 활성화하세요.

3

통합하고 호출 시작

Velokey의 통합 /v1/chat/completions 엔드포인트로 요청을 보내 어시스턴트, 에이전트, 자동화를 구동하고, 사용량은 하나의 콘솔에서 관리하세요.

GLM-5의 실제 활용 사례

풀스택 엔지니어링부터 자율 에이전트까지, 다양한 고자율 시나리오를 포괄합니다.

풀스택 코드 생성

Opus-4.5 수준의 코딩 성능으로, 전체 스택에 걸쳐 자연어로부터 실행 가능한 프론트엔드, 백엔드, 데이터 처리 코드를 생성하는 데 적합합니다.

자율 에이전트 및 도구 사용

에이전트형 벤치마크에서 오픈 웨이트 모델 중 1위를 차지하며, 브라우징, MCP 도구 오케스트레이션, 다단계 작업 자동화에 적합합니다.

복잡한 추론 및 연구

비동기 RL로 학습된 다중 사고 모드 — 심층 추론, 분석, 장기적 연구 워크플로에 적합합니다.

데이터 처리 파이프라인

자연어로부터 실행 가능한 데이터 처리 코드를 생성하며, ETL, 변환, 분석 자동화에 적합합니다.

구조화된 출력 및 통합

함수 호출과 구조화된 JSON 출력 — 모델을 백엔드 서비스 및 타입이 지정된 데이터 흐름에 연결하는 데 적합합니다.

긴 컨텍스트 분석

200K 토큰 컨텍스트와 최대 128K 출력 — 대규모 문서, 코드베이스, 긴 대화를 분석하는 데 적합합니다.

GLM-5에 Velokey를 선택해야 하는 이유

정가 대비 할인

Velokey에서 더 낮은 가격으로 GLM-5를 호출하세요 — 강제 구독 없이 사용한 만큼 지불하여 초기 비용을 줄입니다.

통합 API 인터페이스

하나의 API Key로 GLM-5 및 다른 모델에 액세스할 수 있습니다 — 여러 계정과 키를 번갈아 관리할 필요가 없어 통합이 단순해집니다.

완전한 문서와 통합 가이드

엔드포인트 참조, 매개변수 세부 정보, 예제가 사고 모드, 함수 호출, 구조화된 출력을 원활하게 도입하는 데 도움을 줍니다.

안정적이고 높은 가용성

자동 장애 조치와 안정적인 대체 라우트가 기본 라우트 장애 시에도 가용성을 유지하여 프로덕션 안정성을 보장합니다.

API 레퍼런스

완전한 API 호출 예시와 파라미터 설명

Endpoint

https://api.velokey.ai/v1/chat/completions

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1/chat/completions \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "glm-5",
  "created": 1234567890,
  "data": { ... }
}

GLM-5 API FAQ

GLM-5의 아키텍처는 무엇인가요?

GLM-5는 토큰당 40B 매개변수만 활성화하는 744B 매개변수 희소 전문가 혼합 아키텍처를 사용하며, 효율성을 위해 DeepSeek Sparse Attention을 통합하고 28.5T 토큰으로 사전 학습된 후 비동기 "Slime" RL 프레임워크로 개선되었습니다.

GLM-5의 코딩 성능은 얼마나 좋은가요?

프론트엔드, 백엔드, 데이터 처리 전반에서 자연어로부터 실행 가능한 코드를 생성하며, 소프트웨어 엔지니어링에서 Claude Opus 4.5와 동등한 성능을 달성해 SWE-bench Verified에서 77.8, Terminal Bench 2.0에서 56.2를 기록했습니다.

에이전트형 기능은 얼마나 강력한가요?

GLM-5는 자율적 의사결정과 도구 호출을 수행하여, 단일 문장을 다단계 실행을 거친 완성된 산출물로 전환합니다. BrowseComp, MCP-Atlas, τ²-Bench에서 오픈 웨이트 모델 중 1위를 차지합니다.

어떤 컨텍스트 및 출력 한도를 지원하나요?

GLM-5는 200K 토큰 컨텍스트 창과 최대 128K 토큰 출력을 지원합니다. 다중 사고 모드, 함수 호출, 구조화된 JSON 출력, 컨텍스트 캐싱, 스트리밍을 갖춘 텍스트-투-텍스트 작업을 처리합니다.

Velokey에서는 어떻게 과금되나요?

Velokey는 하나의 API 키를 사용하는 통합 엔드포인트를 통해 정가보다 낮은 가격으로 GLM-5를 라우팅하며, 입력 및 출력 토큰 기준으로 과금됩니다. 이 페이지의 가격 영역에는 대시보드의 현재 Velokey 가격이 표시됩니다.

GLM 5 지금 시작하기

하나의 API 키로 Velokey를 통해 저렴하고 안정적인 AI 모델을 이용하세요.