Qwen3.7-Plus는 화면 인식, GUI 그라운딩, 1M-token 컨텍스트, preserve_thinking을 갖춘 Alibaba의 멀티모달 에이전트 모델입니다. Velokey의 통합 엔드포인트를 통해 정가보다 낮은 가격으로 이용하세요.
활용 사례
화면 인식 및 시각적 UI 테스트 · 브라우저 자동화 및 RPA
입력
텍스트, 이미지
출력
텍스트
청구 방식
토큰당 과금
대화 시작하기
아래에 메시지를 입력해 시작하세요
가입하면 $0.5 무료 크레딧 — 이미지 약 20장을 무료로 생성
요금 상세
사용량 기반의 투명한 가격 정책으로 숨은 비용이 없습니다.
요금 상세
구간별 요금사용량 기반 요금 내역
| 사양 | 가격 | 공식 가격 | 절감 |
|---|---|---|---|
| Input/1M tokens | 0.32 크레딧≈$0.32 | 0.4 크레딧 | -20% |
| Output/1M tokens | 1.28 크레딧≈$1.28 | 1.6 크레딧 | -20% |
| Cache Read/1M tokens | 0.032 크레딧≈$0.032 | 0.04 크레딧 | -20% |
| Cache Write/1M tokens | 0.4 크레딧≈$0.4 | 0.5 크레딧 | -20% |
| 사양 | 가격 | 공식 가격 | 절감 |
|---|---|---|---|
| Input/1M tokens | 0.96 크레딧≈$0.96 | 1.2 크레딧 | -20% |
| Output/1M tokens | 3.84 크레딧≈$3.84 | 4.8 크레딧 | -20% |
| Cache Read/1M tokens | 0.096 크레딧≈$0.096 | 0.12 크레딧 | -20% |
| Cache Write/1M tokens | 1.2 크레딧≈$1.2 | 1.5 크레딧 | -20% |
청구 규칙
- 출력 가격은 모델, 해상도, 품질, 길이 또는 토큰 사용량에 따라 달라집니다.
- 업로드한 참조 파일은 지원되는 경우 별도로 과금될 수 있습니다.
- 웹 검색, 이미지 검색 등 부가 기능은 요청당 과금될 수 있습니다.
- 토큰 기반 모델은 입력 및 출력 토큰 기준으로 과금됩니다.
- 기본 경로를 사용할 수 없는 경우 Velokey가 가능한 범위에서 안정적인 대체 경로로 자동 전환할 수 있습니다.
- 사용량 기반 결제이며 크레딧이 투명하게 차감됩니다.
* 최종 비용은 생성된 결과에 따라 달라집니다.
관련 모델
같은 종류의 다른 모델을 살펴보세요.
- Alibaba20% 할인
Qwen3.6 Plus
Alibaba's Qwen3.6 Plus, a balanced flagship-tier model with strong reasoning, long context, multimodal input, and agentic tool use.
- Alibaba20% 할인
Qwen3.6 Flash
Qwen3.6 Flash (35B-A3B) is Alibaba's open-weight MoE coding model with strong agentic coding, thinking-mode preservation, and a native 262K context (up to 1M with YaRN).
- Alibaba20% 할인
Qwen3.7 Max
Qwen3.7-Max is Alibaba's flagship agent model for long-horizon coding and MCP tool orchestration, sustaining hours-long autonomous runs over a 1M-token context.
- OpenAI20% 할인
GPT 5.4 Mini
OpenAI's fast, cost-efficient GPT-5.4 Mini for high-volume production, with vision, long context, and strong tool use at low latency.
합리적인 가격의 Qwen3.7-Plus API
Velokey에서 Alibaba의 Qwen3.7-Plus에 액세스하세요 — 멀티모달 화면 인식, GUI 그라운딩, 1M-token 컨텍스트, preserve_thinking을 통합 엔드포인트와 프로덕션 에이전트 앱을 위한 정가보다 낮은 가격으로 제공합니다.
Qwen3.7-Plus와 API 액세스 소개
Qwen3.7-Plus는 2026년 6월에 출시된 Alibaba의 멀티모달 비전 지원 에이전트 모델입니다. 텍스트 전용 Qwen3.7-Max에 대응하는 모델로, 동일한 언어 백본을 기반으로 비전 이해와 GUI 그라운딩이 추가되었으며, 화면 인식, 브라우저 자동화, GUI 탐색, 하이브리드 GUI+CLI 에이전트 워크플로를 위해 설계되었습니다. 1M-token 컨텍스트, 최대 65,536 출력 토큰, 최대 256,000 토큰의 내부 chain-of-thought 추론 예산을 지원하며, ScreenSpot Pro에서 79.0, Terminal-Bench에서 70.3을 달성합니다. Velokey는 합리적인 가격과 쉬운 통합을 제공하는 Qwen3.7-Plus API를 제공합니다. 통합 채팅 엔드포인트, 명확한 요청 흐름, 프로덕션 시스템, 에이전트 파이프라인, 자동화 도구를 위한 정가보다 낮은 가격을 제공합니다.
멀티모달 화면 인식 및 GUI 그라운딩
언어 백본 위에 비전 기능을 추가해 컴퓨터 화면과 UI를 읽고, 버튼, 패널 및 기타 요소를 정밀하게 그라운딩합니다. ScreenSpot Pro에서 79.0을 달성하여 인터페이스 이해와 조작의 기반을 마련합니다.
문서 보기 →
GUI 탐색 및 브라우저 자동화
브라우저 자동화, GUI 탐색, 하이브리드 GUI+CLI 에이전트 워크플로를 위해 설계되어 창, 페이지, 터미널 전반에서 지속적으로 작동합니다. Terminal-Bench에서 70.3을 달성합니다.
문서 보기 →
1M-token 컨텍스트 및 preserve_thinking
1M-token 컨텍스트와 최대 65,536 출력 토큰을 지원하며, 최대 256,000 토큰의 추론 예산을 제공합니다. preserve_thinking은 각 호출마다 chain of thought를 재설정하는 대신 도구 호출 전반에서 추론 상태를 유지합니다.
문서 보기 →
저비용 멀티모달 에이전트
공식 가격은 백만 토큰당 입력 $0.4 / 출력 $1.6이며, 캐시된 입력은 더욱 저렴합니다 — Qwen3.7-Max보다 훨씬 저렴하여 대규모 에이전트 배포에 적합합니다.
문서 보기 →
Velokey에서 Qwen3.7-Plus API 배포하는 방법
몇 단계만으로 시작하세요.
가입하고 API Key 받기
Velokey 콘솔에 로그인하여 Qwen3.7-Plus로 전송되는 모든 요청을 인증하는 API Key를 생성하세요.
요청 매개변수 구성
model을 qwen-3-7-plus로 설정하고 스크린샷과 같은 시각 입력이 포함된 메시지를 제출하세요. 에이전트 루프에서 preserve_thinking을 활성화하여 도구 호출 전반에서 추론 상태를 유지하세요.
통합하고 호출 시작
Velokey의 통합 /v1/chat/completions 엔드포인트로 요청을 보내 GUI 에이전트, 브라우저 자동화, RPA 흐름을 구동하고, 사용량을 하나의 콘솔에서 관리하세요.
Qwen3.7-Plus의 실제 사용 사례
화면 자동화부터 에이전트 개발까지, 다양한 고자율 시나리오를 포괄합니다.
화면 인식 및 시각적 UI 테스트
화면 인식과 GUI 그라운딩을 통해 인터페이스 읽기, 요소 위치 파악, 시각적 UI 테스트 및 회귀 테스트 수행에 적합합니다.
브라우저 자동화 및 RPA
브라우저 자동화와 GUI 탐색을 위해 구축되어 웹 및 데스크톱 앱 전반의 다단계 RPA에 적합합니다.
하이브리드 GUI+CLI 에이전트
하이브리드 GUI 및 명령줄 에이전트 워크플로를 지원하며, preserve_thinking으로 긴 작업에서도 안정적으로 유지됩니다.
데스크톱 앱 및 파일 작업 자동화
데스크톱 앱 인터페이스를 인식하고 조작합니다 — 창 간 파일 관리와 다단계 데스크톱 자동화에 적합합니다.
데이터 입력 및 대시보드 자동화
스프레드시트와 대시보드 UI를 읽고 컨트롤을 정밀하게 그라운딩합니다 — 데이터 입력, 스크래핑, 운영 대시보드 자동화에 적합합니다.
대규모 저비용 에이전트
낮은 입력/출력 가격과 캐시 입력 할인을 통해 대량의 대규모 에이전트 배포에 적합합니다.
Qwen3.7-Plus에 Velokey를 선택해야 하는 이유
정가 할인
Velokey에서 더 낮은 가격으로 Qwen3.7-Plus를 호출하세요 — 강제 구독 없이 사용한 만큼 결제하여 초기 비용을 줄입니다.
통합 API 인터페이스
하나의 API Key로 Qwen3.7-Plus와 다른 모델에 액세스할 수 있습니다 — 여러 계정과 키를 번갈아 관리할 필요가 없어 통합이 간소화됩니다.
완전한 문서와 마이그레이션 가이드
엔드포인트 레퍼런스, 매개변수 세부 정보, 시각 입력 예제가 화면 인식과 GUI 자동화를 빠르게 도입하도록 도와줍니다.
안정적이고 높은 가용성
자동 장애 조치와 안정적인 fallback 경로가 기본 경로가 중단될 때도 가용성을 유지하여 프로덕션의 신뢰성을 보장합니다.
API 레퍼런스
완전한 API 호출 예시와 파라미터 설명
Endpoint
https://api.velokey.ai/v1/chat/completionsAuthentication
Bearer YOUR_API_KEYRequest Example
curl https://api.velokey.ai/v1/chat/completions \
-X POST \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-plus",
"messages": [{"role": "user", "content": "Hello!"}],
"temperature": 0.7
}'Response Example
{
"id": "req_abc123",
"model": "qwen3.7-plus",
"created": 1234567890,
"data": { ... }
}Qwen3.7-Plus API FAQ
Qwen3.7-Plus는 Qwen3.7-Max와 어떻게 다른가요?
Qwen3.7-Plus는 텍스트 전용 Qwen3.7-Max에 대응하는 멀티모달 비전 지원 모델로, 동일한 언어 백본을 기반으로 비전 이해와 GUI 그라운딩이 추가되었습니다. Qwen3.7-Max가 텍스트 전용인 반면, 이 모델은 화면 인식, 브라우저 자동화, GUI 탐색을 대상으로 합니다.
preserve_thinking 매개변수는 무엇을 하나요?
preserve_thinking은 에이전트 루프에서 여러 도구 호출 전반에 걸쳐 모델의 추론 상태를 유지하므로, 각 도구 호출 때마다 chain of thought가 재설정되지 않습니다 — 장기 작업의 일관성을 유지하고 중복 재추론을 줄입니다.
컨텍스트 및 출력 제한은 무엇인가요?
Qwen3.7-Plus는 1M-token 컨텍스트 창과 최대 65,536 출력 토큰을 지원하며, 최대 256,000 토큰의 내부 chain-of-thought 추론 예산을 제공합니다.
벤치마크 성능은 어떤가요?
출시 시점에 Qwen3.7-Plus는 ScreenSpot Pro에서 79.0, Terminal-Bench에서 70.3을 달성하여 화면 그라운딩 및 터미널 에이전트 역량을 보여줍니다.
Velokey에서는 어떻게 과금되나요?
공식 가격은 백만 토큰당 입력 $0.4 / 출력 $1.6이며, 캐시된 입력은 더욱 저렴합니다 — Qwen3.7-Max보다 훨씬 저렴합니다. 이 페이지의 가격 영역에는 정가 할인 적용 후 현재 Velokey 가격이 표시됩니다.