Velokey

ERNIE 5.0

百度채팅입력 75 · 출력 75 크레딧 / 1M tokens≈$75 / $75사용 가능

ERNIE 5.0은 텍스트, 이미지, 비디오, 오디오 전반을 아우르며 강력한 추론 및 에이전트 역량을 갖춘 Baidu Wenxin의 플래그십 네이티브 멀티모달 모델입니다. Velokey의 통합 엔드포인트를 통해 정가보다 낮은 가격으로 이용하세요.

네이티브 멀티모달2.4T 파라미터, ~3% 활성화텍스트 / 이미지 / 비디오 / 오디오128K 컨텍스트

활용 사례

코딩 및 에이전트 자동화 · 멀티모달 이해 및 생성

입력

텍스트, 이미지

출력

텍스트

청구 방식

토큰당 과금

0.7
02
2048
2568192
ernie-5.0

대화 시작하기

아래에 메시지를 입력해 시작하세요

가입하면 $0.5 무료 크레딧 — 이미지 약 20장을 무료로 생성

요금 상세

사용량 기반의 투명한 가격 정책으로 숨은 비용이 없습니다.

요금 상세

구간별 요금

사용량 기반 요금 내역

<= 32K tokens컨텍스트 길이 ≤ 32K
사양가격
Input/1M tokens0.9 크레딧≈$0.9
Output/1M tokens3.5 크레딧≈$3.5
> 32K tokens컨텍스트 길이 > 32K
사양가격
Input/1M tokens1.5 크레딧≈$1.5
Output/1M tokens5.8 크레딧≈$5.8

청구 규칙

  • 출력 가격은 모델, 해상도, 품질, 길이 또는 토큰 사용량에 따라 달라집니다.
  • 업로드한 참조 파일은 지원되는 경우 별도로 과금될 수 있습니다.
  • 웹 검색, 이미지 검색 등 부가 기능은 요청당 과금될 수 있습니다.
  • 토큰 기반 모델은 입력 및 출력 토큰 기준으로 과금됩니다.
  • 기본 경로를 사용할 수 없는 경우 Velokey가 가능한 범위에서 안정적인 대체 경로로 자동 전환할 수 있습니다.
  • 사용량 기반 결제이며 크레딧이 투명하게 차감됩니다.

* 최종 비용은 생성된 결과에 따라 달라집니다.

합리적인 가격의 ERNIE 5.0 API

Velokey에서 Baidu Wenxin의 ERNIE 5.0에 액세스하세요 — 통합 텍스트, 이미지, 비디오, 오디오, 효율적인 희소 활성화, 강력한 추론 및 에이전트를 제공하는 네이티브 멀티모달 조 단위 플래그십 모델을 정가보다 낮은 가격의 통합 엔드포인트로 이용할 수 있습니다.

ERNIE 5.0과 API 액세스 소개

ERNIE 5.0은 2026년 2월 6일에 출시된 Baidu Wenxin의 플래그십 모델입니다. 이는 네이티브 멀티모달 아키텍처를 기반으로 구축되었습니다. 별도 모델을 결합하는 대신 텍스트, 이미지, 비디오, 오디오를 하나의 프레임워크에서 처리하는 2.4조 파라미터의 통합 자기회귀 네트워크입니다. Modality-Agnostic Routing MoE는 토큰당 약 3%의 파라미터만 활성화하며, Elastic Training 전략은 배포 유연성을 위해 가변 깊이, 너비, 희소성을 허용합니다. Velokey는 합리적인 가격에 통합하기 쉬운 ERNIE 5.0 API를 제공합니다. 통합 채팅 엔드포인트, 명확한 요청 흐름, 프로덕션 시스템, 에이전트 파이프라인, 멀티모달 애플리케이션을 위한 정가보다 낮은 가격을 제공합니다. 이 플랫폼에서는 텍스트, 이미지, 비디오 입력을 보내고 텍스트 출력을 받을 수 있습니다.

네이티브 통합 멀티모달 아키텍처

하나의 통합 자기회귀 네트워크가 텍스트, 이미지, 비디오, 오디오를 함께 처리합니다 — 별도 모델을 사후에 이어 붙이는 대신 텍스트에는 Next-Token Prediction, 이미지에는 Next-Frame-and-Scale Prediction, 오디오에는 Next-Codec Prediction을 사용합니다.

문서 보기
네이티브 통합 멀티모달 아키텍처

조 단위 규모의 MoE 효율성

2.4조 개의 파라미터와 토큰당 약 3%의 파라미터만 활성화하는 Modality-Agnostic Routing MoE, 그리고 가변 깊이, 너비, 희소성을 위한 Elastic Training 전략을 결합하여, 배포 효율성을 유지하는 조 단위 규모의 용량을 제공합니다.

문서 보기
조 단위 규모의 MoE 효율성

고충실도 멀티모달 생성

하나의 모델에서 고충실도 이미지, 업계 최고 수준의 비디오, 최상위 오디오를 생성합니다 — 경쟁력 있는 텍스트 음성 변환과 함께 TUT2017 오디오 이해에서 동급 최고 수준을 달성하여 이해와 생성을 통합합니다.

문서 보기
고충실도 멀티모달 생성

지식, 추론, 코딩 및 에이전트

강력한 지식 검색, 논리적 추론, 코드 생성, 지시사항 준수, 에이전트 도구 호출을 제공하며, 장기 작업을 위해 컨텍스트 창이 8K에서 128K 토큰으로 점진적으로 확장되었습니다.

문서 보기
지식, 추론, 코딩 및 에이전트

Velokey에서 ERNIE 5.0 API를 배포하는 방법

몇 가지 단계만으로 시작하세요.

1

가입하고 API Key 받기

Velokey 콘솔에 로그인하여 ERNIE 5.0으로 전송되는 모든 요청을 인증하는 API Key를 생성하세요.

2

요청 파라미터 구성

모델을 ernie-5-0으로 설정하고 메시지를 제출하세요. 텍스트, 이미지, 비디오 입력을 전달하고 텍스트 출력을 받으며, 최대 128K 토큰의 컨텍스트를 사용할 수 있습니다.

3

통합하고 호출 시작

Velokey의 통합 /v1/chat/completions 엔드포인트로 요청을 보내 어시스턴트, 에이전트, 멀티모달 앱을 구동하고, 사용량은 하나의 콘솔에서 관리하세요.

ERNIE 5.0의 실제 활용 사례

엔지니어링부터 창작 및 분석 작업까지, 다양한 고부가가치 시나리오를 포괄합니다.

코딩 및 개발 어시스턴트

코드 생성과 지시사항 준수 기능을 통해 개발 어시스턴트, 리팩터링, 코드 리뷰 도우미에 적합합니다.

에이전트 및 도구 호출

안정적인 에이전트 도구 호출을 통해 다단계 자동화, 오케스트레이션, 장기 에이전트 워크플로에 적합합니다.

멀티모달 이해 및 생성

텍스트, 이미지, 비디오를 이해하고 고충실도 이미지와 업계 최고 수준의 비디오를 생성하므로 콘텐츠 및 크리에이티브 스튜디오에 적합합니다.

지식 검색 및 Q&A

강력한 지식 검색 기능은 긴 문서에 대한 연구 도우미, 엔터프라이즈 Q&A, 검색 증강 어시스턴트에 적합합니다.

분석 및 추론

128K 컨텍스트에서의 논리적 추론은 데이터 분석, 구조화된 추출, 다중 문서 종합에 적합합니다.

오디오 및 음성 애플리케이션

경쟁력 있는 텍스트 음성 변환과 함께 동급 최고 수준의 TUT2017 오디오 이해를 제공하여 전사, 음성, 오디오 분석 흐름에 적합합니다.

ERNIE 5.0에 Velokey를 선택해야 하는 이유

정가 대비 할인

Velokey에서 더 낮은 가격으로 ERNIE 5.0을 호출하세요 — 강제 구독 없이 사용한 만큼 지불하여 초기 비용을 줄일 수 있습니다.

통합 API 인터페이스

하나의 API Key로 ERNIE 5.0 및 다른 모델에 액세스할 수 있습니다 — 여러 계정과 키를 번갈아 관리할 필요가 없어 통합이 간소화됩니다.

완전한 문서와 가이드

엔드포인트 참조, 파라미터 세부 정보, 멀티모달 예제가 텍스트, 이미지, 비디오 입력을 원활하게 통합하는 데 도움을 줍니다.

안정적이고 높은 가용성

자동 장애 조치와 안정적인 대체 경로가 기본 경로 장애 시에도 가용성을 유지하여 프로덕션 안정성을 보장합니다.

API 레퍼런스

완전한 API 호출 예시와 파라미터 설명

Endpoint

https://api.velokey.ai/v1/chat/completions

Authentication

Bearer YOUR_API_KEY

Request Example

curl https://api.velokey.ai/v1/chat/completions \
  -X POST \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "ernie-5.0",
    "messages": [{"role": "user", "content": "Hello!"}],
    "temperature": 0.7
  }'

Response Example

{
  "id": "req_abc123",
  "model": "ernie-5.0",
  "created": 1234567890,
  "data": { ... }
}

ERNIE 5.0 API FAQ

ERNIE 5.0이 네이티브 멀티모달 모델인 이유는 무엇인가요?

별도의 모델을 나중에 결합하는 대신 모달리티 전반에 걸쳐 하나의 통합 자기회귀 프레임워크를 사용합니다. 텍스트에는 Next-Token Prediction, 이미지에는 Next-Frame-and-Scale Prediction, 오디오에는 Next-Codec Prediction을 사용하며, 모두 단일 네트워크 안에서 이루어집니다.

모델의 규모는 얼마나 크며 어떻게 효율성을 달성하나요?

2.4조 개의 파라미터를 갖고 있지만, Modality-Agnostic Routing MoE가 토큰당 약 3%만 활성화합니다. Elastic Training 전략은 배포 유연성을 위해 가변 깊이, 너비, 희소성을 지원하므로 조 단위 규모의 용량도 효율적으로 제공할 수 있습니다.

Velokey에서는 어떤 입력과 출력이 지원되나요?

이 플랫폼에서는 텍스트, 이미지, 비디오 입력을 보내고 텍스트 출력을 받을 수 있습니다. 모델 자체는 고충실도 이미지, 업계 최고 수준의 비디오, 오디오 생성도 지원하며, TUT2017 오디오 이해에서 동급 최고 수준이고 경쟁력 있는 텍스트 음성 변환을 제공합니다.

컨텍스트 창은 얼마나 큰가요?

컨텍스트 창은 8K에서 128K 토큰으로 점진적으로 확장되었으므로 긴 문서, 확장된 대화, 다단계 에이전트 워크플로 전반에 걸쳐 추론할 수 있습니다.

Velokey에서는 어떻게 과금되나요?

이 페이지의 가격 영역과 대시보드에서 현재 Velokey 가격을 확인할 수 있으며, 정가 대비 할인된 가격으로 입력 및 출력 토큰 기준으로 과금됩니다. 하나의 API 키와 통합 엔드포인트로 통합을 간단하게 유지할 수 있습니다.

ERNIE 5.0 지금 시작하기

하나의 API 키로 Velokey를 통해 저렴하고 안정적인 AI 모델을 이용하세요.