통제형 오픈 모델 액세스

Qwen 3.8 Flash Uncensored 120B비공개 API 액세스

빠른 비공개 추론, 다국어 애플리케이션, Agent 및 비용 효율적인 전용 배포를 위한 120B급 Qwen 계열 NVFP4 checkpoint의 통제형 액세스를 요청하세요.

120B-class checkpointNVFP4 checkpointPrivate APIOpenAI-compatible target

비공개 용량

가입 후 액세스가 확정됩니다

이 모델은 통제형 액세스 절차로 제공됩니다. 가입 후 예상 트래픽과 배포 요구사항을 제출하면 LLMsRelay가 용량, 상업 조건, 모델 ID 및 출시 일정을 확인합니다.

120B-class checkpoint

NVFP4 checkpoint

Approximately 135 GB

Reference deployment: 2× DGX Spark

checkpoint 출처 보기
팀이 검토하는 이유

다국어 및 Agent 역량을 유지하면서 더 낮은 인프라 요구사항을 원하는 팀을 위한 비교적 작은 footprint 옵션입니다.

세 모델 중 인프라 효율이 가장 높으며, 실제 배포는 용량 및 상업 라이선스 조건 확인 후 제공됩니다.
상업적 사용 사례
저지연 비공개 어시스턴트
다국어 지원 및 콘텐츠 운영
Agent 프로토타입과 도구 워크플로
더 작은 GPU footprint의 전용 추론

비공개 액세스 절차

가입 후 액세스가 확정됩니다

01
1

계정 만들기

LLMsRelay에 가입하고 개발자 dashboard를 여세요.

02
2

워크로드 정의

대상 모델, 예상 token 양, 동시성, 지역 및 지연 시간 요구사항을 제출하세요.

03
3

용량 확인

GPU 가용성, 라이선스 제한, 라우팅 및 상업 조건을 검토합니다.

04
4

통합

활성화 후 계정에 확정된 모델 ID와 API 설정을 사용합니다.

통합 목표

LLMsRelay를 통한 OpenAI 호환 요청 흐름을 목표로 합니다. 정확한 모델 ID와 엔드포인트 가용성은 액세스 검토 후 제공됩니다.

가용성

즉시 사용할 수 있는 공개 self-serve 카탈로그 항목이 아닙니다. 승인된 계정에 용량을 예약하거나 프로비저닝하며 지역과 배포 규모에 따라 달라질 수 있습니다.

라이선스 및 허용 사용

액세스에는 checkpoint 라이선스, 적용 법률 및 LLMsRelay 허용 사용 통제가 적용됩니다. Uncensored는 무제한 또는 익명 사용을 의미하지 않습니다.

액세스에는 checkpoint 라이선스, 적용 법률 및 LLMsRelay 허용 사용 통제가 적용됩니다. Uncensored는 무제한 또는 익명 사용을 의미하지 않습니다.

모델 액세스 질문

LLMsRelay에서 Qwen 3.8 Flash Uncensored 120B을 사용할 수 있나요?

통제형 액세스 절차를 통해 제공됩니다. 가입 후 용량 및 배포 검토가 시작되며 즉시 공개 모델 ID가 보장되지는 않습니다.

OpenAI 호환 클라이언트를 사용할 수 있나요?

목표 통합 방식입니다. 최종 base URL, 모델 ID, 제한 및 스트리밍 동작은 활성화된 계정별로 확정됩니다.

얼마나 빨리 활성화되나요?

모델, GPU 용량, 지역, 동시성, 라이선스 검토 및 예상 사용량에 따라 달라집니다. 워크로드 검토 후 일정을 확인합니다.

Uncensored는 제한이 없다는 뜻인가요?

아닙니다. Checkpoint 동작과 플랫폼 정책은 별개이며 적용 법률, 오용 방지, 라이선스 및 계정 통제가 계속 적용됩니다.

비공개 모델 옵션 비교

다른 통제형 액세스 checkpoint를 검토하고 워크로드에 맞는 용량 프로필을 선택하세요.

제품에 이 모델을 연결하세요

가입하고 워크로드를 설명하면 하드웨어와 라우팅을 직접 추측하지 않고 용량 기반 통합 계획을 받을 수 있습니다.

가입하고 액세스 요청