통제형 오픈 모델 액세스

GLM 5.3 Uncensored 750B비공개 API 액세스

다국어 추론, 도구 중심 Agent, 코드 워크플로 및 비공개 엔터프라이즈 추론을 위한 대형 GLM 5.3 계열 FP8 checkpoint의 통제형 액세스를 요청하세요.

750B-class listingFP8 checkpointPrivate APIOpenAI-compatible target

비공개 용량

가입 후 액세스가 확정됩니다

이 모델은 통제형 액세스 절차로 제공됩니다. 가입 후 예상 트래픽과 배포 요구사항을 제출하면 LLMsRelay가 용량, 상업 조건, 모델 ID 및 출시 일정을 확인합니다.

750B-class listing

FP8 checkpoint

Approximately 756 GB

Reference deployment: 8× H200

checkpoint 출처 보기
팀이 검토하는 이유

추론, Agent 오케스트레이션, 구조화 생성 및 대규모 전용 추론을 평가하는 팀을 위한 고용량 다국어 모델 옵션입니다.

가벼운 공유 엔드포인트보다 예약 용량이 필요한 대규모 멀티 GPU 워크로드에 적합합니다.
상업적 사용 사례
다국어 추론 및 문서 워크플로
도구 호출과 Agent 오케스트레이션 실험
코드 생성 및 기술 분석
비공개 엔터프라이즈 어시스턴트와 배치 처리

비공개 액세스 절차

가입 후 액세스가 확정됩니다

01
1

계정 만들기

LLMsRelay에 가입하고 개발자 dashboard를 여세요.

02
2

워크로드 정의

대상 모델, 예상 token 양, 동시성, 지역 및 지연 시간 요구사항을 제출하세요.

03
3

용량 확인

GPU 가용성, 라이선스 제한, 라우팅 및 상업 조건을 검토합니다.

04
4

통합

활성화 후 계정에 확정된 모델 ID와 API 설정을 사용합니다.

통합 목표

LLMsRelay를 통한 OpenAI 호환 요청 흐름을 목표로 합니다. 정확한 모델 ID와 엔드포인트 가용성은 액세스 검토 후 제공됩니다.

가용성

즉시 사용할 수 있는 공개 self-serve 카탈로그 항목이 아닙니다. 승인된 계정에 용량을 예약하거나 프로비저닝하며 지역과 배포 규모에 따라 달라질 수 있습니다.

라이선스 및 허용 사용

액세스에는 checkpoint 라이선스, 적용 법률 및 LLMsRelay 허용 사용 통제가 적용됩니다. Uncensored는 무제한 또는 익명 사용을 의미하지 않습니다.

모델 액세스 질문

LLMsRelay에서 GLM 5.3 Uncensored 750B을 사용할 수 있나요?

통제형 액세스 절차를 통해 제공됩니다. 가입 후 용량 및 배포 검토가 시작되며 즉시 공개 모델 ID가 보장되지는 않습니다.

OpenAI 호환 클라이언트를 사용할 수 있나요?

목표 통합 방식입니다. 최종 base URL, 모델 ID, 제한 및 스트리밍 동작은 활성화된 계정별로 확정됩니다.

얼마나 빨리 활성화되나요?

모델, GPU 용량, 지역, 동시성, 라이선스 검토 및 예상 사용량에 따라 달라집니다. 워크로드 검토 후 일정을 확인합니다.

Uncensored는 제한이 없다는 뜻인가요?

아닙니다. Checkpoint 동작과 플랫폼 정책은 별개이며 적용 법률, 오용 방지, 라이선스 및 계정 통제가 계속 적용됩니다.

비공개 모델 옵션 비교

다른 통제형 액세스 checkpoint를 검토하고 워크로드에 맞는 용량 프로필을 선택하세요.

제품에 이 모델을 연결하세요

가입하고 워크로드를 설명하면 하드웨어와 라우팅을 직접 추측하지 않고 용량 기반 통합 계획을 받을 수 있습니다.

가입하고 액세스 요청