DeepSeek V4.1 Flash Uncensored 750B비공개 API 액세스
고처리량 추론, 코드 생성, 연구 파이프라인 및 통제된 사내 AI 워크로드를 위한 대형 DeepSeek 계열 FP8 checkpoint의 비공개 액세스를 요청하세요.
비공개 용량
가입 후 액세스가 확정됩니다
이 모델은 통제형 액세스 절차로 제공됩니다. 가입 후 예상 트래픽과 배포 요구사항을 제출하면 LLMsRelay가 용량, 상업 조건, 모델 ID 및 출시 일정을 확인합니다.
750B-class listing
FP8 checkpoint
Approximately 510 GB
Reference deployment: 4× H200
전용 용량, 예측 가능한 라우팅, 소비자용 채팅 UI에 의존하지 않는 배포 경로가 필요한 팀을 위한 대형 추론 checkpoint입니다.
비공개 액세스 절차
가입 후 액세스가 확정됩니다
계정 만들기
LLMsRelay에 가입하고 개발자 dashboard를 여세요.
워크로드 정의
대상 모델, 예상 token 양, 동시성, 지역 및 지연 시간 요구사항을 제출하세요.
용량 확인
GPU 가용성, 라이선스 제한, 라우팅 및 상업 조건을 검토합니다.
통합
활성화 후 계정에 확정된 모델 ID와 API 설정을 사용합니다.
통합 목표
LLMsRelay를 통한 OpenAI 호환 요청 흐름을 목표로 합니다. 정확한 모델 ID와 엔드포인트 가용성은 액세스 검토 후 제공됩니다.
가용성
즉시 사용할 수 있는 공개 self-serve 카탈로그 항목이 아닙니다. 승인된 계정에 용량을 예약하거나 프로비저닝하며 지역과 배포 규모에 따라 달라질 수 있습니다.
라이선스 및 허용 사용
액세스에는 checkpoint 라이선스, 적용 법률 및 LLMsRelay 허용 사용 통제가 적용됩니다. Uncensored는 무제한 또는 익명 사용을 의미하지 않습니다.
모델 액세스 질문
LLMsRelay에서 DeepSeek V4.1 Flash Uncensored 750B을 사용할 수 있나요?
통제형 액세스 절차를 통해 제공됩니다. 가입 후 용량 및 배포 검토가 시작되며 즉시 공개 모델 ID가 보장되지는 않습니다.
OpenAI 호환 클라이언트를 사용할 수 있나요?
목표 통합 방식입니다. 최종 base URL, 모델 ID, 제한 및 스트리밍 동작은 활성화된 계정별로 확정됩니다.
얼마나 빨리 활성화되나요?
모델, GPU 용량, 지역, 동시성, 라이선스 검토 및 예상 사용량에 따라 달라집니다. 워크로드 검토 후 일정을 확인합니다.
Uncensored는 제한이 없다는 뜻인가요?
아닙니다. Checkpoint 동작과 플랫폼 정책은 별개이며 적용 법률, 오용 방지, 라이선스 및 계정 통제가 계속 적용됩니다.
비공개 모델 옵션 비교
다른 통제형 액세스 checkpoint를 검토하고 워크로드에 맞는 용량 프로필을 선택하세요.