Qwen 3.8 Flash Uncensored 120Bприватный API-доступ
Запросите контролируемый доступ к компактному NVFP4-чекпоинту Qwen класса 120B для быстрого приватного inference, мультиязычных приложений, агентов и экономичного dedicated deployment.
Приватная мощность
Доступ подтверждается после регистрации
Модель подключается через controlled-access flow. Зарегистрируйтесь, укажите ожидаемый трафик и требования к deployment, после чего LLMsRelay подтвердит мощность, коммерческие условия, model ID и сроки запуска.
120B-class checkpoint
NVFP4 checkpoint
Approximately 135 GB
Reference deployment: 2× DGX Spark
Вариант с меньшим footprint для команд, которым нужна более лёгкая инфраструктура без отказа от мультиязычности и agent-oriented сценариев.
Как подключается приватный доступ
Доступ подтверждается после регистрации
Создайте аккаунт
Зарегистрируйтесь в LLMsRelay и откройте developer dashboard.
Опишите нагрузку
Укажите модель, объём токенов, concurrency, регион и требования к latency.
Подтвердите мощность
Мы проверим GPU, лицензионные ограничения, routing и коммерческие условия deployment.
Интегрируйте
После активации используйте model ID и API-конфигурацию, подтверждённые для аккаунта.
Целевая интеграция
Планируемый способ подключения — OpenAI-compatible запросы через LLMsRelay. Точный model ID и доступность endpoint выдаются после проверки доступа.
Доступность
Это не мгновенный self-serve пункт публичного каталога. Мощность резервируется или разворачивается для подтверждённых аккаунтов и зависит от региона и размера deployment.
Лицензия и допустимое использование
Доступ зависит от лицензии чекпоинта, применимого права и acceptable-use контролей LLMsRelay. Uncensored не означает неограниченное или анонимное использование.
Вопросы о доступе к модели
Qwen 3.8 Flash Uncensored 120B доступна в LLMsRelay?
Да, через controlled-access процесс. Регистрация запускает проверку мощности и deployment; мгновенный публичный model ID пока не обещается.
Можно использовать OpenAI-compatible клиент?
Это целевой путь интеграции. Финальный base URL, model ID, лимиты и streaming подтверждаются для активированного аккаунта.
Как быстро включается доступ?
Срок зависит от модели, GPU-мощности, региона, concurrency, лицензионной проверки и объёма. LLMsRelay подтверждает срок после разбора нагрузки.
Uncensored означает отсутствие ограничений?
Нет. Поведение чекпоинта и правила платформы — разные вещи. Применимое право, защита от abuse, лицензия и account controls продолжают действовать.
Сравните приватные модели
Посмотрите остальные controlled-access чекпоинты и выберите профиль мощности под свою нагрузку.
Подключите модель к своему продукту
Зарегистрируйтесь, опишите нагрузку и получите подтверждённый мощностью план интеграции без самостоятельного подбора железа и routing.
Зарегистрироваться и запросить доступ