Контролируемый доступ к open-моделям

Qwen 3.8 Flash Uncensored 120Bприватный API-доступ

Запросите контролируемый доступ к компактному NVFP4-чекпоинту Qwen класса 120B для быстрого приватного inference, мультиязычных приложений, агентов и экономичного dedicated deployment.

120B-class checkpointNVFP4 checkpointPrivate APIOpenAI-compatible target

Приватная мощность

Доступ подтверждается после регистрации

Модель подключается через controlled-access flow. Зарегистрируйтесь, укажите ожидаемый трафик и требования к deployment, после чего LLMsRelay подтвердит мощность, коммерческие условия, model ID и сроки запуска.

120B-class checkpoint

NVFP4 checkpoint

Approximately 135 GB

Reference deployment: 2× DGX Spark

Открыть источник чекпоинта
Почему её рассматривают

Вариант с меньшим footprint для команд, которым нужна более лёгкая инфраструктура без отказа от мультиязычности и agent-oriented сценариев.

Самый инфраструктурно эффективный вариант из трёх; доступ зависит от мощности и подтверждения коммерческих лицензионных условий для конкретного deployment.
Коммерческие сценарии
Приватные ассистенты с низкой задержкой
Мультиязычная поддержка и content operations
Прототипы агентов и tool workflows
Выделенный inference с меньшим GPU footprint

Как подключается приватный доступ

Доступ подтверждается после регистрации

01
1

Создайте аккаунт

Зарегистрируйтесь в LLMsRelay и откройте developer dashboard.

02
2

Опишите нагрузку

Укажите модель, объём токенов, concurrency, регион и требования к latency.

03
3

Подтвердите мощность

Мы проверим GPU, лицензионные ограничения, routing и коммерческие условия deployment.

04
4

Интегрируйте

После активации используйте model ID и API-конфигурацию, подтверждённые для аккаунта.

Целевая интеграция

Планируемый способ подключения — OpenAI-compatible запросы через LLMsRelay. Точный model ID и доступность endpoint выдаются после проверки доступа.

Доступность

Это не мгновенный self-serve пункт публичного каталога. Мощность резервируется или разворачивается для подтверждённых аккаунтов и зависит от региона и размера deployment.

Лицензия и допустимое использование

Доступ зависит от лицензии чекпоинта, применимого права и acceptable-use контролей LLMsRelay. Uncensored не означает неограниченное или анонимное использование.

Доступ зависит от лицензии чекпоинта, применимого права и acceptable-use контролей LLMsRelay. Uncensored не означает неограниченное или анонимное использование.

Вопросы о доступе к модели

Qwen 3.8 Flash Uncensored 120B доступна в LLMsRelay?

Да, через controlled-access процесс. Регистрация запускает проверку мощности и deployment; мгновенный публичный model ID пока не обещается.

Можно использовать OpenAI-compatible клиент?

Это целевой путь интеграции. Финальный base URL, model ID, лимиты и streaming подтверждаются для активированного аккаунта.

Как быстро включается доступ?

Срок зависит от модели, GPU-мощности, региона, concurrency, лицензионной проверки и объёма. LLMsRelay подтверждает срок после разбора нагрузки.

Uncensored означает отсутствие ограничений?

Нет. Поведение чекпоинта и правила платформы — разные вещи. Применимое право, защита от abuse, лицензия и account controls продолжают действовать.

Сравните приватные модели

Посмотрите остальные controlled-access чекпоинты и выберите профиль мощности под свою нагрузку.

Подключите модель к своему продукту

Зарегистрируйтесь, опишите нагрузку и получите подтверждённый мощностью план интеграции без самостоятельного подбора железа и routing.

Зарегистрироваться и запросить доступ