Qwen3-30B-A3B представляет первую Mixture-of-Experts (MoE) в серии с общим количеством 30 миллиардов параметров, из которых только 3 миллиарда активируются для каждого токена. Модель построена на архитектуре с 48 слоями, 32 головами внимания и поддерживает контекстное окно в 128K токенов.
Модель использует инновационную архитектуру Mixture of Experts (MoE) со 128 экспертами, из которых на каждый токен активируются только 8. Это позволяет добиться эффективности инференса, сравнимой с компактными 3B-параметрическими моделями, при этом качество генерации приближается к уровню плотных 30B-моделей. Ключевое преимущество MoE-подхода – оптимальное сочетание высокой производительности и энергоэффективности. Система динамически выбирает наиболее подходящих экспертов под конкретную задачу, что обеспечивает превосходное качество обработки при значительно меньших вычислительных затратах по сравнению с плотными аналогами аналогичного уровня.
Qwen3-30B-A3B подходит для высоконагруженных систем, требующих баланса между качеством и производительностью: облачные API-сервисы, корпоративные чат-боты, системы автоматизации контента, многопользовательские AI-платформы. Модель идеально подходит для компаний, которым необходимо качество крупных моделей при ограниченном бюджете на вычисления.
Наименование модели | Контекст | Тип | GPU | TPS | Статус | Ссылка |
---|
Для данной модели пока нет публичных эндпоинтов.
Арендуйте собственный физически выделенный инстанс с почасовой оплатой или на длительный срок с помесячной оплатой.
Мы рекомендуем создание частных инстансов в случаях, если необходимо:
Наименование | vCPU | ОЗУ, МБ | Диск, ГБ | GPU | |||
---|---|---|---|---|---|---|---|
16 | 32768 | 160 | 2 | 51,34 ₽ | Запустить | ||
16 | 32768 | 160 | 2 | 71,14 ₽ | Запустить | ||
16 | 65536 | 160 | 2 | 83,37 ₽ | Запустить | ||
16 | 65536 | 160 | 3 | 84,47 ₽ | Запустить | ||
12 | 65536 | 160 | 1 | 107,57 ₽ | Запустить | ||
16 | 65536 | 160 | 3 | 127,37 ₽ | Запустить | ||
16 | 65536 | 160 | 1 | 141,77 ₽ | Запустить | ||
16 | 65536 | 160 | 2 | 149,37 ₽ | Запустить | ||
16 | 65536 | 160 | 2 | 195,57 ₽ | Запустить | ||
16 | 65536 | 160 | 1 | 230,77 ₽ | Запустить | ||
16 | 65536 | 160 | 1 | 456,27 ₽ | Запустить |
Наименование | vCPU | ОЗУ, МБ | Диск, ГБ | GPU | |||
---|---|---|---|---|---|---|---|
16 | 65536 | 160 | 2 | 83,37 ₽ | Запустить | ||
16 | 65536 | 160 | 4 | 131,77 ₽ | Запустить | ||
16 | 65536 | 160 | 2 | 149,37 ₽ | Запустить | ||
16 | 65536 | 160 | 2 | 195,57 ₽ | Запустить | ||
16 | 65535 | 240 | 2 | 198,54 ₽ | Запустить | ||
16 | 65536 | 160 | 1 | 230,77 ₽ | Запустить | ||
16 | 65536 | 160 | 2 | 261,77 ₽ | Запустить | ||
16 | 65536 | 160 | 1 | 456,27 ₽ | Запустить |
Наименование | vCPU | ОЗУ, МБ | Диск, ГБ | GPU | |||
---|---|---|---|---|---|---|---|
16 | 131072 | 160 | 4 | 156,24 ₽ | Запустить | ||
16 | 131072 | 160 | 1 | 242,04 ₽ | Запустить | ||
16 | 131072 | 160 | 4 | 288,24 ₽ | Запустить | ||
16 | 131072 | 160 | 4 | 380,64 ₽ | Запустить | ||
16 | 98304 | 160 | 3 | 387,41 ₽ | Запустить | ||
16 | 131072 | 160 | 1 | 467,54 ₽ | Запустить |
Свяжитесь с нашей специализированной группой поддержки по нейросетям nn@immers.cloud или отправьте ваш запрос в отдел продаж sale@immers.cloud.