Продукты

Облачные серверы

Облачные серверы с посекундной тарификацией. Изолированные ресурсы дадут максимальную производительность для вашего проекта.

GPU-серверы

Облачные серверы с современными графическими ускорителями RTX и Tesla для игр, рендеринга, стриминга, работы с 3Д-графикой, искусственным интеллектом.

Tesla H100

RTX 5090

RTX 4090

RTX 3090

RTX 3080

Tesla A100

RTX A5000

Tesla A10

RTX 2080 Ti

Tesla A2

Tesla T4

Tesla V100

Все GPU-серверы

CPU-серверы

Облачные серверы с высокопроизводительными центральными процессорами Intel Xeon Gold второго и третьего поколений, доступные на 100% процессорного времени.
SSD-серверы NVMe-серверы
Все CPU-серверы

Выделенные серверы

Арендуйте физически выделенный сервер на длительный срок с помесячной оплатой. Собрерите конфигурацию с использованием современных комлектующих: процессоров Intel Xeon Gold 2-го и 3-го поколений, до 10 новейших видеоускорителей RTX и Tesla и до 8192 ГБ RAM на сервер, SSD- и NVMe-дисков для дата-центров.

Выбрать выделенный сервер

Маркетплейс

Используйте популярные и современные приложения в качестве эффективных инструментов для организации вашего проекта. Экономьте время с помощью предварительно настроенных образов, в которых уже установлены все необходимые компоненты.

Забудьте про ручную загрузку и установку программного обеспечения — просто разверните виртуальный сервер с готовым образом.
Нейронные сети 3D CUDA Docker / NGC Для игр Windows-образы Linux-образы
Все предустановленные образы
Возможности
Тарифы
FAQ
Контакты
Вход

Qwen3-235B-A22B

размышляющая

русскоязычная

Qwen3-235B-A22B представляет собой флагманскую модель серии Qwen3 и одну из самых масштабных открытых языковых моделей в мире. Общее количество её параметров составляет 235 миллиардов, при этом для каждого токена активируется 22 миллиарда. Это стало возможным благодаря эффективной архитектуре Mixture of Experts (MoE), которая включает 128 экспертов, из которых задействуются только 8 на каждом шаге вычислений. Инновационные решения в области работы механизма внимания обеспечивают высокую точность обработки контекста и возможность работы с последовательностями длиной до 128 тысяч токенов.

Одной из ключевых особенностей Qwen3-235B-A22B является поддержка двух режимов работы: thinking и no-thinking . В режиме thinking модель применяет расширенные логические цепочки и дополнительные вычислительные ресурсы для анализа задачи, что позволяет достигать максимального уровня точности и глубины рассуждений. Режим no-thinking, напротив, оптимизирован для быстрого выполнения простых задач, таких как форматирование текста, перевод или краткие ответы, без лишней нагрузки на вычислительные мощности. Эта функциональность даёт пользователям гибкость в выборе баланса между скоростью и качеством вывода.

Qwen3-235B-A22B может использоваться в научных исследованиях, разработке программного обеспечения, автоматизации тестирования, обработке технической документации и создании ИИ-агентов. Модель подходит как для академической среды, так и для государственных и корпоративных проектов, где важны высокая точность, масштабируемость и гибкая настройка под задачи пользователя. А поддержка 119 языков делает модель удобной для международного использования.

Дата анонса: 29.04.2025
Параметров: 235B
Экспертов: 128
Активно параметров при инференсе: 22B
Контекст: 131K
Тип внимания: Full or Sliding Window Attention
Потребление памяти: 132.9 ГБ в точности 4 бит
Разработчик: Alibaba
Версия Transformers: 4.51.0
Версия Ollama: 0.6.6
Лицензия: Apache 2.0

Публичный эндпоинт

Воспользуйтесь нашими готовыми публичными эндпоинтами для теста инференса и знакомства с Qwen3-235B-A22B.

Наименование модели	Контекст	Тип	GPU	TPS	Статус	Ссылка


            Для данной модели пока нет публичных эндпоинтов.

Частный сервер

Арендуйте собственный физически выделенный инстанс с почасовой оплатой или на длительный срок с помесячной оплатой.

Мы рекомендуем создание частных инстансов в случаях, если необходимо:

получить максимальную производительность эндпоинта,
получить полный контекст для обработки больших запросов и диалогов,
обеспечить максимальную безопасность, для обработки данных в выделенном изолированном пространстве,
использовать кастомизированные веса: fine-tuned версии или lora-адаптеры.

Наименование	vCPU	ОЗУ, МБ	Диск, ГБ	GPU	Цена, тариф	Цена, час	Цена, месяц
teslaa100-2.24.256.240	24	262144	240	2		478,74 ₽	344 692,80 ₽	Запустить
teslah100-2.24.256.240	24	262144	240	2		929,74 ₽	669 412,80 ₽	Запустить

Наименование	vCPU	ОЗУ, МБ	Диск, ГБ	GPU	Цена, тариф	Цена, час	Цена, месяц
teslaa100-4.44.512.320	44	524288	320	4		953,57 ₽	686 570,40 ₽	Запустить
teslah100-4.44.512.320	44	524288	320	4		1 855,57 ₽	1 336 010,40 ₽	Запустить

Связанные модели

Qwen3-30B-A3B

Qwen3-0.6B

Qwen3-1.7B

Qwen3-4B

Qwen3-8B

Qwen3-14B

Qwen3-32B

DeepSeek-R1-0528-Qwen3-8B

T-pro-2.0

Qwen3-235B-A22B-Instruct-2507

Qwen3-235B-A22B-Thinking-2507

Qwen3-Coder-480B-A35B-Instruct

Qwen3-Coder-30B-A3B-Instruct

Остались вопросы?

Свяжитесь с нашей специализированной группой поддержки по нейросетям nn@immers.cloud или отправьте ваш запрос в отдел продаж sale@immers.cloud.

Qwen3-235B-A22B

Публичный эндпоинт

Частный сервер

Рекомендуемые конфигурации для хостинга Qwen3-235B-A22B

Связанные модели

Остались вопросы?