Qwen3-1.7B – модель с 1.7 миллиардами параметров, сохраняющую архитектуру из 28 слоев и поддерживающую контекстное окно в 40K токенов. Модель использует ту же конфигурацию внимания (16/8 голов) и архитектурные решения, что и младшая модель в серии, но обладает значительно большими возможностями благодаря увеличенному количеству параметров. Обучение на 36 триллионах токенов с поддержкой 119 языков обеспечивает существенное улучшение качества понимания и генерации текста по сравнению с более аналогичными по размеру решениями.
Модель демонстрирует хорошее качество в задачах, требующих рассуждений и контекстного понимания, сохраняя при этом высокую эффективность вычислений. Интегрированные режимы thinking и non-thinking позволяют модели адаптироваться к различным типам запросов — от быстрых информационных до аналитических задач средней сложности. А механизм thinking budget особенно полезен для оптимизации производительности в условиях переменной нагрузки.
Qwen3-1.7B оптимальна для desktop приложений облачных сервисов с умеренными требованиями к ресурсам и простых корпоративных решений. Модель превосходно справляется с задачами анализа документов, многоязычной поддержки клиентов и работой в образовательных приложениях, где требуется баланс между качеством и скоростью обработки.
| Наименование модели | Контекст | Тип | GPU | Статус | Ссылка |
|---|
Для данной модели пока нет публичных эндпоинтов.
Арендуйте собственный физически выделенный инстанс с почасовой оплатой или на длительный срок с помесячной оплатой.
Мы рекомендуем создание частных инстансов в случаях, если необходимо:
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
40 960 |
1 | 33,74 ₽ | 2,02 | Запустить | ||
40 960 |
1 | 46,94 ₽ | 3,68 | Запустить | ||
40 960 |
1 | 73,73 ₽ | 3,90 | Запустить | ||
40 960 tensor |
2 | 86,54 ₽ | 2,23 | Запустить | ||
40 960 |
1 | 91,14 ₽ | 3,89 | Запустить | ||
40 960 tensor |
2 | 109,77 ₽ | 7,65 | Запустить | ||
40 960 |
1 | 141,77 ₽ | 5,54 | Запустить | ||
40 960 |
1 | 211,77 ₽ | 15,61 | Запустить | ||
40 960 |
1 | 341,77 ₽ | 15,60 | Запустить | ||
40 960 |
1 | 367,41 ₽ | 18,52 | Запустить | ||
40 960 tensor |
2 | 411,81 ₽ | 31,52 | Запустить | ||
40 960 |
1 | 423,04 ₽ | 28,34 | Запустить | ||
40 960 tensor |
2 | 839,97 ₽ | 56,99 | Запустить | ||
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
40 960 |
1 | 33,74 ₽ | 1,88 | Запустить | ||
40 960 |
1 | 46,94 ₽ | 3,54 | Запустить | ||
40 960 |
1 | 73,73 ₽ | 3,76 | Запустить | ||
40 960 tensor |
2 | 86,54 ₽ | 2,09 | Запустить | ||
40 960 |
1 | 91,14 ₽ | 3,75 | Запустить | ||
40 960 tensor |
2 | 109,77 ₽ | 7,51 | Запустить | ||
40 960 |
1 | 141,77 ₽ | 5,40 | Запустить | ||
40 960 |
1 | 211,77 ₽ | 15,47 | Запустить | ||
40 960 |
1 | 341,77 ₽ | 15,46 | Запустить | ||
40 960 |
1 | 367,41 ₽ | 18,38 | Запустить | ||
40 960 tensor |
2 | 411,81 ₽ | 31,38 | Запустить | ||
40 960 |
1 | 423,04 ₽ | 28,20 | Запустить | ||
40 960 tensor |
2 | 839,97 ₽ | 56,85 | Запустить | ||
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
40 960 |
1 | 33,74 ₽ | 1,45 | Запустить | ||
40 960 |
1 | 46,94 ₽ | 3,11 | Запустить | ||
40 960 |
1 | 73,73 ₽ | 3,34 | Запустить | ||
40 960 tensor |
2 | 86,54 ₽ | 1,67 | Запустить | ||
40 960 |
1 | 91,14 ₽ | 3,33 | Запустить | ||
40 960 tensor |
2 | 109,77 ₽ | 7,09 | Запустить | ||
40 960 |
1 | 141,77 ₽ | 4,97 | Запустить | ||
40 960 |
1 | 211,77 ₽ | 15,05 | Запустить | ||
40 960 |
1 | 341,77 ₽ | 15,03 | Запустить | ||
40 960 |
1 | 367,41 ₽ | 17,96 | Запустить | ||
40 960 tensor |
2 | 411,81 ₽ | 30,96 | Запустить | ||
40 960 |
1 | 423,04 ₽ | 27,78 | Запустить | ||
40 960 tensor |
2 | 839,97 ₽ | 56,42 | Запустить | ||
Свяжитесь с нашей специализированной группой поддержки по нейросетям nn@immers.cloud или отправьте ваш запрос в отдел продаж sale@immers.cloud.