Qwen3-0.6B — это самая компактная модель в серии, содержащая 600 миллионов параметров и поддерживающая контекстное окно в 40K токенов. Модель построена на архитектуре из 28 слоев с 16 головами внимания для запросов и 8 головами для ключей и значений, что обеспечивает эффективное использование вычислительных ресурсов при сохранении высокого качества обработки текста. Несмотря на свой компактный размер, модель обучена на 36 триллионах токенов и поддерживает 119 языков и диалектов, что делает ее исключительно универсальной для своего класса.
Основным преимуществом Qwen3-0.6B является её исключительная эффективность при минимальных требованиях к ресурсам. Модель специально предназначена для развертывания на мобильных устройствах, edge-вычислениях и IoT-приложениях, где критичны низкое энергопотребление и быстрый инференс. Несмотря на компактный размер, модель демонстрирует впечатляющие результаты в задачах общего понимания языка, простых диалогах и базовой обработке текста.
Qwen3-0.6B идеально подходит для приложений с жесткими ограничениями по памяти и вычислительным ресурсам: чат-боты для мобильных приложений, встроенные AI-ассистенты, системы быстрой обработки текста и базовые задачи NLP, такие как текстовая классификация, извлечение информации и автоматическое реферирование.
| Наименование модели | Контекст | Тип | GPU | Статус | Ссылка |
|---|
Для данной модели пока нет публичных эндпоинтов.
Арендуйте собственный физически выделенный инстанс с почасовой оплатой или на длительный срок с помесячной оплатой.
Мы рекомендуем создание частных инстансов в случаях, если необходимо:
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
40 960 |
1 | 33,74 ₽ | 2,19 | Запустить | ||
40 960 |
1 | 46,94 ₽ | 3,85 | Запустить | ||
40 960 |
1 | 51,34 ₽ | 1,14 | Запустить | ||
40 960 |
1 | 73,73 ₽ | 4,08 | Запустить | ||
40 960 |
1 | 91,14 ₽ | 4,07 | Запустить | ||
40 960 tensor |
2 | 109,77 ₽ | 7,83 | Запустить | ||
40 960 |
1 | 141,77 ₽ | 5,72 | Запустить | ||
40 960 |
1 | 211,77 ₽ | 15,79 | Запустить | ||
40 960 |
1 | 341,77 ₽ | 15,77 | Запустить | ||
40 960 |
1 | 367,41 ₽ | 18,70 | Запустить | ||
40 960 tensor |
2 | 411,81 ₽ | 31,70 | Запустить | ||
40 960 |
1 | 423,04 ₽ | 28,52 | Запустить | ||
40 960 tensor |
2 | 839,97 ₽ | 57,16 | Запустить | ||
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
40 960 |
1 | 33,74 ₽ | 2,15 | Запустить | ||
40 960 |
1 | 46,94 ₽ | 3,81 | Запустить | ||
40 960 |
1 | 51,34 ₽ | 1,10 | Запустить | ||
40 960 |
1 | 73,73 ₽ | 4,04 | Запустить | ||
40 960 |
1 | 91,14 ₽ | 4,03 | Запустить | ||
40 960 tensor |
2 | 109,77 ₽ | 7,79 | Запустить | ||
40 960 |
1 | 141,77 ₽ | 5,68 | Запустить | ||
40 960 |
1 | 211,77 ₽ | 15,75 | Запустить | ||
40 960 |
1 | 341,77 ₽ | 15,73 | Запустить | ||
40 960 |
1 | 367,41 ₽ | 18,66 | Запустить | ||
40 960 tensor |
2 | 411,81 ₽ | 31,66 | Запустить | ||
40 960 |
1 | 423,04 ₽ | 28,48 | Запустить | ||
40 960 tensor |
2 | 839,97 ₽ | 57,12 | Запустить | ||
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
40 960 |
1 | 33,74 ₽ | 2,00 | Запустить | ||
40 960 |
1 | 46,94 ₽ | 3,66 | Запустить | ||
40 960 |
1 | 73,73 ₽ | 3,88 | Запустить | ||
40 960 tensor |
2 | 86,54 ₽ | 2,21 | Запустить | ||
40 960 |
1 | 91,14 ₽ | 3,87 | Запустить | ||
40 960 tensor |
2 | 109,77 ₽ | 7,63 | Запустить | ||
40 960 |
1 | 141,77 ₽ | 5,52 | Запустить | ||
40 960 |
1 | 211,77 ₽ | 15,59 | Запустить | ||
40 960 |
1 | 341,77 ₽ | 15,58 | Запустить | ||
40 960 |
1 | 367,41 ₽ | 18,50 | Запустить | ||
40 960 tensor |
2 | 411,81 ₽ | 31,50 | Запустить | ||
40 960 |
1 | 423,04 ₽ | 28,32 | Запустить | ||
40 960 tensor |
2 | 839,97 ₽ | 56,97 | Запустить | ||
Свяжитесь с нашей специализированной группой поддержки по нейросетям nn@immers.cloud или отправьте ваш запрос в отдел продаж sale@immers.cloud.