A highly efficient 4-billion-parameter model optimized for mobile and embedded solutions. Despite its compact size, it retains all key capabilities of the series, including multimodality, hybrid attention, and long-context support up to 262K tokens, opening new horizons for on-device AI solutions.
| Наименование модели | Контекст | Тип | GPU | Статус | Ссылка |
|---|
Для данной модели пока нет публичных эндпоинтов.
Арендуйте собственный физически выделенный инстанс с почасовой оплатой или на длительный срок с помесячной оплатой.
Мы рекомендуем создание частных инстансов в случаях, если необходимо:
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
262 144 |
1 | 29,33 ₽ | 1,01 | Запустить | ||
262 144 |
1 | 33,74 ₽ | 1,01 | Запустить | ||
262 144 |
1 | 46,94 ₽ | 1,91 | Запустить | ||
262 144 tensor |
2 | 61,37 ₽ | 1,37 | Запустить | ||
262 144 |
1 | 73,73 ₽ | 1,91 | Запустить | ||
262 144 tensor |
2 | 86,54 ₽ | 1,15 | Запустить | ||
262 144 |
1 | 91,14 ₽ | 1,91 | Запустить | ||
262 144 |
1 | 107,57 ₽ | 2,80 | Запустить | ||
262 144 tensor |
2 | 109,77 ₽ | 4,28 | Запустить | ||
262 144 |
1 | 141,77 ₽ | 2,80 | Запустить | ||
262 144 |
1 | 211,77 ₽ | 8,17 | Запустить | ||
262 144 |
1 | 341,77 ₽ | 8,17 | Запустить | ||
262 144 |
1 | 367,41 ₽ | 9,73 | Запустить | ||
262 144 |
1 | 423,04 ₽ | 14,99 | Запустить | ||
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
262 144 |
1 | 46,94 ₽ | 1,72 | Запустить | ||
262 144 tensor |
2 | 48,14 ₽ | 2,30 | Запустить | ||
262 144 tensor |
2 | 51,34 ₽ | 2,30 | Запустить | ||
262 144 tensor |
2 | 61,37 ₽ | 1,19 | Запустить | ||
262 144 |
1 | 73,73 ₽ | 1,72 | Запустить | ||
262 144 tensor |
2 | 86,54 ₽ | 0,96 | Запустить | ||
262 144 |
1 | 91,14 ₽ | 1,72 | Запустить | ||
262 144 |
1 | 107,57 ₽ | 2,61 | Запустить | ||
262 144 tensor |
2 | 109,77 ₽ | 4,09 | Запустить | ||
262 144 |
1 | 141,77 ₽ | 2,61 | Запустить | ||
262 144 |
1 | 211,77 ₽ | 7,98 | Запустить | ||
262 144 |
1 | 341,77 ₽ | 7,98 | Запустить | ||
262 144 |
1 | 367,41 ₽ | 9,55 | Запустить | ||
262 144 |
1 | 423,04 ₽ | 14,80 | Запустить | ||
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
262 144 |
1 | 46,94 ₽ | 1,29 | Запустить | ||
262 144 tensor |
2 | 48,14 ₽ | 1,88 | Запустить | ||
262 144 tensor |
2 | 51,34 ₽ | 1,88 | Запустить | ||
262 144 |
1 | 73,73 ₽ | 1,29 | Запустить | ||
262 144 pipeline |
3 | 74,84 ₽ | 1,68 | Запустить | ||
262 144 |
1 | 91,14 ₽ | 1,29 | Запустить | ||
262 144 tensor |
4 | 99,74 ₽ | 2,60 | Запустить | ||
262 144 |
1 | 107,57 ₽ | 2,19 | Запустить | ||
262 144 tensor |
2 | 109,77 ₽ | 3,67 | Запустить | ||
262 144 pipeline |
3 | 127,37 ₽ | 1,34 | Запустить | ||
262 144 |
1 | 141,77 ₽ | 2,19 | Запустить | ||
262 144 tensor |
4 | 162,57 ₽ | 2,15 | Запустить | ||
262 144 |
1 | 211,77 ₽ | 7,56 | Запустить | ||
262 144 |
1 | 341,77 ₽ | 7,56 | Запустить | ||
262 144 |
1 | 367,41 ₽ | 9,12 | Запустить | ||
262 144 |
1 | 423,04 ₽ | 14,38 | Запустить | ||
Свяжитесь с нашей специализированной группой поддержки по нейросетям nn@immers.cloud или отправьте ваш запрос в отдел продаж sale@immers.cloud.