Granite-4.0-H-Tiny представляет компактную гибридную модель смеси экспертов с 7 миллиардами общих параметров и всего 1 миллиардом активных параметров во время инференса. Архитектурно H-Tiny повторяет структуру H-Small с тем же соотношением 9:1 между Mamba-2 и трансформерными слоями, но использует меньшее количество параметров в каждом слое. Модель обучена на корпусе из 22 триллионов токенов, что обеспечивает высокое качество на корпоративных задачах несмотря на компактный размер. Поддерживается контекст до 128K токенов с теоретической возможностью расширения благодаря константным требованиям к памяти у Mamba-2.
Производительность H-Tiny впечатляет. На бенчмарке IFEval модель достигает результата 81.44% в среднем значении, в задачах MMLU модель показывает 68.65%, демонстрируя сильные способности в понимании и рассуждениях.
Эта модель специально разработана для edge-развертываний, локальных приложений и сценариев с низкой задержкой, где критичны скорость отклика и минимальные требования к ресурсам. По сведениям разработчиков модель требует всего 8 GB памяти в 8-битном режиме, что позволяет запускать ее на потребительских GPU типа RTX 3060 с 12GB памяти. В корпоративных сценариях H-Tiny рекомендуется использовать как быстрый компонент для выполнения специфических задач в составе более крупных агентских систем, а также в сценариях, где важно соблюдение требований к конфиденциальности данных. Например, модель может обрабатывать function calling, извлечение данных и их обезличивание или классификацию, передавая более сложные задачи рассуждений другим моделям системы.
Наименование модели | Контекст | Тип | GPU | TPS | Статус | Ссылка |
---|
Для данной модели пока нет публичных эндпоинтов.
Арендуйте собственный физически выделенный инстанс с почасовой оплатой или на длительный срок с помесячной оплатой.
Мы рекомендуем создание частных инстансов в случаях, если необходимо:
Наименование | vCPU | ОЗУ, МБ | Диск, ГБ | GPU | |||
---|---|---|---|---|---|---|---|
131 072 |
16 | 16384 | 160 | 1 | 29,33 ₽ | Запустить | |
131 072 |
10 | 16384 | 500 | 1 | 34,23 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 1 | 33,74 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 1 | 46,94 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 1 | 51,34 ₽ | Запустить | |
131 072 |
16 | 24576 | 160 | 1 | 78,53 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 1 | 103,04 ₽ | Запустить | |
131 072 |
12 | 65536 | 160 | 1 | 107,57 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 2 | 109,77 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 1 | 141,77 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 1 | 230,77 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 1 | 456,27 ₽ | Запустить | |
131 072 |
16 | 131072 | 160 | 1 | 623,04 ₽ | Запустить |
Наименование | vCPU | ОЗУ, МБ | Диск, ГБ | GPU | |||
---|---|---|---|---|---|---|---|
131 072 |
16 | 16384 | 160 | 1 | 29,33 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 1 | 33,74 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 1 | 46,94 ₽ | Запустить | |
131 072 |
12 | 65536 | 160 | 2 | 61,37 ₽ | Запустить | |
131 072 |
16 | 24576 | 160 | 1 | 78,53 ₽ | Запустить | |
131 072 |
16 | 32762 | 160 | 2 | 86,54 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 1 | 103,04 ₽ | Запустить | |
131 072 |
12 | 65536 | 160 | 1 | 107,57 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 2 | 109,77 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 1 | 141,77 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 1 | 230,77 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 1 | 456,27 ₽ | Запустить | |
131 072 |
16 | 131072 | 160 | 1 | 623,04 ₽ | Запустить |
Наименование | vCPU | ОЗУ, МБ | Диск, ГБ | GPU | |||
---|---|---|---|---|---|---|---|
131 072 |
16 | 32768 | 160 | 1 | 46,94 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 2 | 48,14 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 2 | 51,34 ₽ | Запустить | |
131 072 |
12 | 65536 | 160 | 2 | 61,37 ₽ | Запустить | |
131 072 |
16 | 24576 | 160 | 1 | 78,53 ₽ | Запустить | |
131 072 |
16 | 32768 | 160 | 1 | 103,04 ₽ | Запустить | |
131 072 |
12 | 65536 | 160 | 1 | 107,57 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 2 | 109,77 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 3 | 127,37 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 1 | 141,77 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 1 | 230,77 ₽ | Запустить | |
131 072 |
16 | 65536 | 160 | 1 | 456,27 ₽ | Запустить | |
131 072 |
16 | 131072 | 160 | 1 | 623,04 ₽ | Запустить |
Свяжитесь с нашей специализированной группой поддержки по нейросетям nn@immers.cloud или отправьте ваш запрос в отдел продаж sale@immers.cloud.