MiniMax M2 — это фундаментальная модель, заложившая архитектурные и методологические принципы всей серии. Разработанная для максимальной эффективности в агентных сценариях и программировании, M2 доказывает, что компактная архитектура может конкурировать с огромными моделями при правильном подходе к обучению и данным.
Архитектура модели — Mixture-of-Experts с 230 миллиардами общих параметров, из которых активируется только 10 миллиардов на токен. Ключевой особенностью является полное внимание (full attention) вместо гибридных механизмов — команда сознательно отказалась от sparse/linear attention после экспериментов, показавших деградацию качества на сложных многошаговых рассуждениях и агентных задачах. Модель внедряет Interleaved Thinking — паттерн чередующегося мышления, где режим рассуждений может происходить между шагами генерации и использования инструментов, а не только в начале диалога.
Уникальность M2 заключается в её роли как фундамента для всей серии. Она не просто отдельная модель, а первая реализация философии MiniMax, согласно которой будущее за "агент-нативными" LLM. Ключевая идея, заложенная в M2, — это подготовка модели не просто к генерации текста, а к решению задач в рамках агентного подхода, где требуется планирование, использование инструментов и адаптация к обратной связи. С практической точки зрения, это означает, что M2 отлично подходит для развертывания в качестве интеллектуального ядра ассистентов, способных работать с документами, анализировать таблицы и генерировать структурированные ответы, требующие понимания предметной области.
| Наименование модели | Контекст | Тип | GPU | Статус | Ссылка |
|---|
Для данной модели пока нет публичных эндпоинтов.
Арендуйте собственный физически выделенный инстанс с почасовой оплатой или на длительный срок с помесячной оплатой.
Мы рекомендуем создание частных инстансов в случаях, если необходимо:
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
196 608 pipeline |
3 | 657,66 ₽ | 1,99 | Запустить | ||
196 608 tensor |
2 | 729,47 ₽ | 1,12 | Запустить | ||
196 608 tensor |
4 | 816,34 ₽ | 3,56 | Запустить | ||
196 608 tensor |
2 | 840,74 ₽ | 2,96 | Запустить | ||
196 608 tensor |
2 | 840,74 ₽ | 2,96 | Запустить | ||
196 608 tensor |
4 | 848,44 ₽ | 3,56 | Запустить | ||
196 608 tensor |
8 | 1 031,74 ₽ | 1,95 | Запустить | ||
196 608 pipeline |
3 | 1 047,66 ₽ | 112.00 | 1,99 | Запустить | |
196 608 tensor |
4 | 1 336,34 ₽ | 3,55 | Запустить | ||
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
196 608 tensor |
4 | 848,44 ₽ | 72.96 | 1,42 | Запустить | |
196 608 tensor |
4 | 877,57 ₽ | 75.06 | 1,42 | Запустить | |
196 608 pipeline |
3 | 1 282,53 ₽ | 3,36 | Запустить | ||
196 608 tensor |
4 | 1 397,57 ₽ | 1,42 | Запустить | ||
196 608 tensor |
4 | 1 450,00 ₽ | 95.44 | 2,52 | Запустить | |
196 608 tensor |
4 | 1 717,59 ₽ | 6,21 | Запустить | ||
196 608 tensor |
4 | 1 717,59 ₽ | 6,21 | Запустить | ||
| Наименование | GPU | TPS | Параллельность (макс.) | |||
|---|---|---|---|---|---|---|
196 608 tensor |
8 | 1 677,58 ₽ | 2,79 | Запустить | ||
196 608 tensor |
4 | 1 719,14 ₽ | 1,61 | Запустить | ||
196 608 tensor |
4 | 1 719,14 ₽ | 1,61 | Запустить | ||
196 608 tensor |
8 | 2 804,12 ₽ | 85.60 | 2,78 | Запустить | |
Свяжитесь с нашей специализированной группой поддержки по нейросетям support@immers.cloud или отправьте ваш запрос в отдел продаж sale@immers.cloud.