Графические серверы с Tesla A100
Все графические серверы с Tesla A100 построены на базе двух центральных процессоров Intel Xeon Gold 3-го поколения — 6336Y, с базовой тактовой частотой 2,4 ГГц и максимальной тактовой частотой с технологией Turbo Boost 3,6 ГГц.
Каждый процессор содержит два блока Intel® AVX-512 и поддерживает функции Intel® AVX-512 Deep Learning Boost. Инструкции данного набора многократно ускоряют операции умножения и сложения с пониженной точностью, которые используются во многих внутренних циклах алгоритма глубокого обучения.
Каждый сервер имеет до 4096 ГБ оперативной памяти DDR4 ECC Reg 3200 МГц. Локальное хранилище общей емкостью 1920 ГБ, организовано на твердотельных накопителях Samsung, разработанных специально для дата-центров.
GPU Tesla A100
GPU Tesla A100 обеспечивает непревзойденное ускорение для задач ИИ, анализа данных и для решения самых сложных вычислительных задач. A100 представляет собой самую производительную комплексную платформу для ИИ и HPC, позволяя получать результаты в реальном времени и разворачивать масштабируемые решения.
При тренировке алгоритмов глубокого обучения, тензорные ядра с поддержкой Tensor Float (TF32) повышают производительность в 20 раз, не требуя изменений в коде, и в 2 раза ускоряют автоматическую функцию работы с различной точностью и FP16.
Тензорные ядра с двойной точностью обеспечивают самую большую производительность для высокопроизводительных вычислений с момента появления GPU. HPC-приложения также могут использовать TF32 для достижения до 11 раз большей пропускной способности для точных операций.
Специалистам по data science необходимо анализировать, визуализировать большие наборы данных и извлекать из них ценную информацию. Чтобы справиться с рабочими нагрузками, серверы укомплектованные графическими ускорителями A100 обеспечивают необходимую вычислительную мощь благодаря большим объемам высокоскоростной памяти с высокой пропускной способностью.
| Объем видеопамяти |
80 ГБ |
| Тип видеопамяти |
HBM2e |
| Пропускная способность памяти |
1935 Гбит/с |
| Энкодер/декодер |
1 энкодер, 2 декодера (декодирование AV1) |
Тесты производительности GPU
Результаты тестов производительности в виртуальной среде для 1 карты Tesla A100.
-
OctaneBench 2020
pts
-
Matrix multiply example
GFlop/s
-
Hashcat bcrypt
H/s
Базовые конфигурации с Tesla A100 80 GB
↔
Индивидуальная конфигурация
Конфигурации Tesla A100 80 GB с NVLink
Обеспечивают хорошую производительность для задач глубокого обучения, научных вычислений и инференса масштабных моделей. В отличие от одиночных A100, объединяют два (или более) GPU через NVLink — высокоскоростной интерконнект с пропускной способностью до 600 ГБ/с на пару GPU, что во много раз превосходит PCIe 4.0 и позволяет GPU обмениваться данными почти без задержек.
Главное преимущество — объединенное адресное пространство памяти. Два A100 с NVLink предоставляют до 160 ГБ совместно доступной HBM2e-памяти, что критично для запуска крупных LLM, MoE-моделей и сложных HPC-приложений без шардинга по узлам. Это особенно важно при работе с длинными контекстами, обучении foundation models или выполнении мульти-GPU-симуляций, где обмен градиентами и активациями не должен становиться узким местом.
Архитектура Ampere, тензорные ядра третьего поколения, поддержка TF32, FP64, FP16 и INT8, а также технология MIG (Multi-Instance GPU) делают A100 универсальной платформой: от высокоточных научных расчетов до энергоэффективного инференса в production. В конфигурациях с NVLink эти возможности раскрываются полностью — без потерь на межузловую коммуникацию.
Если вам нужен сервер с мощными видеокартами для реальных ИИ-нагрузок, выможете арендовать их в облаке immers.cloud. Это идеальное решение для тех, кто ищет сервер для обучения нейросетей с гарантированной производительностью, полной изоляцией ресурсов и поддержкой enterprise-инфраструктуры — без необходимости покупать и обслуживать собственное железо.
↔
Индивидуальная конфигурация
100% производительности
Мы закрепляем физические ядра процессора и графические адаптеры только за одним клиентом.
Это значит, что:
- Ядра процессора будут доступны на 100% процессорного времени;
- Выбранный графический ускоритель будет зарезервирован только за вашим сервером;
- Вы получите высокую производительность при работе с системой хранения.
Тестирование виртуальных серверов с локальными загрузочными дисками показывает до 75 000 IOPS1 на случайные операции чтения и до 20 000 IOPS на случайные операции записи.
Тестирование виртуальных серверов с сетевыми загрузочными дисками показывает до 70 000 IOPS1 на случайные операции чтения и до 60 000 IOPS на случайные операции записи.
Иммерсионное охлаждение обеспечивает минимальную температуру и гарантирует стабильность и более высокие тактовые частоты для каждого ядра центрального процессора или графического чипа.
Готовые образы с нужным ПО
Создавайте виртуальные серверы на базе любой из предустановленных операционных систем с необходимым набором.
Посмотрите все предустановленные образы
в Маркетплейсе.
Оригинальный API OpenStack
Для разработчиков и системных администраторов доступно управление облаком с помощью полноценного API OpenStack.
Пример аутентификации ninja_user:
$ curl -g -i -X POST https://api.immers.cloud:5000/v3/auth/tokens \
-H "Accept: application/json" \
-H "Content-Type: application/json" \
-H "User-Agent: YOUR-USER-AGENT" \
-d '{"auth": {"identity": {"methods": ["password"], "password": {"user": { "name": "ninja_user", "password": "ninja_password", "domain": {"id": "default"}}}}, "scope": {"project": {"name": "ninja_user", "domain": {"id": "default"}}}}}'
Пример создания ninja_vm:
$ curl -g -i -X POST https://api.immers.cloud:8774/v2.1/servers \
-H "Accept: application/json" \
-H "Content-Type: application/json" \
-H "User-Agent: YOUR-USER-AGENT" \
-H "X-Auth-Token: YOUR-API-TOKEN" \
-d '{"server": {"name": "ninja_vm", "imageRef": "8b85e210-d2c8-490a-a0ba-dc17183c0223", "key_name": "mykey01", "flavorRef": "8f9a148d-b258-42f7-bcc2-32581d86e1f1", "max_count": 1, "min_count": 1, "networks": [{"uuid": "cc5f6f4a-2c44-44a4-af9a-f8534e34d2b7"}]}}'
Пример выключения ninja_vm:
$ curl -g -i -X POST https://api.immers.cloud:8774/v2.1/servers/{server_id}/action \
-H "Accept: application/json" \
-H "Content-Type: application/json" \
-H "User-Agent: YOUR-USER-AGENT" \
-H "X-Auth-Token: YOUR-API-TOKEN" \
-d '{"os-stop" : null}'
Пример включения ninja_vm:
$ curl -g -i -X POST https://api.immers.cloud:8774/v2.1/servers/{server_id}/action \
-H "Accept: application/json" \
-H "Content-Type: application/json" \
-H "User-Agent: YOUR-USER-AGENT" \
-H "X-Auth-Token: YOUR-API-TOKEN" \
-d '{"os-start" : null}'
Пример остановки и освобождения ресурсов ninja_vm (остановка тарификации):
$ curl -g -i -X POST https://api.immers.cloud:8774/v2.1/servers/{server_id}/action \
-H "Accept: application/json" \
-H "Content-Type: application/json" \
-H "User-Agent: YOUR-USER-AGENT" \
-H "X-Auth-Token: YOUR-API-TOKEN" \
-d '{"shelve" : null}'
Пример удаления ninja_vm:
$ curl -g -i -X DELETE https://api.immers.cloud:8774/v2.1/servers/{server_id} \
-H "User-Agent: YOUR-USER-AGENT" \
-H "X-Auth-Token: YOUR-API-TOKEN"
Вся документация
Подпишитесь на нашу рассылку
Получайте уведомления о новых акциях и спецпредложениях на электронную почту.