Qwen2.5-1.5B

русскоязычная

Qwen2.5-1.5B содержит 1.5 миллиарда параметров, предлагая значительное улучшение производительности по сравнению с 0.5B версией при сохранении относительно небольших вычислительных требований. Она поддерживает такое же контекстное окно в 32K токенов и генерацию до 8K токенов, что обеспечивает поддержку широкого спектра задач. Тем самым сохраняется ключевое преимущество легковесных моделей - баланс между производительностью и эффективностью. Модель демонстрирует хорошие способности в логическом рассуждении, понимании контекста и генерации связного текста на различных языках (включая русский). При этом она остается достаточно легкой для развертывания на устройствах с ограниченными вычислительными возможностями, чувствительных к энергопотреблению.

Qwen2.5-1.5B отличается высокой скоростью отклика, универсальностью и возможностью работы в ограниченных вычислительных условиях, сохраняя при этом достойный уровень ответов и понимания инструкций. Модель отлично подходит для корпоративных чат-ботов, интеллектуальных ассистентов, локальных систем поддержки, а также для образовательных и исследовательских проектов, где важна приватность данных и автономность.


Дата анонса: 19.09.2024
Параметров: 1.5B
Контекст: 32K
Тип внимания: Full Attention
Потребление памяти: 1.6 ГБ в точности 4 бит
Разработчик: Alibaba
Версия Transformers: 4.43.1
Лицензия: Apache 2.0

Публичный эндпоинт

Воспользуйтесь нашими готовыми публичными эндпоинтами для теста инференса и знакомства с Qwen2.5-1.5B.
Наименование модели Контекст Тип GPU TPS Статус Ссылка
Для данной модели пока нет публичных эндпоинтов.

Частный сервер

Арендуйте собственный физически выделенный инстанс с почасовой оплатой или на длительный срок с помесячной оплатой.

Мы рекомендуем создание частных инстансов в случаях, если необходимо:

  • получить максимальную производительность эндпоинта,
  • получить полный контекст для обработки больших запросов и диалогов,
  • обеспечить максимальную безопасность, для обработки данных в выделенном изолированном пространстве,
  • использовать кастомизированные веса: fine-tuned версии или lora-адаптеры.

Рекомендуемые конфигурации для хостинга Qwen2.5-1.5B

Цены:
Наименование vCPU ОЗУ, МБ Диск, ГБ GPU Цена, час
rtx2080ti-1.16.32.160 16 32768 160 1 37,04 ₽ Запустить
teslat4-1.16.16.160 16 16384 160 1 40,83 ₽ Запустить
teslaa10-1.16.32.160 16 32768 160 1 46,94 ₽ Запустить
teslaa2-2.16.32.160 16 32768 160 2 51,34 ₽ Запустить
rtx3090-1.16.24.160 16 24576 160 1 78,53 ₽ Запустить
rtx4090-1.16.32.160 16 32768 160 1 103,04 ₽ Запустить
teslav100-1.12.64.160 12 65536 160 1 107,57 ₽ Запустить
rtx5090-1.16.64.160 16 65536 160 1 141,77 ₽ Запустить
teslaa100-1.16.64.160 16 65536 160 1 230,77 ₽ Запустить
teslah100-1.16.64.160 16 65536 160 1 456,27 ₽ Запустить
Цены:
Наименование vCPU ОЗУ, МБ Диск, ГБ GPU Цена, час
rtx2080ti-1.16.32.160 16 32768 160 1 37,04 ₽ Запустить
teslat4-1.16.16.160 16 16384 160 1 40,83 ₽ Запустить
teslaa10-1.16.32.160 16 32768 160 1 46,94 ₽ Запустить
teslaa2-2.16.32.160 16 32768 160 2 51,34 ₽ Запустить
rtx3090-1.16.24.160 16 24576 160 1 78,53 ₽ Запустить
rtx4090-1.16.32.160 16 32768 160 1 103,04 ₽ Запустить
teslav100-1.12.64.160 12 65536 160 1 107,57 ₽ Запустить
rtx5090-1.16.64.160 16 65536 160 1 141,77 ₽ Запустить
teslaa100-1.16.64.160 16 65536 160 1 230,77 ₽ Запустить
teslah100-1.16.64.160 16 65536 160 1 456,27 ₽ Запустить
Цены:
Наименование vCPU ОЗУ, МБ Диск, ГБ GPU Цена, час
rtx2080ti-1.16.32.160 16 32768 160 1 37,04 ₽ Запустить
teslat4-1.16.16.160 16 16384 160 1 40,83 ₽ Запустить
teslaa10-1.16.32.160 16 32768 160 1 46,94 ₽ Запустить
teslaa2-2.16.32.160 16 32768 160 2 51,34 ₽ Запустить
rtx3090-1.16.24.160 16 24576 160 1 78,53 ₽ Запустить
rtx4090-1.16.32.160 16 32768 160 1 103,04 ₽ Запустить
teslav100-1.12.64.160 12 65536 160 1 107,57 ₽ Запустить
rtx5090-1.16.64.160 16 65536 160 1 141,77 ₽ Запустить
teslaa100-1.16.64.160 16 65536 160 1 230,77 ₽ Запустить
teslah100-1.16.64.160 16 65536 160 1 456,27 ₽ Запустить

Связанные модели

QwQ

Остались вопросы?

Свяжитесь с нашей специализированной группой поддержки по нейросетям nn@immers.cloud или отправьте ваш запрос в отдел продаж sale@immers.cloud.