Видеокарта NVIDIA A30
Общие характеристики:
- Архитектура: NVIDIA Ampere
- Память: 24GB HBM2
- Форм‑фактор: PCIe
- Сценарии: AI/HPC в
mainstream‑серверах
22 года продаем серверы в России
Новое и оригинальное оборудование
Собственный склад серверов и опций
Обязательное тестирование до отгрузки
Профессиональная техническая поддержка
Обзор
Характеристики
NVIDIA A30 Tensor Core — GPU на базе архитектуры NVIDIA Ampere для ИИ и высокопроизводительных вычислений (HPC) в корпоративных средах. Поддерживает технологию MIG (многоэкземплярные GPU) для безопасного масштабирования задач. Отличается высокой пропускной способностью памяти, низким энергопотреблением и форм‑фактором PCIe — оптимально для серверов массового сегмента. Решение входит в платформу NVIDIA EGX™ и совместимо с каталогом оптимизированных ИИ‑приложений NVIDIA NGC™.
Deep Learning Training
Для обучения моделей ИИ для решения задач нового уровня, таких как разговорный ИИ, требуются колоссальные вычислительные мощности и масштабируемость. GPU NVIDIA A30 (тензорные ядра, TF32) обеспечивает 20‑кратный прирост пропускной способности относительно NVIDIA T4 — за счёт базовой производительности (10×) и смешанной прецизионности FP16 (2×). Масштабирование до тысяч GPU — через NVLink®, PCIe Gen4 и Magnum IO™. С технологией MIG можно динамически переключать A30 между выводом данных (в пиковые часы) и переобучением моделей (в непиковые).
Deep Learning Inference
NVIDIA A30 для вывода в глубоком обучении: поддержка точности от FP64 до TF32 и INT4, до 4 MIG на GPU (с QoS), прирост производительности до 2× за счёт структурной разреженности. Лидирует в MLPerf Inference; с NVIDIA Triton™ Inference Server обеспечивает масштабируемый ИИ для предприятий.
Высокопроизводительные вычисления
GPU NVIDIA A30 на базе архитектуры Ampere предназначен для научных исследований и высокопроизводительных вычислений. Благодаря тензорным ядрам FP64 и 24 ГБ памяти (933 ГБ/с) эффективно решает задачи с двойной точностью, а поддержка TF32 ускоряет операции с плотными матрицами. Технология MIG позволяет нескольким исследователям одновременно использовать вычислительные ресурсы с гарантированным качеством обслуживания. Система адаптируется под разные нагрузки: от вывода ИИ в часы пиковой активности до HPC и обучения моделей в остальное время.
Высокопроизводительный анализ данных
Ускоренные серверы с архитектурой A30 обеспечивают необходимую вычислительную мощность — наряду с большим объемом памяти HBM2, пропускной способностью памяти 933 ГБ/с и масштабируемостью с помощью NVLink — для решения этих задач. В сочетании с NVIDIA InfiniBand, NVIDIA Magnum IO и набором библиотек с открытым исходным кодом RAPIDS™, включая ускоритель RAPIDS для Apache Spark, платформа NVIDIA для центров обработки данных ускоряет эти огромные рабочие нагрузки на беспрецедентном уровне производительности и эффективности.
Память GPU
Пропускная способность памяти GPU
Соединение
NVLINK третьего поколения 200 ГБ/с
Форм-фактор
Максимальная тепловая мощность (TDP)
Multi-Instance GPU (MIG)
2 GPU по 12 ГБ каждый
1 GPU по 24 ГБ
Программная поддержка
Медиа-движки
Характеристики Tensor Core GPU
FP64 Tensor Core: 10.3 teraFLOPS
FP32: 10.3 teraFLOPS
TF32 Tensor Core: 82 teraFLOPS | 165 teraFLOPS
BFLOAT16 Tensor Core: 165 teraFLOPS | 330 teraFLOPS
FP16 Tensor Core: 165 teraFLOPS | 330 teraFLOPS
INT8 Tensor Core: 330 TOPS | 661 TOPS
INT4 Tensor Core: 661 TOPS | 1321 TOPS
Рейтинг
Среднее значение рейтинга
Количество голосов
Нужно больше информации?
Оставьте заявку — эксперт Itelon свяжется с вами в течение 15 минут и поможет подобрать решение под вашу задачу


