NVIDIA CMP 70HX vs NVIDIA Tesla T4

Contents:

Memory ML Performance Compute Power Architecture & Compatibility ML Software Support Clocks & Performance Power Consumption Rendering Benchmarks Additional

Memory

Memory Size

8 ГБ

16 ГБ

Memory Type

GDDR6X GDDR6

Memory Bandwidth

608.3 GB/s 320.0 GB/s

Memory Bus Width

256 бит 256 бит

ML Performance

FP16 (Half Precision)

10.71 TFLOPS

65.13 TFLOPS

BF16 (Brain Float)

No No

TF32 (TensorFloat)

No No

Compute Power

FP32 (Single Precision)

+32% 10.71 TFLOPS

8.141 TFLOPS

FP64 (Double Precision)

0.1674 TFLOPS

0.2544 TFLOPS

CUDA Cores

+50% 3,840

2,560

RT Cores

Architecture & Compatibility

GPU Architecture

Ampere Turing

SM (Streaming Multiprocessor)

PCIe Version

PCIe 1.0 x4 PCIe 3.0 x16

ML Software Support

CUDA Version

8.6

7.5

Clocks & Performance

Base Clock

+133% 1,365

585

Boost Clock

1,395

1,590

Memory Clock

1,188

1,250

Power Consumption

TDP/TGP

unknown 70 W

Recommended PSU

-20% 200 W

250 W

Power Connector

1x 12-pin None

Rendering

Texture Units (TMU)

120

160

ROP

L2 Cache

4 MB

Benchmarks

LLM Perf, Llama-2-7b-hf (bnb)

— 8.55 tokens/s

LLM Perf, Llama-2-7b-hf (gptq)

— 33.6 tokens/s

LLM Perf, Llama-2-7b-hf (unquantized)

— 16.7 tokens/s

LLM Perf, Llama-3.1-8B-Instruct (awq)

— 22.0 tokens/s

LLM Perf, Llama-3.1-8B-Instruct (bnb)

— 7.68 tokens/s

LLM Perf, Llama-3.1-8B-Instruct (gptq)

— 28.8 tokens/s

LLM Perf, Meta-Llama-3-8B (awq)

— 22.4 tokens/s

LLM Perf, Meta-Llama-3-8B (bnb)

— 7.96 tokens/s

LLM Perf, Meta-Llama-3-8B (gptq)

— 28.8 tokens/s

LLM Perf, Meta-Llama-3-8B-Instruct (awq)

— 22.3 tokens/s

LLM Perf, Meta-Llama-3-8B-Instruct (bnb)

— 7.76 tokens/s

LLM Perf, Meta-Llama-3-8B-Instruct (gptq)

— 29.1 tokens/s

llama.cpp, llama-2-7b-Q4_0

— 46.4 tokens/s

LLM Perf, Mistral-7B-Instruct-v0.2 (gptq)

— 26.4 tokens/s

LLM Perf, Mistral-7B-v0.1 (bnb)

— 8.01 tokens/s

LLM Perf, Mistral-7B-v0.1 (gptq)

— 25.7 tokens/s

LLM Perf, Mistral-7B-v0.1 (unquantized)

— 15.5 tokens/s

Additional

Slots

Dual-slot Single-slot

Release Date

July 16, 2021 Sept. 13, 2018

Display Outputs

No outputs

Renting is cheaper than buying

H200 (141GB)

NVIDIA

Первая GPU с памятью HBM3e (141 ГБ) на архитектуре Hopper. Создана для генеративного ИИ и HPC задач. До 2X быстрее для LLM inference по сравнению с H100. Поддерживает FP8, FP16, TF32 и другие форматы точности.

from 375.0 RUB/hour

Rent

Details

H100 80Gb PCIe (80GB)

NVIDIA

Флагманская GPU на архитектуре Hopper с 80 ГБ памяти HBM3. Создана для обучения и инференса больших языковых моделей, HPC задач. Поддерживает FP64, FP32, TF32, FP16, BF16, FP8 и INT8 вычисления с Tensor Cores 4-го поколения.

from 299.11 RUB/hour

Rent

Details

H100 80Gb SXM (80GB)

NVIDIA

Флагманская GPU на архитектуре Hopper с 80 ГБ памяти HBM3 в форм-факторе SXM. Создана для обучения и инференса больших языковых моделей, HPC задач. Поддерживает FP64, FP32, TF32, FP16, BF16, FP8 и INT8 вычисления с Tensor Cores 4-го поколения.

from 299.11 RUB/hour

Rent

Details

Tesla A100 (80GB)

NVIDIA

Видеокарта для исследований на пике современных алгоритмов LLM, CV и пр. Создана специально для ML вычислений.

from 200.89 RUB/hour

Rent

Details

RTX 4090 (48GB)

NVIDIA

Десктопная карта с аппаратной поддержкой Ray Tracing, DLSS 3.5, кодеками H.264/H.265/AV1 и увеличенной видеопамятью 48 ГБ GDDR6X.

from 81.85 RUB/hour

Rent

Details

RTX 3090 (24GB)

NVIDIA

Десктопная карта с аппаратной поддержкой Ray Tracing, DLSS, H.264, H.265

from 34.23 RUB/hour

Rent

Details

RTX A5000 (24GB)

NVIDIA

Создана для обработки видеопотоков, готова к виртуализации. Профессиональная карта с аппаратной поддержкой Ray Tracing, DLSS, H.264, H.265

from 31.25 RUB/hour

Rent

Details

Tesla A10 (24GB)

NVIDIA

Видеокарта идеальная для инференса ИИ, обработки видео, CAD и BIM проектирования, CAE исследований, поддерживающих вычисления на GPU.

from 26.79 RUB/hour

Rent

Details

NVIDIA CMP 70HX vs NVIDIA Tesla T4

Comparison of NVIDIA CMP 70HX with 8 GB GDDR6X and 3,840 cores vs NVIDIA Tesla T4 with 16 GB GDDR6 and 2,560 cores.