Tesla P4 8GB
- vCPU:4 ядра
- RAM:16 ГБ DDR4
- Хранилище:50 ГБ NVMe
- Память GPU:8 ГБ GDDR5
- FP32 / FP16:5.5 / 11 TFLOPS
Подходит для:
- Инференс LLM до 9B параметров в 4-бит квантовании (LLaMA, Mistral, Qwen 7B)
- Контекст до 128K токенов (с PagedAttention / vLLM)
- Whisper Large v3 — транскрибация аудио
- Stable Diffusion / SDXL — генерация изображений
- Рендеринг и транскодирование видео
- YOLO, CLIP, SAM — компьютерное зрение
НЕ подходит для:
- Обучения и fine-tuning моделей (недостаточно VRAM)
- FP16-инференса моделей >7B параметров
≈ 25-35 токенов/сек на LLaMA 7B (4-bit, llama.cpp/vLLM)