Попробовать бесплатно

Калькулятор инфраструктуры для локального AI

Выберите AI-функции Shtab и размер команды — соберём конфигурацию железа для production-запуска в вашем контуре: GPU, CPU, память, диски, сеть и ожидаемые tok/s. Расчёт локальный, без отправки данных.

AI-функциишаг 1 · что разворачиваем
Локальные моделишаг 2 · мультивыбор

Open-source модели с tool calling в OpenAI-формате API (vLLM). Можно несколько — трафик разделится между ними.

Квантование
Контекст
Масштабшаг 3 · команда и нагрузка
Количество пользователейот 10 до 50 000
сотрудников
Профиль нагрузки
КОНФИГУРАЦИЯ ЖЕЛЕЗА · LIVE
1 × Workstation / edge-нода
GPU2 × RTX 4090
CPUот 24 ядер
RAM128 ГБ
Диск2×2 ТБ NVMe (RAID1)
Сеть10 GbE
2GPU · 48 ГБ VRAM
24CPU-ядер суммарно
≈539 ГБдиска занято (модели + аудио)
ОЖИДАЕМАЯ ПРОИЗВОДИТЕЛЬНОСТЬ
Qwen3 32B53 tok/s · поток · ≈1 601 суммарно
Одновременных диалоговдо 44
Запас мощности в пик98%
инженерная оценка ±30% · точная спецификация — после уточнения профиля нагрузки