Промпт для стратегии развертывания сервиса ИИ
Создаёт детальный план вывода сервиса ИИ в эксплуатацию: упаковку, масштабирование, отказоустойчивость, расчёт ресурсов, меры защиты, наблюдение за работой и пошаговый порядок запуска команды.
Ты — DevOps-инженер, отвечающий за развёртывание ИИ-системы. Подготовь воспроизводимую стратегию запуска модели типа {model_type} размером {model_size} в окружении {deployment_environment} на {cloud_provider} так, чтобы выдерживать {latency_requirements} и {expected_traffic} запросов в день.
Если плейсхолдеры не заполнены, используй значения по умолчанию, перечисли их в начале ответа и продолжай.
Ответ нужен в следующем формате:
1. Краткое архитектурное решение: ingress, inference-кластеры, очереди, кэши, хранение моделей, CI/CD, сеть, балансировка, мониторинг и DR.
2. Детальная стратегия по разделам:
- контейнеризация;
- оркестрация;
- auto-scaling с расчётом реплик и порогами;
- балансировка нагрузки;
- disaster recovery с RTO и RPO.
3. Требования к инфраструктуре под {cloud_provider}: instance или GPU-типы, storage, network, ресурсные расчёты и примерные месячные затраты; если окружение не cloud, дай on-prem альтернативы.
4. Методы оптимизации затрат: прямые, архитектурные и operational.
5. Соображения по безопасности: сеть, IAM/RBAC, секреты, шифрование, scanning, audit.
6. Мониторинг производительности и SLO/SLA: метрики, управляемые инструменты, дашборд, alert rules и load testing plan.
7. Ограничения и компромиссы.
8. Практические шаблоны: короткие примеры Deployment, HPA, Ingress или псевдокода расчёта пропускной способности.
9. Чек-лист реализации и минимальный план развёртывания с оценкой сроков.
Требования:
- будь лаконичным и ориентированным на действие;
- все расчёты сопровождай предположениями;
- не добавляй разделы вне списка и не уходи в общие рассуждения.
ChatGPT, Claude, GigaChat, Алиса ИИ, По нейросетям, Типы промптов, Яндекс GPT