Бюджет: 15000 UAH Термін: 7 днів
Підніму інфраструктуру сервінгу на Triton Inference Server або BentoML з Docker Compose або K8s-маніфестами, FastAPI чи gRPC для inference-ендпоінтів і базовим моніторингом через Prometheus. Оцінка строків і вартості, від 7 днів і 15000 грн, але точніше назву після ознайомлення з деталями. Notion-посилання відкривається лише авторизованим, тому можете надати публічний доступ або описати: які саме моделі, очікуване навантаження, яка інфраструктура вже існує?