Budżet: 15000 UAH Termin: 7 dni
Podniosę infrastrukturę serwisowania na Triton Inference Server lub BentoML z Docker Compose lub manifestami K8s, FastAPI lub gRPC dla punktów końcowych inferencji i podstawowym monitoringiem przez Prometheus. Ocena terminów i kosztów, od 7 dni i 15000 zł, ale dokładniej podam po zapoznaniu się z szczegółami. Link do Notion otwiera się tylko dla zalogowanych, więc możecie zapewnić publiczny dostęp lub opisać: jakie dokładnie modele, oczekiwane obciążenie, jaka infrastruktura już istnieje?