Poszukujemy specjalisty do dopracowania procesów automatyzacji w parserze OLX.
Wymagania dla specjalisty
Znajomość języka Python na poziomie zaawansowanym
Znajomość Python 3.10 (lub wersji zbliżonych)
Doświadczenie w tworzeniu parserów (web scraping) w Pythonie, w tym z wykorzystaniem biblioteki Selenium
Doświadczenie w pracy z Selenium oraz zarządzaniu przeglądarkami w kontenerach
Umiejętność konfigurowania Selenium WebDriver (Chrome/Firefox) w kontenerach Docker
Rozumienie specyfiki uruchamiania i konfiguracji przeglądarek bez interfejsu graficznego (tryb headless)
Znajomość REST API oraz zasad interakcji klient-serwer
Umiejętność analizy istniejącego REST API oraz w razie potrzeby jego modyfikacji/optymalizacji
Doświadczenie w pracy z tokenami, ciasteczkami, autoryzacją itp.
Praktyczne doświadczenie w debugowaniu i omijaniu systemów antyspamowych/antybotskich
Rozumienie limitów prędkości, timeoutów, proxy oraz innych narzędzi do stabilnej pracy parsera
Doświadczenie w pracy z systemami kontroli wersji i konteneryzacją
Git (GitHub, GitLab)
Docker (podstawowe umiejętności: budowanie obrazów, konfigurowanie środowiska, docker-compose itp.)
Wskazane: CI/CD (GitLab CI, GitHub Actions itp.)
Dodatkowe cechy
Umiejętność pracy z cudzym kodem: refaktoryzacja, dokumentacja
Gotowość do bliskiej współpracy z zespołem i klientem w celu doprecyzowania wymagań
Samodyscyplina i odpowiedzialność za wyniki
Analiza obecnego rozwiązania:
Przeanalizować istniejący parser OLX w Pythonie 3.10, ustalić przyczyny nieprawidłowego działania procesu autoryzacji.
Refaktoryzacja autoryzacji:
Poprawić/przerobić proces logowania do kont, zapewnić poprawne działanie z ciasteczkami/sesjami.
Przejście na Selenium:
Przenieść główny proces parsowania z REST API na Selenium z wykorzystaniem zarządzanej przeglądarki w Dockerze (tryb headless).
Skonfigurować autoryzację i zbieranie danych przez Selenium.
Koszt realizacji zadania do uzgodnienia.
Programista Python do dopracowania parsera
Poszukujemy specjalisty do dopracowania procesów automatyzacji w parserze OLX. Zadanie: poprawić autoryzację, skonfigurować pracę z ciasteczkami/sesjami, przenieść parsowanie na Selenium (Docker, tryb headless).
Wymagania:
✅ Pewna znajomość Python 3.10
✅ Doświadczenie w web scrapingu (Selenium, REST API)
✅ Konfiguracja Selenium WebDriver w Docker
✅ Praca z tokenami, ciasteczkami, autoryzacją
✅ Zrozumienie limitów szybkości, proxy, systemów antyspamowych
✅ Git, Docker (budowanie obrazów, docker-compose)
Bedzie plusem:
🔹 CI/CD (GitLab CI, GitHub Actions)
🔹 Doświadczenie w refaktoryzacji kodu i dokumentacji
📩 Jeśli masz odpowiednie doświadczenie – pisz! 🚀
Zaloguj się
lub
zarejestruj się,
żeby zobaczyć oryginał