- Zlecenia -
- Ocena -
- Ranking 71
Budżet: 110 EUR Termin: 2 dni
Cześć Joachim.
Muszę powiedzieć, że ostatnio pracowałem nad web scraperem do projektu na uczelni, nie tylko to, ale także stworzyłem aplikację Streamlit do wyświetlania i analizy danych za pomocą dynamicznych wykresów.
Python jest jedną z moich mocnych stron, ponieważ realizowałem wiele projektów związanych z danymi, korzystając z tego języka.
W ramach Twojego projektu mogę pobrać dane, oczyścić je i dostarczyć Ci aplikację Streamlit, którą będziesz mógł oglądać na żywo za każdym razem, gdy się zaktualizuje, bez konieczności dalszego kodowania. A jeśli nie potrzebujesz aplikacji i chcesz, żebym pracował nad już nieukończoną aplikacją, którą masz, również mogę to zrobić.
Śmiało skontaktuj się ze mną, aby rozpocząć pracę nad projektem.
Budżet: 450 EUR Termin: 5 dni
Cześć, Dziękuję za szczegółowe wyjaśnienie. Pracowałem nad podobnymi projektami skrobania danych, w tym zbieraniem danych sportowych o dużej objętości i automatyzacją ukrytą opartą na proxy. Dla Sofascore mogę zbudować bibliotekę w Pythonie z dobrze zorganizowanymi funkcjami, które zwracają nadchodzące mecze, statystyki historyczne, informacje o zawodnikach i rankingi — wszystko poprzez szybkie i odporne skrobanie.
Mój plan to użycie `httpx` z `curl_cffi` i rotacją sesji, dokładne dopasowanie nagłówków i odcisków urządzeń. Aby uniknąć błędów 403 podczas długich sesji skrobania, zoptymalizuję obsługę proxy i logikę ponawiania prób. Funkcje będą zwracać czyste DataFrame'y pandas z surowymi ładunkami JSON na rekord, dzięki czemu łatwo będzie eksplorować lub przechowywać dane.
Proponuję również cache'ować tokeny sesji lub ciasteczka, gdy to możliwe, aby zmniejszyć obciążenie związane z uwierzytelnianiem i wcześnie wykrywać zachowania anty-botowe. Jeśli masz już swój aktualny skrypt piłkarski, chętnie go bezpośrednio ulepszę.
Czy możesz potwierdzić, czy masz już dostawcę proxy, czy wolisz, żebym polecił lepszego na podstawie Twojego wolumenu?
Czekam na współpracę.
Pozdrawiam,
Daniel
Yelisey H.
Oferta, która wygrała- Zlecenia 7
- Ocena -
- Ranking 595
Budżet: 110 EUR Termin: 2 dni
Dzień dobry!
Gotowy do realizacji Twojego projektu w Pythonie z wykorzystaniem zapytań do wewnętrznego API strony Sofascore.
✅ Co zrobię:
Napiszę stabilny skrypt Python (bibliotekę/funkcję), który będzie parsować dane o meczach tenisowych z Sofascore (kursy, statystyki, rankingi ATP i WTA itp.).
Dostarczę wygodny interfejs do pobierania danych w formatach JSON i pandas DataFrame.
Rozwiążę problem z blokadami (błąd 403), korzystając z niezawodnej rotacji nagłówków i proxy (jeśli będzie konieczne — mogę zaproponować przetestowane rozwiązania z residential proxy).
⚙️ Stos:
Python (requests, pandas)
Wewnętrzne zapytania API JSON bezpośrednio do serwera (bez automatyzacji przeglądarki)
🚀 Gwarantuję:
Stabilność i dokładność danych
Wysoką szybkość działania (setki tysięcy zapytań dziennie)
Czysty i czytelny kod z komentarzami
Koszt: 110 EUR
Termin: 3 dni
Jestem do dyspozycji, aby omówić szczegóły!
Budżet: 450 EUR Termin: 5 dni
Cześć Joachim,
Starannie przeanalizowałem Twój projekt dotyczący wyciągania danych tenisowych z Sofascore. To trudne zadanie, ale posiadam doświadczenie, aby zbudować solidne, szybkie rozwiązanie, którego potrzebujesz.
Błąd 403, na który napotykasz w swoim obecnym skrypcie, jest wyraźnym sygnałem, że Sofascore skutecznie "odczuwa" i blokuje Twoje żądania. Proste podejście curl_cffi z podstawowymi nagłówkami i proxy często nie wystarcza dla tak zaawansowanego celu.
Aby to rozwiązać, zbuduję profesjonalną bibliotekę do scrapowania w Pythonie, korzystając z dużo potężniejszej architektury:
Silnik główny (Playwright): Użyję Playwright, a nie tylko bibliotek requests. To pozwala na automatyzację prawdziwej instancji przeglądarki, co sprawia, że zachowanie naszego skryptu jest niemal nie do odróżnienia od użytkownika.
Zaawansowane techniki Anti-Fingerprinting: Wdrożę techniki ukrywania się, aby uniknąć wykrycia. Obejmuje to tworzenie własnych "kontekstów" przeglądarki z losowymi agentami użytkownika, rozdzielczościami ekranu i innymi właściwościami na poziomie przeglądarki, które systemy anty-botowe sprawdzają.
Inteligentne zarządzanie żądaniami: Skrypt będzie zaprojektowany tak, aby naśladować ludzkie wzorce przeglądania, a nie tylko wykonywać szybkie żądania. Będzie również inteligentnie obsługiwał rotację proxy, aby zminimalizować ryzyko blokady IP.
Jako certyfikowany programista Python PCAP™, specjalizuję się w tworzeniu tego typu niezawodnych systemów ekstrakcji danych. Ostateczny produkt będzie czystą biblioteką Python z funkcjami takimi jak get_upcoming_matches(), get_historical_data(match_id) itd., które zwrócą dane w DataFrame, jak tego oczekiwałeś.
Szacunkowy czas realizacji:
Termin: 5 dni
Cena: 450 USD
Twój budżet €110 niestety nie wystarcza na opracowanie systemu, który potrafiłby obejść nowoczesne rozwiązania anty-botowe na takim poziomie, jakiego potrzebujesz. Moja cena odzwierciedla rozwój profesjonalnego narzędzia, które będzie szybkie, niezawodne i zdolne do obsługi Twoich potrzeb związanych z danymi.
Jestem gotowy zbudować scraper, który naprawdę działa.
Budżet: 110 EUR Termin: 2 dni
Dobry wieczór, mogę pomóc Ci z Twoim projektem, mam również doświadczenie w tej dziedzinie. Pisz i omówimy wszystkie szczegóły.
Budżet: 110 EUR Termin: 1 dzień
Witam..
Robiłem podobne rzeczy związane z piłką nożną dla strony flashcore. (jest w portfolio). Pod względem szybkości około 2000 meczów na minutę. Jeśli taki wariant odpowiada, proponuję omówić to bardziej szczegółowo w wiadomościach prywatnych
Aktualnie brak ofert
Aktualne zlecenia dla freelancerów w kategorii Parsowanie danych
-
Nie podano
Parsowanie katalogu produktów do uniwersjalnego Excel/XML (UA/RU) pod Prom.ua, Хорошоп i inne CMS
43 oferty 10:11
-
Nie podano
Zbieranie telefonów z olx.pl
36 ofert 3 sierpnia
-
Nie podano
Parser Autorii
72 oferty 2 sierpnia
-
Nie podano
API Reddit
Programowanie stron internetowych 30 ofert 30 lipca
-
Nie podano
Parsowanie strony, obejście ochrony Akamai
Python 47 ofert 30 lipca