Budżet: 250 USD Termin: 7 dni
Cześć, Andriej! Parsowanie + automatyczne publikowanie w Telegramie to mój temat, już spojrzałem na twoje źródła:
— Douban (movie.douban.com/explore) i Ctrip (you.ctrip.com/travels) ładują treści przez JavaScript — wezmę Playwright (przeglądarka headless), a nie "lekki" BeautifulSoup.
— 36Kr (artykuły/wyszukiwanie/profil) zwraca dane w bardziej uporządkowany sposób, tam parsowanie jest łatwiejsze i szybsze.
Co zrobię:
• dla każdego materiału: tytuł, link, data, autor/źródło, krótki tekst, zdjęcia (gdzie dostępne);
• automatyczne tagi według źródła + według tematu (z tekstu);
• deduplikacja przez bazę (SQLite) — jeden materiał nie zostanie opublikowany dwa razy;
• automatyczne publikowanie w twoim kanale Telegram przez bota według harmonogramu;
• konfiguracja (źródła/tagi/częstotliwość), opóźnienia i logowanie dostosowane do specyfiki chińskich stron (ograniczają częste zapytania) — bez omijania zabezpieczeń, tylko publiczne dane.
Proponuję rozpocząć od MVP z 2-3 źródłami (przez kilka dni sprawdzę rzeczywistą dostępność i oddam działającego bota), potem dobiorę resztę.
Pytania: publikować od razu po znalezieniu czy przez moderację? Czy potrzebne jest tłumaczenie/skrócenie chińskiego tekstu przed publikacją? Tagi tylko według źródła czy także według tematów w tekście?
$250 za działające MVP (2-3 źródła + bot + dedup + wdrożenie), dalej co do źródeł — dogadamy się. Gotów zacząć od razu.
Budżet: 2000 USD Termin: 7 dni
Cześć, pracowałem nad parserem wiadomości dla agregatora mediów — zbieraliśmy artykuły z 12 źródeł, ~500 publikacji/dzień, automatyczne publikowanie w Telegramie z tagami i deduplikacją.
Jeśli chodzi o Twój projekt: niektóre z wymienionych stron (na przykład Douban i Ctrip) używają dynamicznego ładowania przez JavaScript — czy jesteś gotowy na opcję z Playwright zamiast prostego BeautifulSoup, jeśli strona tego wymaga?
Proponuję się skontaktować, chętnie doradzę Ci bezpłatnie z technicznej strony i opracujemy plan rozwoju + opowiem o moim zespole!
Budżet: 15000 USD Termin: 7 dni
Dzień dobry! Mamy doświadczenie w tworzeniu parserów w Pythonie z omijaniem zabezpieczeń i integracją z API Telegrama. Realizujemy to za pomocą biblioteki Playwright dla dynamicznych treści oraz asynchronicznego wysyłania wiadomości do kanału. Skonfigurujemy stabilną pracę skryptu na serwerze, uwzględniając specyfikę chińskich zasobów.
Maksym Potashov
Oferta, która wygrała- Zlecenia 6
- Ocena 3.9
- Ranking 788
Budżet: 150 USD Termin: 7 dni
Zacząłbym od sprawdzenia każdego źródła osobno: Douban, Ctrip i 36Kr mogą różnie oddawać strony, dlatego najpierw określę, gdzie wystarczy zwykłe parsowanie, a gdzie potrzebne jest przetwarzanie dynamicznego ładowania. Na MVP wziąłbym Pythona, Playwright/BeautifulSoup, SQLite, Telegram Bot API i Dockera, aby wszystko można było normalnie uruchomić na serwerze. Duplikaty będą przechowywane w bazie, częstotliwość sprawdzania i tagi będą w konfiguracji. Pracowałem z chińskimi stronami, tam często główny ból głowy nie leży w samym parsowaniu, ale w tym, że część danych ładowana jest osobno lub strona może ograniczać częste zapytania. Dlatego od razu uwzględnię opóźnienia, logowanie i krótki opis ograniczeń dla każdej strony, bez omijania zabezpieczeń. MVP z 2-3 źródeł można zbudować w ciągu kilku dni, pełną wersję po sprawdzeniu dostępności. Co do budżetu, dokładniej powiem po szybkim przeglądzie technicznym stron. Proszę powiedzieć, czy publikacja w Telegramie ma iść od razu po znalezieniu materiału, czy przez moderację? Czy tagi są potrzebne tylko według źródła, czy także według tematów w tekście? I czy trzeba tłumaczyć/skraczać chiński tekst przed publikacją?
Aktualnie brak ofert
Aktualne zlecenia dla freelancerów w kategorii Parsowanie danych
Trzeba stworzyć parser do zbierania cen konkurencji, katalog ponad 40 tysięcy produktów. Dostęp do cen jest możliwy tylko po zalogowaniu
Witam Wcześniej zamieszczałem projekt (opis poniżej) i otrzymałem taki wynik https://docs.google.com/spreadsheets/d/1-abSBtjRZeD_ZGriquW0YUZdbmC4eXcr/edit?usp=sharing&ouid=113724943543706943348&rtpof=true&sd=true jak się okazało, niestety, później - jest on bardzo niekompletny... na przykład w tabeli jest filtr po mieście Neperville - gdzie wskazano tylko 4 dealerów. Ale ręcznie na mapach znalazłem 25 takich i to nie są duplikaty, a unikalne. Niektóre miasta są całkowicie nieobecne. To znaczy interesuje mnie miasto Chicago i okolice (suburbia), przekażę listę w razie potrzeby. ---- Lista kategorii z google maps, z których należy wyciągnąć wszystkie firmy Dealer samochodowy Dealer używanych samochodów Dealer nowych samochodów Podaję również listę kategorii, które wykorzystują markowe salony samochodowe: Dealer Toyoty Dealer Forda Dealer BMW Dealer Hondy listę marek samochodów przekażę osobno. Zazwyczaj w obrębie miasta takich salonów jest kilka na jedną markę samochodu Wynik w formie tabeli. Deduplikacja przez Place ID Cena za pracę. To jest jednorazowa praca. Nie potrzebuję żadnego skryptu, z którym będę pracować dalej. Można robić parsing przez wasze opracowania lub gotowe usługi zewnętrzne.
Trzeba zdalnie skonfigurować parser (przez Anydesk lub TeamViewer), coś się zepsuło i nie działa poprawnie. Głównie wymiana startowych linków i konfiguracja parsera. Strona https://dveri-pol.com/
Potrzebne jest stworzenie nowoczesnego sklepu internetowego z zabawkami na WordPress (WooCommerce). Główne wymagania: - Responsywny design dla komputerów, tabletów i smartfonów. - Katalog produktów z kategoriami, filtrami i wyszukiwarką. - Strony produktów z opisem, zdjęciami, specyfikacjami i ceną. - Koszyk i składanie zamówienia. - Integracja popularnych metod płatności i dostawy. - Konto osobiste klienta. - Wygodny panel zarządzania do dodawania i edytowania produktów. - Podstawowa optymalizacja SEO i wysoka prędkość ładowania strony. - Ustawienia zabezpieczeń, kopii zapasowej i SSL. Preferowane jest użycie nowoczesnego, lekkiego motywu lub stworzenie indywidualnego designu. Po zakończeniu pracy należy dostarczyć krótką instrukcję obsługi strony.
Potrzebne jest zebranie danych dotyczących kupujących i sprzedających dzieła sztuki. Interesują nas bazy danych stron Ebay oraz specjalistycznych światowych stron poświęconych sztuce.