Бюджет: 1000 UAH Термін: 1 день
Доброго дня. Готовий подивитись як працює парсер, та після цього назвати ціну.
Парсер написаний на python. Бібліотека яка реалізує збір даних reability.
Документація: https://pypi.org/project/readability/
Розробник записав тз в голосові, в чому проблема. Тз в архіві. 1 Голосове за Reability і 2 голосове за бутстамп. Також як прийму вас у проект. Передам любі ваші питання розробнику.
В нього вийшло тільки так. Для новачків це напевно не під силу. Тому звертаюсь до профі.
На рахунок бутстампа. Він теж на ньому намагався реалізувати, но бутстапм видав хужі результати на відміну від reability. Було багато дубльованого контента одного і тоже. І брав лишній грязний код не потрібний код.
Про сам код: код написаний на Python. Запити на сервер виконуються через aiohttp,
бо проект є асинхронним, тобто паралельно відправляються запити на сервер, а не по порядку.
Збірка виконана через бібліотеку PyInstaller. Запускаю .exe программу, і запускається командна строка. А сам парсер відкривається в браузері, локально по адресу 127: і так далі.
Щоб оцінити код і вартість роботи. І ви не писали цифру з потолка. Розумію вас. Ви напишете умовну. Тому зручний варіант. Під'єдналися до мого пк. Глянули на код. Зрозуміли що можете покращити результат парсингу, і розв'язувати задачу, щоб брався не тільки текст, а картинки з сайтів. Тоді обновите свою ставку під проектом, прийму вас у проект. Внесу резерв коштів. І тільки так! Бо! Як що ви не глянете у код, напишете яку небудь ставку. То що на виході буде? Потрачений мій час впусту і кошти? А вам негативний відгук? Думаю вам так не потрібно. Думаю це вияснили. Зараз такий результат для прикладу 10 сайтів. Із 10 сайтів бере тільки текст з 5 сайтів, і з решти 5 сайтів бере текст+картинки. Текст бере з усіх 10 сайтів. Думаю логіка зрозуміла. Що потрібно щоб і картинки підбирав так само як і текст з усіх сайтів.
Мені байдуже як це реалізувати через reability чи через бутстамп. Мені головне. Щоб парсер брав точніше дані. Через reability бере з кожного сайту текст, но картинки не з кожного. Тому задача була удосконалити його, або зхрестити його з другою біліотекою, алгоримтом, технологією. Яка підбирала б картинки. А він текст.
Або взагалі зробити черз бутстамп. Но тільки щоб брався і текст + картинки і з усіх сайтів. Короче, щоб працювало на бутстампі не хуже, чим на reability.
Можу надати доступ через anydesk, можу сам скомпілювати та зібрати в bild.exe. Вам тільки зайти на мій пк, оцінити код. І подивитись чи зможете зробити в мому коді. На bs4. Як що ви думаєте, що це покращить збір даних, і вирішить мою проблему, тоді без питань. Як що ми з вами протестимо і побачимо що ваша технологія краща. Я відразу обираю вас у проект. Вношу резерв коштів, ви вносите зміни в код. Тестим. Як що результати кращі. Я приймаю проект.
Бюджет: 1000 UAH Термін: 1 день
Доброго дня. Готовий подивитись як працює парсер, та після цього назвати ціну.
Бюджет: 16000 UAH Термін: 1 день
Добрий день,
Готовий взятися за ваш проект парсера на Python для збору даних за допомогою бібліотеки Reability. Я маю досвід у розробці коду на Python і використанні aiohttp для асинхронних запитів. Згорнутий запуск програми через PyInstaller також знаходиться у моєму арсеналі.
Щоб оцінити код та розробити стратегію для збору як тексту, так і картинок з сайтів, запрошую вас підключитися до мого ПК через anydesk. При глибшому огляді коду та тестуванні можемо внести необхідні зміни та покращення для досягнення бажаного результату.
Моя годинна ставка становить 16$. Чекаю на ваш відповідь для подальшої співпраці.
З повагою,
Максим
Доброго дня Александр
Вашу програму можна покращити, але це не буде саме те, що Ви хочете.
Розбирати правильно абсолютно будь який сайт неможливо, або близько до цього.
Як мінімум -- на данний час.
В те щоб зробити readability вкладено багато грошей і років часу.
Якщо у Вас є якийсь перелік сайті(лінків) які Ви регулярно скрейпите -- то надішліть мені. Я подивлюсь який відсоток вийде покращити.
Зараз я трохи зайнятий і не зможу відповідати миттєво
Десктопні додатки 49 ставок 31 липня
Розробка ботів 54 ставки 31 липня
Парсинг даних 39 ставок 30 липня
72 ставки 29 липня
Розробка ботів 87 ставок 27 липня