• Проєкти 4
  • Оцінка 5.0
  • Рейтинг 1 189

Бюджет: 4000 UAH Термін: 5 днів

Доброго дня!

Зберу базу на Python, але не парсером по сайтах наосліп, а насамперед через відкриті академічні API — OpenAlex, Crossref, ORCID і OAI-PMH українських журналів на OJS. Там дані віддаються офіційно й пачками: автор, установа, посада, посилання на джерело, а в метаданих статей у Crossref лежить пошта автора для листування. Сайти кафедр та інституційні репозитарії добираю зверху, щоб закрити тих, хто мало публікується за кордоном.

На виході один файл у Excel і CSV: ПІБ, email, установа, посада, посилання на джерело, дата збору. Дублікати чищу у два проходи — за email і за нормалізованим ПІБ разом з установою, бо люди міняють афіліацію і просте порівняння рядків тут не спрацьовує. Пошти проганяю через перевірку синтаксису та MX-запису домену, статус виношу окремою колонкою, щоб ви одразу бачили, що з бази робоче.

Питання по суті: який орієнтир за обсягом ви тримаєте — умовно 5 тисяч контактів чи ближче до 30-40 тисяч? І чи лишати в базі рядки без знайденої пошти як заготовку, чи потрібні тільки контакти з email? Від цього залежить, куди тягнути глибину збору.

Ціна 4000 грн, як у бюджеті, строк 5 днів. Проміжний зріз на кілька сотень рядків покажу вже на другий день, щоб ви звірили структуру колонок до того, як я поїду по всьому масиву.

  • Проєкти 3
  • Оцінка 3.5
  • Рейтинг 572

Бюджет: 4000 UAH Термін: 4 дні

Вітаю, розпочну одразу: у перший день надам структуру Excel/CSV і першу вибірку з посиланнями на джерела. Зберу публічно доступні контакти через OpenAlex, ORCID та офіційні сайти установ, нормалізую поля, приберу дублікати й перевірю формат та домен email. Результат — чиста таблиця з ПІБ, посадою, установою та джерелом. Термін — 4 дні. Чи є пріоритетні установи або галузі?

  • Проєкти 5
  • Оцінка 4.9
  • Рейтинг 756

Бюджет: 4000 UAH Термін: 7 днів

Вітаю, я недавно робив схожий парсер академічних джерел: збір ПІБ, email, місця роботи і посади зі сторінок кафедр і профілів викладачів, з посиланням на джерело по кожному контакту. Дедублікація і перевірка актуальності email через API теж були частиною того проєкту.

Якщо база потрібна для розсилок, варто одразу прогнати email через SMTP-валідацію і відсіяти неробочі, це підвищує доставність приблизно на 20-30%.

Скільки контактів орієнтовно треба на старті і чи це разовий збір, чи потрібні регулярні оновлення бази? Ще важливо, які джерела в пріоритеті - ORCID і OpenAlex дають чистіші дані, ніж ResearchGate.

Пропоную зв'язатись, заразом накидаю схему парсингу по джерелах і структуру фінального CSV під ваші поля.

  • Проєкти 7
  • Оцінка 5.0
  • Рейтинг 404

Бюджет: 4000 UAH Термін: 5 днів

Вітаю! Маю досвід збору великих баз даних із відкритих джерел та інтернету.

Зберу чисту базу без дублікатів у форматі Excel/CSV з усіма полями та посиланнями на джерела.

Звертайтесь, буду рада співпраці.

  • Проєкти -
  • Оцінка -
  • Рейтинг 355

Бюджет: 4000 UAH Термін: 4 дні

Добрий день, Зоряно. ORCID, OpenAlex і Crossref дадуть чисту структуру ПІБ, афіліації та посади майже без ручної роботи, але особистого email як окремого поля там немає. Реальне джерело пошти це сторінка кафедри чи профіль викладача на сайті вишу і блок «для листування» на першій сторінці PDF самої статті. Українські журнали на OJS додатково відкривають метадані через OAI-PMH, це швидше за ручний обхід сайтів і покриває видання, яких немає в міжнародних базах.

Google Scholar і ResearchGate забороняють автоматизований збір своїми умовами використання, тому ці два джерела беру вручну і невеликими порціями, а не основним потоком. Дублікати прибираю за email і окремо за нормалізованим ПІБ разом з установою, бо афіліація в людей змінюється і збіг лише за іменем ненадійний. Пошту перевіряю на формат і MX-запис домену, а не на фактичну доставність, це різні речі і друге без відправки листа не перевірити.

За 4000 грн і 4 дні зберу першу партію 2000-3000 унікальних перевірених контактів з посиланням на джерело в кожному рядку, на другий день покажу кілька сотень рядків на звірку структури. Якщо після цього потрібно йти до тридцяти-сорока тисяч, продовжу окремими партіями за ціною, узгодженою за тисячу нових контактів. Який орієнтир по обсягу тримаєте, кілька тисяч чи одразу такий масштаб?

  • Проєкти -
  • Оцінка -
  • Рейтинг 278

Бюджет: 4000 UAH Термін: 7 днів

Вам потрібно зібрати актуальну базу контактів українських науковців, викладачів і аспірантів з відкритих академічних джерел у форматі Excel або CSV. Я налаштую збір даних із сайтів університетів, сторінок кафедр, ORCID, OpenAlex, Google Scholar, Crossref та інституційних репозитаріїв за допомогою Python і парсингу. Кожен запис матиме ПІБ, email, місце роботи, посаду й посилання на джерело. Додам очищення від дублікатів і перевірку актуальності адрес там, де це можливо. Автоматизацію побудую так, щоб не порушувати правила сервісів, а таблицю зроблю зручною для роботи. Готовий взятися за завдання і зібрати для вас повну базу з відкритих джерел. Напишіть мені, щоб узгодити деталі та потрібний обсяг вибірки.

  • Проєкти 56
  • Оцінка 5.0
  • Рейтинг 1 754

Бюджет: 3999 UAH Термін: 2 дні

ㅤㅤㅤㅤ
Маю майже готову базу викладачів, які пропонують послуги репетира.
Скіншот бази https://ibb.co/xSz30ZBS
Кількість контактів 30+ тис
Але полів посада, місце роботи, точне ПІБ нема.
ㅤㅤㅤㅤ
ㅤㅤㅤㅤ

  • Проєкти -
  • Оцінка -
  • Рейтинг 304

Бюджет: 3900 UAH Термін: 3 дні

Вітаю, готовий налаштувати збір контактів українських науковців з академічних ресурсів та сформувати структуровану базу у форматі CSV. Складання алгоритму для обробки сторінок кафедр та профільних порталів є зрозумілим завданням. Який приблизний обсяг бази ви плануєте отримати на першому етапі? Буду радий вашому фідбеку, відповім на всі ваші питання та зорієнтуємося краще по дедлайнах та іншим деталям проекту. Залюбки допоможу.

  • Проєкти -
  • Оцінка -
  • Рейтинг 273

Бюджет: 4000 UAH Термін: 7 днів

Доброго дня! Маю досвід автоматизації та парсингу відкритих джерел (Python, робота з API, Google Sheets). Пропоную pipeline: масовий збір імен та афіляцій через OpenAlex і Crossref API по українських наукових установах, доповнення email через парсинг PDF статей (corresponding author) та сторінок кафедр/викладачів на сайтах університетів, дедуплікація за ПІБ. Результат — Excel/CSV: ПІБ, email, місце роботи, посада, джерело.

Оскільки обсяг "великої бази" в ТЗ не конкретизований, пропоную старт зі збору 1000-1500 унікальних валідних контактів за 5 днів у межах бюджету — за потреби продовжу збір окремим етапом. Готовий обговорити деталі.

  • Проєкти 78
  • Оцінка 4.8
  • Рейтинг 3 000

Бюджет: 4000 UAH Термін: 2 дні

Добрий день! Готова зібрати таку велику та актуальну базу контактів за пару днів! всі конаткти будуть актуальні та релевантні!!! Звертайтесь!!!

  • Проєкти 13
  • Оцінка 4.5
  • Рейтинг 622

Бюджет: 4000 UAH Термін: 7 днів

Вітаю! Маю досвід розробки кастомних парсерів та роботи з академічними API (OpenAlex, Crossref, ORCID) і сайтами вишів. Готова зібрати чисту базу українських науковців з дедуплікацією, посиланнями на джерела та вивантаженням в Excel/CSV. Скільки записів плануєте зібрати?

  • Проєкти 3
  • Оцінка 5.0
  • Рейтинг 778

Бюджет: 4000 UAH Термін: 1 день

Вітаю! Готовий реалізувати цей проєкт. Маю досвід у написанні кастомних скриптів на Python для збору, парсингу та очищення даних із відкритих академічних джерел (OpenAlex, API наукових платформ, сайти університетів).

Зроблю все через код (Python + BeautifulSoup/Pandas/API), налаштую дедупликацію та базову перевірку доменів (MX-записи), щоб на виході ви отримали чисту таблицю в CSV/Excel з необхідними полями та джерелами.

Готовий обговорити деталі (який саме обсяг бази потрібен і чи є пріоритетні заклади) та узгодити терміни й вартість. Пишіть в особисті!

  • Проєкти 43
  • Оцінка 5.0
  • Рейтинг 3 182

Бюджет: 4000 UAH Термін: 10 днів

Доброго дня, я бачу ви повторно опублікували проект. Я повторно пропоную свої послуги, приклад даних вже надавав.

  • Проєкти -
  • Оцінка -
  • Рейтинг 266

Бюджет: 4000 UAH Термін: 1 день

Привіт! Готовий виконати, але шкода, що мене не виберуть! Без відгуку всі вважають поганим спеціалістом! Хоча я точно роблю свою роботу краще, ніж 99%. За 1 день зроблю, якщо терміни вам цікаві!

  • Проєкти 3
  • Оцінка 5.0
  • Рейтинг 543

Бюджет: 4000 UAH Термін: 2 дні

Доброго дня, Зоряно!

Зберу базу з офіційних API — ORCID, OpenAlex, Crossref — плюс сайти кафедр українських вишів. Перевага цих джерел у тому, що вони віддають посаду й установу структуровано, тому колонки «посада» та «місце роботи» будуть заповнені, а не порожні, як буває при звичайному парсингу сторінок.

Пропоную почати з пілоту: 2000–3000 унікальних контактів з дедуплікацією та перевіркою поштових доменів, 4 дні, 4000 грн. Побачите якість і структуру — далі масштабуємо, 1500 грн за кожну наступну тисячу.

Чесно про два моменти. Google Scholar і ResearchGate забороняють автоматизований збір, тому їх беру точково вручну або не беру взагалі. І повна перевірка «живості» email можлива лише тестовою розсилкою — я перевіряю коректність домену й формату.

Одне питання: для чого плануєте використовувати базу? Від цього залежить, які поля важливіші.

  • Проєкти 45
  • Оцінка 4.9
  • Рейтинг 18 121

Бюджет: 6000 UAH Термін: 5 днів

Збір великої бази email науковців — завдання, де ключове не просто знайти адреси, а відфільтрувати дублікати та неактуальні контакти. Маю досвід у парсингу сайтів з Selenium та обробці великих об'ємів даних (Allegro API, автоаукціони). Як бачу рішення:
1. 2. Дедуплікація за ПІБ та email, перевірка актуальності через синтаксис і SMTP-верифікацію. 3. Експорт у CSV/Excel з посиланнями на джерела. Працював над схожим — Selenium-скрейпер для автоаукціону (https://freelancehunt.com/showcase/work/selenium-veb-skraper-dlya-izvlecheniya-dannyih/1874474.html). Який обсяг бази (тисячі/десятки тисяч)? Чи є конкретні джерела, які треба використати? Чи потрібна перевірка валідності email?

Ціна: 6000 UAH
Термін: 5 днів

  • Проєкти -
  • Оцінка -
  • Рейтинг 342

Бюджет: 4000 UAH Термін: 1 день

Вітаю.

Я повністю переглянув ваші вимоги та готовий розпочати, щойно ми завершимо наше обговорення.

Я реалізую ваші вимоги за допомогою скрипта Python.

  • Проєкти -
  • Оцінка -
  • Рейтинг 367

Бюджет: 5000 UAH Термін: 7 днів

Stattiinua, вітаю! Бачу, що потрібна база email науковців і аспірантів з відкритих джерел, з перевіркою на дублікати та валідність адрес, вивантаження в Excel/CSV з посиланням на джерело для кожного контакту.

Зроблю це через Python-скрипт, який працює з API OpenAlex та ORCID для отримання ПІБ, афіліації, посади та email там, де вони публічні, доповню парсингом сторінок кафедр і репозитаріїв університетів там, де email в API немає. Дублікати прибиратиму по ORCID ID та нормалізованому email, актуальність адрес перевірю через SMTP-запит без відправки листа. Результат віддам одним файлом з усіма потрібними колонками.

На виконання потрібно 7 днів.

Підкажіть, будь ласка, є пріоритет по конкретних університетах чи галузях наук, чи потрібна максимально широка вибірка по всій Україні?

У списку не показані ставки, приховані замовником чи фрилансером з Plus, а також ставки, що порушують правила