• Проекты 4
  • Оценка 5.0
  • Рейтинг 1 189

Бюджет: 4000 UAH Срок: 5 дней

Доброго дня!

Соберу базу на Python, але не парсером по сайтах наосліп, а насамперед через відкриті академічні API — OpenAlex, Crossref, ORCID і OAI-PMH українських журналів на OJS. Там дані віддаються офіційно й пачками: автор, установа, посада, посилання на джерело, а в метаданих статей у Crossref лежить пошта автора для листування. Сайти кафедр та інституційні репозитарії добираю зверху, щоб закрити тих, хто мало публікується за кордоном.

На виході один файл у Excel і CSV: ПІБ, email, установа, посада, посилання на джерело, дата збору. Дублікати чищу у два проходи — за email і за нормалізованим ПІБ разом з установою, бо люди міняють афіліацію і просте порівняння рядків тут не спрацьовує. Пошти проганяю через перевірку синтаксису та MX-запису домену, статус виношу окремою колонкою, щоб ви одразу бачили, що з бази робоче.

Питання по суті: який орієнтир за обсягом ви тримаєте — умовно 5 тисяч контактів чи ближче до 30-40 тисяч? І чи лишати в базі рядки без знайденої пошти як заготовку, чи потрібні тільки контакти з email? Від цього залежить, куди тягнути глибину збору.

Ціна 4000 грн, як у бюджеті, строк 5 днів. Проміжний зріз на кілька сотень рядків покажу вже на другий день, щоб ви звірили структуру колонок до того, як я поїду по всьому масиву.

  • Проекты 3
  • Оценка 3.5
  • Рейтинг 572

Бюджет: 4000 UAH Срок: 4 дня

Здравствуйте, начну сразу: в первый день предоставлю структуру Excel/CSV и первую выборку с ссылками на источники. Соберу публично доступные контакты через OpenAlex, ORCID и официальные сайты учреждений, нормализую поля, уберу дубликаты и проверю формат и домен email. Результат — чистая таблица с ФИО, должностью, учреждением и источником. Срок — 4 дня. Есть ли приоритетные учреждения или отрасли?

  • Проекты 5
  • Оценка 4.9
  • Рейтинг 756

Бюджет: 4000 UAH Срок: 7 дней

Здравствуйте, я недавно делал похожий парсер академических источников: сбор ФИО, email, места работы и должности со страниц кафедр и профилей преподавателей, с ссылкой на источник по каждому контакту. Дедубликация и проверка актуальности email через API также были частью того проекта.

Если база нужна для рассылок, стоит сразу прогнать email через SMTP-валидацию и отсеять нерабочие, это повышает доставляемость примерно на 20-30%.

Сколько контактов ориентировочно нужно на старте и это разовый сбор, или нужны регулярные обновления базы? Еще важно, какие источники в приоритете - ORCID и OpenAlex дают более чистые данные, чем ResearchGate.

Предлагаю связаться, заодно накидаю схему парсинга по источникам и структуру финального CSV под ваши поля.

  • Проекты -
  • Оценка -
  • Рейтинг 327

Бюджет: 4000 UAH Срок: 4 дня

Привет! У меня есть опыт в сборе больших баз данных и работе с открытыми академическими источниками. Предлагаю реализовать проект следующим образом:

1. Использую парсинг официальных сайтов университетов и научных учреждений Украины
2. Соберу данные из ORCID, Google Scholar, ResearchGate и OpenAlex через их API
3. Структурирую результат в CSV/Excel с полями: ФИО, email, учреждение, должность, источник
4. Проведу дедупликацию и базовую валидацию email-адресов
5. Обеспечу максимальное покрытие актуальных контактов

Могу начать сразу. Буду соблюдать все правила сервисов по сбору данных.

  • Проекты -
  • Оценка -
  • Рейтинг 374

Бюджет: 4000 UAH Срок: 2 дня

Здравствуйте! Готов собрать для вас максимально полную и чистую базу контактов украинских ученых и преподавателей. Я специализируюсь на автоматизации и работе с данными (Python, API). Вместо ручного поиска я быстро извлеку верифицированные профили через API открытых баз (OpenAlex, Crossref, ORCID) и напишу кастомные парсеры для институциональных репозиториев и сайтов ВУЗов. Далее через скрипты соберу все в единый структурированный Excel-файл (ФИО, email, место работы, должность, источник), полностью очищу дубликаты и проверю валидность email-адресов. У меня большой практический опыт в масштабном парсинге. Напишите, какой объем базы вас интересует для старта, и я готов сразу запустить сбор!

  • Проекты -
  • Оценка -
  • Рейтинг 361

Бюджет: 4000 UAH Срок: 5 дней

Доброго дня! Ознакомился с заданием. Имею опыт в разработке парсеров и работе с открытыми научными API (ETL-процессы), поэтому смогу собрать большую, структурированную и детализированную базу исключительно из открытых источников, как указано в ТЗ.

Как будет реализован сбор и обработка данных (Python):

Источники выгрузки: Автоматизированный сбор данных через бесплатные API научных баз данных (OpenAlex, ORCID), а также парсинг открытых реестров украинских научных журналов (OJS) и профилей ЗВО. Это позволит получить точные связи: ФИО + Email + Университет/Кафедра + Должность.

Очистка и дедупликация: С помощью библиотеки pandas нормализую данные и удалю все дубликаты по почтовым ящикам и комбинации «ФИО + Учреждение».

Валидация контактов: Автоматическая проверка синтаксиса email-адресов и наличия активных MX-записей почтовых серверов для отсеивания устаревших/неактивных почт.

  • Проекты 7
  • Оценка 5.0
  • Рейтинг 404

Бюджет: 4000 UAH Срок: 5 дней

Здравствуйте! У меня есть опыт сбора больших баз данных из открытых источников и интернета.

Соберу чистую базу без дубликатов в формате Excel/CSV со всеми полями и ссылками на источники.

Обращайтесь, буду рада сотрудничеству.

  • Проекты -
  • Оценка -
  • Рейтинг 355

Бюджет: 4000 UAH Срок: 4 дня

Good day, Zoryana. ORCID, OpenAlex, and Crossref will provide a clean structure of full names, affiliations, and positions with almost no manual work, but there is no personal email as a separate field there. The real source of email is the department page or the teacher's profile on the university website and the "for correspondence" block on the first page of the PDF of the article itself. Ukrainian journals on OJS additionally open metadata through OAI-PMH, which is faster than manually browsing websites and covers publications that are not in international databases.

Google Scholar and ResearchGate prohibit automated collection by their terms of use, so I take these two sources manually and in small batches, rather than as a main flow. I remove duplicates by email and separately by normalized full name along with the institution, as people's affiliations change and matching only by name is unreliable. I check the email for format and MX record of the domain, not for actual deliverability, as these are different things and the latter cannot be verified without sending an email.

For 4000 UAH and 4 days, I will collect the first batch of 2000-3000 unique verified contacts with a source link in each line, and on the second day, I will show a few hundred lines for structure verification. If after this you need to go to thirty-forty thousand, I will continue in separate batches at a price agreed upon for a thousand new contacts. What volume benchmark are you keeping, a few thousand or immediately such a scale?

  • Проекты -
  • Оценка -
  • Рейтинг 278

Бюджет: 4000 UAH Срок: 7 дней

Вам нужно собрать актуальную базу контактов украинских ученых, преподавателей и аспирантов из открытых академических источников в формате Excel или CSV. Я настрою сбор данных с сайтов университетов, страниц кафедр, ORCID, OpenAlex, Google Scholar, Crossref и институциональных репозиториев с помощью Python и парсинга. Каждая запись будет содержать ФИО, email, место работы, должность и ссылку на источник. Добавлю очистку от дубликатов и проверку актуальности адресов там, где это возможно. Автоматизацию построю так, чтобы не нарушать правила сервисов, а таблицу сделаю удобной для работы. Готов взяться за задание и собрать для вас полную базу из открытых источников. Напишите мне, чтобы согласовать детали и необходимый объем выборки.

  • Проекты 56
  • Оценка 5.0
  • Рейтинг 1 754

Бюджет: 3999 UAH Срок: 2 дня

Маю майже готову базу викладачів, які пропонують послуги репетира. Скіншот бази https://ibb.co/xSz30ZBS Кількість контактів 30+ тис Але полів посада, місце роботи, точне ПІБ нема.

  • Проекты -
  • Оценка -
  • Рейтинг 304

Бюджет: 3900 UAH Срок: 3 дня

Здравствуйте, готов настроить сбор контактов украинских ученых из академических ресурсов и сформировать структурированную базу в формате CSV. Составление алгоритма для обработки страниц кафедр и профильных порталов является понятной задачей. Какой приблизительный объем базы вы планируете получить на первом этапе? Буду рад вашему фидбеку, отвечу на все ваши вопросы и лучше сориентируемся по дедлайнам и другим деталям проекта. С удовольствием помогу.

  • Проекты -
  • Оценка -
  • Рейтинг 273

Бюджет: 4000 UAH Срок: 7 дней

Добрый день! У меня есть опыт автоматизации и парсинга открытых источников (Python, работа с API, Google Sheets). Предлагаю пайплайн: массовый сбор имен и аффилиаций через OpenAlex и Crossref API по украинским научным учреждениям, дополнение email через парсинг PDF статей (corresponding author) и страниц кафедр/преподавателей на сайтах университетов, дедупликация по ФИО. Результат — Excel/CSV: ФИО, email, место работы, должность, источник.

Поскольку объем "большой базы" в ТЗ не конкретизирован, предлагаю старт со сбора 1000-1500 уникальных валидных контактов за 5 дней в рамках бюджета — при необходимости продолжу сбор отдельным этапом. Готов обсудить детали.

  • Проекты 78
  • Оценка 4.8
  • Рейтинг 3 000

Бюджет: 4000 UAH Срок: 2 дня

Добрый день! Готова собрать такую большую и актуальную базу контактов за пару дней! Все контакты будут актуальными и релевантными!!! Обращайтесь!!!

  • Проекты 13
  • Оценка 4.5
  • Рейтинг 622

Бюджет: 4000 UAH Срок: 7 дней

Здравствуйте! У меня есть опыт разработки кастомных парсеров и работы с академическими API (OpenAlex, Crossref, ORCID) и сайтами вузов. Готова собрать чистую базу украинских ученых с дедупликацией, ссылками на источники и выгрузкой в Excel/CSV. Сколько записей планируете собрать?

  • Проекты 3
  • Оценка 5.0
  • Рейтинг 778

Бюджет: 4000 UAH Срок: 1 день

Здравствуйте! Готов реализовать этот проект. У меня есть опыт написания кастомных скриптов на Python для сбора, парсинга и очистки данных из открытых академических источников (OpenAlex, API научных платформ, сайты университетов).

Сделаю все через код (Python + BeautifulSoup/Pandas/API), настрою дедупликацию и базовую проверку доменов (MX-записи), чтобы на выходе вы получили чистую таблицу в CSV/Excel с необходимыми полями и источниками.

Готов обсудить детали (какой именно объем базы нужен и есть ли приоритетные заведения) и согласовать сроки и стоимость. Пишите в личные!

  • Проекты 43
  • Оценка 5.0
  • Рейтинг 3 182

Бюджет: 4000 UAH Срок: 10 дней

Доброго дня, я вижу, вы повторно опубликовали проект. Я повторно предлагаю свои услуги, пример данных уже предоставлял.

  • Проекты -
  • Оценка -
  • Рейтинг 266

Бюджет: 4000 UAH Срок: 1 день

Здравствуйте! Готов выполнить но жаль что меня не выберут! Без отзыва все считают плохой спецалист! Хотя я точно делаю свою работу лучше чем 99%. За 1 день сделаю если сроки вам интересны!

  • Проекты 3
  • Оценка 5.0
  • Рейтинг 543

Бюджет: 4000 UAH Срок: 2 дня

Добрый день, Зоряна!

Соберу базу из официальных API — ORCID, OpenAlex, Crossref — плюс сайты кафедр украинских вузов. Преимущество этих источников в том, что они предоставляют должность и учреждение структурированно, поэтому колонки «должность» и «место работы» будут заполнены, а не пустыми, как бывает при обычном парсинге страниц.

Предлагаю начать с пилота: 2000–3000 уникальных контактов с дедупликацией и проверкой почтовых доменов, 4 дня, 4000 грн. Увидите качество и структуру — дальше масштабируем, 1500 грн за каждую следующую тысячу.

Честно о двух моментах. Google Scholar и ResearchGate запрещают автоматизированный сбор, поэтому их беру точечно вручную или не беру вообще. И полная проверка «живости» email возможна лишь тестовой рассылкой — я проверяю корректность домена и формата.

Один вопрос: для чего планируете использовать базу? От этого зависит, какие поля важнее.

  • Проекты 45
  • Оценка 4.9
  • Рейтинг 18 121

Бюджет: 6000 UAH Срок: 5 дней

Сбор большой базы email ученых — задача, где ключевое не просто найти адреса, а отфильтровать дубликаты и неактуальные контакты. У меня есть опыт в парсинге сайтов с Selenium и обработке больших объемов данных (Allegro API, автоаукционы). Как вижу решение:
1. Дедупликация по ФИО и email, проверка актуальности через синтаксис и SMTP-верификацию.
2. Экспорт в CSV/Excel с ссылками на источники.
Работал над похожим — Selenium-скрейпер для автоаукциона (https://freelancehunt.com/showcase/work/selenium-veb-skraper-dlya-izvlecheniya-dannyih/1874474.html). Какой объем базы (тысячи/десятки тысяч)? Есть ли конкретные источники, которые нужно использовать? Нужна ли проверка валидности email?

Цена: 6000 UAH
Срок: 5 дней

  • Проекты -
  • Оценка -
  • Рейтинг 342

Бюджет: 4000 UAH Срок: 1 день

Здравствуйте.

Я полностью ознакомился с вашими требованиями и готов начать, как только мы завершим наше обсуждение.

Я реализую ваши требования с помощью скрипта Python.

  • Проекты -
  • Оценка -
  • Рейтинг 367

Бюджет: 5000 UAH Срок: 7 дней

Stattiinua, привет! Вижу, что нужна база email ученых и аспирантов из открытых источников, с проверкой на дубликаты и валидность адресов, выгрузка в Excel/CSV с ссылкой на источник для каждого контакта.

Сделаю это через Python-скрипт, который работает с API OpenAlex и ORCID для получения ФИО, аффилиации, должности и email там, где они публичные, дополню парсингом страниц кафедр и репозиториев университетов там, где email в API нет. Дубликаты уберу по ORCID ID и нормализованному email, актуальность адресов проверю через SMTP-запрос без отправки письма. Результат отдам одним файлом со всеми нужными колонками.

На выполнение нужно 7 дней.

Подскажите, пожалуйста, есть приоритет по конкретным университетам или областям наук, или нужна максимально широкая выборка по всей Украине?

В списке не показаны ставки, скрытые заказчиком или фрилансером c профилем Plus, а также ставки, нарушающие правила