Бюджет: 400 PLN Срок: 1 день
Добрый день. Уже делал подобное, но хотелось бы подробнее обсудить конечный формат сохранения. Буду рад сотрудничеству
Буду рад сотрудничеству!Необходимо парсить текстовый PDF с таблицами и создать динамический объект со всеми данными что есть в документе.
В нем находится 2 таблицы основные которые можно "склеить" в одну и потом для каждой записи из этой таблицы - по таблице детальной информации чуть ниже после основных таблиц.
По хорошему чтобы я мог потом с этими данными работать через Python
Заранее спасибо
Бюджет: 400 PLN Срок: 1 день
Добрый день. Уже делал подобное, но хотелось бы подробнее обсудить конечный формат сохранения. Буду рад сотрудничеству
Буду рад сотрудничеству!Бюджет: 400 PLN Срок: 3 дня
Здравствуйте.
Я NodeJS разработчик. Готов взяться. Пишите, обсудим.
Бюджет: 400 PLN Срок: 5 дней
Здравствуйте!
Я могу реализовать ваш проект на Python. План работы такой:
Парсинг PDF с таблицами с использованием библиотек вроде pdfplumber, camelot или tabula-py.
Объединение основных таблиц в одну динамическую структуру (например, список словарей или DataFrame), чтобы каждая запись была уникальной и готовой к обработке.
Для каждой записи основной таблицы будет привязана детальная информация из нижней таблицы.
Создание динамического объекта/структуры, с которой можно удобно работать в Python (например, через pandas или напрямую как объекты/словарь).
Опционально: возможность сохранять данные в CSV/JSON для последующей аналитики или обработки.
Реализация будет гибкой, чтобы вы могли легко фильтровать, анализировать и модифицировать данные после парсинга.
Готов обсудить детали PDF и сроки реализации.
Бюджет: 500 PLN Срок: 3 дня
Добрый день, могу это реализовать и добавить ИИ для нормализации, напишите в лс
Бюджет: 380 PLN Срок: 1 день
Здравствуйте,
Я завершил вашу задачу. Из текстового PDF с таблицами я создал динамический объект Python и одну объединенную сводную таблицу: две основные таблицы соединены по ecu_code, и для каждой записи прикреплен соответствующий раздел … ДЕТАЛИ.
Результаты:
Чистый CLI-скрипт (меню/аргументы) с структурированными логами и README.
Результаты в двух форматах:
ecu_summary_merged.csv — объединенная сводка (основные таблицы + поля “(CONT…)”).
ecu_merged.json — динамический объект: summary_merged[] плюс details{} на каждый ecu_code.
Проверено на вашем документе: парсинг последовательный, многострочные поля (например, CVNS) обрабатываются.
Запуск локально (если необходимо):
python parse_ecu_pdf.py --input "Details Report.pdf" --outdir "out" --log "out/run.log"
# или интерактивно:
python parse_ecu_pdf.py --menu
Прикреплено:
parse_ecu_pdf.py
ecu_summary_merged.csv
ecu_merged.json
(по желанию) короткий скринкаст/скриншоты
Я также могу предоставить вывод в формате XLSX и/или минимальный веб-интерфейс для просмотра и поиска.
Файлы готовы к передаче.
Бюджет: 401 PLN Срок: 4 дня
Здравствуйте. Готов реализовать парсер для вашего PDF-документа.
Сделаю:
– Чтение и обработку основного PDF с таблицами
– Объединение двух основных таблиц в одну
– Привязку к каждой записи своей детальной информации
– Вывод в виде Python-объекта або pandas DataFrame, з яким можна легко працювати
Работа будет чистая, код понятный. Напишите в личку — всё покажу и уточним детали.
Бюджет: 400 PLN Срок: 1 день
Добрый день. Уже сделал данный парсер. Все готово.
Добрый день. Уже сделал данный парсер. Все готово.
+++++++++++++++++++++++++++++++++++++++++++++
Бюджет: 400 PLN Срок: 3 дня
Привет!
есть опыт работы с различными типами данных
смогу помочь как с текстовыми данными, так и с изображениями
Бюджет: 400 PLN Срок: 1 день
Здравсвтувуйте.
Смогу создать объект с информации в pdf, предлагаю сделать json файл. Также могу любой другой формат сделать если есть необходимость
Напишите мне чтобы обсудить в каком формате будет лучше работать дальше с данными
Бюджет: 400 PLN Срок: 3 дня
Добрый день!
Могу реализовать решение на Python для парсинга PDF:
- извлечь основные таблицы,
- объединить их в одну,
- добавить детальную информацию из следующих таблиц,
- сохранить результат в удобном формате (например, DataFrame или JSON) для дальнейшей работы.
Буду рад уточнить детали задания и согласовать формат финального результата.
Бюджет: 400 PLN Срок: 1 день
Доброго дня, готов выполнить быстро и качественно, напишите в личные сообщения, обсудим детали. С удовольствием помогу)
Бюджет: 400 PLN Срок: 1 день
Добрый день, уже разрабатывал подобные парсеры, сделаю с использованием Python + pdfplumber + pandas DataFrame. Если заинтересовало - пишите, с радостью обсудим подробнее.
Бюджет: 400 PLN Срок: 2 дня
Добрый день. Уже делал подобный проект. Но на пхп. Если не принципиально что пхп, обращайтесь сделаю
Бюджет: 430 PLN Срок: 4 дня
Мои приветствия, Артем
Вам нужна утилита, к которой вы будете обращаться из своего питон-кода, вроде
parser -pdf path/to/my.pdf
и получать данные в структурированном формате (какой-то специализированный класс)?
Возможно, стану в нагоде..
Бюджет: 400 PLN Срок: 1 день
Привет! Смогу реализовать. Напишите в личку, чтобы обсудить все детали. Буду рад сотрудничеству!
Бюджет: 400 PLN Срок: 1 день
Добрый день! Реализую такой парсер на Python!!!!!!!!!!!
Обращайтесь!!!!!!
PHP 71 ставка 4 августа
17 ставок 4 августа
Разработка ботов 71 ставка 31 июля
Парсинг данных 47 ставок 30 июля
85 ставок 29 июля