Бюджет: 2000 USD Срок: 3 дня
Здравствуйте) Меня интересует ваш проект. Буду рада с вами работать. Если что, на связи ;)
Я ищу, чтобы преобразовать старые PDF-документы из сканов в текстовые документы.
Вы можете использовать OCR для извлечения и частично справиться с задачей, но документ нужно будет очистить.
Я указал работу как почасовую, но на самом деле это будет по страницам, чем больше страниц будет преобразовано, тем лучше, если вы будете быстрее, то заработаете больше за час.
У меня есть разные уровни в зависимости от качества PDF.
Я включаю 2 страницы в качестве примеров некоторых из самых сложных случаев, с которыми вы столкнетесь.
Пожалуйста, приведите примеры вашей работы и вашу стратегию преобразования.
Бюджет: 2000 USD Срок: 3 дня
Здравствуйте) Меня интересует ваш проект. Буду рада с вами работать. Если что, на связи ;)
Бюджет: 2000 USD Срок: 5 дней
Я очень заинтересован в вашем проекте. Как разработчик, который создал индивидуальный инструмент извлечения данных на основе ИИ (pdf2table.com), у меня есть значительное техническое преимущество для этой работы. Хотя публичная версия моего SaaS специализируется на экспорте в Excel, основной движок работает на продвинутых LLM (Больших Языковых Моделях). Это означает, что извлечение идеально чистого, простого текста из ваших сканов полностью соответствует моей настройке. Я не полагаюсь только на стандартный "глупый" OCR; мой ИИ-управляемый конвейер на самом деле понимает контекст текста, что позволяет ему умно обрабатывать сложные макеты и неаккуратные сканы. Из-за этого я могу обрабатывать большие объемы намного быстрее, чем стандартный фрилансер по вводу данных, с значительно более высокой точностью. Вот моя стратегия конверсии: 1. Извлечение на основе ИИ: Я пропущу отсканированные документы через бэкенд моего движка pdf2table. ИИ извлечет текст, умно сохраняя логический порядок чтения и основную структуру (абзацы, списки). 2. Контекстная очистка: В отличие от стандартного OCR, ИИ автоматически устраняет большинство распространенных артефактов (например, исправляет сломанные символы на основе контекста, удаляет неуместные номера страниц/заголовки). Я дополню это целевыми скриптами для любых постоянных проблем, уникальных для ваших документов. 3. Ручная проверка качества (QA): Автоматизированный конвейер выполняет тяжелую работу, давая мне время вручную просмотреть и доработать текст, полностью сосредоточившись на тех "наихудших" ухудшенных страницах, которые вы упомянули. Примеры моей работы: Поскольку каждый отсканированный документ уникален, лучшее доказательство моего качества — это живой тест. Пожалуйста, отправьте мне 2 "наихудших" примера страниц, которые вы упомянули в описании работы. Я пропущу их через свою ИИ-систему и вручную доработаю, отправив вам чистый текст сразу же. Это продемонстрирует как мою скорость, так и финальное качество, которого вы можете ожидать. Я готов обрабатывать большие объемы и масштабировать процесс по мере необходимости. Давайте обсудим уровни и начнем с тестовых страниц!
Написание статей 7 ставок 3 августа
43 ставки 3 августа
Английский язык 31 ставка 2 августа
Рерайтинг 28 ставок 31 июля
Полиграфический дизайн 35 ставок 28 июля