Бюджет: 15000 UAH Термін: 10 днів
Добрий день.
Для задачі з трьохколонковою версткою та витягуванням блоків тексту разом з картинками можна написати кастомний координатний парсер, але як більш надійну альтернативу пропоную розглянути спеціалізовані API, такі як AWS Textract або Google Document AI. Вони нативно розпізнають складний багатоколонковий лейаут і віддають готову структуру, що значно знизить кількість помилок перед відправкою тексту на перевірку.
Всю серверну логіку з маршрутизацією, валідацією через Claude API в три спроби та збереженням результатів реалізую на Node.js з Typescript. Інтерфейс адміністратора для управління чергою книг, виводу статистики та перегляду логів по проблемним розділам зберемо на Next.js.
В особистих повідомленнях покажу приклади скриптів витягування даних з документів зі складною структурою та інтеграції з LLM API. Буду радий вивчити розширене технічне завдання.