Бюджет: 25000 UAH Термін: 8 днів
⚙️ OCR + NLP-пайплайн для медичних документів — моя щоденна робота. Знаю, де такі проєкти зазвичай спотикаються: нечіткі скани, різноманітні формати бланків, змішана мова термінології.
Зроблю витяг структурованих даних із звітів і форм довгострокового догляду через Python — з попередньою очисткою OCR-виводу й NLP-моделлю для витягу полів.
На вхід: сканы/фото документів
Розпізнавання тексту (Tesseract або підхід під ваші дані)
NLP-витяг сутностей у структурований JSON
Валідація результату на контрольній вибірці
Робив подібне зі складними медичними звітами — головний зиск у тому, що після налаштування пайплайн сам підставляє поля без ручної роботи.
Можу стартувати сьогодні, для старту потрібна лише вибірка зразків документів.
Напишіть — і я за 10 хвилин накидаю план першого етапу під ваші формати.