Не указан
23 ставки
Нужна система для автоматической обработки больших объёмов информации с помощью ИИ
Сейчас я использую собственный промпт в Claude. На небольших текстах он работает хорошо, но при больших объёмах нейросеть может пропускать части, останавливаться раньше конца или сообщать о завершении, хотя материал обработан не полностью.
Нужна система, которая принимает сразу книгу на 200+ страниц, несколько книг, PDF, DOCX, TXT, субтитры, расшифровки аудио и видео или другой большой массив информации и автоматически обрабатывает его от начала до конца.
Один из основных форматов результата для каждого смыслового предложения:
English version.
••••••••••••••••••••••••••••
Russian version.
••••••••••••••••••••••••••••
English version.
••••••••••••••••••••••••••••
English version.
••••••••••••••••••••••••••••
Russian version.
••••••••••••••••••••••••••••
English version.
Каждая смысловая строка выводится четыре раза на английском и два раза на русском в указанной очередности. Перевод должен точно передавать смысл. Короткие предложения можно объединять, длинные — делить на законченные смысловые строки.
Формат должен настраиваться: количество английских повторений и переводов, их очередность, языки, разделитель, длина строк, основной промпт и сохранение разных шаблонов. Например, вместо English–Russian–English–English–Russian–English можно выбрать любую другую последовательность.
Если документ невозможно обработать одним запросом, программа должна сама разделить его на внутренние блоки, отправить их в Claude, ChatGPT, Gemini или другую модель, проверить результат, повторить проблемные части и объединить всё в один файл. Пользователь не должен вручную копировать текст по четыре страницы.
Необходимо проверять, что не пропущено ни одного предложения, абзаца или смыслового фрагмента, отсутствуют дубли между блоками, а структура соответствует шаблону. Проверка не должна основываться только на утверждении нейросети.
Обработка аудио
Система также должна обрабатывать большие архивы аудио, например Telegram-канал с 300 эфирами примерно по одному часу.
Желательно автоматически скачать аудио либо принять весь архив, распознать речь и обработать всё без ручного участия. По каждому эфиру должна создаваться структурированная выжимка: тема, главные мысли, важные факты, примеры, рекомендации и выводы. Приветствия, реклама, разговорный мусор и бессмысленные повторы удаляются, но полезная информация сохраняется.
После обработки нужны не только отдельные конспекты, но и один общий читабельный документ, где информация объединена по темам. Если тема обсуждалась в разных эфирах, материалы собираются в один раздел, дубли удаляются, а ссылки на исходные записи сохраняются.
В результате должны быть:
— выжимка по каждому эфиру;
— общий тематический документ;
— поиск по словам и темам;
— связь выводов с исходным аудио;
— сохранение прогресса и продолжение после ошибок.
Большую часть этих действий я уже могу выполнять самостоятельно, но только на небольшом объёме и вручную. Поэтому также готов рассмотреть более эффективный способ скачивания и преобразования аудио в текст, если исполнитель предложит решение лучше используемого мной.
Что указать в отклике
Напишите:
— как будет реализована система и какой продукт я получу;
— какие модели ИИ и распознавания речи будут использоваться;
— как проверяется полнота и исключаются пропуски и повторы;
— можно ли менять промпты, количество переводов, повторений и их очередность;
— возможно ли скачивание материалов из Telegram;
— стоимость разработки, API, сроки и цену дальнейших доработок.
Главная цель — универсальная система, которая без ручного участия обрабатывает большие книги и сотни часов аудио, не теряет информацию и выдаёт готовый результат строго по выбранному шаблону.