Nie podano
30 ofert
Potrzebny jest system do automatycznego przetwarzania dużych ilości informacji za pomocą AI
Obecnie używam własnego promptu w Claude. Działa dobrze na małych tekstach, ale przy dużych objętościach sieć neuronowa może pomijać części, zatrzymywać się przed końcem lub informować o zakończeniu, mimo że materiał nie został w pełni przetworzony.
Potrzebny jest system, który przyjmuje od razu książkę na 200+ stron, kilka książek, PDF, DOCX, TXT, napisy, transkrypcje audio i wideo lub inny duży zbiór informacji i automatycznie przetwarza go od początku do końca.
Jeden z podstawowych formatów wyniku dla każdego sensownego zdania:
Wersja angielska.
••••••••••••••••••••••••••••
Wersja rosyjska.
••••••••••••••••••••••••••••
Wersja angielska.
••••••••••••••••••••••••••••
Wersja angielska.
••••••••••••••••••••••••••••
Wersja rosyjska.
••••••••••••••••••••••••••••
Wersja angielska.
Każda sensowna linia jest wyświetlana cztery razy po angielsku i dwa razy po rosyjsku w podanej kolejności. Tłumaczenie powinno dokładnie oddawać sens. Krótkie zdania można łączyć, długie — dzielić na zakończone sensowne linie.
Format powinien być konfigurowalny: liczba angielskich powtórzeń i tłumaczeń, ich kolejność, języki, separator, długość linii, główny prompt i zachowanie różnych szablonów. Na przykład, zamiast English–Russian–English–English–Russian–English można wybrać dowolną inną sekwencję.
Jeśli dokumentu nie można przetworzyć jednym zapytaniem, program powinien samodzielnie podzielić go na wewnętrzne bloki, wysłać je do Claude, ChatGPT, Gemini lub innego modelu, sprawdzić wynik, powtórzyć problematyczne części i połączyć wszystko w jeden plik. Użytkownik nie powinien ręcznie kopiować tekstu przez cztery strony.
Trzeba sprawdzić, czy nie pominięto żadnego zdania, akapitu ani sensownego fragmentu, czy nie ma duplikatów między blokami, a struktura odpowiada szablonowi. Weryfikacja nie powinna opierać się tylko na stwierdzeniu sieci neuronowej.
Przetwarzanie audio
System powinien również przetwarzać duże archiwa audio, na przykład kanał Telegram z 300 audycjami trwającymi około jednej godziny.
Preferowane jest automatyczne pobieranie audio lub przyjęcie całego archiwum, rozpoznanie mowy i przetworzenie wszystkiego bez ręcznego udziału. Dla każdej audycji powinna być tworzona zorganizowana notatka: temat, główne myśli, ważne fakty, przykłady, rekomendacje i wnioski. Powitania, reklamy, rozmowy śmieciowe i bezsensowne powtórzenia są usuwane, ale przydatne informacje są zachowywane.
Po przetworzeniu potrzebne są nie tylko oddzielne notatki, ale także jeden wspólny czytelny dokument, w którym informacje są zebrane według tematów. Jeśli temat był omawiany w różnych audycjach, materiały są zbierane w jeden dział, duplikaty są usuwane, a linki do oryginalnych nagrań są zachowywane.
W rezultacie powinny być:
— notatka dla każdej audycji;
— ogólny dokument tematyczny;
— wyszukiwanie według słów i tematów;
— powiązanie wniosków z oryginalnym audio;
— zachowanie postępu i kontynuacja po błędach.
Większość tych działań mogę już wykonywać samodzielnie, ale tylko na małej objętości i ręcznie. Dlatego również jestem gotów rozważyć bardziej efektywny sposób pobierania i przekształcania audio na tekst, jeśli wykonawca zaproponuje lepsze rozwiązanie niż to, którego używam.
Co wskazać w odpowiedzi
Napisz:
— jak będzie zrealizowany system i jaki produkt otrzymam;
— jakie modele AI i rozpoznawania mowy będą używane;
— jak sprawdzana jest pełność i wykluczane są pominięcia i powtórzenia;
— czy można zmieniać prompt, liczbę tłumaczeń, powtórzeń i ich kolejność;
— czy możliwe jest pobieranie materiałów z Telegramu;
— koszt opracowania, API, terminy i cena dalszych poprawek.
Głównym celem jest uniwersalny system, który bez ręcznego udziału przetwarza duże książki i setki godzin audio, nie traci informacji i wydaje gotowy wynik ściśle według wybranego szablonu.