Нужен софт, который будет в текстах искать по 3 повторяющие слова.
И сортировать по количеству совпадений с остальными строками (то есть сколько есть в других строках повторяющихся 3 слова подряд :
Уникальные (где нету совпадений вообще)
1 совпадения
2 совпадения
3 совпадения
и тд
Важный момент, на знаки препинания и регистр букв софт обращать внимание не должен, искать чисто по словах
Пример :
Я загружаю текстовый файл и внутри него следующие строки :
Добрый день, сегодня прекрасная погода
Добрый день, сегодня погода прекрасная
Хороший день. Сегодня прекрасная игра нас ждет
Всем привет. Сегодня прекрасная погода
Привет всем, сегодня хорошая погода
Софт должен выдать таблицу с возможностью экспорта:
Уникальные (1). Нажав по нему открывается текстовый документ и в нем все строки где нету совпадений по 3 подряд слова. На моем примере это одна строка
Привет всем, сегодня хорошая погода
1 совпадение (3) . Нажав по нему открывается текстовый документ и в нем все строки где только одно совпадений по сравнению со всеми строками 3х слов подряд. На моем примере это 3 строки, в скобках объяснение почему, но то что в скобках не должно быть при экспорте
Добрый день, сегодня погода прекрасная (Совпадение со строкой "Добрый день, сегодня прекрасная погода" - "добрый день сегодня")
Хороший день. Сегодня прекрасная игра нас ждет (Совпадение со строкой "Добрый день, сегодня прекрасная погода" - "день сегодня прекрасная")
Всем привет. Сегодня прекрасная погода (Совпадение со строкой "Добрый день, сегодня прекрасная погода" - "сегодня прекрасная погода")
3 совпадения (1)
Добрый день, сегодня прекрасная погода (по скобках объяснений предудущих тут уже все понятно должно быть)
в скобках возле к-ва совпадений должно быть число - сколько строк с совпадениями
Софт должен выдерживать нагрузку вплоть до 20к строк