Budget: 1000 RUB Deadline: 4 days
Привет! Нужно узнать насколько абзацы в тексте похожи друг на друга. Есть такой код:
$text = ["text text text", "its my text", "its string hello world"];
echo count($text);
$sim = similar_text($text[0], $text[1], $perc);
echo "similar_text: $sim ($perc %)\n";
Сейчас он может проверять только 0 и 1 значение массива, а их может быть неограниченное множество (но обычно не больше 20). Нужно написать алгоритм проверки схожести между ними: сравнить 1 с 2, 3...n; 2 с 1, 2...n и т.д. И потом вывести среднее значение схожести. Т.е. сначала высчитать схожесть первой пары, потом второй, третей и т.д и вывести среднее арифметическое их схожести.
Текст добавляется через форму textarea:
<h2>heading 1</h2>
text1
<h2>heading 2</h2>
text2
То, что находится в heading 1 заносится в 0 значение массива, heading 2 в 1 значение массива. Думаю можно это сделать через регулярное выражение (извлекать значение между тегами <h2>) и заносить в массив.
Budget: 1000 RUB Deadline: 4 days
HTML & CSS 52 proposals 10:23
Content Management Systems 50 proposals 5 August
Web Programming 78 proposals 4 August
Python 79 proposals 4 August
Content Management Systems 36 proposals 2 August