Бюджет: 800 UAH Термін: 2 дні
Доброго дня, пане Олександре. В черговий раз пропоную відмовитись від своєї ідеї. Ні гроші, ні час Ви не зекономите. Буду радий співпраці
Буду радий співпраці!
Ярослав Жомирук
Переможець- Проєкти 4
- Оцінка -
- Рейтинг 465
Бюджет: 2000 UAH Термін: 5 днів
Готовий зайнятися цим проектом і забезпечити його успішне виконання.
Бюджет: 10000 UAH Термін: 10 днів
я не розумію, а в чому "порушення правил сервісу"? тому що більшість не осилить таке завдання. а раз не можу, значить, скарга? йдіть на завод.
пропонував автору свій варіант - наповнювати контент з телеграму, а він вже підчистить
Бюджет: 1000 UAH Термін: 1 день
Доброго дня, в теорії хвилі реалізовано, але не всі сайти пишуться за подібністю і т.д, пишіть обговоримо, поясню
Бюджет: 1200 UAH Термін: 1 день
Добрий день.
Приблизний варіант скрипта накидав. За більш детальною інформацією звертайтеся в особисті повідомлення.
Бюджет: 4000 UAH Термін: 5 днів
Добрий день!
Завдяння виглядає цiкавим. Напишiть в ЛС, обговоримо.
---------------------------------------------------------------------
Бюджет: 3000 UAH Термін: 2 дні
Добрий день
Можу реалізувати вашу логіку парсингу на nodejs.
Бюджет: 1000 UAH Термін: 5 днів
Доброго дня , можу на nodejs/puppeteer спарсити дані.
Потрібен список сайтів , налаштую автопостинг на wordpress по rest api
Бюджет: 2000 UAH Термін: 4 дні
Вітаю! Готовий взятися за цю задачу. У мене вже є досвід роботи з парсингом даних, тому виконаю все оперативно та якісно. Давайте зв'яжемося та обговоримо деталі
Ставки поки відсутні
-
Василь Собовий 12 серпня 2024На практике это не работает. Все верстают по разному и не всегда семантически правильно. Подзаголовки и параграфы могут быть не только в теле статьи, но и в меню и в дополнительных блоках. Кроме параграфов будут еще изображения, списки и ссылки. Вам как минимум нужно найти начало и конец контентной части.
Может на простых однотипных сайтах ваш метод и будет работать, но об универсальности речь не идет. -
Владимир Смирнов 12 серпня 2024Когда-то программисты считали что невозможно написать программу которая распознает рукописный ввод, так как считали что программа должна учитывать все возможные варианты. Но потом появился ИИ и все оказалось возможным. Идея автора задания вполне реализуема.
-
Владислав З. 13 серпня 2024Ну так твій АІ створювався не один день. На це пішли багато років збору різної інформації. Тепер можно цю інформацію ПРОДАВАТИ. Так що, якщо розробити парсера на АІ, то ціна буде дорожкою, ані ж просто ручками копіювати :)
Поки що це так. Можливо, пізніше буде це безкоштовно.
-
Ирина Г. 13 серпня 2024я вас растрою. распознавание рукописного текста появилось еще в 97 году когда про ИИ никто не думал. так что это разное. И дрессировали той псевдо-ИИ на паспортах. веселое было занятие.
конечно я по такому пути тоже шёл - взять видимый текст на странице. и там вместе с контентом было столько же мусора сколько и полезной информации. рекламные блоки, меню, какие то масивы текста переменных. так что программы и люди одно и тоже видят по разному.
Так что создание универсального парсера который бы парсил мох и болото вполне возможно даже на сегодня. но я думаю что это будет с серьезным вливанием денег в виде машино*часов для аренды гпу (либо купить свою Nvidia Tesla A100 ) чтобы обучить свой ИИ. внедрение в изучение структуры документа я считаю тупиковым развитием из за большой вариативности.
-
Ирина Г. 12 серпня 2024Вы просто не понимаете как работает ЛЮБОЙ софт. возьмите напишите ТЗ и тогда у программистов не будет вопросов что "сайты все разные"
-
Ирина Г. 12 серпня 2024Так само з текстом. Ось <div class="article-content__container"> <div> </div> <p>Текст.</p>
Ми можемо вчепитися за "article-content__container". Но на іншому сайті він буде інший. Навіщо теж так робити? Чому не можна вчепитися просто за <p></p>. Невже так не можна зробити?обьясняю - полно сайтов которые построены чисто на div без всяких там p h1
-
Ирина Г. 12 серпня 2024Одно понятно - вам нужен контент. рерайтить лень. нужно копипаст.
как я делал для себя когда мне нужно было 20тыс страниц контента:
написал прогу которая - парсит нужные телеграмм группы - сохраняет. парсит 5 сайтов - сохраняет. далее все сохраненные посты (а их было порядка 45тыс) чиститься по ключевым словам и вырезалась реклама. пропускаеться через чатгпт с нужными промтами. на выходе имел чистый код со статьей который я по апи вордпресс закинул на сайт. все. а не вот это вот.
А вы и дальше можете доказывать что ваш способ лучше. но вы не учитываете тот момент что между движениями мышки мозг анализирует информацию. И я много раз сталкивался с тем что контент который занимает 10000 символом в странице занмиает 600-1000кбайт. И мусор вычищать то еще занятие. так что теория и практика это разное.
Актуальні фриланс-проєкти в категорії Python
-
Не вказано
Доопрацювання Python-програми під новий інтерфейс чатів Twitter (X)
Десктопні додатки 69 ставок 31 липня
-
3000 UAH
Сигнальний бот для трейдингу
Розробка ботів 67 ставок 31 липня
-
Не вказано
Парсинг сайту, обхід захисту Akami
Парсинг даних 46 ставок 30 липня
-
20 000 UAH
Розробка ІІ-бота для прийому та обробки замовлень від ресторанів у Telegram з інтеграцією в 1С
77 ставок 29 липня
-
Не вказано
Потрібно на поточній версії бота виправити баг.
Розробка ботів 87 ставок 27 липня