Бюджет: 800 UAH Срок: 2 дня
Добрый день, пан Олександр. В очередной раз предлагаю отказаться от своей идеи. Ни деньги, ни время Вы не сэкономите. Буду рад сотрудничеству
Буду рад сотрудничеству!
Ярослав Жомирук
Победившая ставка- Проекты 4
- Оценка -
- Рейтинг 465
Бюджет: 2000 UAH Срок: 5 дней
Готов заняться этим проектом и обеспечить его успешное выполнение.
Бюджет: 10000 UAH Срок: 10 дней
я не понимаю а в чем "нарушение правил сервиса"? потому что большинство не осилят такую задачу. а раз не могу значит жалоба? идите на завод.
предложил автору свой вариант - наполнять контент с телеграм, а он уже подчистит
Бюджет: 1000 UAH Срок: 1 день
Добрый день, в теории волне реализуемо, но не все сайты пишутся по подобию и т.д, пишите обсудим, обьясю
Бюджет: 1200 UAH Срок: 1 день
Добрый день.
Приблизительный вариант скрипта накидал. За более детальной информацией обращайтесь в личные сообщения.
Бюджет: 4000 UAH Срок: 5 дней
Добрый день!
Задание выглядит интересным. Напишите в ЛС, обсудим.
---------------------------------------------------------------------
Бюджет: 3000 UAH Срок: 2 дня
Добрый день
Могу реализовать вашу логику парсинга на nodejs.
Бюджет: 1000 UAH Срок: 5 дней
Добрый день, могу на nodejs/puppeteer спарсить данные.
Нужен список сайтов, настрою автопостинг на wordpress по rest api
Бюджет: 2000 UAH Срок: 4 дня
Привет! Готов взяться за эту задачу. У меня уже есть опыт работы с парсингом данных, поэтому выполню все оперативно и качественно. Давайте свяжемся и обсудим детали
Ставки пока отсутствуют
-
Василь Собовий 12 августа 2024На практике это не работает. Все верстают по разному и не всегда семантически правильно. Подзаголовки и параграфы могут быть не только в теле статьи, но и в меню и в дополнительных блоках. Кроме параграфов будут еще изображения, списки и ссылки. Вам как минимум нужно найти начало и конец контентной части.
Может на простых однотипных сайтах ваш метод и будет работать, но об универсальности речь не идет. -
Владимир Смирнов 12 августа 2024Когда-то программисты считали что невозможно написать программу которая распознает рукописный ввод, так как считали что программа должна учитывать все возможные варианты. Но потом появился ИИ и все оказалось возможным. Идея автора задания вполне реализуема.
-
Владислав З. 13 августа 2024Ну так твій АІ створювався не один день. На це пішли багато років збору різної інформації. Тепер можно цю інформацію ПРОДАВАТИ. Так що, якщо розробити парсера на АІ, то ціна буде дорожкою, ані ж просто ручками копіювати :)
Поки що це так. Можливо, пізніше буде це безкоштовно.
-
Ирина Г. 13 августа 2024я вас растрою. распознавание рукописного текста появилось еще в 97 году когда про ИИ никто не думал. так что это разное. И дрессировали той псевдо-ИИ на паспортах. веселое было занятие.
конечно я по такому пути тоже шёл - взять видимый текст на странице. и там вместе с контентом было столько же мусора сколько и полезной информации. рекламные блоки, меню, какие то масивы текста переменных. так что программы и люди одно и тоже видят по разному.
Так что создание универсального парсера который бы парсил мох и болото вполне возможно даже на сегодня. но я думаю что это будет с серьезным вливанием денег в виде машино*часов для аренды гпу (либо купить свою Nvidia Tesla A100 ) чтобы обучить свой ИИ. внедрение в изучение структуры документа я считаю тупиковым развитием из за большой вариативности.
-
Ирина Г. 12 августа 2024Вы просто не понимаете как работает ЛЮБОЙ софт. возьмите напишите ТЗ и тогда у программистов не будет вопросов что "сайты все разные"
-
Ирина Г. 12 августа 2024Так само з текстом. Ось <div class="article-content__container"> <div> </div> <p>Текст.</p>
Ми можемо вчепитися за "article-content__container". Но на іншому сайті він буде інший. Навіщо теж так робити? Чому не можна вчепитися просто за <p></p>. Невже так не можна зробити?обьясняю - полно сайтов которые построены чисто на div без всяких там p h1
-
Ирина Г. 12 августа 2024Одно понятно - вам нужен контент. рерайтить лень. нужно копипаст.
как я делал для себя когда мне нужно было 20тыс страниц контента:
написал прогу которая - парсит нужные телеграмм группы - сохраняет. парсит 5 сайтов - сохраняет. далее все сохраненные посты (а их было порядка 45тыс) чиститься по ключевым словам и вырезалась реклама. пропускаеться через чатгпт с нужными промтами. на выходе имел чистый код со статьей который я по апи вордпресс закинул на сайт. все. а не вот это вот.
А вы и дальше можете доказывать что ваш способ лучше. но вы не учитываете тот момент что между движениями мышки мозг анализирует информацию. И я много раз сталкивался с тем что контент который занимает 10000 символом в странице занмиает 600-1000кбайт. И мусор вычищать то еще занятие. так что теория и практика это разное.
Актуальные фриланс-проекты в категории Python
-
Не указан
Доработка Python-программы под новый интерфейс чатов Twitter (X)
Десктопные приложения 69 ставок 31 июля
-
3000 UAH
Сигнальный бот для трейдинга
Разработка ботов 67 ставок 31 июля
-
Не указан
Парсинг сайта, обход защиты Akami
Парсинг данных 46 ставок 30 июля
-
20 000 UAH
Разработка ИИ-бота для приема и обработки заказов от ресторанов в Telegram с интеграцией в 1С
77 ставок 29 июля
-
Не указан
Нужно на текущей версии бота исправить баг
Разработка ботов 87 ставок 27 июля