Как я собрал 18,6 тысяч материалов и потратил на это 2,7 бакса
Звучит как супер-пупер успешный кейс, на самом деле это просто прикольный кейсик. Сеошник попросил отобрать статьи Хабра на тему ИИ и нейросетей, потому что вручную и с помощью краулеров было сложно к этому подступиться — УРЛ у статей формата article/1234434, плюс статьи про нейронки могут быть в разных тегах и все такое.
Ну и в целом у Хабра 470к урлов за время его жизни и попробуй в этом всем разберись. Поэтому мы с нейронкой разобрались, как отобрать только нужные материалы по ИИ, нейронкам и прочему из этих 470к и нарыли 26 тысяч ссылок. Но это все равно много и куча из этих статей может быть никак не связана с нейронками — поэтому дальше мы подключили Jev и он все эти статьи быстро просканил и откинул еще 6 тысяч нерелевантных материалов (Jev получал заголовок, теги и начало текста и присваивал категорию: подходит, технический материал, исключить или проверить отдельно). Деньгами на это ушло 2,7 бакса (!).
Потом скрипт прошёл по этим 18,6 тысячи страниц и собрал SEO-поля.
На всю работу от первого запроса до полностью готовой таблицы прошло 14 часов. Но я лично во всем участвовал дай бог час, в остальное время просто скрипты отрабатывали.
Миша, давай по новой
===
💬Это пост из ленты, которую читает Саша - автор канала Мальцев: Карьера. Маркетинг. AI. @maltsevprosto
Другие каналы по темам:
🤖 AI @maltsevdaily
🧑🎓 Карьеры @maltsevdailyc
🦹 Маркетинга @maltsevdailym
Post #117629
5