Black Hat SEO|DOR
638 subscribers
29 photos
2 videos
12 files
268 links
Download Telegram
Forwarded from Евгений Xstroy
Пипец насоветовали ... после оплаты на контабо на левак
В дополнение к вышеуказанному, пожалуйста, пришлите нам документ, подтверждающий адрес. Это может быть:

1. Скан вашего паспорта, водительских прав или национального удостоверения личности.
2. Скан счета за телефон, электричество или любое другое коммунальное обслуживание, если в нем указаны ваше имя и адрес, указанный выше.

выполнение вашего заказа приостановлено до тех пор, пока вы не предоставите нам эти данные.
Forwarded from Евгений Xstroy
Проблема где искать норвежские доки
Forwarded from Михаил
Вот еще:

Решил опубликовать небольшой кейс, о том, как я собираю, структурирую текстовку для своих дорвеев и конечно же ее чищу т.е. делаю пост-обработку после парсинга, после чего наполняю базу данных и уже использую для дальнейшей генерации доров. Цель моего кейса - рассказать о шикарной софтине, которая помогает обрабатывать текстовые и другие (xls, csv и т.п.) файлы огромных размеров. Ни, всем привычный notepad++, ни другие редакторы просто не могут открыть файлы такого размера и, соответственно, произвести в них нужные замены/чистки. Речь пойдет о Penguin Keywords Tools. Ближайший аналог, которым я пользовался ранее - это TextPipe, который стоит кучу денег и жутко неудобный, постоянно крашился (юзал-то я крякнутую версию).

Итак, для распарса всего и вся я уже более 7 лет, наверное, использую A-parser т.к. это топ софт для этих целей.
В кратце опишу алгоритм, не углубляясь в настройки и регулярки пресетов парсера...

Паршу несколько поисковиков - Google, Bing, Aol, Ask сразу и собираю данные по ключам в сводный файл по типу Multikey: KEY;;;TOPURLS;;;SNIP_T;;;SNIP_D;;;IMG_URL;;;YT_URL;;;LSI
Выглядит это, примерно так: http://joxi.ru/xAe0eaXfRwMPR2 На скрине, уже почищенные данные, приведенные в более-менее человеческий вид. Они не идеальны (ведь это доры!), но генеренные на очищенных данных дорвеи у меня индексируются и живут дольше.

Как происходит чистка всякого мусора? Я загружаю свои напаршенные исходники (которые, зачастую, весят десятки гигабайт) в Penguin и применяю ряд стандартных функций софта + список регулярок, которые частично писал сам под нужные мне задачи, а какие-то банально нагуглил :) Кто-то вовсе не чистит исходники и нормально становится в топы своими дорвеями - дело каждого. К тому же, такими чистками я неплохо экономлю на размере БД и серверного диска (у меня дорген похож чем-то на Pandor'у , но серверный и данные тянет с БД при генерации).

В основном - это работа со сниппетами с двумя столбцами - title и description. http://joxi.ru/eAO14j6h93vaqm
Вот некоторая часть моих регулярок, которые участвуют в чистке https://pastebin.com/yQ6UCcY0 я не комментировал что есть что, каждый может подобрать себе что-то нужное... Для чистки различных типов данных я использую разные списки - все зависит от задач, выдача-то везде разная и мусор тоже бывает разный). Замены в софте выглядят так: http://joxi.ru/Dr8EnL9CoBKP1m "что меняем=>на что".
Приведу пример того, что я зачищаю обязательно:
- Даты из сниппетов;
- Всякий мусор вначале строк;
- Удаляю разные вариации ссылок;
- Двойные пробелы и ряд других задвоенных символов;
- Меняю последние года на актуальный;

В конечном итоге, под каждый ключ у меня выходит большой массив title, description, txt (в кейс не попало), LSI (тоже), тематическиих урлов, ютубов и т.п. Все эти массивы представляют из себя уже очищенные и приведенные в "читабельный" вид предложения, на основе которых, я составляю шаблон и решаю где, как и сколько раз мне нужно вывести для той или иной тематики дорвея.

"Почему ты не используешь чистку в рил-тайме, при парсинге" - спросите вы? Ответ прост - за годы работы с A-parser'ом, при чем не на самом топовом железе, я обнаружил, что такое большое количество регулярок (а некоторые получаются совсем тяжелые) у меня он начинал работать нестабильно и, порой, крашился довольно часто. Ко всему этому, я мог допустить банальную ошибку в какой-то из регулярок и т.п. и весь долгочасовой/суточный процесс парсинга шел насмарку т.к. в конечном файле результатов я видел совсем не то, что ожидал. Поэтому, я пришел к пост-обработке с помощью шикарной софтины Penguin. Как-то так...

P.s. у меня нет своего блога/канала, поэтому, с позволения Макса @Virtprofit я публикую этот "мини-кейс" тут :) Это не реклама, хоть я и рекомендую использовать софт Penguin, просто мне он экономит множество рутинных задач по обработке, чистке, и кластеризации большого количества напаршенного и хочу поделиться такой инфой... Разработчик софта, кстати очень отзывчивый человек и по моим просьбам внедряет необходимые фичи и апдейты.
👍2
Forwarded from Deleted Account
Годнота
Чат чет не найду..
Forwarded from Deleted Account
ВП тормозная же жутко
Forwarded from vezelvu
просто вы не умеете ее готовить 😉
Forwarded from vezelvu
Forwarded from PRODVIGAET
Есть какой то изящный способ просмотра выдачи гугла из под конкретного гео без впн, прокси. Нашёл возможность просматривать через ads. Google но выдаёт только скрин выдачи
2
Forwarded from Евгений Xstroy
region.xstroy.com
Сформируй url под свой город и выдачу и юзай.
Делал когда-то для интереса себе.
Сеошники до сих пор юзают.
2
Forwarded from Andrey Ivanov
Палю тему:
1. Выключаете все мессенджеры на компе
2. Ставите телефоны на вибро и переворачиваете их экраном вниз
3. Делаете доры
Практикую уже неделю, позволяет хоть как-то сконцентрироваться в этом дурдоме)
Forwarded from Иван Семин🍀
В РСЯ принимают все сайты

Ну почти все. В телдери чате вчера написали, что РСЯ принимает сайты, которые раньше не проходили по модерации.

Отправил 3 сайта на модерацию. Один майнкрафт, один старый по народной медицине, один лендос.

Сегодня все приняли.

Не знаю в чем дело, но рекомендую вам добавить сайты, которые не проходили. Видимо модераторы ослабили критерии или временный глюк 😅
1
Forwarded from Евгений Xstroy
Конечно дорвейщики все работают на гугл, но возможно местным товарищам, ориентированным на Яшу пригодится Парсер ключей из вебмастера:
https://xstroy.com/parser-zaprosov-yandeks-vebmastera/
Когда-то встретил скрипт в Фейсбуке, но потом он сдох. Я его слегка декодировал и допилил по себя. Пока работает юзайте.
Полезные ключики кажет на живом сайте.
Может выгружать много, но на больших объемах делайте выборки от и до.
P.s. Чел написал в комментах, что не работает, вот я и вспомнил что оно есть 😎. Обманул, все работает как часики. Зачем добру пропадать.
Правда там бы ещё сортировку по столбцам добавить, но ленюсь...
👍32🖕2
Forwarded from IT DED
такое на каталожное наверно приспособить можно
+ товарка само собой
1
Forwarded from IT DED
Ну или если кто доры генерит вот по такому ману...
https://doorway.life/ru/dopolnitelniy-beliy-trafik-dlya-sayta
👍31