Forwarded from Евгений Xstroy
Пипец насоветовали ... после оплаты на контабо на левак
В дополнение к вышеуказанному, пожалуйста, пришлите нам документ, подтверждающий адрес. Это может быть:
1. Скан вашего паспорта, водительских прав или национального удостоверения личности.
2. Скан счета за телефон, электричество или любое другое коммунальное обслуживание, если в нем указаны ваше имя и адрес, указанный выше.
выполнение вашего заказа приостановлено до тех пор, пока вы не предоставите нам эти данные.
В дополнение к вышеуказанному, пожалуйста, пришлите нам документ, подтверждающий адрес. Это может быть:
1. Скан вашего паспорта, водительских прав или национального удостоверения личности.
2. Скан счета за телефон, электричество или любое другое коммунальное обслуживание, если в нем указаны ваше имя и адрес, указанный выше.
выполнение вашего заказа приостановлено до тех пор, пока вы не предоставите нам эти данные.
Forwarded from Михаил
Для любителей готового, не мое:
https://pastebin.com/yQ6UCcY0
https://pastebin.com/yQ6UCcY0
Pastebin
#Текстовки:\<.*?\>=> -->=>\b([a-z0-9._-]+@[a-z0-9.-]+)\b=>(?:\+|\d)[\d - Pastebin.com
Pastebin.com is the number one paste tool since 2002. Pastebin is a website where you can store text online for a set period of time.
Forwarded from Михаил
Вот еще:
Решил опубликовать небольшой кейс, о том, как я собираю, структурирую текстовку для своих дорвеев и конечно же ее чищу т.е. делаю пост-обработку после парсинга, после чего наполняю базу данных и уже использую для дальнейшей генерации доров. Цель моего кейса - рассказать о шикарной софтине, которая помогает обрабатывать текстовые и другие (xls, csv и т.п.) файлы огромных размеров. Ни, всем привычный notepad++, ни другие редакторы просто не могут открыть файлы такого размера и, соответственно, произвести в них нужные замены/чистки. Речь пойдет о Penguin Keywords Tools. Ближайший аналог, которым я пользовался ранее - это TextPipe, который стоит кучу денег и жутко неудобный, постоянно крашился (юзал-то я крякнутую версию).
Итак, для распарса всего и вся я уже более 7 лет, наверное, использую A-parser т.к. это топ софт для этих целей.
В кратце опишу алгоритм, не углубляясь в настройки и регулярки пресетов парсера...
Паршу несколько поисковиков - Google, Bing, Aol, Ask сразу и собираю данные по ключам в сводный файл по типу Multikey: KEY;;;TOPURLS;;;SNIP_T;;;SNIP_D;;;IMG_URL;;;YT_URL;;;LSI
Выглядит это, примерно так: http://joxi.ru/xAe0eaXfRwMPR2 На скрине, уже почищенные данные, приведенные в более-менее человеческий вид. Они не идеальны (ведь это доры!), но генеренные на очищенных данных дорвеи у меня индексируются и живут дольше.
Как происходит чистка всякого мусора? Я загружаю свои напаршенные исходники (которые, зачастую, весят десятки гигабайт) в Penguin и применяю ряд стандартных функций софта + список регулярок, которые частично писал сам под нужные мне задачи, а какие-то банально нагуглил :) Кто-то вовсе не чистит исходники и нормально становится в топы своими дорвеями - дело каждого. К тому же, такими чистками я неплохо экономлю на размере БД и серверного диска (у меня дорген похож чем-то на Pandor'у , но серверный и данные тянет с БД при генерации).
В основном - это работа со сниппетами с двумя столбцами - title и description. http://joxi.ru/eAO14j6h93vaqm
Вот некоторая часть моих регулярок, которые участвуют в чистке https://pastebin.com/yQ6UCcY0 я не комментировал что есть что, каждый может подобрать себе что-то нужное... Для чистки различных типов данных я использую разные списки - все зависит от задач, выдача-то везде разная и мусор тоже бывает разный). Замены в софте выглядят так: http://joxi.ru/Dr8EnL9CoBKP1m "что меняем=>на что".
Приведу пример того, что я зачищаю обязательно:
- Даты из сниппетов;
- Всякий мусор вначале строк;
- Удаляю разные вариации ссылок;
- Двойные пробелы и ряд других задвоенных символов;
- Меняю последние года на актуальный;
В конечном итоге, под каждый ключ у меня выходит большой массив title, description, txt (в кейс не попало), LSI (тоже), тематическиих урлов, ютубов и т.п. Все эти массивы представляют из себя уже очищенные и приведенные в "читабельный" вид предложения, на основе которых, я составляю шаблон и решаю где, как и сколько раз мне нужно вывести для той или иной тематики дорвея.
"Почему ты не используешь чистку в рил-тайме, при парсинге" - спросите вы? Ответ прост - за годы работы с A-parser'ом, при чем не на самом топовом железе, я обнаружил, что такое большое количество регулярок (а некоторые получаются совсем тяжелые) у меня он начинал работать нестабильно и, порой, крашился довольно часто. Ко всему этому, я мог допустить банальную ошибку в какой-то из регулярок и т.п. и весь долгочасовой/суточный процесс парсинга шел насмарку т.к. в конечном файле результатов я видел совсем не то, что ожидал. Поэтому, я пришел к пост-обработке с помощью шикарной софтины Penguin. Как-то так...
P.s. у меня нет своего блога/канала, поэтому, с позволения Макса @Virtprofit я публикую этот "мини-кейс" тут :) Это не реклама, хоть я и рекомендую использовать софт Penguin, просто мне он экономит множество рутинных задач по обработке, чистке, и кластеризации большого количества напаршенного и хочу поделиться такой инфой... Разработчик софта, кстати очень отзывчивый человек и по моим просьбам внедряет необходимые фичи и апдейты.
Решил опубликовать небольшой кейс, о том, как я собираю, структурирую текстовку для своих дорвеев и конечно же ее чищу т.е. делаю пост-обработку после парсинга, после чего наполняю базу данных и уже использую для дальнейшей генерации доров. Цель моего кейса - рассказать о шикарной софтине, которая помогает обрабатывать текстовые и другие (xls, csv и т.п.) файлы огромных размеров. Ни, всем привычный notepad++, ни другие редакторы просто не могут открыть файлы такого размера и, соответственно, произвести в них нужные замены/чистки. Речь пойдет о Penguin Keywords Tools. Ближайший аналог, которым я пользовался ранее - это TextPipe, который стоит кучу денег и жутко неудобный, постоянно крашился (юзал-то я крякнутую версию).
Итак, для распарса всего и вся я уже более 7 лет, наверное, использую A-parser т.к. это топ софт для этих целей.
В кратце опишу алгоритм, не углубляясь в настройки и регулярки пресетов парсера...
Паршу несколько поисковиков - Google, Bing, Aol, Ask сразу и собираю данные по ключам в сводный файл по типу Multikey: KEY;;;TOPURLS;;;SNIP_T;;;SNIP_D;;;IMG_URL;;;YT_URL;;;LSI
Выглядит это, примерно так: http://joxi.ru/xAe0eaXfRwMPR2 На скрине, уже почищенные данные, приведенные в более-менее человеческий вид. Они не идеальны (ведь это доры!), но генеренные на очищенных данных дорвеи у меня индексируются и живут дольше.
Как происходит чистка всякого мусора? Я загружаю свои напаршенные исходники (которые, зачастую, весят десятки гигабайт) в Penguin и применяю ряд стандартных функций софта + список регулярок, которые частично писал сам под нужные мне задачи, а какие-то банально нагуглил :) Кто-то вовсе не чистит исходники и нормально становится в топы своими дорвеями - дело каждого. К тому же, такими чистками я неплохо экономлю на размере БД и серверного диска (у меня дорген похож чем-то на Pandor'у , но серверный и данные тянет с БД при генерации).
В основном - это работа со сниппетами с двумя столбцами - title и description. http://joxi.ru/eAO14j6h93vaqm
Вот некоторая часть моих регулярок, которые участвуют в чистке https://pastebin.com/yQ6UCcY0 я не комментировал что есть что, каждый может подобрать себе что-то нужное... Для чистки различных типов данных я использую разные списки - все зависит от задач, выдача-то везде разная и мусор тоже бывает разный). Замены в софте выглядят так: http://joxi.ru/Dr8EnL9CoBKP1m "что меняем=>на что".
Приведу пример того, что я зачищаю обязательно:
- Даты из сниппетов;
- Всякий мусор вначале строк;
- Удаляю разные вариации ссылок;
- Двойные пробелы и ряд других задвоенных символов;
- Меняю последние года на актуальный;
В конечном итоге, под каждый ключ у меня выходит большой массив title, description, txt (в кейс не попало), LSI (тоже), тематическиих урлов, ютубов и т.п. Все эти массивы представляют из себя уже очищенные и приведенные в "читабельный" вид предложения, на основе которых, я составляю шаблон и решаю где, как и сколько раз мне нужно вывести для той или иной тематики дорвея.
"Почему ты не используешь чистку в рил-тайме, при парсинге" - спросите вы? Ответ прост - за годы работы с A-parser'ом, при чем не на самом топовом железе, я обнаружил, что такое большое количество регулярок (а некоторые получаются совсем тяжелые) у меня он начинал работать нестабильно и, порой, крашился довольно часто. Ко всему этому, я мог допустить банальную ошибку в какой-то из регулярок и т.п. и весь долгочасовой/суточный процесс парсинга шел насмарку т.к. в конечном файле результатов я видел совсем не то, что ожидал. Поэтому, я пришел к пост-обработке с помощью шикарной софтины Penguin. Как-то так...
P.s. у меня нет своего блога/канала, поэтому, с позволения Макса @Virtprofit я публикую этот "мини-кейс" тут :) Это не реклама, хоть я и рекомендую использовать софт Penguin, просто мне он экономит множество рутинных задач по обработке, чистке, и кластеризации большого количества напаршенного и хочу поделиться такой инфой... Разработчик софта, кстати очень отзывчивый человек и по моим просьбам внедряет необходимые фичи и апдейты.
👍2
Forwarded from PRODVIGAET
Есть какой то изящный способ просмотра выдачи гугла из под конкретного гео без впн, прокси. Нашёл возможность просматривать через ads. Google но выдаёт только скрин выдачи
❤2
Forwarded from Евгений Xstroy
region.xstroy.com
Сформируй url под свой город и выдачу и юзай.
Делал когда-то для интереса себе.
Сеошники до сих пор юзают.
Сформируй url под свой город и выдачу и юзай.
Делал когда-то для интереса себе.
Сеошники до сих пор юзают.
❤2
Forwarded from Andrey Ivanov
Палю тему:
1. Выключаете все мессенджеры на компе
2. Ставите телефоны на вибро и переворачиваете их экраном вниз
3. Делаете доры
Практикую уже неделю, позволяет хоть как-то сконцентрироваться в этом дурдоме)
1. Выключаете все мессенджеры на компе
2. Ставите телефоны на вибро и переворачиваете их экраном вниз
3. Делаете доры
Практикую уже неделю, позволяет хоть как-то сконцентрироваться в этом дурдоме)
Forwarded from Иван Семин🍀
В РСЯ принимают все сайты
Ну почти все. В телдери чате вчера написали, что РСЯ принимает сайты, которые раньше не проходили по модерации.
Отправил 3 сайта на модерацию. Один майнкрафт, один старый по народной медицине, один лендос.
Сегодня все приняли.
Не знаю в чем дело, но рекомендую вам добавить сайты, которые не проходили. Видимо модераторы ослабили критерии или временный глюк 😅
Ну почти все. В телдери чате вчера написали, что РСЯ принимает сайты, которые раньше не проходили по модерации.
Отправил 3 сайта на модерацию. Один майнкрафт, один старый по народной медицине, один лендос.
Сегодня все приняли.
Не знаю в чем дело, но рекомендую вам добавить сайты, которые не проходили. Видимо модераторы ослабили критерии или временный глюк 😅
❤1
Forwarded from Евгений Xstroy
Конечно дорвейщики все работают на гугл, но возможно местным товарищам, ориентированным на Яшу пригодится Парсер ключей из вебмастера:
https://xstroy.com/parser-zaprosov-yandeks-vebmastera/
Когда-то встретил скрипт в Фейсбуке, но потом он сдох. Я его слегка декодировал и допилил по себя. Пока работает юзайте.
Полезные ключики кажет на живом сайте.
Может выгружать много, но на больших объемах делайте выборки от и до.
P.s. Чел написал в комментах, что не работает, вот я и вспомнил что оно есть 😎. Обманул, все работает как часики. Зачем добру пропадать.
Правда там бы ещё сортировку по столбцам добавить, но ленюсь...
https://xstroy.com/parser-zaprosov-yandeks-vebmastera/
Когда-то встретил скрипт в Фейсбуке, но потом он сдох. Я его слегка декодировал и допилил по себя. Пока работает юзайте.
Полезные ключики кажет на живом сайте.
Может выгружать много, но на больших объемах делайте выборки от и до.
P.s. Чел написал в комментах, что не работает, вот я и вспомнил что оно есть 😎. Обманул, все работает как часики. Зачем добру пропадать.
Правда там бы ещё сортировку по столбцам добавить, но ленюсь...
👍3❤2🖕2
Forwarded from IT DED
Ну или если кто доры генерит вот по такому ману...
https://doorway.life/ru/dopolnitelniy-beliy-trafik-dlya-sayta
https://doorway.life/ru/dopolnitelniy-beliy-trafik-dlya-sayta
👍3❤1