ChatGPT, AI, Python для SEO - автоматизация
479 subscribers
65 photos
2 videos
50 links
Автоматизация с помощью python работы в seo.
Скрипты которые решают большинство вопросов в seo c исходным кодом.

Контакт https://t.me/devvver
Download Telegram
📈 Nginx Log Analyzer Ultimate: Интерактивный анализ логов, геолокация и детекция ботов на PHP

Браузерный анализатор логов access.log получил обновление.

🚀 Главные нововведения Ultimate-версии:

🌍 Автоматическая геолокация и флаги стран

Теперь флаги государств отображаются прямо в таблице IP-адресов и во всех детальных срезах. При просмотре карточки IP-адреса вы мгновенно получаете информацию о стране, диапазоне сети, ASN (провайдере) и домене.


 Специальная вкладка «🎃 Google Поисковые боты»

🔘 Выделенный раздел для детального мониторинга индексации вашего сайта.
🔘 PHP-скрипт в фоновом режиме запрашивает у Google актуальные списки IP-префиксов краулеров.
🔘 Автоматически разделяет обычных поисковых и специальных (Special) роботов Google.
🔘 Строит отдельный график активности ботов по часам.
🔘 Показывает таблицы IP-адресов роботов, их User-Agent и точное время заходов.
Если нужно больше ботов - справка.

⚡️  Сквозная навигация между отчетами

Все IP-адреса внутри модальных окон (например, при просмотре логов конкретной страницы или источника перехода) теперь снабжены флагами и стали кликабельными. Заметили подозрительный IP в логах URL? Один клик — и вы в его детальном профиле с геолокацией.


📂 Как начать работу?
Скачайте один файл index.php и загрузите его в любую папку на вашем хостинге.
Откройте страницу скрипта в браузере.
Перетащите в окно ваш файл access.log.

📂 Где взять файл лога?

Вариант 1: Через cPanel
В разделе «Метрики» выберите «Редактор необработанных журналов» (Raw Access Logs).
Кликните на нужный домен и скачайте архив .gz. Распакуйте его перед использованием.

Вариант 2: Через FTP/SFTP
Подключитесь к хостингу и поднимитесь на уровень выше папки public_html.
Зайдите в папку /logs — там лежат архивы логов по месяцам.
Скачайте файл вида yourdomain.com-Jun-2026.gz и распакуйте его.
(Если папка пуста, включите в cPanel галочку «Архивировать журналы в домашнем каталоге»)

💻 Скачать на GitHub: файл ai.php https://github.com/Devvver/Nginx-Log-Analyzer
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5👌1
🚀 Автоматизируем SEO-аудит: Интерактивный дашборд на Python + Screaming Frog CLI!

Это демо для тех кто не знал что Screaming Frog можно запускать в фоновом режиме и получать результаты в своей панельке.

🎯 Главные фичи и функционал:

Headless-краулинг в один клик: Дашборд автоматически находит Screaming Frog на вашем компьютере и запускает сканирование в фоновом режиме. Вы видите прогресс-бар прямо в браузере.

📋 Интерактивный чек-лист из 31 SEO-параметра: Мгновенный срез состояния сайта. Всё от битых ссылок (4xx/5xx) и цепочек редиректов до дубликатов мета-тегов, отсутствия микроразметки (Schema/OpenGraph) и медленных страниц.

🖱 Интерактивный UX (Клик-инфо): Хотите узнать, на каких страницах дублируются заголовки H1 или где не настроен Canonical? Просто кликните по нужной строке в общем чек-листе — и подробная таблица с проблемными URL сразу откроется прямо под ним!

🔗 Все адреса страниц в таблицах оформлены как активные гиперссылки. Кликайте и сразу проверяйте страницу в новой вкладке.

💾 История сканирований: Больше не нужно перекрауливать сайт заново! Дашборд кэширует результаты. Вы можете в любой момент переключиться на ранее просканированные домены через быстрый список.

📥 Авто-экспорт отчетов: Система автоматически генерирует детальные CSV-отчеты по каждой ошибке и собирает их в один аккуратный ZIP-архив для отправки клиенту или разработчикам.

Пример - просто демо работы с функционалом лягушки, дорабатывайте на его базе дальше код.

Скачать с Гитхаб
👍10🔥3🙈1🤝1
TripleTree · менеджер семантики

Однофайловый браузерный сервис управления семантическим ядром. Не требует установки и сервера: один HTML-файл, данные хранятся локально в браузере (автосохранение сессии), AI-функции работают через API Anthropic по собственному ключу пользователя. Автор скрипта.

Данные и импорт

• Импорт семантического ядра из XLSX (запрос, показы, WS, Score, роль, структура папок из колонки пути).
• Догрузка запросов в существующую сессию из второго файла: дедупликация по нормализованной форме (стеммер Snowball), корзина не воскрешается, новые запросы попадают в «Неразобранное».
• Автосохранение сессии в браузере; ручное сохранение/загрузка файла сессии.
• Отмена последних операций (Undo, до 80 шагов): перемещения, роли, структура, схлопывание, удаление.

Структура (дерево папок)

- Папки и подпапки без ограничения вложенности; перетаскивание запросов и папок мышью, палитра «Переместить в…».
Динамическая нумерация папок среди соседей уровня — ненавязчивая, пересчитывается при перестановке.
Цветовые метки папок (зелёный / жёлтый / красный / синий).
Красная метка = карантин: красное поддерево исключается из всех анализов, отчётов и листов экспорта; единственное место — лист «Запросы» с пометкой «КРАСНАЯ». В диалогах отбора чекбоксы красных подпапок по умолчанию сняты.
Теги статуса папки: ✓ готово / ⟳ в работе / ⚠️ проблема — цветные бейджи в дереве, переключаются в контекстном меню.
Метки Tier 1–3 — приоритет папки, три различимых цвета.
Технические разделители структуры: именованная строка-линия перед группой папок; перетаскивается, переименовывается, не участвует в анализах, экспорте и нумерации.
Схлопывание подпапок: все запросы поддерева собираются в папку, подпапки удаляются (с Undo).
• Удаление папки отправляет все её запросы в корзину.
• Корзина с восстановлением и очисткой; счётчики запросов и показов по каждой папке; URL папки с наследованием для вложенных.
• Поиск/фильтр по дереву.

Группировка кластера (AI, требует API-ключ Anthropic)

AI-аудит (чистка): выявление мусорных, нецелевых и дублирующих запросов.
Структура: создать и разложить: модель предлагает подпапки по интентам и раскладывает запросы; защита от групп-дублей (Жаккар покрытий) и микрогрупп.
Раскладка по подпапкам: классификация запросов по существующей структуре.
Разгруппировка по маркерам.
• После любой раскладки остаток корня автоматически уходит в подпапку «Нераспределенные» с красной меткой — сразу под карантином.

Таблица запросов

• Сортировки, фильтр по папке с исключающими токенами, «включая подпапки», выделения, массовые операции, копирование.
• Группы дублей (D-группы) по нормализованной форме.
• Плашки меток на запросах.
• Ручная установка/снятие вершины (хоткей V); глобальный прогон авто-вершин по всем папкам сессии (жёлтая подсветка спорных).

Правые панели (просмотр)

• Униграммы, Биграммы, Триграммы — частотный словарь области с весами.
• Хоткеи панелей: U

Экспорт XLSX

• Листы: Запросы (с пометкой красных), Структура (без красных и разделителей, с колонкой «Тег»), Униграммы / Биграммы / Триграммы, Корзина.
• Экспорт всей сессии или отдельной папки.

Интерфейс

Светлая и тёмная темы (переключатель ☾/☀️, уважение системной настройки).


Распространяется по лицензии CC0 "Работает как есть, можете переделывать как вам надо".
Ссылка на файлы.
8
🔍 Получаем AI overview и топ 10 выдачи бесплатно через API

Компактный PHP-скрипт для парсинга поисковой выдачи Google, который одновременно собирает классический топ 10 и  AI Overview .
🟣Обратите внимание что ответ зависит от языка и страны, поэтому выбирайте ваш регион правильно.

Провайдер API (Bright Data) предоставляет при регистрации бесплатный баланс, которого хватает примерно на 5000 тестовых запросов. Для получения доступа привязывать банковскую карту не требуется.


🟣Получите API-ключ на платформе Bright Data (в разделе SERP API) и вставьте в сам скрипт (177 строка $apiKey)

Это демо, можете по аналогии встроить себе в панельку или доработать мой.

Исходный код (скопируйте код, создайте php файл, добавьте API ключ и залейте на хостинг)
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🔥3
Forwarded from SEO-специалист
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
🔍 Быстрый чек обратных ссылок: без сторонних библиотек и сложных скриптов

При линкбилдинге часто собираются огромные таблицы с обещанными размещениями. Но как узнать, какие из них действительно работают и не удалены, а не затерялись при публикации?

Для этого есть лёгкий утилитарный инструмент — backlink-finder.
Он сканирует список донорских страниц и показывает, какие из них реально ссылаются на ваши домены, собирая анкоры и атрибуты ссылок.

⚙️ Главные фишки:
Только стандартная библиотека:
Работает на чистом Python 3.9+ без единой внешней зависимости (pip install не потребуется).

Сбор параметров: Вытягивает не только факт наличия ссылки, но и anchor_text, атрибут rel (проверяет на nofollow, sponsored, ugc), а также итоговый URL.

Умный парсинг: Автоматически учитывает поддомены (например, mysite.com найдет и ссылки на blog.mysite.com), обрабатывает редиректы, <base href> и различные кодировки страниц.

Удобный вывод: Результаты выгружаются в CSV-файл, а сводный отчёт выводится прямо в терминал.

🚀 Быстрый старт:
Клонируем репозиторий:

git clone https://github.com/izzipizzy/backlink-finder.git
cd backlink-finder


Создаем файл urls.txt со списком страниц для проверки (по одной на строку) и запускаем сканирование:
python3 backlink_finder.py urls.txt --domains mysite.com --out found.csv

💡 Подсказка: Если доменов много, их можно вынести в отдельный файл domains.txt — скрипт подтянет его автоматически.
👍2🔥1
Гуглоиды подтвердили внедрение маскировки урлов в серпе через редирект на google.com/goto.

В чем суть проблемы? Я так понимаю это результат борьбы с парсерами. Теперь если не перейти по ссылке goto - вы не узнаете url страницы. И наверное с попытками перехода Гугл тоже будет бороться, показывая капчу, иначе зачем все это.

Что это значит для seo оптимизаторов? Если раньше скраперы накручивали показы, сканируя топы, то сейчас может оказаться что крутиться будут и переходы, так как чтобы узнать юрл парсеру нужно перейти по goto.
Готовьтесь к кликам по запросам от ботов.


Второе что интересное - не поломается ли работа ботов ChatGPT и других, которые частично использовали поиск в Google для выдачи ответа. Я надеюсь что они договорятся, потому что иначе может поломаться вся логика и останется только Bing и внутренний RAG поиск.

обновление 29.08.2026: найдены первые ссылки с goto в ChatGPT
https://x.com/metehan777/status/2093433841616617814

Невозможность предпросмотра ссылки: Раньше пользователь мог навести курсор на ссылку в поисковой выдаче (SERP) и в левом нижнем углу браузера увидеть реальный адрес сайта, куда он перейдет.
Я лично довольно часто юзал такой предпросмотр и для как пользователя это потеря.
🤔1
Как ИИ-системы выбирают источники? Разбор 500 реальных цитат в ChatGPT, Perplexity и Google AI Overviews.

Команда RankAI проанализировала выборку из 500 цитирований и сопоставила данные с крупнейшими исследованиями рынка (Ahrefs на 4 млн URL и Profound на 680 млн цитат).

Собрали главные инсайды и тренды GEO (Generative Engine Optimization):

1. Топ-10 Google больше не гарантирует попадание в ИИ

Лишь 38% ссылок из Google AI Overviews входят в органический Top-10 Google (семь месяцев назад этот показатель составлял 76%).
ИИ-системы используют алгоритмы мульти-поиска (fan-out queries) и собирают ответы по всей глубине выдачи.

2. У каждой платформы свои фавориты

ChatGPT чаще всего цитирует Википедию и крупные справочные ресурсы.
Perplexity отдаёт явное предпочтение Reddit и форумным обсуждениям.
Google AI Overviews распределяет ссылки равномернее и чаще других использует видео с YouTube.

3. Правило «Первой трети»

Около 44% всех цитат берутся из первых 30% объема страницы. Читатели и алгоритмы одинаково ценят прямой ответ в самом начале.

• Начало страницы (0–30%): ~44% цитирований
• Середина (30–70%): ~31% цитирований
• Конец (70–100%): ~25% цитирований


4. Формат имеет решающее значение

Нейросети чаще всего забирают данные из:
• Сравнительных таблиц
• Четко размеченных FAQ-блоков
• Коротких блоков с определениями вверху страницы
Длинные нарративные тексты цитируются значительно реже.

5. Независимость важнее бренд-контента

При сравнении продуктов ИИ почти всегда ссылается на сторонние обзоры и независимые площадки, а не на официальные страницы брендов.

6. Миф о Schema-разметке

Исследования показали: добавление микроразметки на уже цитируемые страницы не даёт прироста в количестве упоминаний. Разметка помогает алгоритмам распарсить страницу, но сам факт её наличия не является фактором ранжирования для ИИ.